Je vais réparer votre setup Ollama, ComfyUI ou AI local sur Linux ou Windows

T
taralyne84
T
taralyne84
Tara Lyne
Certaines informations ont été traduites automatiquement.

À propos de ce service

Traduction automatique

Votre modèle se charge mais ne renvoie rien. Ou il tourne à 2 tokens par seconde sur un GPU qui devrait en faire quarante. Ou il dépasse la mémoire lors d’un modèle qui devrait tenir. Je règle précisément cela.


Je gère une stack AI locale complète sur un seul 3090 — Ollama, ComfyUI, formation LoRA, modèles vocaux, pipelines automatisés. J’ai rencontré chacun de ces échecs sur mon propre matériel et j’ai compris pourquoi.


Ce que je répare :

  • Réponses vides des modèles de raisonnement. Les tokens de raisonnement consomment tout votre budget de num_predict, donc il ne renvoie rien avec done_reason "length". On dirait un modèle cassé. Ce n’est pas le cas.
  • Le déchargement partiel du CPU qui détruit silencieusement votre vitesse
  • La taille du contexte qui surcharge votre VRAM (le cache KV évolue avec le contexte)
  • Les modèles qui se rechargent à chaque requête parce que keep-alive est toujours par défaut
  • Les workflows ComfyUI qui échouent à cause d’un nœud personnalisé manquant ou d’un modèle dans le mauvais dossier
  • Les incompatibilités CUDA, driver et container sur Linux
  • Le choix du bon modèle et de la quantification selon la VRAM dont vous disposez réellement

Contactez-moi d’abord avec ce qui se passe, votre OS, GPU et VRAM. Je vous dirai honnêtement si je peux le réparer avant que vous passiez commande. Si je ne peux pas, je vous le dirai plutôt que de prendre votre argent.


Je crée et vends mes propres outils AI locaux, donc ce n’est pas de la théorie.

Découvrez Tara Lyne

Tara Lyne

AI Automation and LLM Integration Developer

  • DeÉtats-Unis
  • Membre depuisfévr. 2026
  • Langues

    Anglais
I build AI systems that actually work — not demos, production systems. I run a 5-node AI cluster 24/7 with local LLMs, RAG pipelines, and autonomous agents. I deliver Python automation, FastAPI backends, LLM integration, Flutter mobile apps, and web scraping solutions. Fast delivery. Clean code. Real results.

Traduction automatique

Autres services de Développement IA I Offre