Je vais déployer comfyui en tant qu'API serverless évolutive sur runpod

A
avivk5498
A
avivk5498
Aviv K.
Certaines informations ont été traduites automatiquement.

À propos de ce service

Traduction automatique

Votre workflow ComfyUI fonctionne localement. Maintenant, vous souhaitez qu'il se comporte comme un produit.

Je vais déployer votre workflow existant d'image ou de vidéo sur Runpod en tant qu'API de production que votre application pourra appeler.


Ce n'est pas simplement une configuration de pod basique. Je construis l'infrastructure backend nécessaire pour exécuter l'inférence GPU de manière fiable, sécurisée et à grande échelle.


Selon votre package, le système peut inclure :

  • Déploiement ComfyUI en Docker
  • API authentifiée avec des entrées de workflow dynamiques
  • Exécution en file d'attente et autoscaling des travailleurs GPU
  • Stockage privé des résultats et webhooks
  • Reprises, délais d'attente, journaux et surveillance
  • Optimisation du coût du démarrage à froid, de la VRAM et du GPU
  • Code source, documentation API et transfert technique


Je travaille avec les workflows Wan, LTX, MiniMax, Qwen, Z-Image, Krea, Flux et Stable Diffusion.

Un backend Runpod que j'ai construit a traité plus de 45 000 tâches avec un taux de disponibilité de 99,9 % tout en réduisant les coûts GPU d'environ 60 %.

Avant de commander, envoyez-moi votre JSON de workflow, les modèles requis, le trafic attendu et les entrées API. Je confirmerai le package approprié et identifierai les modifications nécessaires du workflow avant le déploiement.

Découvrez Aviv K.

Aviv K.

Senior AI Engineer, Runpod and ComfyUI, Solutions Architect

  • DeIsraël
  • Membre depuisaoût 2026
  • Langues

    Anglais, Hébreu
I'm a senior software engineer and solutions architect who turns AI ideas into systems teams can run. I design and build governed AI agents, AWS serverless workflows, Runpod and ComfyUI backends, image and video APIs, and LoRA training pipelines. Before specializing in AI, I handled more than 250 production incidents. One generation backend I built processed 45,000+ jobs at 99.9% uptime while reducing GPU costs by about 60%. I work from diagnosis and architecture through deployment, monitoring, and handoff. If you need technical direction and an engineer who can build the system, let's talk.

Traduction automatique

Mon portfolio