Je vais configurer des agents AI Claude code sur votre VPS avec Docker
Ingénieur DevOps senior, expert en sécurité réseau et Linux
À propos de ce service
Je gère des flottes Linux en production depuis des années. La mise en place d'agents AI ne se limite pas à "docker run", il s'agit de faire en sorte qu'ils survivent aux redémarrages, gèrent les crashs, restent sécurisés et ne font pas exploser votre facture GPU.
Ce que vous obtenez :
Agent dockerisé Claude Code, OpenHands, AutoGen ou votre agent personnalisé en Python/TypeScript, build multi-étapes, non-root, vérifications de santé
Service systemd Démarre au boot, redémarre en cas de crash, limites de ressources (CPU/RAM/GPU), rotation des logs via journald
Reverse proxy Nginx TLS (Let's Encrypt auto-renouvelé), support WebSocket pour le streaming, limitation de débit, option authentification de base
File d'attente Redis File de jobs avec priorité, retries/exponentiel backoff, gestion des dead-letter (Standard/Premium)
Observabilité Loki + Promtail pour les logs, métriques Prometheus (profondeur de la file, latence, utilisation des tokens), tableau de bord Grafana
Vector DB Qdrant/Weaviate pour agents RAG, volume persistant, backup cron (Premium)
Contrôle des coûts Alerte de dépense quotidienne (Discord/Slack/Email), arrêt automatique en cas de dépassement de budget (Premium)
Runbook Architecture, guide de mise à l’échelle, dépannage "agent bloqué ?", procédure de rotation des credentials
Stack que j’utilise quotidiennement : Docker, Nginx, systemd, Redis, Loki/Prometheus/Grafana, Qdrant, NVIDIA Container Toolkit, API RunPod/Vast.ai/Lambda, Linux
Mon portfolio
Autres services de Ingénierie DevOps I Offre
FAQ
Traduction automatique
Quels agents supportez-vous ?
Claude Code, OpenHands, AutoGen, CrewAI, LangGraph, agents Python/Node personnalisés. Tout agent conteneurisable fonctionne. Envoyez-moi votre repo — je confirmerai la compatibilité.
Comment gérez-vous les clés API / secrets ?
Jamais dans l’image ou le compose. Options : 1) HashiCorp Vault, 2) CLI 1Password, 3) fichiers cryptés SOPS/age, 4) secrets Docker (swarm), 5) Environnements GitHub (CI/CD). Nous choisirons ce qui convient à votre workflow.
Pouvez-vous optimiser les coûts GPU ?
Seulement Premium : alertes de dépense quotidienne (Slack/Discord/Email), arrêt automatique des agents inactifs, fallback sur spot instance (RunPod/Vast.ai), suivi de l’utilisation des tokens par agent. Économies typiques : 40-60 % par rapport à une configuration toujours active.

