Je déploierai une IA privée auto-hébergée sur votre serveur avec ollama et open webui


À propos de ce service
Traduction automatique
Votre équipe souhaite une IA de style ChatGPT. Votre politique de conformité stipule que les données clients ne doivent pas quitter votre contrôle. Ce service résout ces deux problèmes.
Je déploie une pile d’IA privée — Ollama + Open WebUI — sur votre serveur ou VPS. Les prompts, l’historique de chat et les documents ne touchent jamais un cloud tiers. Conçu pour les secteurs juridique, médical, ou toute entreprise avec une politique d’IA sans cloud.
Chaque niveau inclut :
- Déploiement Docker en production avec proxy inverse HTTPS
- 2-3 modèles ouverts sélectionnés et ajustés à votre matériel
- Guide d’administration écrit : mises à jour, sauvegardes, gestion des utilisateurs
- Vous possédez tout : configurations, code, identifiants d’administration
- Communication directe basée aux États-Unis
Le niveau standard inclut RAG — votre IA répond à partir de vos propres documents — ainsi que l’accès sécurisé Tailscale pour votre équipe. Le niveau premium ajoute une API compatible OpenAI (LiteLLM), des comptes utilisateurs, un appel de transfert, et 14 jours de support.
À propos de moi : B.Sc. en génie électrique, dix ans dans l’industrie des semi-conducteurs. Je gère cette pile en production 24/7 sur une infrastructure que j’ai construite et que je maintiens — LLM auto-hébergés, services Docker, réseau VPN en maillage, journalisation SIEM.
Je ne suis pas la prestation la moins chère ici. Je suis celui qui documente le travail et vous remet les clés.
Découvrez Michael B
AI Automation Engineer, Private LLMs, Alerting, Network Security
- DeÉtats-Unis
- Membre depuisjanv. 2026
- Temps de réponse moy.1 heure
Langues
Anglais
Traduction automatique
Autres services de Développement IA I Offre
FAQ
Traduction automatique
Pourquoi devrions-nous vous faire confiance pour l’accès admin lors de la configuration ?
Je peux travailler en partage d’écran pour que vous voyiez chaque étape. Vous fournissez des identifiants temporaires et changez tout lors du transfert ; la documentation montre précisément ce qui fonctionne où. Tout logiciel est open source et rien ne téléphone chez moi. NDA sur demande — je peux aussi vous présenter ma propre instance en direct avant votre commande.
Y a-t-il des coûts API ou de licence récurrents après la livraison ?
Non. Ollama, Open WebUI, et LiteLLM sont open source, et les modèles tournent sur votre propre matériel. Il n’y a pas de frais par token ni d’abonnements — votre seul coût récurrent est le serveur lui-même (énergie ou location VPS).
Que dois-je fournir ?
Un serveur Linux ou VPS (je peux en recommander un adapté à votre budget), une méthode pour me donner accès (clé SSH ou identifiants temporaires), et un nom de domaine si vous souhaitez HTTPS sur une adresse publique. Pour RAG standard/premium, les documents que vous souhaitez que l’IA connaisse.
Quel matériel cela nécessite-t-il ?
Open WebUI fonctionne presque partout ; la vitesse du modèle dépend de la RAM et du GPU. Un CPU moderne avec 16 Go de RAM gère bien les petits modèles ; un GPU accélère les modèles plus grands. Envoyez-moi vos spécifications (ou budget) avant de commander, et je vous dirai honnêtement quelles performances attendre.
Que se passe-t-il après la livraison ?
Chaque niveau inclut un guide d’administration écrit couvrant mises à jour, sauvegardes et gestion des utilisateurs. Le niveau premium comprend un appel de transfert en direct et 14 jours de support. La maintenance continue ou les mises à jour ultérieures — nouveaux modèles, plus d’utilisateurs, intégrations API — sont disponibles en offres personnalisées.
Ce sera aussi performant que ChatGPT ?
Pour la rédaction, le résumé et la Q&A sur vos propres documents, les modèles ouverts actuels (Llama, Qwen, Mistral) font un excellent travail. Les modèles cloud de frontier restent plus performants pour le raisonnement complexe — le compromis que vous achetez est la confidentialité totale des données. Je recommande honnêtement les modèles en fonction de votre cas d’usage.
