Notre agence déploiera une IA auto-hébergée avec open webui et rag


Agence
À propos de ce service
Traduction automatique
Vous avez besoin d’un assistant IA qui fonctionne sur votre propre infrastructure, avec vos propres documents ?
WZ-IT déploie des stacks LLM et RAG auto-hébergés pour les entreprises qui ne peuvent pas envoyer leurs données internes à une API américaine. Open WebUI comme interface, LiteLLM comme passerelle, Qdrant ou pgvector pour la recherche, Langfuse pour le traçage et le contrôle des coûts.
Selon la portée, nous couvrons :
- Open WebUI avec SSO, groupes d’utilisateurs et accès aux modèles par équipe
- Passerelle LiteLLM : une API pour modèles locaux et externes, budgets par équipe
- inférence vLLM ou Ollama, adaptée à votre budget GPU ou CPU
- pipeline RAG : ingestion, découpage, embeddings, Qdrant ou pgvector
- recherche avec permissions pour que les utilisateurs ne voient que les documents qu’ils sont autorisés à voir
- Langfuse pour le traçage, l’évaluation et le suivi des coûts par équipe
- déploiement sur votre serveur GPU, cloud européen ou sur site
La partie difficile n’est pas la fenêtre de chat. C’est faire en sorte que la recherche respecte déjà vos permissions, et connaître le coût réel mensuel.
Commencez par une consultation : une heure avec les deux fondateurs de WZ-IT, accompagnée d’une recommandation écrite que vous gardez dans tous les cas. Tout projet plus important est proposé sous forme d’offre personnalisée, adaptée à vos besoins réels.
Plus de nos réalisations : wz-it.com
À propos de cette agence

Agence
3 employés
- DeAllemagne
- Membre depuisoct. 2019
- Temps de réponse moy.1 heure
- Dernière commande1 an
Langues
Allemand, Anglais, Néerlandais
Traduction automatique
Portfolio
FAQ
Traduction automatique
Quel modèle devrions-nous utiliser ?
Cela dépend de la tâche, de la langue et du matériel. Les petits modèles open-weight gèrent la plupart des assistants internes ; un modèle de 70 milliards de paramètres nécessite un budget GPU conséquent. Nous l’adaptons à votre cas d’usage.
RAG respecte-t-il nos permissions existantes ?
Seulement si c’est conçu ainsi. Le filtrage doit se faire avant la recherche vectorielle, pas en demandant au modèle de se comporter. C’est le cœur du package RAG Platform.
Avons-nous besoin d’un GPU ?
Pas toujours. Les petits modèles et l’inférence CPU sont possibles à faible concurrence. Nous vous indiquons dans quel cas vous vous trouvez avant d’acheter du matériel.
Pouvez-vous le connecter à Nextcloud ou à un partage de fichiers ?
Oui, en tant que source de documents dans le pipeline d’ingestion, y compris la cartographie des permissions.
4 avis concernant ce service
| (4) | ||
| (0) | ||
| (0) | ||
| (0) | ||
| (0) |
Détails de la notation
- Niveau de communication avec le freelance
- À recommander à un ami
- Service conforme à la description
Trier par
P pawelpavlo

Allemagne
Very well and quickly executed order :) I recommend !!!
Utile?D dnlnrx
Client récurrent

Allemagne
Exzellente Arbeit. 1A Kommunikation.
Utile?S sbroderman

Suède
Perfect delivery!
Utile?S 
sangeorgean2
Client récurrent

Allemagne
Super, thank you!
Utile?
4 avis concernant ce service
| (4) | ||
| (0) | ||
| (0) | ||
| (0) | ||
| (0) |
Détails de la notation
- Niveau de communication avec le freelance
- À recommander à un ami
- Service conforme à la description
Trier par
P pawelpavlo

Allemagne
Very well and quickly executed order :) I recommend !!!
Utile?D dnlnrx
Client récurrent

Allemagne
Exzellente Arbeit. 1A Kommunikation.
Utile?S sbroderman

Suède
Perfect delivery!
Utile?S 
sangeorgean2
Client récurrent

Allemagne
Super, thank you!
Utile?
