Je vais déployer des LLM auto-hébergés, rag, ollama, vllm, agents IA sur vps ou serveur gpu

Certaines informations ont été traduites automatiquement.
5,0
5,0

Pakistan

Je parle Ourdou, Anglais

907 commandes terminées

Ingénieur AIOps et Linux DevOps

671 avis 5 étoiles. Plus de 900 commandes. 10 ans sur Fiverr, et 13 ans dans l'infrastructure de production. Je maintiens les serveurs Linux rapides, stables et sécurisés, et je déploie de l'AI auto-...

Niveau 1

Répond à certains critères de performance et présente un fort potentiel sur la place de marché.

À propos de ce service

671 avis cinq étoiles · plus de 600 commandes · 13+ années dans l'infrastructure de production


Je déploie des LLMs open-source et des systèmes d’IA sur vos propres serveurs, pour que vous n’ayez plus à payer par token et que vos données restent en interne.


Ce que je déploie

  • Ollama, vLLM, llama.cpp, OpenWebUI
  • Llama, Mistral, Qwen, DeepSeek, Gemma
  • RAG avec Qdrant, Chroma, Weaviate, pgvector
  • Agents IA via n8n, LangChain, LlamaIndex


Où je le déploie

  • Votre VPS : Hetzner, DigitalOcean, Contabo, OVH
  • Serveurs GPU et bare metal : A100, L40S, RTX 4090
  • AWS, GCP, Azure, RunPod
  • Installations sur site et en réseau isolé


Comment ça fonctionne

  1. Vous envoyez les spécifications de votre serveur et le modèle souhaité
  2. Je confirme ce que votre matériel peut réellement supporter
  3. Je déploie, ajuste et documente le tout


Ce que vous obtenez

  • Déploiement avec Docker ou systemd, reproductible
  • Reverse proxy Nginx avec SSL et authentification API
  • Ajustement du GPU et de la VRAM pour que le modèle fonctionne rapidement
  • Surveillance, journalisation et redémarrage automatique en cas de problème
  • Documentation de transfert écrite


Références

  • Organisation du prix Nobel, Starbucks, T-Mobile, Beasley Media
  • Plateformes servant 45 000 utilisateurs simultanés à 40 Gbps


Contactez-moi avant de commander, je vous dirai honnêtement si votre matériel peut le supporter.

Outils:

Kubernetes

Docker

Amazon EKS

Moteur Google Kubernetes

Frameworks:

Terraform

Ansible

Marionnette

Fournisseur de services cloud:

Amazon Web Services

Langage de programmation:

Bash

Python

Expertise:

Installation

Migration

Débogage

Mon portfolio

Avis

2 avis concernant ce service
5,0

(2)
(0)
(0)
(0)
(0)
Détails de la notation
  • Niveau de communication avec le freelance
    5
  • Qualité de la livraison
    5
  • Valeur de la livraison
    5
Trier par
Les plus pertinents
  • L

    lara_chad2

    GB

    Royaume-Uni

    5

    Excellent service! The deployment was completed quickly and professionally. The seller understood the issue, handled the Dockerized Python AI application deployment smoothly, and kept me updated throughout the process. Everything is working as expected. Highly recommended!

    50 $US

    Prix

    1 jour

    Durée

    Utile?
    Oui
    Non
  • D

    drezin

    US

    États-Unis

    Collaboration en cours
    5

    Shazeb was great in understanding the problem and working to fix It. would recommend.

    100 $US-200 $US

    Prix

    2 jours

    Durée

    Utile?
    Oui
    Non
Avis

2 avis concernant ce service
5,0

(2)
(0)
(0)
(0)
(0)
Détails de la notation
  • Niveau de communication avec le freelance
    5
  • Qualité de la livraison
    5
  • Valeur de la livraison
    5
Trier par
Les plus pertinents
  • L

    lara_chad2

    GB

    Royaume-Uni

    5

    Excellent service! The deployment was completed quickly and professionally. The seller understood the issue, handled the Dockerized Python AI application deployment smoothly, and kept me updated throughout the process. Everything is working as expected. Highly recommended!

    50 $US

    Prix

    1 jour

    Durée

    Utile?
    Oui
    Non
  • D

    drezin

    US

    États-Unis

    Collaboration en cours
    5

    Shazeb was great in understanding the problem and working to fix It. would recommend.

    100 $US-200 $US

    Prix

    2 jours

    Durée

    Utile?
    Oui
    Non