Je vais construire des pipelines RAG et des systèmes backend alimentés par l'IA

M
mathan_teqbahn
M
mathan_teqbahn
Mathan K
Certaines informations ont été traduites automatiquement.

À propos de ce service

Traduction automatique

Ingénieur Backend IA | Pipelines RAG · Intégration LLM · Systèmes agentiques


Je suis un ingénieur logiciel senior avec plus de 12 ans d'expérience dans la création de systèmes IA en production. Je suis l'architecte unique de Teqit, une plateforme d'entreprise en direct avec des pipelines RAG, une inférence LLM sur site et des microservices agentiques servant plus de 10 clients.


Ce que je construis pour vous :

- Pipelines RAG ingestion de documents, recherche vectorielle, génération de réponses LLM

- Intégration API LLM OpenAI, Claude, Gemini ou tout modèle hébergé

- Inférence LLM locale avec Ollama / llama.cpp (réduction des coûts IA d'environ 70%)

- Outils de workflows agentiques appel de outils, raisonnement multi-étapes, pipelines de décision

- Backends FastAPI ou Scala via REST ou gRPC

- Routage hybride commutation intelligente entre modèles locaux et cloud


Pourquoi moi ?

J'ai réalisé cela en production réelle, pas en tutoriels. J'ai réduit les coûts IA de 70 % avec l'inférence locale, créé des pipelines vidéo génératifs pour avatars, et conçu des agents qui raisonnent de manière indépendante sur des bases de connaissances d'entreprise.


Tech : Python · FastAPI · Ollama · API OpenAI · Akka/Scala · Docker · AWS


Contactez-moi avant de commander, je vais d'abord examiner votre cas d'utilisation.

Découvrez Mathan K

Mathan K

Senior AI and Backend Engineer

  • DeInde
  • Membre depuissept. 2026
  • Temps de réponse moy.1 heure
  • Langues

    Anglais
Senior Software Engineer with 12+ years building production AI systems, distributed backends, and cross-platform mobile apps. I'm the sole architect of Teqit — a live multi-tenant enterprise platform with RAG pipelines, on-premise LLM inference (Ollama), and agentic microservices serving 10+ enterprise clients. I build RAG pipelines, LLM integrations, agentic workflows, and FastAPI/Scala backends — cutting AI costs ~70% with local inference. I review every project personally before starting. Message me first.

Traduction automatique