Je vais construire un SaaS AI avec rag, embeddings et recherche vectorielle


À propos de ce service
Traduction automatique
La plupart des gigs en IA vous vendent une simple enveloppe autour d'une clé API. C'est un produit : vos propres données, votre propre récupération, votre propre application.
Je construis toute la pile. Documents en entrée, embeddings et un index vectoriel derrière, récupération qui retourne des sources, et une vraie application web sur laquelle vos clients se connectent.
CE QUE VOUS OBTENEZ
Ingestion pour PDFs, documents, sites, Notion ou votre base de données
Découpage, embeddings et un index vectoriel optimisé
Réponses avec citations, pour que les utilisateurs puissent vérifier la source
Interface de chat en streaming, authentification et téléchargement de documents
Évaluations pour prouver la qualité plutôt que de deviner
Contrôles de coût et de tokens, plus limitation de débit
TypeScript propre, documenté, déployé et à vous
STACK
Next.js, Node, TypeScript, pgvector, Pinecone, Qdrant, LangChain, les APIs Claude et OpenAI, Postgres, Stripe et Vercel
J'ai 65 avis cinq étoiles et je construis en full stack, donc la partie IA est réellement intégrée dans un produit fonctionnel plutôt que dans un simple notebook.
Dites-moi quelles données vous souhaitez qu'il utilise pour répondre, et je vous dirai si RAG est même la bonne solution pour vous.
Découvrez Abhinay Pandey
Professionally Personal
- DeInde
- Membre depuisaoût 2017
- Dernière commande8 mois
Langues
Anglais, Hindi
Traduction automatique
Mon portfolio
Autres services de Développement IA I Offre
FAQ
Traduction automatique
En quoi cela diffère-t-il d’un wrapper ChatGPT ?
Un wrapper envoie votre question directement à une API. Celle-ci récupère d'abord dans votre propre contenu, pour que les réponses soient basées sur vos données et citent leurs sources. C'est la différence entre une démo et quelque chose que vous pouvez présenter à vos clients.
Quel modèle et quelle base de données vectorielle utilisez-vous ?
Tout ce qui correspond à la taille de vos données, votre budget et vos besoins en confidentialité. Généralement Claude ou OpenAI avec pgvector si vous utilisez déjà Postgres, ou Pinecone et Qdrant à plus grande échelle. Je vous expliquerai les compromis avant de commencer, pas après.
Qui paie les coûts de l'API et de l'hébergement ?
Vous, sur vos propres comptes, pour ne pas dépendre de moi par la suite. J'intègre la mise en cache, les limites de tokens et la limitation de débit pour que votre facture reste prévisible, et je vous donnerai une estimation de votre coût mensuel avant de commencer.
