Je vais concevoir des modèles spécialisés tiny gpt bert pour appareils en edge


À propos de ce service
Traduction automatique
Vous avez besoin d’une IA qui fonctionne localement sans API cloud, accès internet ou serveur externe ?
Je conçois et implémente des modèles d’IA de style transformer spécifiques à la tâche pour des plateformes embarquées à ressources limitées, en utilisant des opérations vectorielles, matricielles et tensorielle classiques.
Selon la tâche ciblée, je peux développer des architectures légères telles que :
- des architectures de style GPT pour la génération de texte ou la prédiction de séquences
- des architectures de style BERT pour la classification, les embeddings et l’extraction de caractéristiques
- des architectures encodeur-décodeur pour des tâches spécifiques de séquence à séquence
- des modèles basés sur l’attention optimisés pour l’inférence embarquée
- des modèles quantifiés et optimisés pour la mémoire pour MCUs 32 bits
- des architectures d’inférence multi-MCU ou en cluster de MCUs
Les plateformes cibles peuvent inclure ESP32-S3, STM32, autres MCUs 32 bits, en fonction de la RAM, Flash, PSRAM disponibles et des exigences spécifiques.
L’objectif est une IA en edge totalement hors ligne : l’inférence s’effectue directement sur votre appareil, sans dépendre des API d’OpenAI, des serveurs cloud ou d’une connexion internet continue.
Important : Il s’agit de systèmes d’IA embarqués spécifiques à une application, et non de remplacements complets de ChatGPT. Veuillez me contacter avant de commander afin que je puisse évaluer vos ressources MCU, votre dataset, vos besoins en modèle et la tâche cible.
Découvrez Saikat M
Embedded ML
- DeInde
- Membre depuisjuin 2026
- Temps de réponse moy.1 heure
Langues
Bengali, Anglais, Hindi
Traduction automatique

