Je déploierai votre modèle d'IA avancé sur un GPU sans serveur à coût réduit

K
kstrdevelopment
K
kstrdevelopment
Ismael
Certaines informations ont été traduites automatiquement.

À propos de ce service

Traduction automatique

Je conçois et optimise des backends d'inférence AI pour des applications nécessitant une véritable puissance de calcul GPU, pas seulement une interface autour de l'API ChatGPT.

J'ai déployé et optimisé des pipelines AI en production (traitement d'images/vidéos, modèles génératifs de style face-swap) sur l'infrastructure GPU sans serveur de Modal, notamment :

- Configuration des instances GPU/CPU (L4/T4) ajustée pour l'équilibre entre coût et latence

- Optimisation du cold-start et du warmup pour réduire le temps de GPU gaspillé

- Capture d'instantanés de la mémoire GPU pour diminuer le temps de cold-start

- Optimisation des pipelines : réduction d'environ 75 % du temps de traitement sur une charge de travail en production

- Gestion des signaux et corrections de fiabilité pour les tâches d'inférence longues

Découvrez Ismael

Ismael

Mobile App Developer

  • DeEspagne
  • Membre depuisaoût 2026
  • Temps de réponse moy.1 heure
  • Langues

    Espagnol, Anglais
Software engineer specializing in cross-platform mobile development and cloud backend integration. I design, build, and deploy production-ready mobile applications using Flutter, backed by scalable serverless architectures.

Traduction automatique