Je vais optimiser et accélérer votre modèle d'IA avec onnx et tensorrt

R
riticpathania
R
riticpathania
Ricky
Certaines informations ont été traduites automatiquement.

À propos de ce service

Traduction automatique

Votre modèle d'IA est précis mais trop lent pour une utilisation en conditions réelles ?


J'optimise les pipelines d'inférence en apprentissage automatique et vision par ordinateur pour réduire la latence, améliorer le débit et simplifier le déploiement sur GPU NVIDIA, appareils edge, API et systèmes de production.


Je peux vous aider avec :


Profilage de modèles PyTorch et analyse des goulets d'étranglement en inference

Exportation de PyTorch vers ONNX

Optimisation avec ONNX Runtime

Conversion en moteur NVIDIA TensorRT

Optimisation FP16 et INT8 lorsque supporté

Benchmarking de latence, débit et FPS

Validation des sorties par rapport au modèle original

Optimisation du prétraitement et post-traitement

Gestion dynamique des entrées et des tailles de lot

Environnements d'inférence Dockerisés

Intégration de la modélisation avec FastAPI

Flux de travail de déploiement sur NVIDIA Jetson / GPU

Optimisation de l'inférence YOLO et vision par ordinateur


Mon objectif n'est pas simplement de convertir un format de fichier. Je vérifie que le modèle optimisé produit toujours des sorties correctes et je mesure l'amélioration réelle des performances.


Les livrables typiques peuvent inclure :

Fichiers de modèle / moteur optimisés

Scripts d'inférence Python

Résultats de benchmarks avant/après

Résultats de validation des sorties

Instructions d'installation


Veuillez me contacter avant de passer commande.

Découvrez Ricky

Ricky

High Performance Python and AI Engineer, APIs, Vision, Optimization

4,9(6)
  • DeInde
  • Membre depuisjuil. 2023
  • Dernière commande2 semaines
  • Langues

    Hindi, Anglais
I'm a Python and AI engineer focused on performance and production machine learning. I help clients solve technical problems such as slow Python/Pandas code, broken or incomplete FastAPI backends, custom YOLO computer-vision pipelines, and slow AI inference workflows. My work includes: - Python, Pandas, NumPy, Cython and C/C++ performance optimization - FastAPI and Flask backend development and debugging - REST APIs, databases, Docker and production deployment - YOLO object detection, tracking and computer-vision pipelines - PyTorch, ONNX and TensorRT inference optimization

Traduction automatique

Mon portfolio