Je vais concevoir la reconnaissance faciale, la reconnaissance de gestes de la main et la reconnaissance vocale ou de la parole
Vision par ordinateur, développeur IA, spécialiste en automatisation BIM
Niveau 1
Répond à certains critères de performance et présente un fort potentiel sur la place de marché.
À propos de ce service
Vous avez besoin d’un système d’IA capable de reconnaître des visages, de comprendre des signes de la main ou de traiter la voix et les sons en temps réel ?
Je crée des systèmes de reconnaissance multimodaux d’IA personnalisés qui combinent la vision par ordinateur et le traitement audio en fonction de votre application spécifique.
Selon vos besoins, je peux développer :
- Détection, identification et vérification de visages
- Reconnaissance de gestes et de signes de la main
- Reconnaissance de la langue des signes
- Analyse des points de repère de la main et des doigts
- Reconnaissance de la parole et de la voix
- Reconnaissance d’événements sonores personnalisés
- Traitement en temps réel de la caméra et du microphone
- APIs de reconnaissance et intégration d’applications
Votre système peut traiter l’entrée de la webcam ou de la vidéo ainsi que l’entrée microphone/ audio et renvoyer des résultats de reconnaissance, des classifications, des événements, des coordonnées, des scores de confiance ou d’autres sorties nécessaires à votre application.
Pour la vision par ordinateur, je peux utiliser des technologies telles que Python, OpenCV, MediaPipe, YOLO, PyTorch, TensorFlow, ONNX Runtime, InsightFace et frameworks associés.
Cela peut être utilisé pour des applications interactives, des outils d’accessibilité, des interfaces intelligentes, des systèmes de sécurité, des projets de langue des signes.

