Je vais concevoir une IA de speech to text en arabe avec un modèle fine-tuned
Ingénieur IA
À propos de ce service
Vous avez besoin de transformer automatiquement un audio arabe en texte ? Je crée des pipelines speech-to-text en utilisant Whisper, le modèle de reconnaissance vocale open-source, configuré pour transcrire vos enregistrements arabes en texte clair et sous-titres SRT synchronisés.
J’ai ajusté Whisper sur 25 000 échantillons de discours en arabe, réduisant son taux d’erreur de mot de 44,5 % à 25,7 %, et j’ai développé un système complet qui transcrit, résume et recherche dans l’audio arabe. Je mets cette expérience à votre service pour vos enregistrements, qu’il s’agisse de conférences, interviews, podcasts ou réunions.
Le package de base fournit une pipeline de transcription prête à l’emploi, testée sur jusqu’à 1 heure de votre audio, avec des sorties texte et SRT ainsi qu’un guide d’installation. Veuillez noter qu’il s’agit d’une transcription IA et qu’elle n’est pas relue par une personne ; la précision dépend du dialecte, du bruit de fond et de la qualité de l’enregistrement. Il est possible d’ajuster un modèle sur votre propre audio pour une meilleure précision via une offre personnalisée.
Contactez-moi avant de commander et envoyez un court extrait de votre audio, afin que je puisse l’examiner et définir des attentes claires avant votre achat.
Expertise:
Discours & Audio
Langage de programmation:
Python
Outils:
Autres

