Je vais concevoir une IA de speech to text en arabe avec un modèle fine-tuned

Certaines informations ont été traduites automatiquement.

Égypte

Je parle Anglais, Arabe

Ingénieur IA

Bonjour ! Je suis un ingénieur en IA d’Égypte, titulaire d’un B.Sc. en IA & Data Science, avec une recherche en vision par ordinateur en première auteur en cours de revue par des pairs. Je crée des ou...
À propos de ce service

Vous avez besoin de transformer automatiquement un audio arabe en texte ? Je crée des pipelines speech-to-text en utilisant Whisper, le modèle de reconnaissance vocale open-source, configuré pour transcrire vos enregistrements arabes en texte clair et sous-titres SRT synchronisés.


J’ai ajusté Whisper sur 25 000 échantillons de discours en arabe, réduisant son taux d’erreur de mot de 44,5 % à 25,7 %, et j’ai développé un système complet qui transcrit, résume et recherche dans l’audio arabe. Je mets cette expérience à votre service pour vos enregistrements, qu’il s’agisse de conférences, interviews, podcasts ou réunions.


Le package de base fournit une pipeline de transcription prête à l’emploi, testée sur jusqu’à 1 heure de votre audio, avec des sorties texte et SRT ainsi qu’un guide d’installation. Veuillez noter qu’il s’agit d’une transcription IA et qu’elle n’est pas relue par une personne ; la précision dépend du dialecte, du bruit de fond et de la qualité de l’enregistrement. Il est possible d’ajuster un modèle sur votre propre audio pour une meilleure précision via une offre personnalisée.


Contactez-moi avant de commander et envoyez un court extrait de votre audio, afin que je puisse l’examiner et définir des attentes claires avant votre achat.


Expertise:

Discours & Audio

Langage de programmation:

Python

Outils:

Autres

Mon portfolio

Autres services de Data science et machine learning I Offre