Je vais transcrire et annoter l'audio mandarin pour des datasets d'IA
Ingénieur en Big Data et IA
À propos de ce service
Préparez l'audio mandarin pour des datasets d'IA avec des transcriptions vérifiées par des humains et des étiquettes structurées.
Je suis un locuteur natif mandarin et ingénieur en Big Data et IA, combinant la compréhension de la langue chinoise avec la préparation de données structurées.
Je transcris un mandarin clair, étiquette jusqu'à 2 locuteurs, ajoute des horodatages au niveau des tours de parole, et marque les discours peu clairs ou qui se chevauchent sans deviner. Livrables : TXT et CSV ; JSON en Standard et Premium.
Basic : 2 minutes d'audio, jusqu'à 100 segments. Standard : 5 minutes, jusqu'à 200 segments, plus jusqu'à 5 étiquettes d'intention définies par le client. Premium : 10 minutes, jusqu'à 300 segments, plus des problèmes observables dans le dialogue IA tels que des réponses non pertinentes ou des erreurs évidentes dans la transcription. La durée et le nombre de segments sont limités.
Fournissez l'audio, les lignes directrices pour l'étiquetage et la terminologie. Envoyez un échantillon préalable pour le bruit, les accents ou les sujets spécialisés. L'alignement au niveau des mots, la traduction, l'enregistrement vocal et le doublage commercial ne sont pas inclus.
Les révisions corrigent le travail dans l'audio original et selon les règles convenues. Les nouveaux fichiers ou modifications d'étiquettes nécessitent un nouveau devis. Partagez uniquement l'audio autorisé et supprimez les détails confidentiels.
Technique:
Manuel
Type d'identification:
Texte
•
Audio
FAQ
Traduction automatique
Enregistrez-vous ou faites-vous du doublage de voix ?
Ce service annoté votre audio existant. L'enregistrement vocal humain et le doublage commercial ne sont pas inclus.
Quelle est la précision des horodatages ?
Les horodatages indiquent les tours de parole. L'alignement au niveau des mots n'est pas inclus. La durée de l'audio et le nombre de segments sont limités.
Pouvez-vous étiqueter l'intention ou revoir les réponses de l'IA ?
Le support standard et premium permet jusqu'à 5 étiquettes d'intention convenues. Le premium ajoute la détection de problèmes observables dans l'audio fourni et le contexte ; il ne garantit pas la vérification complète des faits.
Pouvez-vous traiter des enregistrements bruyants ou des dialectes ?
Envoyez d'abord un court échantillon. Les packages couvrent un mandarin clair avec jusqu'à 2 locuteurs. Les sections peu claires sont marquées plutôt qu'inventées.
