Je vais créer un modèle de voix IA avec n'importe quelle voix et cloner votre voix


Level 2
À propos de ce service
Traduction automatique
Clonage de voix IA qui sonne naturel, pas synthétique. La plupart des vendeurs utilisent un seul outil et cliquent sur générer, ce qui donne une voix plate, métallique et mince. Je construis toute la chaîne audio autour du modèle, pour qu’elle se rapproche davantage de la source.
Je travaille avec des créateurs, des studios de doublage, des éditeurs d’audiobooks et des marques qui ont besoin d’une voix IA cohérente sur un projet. Ce que je propose : du doublage multilingue conservant le même timbre dans une nouvelle langue, de la narration longue qui reste cohérente au-delà de 15 minutes sans dérive de ton, et du travail de personnages à voix multiples.
Ma configuration : RVC v2, GPT-SoVITS, CosyVoice, ElevenLabs, Chatterbox, UVR5 et Demucs pour l’isolation, puis mastering en DAW. Je choisis le moteur adapté à votre source, pas un seul outil pour tous les travaux.
Je viens de l’ingénierie audio, donc je lutte contre les artefacts robotiques que la plupart des clones laissent derrière eux. Certifié en cybersécurité par Google, fichiers sources supprimés après livraison. Je respecte la transparence du EU AI Act : consentement écrit avant de commencer, utilisation de l’IA divulguée dans le livrable.
Besoin d’une conversion en temps réel pour Zoom ou Discord ? Contactez-moi, c’est une prestation séparée.
Droits de propriété des voix
Vous devez disposer des pleins droits et de l'autorisation d'utiliser les voix impliquées dans votre service de voix d'IA personnalisées. Je n'utiliserai pas les voix à des fins illégales, frauduleuses ou mensongères.
Découvrez Cristian
AI Agents and Automation Engineer
Level 2
- DeItalie
- Membre depuismars 2021
- Temps de réponse moy.1 heure
- Dernière commande1 mois
Langues
Italien, Anglais
Traduction automatique
Mon portfolio
FAQ
Traduction automatique
Que dois-je fournir
Audio de la cible que vous souhaitez cloner. Zero-shot (de base) : 10 à 30 secondes suffisent. Fine-tuned (Standard/Premium) : 10 à 20 minutes pour de meilleurs résultats. WAV ou FLAC préféré, MP3 accepté. Standard/Premium inclut un nettoyage complet de l’audio — envoyez-moi ce que vous avez.
Quelles technologies utilisez-vous ?
Plusieurs modèles d’IA : RVC v2 pour la conversion et le chant entraînés, GPT-SoVITS pour le clonage zero-shot, CosyVoice pour la synthèse multilingue, GLM-TTS et Fish Speech pour la narration. Je choisis le bon moteur pour votre projet, pas une approche universelle.
Quelle est la différence entre zero-shot et fine-tuned ?
Zero-shot (de base) : clones à partir d’un court extrait sans entraînement, rapide, bonne qualité, idéal pour des projets rapides. Fine-tuned (Standard/Premium) : j’entraîne un réseau neuronal sur vos données pour capturer la respiration, le rythme, l’émotion et les patterns vocaux uniques. Fine-tuned = fidélité supérieure.
Pourquoi vos modèles ont-ils une meilleure qualité que ceux de la concurrence ?
Je prépare l’audio avant et après l’IA. Avant : isolation UVR5, désreverb, optimisation mono. Après : suppression des artefacts, de-essing, égalisation, compression, normalisation du volume dans un DAW. La plupart des vendeurs cliquent sur générer et exporter. Je fournis un audio prêt pour la diffusion.
Le modèle peut-il chanter ?
Oui. Ajoutez l’option Singing Model et j’optimise un modèle RVC v2 pour la performance musicale : précision de la tonalité, vibrato, contrôle de la respiration et plage dynamique adaptée au chant. Fonctionne pour les covers IA, musique originale, harmonies et jingles publicitaires.
Pouvez-vous cloner une voix dans plusieurs langues ?
Oui. Ajoutez l’option Clone multilingue. En utilisant GPT-SoVITS et CosyVoice pour la synthèse cross-linguale, je génère un audio dans une nouvelle langue tout en conservant le timbre original. Supporté : anglais, espagnol, français, chinois, japonais, coréen, et plus.
Pouvez-vous mettre en place un changeur en temps réel ?
Oui. Ajoutez l’option Realtime VC Setup. Je forme un modèle RVC personnalisé et configure un pipeline pour OBS, Discord ou le streaming. Latence aussi basse que 90 ms avec ASIO. Inclut les fichiers du modèle, la configuration de routage audio et un guide pour que vous puissiez l’utiliser vous-même.
Puis-je utiliser cela à des fins commerciales ?
Ajoutez l’option Usage commercial. Elle couvre les droits sur le modèle IA et mon travail d’ingénierie. Vous êtes responsable légalement d’avoir le consentement écrit du locuteur original. Je ne concède pas de droits sur l’identité d’autrui, seulement sur mes livrables techniques. Conforme au règlement européen sur l’IA.
Quels fichiers vais-je recevoir ?
Basic : audio rendu en WAV avec la configuration du modèle. Standard : fichiers modèle .pth et .index ou checkpoint GPT-SoVITS avec l’audio généré. Premium : tous les fichiers du modèle, audio masterisé, documentation et support pour l’installation locale. Tous les modèles fonctionnent avec des outils open-source, à vous pour toujours.
Conservez-vous mes données ?
Non. Une fois livré, je supprime tous les fichiers de mon système. Votre modèle et vos données vous appartiennent exclusivement et à jamais. Besoin de plus d’audio plus tard ? Recommandez avec votre modèle existant ou ajoutez l’option Extra 5min Audio Gen. Pour du contenu continu comme des podcasts, renseignez-vous sur les forfaits mensuels.
11 avis concernant ce service
| (9) | ||
| (1) | ||
| (0) | ||
| (0) | ||
| (1) |
Détails de la notation
- Niveau de communication avec le freelance
- Qualité de la livraison
- Valeur de la livraison
Trier par
B bejbiswetka

Pays-Bas
I have no words! Cristian went above and beyond to help me with my problem. He created a solution that exceeded my expectations and I could not be happier. He even went an extra step and helped me out with the setup. I cannot recommend enough! If I ever need a voice model with a guy that knows this stuff......
200 $US-400 $US
Prix
8 jours
Durée
Utile?C carlo_egli

Italie
Ringrazio Cristian per il lavoro svolto, la sua velocità nel rispondere e la sua attenzione. Ha allegato anche istruzioni e tutoraggio benche no fossero all interno del pacchetto. Grazie mille!
50 $US-100 $US
Prix
3 jours
Durée
Utile?E enricobalbetti

Italie
Ha prodotto un lavoro davvero spettacolare, non me ne intendo tanto eppure per quello che ho pagato mi ha prodotto un risultato davvero spettacolare. Consigliatissimo.
Jusqu’à 50 $US
Prix
19 Mois
Durée
Utile?B bernardhyppolit

États-Unis
I was very pleased with my results. Cris was attentive to my concerns and made sure I was getting my desired outcome
Jusqu’à 50 $US
Prix
6 jours
Durée
Utile?R realorrin

États-Unis
Thanks for the amazing voice model!
Jusqu’à 50 $US
Prix
1 jour
Durée
Utile?
11 avis concernant ce service
| (9) | ||
| (1) | ||
| (0) | ||
| (0) | ||
| (1) |
Détails de la notation
- Niveau de communication avec le freelance
- Qualité de la livraison
- Valeur de la livraison
Trier par
B bejbiswetka

Pays-Bas
I have no words! Cristian went above and beyond to help me with my problem. He created a solution that exceeded my expectations and I could not be happier. He even went an extra step and helped me out with the setup. I cannot recommend enough! If I ever need a voice model with a guy that knows this stuff......
200 $US-400 $US
Prix
8 jours
Durée
Utile?C carlo_egli

Italie
Ringrazio Cristian per il lavoro svolto, la sua velocità nel rispondere e la sua attenzione. Ha allegato anche istruzioni e tutoraggio benche no fossero all interno del pacchetto. Grazie mille!
50 $US-100 $US
Prix
3 jours
Durée
Utile?E enricobalbetti

Italie
Ha prodotto un lavoro davvero spettacolare, non me ne intendo tanto eppure per quello che ho pagato mi ha prodotto un risultato davvero spettacolare. Consigliatissimo.
Jusqu’à 50 $US
Prix
19 Mois
Durée
Utile?B bernardhyppolit

États-Unis
I was very pleased with my results. Cris was attentive to my concerns and made sure I was getting my desired outcome
Jusqu’à 50 $US
Prix
6 jours
Durée
Utile?R realorrin

États-Unis
Thanks for the amazing voice model!
Jusqu’à 50 $US
Prix
1 jour
Durée
Utile?

