Fish Audio

Fish Audio

Audio et Voix
Fish Audio
FreemiumOpen SourceAPI

À Propos

Plateforme de génération vocale de l'équipe derrière le TTS open source Fish Speech. Clonez une voix avec seulement 10-30 secondes d'audio ; les modèles S1/S2 offrent une parole naturelle et expressive, avec usage commercial et API à l'usage

Partager cet outil

Notre Verdict

Recommandé

Une qualité proche d'ElevenLabs pour une fraction du prix — avec une porte de sortie open source

Fish Audio attaque le marché de la TTS sous un angle que les acteurs installés ne peuvent pas facilement copier : il publie ses modèles cœurs en open source. La gamme Fish Speech / OpenAudio truste les benchmarks communautaires, et la plateforme hébergée habille ces modèles d'un studio qui clone une voix à partir de 10-30 secondes d'audio avec une fidélité saisissante. L'économie est le grand titre — Plus à 5,5 $/mois effectifs offre environ 200 minutes de génération, une fraction du prix d'une qualité équivalente chez ElevenLabs, et les développeurs à l'étroit peuvent simplement auto-héberger S1-mini gratuitement. Les compromis tiennent à l'écosystème, pas au moteur : le marché de voix est plus mince que celui d'ElevenLabs, l'outillage de doublage est plus jeune, et le clonage commercial exige à juste titre vérification de propriété et offre payante. Les quelque sept minutes gratuites par mois sont une dégustation, pas un repas. Mais pour les narrateurs, développeurs indés et quiconque produit un volume sérieux de TTS avec un budget serré, Fish Audio est aujourd'hui le meilleur rapport qualité-prix de la voix IA — et la porte de sortie open source garantit de ne jamais être piégé.

Idéal pour

  • Créateurs produisant de la narration en volume avec un budget serré
  • Développeurs voulant des API TTS bon marché ou des modèles auto-hébergés gratuits
  • Passionnés d'open source refusant le verrouillage fournisseur

Envisagez des alternatives si

  • Vous avez besoin du plus grand marché de voix et écosystème de doublage (→ ElevenLabs)
  • Vous voulez une TTS intégrée à une suite IA chinoise plus large (→ MiniMax Audio)

Plateformes prises en charge

Application webAPI

Les plateformes disponibles incluent Application web et API.

Fonctionnalités Clés

Clonage vocal à partir de seulement 10-30 secondes d'audio de référence, capturant timbre et style
La famille de modèles S1/S2 offre une parole multilingue naturelle et émotionnellement expressive
Racines open source : les modèles Fish Speech / OpenAudio peuvent être auto-hébergés gratuitement
Voice Design permet aux abonnés de concevoir des voix personnalisées au-delà du simple clonage
Usage commercial autorisé sur les offres payantes, avec des emplacements de voix professionnels
API développeur à l'usage en plus du studio web

Tarifs

free
L'offre gratuite inclut 8 000 crédits par mois (environ 7 minutes de génération), jusqu'à 500 caractères par génération et 3 emplacements de voix publics — sans carte bancaire. L'auto-hébergement des modèles open source est gratuit.
paid
Plus coûte 15 $/mois ou 5,5 $/mois en facturation annuelle (66 $/an, 250 K crédits ≈ 200 minutes). Pro coûte 100 $/mois ou 37,5 $/mois en annuel (450 $/an, 2 M crédits ≈ 1 620 minutes, 3 sièges d'équipe). Max coûte 999 $/mois ou 749 $/mois en annuel (25 M crédits). Enterprise est sur mesure et l'API est facturée à l'usage. (Vérifié avec la page tarifaire officielle, 2026-07-28.)

Cas d'Utilisation

Narration de vidéos, podcasts et livres audio avec une voix clonée ou conçue
Développeurs indés ajoutant une TTS économique à leurs apps via l'API ou les modèles auto-hébergés
Localiser du contenu en plusieurs langues avec une voix cohérente
Chercheurs et bidouilleurs exécutant une TTS open source de pointe en local

Avantages

Prix à la minute parmi les plus bas des services TTS de qualité premium
La famille de modèles open source signifie zéro verrouillage — auto-hébergez à tout moment
La qualité du clonage vocal à partir d'échantillons courts rivalise avec des concurrents bien plus chers
Remises annuelles généreuses (Plus revient à 5,5 $/mois)

Inconvénients

Les ~7 minutes mensuelles de l'offre gratuite ne suffisent qu'à des tests légers
La bibliothèque de voix et l'écosystème de doublage sont plus petits que ceux d'ElevenLabs
L'usage commercial des voix clonées exige une vérification de propriété et une offre payante
L'auto-hébergement des modèles demande un GPU sérieux et une installation technique

Dernière Mise à Jour

2026 : la génération S2 a affûté le clonage vocal à partir d'échantillons de 10-30 secondes, tandis que la gamme open source Fish Speech / OpenAudio (dont le S1-mini auto-hébergeable) continue de dominer les benchmarks TTS communautaires. Les tarifs vont de l'offre gratuite de 8 000 crédits à Plus (15 $/mois), Pro (100 $/mois) et Max (999 $/mois), avec de fortes remises annuelles et une API à l'usage.

S'abonner aux actualités IA

Recevez les dernières recommandations d'outils IA et analyses dans votre boîte mail.

Nous respectons votre vie privée. Désabonnement à tout moment.