最佳 音频与语音 AI 工具
AI 音频工具,用于语音合成、音乐生成和语音识别
9 款工具
ElevenLabs
领先的 AI 语音合成和克隆平台,支持多语言
免费增值API
Whisper
OpenAI 开源的语音识别模型,支持多语言语音转文字
免费开源
Fish Audio
开源 TTS 明星 Fish Speech 团队的语音生成平台,10-30 秒样本即可克隆声音,S1/S2 模型音质自然情感丰富,支持商用与 API 按量付费
免费增值开源API
MiniMax语音
MiniMax 旗下语音生成平台,Speech 系列模型支持 40+ 语言的超拟真 TTS 与 10 秒级声音克隆,情绪与音效标签可控,网页版免费试用
免费增值API
Cartesia
实时语音 AI 平台,Sonic 3.5 文本转语音低延迟常年第一,配套 Ink-2 转录,主打语音智能体与 AI 电话,基于 Mamba/SSM 研究,免费档每月约 2 万信用点
免费增值API
Murf AI
企业级 AI 配音与 TTS 平台,Gen2 模型提供 20+ 语言广播级拟真语音并支持语气、停顿与重音的细粒度控制,200+ 音色、语音克隆、多语言配音翻译与开发者 API 俱全,免费试用、Creator 年付 $19/月
免费增值API
Krisp
AI 降噪赛道的事实标准,双向去除通话背景噪声与回声、兼容 800+ 通讯应用,AI 会议纪要无需机器人入会,2025 年主打的实时口音转换面向呼叫中心,另有 SDK;免费档每天 60 分钟、Pro 约 $8/月(年付)
免费增值API
Voicebox
开源 AI 语音工作室,本地运行的声音克隆/语音合成/听写/智能体语音一体化工具,免费替代 ElevenLabs + WisprFlow,支持 7 种 TTS 引擎和 23 种语言
免费开源API
VoxCPM(语音合成)
OpenBMB 的免 Tokenizer TTS 系统:直接生成连续语音表征,2B 参数、30 种语言、语音设计、可控语音克隆、48kHz 录音室级音频输出。
开源免费