AI音频
53 个工具
Suno
全球最大AI音乐平台,文本生成完整歌曲含人声配器,约200万付费用户
Udio
Suno最强竞品,音质更自然擅长摇滚爵士原声
MiniMax Music
专业音乐制作场景,2026年1月发布
Google Lyria 3
Google音乐生成,48kHz立体声支持人声歌词
Stable Audio
Stability AI音乐音效生成,适合采样制作
AIVA
古典管弦乐电影配乐生成,获作曲家协会认可
音述AI
国内AI音乐平台,120+风格,已服务12万+创作者
Soundraw
为内容创作者打造免版税背景音乐
Mubert
实时AI音乐流媒体生成,适合直播
Beatoven
AI音乐生成工具
ToMusic
AI音乐生成平台
ElevenLabs
行业领先TTS与声音克隆,情感表现顶尖音质9.5/10
OpenAI TTS
几行Python即可调用,定价约0.10元/千字
Azure TTS
国内数据中心,700+音色,免费50万字符/月
Amazon Polly
神经网络TTS,支持SSML,多SDK访问
Google Cloud TTS
20+语言自动检测,SSML情感风格
Cartesia
超低延迟Sonic模型,WebSocket多路复用
Deepgram Aura
Aura TTS流式传输+Voice Agent API
PlayHT
实时流式传输首选,短音频声音克隆
Resemble AI
高质量声音克隆,短音频高度匹配
Grok TTS
xAI商用TTS API,5种音色定价$4.20/百万字符
火山引擎TTS
字节跳动TTS,国内开发者综合首选,1.3元/千字
FishAudio
开源高保真TTS,80+语言15秒声音克隆
MiniMax Audio
情绪配音能力突出,逐句调节情绪
腾讯云TTS
企业级AI语音能力
Fish Speech
开源高保真TTS,S2 Pro支持80+语言
GPTSoVITS
离线运行,5秒零样本中文声音克隆
ElevenLabs Music
基于语音技术积累,内置声音克隆和人声分离
Tango
轻量高效文生音效,扩散模型架构
Make-An-Audio
复杂语义理解的文生音效
AudioLDM
文本或音频驱动的音效检索与合成
HunyuanVideo-Foley
腾讯视频驱动端到端音效生成
Adobe Podcast
音频修复与增强,降噪人声增强母带优化
Krisp
实时通话降噪,适合在线会议直播
Audacity
完全免费开源音频编辑器,降噪声声分离
StepAudio 2.5
阶跃星辰TTS高自然度+ASR高速高精度
Gemini Live API
具备情绪感知能力的实时语音交互API
Grok Voice Agent
最快响应TTFA小于1秒,100+语言定价$0.05/分钟
CosyVoice-v3
阿里云百炼语音合成大模型
鲸鱼音乐
自研V9版音乐模型,累计生成1000万+首,服务3000+企业客户
媒小三配音
1300+音色含20种情绪标签,10秒录音声音克隆
配朵朵
1000+音色按场景分类,集成AI写作音频转文字
百宝音
30秒声音克隆,多角色对话自动区分,批量导出SRT字幕
百音工坊
AI音频创作全流程平台,文本转语音声音克隆一站式
黑狐配音
音频情感表现力强,3秒样本完成音色复刻
剪映内置配音
字节跳动基础配音完全免费,海量中文方言音色一键生成字幕
Gepard
低延迟流式TTS,文本到达即开始生成音频无需等待完整句子
SoundBot
基于DSP的音频ChatBot,语音命令驱动音效生成
ACE-Step 1.5
AI音乐与音效生成模型
Qwen-Audio-3.0-TTS
阿里云百炼平台语音合成大模型
Qwen2.5-Omini
阿里开源通用全能语音大模型
AudioFlamingo3
开源音频大模型,语音声音音乐全模态理解
SoulX-Singer
AI歌声合成模型,零样本高保真歌唱合成
