音频模型
语音、音乐与音频理解模型 · 44 篇
站内搜索
搜索
2026年8月13日
语音模型
11:09
Deepgram 发布 Flux TTS:首个对话原生语音合成模型,80ms 延迟+跨轮次上下文,盲测击败 ElevenLabs
15 次阅读
阅读全文
2026年8月12日
语音模型
01:05
IndexTTS-2.5 开源发布:多语言零样本语音克隆,支持情感与语速精细控制
21 次阅读
阅读全文
2026年8月11日
语音模型
21:36
NVIDIA 开源全双工语音模型 VoiceChat 11B:一个模型替代 ASR+LLM+TTS 三件套,448ms 对话延迟还支持工具调用
8 次阅读
阅读全文
2026年8月8日
语音模型
11:22
阿里推出 CosyVoice Studio:国内首个 AI 语音生产力平台,Qwen-Audio-3.0 登顶全球
23 次阅读
阅读全文
2026年8月6日
语音模型
11:39
字节 SeedRealtime 发布:首个音视频全双工大模型,AI 终于能「边看边听边说」
13 次阅读
阅读全文
2026年8月3日
语音模型
11:16
Irodori-TTS v4 Small 开源:766M 参数日语 TTS,用 Emoji 控制语气和拟声,零样本克隆最长 120 秒参考音频
20 次阅读
阅读全文
语音模型
01:11
Audio8 TTS 开源:0.6B 小模型实现 11 语言零样本语音克隆,RTF 仅 0.116
18 次阅读
阅读全文
2026年8月2日
语音模型
11:08
OpenAI 给 GPT-Live 语音加上隐形水印:SynthID 音频验证上线,EU AI Act 前一天踩点交付
12 次阅读
阅读全文
2026年8月1日
语音模型
11:14
Baseten 上线 Qwen3-TTS 语音克隆微调:三种克隆方式对比,SFT 模式 TTFA 快 16%
11 次阅读
阅读全文
2026年7月28日
语音模型
11:21
MiniMax Speech 2.8 发布:AI语音学会嗯…啊…,10秒克隆你的声音
18 次阅读
阅读全文
2026年7月18日
语音模型
11:17
AssemblyAI 推出 Sync API:一个 HTTP 请求完成语音转写,延迟仅 134ms
12 次阅读
阅读全文
2026年7月17日
语音模型
11:13
Google Vids 推出个人数字分身:上传一张自拍和一段语音,AI 就能替你说话
18 次阅读
阅读全文
已显示 12 / 44 篇文章
加载更多
加装
AI
助手
首页
大语言模型
生图模型
视频模型
音频模型
AI硬件
AI工具
本站经验分享
正在读取账户...