音频模型
语音、音乐与音频理解模型 · 54 篇
站内搜索
搜索
2026年8月3日
语音模型
11:16
Irodori-TTS v4 Small 开源:766M 参数日语 TTS,用 Emoji 控制语气和拟声,零样本克隆最长 120 秒参考音频
4 次阅读
阅读全文
语音模型
01:11
Audio8 TTS 开源:0.6B 小模型实现 11 语言零样本语音克隆,RTF 仅 0.116
4 次阅读
阅读全文
2026年8月2日
语音模型
11:08
OpenAI 给 GPT-Live 语音加上隐形水印:SynthID 音频验证上线,EU AI Act 前一天踩点交付
5 次阅读
阅读全文
2026年8月1日
语音模型
11:14
Baseten 上线 Qwen3-TTS 语音克隆微调:三种克隆方式对比,SFT 模式 TTFA 快 16%
3 次阅读
阅读全文
2026年7月31日
音乐模型
11:08
Google Lyria 3.5 上线:AI 音乐生成迎来更强人声与创作控制
5 次阅读
阅读全文
2026年7月28日
语音模型
11:21
MiniMax Speech 2.8 发布:AI语音学会嗯…啊…,10秒克隆你的声音
11 次阅读
阅读全文
2026年7月18日
语音模型
11:17
AssemblyAI 推出 Sync API:一个 HTTP 请求完成语音转写,延迟仅 134ms
9 次阅读
阅读全文
2026年7月17日
语音模型
11:13
Google Vids 推出个人数字分身:上传一张自拍和一段语音,AI 就能替你说话
15 次阅读
阅读全文
2026年7月15日
语音模型
11:09
AssemblyAI 推出 Sync API:短音频转录一次请求搞定,134ms 返回结果
9 次阅读
阅读全文
2026年7月8日
语音模型
11:23
Cohere 发布阿拉伯语 ASR 新 SOTA:2B 参数开源模型,WER 比 Whisper 低 11 个点
10 次阅读
阅读全文
2026年7月7日
语音模型
11:37
AssemblyAI Universal-3.5 Pro:原生语码转换、最准说话人分离,ASR 模型解决真实音频三大痛点
13 次阅读
阅读全文
2026年6月30日
音乐模型
11:12
Tidal 全面拒付 AI 生成音乐版税:7月起加标签、即日起停分成
17 次阅读
阅读全文
已显示 12 / 54 篇文章
加载更多
加装
AI
助手
首页
大语言模型
生图模型
视频模型
音频模型
AI硬件
AI工具
本站经验分享
正在读取账户...