音频模型
语音、音乐与音频理解模型 · 56 篇
站内搜索
搜索
2026年9月22日
语音模型
11:08
Kyutai 一周内给 Pocket TTS 连更四刀:默认英语模型换新,还能训 Muon、跑波兰语
2 次阅读
阅读全文
2026年9月16日
语音模型
11:05
Google 发布 Gemini 3.8 Live 系列语音模型:边聊边干活,还能看懂你指的东西
4 次阅读
阅读全文
2026年9月15日
语音模型
11:21
Apple Siri AI 发布:Expressive Voices 让语音交互进入新时代
2 次阅读
阅读全文
2026年9月14日
语音模型
11:07
腾讯混元开源 AuK:一个 1.5B 模型,从零样本 TTS 到音频编辑全能覆盖
13 次阅读
阅读全文
2026年9月13日
语音模型
11:04
Azure AI Speech 推出 LLM Speech 2607:多语种更准、延迟快 3 倍的语音识别更新
6 次阅读
阅读全文
2026年9月11日
语音模型
11:08
OpenAI 语音模型 GPT-Live-1 开放 API:能同时听和说的语音 Agent,每分钟 5 美分
4 次阅读
阅读全文
2026年9月8日
语音模型
01:07
Breeze TTS 2:一个 3B 开源 TTS,把语音克隆、声音设计、多人对话全装进 ComfyUI
8 次阅读
阅读全文
2026年9月7日
语音模型
11:06
VoiceStudio 开源神器:本地跑完 ElevenLabs 全家桶,646 种语言语音克隆免费用
2 次阅读
阅读全文
2026年9月5日
语音模型
11:16
Meta 发布 Muse Voice Transcribe:首款实时音频感知模型,一次搞定 20 人对话转录
2 次阅读
阅读全文
2026年9月4日
语音模型
11:15
微软发布 MAI-Transcribe-2:号称全球最快最准最便宜的语音转文字模型,超越 GPT-Transcribe 和 Gemini
7 次阅读
阅读全文
语音模型
01:19
世界第一开源TTS Breeze 2来了:T8开源ComfyUI整合包及节点,搭配MiniMax H3极致情感演绎
16 次阅读
阅读全文
2026年8月25日
语音模型
11:14
Murf 推出 Falcon 2:号称实时语音代理里最快的 TTS,1 美分一分钟,10 秒音频就能克隆品牌声音
8 次阅读
阅读全文
已显示 12 / 56 篇文章
加载更多
加装
AI
助手
首页
大语言模型
生图模型
视频模型
音频模型
AI硬件
AI工具
本站经验分享
正在读取账户...