header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Fish Audio发布Drama 3:把TTS做成可编辑音频,错一个词只重做一个词

动察 Beating AI 快讯,AI 语音公司 Fish Audio 发布语音模型 Drama 3 预览版,主打更精细的语音控制。用户可以直接用自然语言描述语气、节奏和角色,不需要自己组合一堆情绪或音频标签。


Drama 3 可以在一句话中途改变声音和说话方式,也能一次生成多个角色的对话。哪里不满意,还可以只重做一个词,不需要整段重新生成。


Fish Audio 上一代 S2 已经支持用自然语言控制语音。Drama 3 继续把控制做细,把句中换声、多角色生成和局部重做放进同一个模型里。对于游戏对白、有声内容和 AI 角色,后期修改会方便很多。


目前 Drama 3 仍处于 Preview 阶段,开发者可以申请 API 测试资格。

AI 解读
Fish Audio 7 月完成 5200 万美元种子轮后不足两个月,把 S2.1 Pro 的词级控制推进到 Drama 3 的词级重做。预览版支持自然语言调度语气、节奏、角色,句中换声、多角色对白同模生成;错一个词只重做一个词,TTS 从“生成像真人”转向配音后期工作流。

腾讯混元 AuK、字节 Seed Audio 1.0、谷歌 Gemini 3.1 Flash TTS 近期均把改词、换声、多角色与自然语言控制塞进同一模型,竞争焦点转向可编辑、可编排。

但 Drama 3 仍是 Preview,仅开放 API 测试申请;竞品已有开源权重或开放 API。Fish Audio 融资后先抢控制粒度,商业化节奏留了一手。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成