返回资讯列表
ithome
•2026-10-03 14:01将语音与音乐作为单一连贯音轨共同生成,AI 音乐制作平台 Suno 推出 Speech 语音功能
IT之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型。
据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合“语音朗读 + 原创 BGM”的端到端闭源音频模型。
在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。
官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。
IT之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得“过于戏剧化”,导致断句节奏过慢。
最新资讯
AI 数字人面试官引发求职者“恐怖谷效应”吐槽,相关话题冲上热搜
ithome•2026-10-03 15:52
爱彼迎 Airbnb 民宿房东利用 AI 图片勒索房客要求其支付维修费,后者利用水印检测器成功识破
ithome•2026-10-03 15:05
“争气机”换更强“争气芯”:全系韬芯片之华为 Mate 90 发布,央视报道称走出世界半导体的新路
ithome•2026-10-03 14:38
HPE 获得其首笔 AMD "Helios" AI 机架订单,价值 12 亿美元
ithome•2026-10-03 14:23
旗下智能体频繁“闯祸”,OpenAI 每天要烧掉超 50 万美元来调查
ithome•2026-10-03 14:18