← 内容生产、营销素材与AIGC

AI生成语音音乐和音效

现在AI生成音频内容进入应用爆发和工具链完善阶段。音乐生成平台Suno升级歌词功能并探索API开放,AI配音模型VoxCPM和Fish Audio新版本提供多语言和高保真合成。开源项目如MuScriptor实现多乐器转录,本地翻唱工作站star-cover打通全链路。GPT-Live和微软Ode Poetry则展示语音交互在新闻和情感陪伴上的新场景。整体从创意工具走向生产力和个性化服务
7月17日
MiniMax语音模型新增600余种声音
600多种由MiniMax Speech 2.8 Turbo驱动的新声音现已登陆Together AI @togethercompute 🎙️✨ 立即体…
7月13日
豆包音频生成模型1.0发布,重新定义AI音频创作
火山引擎正式发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0),支持文本与音频参考生成,端到端输出目标音频。
7月10日
Kyutai 发布 MuScriptor:用于多乐器自动音乐转录的开源解码器专用 Transformer 模型
Kyutai 与 Mirelo 团队发布 MuScriptor,一款用于多乐器自动音乐转录(AMT)的开放权重解码器专用 Transformer 模型。
7月10日
GPT-Live 实现个性化互动新闻简报
OpenAI 联合创始人 Greg Brockman 分享 GPT-Live 新用例:个性化互动新闻简报。
7月10日
微信鸿蒙版 App 获 8.0.19.37 正式版与 8.0.19.38 邀测更新
微信鸿蒙版 App 今日推送 8.0.19.37 正式版及 8.0.19.38 邀测更新,官方公告均为"修复了一些已知问题"。
7月9日
OpenAI Bidi 1 语音模型:可唱歌、生成声音
OpenAI 即将推出双向语音模型 Bidi 1,支持唱歌和生成不同声音。
7月9日
微软推出 Ode Poetry:AI 诗歌药房匹配心情朗读
微软 AI 发布 Ode Poetry 工具,用户只需描述当前感受,AI 音频模型就会连接诗歌专家 William Sieghart 的推荐作品,
7月9日
Suno:助你保持专注状态
为了帮助你保持状态:
7月9日
Suno歌词写作功能重大升级上线
不要相信我们的话,相信你自己的……在 Suno 上写歌词刚刚获得重大升级。 以下是今天在网页端推出的内容 👇
7月8日
VoxCPM全球下载量突破100万
面壁智能(OpenBMB)宣布开源语音生成模型VoxCPM全球下载量超100万。
7月8日
ClickUp Brain AI 将支持音乐生成
ClickUp 正在为 Brain AI 开发音乐生成支持! 即将推出的 Brain 功能 👀 > Brain 可根据曲目描述生成原始音频。
7月7日
Suno上制作国家热门国歌指南
这是如何在 Suno 上制作你国家的下一首大热国歌!
7月7日
SunoAI最佳用例:Anthropic请听好
SunoAI的最佳用例。我希望你仔细听,@AnthropicAI
7月7日
Suno Drake恶搞视频讽刺Claude开发者
AI彻底AI了。👌 一首Suno制作的Drake恶搞歌曲正在走红。 讽刺了开发者对Claude的上下文窗口、API密钥和代码重写的沮丧。
7月6日
用 Suno 制作独立流行专辑《Paper weather》
用户用 Suno 创作了一张 indie pop 风格的专辑《Paper weather》,
7月4日
本地AI翻唱工作站star-cover 0.1上线,群星逐句分配歌手
独立开发者@ykszs017发布star-cover 0.1,一个全程本地运行的AI翻唱工作站。
7月1日
智能体脚本配合Lyria 3生成音乐作品
最近用智能体编写脚本真是太棒了。 我给一个子智能体赋予了Hyperframes技能、一些Omni输出和提示词,它就生成了这个。 音乐由Lyria 3生成
7月1日
Suno 探索开发者 API 计划
Suno 正在探索推出开发者 API,计划从一批合作伙伴开始,重点关注能解锁生成式音乐新体验的应用。主推文仅一个表情"👀"
7月1日
Fish Audio S2.1 Pro 文本转语音模型发布
Fish Audio 发布 S2.1 Pro 文本转语音模型,通过 API 免费使用至 2026 年 7 月 24 日。
6月30日
Runway 推出 Seed Audio 1.0 音频生成
Seed Audio 1.0 现已在 Runway 上对所有付费方案开放。只需简单文本提示即可生成最长 120 秒的动态语音、音效设计和音乐。
6月30日
Netflix 在《Wonka's The Golden Ticket》真人秀中使用 AI 复刻 Gene Wilder 声音
Netflix 真人秀《Wonka's The Golden Ticket》将于 9 月 23 日首播。
6月30日
Dream Relic:用 Suno 为超现实影像配乐
AI 视觉艺术家 Dream Relic(Broc Vaughn)通过 Suno 的 Create 功能,将多年来积累的歌词转化为配乐歌曲,
6月29日
Uber车主 用 AI 以乘客的名字即时生成音乐 恶搞乘客 当乘客听到自己名字的时候有点搞笑🤣
Uber车主 用 AI 以乘客的名字即时生成音乐 恶搞乘客 当乘客听到自己名字的时候有点搞笑🤣
6月28日
Suno 推出 Spark:支持下一代独立艺术家
Suno 宣布启动 **Spark** 孵化器项目,面向年满18岁的未签约独立歌手、词曲作者和制作人。
6月26日
AI实时世界杯解说员项目开源
开发者@zicohacks利用AI构建了一个实时世界杯解说员。
6月24日
VoxCPM2 技术报告发布
面壁智能 OpenBMB 发布 VoxCPM2 技术报告。
6月23日
网易有道发布 Confucius4-TTS:14 语种跨语种无口音语音克隆开源模型
网易有道推出"子曰 4.0"TTS 引擎 Confucius4-TTS,
6月23日
Google Magenta RealTime 2 (MRT2) 实时音乐模型发布
Google AI for Developers 宣布推出开放权重的实时音乐模型 Magenta RealTime 2 (MRT2)。
6月13日
Suno 音轨分离:从零生成更纯净
重大更新:Suno 的音轨分离刚刚大幅升级。🚀 我们现在从零重新生成音轨,而非仅仅隔离频率。结果如何?纯净无伪影的音轨,可直接拖入你的 DAW
6月8日
腾讯混元联合多家机构发布首个音频编辑基准MMAE
腾讯混元联合上海交大、南洋理工等机构推出MMAE(Massive Multitask Audio Editing Benchmark),
6月5日
Suno Voices 使用指南:6 个技巧打造高质量人声录制
Suno Voices 面向 Web 付费用户开放。
6月4日
Boson AI 与 LMSYS 发布基于 SGLang-Omni 的 Higgs Audio v3 TTS 端到端服务
Boson AI 与 LMSYS 联合推出基于 SGLang-Omni 推理框架的 Higgs Audio v3 TTS 端到端服务。
5月29日
小米开源可控视频音效生成模型 ControlFoley,让声音"按你想要的来"
小米大模型应用团队发布开源可控视频音效生成模型 ControlFoley,旨在解决创作中的可控性难题。
5月22日
Suno AI创作夏日神曲《波多黎各》爆火
今年夏天的热门歌曲是用 Suno 制作的。☀️非常感谢 @GMA 让这首病毒式传播的《Puerto Rico》歌曲被更多人看到!还有谁的脑海里也一直回响…
5月21日
开源Suno技能:一键生成任意风格AI音乐
这是基于Suno AI音乐生成工具的技能实现,可通过简单指令按用户需求生成不同风格的歌曲(例如德语空灵风格)。
5月20日
Stability AI 推出音频模型 Stability Audio 3.0,可生成最长 6 分钟专业级歌曲
Stability AI 推出 Stability Audio 3.0 音频生成模型家族,包含四款不同规格模型,参数从45900万到27亿。