AI 音乐周刊 W.A 043
法院批准环球与索尼追加起诉 Suno 违反 DMCA,索尼与华纳联合起诉 Anthropic;Stability AI 完成 7600 万美元 B 轮融资,ElevenMusic 上线分段编辑器 Composer。
领域
61 条 · 2025 年 6 月 27 日 至 2026 年 8 月 31 日
这个领域还有 共学 3 篇
2026 年 1 月 29 日,WaytoAGI 社区邀请 ListenHub 内容负责人国荣和英语教师培训师吴熳,在「晚八点共学」直播中完整演示了 ListenHub 2.0 创作平台的六大功能——解说视频、PPT、AI 播客、TTS、音色克隆和 AI 生图,并展示了如何用多个功能组合完成一个新年拜年视频。无论你是内…
讲师 国荣
2025 年 12 月 5 日的 WaytoAGI 社区直播中,AI 音乐创作者 JKMiles 与音乐板块版主 Keen 围绕百度「AI 星企划」数字角色选秀大赛,带来了一场面向零基础用户的 Suno 实操分享。JKMiles 从注册、界面到歌词修改逐步演示,Keen 则补充了提示词框架、音频处理与变现路径。无论你是准…
讲师 JKMiles、KEEN
8 月 19 日晚,WaytoAGI 社区「鹿演」路演第三期邀请到橘子老师,分享了他创办的 AI 音频工具 ListenHub。橘子老师是公众号「橘子汽水铺」主理人,在 X、即刻、小红书等平台以 Orange AI 身份活跃,拥有十余万粉丝。这场分享围绕 ListenHub 的产品功能、用户案例、创业历程与未来规划展开…
讲师 橘子、生姜
法院批准环球与索尼追加起诉 Suno 违反 DMCA,索尼与华纳联合起诉 Anthropic;Stability AI 完成 7600 万美元 B 轮融资,ElevenMusic 上线分段编辑器 Composer。
环球音乐与 Hook 推出单曲级二创重混权限系统,MIH 向 Udio 及 GRAI 开放 24 项 AI 核心专利;Apple Music 将增设 AI 生成音乐标签。
Suno 9 月 3 日起实施阶梯式下载限额,免费用户终身 7 次、Pro 月 20 次、Premier 月 60 次;Suno 与 BMG 达成全球战略联盟,将推出首个与音乐产业联合研发的合规 AI 音乐大模型。
Suno 推出黑胶定制服务 Suno Vinyl,单张约 45 美元;Suno Voices 声音克隆功能登陆 iOS 与 Android 双端。
美国音乐家工会起诉环球与华纳唱片,指控其未经许可授权录音给 Suno 和 Udio 训练;三大唱片联合发布 AI 音乐入榜 6 大原则,Suno 在德国败诉。
Suno 被曝训练数据侵权,涉及数十万小时版权音频与用户隐私泄露;MiniMax 发布 Music 3.0 音乐模型,主打纯净人声与自然乐器演奏。
全双工架构实现边听边说,可实时打断与追问;日常对话自接,难题实时委托后台 GPT-5.5 处理,对话不中断。
Suno 与 Udio 遭独立音乐人集体诉讼,英伟达因非法训练被索赔超 2000 万美元;即梦上线 SeedMusic 1.0,支持 30-360 秒生成。
Seed-Audio 1.0 可用自然语言直接生成带环境音效与情绪声场的完整音频,无需后期处理;同一音色可通过提示词切换场景与情绪,并支持戏曲、直播带货等场景。
ElevenLabs Music v2 开放 API,支持局部重构与长篇结构化创作;阿里通义发布 UniVocal,实现纯文本驱动的说唱无缝切换。
谷歌以 YouTube 服务条款为由申请驳回 Lyria 3 侵权诉讼;Deezer 数据显示 43% 新用户曲库含 AI 音乐,每天识别至少 7.5 万首 AI 歌曲。
支持 70 多种语言边听边译,保留说话人语调节奏音高;已登陆 Gemini Live API、Google Translate App 和 Google Meet,Meet 语言组合扩至 2000 多种。
Suno 完成超 4 亿美元 D 轮融资,估值达 54 亿美元;谷歌发布开源实时模型 Magenta RealTime 2,延迟低于 200ms。
Stability AI 开源 SAME 音频自编码器,实现 4096 倍压缩;索尼 AI 推出音效大模型 Woosh,支持文本与视频双驱动。
苹果音乐每月新增曲目中超 33% 为纯 AI 生成,但 AI 歌曲收听时长占比不足 0.5%;中央音乐学院开源 Khala 1.0,采用统一声学 Token 技术生成完整歌曲。
Suno 寻求超 2.5 亿美元 D 轮融资,估值翻倍至 50 亿美元;ElevenLabs ARR 突破 5 亿美元,获英伟达及好莱坞明星投资。
GPT-Realtime-2 首次将 GPT-5 级推理接入语音,上下文从 32K 扩至 128K;Big Bench Audio 跑分 96.6%,较上代提升 15.2 个百分点。
SIQA 报告显示 81% 创作者采用人机协作,Suno 占商业 AI 音乐 90.4%;Deezer 日均新增 44% AI 歌曲,85% 播放量涉欺诈。
英伟达开源 AF-Next,支持 30 分钟超长音频解析并释放三大变体;Splice 上线三款生成式 AI 工具,首创衍生品分成模式但陷默认授权争议。
ACE-Step 1.5 XL 以 4B 参数开源,Turbo 版 8 步出音,最低 12GB 显存可跑;MiniMax Music 2.6 上线 Cover 翻唱功能并开源三款 Music Skill,开启 14 天免费内测。
Qwen3.5-Omni 发布,支持 256k 上下文与音视频直接编程;ElevenLabs 推出 ElevenMusic 对标 Suno 与 Udio。
谷歌发布 Lyria 3 Pro,支持 3 分钟结构化生成并接入 Vertex AI 与 Gemini API;Suno v5.5 主打声音克隆与自定义模型,Pro/Premier 用户可创建最多 3 个专属模型。
独立音乐人联盟起诉谷歌,指控其用 Lyria 3 和 ProducerAI 训练侵权;GEMA 诉 Suno 案定于 2026 年 6 月 12 日宣判。
MiniMax Music 2.5+ 解锁高保真纯音乐生成;Apple Music 要求 AI 生成内容添加透明度标签,Suno 日均生成 700 万首。
通义语音发布 Fun-CosyVoice3.5 与 Fun-AudioGen-VD 双模型,支持自然语言指令控制语音生成;新增泰语、印尼语、葡萄牙语、越南语四种语言,生僻字读错率从 15.2% 降至 5.3%。
Suno 年营收达 3 亿美元,AI 艺人 China Styles 单曲冲上 Billboard 榜单亚军;音乐维权组织发公开信抵制 Suno,音乐人起诉 Stability AI 侵权。
30 秒音轨、自动歌词与封面图,支持文字 / 图片 / 视频生成;嵌入 SynthID 水印并新增音频验证,API 版本为 lyria-002。
Mozart AI 获 600 万美元种子轮融资,平台已积累 10 万用户、生成超 100 万首歌曲;音潮 V3.0 主打“音乐平权”,实现情感直出与物理级高保真。
Apple 以 16 亿至 20 亿美元收购 Q.ai,布局无声语音交互;ACE-Step 1.5 开源,单卡 10 秒生成 Suno 级全曲。
环球音乐等向 Anthropic 索赔 30 亿美元,涉 2 万首歌曲;Suno 上线 Sample 采样功能,昆仑天工发布 Mureka V8 并携手太合音乐。
Qwen3-ASR 系列开源,含 1.7B/0.6B 识别模型与 0.6B 强制对齐模型;1.7B 在中文、英文、方言与歌唱识别上达 SOTA,0.6B 支持 128 并发 2000 倍吞吐。
Mureka V8 今日上线,官方称旋律、人声、编曲与情绪表达均碾压 Suno V5;实测给出提示词万能公式「风格 + 编曲 + 氛围 + 制作」,并演示简单与自定义两种模式。
环球音乐与英伟达合作部署 Music Flamingo 模型,并设立艺术家孵化器;LANDR 收购 Reason Studios,Soundverse 发布 AI 音乐版权白皮书。
Forbes 预测 2026 年音乐产业版权管理转向事后风控、流媒体推行分级版税制;Saving Country Music 自 2026 年 3 月 1 日起对 AI 作品实施披露与准入红线。
快手可灵 2.6 实现原生音视频同步,支持 AI 唱歌说唱;字节海绵音乐与 ElevenLabs 上线分轨功能,最高 8 轨拆解。
Meta 发布开源音频分割模型 SAM Audio,支持多模态提示分离音轨;QQ 音乐上线哼唱作歌功能,Suno 升级 Persona 至 v5。
谷歌推出 Lyria Camera 实时将视觉转为背景音乐;ElevenLabs 与 FL Studio、Meta 达成合作,迪士尼投资 OpenAI 并授权内容库。
Suno 与华纳音乐达成战略合作并和解版权诉讼,免费用户取消下载、付费用户下载设月度配额;Mureka 发布 V7.6/O2 双模型,ElevenLabs 推出 Eleven Music 并明确订阅分级商用权限。
咪咕音乐发布 AI 明星社区“咪咕知音”及“AI 星辰计划”,推出行业首个完整授权商用音乐智能体“AI 小亮”;Suno 完成 2.5 亿美元 C 轮融资,估值达 24.5 亿美元。
UMG 与 Udio 达成行业首个战略协议,计划 2026 年推出仅用授权目录训练的新平台;丹麦版权组织 Koda 对 Suno 提起里程碑式版权诉讼。
AI 乡村音乐艺人 Breaking Rust 单曲登顶 Billboard 乡村数字歌曲销量榜,Spotify 月收听者超 200 万;Deezer/Ipsos 盲听测试显示 97% 受访者无法区分 AI 与人类音乐。
Suno V5 支持自定义歌词分段提示词、上传音频修改与 Studio 分音轨模式;给出可发给 LLM 的完整提示词模板,按歌手与歌词自动生成全局风格提示词和分段指令。
Suno 于 9 月 23 日上线 v5 Beta 模型,仅向 Pro 和 Premier 玩家开放;9 月 25 日 Suno Studio 功能上线,目前仅向 Premier 玩家开放测试。
中英稳定性在 seed-tts-eval 上取得 SOTA,超越 SeedTTS、MiniMax、GPT-4o-Audio-Preview;提供 17 种音色、每种支持 10 种语言,并支持 9 种方言。
测评 9 款主流开源 TTS,覆盖 GPT-SoVITS、Fun-CosyVoice、F5-TTS 等;从音色克隆、多情感、长文本等 10 个方向横向对比。
MiniMax 语音送 10000 积分,音色库含 40 种语言 300 多种声音;音色设计功能可按提示词生成角色配音并保存为个人声库,支持商用。
ElevenLabs 于 8 月 5 日推出 AI 音乐生成服务 Eleven Music,估值 33 亿美元;用户可用自然语言描述风格、情绪、用途,数分钟内生成含人声与器乐的完整曲目。
Riffusion 更名为 Producer.ai,搭载旗舰模型 FUZZ-2.0,支持对话式音乐创作与音频再创作;目前为邀请制,现有用户可直接访问并获赠 500 点积分。
首次在自回归 TTS 中实现语音持续时间精确控制,支持 0.75x/1.0x/1.25x 三档时长;情感与音色解耦,可用文本描述控制情感,并发布模型权重与推理代码。
MiniMax 语音推出「音色设计」功能,输入一句音色描述 prompt 即可生成个性音色,一次生成 3 个供选择;免费用户可存 3 个音色卡槽,会员可存 10 个并支持商用。
直播实测 CosyVoice 2、MiniMax Audio、ElevenLabs 三款声音克隆工具,覆盖多语言、方言、情绪与专业术语发音;文末附开篇音色的提示词。