谷歌Lyria 3.5音乐生成模型上线Gemini:人人可用AI写歌,44.1kHz完整歌曲带SynthID水印
2026年9月4日,谷歌在官方博客宣布:其音质最好的音乐生成模型Lyria 3.5正式上线Gemini App与Gemini API,向全球所有用户开放。这意味着任何人现在都可以在Gemini里用一句提示词,生成一首带人声、有完整主歌副歌桥段的44.1kHz立体声歌曲——不需要任何音乐制作经验。Lyria 3.5带来了'更富表现力的人声和更丰富的音乐编曲',同时内置SynthID不可感知水印,为AI音乐的可追溯性提供了技术方案。开发者方面,Lyria 3.5通过Gemini API提供,模型ID为lyria-3.5,也开放给Google AI Studio与Google Vids使用;另有一个lyria-3-clip-preview模型,专门生成30秒的循环片段。从仅限Flow Music工具,到全面铺开进Gemini,谷歌在AI音乐赛道向Suno、Udio等创业公司发出了最明确的竞争信号。
先看Lyria 3.5到底是什么。它是谷歌DeepMind团队开发的音乐生成大模型,一个多月前首次亮相时只出现在Google Flow Music工具中,这次是它第一次大规模进入Gemini。根据谷歌开发者文档,Lyria 3.5可以接受文本提示或图片输入,输出44.1kHz的立体声音频,具备'结构连贯性'——包括人声、对齐的歌词时间轴和完整的器乐编曲。也就是说,用户不只是得到一段旋律,而是一首有头有尾、有主歌副歌桥段的完整歌曲,时长达数分钟。在Gemini App里,用户可以结合风格选择与提示词输入,还能选择歌曲是否包含人声、或者只要纯器乐伴奏;文档还显示Lyria 3.5支持新的文本歌词功能,让生成歌曲的歌词也由用户掌控。对于需要短循环素材的场景,谷歌保留了lyria-3-clip-preview模型,总是输出30秒的clip,方便做预览、做循环、做短视频配乐。
这次发布的分量,放在整个AI音乐竞争格局里看会更清楚。过去两年,Suno与Udio凭借'一句话生成完整歌曲'的能力迅速走红,一度让传统音乐产业如临大敌;Udio在2024年被谷歌旗下DeepMind投资的Uncharted Labs团队拆分后,Suno成为独立赛道里最受关注的玩家,最新估值据报已达百亿美元级别。与此同时,版权诉讼一直是悬在AI音乐头上的达摩克利斯之剑——就在今年7月31日,德国慕尼黑法院对Suno作出裁决,认定其在训练中使用受版权保护的作品构成侵权,并主张对欧盟境外发生的训练行为也具有管辖权。谷歌选择在这个时间点把Lyria 3.5大规模铺开,并且强调SynthID水印,明显是在打'安全合规'这张牌:用技术手段让AI生成内容可被识别、可被追溯,既回应监管关切,也向潜在的企业级客户递出橄榄枝。
对普通用户来说,最直观的变化是:写歌的门槛变成了'会打字'。在Gemini App里,用户选好曲风(流行、电子、嘻哈、民谣等),输入一句描述,比如'一首关于夏日海边告别的抒情歌,女生声线,带点爵士',Lyria 3.5就会在几十秒内给出完整歌曲。如果想做短视频配乐或铃声,30秒的lyria-3-clip-preview会更合适。需要强调的是,生成内容都会带上SynthID水印——这是一种嵌入音频频谱的不可感知标记,人耳听不出来,但可以被检测工具识别,从而让平台与创作者能够确认一段音频是否由AI生成。对于YouTube、TikTok这类需要标注AI内容的平台,这相当于给AI音乐装上了'身份证'。谷歌还强调,Lyria 3.5不仅支持英文,也能处理多语言人声,未来在音乐全球化创作上有很大想象空间。
把Lyria 3.5放进Gemini,对谷歌自身的战略意义也不小。今年以来,谷歌在AI内容生成上明显加速:8月一口气发布了Gemini 3.7 Flash与3.8 Flash等多款模型,现在又把音乐生成塞进拥有数亿用户的Gemini App——这是典型的'流量入口+模型能力'组合拳。对开发者而言,Gemini API开放Lyria 3.5意味着:做音乐教学App的可以内置'AI作曲演示',做视频工具的可以让用户一键配乐,做游戏工作室的可以快速生成氛围BGM。谷歌的定价策略也相当激进,延续了Flash系列'低价走量'的思路,试图用规模摊薄成本、用生态锁定开发者。接下来值得关注的是:Suno与Udio会如何应战?版权裁决会不会改变AI音乐的商业模型?以及,当每个人都成为'作曲家',传统音乐产业的游戏规则会不会被彻底重写?
📌 来源:谷歌官方博客《Create your best tracks yet with Lyria 3.5 in Gemini》(2026年9月4日,https://blog.google/innovation-and-ai/products/gemini-app/better-tracks-lyria-gemini/)、Android Authority(https://www.androidauthority.com/latest-lyria-model-comes-to-gemini-app-3707842)、The Next Web(https://thenextweb.com/news/google-lyria-3-5-gemini-app-api-music-generation-gema-suno-munich-ruling-deezer-uploads)、Unite.AI(https://www.unite.ai/google-brings-lyria-3-5-music-generation-to-the-gemini-app-and-api/)、Investing.com(Reuters,https://www.investing.com/news/stock-market-news/google-launches-lyria-35-music-model-in-gemini-app-93CH-4889967)。Suno慕尼黑裁决事实依据The Next Web报道。
🤔 常见问题解答
Q1: Lyria 3.5在哪里可以使用?
2026年9月4日起,Lyria 3.5在Gemini App(网页端与移动端)和Gemini API中向全球用户开放;开发者还可以在Google AI Studio与Google Vids中调用。此前它只在Google Flow Music工具中提供。
Q2: Lyria 3.5能生成什么样的音乐?
Lyria 3.5可从文本或图片提示生成44.1kHz立体声完整歌曲,包含人声、歌词时间轴与完整器乐编曲,时长数分钟,具备主歌、副歌、桥段结构;也支持纯器乐与多语言人声。另有lyria-3-clip-preview模型专门生成30秒循环片段。
Q3: AI生成的音乐会打水印吗?
会。Lyria 3.5生成的内容内置SynthID水印——一种嵌入音频频谱的不可感知标记,人耳无法察觉但可被检测工具识别,帮助平台和创作者确认音频是否由AI生成。
Q4: Lyria 3.5与Suno、Udio相比如何?
Lyria 3.5的优势在于背靠谷歌生态:深度集成Gemini App的数亿用户流量、Gemini API与AI Studio等开发者工具,并内置SynthID合规水印;Suno与Udio则在独立产品体验和社区生态上先行一步。版权方面,德国慕尼黑法院7月31日刚对Suno作出不利裁决,AI音乐版权合规成为各方竞争焦点。
🛠️ 推荐工具
站在更长的时间线上,Lyria 3.5进入Gemini可能是一个标志性节点。它意味着AI音乐从'极客玩具'变成了'国民应用'——数亿Gemini用户不用安装任何新软件,就能在聊天里完成从灵感到成曲的全流程。对创作者来说,AI不会取代会写歌的人,但它一定会改变'写歌'这件事的分布:过去只有受过训练的音乐人才能完成的编曲、混音、人声合成,现在变成了一句提示词。而SynthID水印的存在,让这场创作民主化没有滑向'深度伪造音乐'的失控方向。真正的悬念在于商业模型:当生成音乐的边际成本趋近于零,音乐产业的价值会从'作品'迁移到'现场、版权、情感连接'——这恰恰是AI最难复制的东西。谷歌迈出的这一步,正在把那个未来提前带到每个人面前。
总结
2026年9月4日,谷歌宣布音乐生成模型Lyria 3.5正式上线Gemini App与Gemini API,面向全球用户开放。Lyria 3.5是谷歌音质最好的音乐生成模型,可从文本或图片提示生成44.1kHz立体声完整歌曲,支持更富表现力的人声、更丰富的编曲,以及带主歌副歌桥段的数分钟级结构;用户可选择带人声或纯器乐,还支持文本歌词输入与多语言人声。生成内容内置SynthID不可感知水印,可用于AI音频溯源。开发者可通过Gemini API(模型ID lyria-3.5)、Google AI Studio与Google Vids调用;另有lyria-3-clip-preview模型生成30秒循环片段。Lyria 3.5此前仅存在于Google Flow Music,此次扩展是其首次大规模进入Gemini。行业背景上,Suno与Udio在独立赛道先行,但德国慕尼黑法院7月31日刚对Suno作出侵权裁决,版权合规成为竞争焦点;谷歌以生态整合与SynthID合规水印应战,标志着AI音乐竞争进入'平台+安全'新阶段。对普通用户而言,写歌门槛已降至'会打字';对产业而言,音乐价值正从作品本身向现场、版权与情感连接迁移。