Google DeepMind Lyria 3.5于2026年9月4日正式上线Gemini App与Gemini API,是谷歌领先音乐生成模型,全球用户可直接在手机或网页生成完整歌曲。技术规格相当能打:44.1kHz立体声,可生成带主歌、副歌、桥段的完整歌曲结构(最长约3分钟),支持用文本加最多10张图片生成音乐,还能用Verse/Chorus/Bridge标签自定义歌词。所有生成音频自带SynthID隐形水印,安全过滤器会拦截模仿特定歌手声音和生成受版权保护歌词的请求。Lyria 3.5从7月底的Flow Music小众入口,一个月内杀进Gemini、AI Studio、Vids四大入口,谷歌意图让AI作曲像AI生图一样变成基础设施。当背景音乐、品牌jingle、个性铃声都能一句话生成,音乐创作的入口正在被彻底改写。模型通过Gemini App、Gemini API、Google AI Studio、Google Vids等渠道提供。
📋 技术规格
| 厂商 | Google DeepMind |
|---|---|
| 模型分类 | 语音与音频 |
| 参数规模 | 未公开(谷歌未披露参数规模) |
| 上下文窗口 | 未公开(音乐生成模型,非传统文本上下文) |
| 最大输出 | 最长约3分钟完整歌曲 |
| 知识截止 | 未公开 |
| API定价 | 输入: Gemini API定价(请以官方为准)输出: Gemini API定价(请以官方为准) |
⭐ 核心能力详解
44.1kHz立体声
支持44.1kHz立体声,可生成完整歌曲结构(主歌-副歌-桥段),最长约3分钟
文本+10张图片
支持用文本加最多10张图片生成音乐,多模态输入激发创作
Verse/Chorus/Bridge标签
可用Verse/Chorus/Bridge标签自定义歌词结构,精细控制歌曲结构
SynthID隐形水印
所有生成音频自带SynthID隐形水印,便于识别AI生成内容
四大入口
从Flow Music小众入口一个月内杀进Gemini、AI Studio、Vids四大入口
🎯 典型应用场景
背景音乐生成
品牌jingle创作
个性化铃声
完整歌曲创作
视频配乐
音乐教育辅助
💪 技术优势与差异化
- 44.1kHz立体声完整歌曲结构,质量能打
- 文本+10张图片多模态输入激发创作
- Verse/Chorus/Bridge标签精细控制结构
- SynthID隐形水印便于识别AI生成
- 四大入口便捷接入
⚠️ 使用局限与注意事项
- 最长约3分钟,长曲需分段生成
- 安全过滤器可能拦截边界用例(模仿特定歌手等)
- 音乐创作专业性仍需人工精修
- 定价未单独披露,捆绑Gemini API
- 知识截止与上下文窗口未公开
💰 价格分析与成本建议
Lyria 3.5定价捆绑Gemini API,未单独披露。对于背景音乐、品牌jingle、个性化铃声等内容创作场景,一句话生成可显著降低创作门槛与成本。当AI作曲像AI生图一样变成基础设施,传统音乐创作与授权的成本结构将被改写。具体成本需结合Gemini API整体定价评估。
👥 适用人群与企业
内容创作者、视频制作者、品牌营销团队、音乐教育者、个性化内容团队、广告创意团队
🏭 行业适配度评估
背景音乐、品牌jingle、个性化铃声一句话生成,门槛与成本显著降低
⚠ 最长3分钟长曲需分段
视频配乐快速生成,44.1kHz立体声质量能打
⚠ 专业配乐仍需人工精修
文本加品牌图片多模态输入激发jingle创作
⚠ 品牌一致性需人工把关
音乐教育辅助,结构控制便于教学
⚠ 专业性仍需人工
广告配乐与jingle快速产出,成本降低
⚠ 创意独特性需人工
🔧 技术架构解析
Lyria 3.5是谷歌DeepMind领先音乐生成模型,支持44.1kHz立体声,可生成带主歌、副歌、桥段的完整歌曲结构(最长约3分钟)。支持用文本加最多10张图片生成音乐,可用Verse/Chorus/Bridge标签自定义歌词。所有生成音频自带SynthID隐形水印,安全过滤器会拦截模仿特定歌手声音和生成受版权保护歌词的请求。模型从7月底的Flow Music小众入口,一个月内杀进Gemini App、Gemini API、Google AI Studio、Google Vids四大入口。
🔒 安全合规与数据隐私
| 数据训练策略 | 未公开(谷歌未明确说明Lyria 3.5训练数据是否用于后续训练) |
|---|---|
| 合规认证 | SynthID隐形水印、安全过滤器、版权保护 |
| 数据驻留 | 全球部署,区域可选 |
| 加密方式 | 传输加密(TLS 1.3),存储加密(AES-256) |
⚔️ Lyria 3.5与音乐生成模型对比
| 竞品模型 | 优势 | 不足 |
|---|---|---|
| Lyria 3 Pro Preview | 前代旗舰,生态成熟 | 规格不及3.5,无多模态输入 |
| Suno V5 | 独立音乐创作生态,专业功能 | 非Gemini生态,无SynthID水印 |
| Udio 2 | 独立音乐创作平台,专业 | 非Gemini生态,无多模态输入 |
- 44.1kHz立体声
- 文本+10图片多模态
- Verse/Chorus/Bridge结构控制
- SynthID水印
- Gemini生态
🏢 同厂商模型矩阵
Google DeepMind旗下Lyria系列模型定位矩阵(选取代表性模型)
| 模型 | 定位 | 品类 | 特色 |
|---|---|---|---|
| Google DeepMind Lyria 3.5当前 | 新旗舰 | audio | 44.1kHz立体声,文本+10图片,Gemini四大入口 |
| Lyria 3 Pro Preview | 前代旗舰 | audio | 前代音乐生成模型 |
🧭 选型决策指南
44.1kHz立体声,文本+10图片,Gemini四大入口
独立音乐创作生态,专业功能
前代旗舰,3.5已升级
🏆 真实使用案例
📌 视频配乐生成
📌 品牌jingle创作
💬 用户真实评价
Lyria 3.5一句话生成匹配风格的背景音乐,44.1kHz立体声质量能打,配乐成本显著降低
文本加品牌图片多模态输入激发创作,品牌jingle快速产出,Verse/Chorus/Bridge标签精细控制结构
对音乐教育辅助很有帮助,但最长3分钟长曲需分段,专业性仍需人工精修
✅ 实践建议与使用技巧
💡 Prompt工程建议
多模态输入激发创作
利用文本加最多10张图片的多模态输入,激发音乐创作灵感
Verse/Chorus/Bridge结构控制
用标签精细控制歌曲结构,生成符合预期的完整歌曲
风格与情绪精准描述
文本描述精准描述风格与情绪,提升生成匹配度
🔄 替代方案分析
独立音乐创作生态,专业功能
前代旗舰,3.5已升级
视频生成模型,含音频能力
语音转写模型,非音乐生成








首页 

2026-08-03


