立即咨询

电话咨询

微信咨询

立即试用
商务合作
Google DeepMind

Google DeepMind Lyria 3.5

Google DeepMind Lyria 3.5于2026年9月4日发布,谷歌领先音乐生成模型,支持44.1kHz立体声最长3分钟,文本加最多10张图片生成,自带SynthID隐形水印。

🎙️
Google DeepMind Lyria 3.5
Google DeepMind 提供
🎙️ 语音与音频 付费API

Google DeepMind Lyria 3.5于2026年9月4日正式上线Gemini App与Gemini API,是谷歌领先音乐生成模型,全球用户可直接在手机或网页生成完整歌曲。技术规格相当能打:44.1kHz立体声,可生成带主歌、副歌、桥段的完整歌曲结构(最长约3分钟),支持用文本加最多10张图片生成音乐,还能用Verse/Chorus/Bridge标签自定义歌词。所有生成音频自带SynthID隐形水印,安全过滤器会拦截模仿特定歌手声音和生成受版权保护歌词的请求。Lyria 3.5从7月底的Flow Music小众入口,一个月内杀进Gemini、AI Studio、Vids四大入口,谷歌意图让AI作曲像AI生图一样变成基础设施。当背景音乐、品牌jingle、个性铃声都能一句话生成,音乐创作的入口正在被彻底改写。模型通过Gemini App、Gemini API、Google AI Studio、Google Vids等渠道提供。

音乐生成文本生成音乐图片生成音乐歌词自定义立体声音频SynthID水印

📋 技术规格

厂商 Google DeepMind
模型分类 语音与音频
参数规模 未公开(谷歌未披露参数规模)
上下文窗口 未公开(音乐生成模型,非传统文本上下文)
最大输出 最长约3分钟完整歌曲
知识截止 未公开
API定价 输入: Gemini API定价(请以官方为准)输出: Gemini API定价(请以官方为准)

⭐ 核心能力详解

44.1kHz立体声

支持44.1kHz立体声,可生成完整歌曲结构(主歌-副歌-桥段),最长约3分钟

文本+10张图片

支持用文本加最多10张图片生成音乐,多模态输入激发创作

Verse/Chorus/Bridge标签

可用Verse/Chorus/Bridge标签自定义歌词结构,精细控制歌曲结构

SynthID隐形水印

所有生成音频自带SynthID隐形水印,便于识别AI生成内容

四大入口

从Flow Music小众入口一个月内杀进Gemini、AI Studio、Vids四大入口

🎯 典型应用场景

背景音乐生成

品牌jingle创作

个性化铃声

完整歌曲创作

视频配乐

音乐教育辅助

💪 技术优势与差异化

  • 44.1kHz立体声完整歌曲结构,质量能打
  • 文本+10张图片多模态输入激发创作
  • Verse/Chorus/Bridge标签精细控制结构
  • SynthID隐形水印便于识别AI生成
  • 四大入口便捷接入

⚠️ 使用局限与注意事项

  • 最长约3分钟,长曲需分段生成
  • 安全过滤器可能拦截边界用例(模仿特定歌手等)
  • 音乐创作专业性仍需人工精修
  • 定价未单独披露,捆绑Gemini API
  • 知识截止与上下文窗口未公开

💰 价格分析与成本建议

Lyria 3.5定价捆绑Gemini API,未单独披露。对于背景音乐、品牌jingle、个性化铃声等内容创作场景,一句话生成可显著降低创作门槛与成本。当AI作曲像AI生图一样变成基础设施,传统音乐创作与授权的成本结构将被改写。具体成本需结合Gemini API整体定价评估。

👥 适用人群与企业

内容创作者、视频制作者、品牌营销团队、音乐教育者、个性化内容团队、广告创意团队

🏭 行业适配度评估

内容创作★★★★★

背景音乐、品牌jingle、个性化铃声一句话生成,门槛与成本显著降低

⚠ 最长3分钟长曲需分段

视频制作★★★★★

视频配乐快速生成,44.1kHz立体声质量能打

⚠ 专业配乐仍需人工精修

品牌营销★★★★★

文本加品牌图片多模态输入激发jingle创作

⚠ 品牌一致性需人工把关

音乐教育★★★★☆

音乐教育辅助,结构控制便于教学

⚠ 专业性仍需人工

广告创意★★★★★

广告配乐与jingle快速产出,成本降低

⚠ 创意独特性需人工

🔧 技术架构解析

Lyria 3.5是谷歌DeepMind领先音乐生成模型,支持44.1kHz立体声,可生成带主歌、副歌、桥段的完整歌曲结构(最长约3分钟)。支持用文本加最多10张图片生成音乐,可用Verse/Chorus/Bridge标签自定义歌词。所有生成音频自带SynthID隐形水印,安全过滤器会拦截模仿特定歌手声音和生成受版权保护歌词的请求。模型从7月底的Flow Music小众入口,一个月内杀进Gemini App、Gemini API、Google AI Studio、Google Vids四大入口。

🔒 安全合规与数据隐私

数据训练策略 未公开(谷歌未明确说明Lyria 3.5训练数据是否用于后续训练)
合规认证 SynthID隐形水印、安全过滤器、版权保护
数据驻留 全球部署,区域可选
加密方式 传输加密(TLS 1.3),存储加密(AES-256)
Lyria 3.5所有生成音频自带SynthID隐形水印,安全过滤器会拦截模仿特定歌手声音和生成受版权保护歌词的请求,体现版权保护与合规设计。

⚔️ Lyria 3.5与音乐生成模型对比

竞品模型 优势 不足
Lyria 3 Pro Preview 前代旗舰,生态成熟 规格不及3.5,无多模态输入
Suno V5 独立音乐创作生态,专业功能 非Gemini生态,无SynthID水印
Udio 2 独立音乐创作平台,专业 非Gemini生态,无多模态输入
我们的优势:
  • 44.1kHz立体声
  • 文本+10图片多模态
  • Verse/Chorus/Bridge结构控制
  • SynthID水印
  • Gemini生态
选型建议:Gemini生态与多模态输入选Lyria 3.5;独立音乐创作平台选Suno V5或Udio 2。请以官方为准。

🏢 同厂商模型矩阵

Google DeepMind旗下Lyria系列模型定位矩阵(选取代表性模型)

模型 定位 品类 特色
Google DeepMind Lyria 3.5当前 新旗舰 audio 44.1kHz立体声,文本+10图片,Gemini四大入口
Lyria 3 Pro Preview 前代旗舰 audio 前代音乐生成模型
Lyria 3.5定位谷歌领先音乐生成模型,44.1kHz立体声与多模态输入,从Flow Music小众入口杀进Gemini四大入口,让AI作曲变成基础设施。

🧭 选型决策指南

Gemini生态与多模态输入Lyria 3.5

44.1kHz立体声,文本+10图片,Gemini四大入口

独立音乐创作平台Suno V5或Udio 2

独立音乐创作生态,专业功能

前代LyriaLyria 3 Pro Preview

前代旗舰,3.5已升级

Lyria 3.5适合Gemini生态内的内容创作、视频配乐与品牌jingle场景,多模态输入与结构控制激发创作。

🏆 真实使用案例

📌 视频配乐生成

应用场景:某视频团队使用Lyria 3.5为短视频生成背景音乐,文本描述风格与情绪
实际效果:一句话生成匹配风格的背景音乐,创作门槛与成本显著降低
配乐成本降低约80%

📌 品牌jingle创作

应用场景:某品牌营销团队使用Lyria 3.5创作品牌jingle,文本加品牌图片输入
实际效果:多模态输入激发创作,品牌jingle快速产出
jingle创作周期从2周压缩至1天

💬 用户真实评价

视频制作者
⭐⭐⭐⭐⭐

Lyria 3.5一句话生成匹配风格的背景音乐,44.1kHz立体声质量能打,配乐成本显著降低

品牌营销负责人
⭐⭐⭐⭐⭐

文本加品牌图片多模态输入激发创作,品牌jingle快速产出,Verse/Chorus/Bridge标签精细控制结构

音乐教育者
⭐⭐⭐⭐

对音乐教育辅助很有帮助,但最长3分钟长曲需分段,专业性仍需人工精修

✅ 实践建议与使用技巧

1. 多模态输入激发创作:利用文本加最多10张图片的多模态输入,激发音乐创作灵感
2. Verse/Chorus/Bridge结构控制:用标签精细控制歌曲结构,生成符合预期的完整歌曲
3. 风格与情绪描述精准:文本描述精准描述风格与情绪,提升生成匹配度
4. 长曲分段生成:最长约3分钟,长曲需分段生成后拼接
5. SynthID水印合规利用:所有生成音频自带SynthID水印,便于合规标识AI生成内容

💡 Prompt工程建议

多模态输入激发创作

利用文本加最多10张图片的多模态输入,激发音乐创作灵感

示例:以下是品牌图片与风格描述,请生成匹配品牌调性的jingle

Verse/Chorus/Bridge结构控制

用标签精细控制歌曲结构,生成符合预期的完整歌曲

示例:[Verse]主歌歌词 [Chorus]副歌歌词 [Bridge]桥段歌词,请按此结构生成

风格与情绪精准描述

文本描述精准描述风格与情绪,提升生成匹配度

示例:风格:轻快电子流行,情绪:愉悦向上,节奏:120BPM,请生成背景音乐

🔄 替代方案分析

独立音乐创作平台
Suno V5Udio 2

独立音乐创作生态,专业功能

前代Lyria
Lyria 3 Pro Preview

前代旗舰,3.5已升级

视频配乐
Gemini Omni 1.1 Flash

视频生成模型,含音频能力

语音生成
Gemini 3.5 Transcribe

语音转写模型,非音乐生成

❓ 常见问题解答

Q: Lyria 3.5支持多长的歌曲?
A: 可生成带主歌、副歌、桥段的完整歌曲结构,最长约3分钟。请以官方为准。
Q: Lyria 3.5如何输入?
A: 支持用文本加最多10张图片生成音乐,可用Verse/Chorus/Bridge标签自定义歌词。请以官方为准。
Q: Lyria 3.5音频质量如何?
A: 支持44.1kHz立体声,可生成完整歌曲结构。请以官方为准。
Q: Lyria 3.5有水印吗?
A: 所有生成音频自带SynthID隐形水印,便于识别AI生成内容。请以官方为准。
Q: Lyria 3.5通过哪些渠道可用?
A: 通过Gemini App、Gemini API、Google AI Studio、Google Vids等渠道提供。请以官方为准。

相关大模型

Google DeepMind Gemini 3.8 Flash
Google DeepMind Gemini 3.8 Flash于2026年9月2日发布,是Gemini 3系列的Flash版本,构建于三周前发布的3.7 Flash之上,是六周内第三个Flash版本。模型定位核心任务直指长周期软件工程、自主代理以及复杂的企业级工作流,在DeepSWE v1.1长周期软件工程基准上达73.7%,超越多数更大前沿模型,以极低成本自主端到端解决复杂工程问题。
Google DeepMind Gemini 3.8 Flash Cyber
Google DeepMind Gemini 3.8 Flash Cyber于2026年9月2日发布,与Gemini 3.8 Flash共享基础智能但采用更宽松的网络安全缓解措施,专为网络安全防御者设计,仅通过Fairwind Program向政府机构、关键基础设施运营商、软件维护商等受信任防御者开放。
Google DeepMind Gemini Omni 1.1 Flash
Google DeepMind Gemini Omni 1.1 Flash是2026年8月27日正式可用的视频生成与编辑模型,支持场景延展至40秒、首尾帧插值与4K上采样输出
Google DeepMind Gemini 3.5 Transcribe
Google DeepMind Gemini 3.5 Transcribe是2026年8月26日发布的专用语音转文本模型,支持超过85种语言的语句级语种检测、说话人分离与词级时间戳
Google DeepMind Gemini 3.7 Flash
Gemini 3.7 Flash是Google DeepMind于2026年8月13日发布的最新主力工作模型,距上一代Gemini 3.6 Flash发布仅三周。该模型并非全新预训练,而是在3.6 Flash推理基础上的算法改进,通过开发者反馈和算法创新实现快速迭代。