主流厂商全线接入,海量大模型任你选,用 AI 就这么简单

豆包大模型豆包大模型Seedance 2.5是字节跳动Seed团队于2026年7月31日正式发布的新一代视频创作模型。该模型延续了Seedance 2.0统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力三大核心方向。
MiniMaxMiniMax H3是MiniMax从专用任务模型迈向通用多模态智能的重要探索,于2026年7月31日正式发布。与以往按图片、视频、声音单一任务划分边界不同,H3在统一的多模态上下文中理解创作意图,实现更自然、更连贯的生成与表达。
Agnes AI新加坡Agnes AI Agnes-Video-V2.0推出的旗舰视频生成模型,2026年6月起全球无限期免费。支持文生视频、图生视频、多图融合与关键帧动画,最大输出18秒。
通义千问HappyHorse 1.1 T2V是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,文生视频。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
通义千问HappyHorse 1.1 I2V是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,图生视频。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
通义千问HappyHorse 1.1 R2V是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,参考生视频。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
通义千问HappyHorse 1.0 Video Edit是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,视频编辑。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
豆包大模型Seedance 2.0 Mini是字节跳动于2026年6月发布的豆包视频生成模型系列轻量版,定位为高性价比视频生成方案,面向更广泛的视频创作与规模化生产需求。该模型在Seedance 2.0统一多模态音视频联合生成架构基础上做了轻量化优化,以更低的成本提供视频生成能力。
Google DeepMindGemini Omni Flash是Google DeepMind于2026年6月30日正式向开发者开放的视频生成与编辑模型。该模型将Gemini的多模态推理能力与视频生成技术深度融合,支持通过自然语言进行对话式视频编辑,可基于文本、图像和视频的组合输入生成和修改视频内容。
腾讯混元支持文生视频、图生视频、视频续写,HunyuanVideo-1.5。混元视频1.5是8.3B参数的开源视频生成模型,能生成5-10秒的高清晰度视频。以流畅的运动轨迹和出色的视觉连贯性受到创作者欢迎。。
通义千问凭借先进的时空建模能力,Tripo-H3.1。Tripo H3.1是阿里云百炼上的最新3D模型生成工具,支持文本描述或图片生成高精度3D模型。在游戏开发、工业设计和元宇宙场景中有广泛应用。。
Stability AI凭借时序一致性和物理合理性,Stable-Video-Diffusion。Stable Video Diffusion是Stability AI的开源图生视频模型,支持从静态图片生成动态视频。
Runway为内容创作者提供全流程工具,Runway-Gen-4。Runway Gen-4是Runway公司最新的AI视频生成和编辑模型。以出色的物理一致性和精准的视频编辑能力著称,是专业视频创作者的重要工具。。
Runway凭借时序一致性和物理合理性,Runway Gen-3 Alpha。Runway Gen-3 Alpha是Gen-3的预览版本,率先展示新一代视频生成能力。。