主流厂商全线接入,海量大模型任你选,用 AI 就这么简单

豆包大模型豆包大模型Seedance 2.5是字节跳动Seed团队于2026年7月31日正式发布的新一代视频创作模型。该模型延续了Seedance 2.0统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力三大核心方向。
MiniMaxMiniMax H3是MiniMax从专用任务模型迈向通用多模态智能的重要探索,于2026年7月31日正式发布。与以往按图片、视频、声音单一任务划分边界不同,H3在统一的多模态上下文中理解创作意图,实现更自然、更连贯的生成与表达。
Google DeepMindGoogle DeepMind Gemini Omni 1.1 Flash是2026年8月27日正式可用的视频生成与编辑模型,支持场景延展至40秒、首尾帧插值与4K上采样输出
PixVersePixVerse V6是PixVerse于2026年8月12日发布的旗舰AI视频生成模型,一次调用生成最长15秒1080p视频+同步音频+多镜头,五大工作流单一模型覆盖,$4.80/分钟按秒计费。
通义千问通义千问万相3.0于2026年8月6日发布,是全能参考视频生成模型,All-in-One统一支持文生图生参考生视频,最长30秒,自然语言指令在线修改画面剧情,将复杂后期简化为一句话操作。
Agnes AI新加坡Agnes AI Agnes-Video-V2.0推出的旗舰视频生成模型,2026年6月起全球无限期免费。支持文生视频、图生视频、多图融合与关键帧动画,最大输出18秒。
通义千问HappyHorse 1.1 T2V是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,文生视频。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
通义千问HappyHorse 1.1 I2V是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,图生视频。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
通义千问HappyHorse 1.1 R2V是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,参考生视频。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
通义千问HappyHorse 1.0 Video Edit是阿里云于2026年6月在百炼平台正式上线的HappyHorse系列视频生成模型,视频编辑。该模型基于15亿参数单流Transformer架构,实现文本、图像、视频、音频的统一编码与原生协同生成,支持720p视频输出和音画同步。
豆包大模型Seedance 2.0 Mini是字节跳动于2026年6月发布的豆包视频生成模型系列轻量版,定位为高性价比视频生成方案,面向更广泛的视频创作与规模化生产需求。该模型在Seedance 2.0统一多模态音视频联合生成架构基础上做了轻量化优化,以更低的成本提供视频生成能力。
Google DeepMindGemini Omni Flash是Google DeepMind于2026年6月30日正式向开发者开放的视频生成与编辑模型。该模型将Gemini的多模态推理能力与视频生成技术深度融合,支持通过自然语言进行对话式视频编辑,可基于文本、图像和视频的组合输入生成和修改视频内容。
腾讯混元支持文生视频、图生视频、视频续写,HunyuanVideo-1.5。混元视频1.5是8.3B参数的开源视频生成模型,能生成5-10秒的高清晰度视频。以流畅的运动轨迹和出色的视觉连贯性受到创作者欢迎。。
通义千问凭借先进的时空建模能力,Tripo-H3.1。Tripo H3.1是阿里云百炼上的最新3D模型生成工具,支持文本描述或图片生成高精度3D模型。在游戏开发、工业设计和元宇宙场景中有广泛应用。。
Stability AI凭借时序一致性和物理合理性,Stable-Video-Diffusion。Stable Video Diffusion是Stability AI的开源图生视频模型,支持从静态图片生成动态视频。