立即咨询

电话咨询

微信咨询

立即试用
商务合作

你要的AI大模型,都在这里

主流厂商全线接入,海量大模型任你选,用 AI 就这么简单

通义千问通义千问

Qwen3-Omni-30B-A3B

为多模态Agent应用提供核心引擎,Qwen3-Omni-30B-A3B。Qwen3-Omni-30B-A3B是千问的端侧全模态模型,以极低推理成本支持文本、图像和音频处理。

查看详情
Mistral AIMistral AI

Mistral AI Shieldstral

Shieldstral是Mistral AI于2026年8月4日正式发布的3B参数开放权重多模态安全分类器,代表了内容审核领域的一次范式重构。与传统依赖固定风险标签的安全模型不同,Shieldstral支持在推理阶段通过自然语言输入自定义审核规则,使同一模型可适配不同业务场景。

查看详情
豆包大模型豆包大模型

豆包大模型SeedRealtime

豆包大模型SeedRealtime于2026年8月5日发布,是字节跳动推出的原生音视频全双工大模型,采用统一端到端架构融合音频、视频与文本,实现边看、边听、边说的实时交互体验,已在豆包App全量上线。

查看详情
Google DeepMindGoogle DeepMind

Gemini Robotics ER 2

Gemini Robotics ER 2是Google DeepMind于2026年7月30日发布公开预览的具身推理Embodied Reasoning模型,专为机器人应用场景设计。该模型提供两个端点:gemini-robotics-er-2-preview和gemini-robotics-er-2-streaming-preview,分别面向标准推理和实时流式场景。

查看详情
Google DeepMindGoogle DeepMind

Google Gemini 3.6 Flash

Gemini 3.6 Flash是Google DeepMind于2026年7月21日正式发布的稳定版Gemini API模型,隶属Gemini 3.6系列。该模型在Gemini 3.5 Flash基础上迭代,重点强化代码生成、多模态理解与知识工作三大能力

查看详情
MiniMaxMiniMax

MiniMax-M3.1

2026年WAIC上MiniMax首发M3.1升级版本MiniMax-M3.1,428B总参数激活23B的MoE架构搭配自研MSA稀疏注意力,1M上下文适配工业制造与供应链协同等复杂商业场景。

查看详情
通义千问通义千问

通义千问Qwen3.8-Max

通义千问Qwen3.8-Max于2026年8月3日正式发布,总参数2.4万亿、激活95B的MoE旗舰模型,支持视觉理解和1M上下文,编程与专业办公能力大幅提升

查看详情
KimiKimi

Kimi-VL

Kimi-VL是月之暗面2025年4月发布的首款开源多模态模型,16B参数MoE架构激活3B,专为图像理解与文本生成结合任务设计,在轻量级视觉任务中具备高性价比。

查看详情
Mistral AIMistral AI

Mistral AI Robostral Navigate

Mistral AI Robostral Navigate是2026年7月8日发布的8B具身导航模型,仅需单个RGB摄像头即可实现全自主导航,在R2R-CE未见场景成功率76.6%,超越多传感器方案。

查看详情
Meta AIMeta AI

Meta AI Muse Spark 1.1

Muse Spark 1.1是Meta超级智能实验室于2026年7月9日正式发布的多模态推理模型,定位为面向智能体任务的前沿模型。该模型在工具调用、计算机操作、编程和多模态理解方面实现重大提升,是Meta在AI Agent赛道的重要布局。

查看详情
通义千问通义千问

通义千问Qwen3.5-Omni-Plus

通义千问Qwen3.5-Omni-Plus是2026年3月发布的旗舰级原生全模态大模型,支持图片、视频、语音、文字全模态输入输出,256K上下文,113种语言,在215项第三方评测中取得SOTA。

查看详情
通义千问通义千问

通义千问Qwen3.5-Omni-Plus-Realtime

通义千问Qwen3.5-Omni-Plus-Realtime是全模态大模型的实时版本,支持端到端语音对话,无需分别调用ASR和TTS,适合实时交互场景。

查看详情
面壁智能ModelBest面壁智能ModelBest

面壁智能ModelBestMiniCPM-V

面壁智能ModelBest MiniCPM-V是多模态视觉语言模型,具备图文理解与图像描述生成能力,可应用于智能客服、内容审核和多模态搜索等场景。

查看详情
零一万物零一万物

零一万物Yi-VL 6B

Yi-VL 6B是零一万物的多模态轻量版本,以6B参数实现图文理解能力,适合需要视觉功能的资源受限型应用。

查看详情
通义千问通义千问

通义千问Qwen-Omni

Qwen-Omni是通义千问的新一代多模态统一模型,支持文本、图像和音频的联合理解与生成,是多模态AI应用的理想基座。

查看详情
通义千问通义千问

通义千问Qwen-VL

Qwen-VL是通义千问的多模态版本,融合了视觉理解能力,在OCR、视觉问答和图像描述生成上表现稳定。

查看详情
腾讯混元腾讯混元

腾讯混元混元-VL

混元VL融合视觉理解能力,支持图像描述和视觉问答,是腾讯云多模态AI服务的核心视觉语言模型。

查看详情
讯飞星火讯飞星火

讯飞星火Spark-VL

Spark-VL是星火的多模态视觉语言模型,支持图像理解和视觉问答,适合智能表单处理和多模态客服场景。

查看详情
百度文心一言百度文心一言

百度文心一言ERNIE-ViL

ERNIE-ViL是百度早期的视觉语言模型探索,在图文检索和视觉定位任务上奠定了百度多模态研究的技术基础。

查看详情
百度文心一言百度文心一言

百度文心一言ERNIE-4.5-VL-28B

ERNIE 4.5-VL-28B是百度的多模态视觉语言模型,以28B参数实现了优秀的图文理解和视觉问答能力,适合智能文档处理场景。

查看详情
智谱AI智谱AI

智谱AIGLM-4V

GLM-4V是智谱的多模态视觉语言模型,支持图像理解和视觉问答,在智能文档分析和多模态搜索场景中表现成熟。

查看详情
日日新日日新

日日新SenseNova多模态基座

SenseNova是商汤新一代多模态基座大模型,统一了文本、图像和视频的理解与生成能力,为复杂的多模态AI应用提供统一底座。

查看详情
日日新日日新

日日新SenseVision

SenseVision是商汤的计算机视觉核心模型,在目标检测、图像分割和人脸识别等CV基础任务上处于行业领先水平。

查看详情
盘古大模型盘古大模型

盘古大模型盘古多模态大模型

华为盘古多模态大模型融合文本与图像理解能力,支持图文检索、视觉问答和跨模态内容生成,为企业级AI应用提供统一的多模态交互入口。

查看详情