主流厂商全线接入,海量大模型任你选,用 AI 就这么简单

KimiKimi K3是月之暗面(Moonshot AI)于2026年7月16日正式发布的最新旗舰大模型,拥有2.8万亿参数,是全球参数规模最大的开源AI模型。模型采用MoE架构,896个专家中每次激活16个,基于独创的Kimi Delta Attention(KDA)和Attention Residuals(AttnRes)技术构建,在百万token上下文中解码速度提升最高6.3倍。
智谱AIGLM-5.2是智谱AI于2026年6月16日发布的旗舰基座模型。支持1M无损上下文与128K最大输出,主打项目级工程接管、长程Coding Agent与复杂任务闭环,
DeepSeekDeepSeek-V4-Flash是DeepSeek于2026年7月31日全量公测的V4 GA轻量版,2840亿总参数13B激活,1M超长上下文,0731正式版Agent能力大幅增强
OpenAI凭借行业领先的综合能力,GPT-5 Nano。GPT-5 Nano是OpenAI最小的量产模型,针对延迟敏感和成本敏感场景深度优化。适合移动端应用、批量文本处理和实时对话系统。。
AnthropicClaude Opus 4.8是Anthropic于2026年5月发布的最新旗舰模型,在SWE-bench、GPQA和MMLU等权威评测中刷新多项记录。
Anthropic在通用智能和垂直任务上表现均衡,Claude Opus 4.7。Claude Opus 4.7是2026年4月发布的旗舰版本,在编程Agent和复杂推理任务上达到当时业界最高水平。
通义千问在通用智能和垂直任务上表现均衡,Qwen3.6-Plus。Qwen3.6-Plus是Qwen3.6系列的中坚力量,在保持强大语言能力的同时提供极具竞争力的定价。适合大多数通用AI应用场景。。
MiniMax聚焦中小规模商业场景,MiniMax-M2.7。MiniMax-M2.7是M2系列的最新迭代,在代码生成、推理和Agent能力上实现了显著提升。是企业级应用和开发者工具的热门选择。。
xAIGrok 4.6是xAI于2026年8月7日发布的前沿大语言模型,定位为2026年夏季的主力通用模型。该模型沿用Grok 4.5的1.5万亿参数V9基础架构,核心升级集中在后训练阶段——监督微调(SFT)与强化学习(RL)的显著改进。
Thinking Machines LabThinking Machines Inkling是Thinking Machines Lab于2026年7月15日发布的开源大模型,采用975B总参数、41B激活参数的稀疏Mixture-of-Experts架构。模型以Apache 2.0许可证发布,是该参数规模下许可证最宽松的开源模型之一,允许下游组织下载、微调与商业再分发而无需额外授权。
Google DeepMindGemini 3.5 Flash-Lite是Google DeepMind于2026年7月21日正式发布的稳定版高吞吐自动化模型,隶属Gemini 3.5系列的最轻量档位,定位面向高并发、低延迟的批量自动化任务。
阶跃星辰 StepFun阶跃星辰于2026年7月12日发布Step Edge端侧模型全家桶,基础模型在29项权威基准评测中位列同类端侧模型第一,覆盖基础Audio GUI Gen四款产品,定位端侧AI规模化落地。
AnthropicAnthropic Claude Sonnet 4.5于2025年9月推出的Sonnet系列模型,定位构建agents和编码的最智能选择,速度与智能出色平衡。200K上下文,64K输出。
AnthropicAnthropic Claude Opus 4.1于2025年8月推出的Opus系列模型,作为Opus 4的drop-in replacement,在真实编码和agentic任务上提供更优性能与精度。
面壁智能ModelBest2026年WAIC上面壁智能ModelBest发布端侧大模型面壁智能ModelBestMiniCPM5-2B,2B参数在AA榜单取得17分创4B以下最高纪录,512K上下文支持完整Agent能力。
百度文心一言百度文心一言ERNIE 5.1于2026年5月发布,多维弹性预训练技术将预训练成本压至业界6%,LMArena搜索榜全球第四国内第一,Agent能力超越DeepSeek-V4-Pro。
KimiKimi Linear是月之暗面2025年10月发布的48B MoE轻量级模型,每token仅激活3B参数,支持128K上下文,专为边缘部署和资源受限环境设计,可在消费级硬件上流利运行。