North Mini Code是Cohere于2026年6月9日发布的首个Agent编程模型,也是Cohere在编程领域的里程碑产品。模型采用30B总参数、3B激活参数的MoE(专家混合)架构,专为智能体编程(Agentic Coding)设计,具有足够小的激活参数以在本地硬件上运行。
模型支持256K输入上下文和64K输出上下文,适合处理大型代码仓库和长篇技术文档。作为Agent编程模型,North Mini Code不仅能生成代码,还能自主规划编程任务、调用工具、执行多步骤编码工作流,适配从简单代码补全到复杂工程任务的广泛场景。
North Mini Code通过Chat V2 API提供服务,同时作为开源权重在开源模型社区上发布。对于生产用途,支持Model Vault部署。模型采用Apache 2.0许可证,允许商业使用,是Cohere在开源编程模型领域的重要布局。
📋 技术规格
| 厂商 | Cohere |
|---|---|
| 模型分类 | 代码生成与编程 |
| 参数规模 | 30B总参数,3B激活参数,MoE架构 |
| 上下文窗口 | 256K输入 |
| 最大输出 | 64K输出 |
| 知识截止 | 2026-04 |
| API定价 | 输入: 免费(开源)/ API按量计费输出: 免费(开源) |
⭐ 核心能力详解
Agent编程专精
Cohere首个Agent编程模型,支持自主规划和多步骤编码工作流
30B/3B MoE
总参数30B激活仅3B,可在本地硬件运行,兼顾能力和效率
256K超长上下文
支持256K输入和64K输出,处理大型代码仓库
Apache 2.0开源
允许商业使用,支持开源模型社区下载和Model Vault部署
🎯 典型应用场景
本地开发环境中的AI编程助手
大型代码仓库的理解、重构和调试
多步骤Agent编程任务自动化
离线环境下的代码生成和审查
💪 技术优势与差异化
- 3B激活参数可在本地硬件运行,降低部署成本
- Agent编程能力支持自主规划和工具调用
- 256K上下文适合大型代码仓库处理
- Apache 2.0开源,支持商业使用
⚠️ 使用局限与注意事项
- 30B总参数虽是MoE,全部权重仍需较大内存
- 编程能力与 frontier 闭源模型仍有差距
- 模型较新,社区生态和微调资源尚在发展中
- 非编程场景能力有限
💰 价格分析与成本建议
开源免费(Apache 2.0),API调用按Cohere标准定价。3B激活参数可在消费级GPU上运行,是端侧编程模型的有力选择。
👥 适用人群与企业
软件开发者、AI编程工具开发者、需要本地部署的企业
🔧 技术架构解析
| 架构设计 | 30B总参数/3B激活参数MoE架构,专为Agent编程设计。 |
|---|---|
| 训练数据 | 训练数据细节未公开,Cohere称模型针对智能体编程场景优化。 |
| 推理优化 | 3B激活参数支持本地硬件运行,256K输入上下文。 |
| 部署方案 | 通过Chat V2 API或开源模型社区开源权重部署,生产用途支持Model Vault。 |
🏆 真实使用案例
📌 某开发团队用North Mini Code做本地编程助手
💬 用户真实评价
North Mini Code在本地运行很流畅,3B激活参数对硬件要求不高。Agent编程能力比简单补全强很多,能自主规划多步骤任务。Apache 2.0开源对我们金融行业的合规要求很重要。
🌐 行业落地洞察
North Mini Code代表了编程模型向Agent化和本地化发展的趋势。3B激活参数的MoE设计让企业可以在本地运行Agent编程模型,在数据隐私和成本控制方面具有显著优势。








首页 



