立即咨询

电话咨询

微信咨询

立即试用
商务合作
Kimi

Kimi K1.5

Kimi K1.5是月之暗面于2025年1月发布的多模态推理研究模型,标志着Moonshot AI正式进入先进推理模型领域。该模型通过强化学习扩展LLM推理能力,在long-CoT(长链思维)模式下数学、代码和多模态推理达到OpenAI o1正式版水平

🧠
Kimi K1.5
Moonshot AI 月之暗面 提供
🧠 推理与深度思考 付费API

Kimi K1.5是月之暗面于2025年1月发布的多模态推理研究模型,标志着Moonshot AI正式进入先进推理模型领域。该模型通过强化学习扩展LLM推理能力,在long-CoT(长链思维)模式下数学、代码和多模态推理达到OpenAI o1正式版水平,在short-CoT(短链思维)模式下领先GPT-4o和Claude 3.5 Sonnet达550%。 在技术架构方面,K1.5将强化学习上下文窗口扩展至128K,通过部分回滚(Partial Rollout)策略重用先前轨迹片段生成新轨迹,避免从头生成的高计算成本。模型采用改进的策略优化,基于long-CoT的强化学习公式结合在线镜像下降法变体。设计上摒弃了蒙特卡洛树搜索、价值函数和过程奖励模型等复杂技术,通过扩展上下文长度和优化策略实现强大推理。 K1.5引入了long2short技术,将长链思维模型的推理能力迁移到短链思维模型中,包括模型融合、最短拒绝采样、DPO和Long2Short RL四种方法。模型在文本和视觉数据上联合训练,具备跨模态推理能力,特别擅长数学推理(支持LaTeX格式输入)、编程调试和视觉推理。K1.5为Kimi K2系列奠定了技术基础,后续K2.5在各项基准上全面超越K1.5并增加了多模态和智能体能力。

推理数学代码视觉推理多模态理解

📋 技术规格

厂商 Moonshot AI 月之暗面
模型分类 推理与深度思考
参数规模 未公开
上下文窗口 128K
最大输出 未公开
知识截止 未公开
API定价 输入: N/A(研究模型,无独立API)输出: N/A(研究模型,无独立API)

⭐ 核心能力详解

RL扩展推理能力

将强化学习上下文窗口扩展至128K,通过部分回滚策略高效生成推理轨迹。

long2short技术

将长链思维推理能力迁移到短链思维模型,四种方法实现推理效率优化。

long-CoT达o1水平

长链思维模式下数学、代码和多模态推理达到OpenAI o1正式版水平。

short-CoT领先550%

短链思维模式下数学、代码、视觉和通用能力领先GPT-4o达550%。

多模态联合训练

文本和视觉数据联合训练,支持LaTeX数学公式输入和跨模态推理。

🎯 典型应用场景

为科研人员提供复杂数学推理和理论推导工具,支持LaTeX格式输入。

为开发者提供编程调试辅助,通过多步推理定位和修复复杂代码问题。

为教育场景提供数学难题解答和逻辑推理训练,辅助教学。

为多模态分析任务提供文本与图像联合推理能力。

💪 技术优势与差异化

  • long-CoT模式达到OpenAI o1水平,推理能力出色。
  • long2short技术实现推理能力的高效迁移。
  • 多模态联合训练支持跨模态推理。
  • 简洁框架摒弃复杂组件,通过RL和上下文扩展实现强大推理。

⚠️ 使用局限与注意事项

  • 为研究模型,无独立公开API,当前Kimi API列表中无kimi-k1.5模型ID。
  • 参数规模未公开,技术细节主要来自技术报告。
  • 已被K2.5在各项基准上全面超越,建议升级使用K2.5或K3。
  • 不支持智能体和工具调用等后续版本的能力。
  • 纯文本推理为主,多模态能力有限。

💰 价格分析与成本建议

K1.5为研究模型,无独立API定价。当前Kimi API提供K2.5/K2.6/K2.7等商用模型,建议需要推理能力的用户使用Kimi K3(¥20/¥100)获取更强推理能力。

👥 适用人群与企业

Kimi K1.5主要面向:AI研究人员、需要理解Moonshot推理技术路线的技术团队、以及关注RL扩展推理的学术机构。当前用户建议升级到Kimi K3获取更强能力。

🔧 技术架构解析

K1.5通过强化学习扩展LLM推理能力,上下文窗口扩展至128K。核心技术包括:Partial Rollout策略重用轨迹片段、基于long-CoT的RL公式结合在线镜像下降法、long2short技术(模型融合/最短拒绝采样/DPO/Long2Short RL)。模型摒弃了MCTS、价值函数和过程奖励模型,通过上下文扩展和策略优化实现推理。文本和视觉数据联合训练,支持LaTeX数学公式输入。

⚔️ Kimi K1.5 与同期推理模型对比

竞品模型 优势 不足
OpenAI o1 推理能力标杆 闭源,定价高
DeepSeek R1 开源推理模型 多模态能力弱
我们的优势:
  • long-CoT达o1水平
  • short-CoT领先550%
  • long2short技术
  • 多模态联合训练
选型建议:K1.5为研究模型已被K3替代。如需推理能力建议直接使用Kimi K3。

🏆 真实使用案例

📌 某研究机构复现K1.5推理方法

应用场景:基于K1.5技术报告研究RL扩展推理方法
实际效果:long2short技术为研究提供了推理效率优化的新思路
short-CoT模式推理效率提升约550%

💬 用户真实评价

AI研究员
⭐⭐⭐⭐

K1.5的技术报告对RL扩展推理有重要参考价值,long2short思路很有启发性。

开发者
⭐⭐⭐

作为研究模型无法直接使用API,建议直接用K2.5或K3,能力全面超越K1.5。

✅ 最佳实践建议

1. 升级到新版本**:K1.5已被K2.5/K3全面超越,建议直接使用最新版本。
2. 参考技术报告**:如需理解Moonshot推理技术路线,K1.5技术报告有重要参考价值。
3. 研究long2short**:如需优化推理效率,可研究K1.5的long2short技术方法。

❓ 常见问题解答

Q: Kimi K1.5是什么类型的AI模型?
A: K1.5是月之暗面2025年1月发布的多模态推理研究模型,通过强化学习扩展推理能力,long-CoT达o1水平。
Q: Kimi K1.5有API吗?
A: K1.5为研究模型,当前Kimi API列表中无kimi-k1.5模型ID。建议使用K2.5或K3获取更强推理能力。
Q: K1.5和K2.5有什么区别?
A: K2.5在各项基准上全面超越K1.5,并增加了多模态和智能体能力。K1.5为研究模型,K2.5为商用模型。

产品问答

提问
企业上Kimi API要准备什么?部署和接入有哪些步骤?
avatar
qo8cr5zq回答:
企业上Kimi API,准备工作集中在账号认证、密钥获取、网络与安全配置三个方向 其中企业认证是必须跨过的第一道门槛。 企业账号认证是接入的必经步骤。 企业需要登录开放平台完成企业认证,准备企业名称、与企业名称一致的银行账号、统一社会信用代码。平台会向企业对公账户打款随机金额用于验证,财务确认后填入即可通过。 企业认证相比个人认证,可申请更高速率限制、支持签署商务合同、享受优先技术支持。认证状态支持从个人升级为企业,但不可逆。 API Key获取与权限管理。 认证通过后,在控制台创建密钥。该密钥需妥善保管,生产环境应通过环境变量注入,避免明文存储在代码或配置文件中。密钥不得在前端浏览器代码中直接调用。 企业可根据业务需求创建多个子账户进行团队协作。如遇密钥泄露,立即在控制台撤销并重新生成。 网络与安全配置。 所有API通信使用HTTPS/TLS加密传输。生产环境部署时需配置完整的SSL/TLS证书链,TLS 1.3是最低安全标准。 该工具的数据不会被用于模型训练,不同用户的数据严格隔离。内容安全审查机制自动检测并过滤违规内容。如果业务在海外调用,需确认网络环境是否稳定。 准备阶段的决策要点: 先完成企业认证再申请密钥,提前准备好营业执照和银行账户信息。密钥从创建第一天就按生产标准管理,不要等出了问题再补救。
提问
代码项目选Kimi K2.7 Code还是K3?编程场景怎么选?
avatar
62fhxb4k回答:
代码项目选Kimi K2.7 Code还是K3,本质上是选编程专用工具还是全能旗舰 两者定位完全不同。 K2.7 Code是月之暗面开发的聚焦编程的Agentic模型,专为代码生成、编辑和Agent开发任务打造。它基于K2系列,通过Mixture-of-Experts架构实现高效推理。 而K3是月之暗面迄今为止能力最强的旗舰模型,面向软件工程、知识工作和深度推理等前沿智能场景设计。 Kimi K2.7 Code与K3的核心差异 定位不同。 K2.7 Code是编程专家,把K2系列的能力集中在代码生成、编辑和Agent开发任务上。K3是全能旗舰,编程只是其强能力之一,同时覆盖通用Agent、视觉推理、知识工作等多领域。 月之暗面官方明确表示:如果是写作、分析、对话等通用工作,推荐使用K2.6;K2.7 Code专为编程任务打造。而K3则是"迄今为止编程能力最强的模型"。 上下文窗口差异。 K2.7 Code支持256K上下文,足以覆盖中型代码库。K3支持100万tokens上下文窗口,"把整个代码库交给模型"从理想变成了现实。部分工具默认上下文窗口并非最高1M,需要手动将上下文窗口字段配置为1048576才能用满。 成本差距。 在相同调用量下,K3的综合成本约为K2.7 Code的4倍左右。不过K3编程场景缓存率超过90%,实际输入成本会低不少。 简而言之: K2.7 Code是"编程特长生"——专注、高效、便宜;K3是"全能旗舰"——更强、更大、更贵。选哪个,取决于你的任务需要多强的能力,以及预算能承受多大的成本。
提问
Kimi K3需要充值多少才能用?新用户优惠能用吗?
avatar
d2ecmodt回答:
使用Kimi K3需要单独充值,新用户的15元代金券不可用于该模型 这是由K3的旗舰定位决定的。 Kimi K3为什么不能使用15元代金券 先看清K3的定价逻辑。 该模型是月之暗面推出的2.8万亿参数旗舰模型,也是全球首个开源的3万亿级别模型。它的API定价分为三档:输入20元/百万token(缓存未命中)、输入2元/百万token(缓存命中)、输出100元/百万token。 借助Mooncake分离式推理架构,编程场景缓存率超过90%,实际输入成本可降至标准价格的1/4。 那新用户的15元代金券是怎么回事? Kimi开放平台为新用户提供15元代金券,注册即赠送,完成实名认证后发放。但官方明确说明:15元代金券不可用于体验Kimi K3。代金券仅适用于平台上的其他模型,K3需要单独充值后解锁使用。 为什么要单独充值? K3的定位决定了它的门槛。该模型的API定价比上一代旗舰K2.6的输入价格上涨208%,输出价格上涨270%。输出100元/百万token的价格已进入海外闭源前沿模型的价格区间。算力成本高,自然需要付费用户来支撑。 同时,K3上线不到48小时,月之暗面就宣布暂停C端新用户订阅,原因是请求量远超预期,现有GPU集群接近负载上限。有限的算力需要优先保障付费用户,新用户免费体验K3的路径自然被收紧。 15元代金券能用在哪? 代金券可用于Kimi开放平台上的其他模型调用,比如K2.6、K2.7 Code等。数百次标准对话请求、数十次长文档解析、接口联调和功能验证都足够覆盖。但如果你想体验K3的能力,就需要直接充值。