立即咨询

电话咨询

微信咨询

立即试用
商务合作

GLM-130B 到 GLM-5.2:从中国率先开源的千亿基座到全球开源 SOTA

2026-07-23

 

 

智谱GLM的路线起点是2022年开源的GLM-130B,那是中国率先对外开放权重的千亿参数基座之一。三年后,GLM-5.2在多项开源基准上位居全球前列,这条从国产率先到开源SOTA的路,值得被完整记录,因为它折射的是国产大模型整体位置的迁移。

 

把两代模型放在一起看,变化的不只是参数和能力,开源生态位置的迁移才是真正的分水岭。本文按时间线拆解这段跨越,看每一步为什么发生,又带来了什么。

 

GLM-130B:国产开源千亿的破冰

 

2022年之前,千亿参数模型基本由少数闭源机构掌握,国内研究团队想做大规模实验,要么申请受限接口,要么从零自研,起步门槛很高。GLM-130B把权重、推理代码、评测脚本一并开源,率先让国内研究者能在千亿级模型上自由做二次开发,门槛被一次性拉低。

 

它的结构采用Encoder-Decoder,在中文语境下验证了大规模预训练的稳定性。更重要的是,开源动作本身打破了信息壁垒,下游高校和企业在它之上做微调、蒸馏、评测,形成了国产大模型早期的方法论积累,这些经验后来被复用到了更小的实用模型上。

 

 

从生态意义看,GLM-130B的价值超出模型本身。它证明国产团队既能训出大模型,又愿意把基座交出来,这种开放姿态为后来ChatGLM的社区繁荣埋下伏笔,也奠定了智谱开源优先的路线底色,后续每一代都延续了权重开放的节奏。

 

ChatGLM 阶段:把能力送到单卡可跑

 

GLM-130B证明了规模可行,但千亿模型部署成本太高,难以普及。ChatGLM-6B把对话能力压缩到消费级显卡可跑,配合量化让个人开发者也能本地部署,这一步把开源大模型从实验室带进了工位,普通工程师率先能在自己机器上跑起对话模型。

 

随后ChatGLM2、ChatGLM3在长上下文和工具调用上迭代,逐步具备可用的Agent能力。这一阶段智谱完成的关键转身,是从证明能训大模型到让大多数人用得上大模型,用户基数因此指数级扩张,社区里的教程、插件、微调方案也跟着丰富起来。

 

 

社区反馈又反哺了模型。海量二次开发和真实使用暴露的问题,被吸收进后续版本,形成开源特有的飞轮:用的人越多,模型迭代越快,这比闭源团队的有限测试覆盖得更广,也更能贴近真实场景里的长尾需求,产品因此更耐操。

 

GLM-5 系列:能力与协议同步升级

 

GLM-5阶段,智谱把上下文、多语言、指令跟随一并拉高,并在Hugging Face上持续放出权重,下载量随之累积。这一代开始,智谱不再只和国内开源模型比,而是直接对标全球开源前沿,竞争坐标系被主动放大到国际舞台。

 

协议层面也同步进化。从早期带限制条款的社区协议,到GLM-5.2采用MIT无限制开源,智谱把商用和本地部署的门槛降到较低。协议放开让企业敢于把它写进生产系统,反过来又推高了下载与采用,宽松许可和广泛采用之间是互相强化的关系。

 

 

能力加协议的双重升级,使GLM系列在全球开源版图里站稳。海外开发者开始把GLM当作非英语系强模型纳入工具链,这种跨地域采用是SOTA定位的前提,因为开源影响力本身就是全球维度的,只在单一市场受欢迎不算真正的全球前列。

 

GLM-5.2:站上开源 SOTA 的关键一役

 

GLM-5.2在Artificial Analysis综合榜单上进入全球前三,与多家闭源前沿同列。在Code Arena这类用户盲测中排名前列,在FrontierSWE等工程基准上距闭源前列仅一步之遥,这些结果把开源能打从口号变成了数据,也改变了行业对开源上限的想象。

 

架构上,IndexShare、DSA、MTP三项改动把1M上下文成本和推理延迟同时压下来,让开源模型在长且快且省上首次具备与闭源正面对抗的资本。能力、成本、协议三件同时成立,才构成真正的SOTA竞争力,单有跑分没有成本优势依然进不了生产。

 

智谱官方也把这代定位为排名靠前的开源模型。这种说法有基准支撑,也标志着国产开源模型从追赶者变成被追赶者。从GLM-130B破冰到GLM-5.2登顶,三年时间完成了位置反转,这条曲线对评估国产模型长期走势是很有参考价值的样本。

 

这段历史给行业的三个信号

 

其一,开源节奏决定生态位。持续放开权重比单次发大招更能积累开发者信任,GLM系列的下载量曲线说明了这一点,信任是慢慢攒出来的。其二,协议宽松是商业化的前置条件,MIT让企业敢用,用的人多又推高影响力,形成正向循环。其三,架构创新是开源对抗闭源的武器,光靠堆参数赢不了成本战,IndexShare这类设计才是关键。

 

对正在选型的企业,这段历史的启示是:看一款开源模型,别只看当下跑分,要看它三年里是否持续开源、协议是否宽松、架构是否还在进步。GLM从130B到5.2的轨迹,恰好满足这三条,这也是它值得进入候选清单的根本原因,短期分数会波动,长期路线更可信。

 

把这套判断用到实际采购,可以形成一个简单的打分表:开源连续性占三成,协议宽松度占三成,架构是否仍在迭代占四成。很多团队反过来,把跑分放到七成,结果选了能力强但协议受限、半年后无法续用的模型,反而增加了替换成本。GLM系列的参考价值,正在于它三项都不偏科,适合作为长期持有的底座而非一次性试用品。

 

对中小团队,这条路线的现实意义是门槛在持续下探。从GLM-130B要集群才能跑,到ChatGLM-6B单卡可玩,再到GLM-5.2能在国产硬件上低成本商用,每一步都把使用门槛往下降。这意味着早期没算力积累的公司,现在也能基于开源基座做产品,不必从零训模型。开源惯性的价值,最终体现在让更多团队有机会站上同一个起点。

 

行动建议

 

目前,智谱GLM已经在云巴巴平台上线。在云巴巴,你可以横向对比智谱GLM与同类产品的能力与价格,找到最适合你业务场景的AI解决方案。如果你正在评估大模型选型,或者想了解这款产品能为你省多少成本,云巴巴提供免费的产品咨询和方案对比服务。访问云巴巴,让专业顾问帮你做决策。

热门数字化产品

微加云学院企业培训平台微加云学院企业培训平台,多种培训模式,满足不同需求,培训更灵活,实时掌握学习进度,自动生成学习数据,帮管理者提升培训效果。提供高质量的培训课程,解决企业内部讲师少、课程研发能力弱的问题,将反复型培训流程化,提高效率,高性价比工具,降低培训成本。
跨境云手机跨境云手机,基于自主知识产权的磐玉蜂巢服务器及创新的容器化技术, 跨境云产品以“ 高安全性、高能效比、高性价比” 为价值理念, 持续构建丰富的ARM云产品矩阵, 帮助客户以更低成本获得安全稳定、绿色节能、高效敏捷的ARM云服务和云算力,为跨境直播带货,海外市场营销和进出口贸易,跨境电商出海创造更多可能。
腾讯云实时音视频TRTCTRTC 源自 QQ 音视频团队,是基于 QQ 20多年来的音视频技术积累,在腾讯云上部署售卖的 RTC 云服务。TRTC 支撑了腾讯会议、微信群直播、微信视频号直播、企业微信直播、腾讯课堂、全民K歌等业务是腾讯集团丰富的音视频场景的最佳实践输出。
橙色云CRDE智橙协同设计研发平台橙色云CRDE智橙协同设计研发平台是SaaS云原生平台,整合云CAD、项目管理、BOM管理等多功能,支持多终端、跨地域协同工作。它以云PLM与云CAD一体化为核心,提供一站式产品创新解决方案,推动企业数字化转型,实现高效、低成本研发设计。
艺赛旗桌面行为分析CDA艺赛旗桌面行为分析CDA,通过可视化录屏、用户行为数据化和基于大数据的智能行为分析,真实全面的记录“人”的行为,帮助企业防范信息泄露,避免商业欺诈,提高客户服务质量和员工工作效率。便捷、灵活的风险监管策略配置,更准确的定位员工的桌面操作行为和风险行为。
为你推荐
Qoder 知识引擎上手难在哪:让 Agent 读懂大仓库比写代码更值钱

Qoder 知识引擎把一次性的项目搜索转成可复用、会进化的工程能力。本文拆解知识卡如何把工程语义变成 Agent 可消费的结构化上下文,并结合 SWE-bench Pro 实测,讲清它为何能提升任务得分、压低成本波动。

2026-07-24
自主迭代 Agent 怎么炼成?Qoder 用 ComputerUse 跑通自进化闭环

Qoder 用 ComputerUse 跑通自主迭代 Agent,靠 Goal 模式、自验证、回归守卫与项目记忆搭成自进化闭环,让不熟技术栈的人也能交付生产级软件,评测优于 Codex。

2026-07-24
AI 助手有意识吗?QoderWork 记忆反思成长让搭子会进化

QoderWork 上线意识功能,由记忆、反思、技能进化组成闭环,让 AI 助手跨会话记住偏好、主动忘记过时内容、把高频流程固化为本领,额外成本仅主对话百分之五。

2026-07-24
AI Coding 瓶颈从模型转移到人:Qoder 工程实践里的三层委派与睡后 Token

Qoder 的工程实践显示,当 AI 产出超过 Token 成本,瓶颈从模型转到人的精力。本文讲清三层委派、睡后 Token 与 Harness 平台,帮研发团队把人前移到决策位。

2026-07-24
夜间折扣怎么薅?Qoder 放夜里的 Credits 打到两折

Qoder 全系夜间折扣上线,每晚十点到早八点切 Qwen3.7 低至两折,模型能力不变。Desktop、CLI、QoderWork、QoderWake、Cloud Agents 各自适合夜间无人值守场景,把大任务放心交给夜里。

2026-07-24
查看更多