
GLM-5.3-Flash 这两天上线了 WorkBuddy,从参数表和跑分看,这版模型有点意思:总参数 320B,比 GLM-5.2 少了一半,但 Artificial Analysis Intelligence Index 拿了 57 分,和 Claude Opus 4.8 持平,正式挤进全球前沿模型区间。编程这边也一样,Z.ai Code Bench 的体感评估里和 Opus 4.8 打得有来有回。

先聊成本。这个模型是第一个用稀疏注意力加线性注意力混合架构的开源前沿模型,激活参数从 32B 降到 18B,层数从 92 砍到 45,差不多都减半。结果是注意力计算量降了 3.01 倍,KV 缓存降了 4.44 倍。对于要跑大量推理的企业用户来说,这个账很好算:推理便宜一半,能力没掉,这才是实打实的降本。
多模态这次是原生的,不是外挂。GLM-5 系列里第一个原生集成视觉能力的模型,做前端、游戏或者 3D 仿真时,模型能自己“看”产出结果,再根据视觉反馈迭代。官方给过一个挺硬的例子:不给任何外部素材,它自主跑了 16 个小时,搭出约 400 平方米的 3D 场景。这种长时程自主任务以前基本是大参数闭源模型的专利,现在开源侧也有了。
办公场景的优化也没落下。PPTX、PDF、DOCX、XLSX 这些格式的文档任务都做了针对性处理,模型能自查输出,还带审美判断:PPT 排版丑不丑它自己有数。行业侧,金融覆盖研究、报告生成、建模分析全流程;法律可以批注合同、起草文书,官方说法是“生成即可交付”,我对这个说法保留一点态度,但方向是对的。
最后提醒一句:目前算力紧张,WorkBuddy 只对订阅用户优先开放 GLM-5.3-Flash,高峰期可能要排队,等资源宽裕了才全量开放。想尝鲜的建议错峰用。

GLM-5.3-Flash 在 WorkBuddy 上的落地,给企业用低成本跑前沿模型能力提供了一个新选项。如果你正在为团队评估企业级 AI Agent 的选型与落地,可以直接找云巴巴聊聊。云巴巴是腾讯云 AI 智能体示范伙伴、腾讯 WorkBuddy 核心伙伴及官方授权服务中心,汇聚了 WorkBuddy、千问办公、TRAE Work 等多家主流 Agent 工具与方案,能结合你的数据边界、任务形态和团队能力,从选型对比、方案验证到陪跑落地提供一站式服务。欢迎咨询云巴巴,获取专属的 Agent 实施落地方案。


围绕跨境独立站访问慢的痛点,解析网宿科技全站加速WAS在海外节点布局、动静分离加速与智能调度上的能力,给出上线验证与运维建议。

围绕电商反爬与数据防抓取场景,拆解网宿BotGuard爬虫管理的识别机制与执行策略,给出评估维度、落地节奏与选型对比建议。

突发DDoS攻击如何应急?本文梳理攻击识别、流量牵引切换、业务降级保护、事后复盘与常态加固的完整处置流程,结合网宿DDoS云清洗的云端清洗机制,帮助企业把攻击造成的服务中断风险降到更低水平。

围绕网站动静分离这一加速基本功,解析网宿科技全站加速WAS在静态缓存、动态链路优化与统一调度上的能力,给出验证与持续调优建议。

面向金融业务场景,解析网宿网站安全监测在漏洞、内容、可用性三条线的监测能力,给出落地步骤、防护协同与合规选型建议。