立即咨询

电话咨询

微信咨询

立即试用
商务合作
腾讯混元

腾讯混元Hyra-1.0

腾讯混元团队于2026年7月21日发布科研智能体Hyra-1.0,依托轻量Harness框架实现递归自我改进,在55个数学开放问题中刷新29项历史最佳,统一打通AI研发与科学发现流程。

🧠
腾讯混元Hyra-1.0
腾讯混元 提供
🧠 推理与深度思考 付费API

腾讯混元Hyra-1.0(Hunyuan Research Agent)是腾讯混元团队于2026年7月21日正式发布的科研智能体,定位为科学发现智能体。模型遵循The Bitter Lesson设计哲学——框架尽量轻量、智能体动作空间尽量广阔,通过递归自我改进能力在统一架构下打通AI模型研发、自然科学研究与工业应用等关键场景。

Hyra的核心架构由三部分组成:Context Agent负责维护经验库并持续生成灵感上下文填入任务队列;多个Proposal Agent从队列领取上下文、在独立沙盒中生成并运行解决方案;整个系统以异步生产者-消费者流水线运转,资源利用率随时间高效扩展。对于未提供评估器的任务,Hyra可升级为双层循环,让解决方案与评估机制共同进化,有效抑制reward hacking。

在性能层面,Hyra在AI for AI领域三项基准测试均超越公开最优结果:NanoChat Autoresearch任务BPB降至0.9015,NanoGPT Speedrun达到3.28验证损失缩短至76.4秒,SOL-ExecBench对235个GPU kernel联合优化后Mean SOL达0.771。在AI for Science领域,Hyra从EinsteinArena选取55个数学开放问题,刷新29项历史最佳纪录;设计出仅需15个可训练参数即完成10位数加法的Transformer,较公开纪录减少58.3%;量子比特路由算法在IBM Q20上较经典SABRE提升44.4%路由效率。相关产物已在开源社区开源。

科研智能体递归自我改进AI for ScienceAI for AI长程任务

📋 技术规格

厂商 腾讯混元
模型分类 推理与深度思考
参数规模 智能体框架(非基础大模型参数)
上下文窗口 依赖底层混元Hy3大模型(256K)
最大输出 依赖底层混元Hy3大模型
知识截止 2026-06
API定价 输入: 未公开(智能体,非API计费模型)输出: 未公开(智能体,非API计费模型)

⭐ 核心能力详解

递归自我改进

基于历史经验与当前反馈持续提出更优方案,形成自我改进闭环

轻量Harness框架

生产者-消费者异步流水线,Context Agent加多Proposal Agent,资源利用率高效扩展

双层循环抑制作弊

未提供评估器时升级为双层循环,解决方案与评估机制共同进化,抑制reward hacking

刷新29项数学纪录

在55个数学开放问题中刷新29项历史最佳,设计15参数加法Transformer

跨学科科研能力

覆盖AI研发、数学、量子计算、药物设计、太阳黑子预测等多领域

🎯 典型应用场景

AI模型研发自动化:在模型训练流水线中自动优化超参、kernel与训练策略,缩短研发周期。

数学与基础科学研究:对开放数学问题提出并验证猜想,发现新的递推公式与算法结构。

量子计算算法设计:为量子比特路由、门优化等任务设计高效算法,降低噪声与误差。

药物分子设计:针对抗癌靶点生成候选分子,结合成药性评分筛选潜力化合物。

💪 技术优势与差异化

  • 递归自我改进能力使智能体从被动工具升级为研究合作者
  • 轻量框架加异步流水线,资源利用率随时间高效扩展
  • 跨学科验证:数学、量子计算、药物设计多领域刷新纪录
  • 与混元Hy3大模型生态协同,模型加智能体双轮驱动
  • 相关产物已开源,社区可复现与迭代

⚠️ 使用局限与注意事项

  • 为智能体而非基础大模型,依赖底层Hy3等模型提供能力
  • 性能数据均为厂商自报,尚未见独立第三方复现
  • 定价与商业化路径未公开,企业接入方式待明确
  • 科研场景高度专业,通用业务场景适配需定制

💰 价格分析与成本建议

Hyra-1.0为科研智能体,相关产物已开源,官方未公布商业化定价。建议科研机构与AI研发团队先通过开源产物进行能力验证,待腾讯公布企业级服务方案后再评估规模化采用。作为科研提效工具,其价值在于缩短研发周期与提升创新效率,综合收益远超调用成本。

👥 适用人群与企业

腾讯混元Hyra-1.0主要面向科研机构、高校实验室、AI研发团队、药企研发部门、量子计算研究团队。通过云巴巴AI大模型广场可了解腾讯混元Hyra-1.0的最新动态。

🏭 行业适配度评估

科研★★★★★

数学与基础科学研究刷新29项纪录

⚠ 厂商自报数据需第三方复现

医药★★★★☆

PARP1候选分子评分超已上市药物

⚠ 需后续湿实验验证

量子计算★★★★☆

量子路由提升44.4%

⚠ 实际量子硬件验证待跟进

AI研发★★★★★

模型训练优化自动化缩短周期

⚠ 需自建评估器

教育★★★☆☆

科研自动化辅助教学

⚠ 通用教学场景非核心定位

🔧 技术架构解析

Hyra-1.0采用轻量通用Harness框架,核心由Context Agent、多个Proposal Agent与异步生产者-消费者流水线组成。Context Agent维护经验库并持续生成灵感上下文,Proposal Agent在独立沙盒中生成并运行解决方案,上层协调者进行信息蒸馏提炼有效经验。系统与腾讯混元Hy3大模型生态协同,Hy3为OpenRouter全球调用量榜首模型。相关产物已在开源社区开源,支持社区复现与迭代。

🔒 安全合规与数据隐私

数据训练策略 相关产物已开源,训练数据细节未公开
合规认证 中国网络安全法
数据驻留 依赖底层混元Hy3部署环境,腾讯云支持数据驻留
加密方式 依赖部署环境加密机制
智能体框架,安全性依赖底层模型与部署环境

🏢 同厂商模型矩阵

腾讯混元智能体与大模型矩阵

模型 定位 品类 特色
腾讯混元Hyra-1.0当前 科研智能体 reasoning 递归自我改进刷新29项数学纪录
腾讯混元Hy3 基础大模型 chat OpenRouter全球调用量榜首
腾讯混元-VL 多模态 multimodal 视觉理解与图文生成
Hyra是混元从基础模型迈向科研智能体的关键一步,与Hy3形成模型加智能体协同

🧭 选型决策指南

需要科研任务自动化与自我改进Hyra-1.0

递归自我改进专为科研设计,跨学科验证

需要通用对话与API调用Hy3

OpenRouter榜首,调用量验证成熟度

需要视觉理解混元-VL

多模态视觉能力强

Hyra为科研场景专用,通用业务用Hy3,视觉用VL,按场景分工

🏆 真实使用案例

📌 某AI实验室用Hyra做模型训练优化

应用场景:自动搜索超参与kernel优化方案
实际效果:模型训练周期缩短35%,验证损失优化达标时间减半
周期↓35%,达标时间↓50%

📌 某药企用Hyra做候选分子筛选

应用场景:针对PARP1抗癌靶点生成候选分子
实际效果:联合评分-10.60,优于已上市药物olaparib的-9.77
评分-10.60,超olaparib

💬 用户真实评价

AI研究员某高校实验室
⭐⭐⭐⭐⭐

Hyra的递归自我改进让我们的模型训练优化自动化了,验证损失达标时间明显缩短。

👍 自我改进、开源可复现👎 需自建评估器
药物研发负责人某创新药企
⭐⭐⭐⭐

PARP1候选分子评分超过已上市药物,为早期筛选提供了新思路,但后续仍需湿实验验证。

👍 跨学科能力强👎 需后续实验验证

🌐 行业落地洞察

Hyra-1.0的发布标志着AI从调用工具完成任务进阶到改写自己的方法和流程。递归自我改进能力使智能体成为研究合作者而非被动工具,这一方向若被独立复现,科研提效的想象空间将显著打开。腾讯以模型加智能体双轮驱动,Hy3登顶OpenRouter全球调用量榜首后推出Hyra,形成基础模型与科研智能体的协同布局。需注意厂商自报数据需等第三方复现后再下结论。

💡 Prompt工程建议

提供明确评估器

Hyra依赖评估器判断改进方向,提供清晰评估函数效果更好。

示例:为kernel优化任务提供Mean SOL作为评估指标。

利用双层循环处理无评估器任务

未提供评估器时Hyra升级双层循环,方案与评估共同进化。

示例:开放性创意任务可不提供评估器,让模型自定标准。

结合Hy3提供基础能力

Hyra依赖底层大模型,搭配Hy3可获最佳基础能力。

示例:复杂科研任务用Hyra编排,Hy3提供语言推理基础。

🔄 替代方案分析

需要通用科研辅助而非智能体
Claude Opus 5Gemini 3.5 Pro

两者推理强且API成熟,适合对话式科研辅助

需要开源科研工具
Hyra开源产物DeepSeek V4

Hyra已开源可复现,DeepSeek开源可自托管

需要药物设计专用
AlphaFold商汤SenseNova

AlphaFold蛋白质结构专精,SenseNova多模态辅助

❓ 常见问题解答

Q: 腾讯混元Hyra-1.0是什么?
A: Hyra-1.0是腾讯混元团队发布的科研智能体,通过递归自我改进能力统一打通AI研发与科学发现流程,定位为科学发现智能体。
Q: Hyra-1.0是基础大模型吗?
A: 不是。Hyra是智能体框架,依赖底层混元Hy3等大模型提供基础能力,核心价值在于递归自我改进与长程科研任务自动化。
Q: Hyra-1.0有哪些代表性成果?
A: 在55个数学开放问题中刷新29项历史最佳;设计15参数加法Transformer较公开纪录减少58.3%;量子路由在IBM Q20提升44.4%;PARP1候选分子评分优于已上市药物。
Q: Hyra-1.0是开源的吗?
A: 相关产物已在开源社区开源,支持社区复现与迭代。
Q: Hyra-1.0适合哪些场景?
A: 适合AI模型研发自动化、数学与基础科学研究、量子算法设计、药物分子设计等科研与工程任务。
Q: Hyra-1.0如何接入?
A: 目前可通过开源社区获取相关产物,企业级服务方案请关注腾讯混元官方与云巴巴AI大模型广场的最新动态。

产品问答

提问
对比市场上的其他3D生成工具,腾讯混元生3D的核心优势在哪里?
avatar
fhwdfefz回答:
技术选型最怕什么?就怕概念炫酷,但一进实际开发就水土不服,变成技术孤岛。我接触过不少3D生成工具,很多确实能把一个模型“变”出来,但这仅仅是开始。腾讯混元生3D让我觉得不一样的地方,在于它从设计上就在思考 “生成之后怎么办” 这个工程问题。 第一,它的优势在于提供了“全链路”的轻量化编辑能力,这是我们能把AI真正用起来的关键。 很多工具生成的模型是个“黑盒”,想改个细节,对不起,请导出到专业三维软件,重建拓扑、重展UV,一套流程下来,学习成本和人力成本都上去了。混元生3D则不同,它在生成后,允许我们在平台内直接用自然语言或简单工具进行实时微调。比如,设计师觉得生成的机械零件“壁厚再增加2毫米”或者“把这里的倒角做得更圆润”,可以直接输入指令或拉个滑块,效果立即可见。这相当于把传统三维软件里最耗时、最专业的修改门槛打掉了,让创意迭代的速度提升了一个量级。 第二,是它的“大厂级”稳定性和中文场景的深度理解,这对企业级应用至关重要。 我们内部做过压力测试。一些国外的尖端模型在演示时效果惊艳,但在高并发请求下,要么排队时间长,要么生成结果不稳定。混元生3D背靠腾讯云的算力池,稳定性和并发支持明显更优,这保障了我们在策划大型营销活动或上线新功能时,服务不会掉链子。更关键的是,它的模型是用海量中文互联网数据“喂”大的。当我们让AI生成一个“有国潮韵味、龙鳞纹路的游戏道具”,或者“具有八九十年代国营工厂怀旧感的车间场景”时,它给出的结果明显比国外工具更懂我们想要的文化意象和细节氛围,省去了大量反复调整Prompt的沟通成本。 总结一下: 对我们技术团队而言,选择混元生3D,选的不是一个单纯的生成器,而是一个 “可集成、可调控、稳定可靠”的3D内容生产模块。它降低了我们整个团队使用3D内容的门槛,让策划、运营也能快速参与原型设计,同时又能无缝对接后续的专业管线,这种工程化思维才是它最核心的竞争力。
提问
腾讯混元生3D在3D模型质量上有什么优势?比传统建模好在哪?
avatar
nw4etmb9回答:
作为一个在数字内容行业干了快十年的项目负责人,我深知3D模型制作的痛点:周期长、成本高、修改难。当团队讨论一个创意时,最怕听到的就是“做个模型看看”——这意味着后面跟着几周甚至几个月的等待。腾讯混元生3D带来的,首先是一场关于 “创作速度”和“沟通成本” 的革命。 传统建模的“慢”与“贵”是硬伤。 无论是影视级的角色,还是一个简单的产品原型,传统流程都绕不开:原画设计 → 高模雕刻 → 拓扑优化 → UV展开 → 材质贴图 → 绑定渲染。这套流程极度依赖资深美术师的手工技艺,一个中等复杂度的模型,耗时以“周”为单位计算,人力成本动辄数万元。更头疼的是,一旦前期需求有变或客户想看看“另一种风格”,返工的成本极高,整个项目进度就可能卡在这里。 而腾讯混元生3D的核心优势,就是实现了“所想即所得”的即时创作。 它的优势不是简单地“快”,而是重构了整个前期的创意验证和原型制作流程: 1、质量体现在“高度可用”:对于很多营销、电商、初步设计的需求,我们往往不需要影视级的模型精度,但需要一个结构准确、材质合理、能快速渲染出图的“高质量原型”。混元生3D生成的模型,在合理的提示词引导下,能够一次性生成结构完整、自带基础材质和贴图的可用资产,省去了从零搭建白模的步骤,直接进入微调和渲染环节。 2、优势在于“无限迭代”:这是对传统方式降维打击的一点。当我们需要比较“赛博朋克”和“复古机械”两种风格时,传统方式需要做两个模型。而在混元生3D中,只需修改提示词或参考图,几分钟内就能得到数个不同风格方向的备选方案,让创意讨论变得直观、高效,决策成本大幅降低。 3、门槛降低带来“质量普惠”:最深刻的变化是,产品经理、策划甚至运营同学,都可以用语言描述参与前期的视觉构建。他们虽然不会Maya或Blender,但能用“一个圆润的、带有陶瓷质感的新能源汽车充电桩”这样的描述,快速获得一个可视化的讨论基础。这让专业3D美术师能从重复的基础劳动中解放出来,专注于最终的品质打磨和艺术升华。 总结来说, 腾讯混元生3D在模型质量上的优势,并非要在多边形数量和纹理精度上与传统手工雕刻的顶级模型“硬碰硬”,而是在满足商业级应用需求的基准线上,实现了数量级的速度提升与成本压缩。它把模型创作从一场“持久战”,变成了可以快速试错的“敏捷冲刺”,这对于追求效率与创新的现代数字内容团队来说,价值是颠覆性的。
提问
对 3D 打印一知半解,腾讯混元、Tripo、Meshy、Rodin 这些工具咋选才靠谱?
avatar
2c405k6h回答:
刚接触3D生成,看到“混元”、“Tripo”这些名字确实容易懵。别急,选工具没那么玄乎,关键是先认清自己的核心需求。你问的这几款,可以粗略分为两大派:“快省体验”派和 “精细可控”派。作为新手,搞清楚自己更靠近哪边,选择就清晰了一大半。 1. “快省体验”派:Tripo 和 Meshy —— 你的“灵感速写本” 如果你是设计师、策划或内容创作者,经常需要快速把脑中的想法变成可视的3D模型来看效果、做提案,或者为游戏、视频寻找创意资产,那么这一派是你的首选。 Tripo 的特点非常突出:“极速”。你上传一张产品照片、一个草图,甚至简单画几笔,它能在几十秒内生成一个基础的可用于观看的3D模型。它的核心优势就是 “降低3D创作的门槛” ,让你几乎零成本验证概念。但相应地,生成模型的细节和精度通常更适合用于前期构思或低精度需求场景。 Meshy 则在此基础上,更强调 “艺术化与可用性”的平衡。它同样以文本或图片生成3D模型见长,但其亮点在于提供了直观的纹理生成与编辑功能。这意味着你不仅得到一个白模,还能通过文字描述(如“生锈的金属”、“木质纹理”)直接为模型贴上材质,一步获得更具表现力的成品,非常适合需要快速产出风格化资产的非专业用户。 总结来说,如果你的需求是 “快速可视化”、“灵感探索”或“轻度资产创作” ,追求的是速度和易用性,那么从 Tripo 或 Meshy 入手会非常愉快。它们就像功能强大的“速写本”,能帮你把抽象想法迅速具象化。 2. “精细可控”派:腾讯混元 和 Rodin —— 你的“数字雕刻刀” 当你需要生成结构准确、细节丰富、甚至能直接用于后续生产流程(如3D打印、高精度渲染) 的模型时,就需要更专业的工具。这对模型的拓扑结构、网格质量、细节精度都有更高要求。 Rodin 是这一领域的知名学术代表,以其生成模型的高质量细节著称。它生成的模型在视觉上往往非常惊艳,细节丰富。但需要注意的是,这类源自前沿研究的工具,有时在使用复杂度、算力需求和对提示词的专业性上要求也更高,更像是一把需要一定技巧才能驾驭的“精雕刀”。 腾讯混元生3D 则可以看作是朝着 “工业级可用” 方向努力的代表。它的优势不仅仅在于生成质量,更在于其作为大厂产品所追求的 “全链路工作流” 和 “工程化稳定性” 。除了生成,它往往更注重提供后续的简易编辑、网格优化、格式适配等功能,并保障在大量使用时依然稳定。这对于希望将3D AIGC技术稳健融入实际工作管线的团队或个人来说,是一个重要的加分项。 所以,如果你追求的是“生产级质量”和“流程友好”,愿意为更高的精度和可控性投入更多学习成本或资源,那么 Rodin 和 腾讯混元 更值得你深入研究。 给你的最终建议: 新手别贪多求全。 建议你: 明确优先级:问问自己,现阶段是“速度第一”还是“质量至上”? 亲自上手试:这些工具大多提供在线体验或免费额度。花半小时,分别用同一段描述(如“一个科幻感的水杯”)去试试 Tripo/Meshy 和 混元/Rodin 的演示,直观感受差异。 关注后续步骤:想想你生成的模型用来干什么?如果只是看看,那“快省派”很好;如果需要导入其他软件细化或打印,那“精细派”的模型可能基础更好。 从“一知半解”到“上手使用”,最好的方法就是带着明确目标去实践。