
姚顺雨空降半年,腾讯混元开进大模型第一梯队。
7 月,Hy3 正式版才刚出来,不到两个月,新一代旗舰模型Hy4 preview又来了。
770B 总参数、49B 激活参数、1M 上下文,Coding、Agent、科学研究和真实生产力能力全线往上抬。

在最新的 Code Arena WebDev 榜单上,Hy4 preview 已经冲到全球第 5、开源模型第 3。

混元开始真正挤进第一梯队了。
跻身第一梯队
Hy4 preview 继续采用 MoE 架构,总参数规模从 Hy3 的 295B 直接扩到了 770B,每次推理激活 49B 参数,上下文也从 256K 一步拉到了 1M。
规模上去了,也越来越能干活。
在软件工程和 Agent 相关评测里,Hy4 的提升很直观。
Terminal Bench 2.1 从 Hy3 的 70.8 上涨到 85.4;DeepSWE 则从 28.0 直接冲到 64.3,翻了一倍还多。
在主打长链路复杂开发任务的的 SWE-bench Pro 拿到 65.7,已经和 GLM-5.3、Kimi K3、GPT-5.6 Sol 这些旗舰模型挤到了同一个区间;

而且 Hy4 的实际落地能力,也能看出明显进步。
比如做一套国家古建筑 3D 数字卷宗,这是一个包含前端设计、Three.js 开发、3D 资产处理和交互逻辑的完整项目。
最终 Hy4 把故宫、布达拉宫、黄鹤楼、天坛、长城、福建土楼、莫高窟 7 个真实 3D 模型全部装进了一个可以直接操作的数字卷宗里。
还能实现三栏式卷宗界面、模型旋转缩放、自动播放演示、截图、全屏、中英文切换、多视图同步联动。

再换一个画风,让它做金融世界沙盘。
用户只需要改一个变量,比如" AI 资本开支下降 30%。"
然后整个系统就会自己推演这个冲击如何从宏观环境一路传导到产业链,再落到具体公司的收入、利润、现金流和估值。
它相当于搭好了一张完整的产业因果网络,把 AI 基建、芯片、HBM、云厂商之间盘根错节的关联全部封装进去。
只要改动一个参数,整张网络就会动态重新运转,谁受益、谁受损,各家估值跟着一起联动更新。

甚至连游戏引擎都开始直接接管。
在 Unreal 5 里,Hy4 可以通过 MCP 全程程序化搭建一张 500 米见方的黄昏森林 FPS:
地形、树木、岩石、植被、玩家属性、触发器、武器伤害、尸潮刷新逻辑,一路从环境美术搭到玩法和关卡。

但 Hy4 显然还没满足于"给人干活",它开始自己搞科研了。
Hy4 开始自己搞科研了
先看个最像 AI 研究员的,小模型后训练。
这一次 Hy4 直接坐到了 researcher 的位置,同时管理多个 Codex Session,让不同 Agent 分别尝试不同实验方向。
再根据每一轮结果判断哪些路线值得继续,哪些应该放弃,然后重新安排下一步探索。
最终在 8 项评测上,Hy4 组织多个 Codex 共同探索,全部优于 Codex 单独干活。

配合 Hyra,Hy4 preview 开始挑战机器学习力场分子动力学模拟。
在一个包含 32512 个原子的磷脂双分子层 SO3LR 任务里,它在已经高度优化的 JAX 实现基础上,又把速度提高了 2 倍,达到 54.9 ms/step。
单张高端 GPU,甚至可以容纳 30 万原子。

Hy4 还跑去解决了一个已经存在上百年的经典几何问题:
三维 Blaschke – Lebesgue 问题。
这个问题研究的是所有等宽三维凸体里,到底谁的体积最小?
数学界长期猜测答案可能是 Meissner 四面体,对应体积约 0.41986,但一直没有得到最终证明。
配合 Hyra,Hy4 preview 把这个问题已经证明的体积下界,从 0.380799 推进到了 0.41104。
距离 Meissner 四面体猜想,只剩大约最后 2% 的 Gap。

姚顺雨加入大半年,混元换挡了
Hy4 出来之后,一个绕不开的名字是姚顺雨。
优配网入口
他对大模型的一系列判断,正越来越具体地出现在混元的模型路线里。
今年 2 月,姚顺雨加入腾讯后的第一批研究成果公开。

研究抛出的最核心的问题是模型到底应该怎么继续变聪明。
过去几年,大模型最主流的进化方式是 Scaling,堆更多参数、灌入更多数据、投入更多算力。
这条路线当然远没有失效,Hy4 自己就是一个 770B 总参数的 MoE 大模型。
但姚顺雨此前反复讨论过一个问题:
当互联网里现成的人类高质量数据逐渐逼近上限,下一阶段的智能从哪里来?
在他的判断里,答案很大程度指向环境与经验。
模型不能一直坐在题库里学习人类已经留下来的答案,它得真正进入环境做事,在执行过程中得到反馈,再从自己的成功和失败里继续学习。
把这套思考放回混元过去半年的变化里,就能看到一些对应。
今年 4 月,姚顺雨加入腾讯后的第一张完整模型答卷 Hy3 preview,已经明显把 Agent 能力放到了更核心的位置。
到了 Hy3 正式版,这条路线继续强化。
模型发布一周后,Hy3 总调用量相比上一代 Hy2 增长超过 68 倍;在 WorkBuddy 主动选择模型的用户里,Hy3 占比已经达到 60%。

这两个数字虽然不能简单等同于模型能力,但至少说明了一件事:
混元开始真正进入用户的工作环境。
模型能力起来以后,腾讯紧接着又动了组织,把原来的大语言模型部门和多模态模型部门整合为基础模型部,统一交给姚顺雨负责:
开始尝试把原本分散的资源,接到同一套基础模型研发体系里。
来自软件工程、游戏、金融、安全等业务线的腾讯专家深度参与数据与需求建设,Hy4 也和 WorkBuddy、CodeBuddy 开展 Co ‑ Design 协同设计。
从 Hy3 到 Hy4,混元越来越多的能力增量出现在 Coding、Agent 和长程任务上。
技术理念、组织架构与产品侧需求开始形成服务模型迭代的协同合力。
姚顺雨加入半年,腾讯 AI 开进第一梯队了。
元股证券:ygzq.hk或许再一次见面,就可以问姚顺雨:腾讯怎么快起来了?
一键三连「点赞」「转发」「小心心」
欢迎在评论区留下你的想法!
— 完 —
� � 点亮星标 � �
科技前沿进展每日见交易系统怎么测试
多空炒股网提示:本文来自互联网,不代表本网站观点。