腾讯Hy3正式版上线,姚顺雨半年交卷

Hy3正式版官方公布的12项评测维度,横向对比模型包括GLM-5.2、DeepSeek V4 Pro、Qwen 3.7 Max、Seed-2.1 Pro、GPT-5.5和Claude Opus 4.8。

短板:暴力、幻觉与冷门技术栈


但对于这篇报告的主角而言,故事才刚刚开始。Hy3 正式版是姚顺雨自去年 12 月空降腾讯、接掌混元大模型部后交出的首份核心成绩单。这位前 OpenAI 研究员顶着“彻底重建团队”的巨大压力,在短短半年内通过极务实的后训练与短板对齐,将混元从早期的结构性缺陷中拉了出来,
起点课堂会员权益




Hy3正式版延续295B参数和256K窗口,不跟风长上下文,重点压榨推理和Agent能力。评测上务实偏科,搜索和Agent强,数学和工具调用弱。姚顺雨的实用主义AI理念落地,但腾讯内部组织博弈才是下一场硬仗。