共计 1168 个字符,预计需要花费 3 分钟才能阅读完成。
半年重建, 腾讯再交卷:5 分钟生成 3D 跑酷小游戏, 混元 Hy3 正式发布
📌 半年重建后,Hy3 进入正式版本
据公开信息, 腾讯混元在今年 1 月底启动底层基础设施重建,4 月推出 preview 版本, 随后在 7 月发布 Hy3 正式版。相比单纯追求模型规模, 腾讯此次更强调“模型与产品共同设计”的路径: 模型进入办公、知识管理、开发工具等场景, 再由实际使用反馈推动迭代。
🔍 核心参数: 大总参、小激活与长上下文
Hy3 采用快慢思考融合的 MoE 架构, 总参数为 295B, 激活参数为 21B, 并支持 256K 上下文长度。这样的设计思路是: 保留较大的知识容量和复杂任务承载能力, 同时在推理时只调用部分权重, 以降低成本和时延。
腾讯披露的内部盲测显示,Hy3 在部分工程类任务中表现较突出 , 尤其涉及前端、数据与存储、CI/CD 等开发场景。不过, 这类评测结果仍需结合更多第三方测试和真实用户反馈继续观察。
💡 真实业务中的改进: 办公、Agent 与开发工具
Hy3 的一个关键信号, 是被嵌入多个腾讯产品与内部工具中测试 。公开材料显示, 在办公场景内部测评中, 任务成功率从 72% 提升至 90%, 平均耗时缩短 34%。元宝、ima、Marvis、公众号 AI 分身、WeGame AI 助手等产品也获得不同程度的能力更新。
- 降低幻觉: 内部评测中幻觉率从 12.5% 降至 5.4%, 常识错误率从 25.4% 降至 12.7%。
- 增强多轮对话: 多轮问题率从 17.4% 降至 7.9%, 长对话基准 MRCR 从 42.9% 提升至 75.1%。
- 提升工具调用: 针对不同开发脚手架进行泛化优化, 减少环境切换带来的表现波动。
- 优化成本: 在高频办公任务中, 文档处理和 PPT 制作的 token 消耗被披露有明显下降。
📊 价格与开源: 降低开发者试用门槛
商业化策略方面,Hy3 延续低单价路线: 输入 1 元 / 百万 tokens, 输出 4 元 / 百万 tokens, 命中缓存为 0.25 元。对于企业和开发者而言, 价格能否支撑高频调用, 是模型落地时绕不开的问题。
开源方面,Hy3 采用 Apache 2.0 协议, 允许免费商用, 并已接入 Hugging Face 与 ModelScope, 后续还计划覆盖更多海外平台。低门槛开源有助于扩大开发者试用规模, 但生态能否形成, 还取决于模型稳定性、工具链适配和社区反馈。
🚀 行业观察: 大模型竞争正在转向“能不能办成事”
材料中提到,Hy3 曾在 WorkBuddy 中生成一款单文件 3D 跑酷小游戏, 浏览器可直接打开运行, 整个过程约 5 分钟。这个案例的意义不在于游戏本身复杂度, 而在于模型能否处理需求拆解、代码生成、本地依赖引用、交互逻辑和运行细节。
对大模型行业来说,Hy3 的看点在于腾讯是否能把产品矩阵转化为持续反馈优势 。未来竞争可能不再只是参数、榜单和发布节奏, 而是模型在真实流程中是否可靠、便宜、可复用。