腾讯突然甩出 Hy4 preview!WorkBuddy 首发接入,免费两周赶紧用

就在刚刚,腾讯混元发布了新一代旗舰模型 Hy4 preview

这次更新不只是参数规模变大。Hy4 preview 明显把重心放在了更难、更长、更接近真实工作的任务上:写代码、处理办公任务、解决复杂科研问题、调用工具,以及自主组织多轮实验。
更直接的好消息是,WorkBuddy 国内版、国际版已经同步首发接入 Hy4 preview

从现在起,用户可以直接在 WorkBuddy 里选择新模型体验,限时免费至 2026 年 9 月 10 日 23:59

Hy4 preview 是什么?

按照腾讯混元官方公布的信息,Hy4 preview 是 Hy4 的早期预览版本,也是面向下一代复杂任务的新旗舰模型。
它采用 MoE 架构:

  • • 总参数:770B
  • • 激活参数:49B
  • • 上下文长度:1M

770B 决定了模型的知识与能力容量,49B 激活参数则意味着每次推理只调用其中一部分参数,在能力与推理效率之间做平衡。
而 1M 上下文的价值,不只是一次能“塞进去更多文字”。
对于真实工作,它意味着模型可以一次处理更长的代码仓库、更多项目文档、更复杂的研究材料和更完整的任务历史,减少因为上下文被截断造成的信息丢失。

这次升级,重点不只是“会回答”

从官方展示的案例看,Hy4 preview 想解决的核心问题,是让模型从回答问题走向完成复杂任务。

1. 代码能力更贴近真实项目

简单生成一段代码,已经不是现在大模型竞争的重点。
真实开发往往需要理解项目结构、跨文件修改、调用工具、运行测试、发现错误,再根据结果继续修正。Hy4 preview 强调的正是这种长链路代码任务能力。
官方还展示了 Three.js、原生 WebGL、Canvas 程序化纹理等案例。模型不仅要写出代码,还要兼顾镜头节奏、交互逻辑、视觉连续性和移动端性能。
换句话说,它面对的不是一道孤立的编程题,而是一个需要持续推进的小型工程。

2. 办公任务更强调“交付结果”

在办公场景里,真正耗时的通常不是写一句话,而是:

  • • 阅读大量材料并提炼重点
  • • 整理文档、表格和报告
  • • 将模糊需求拆成执行步骤
  • • 多轮检查结果并继续修改

1M 上下文配合工具调用能力,让 Hy4 preview 更适合承接这类包含大量资料、多个步骤和明确交付物的任务。
这也是它接入 WorkBuddy 后最值得关注的地方:模型能力不再停留在聊天窗口,而是可以进入一个更完整的任务执行环境。

3. 科研推理进一步增强

腾讯混元表示,Hy4 preview 显著提升了复杂科研问题的理解、推理与求解能力,覆盖 AI 研发、分子动力学模拟、凝聚态物理等方向。
科研任务的难点,往往不是记住一个答案,而是理解问题、提出假设、设计实验、分析结果,再不断调整方向。
官方案例中,Hy4 preview 可以像研究者一样管理多个 Codex Session 开展实验。在小模型后训练任务里,它作为 researcher 协调多组实验,并根据评测结果持续调整探索方向。
这类能力说明,Hy4 preview 正在尝试承担更高层的任务:不只是执行命令,也参与判断下一步应该做什么。

4. 能自主发现瓶颈并持续优化

官方还公布了一个推理系统优化案例。
Hy4 preview 自主分析系统瓶颈,围绕算子融合、通信优化等方向开展多轮调整,最终让端到端吞吐相较基线提升 31.8%
这个案例值得关注的地方,不只是 31.8% 这个结果,而是完整过程:
发现问题 → 提出方案 → 执行实验 → 读取反馈 → 继续优化。
这正是 Agent 要完成复杂任务时最关键的闭环能力。

WorkBuddy 已经首发接入

模型发布后,普通用户最关心的问题通常只有一个:在哪里能用?
目前,WorkBuddy 国内版和国际版已经同步首发接入 Hy4 preview
打开 WorkBuddy,在模型选择区域切换到 Hy4 preview,就可以把它用于代码、文档、数据分析、资料研究等任务。
相比只在对话框里测试几个问题,更建议直接拿一个真实任务体验,例如:

场景一:处理一个已有代码项目

可以把目标直接描述清楚:

阅读当前项目,定位启动失败的原因,修复问题并运行测试。不要只给建议,请直接完成修改,并说明改了哪些文件。

这类任务更容易看出模型是否能理解代码结构、使用工具、根据报错继续修正。

场景二:整理一批复杂资料

例如:

阅读这些项目资料,提取核心结论、争议点和待确认信息,整理成一份适合管理层阅读的报告,并附上可执行的下一步计划。

长上下文能力在这里会更有价值,因为模型需要同时保持多个文档之间的关系。

场景三:完成研究型任务

例如:

围绕这个技术问题制定研究方案,拆分可验证的假设,设计实验步骤,并根据每轮结果调整下一步方向。

这类任务能够更直接地测试 Hy4 preview 的复杂推理、实验组织和持续迭代能力。

免费体验时间与使用边界

Hy4 preview 在 WorkBuddy 内的免费体验截止时间为:
2026 年 9 月 10 日 23:59。
体验前还有两点需要注意。
第一,Hy4 preview 是大语言模型,暂不具备多模态能力。如果要求它生成图片或视频,WorkBuddy 会切换到其他多模态模型完成,因此会按照正常规则消耗积分。
第二,限免期间设有每日免费额度。达到当日限额后,可以消耗积分继续使用,页面会提示额度重置时间;资源繁忙时也可能需要排队。
因此,“限时免费”并不等于无限量使用,最终可用额度和排队状态以 WorkBuddy 页面显示为准。

Preview,也意味着它还在快速迭代

腾讯混元明确说明,Hy4 preview 是 Hy4 的早期版本,预训练和后训练仍有较大的提升空间。
当前已知问题包括:面对复杂任务时可能出现较长思考,以及过度自我验证的倾向。
这也是 preview 版本最需要理性看待的地方。
它展示了更强的能力上限,但不代表每一次任务都能稳定得到理想结果。涉及重要代码、数据、研究结论和业务决策时,仍然需要人工检查;上传企业资料或个人信息前,也要确认权限与隐私边界。

写在最后

Hy4 preview 最值得关注的,不只是 770B 参数或 1M 上下文。
更重要的是,它正在把大模型的能力推向真实任务:阅读更长的上下文,调用更多工具,管理更复杂的过程,并根据反馈持续修正。
而 WorkBuddy 的首发接入,让这次模型发布不再只是参数和榜单上的比较。用户可以直接把它放进自己的代码项目、办公资料和研究任务里,看看它究竟能不能交付结果。
与其只问它“你有多强”,不如给它一个一直没空处理的真实任务。
开源链接:

模型体验:

转自:https://mp.weixin.qq.com/s/P50rU5XQ_Y2_-f0Li9mx8Q