
混元 Hy3首发接入 WorkBuddy 后开启两周限免体验,因用户量激增导致算力紧张、排队率超50%,腾讯紧急扩容后将限免延长至8月5日。本文还原这一事件脉络并解读背后的用户需求信号。
2026年7月6日,腾讯混元正式发布新一代大模型 Hy3。这款基于 MoE 架构的推理模型在参数效率和任务表现上实现了显著突破——总参数量2950亿但激活参数仅210亿,最大支持256K 上下文窗口,在办公场景中的任务成功率从72%提升至90%,平均耗时缩减34%。这样一组技术参数让 Hy3在发布之初就获得了业界的广泛关注。
紧随其后,WorkBuddy 作为首批接入 Hy3的应用平台,面向用户开启了为期两周的限时免费体验活动。活动的初衷是让现有用户在真实使用场景中感受新模型带来的能力提升,同时收集反馈以进一步优化模型表现。按照最初的预期,两周的体验周期足以让活跃用户充分评估 Hy3在日常工作中的实际价值。
然而事态的发展超出了预期。活动上线后,用户对 Hy3的使用热情持续攀升,大量用户将原本在其他模型上完成的工作迁移到了 Hy3。无论是复杂的数据分析报告生成、多步骤的代码调试,还是需要长上下文理解的文档梳理,用户在这些高难度场景中对 Hy3表现出了明显的偏好。这种偏好的形成并非偶然——Hy3在任务成功率和响应速度上的双重提升,让用户在实际使用中能够直观感受到效率的差异。
随着使用量的快速增长,算力资源的供需矛盾开始显现。7月20日前后,部分时段的用户请求排队率超过了50%。这意味着每两个发起任务的用户中就有一个需要等待算力资源释放才能开始执行。对于一款定位为效率工具的 AI 办公产品而言,这样的等待时间直接影响了用户体验的核心指标——从提出需求到获得结果的时间间隔。
排队现象的出现从侧面反映了 Hy3在用户群体中的受欢迎程度。用户愿意等待而非转向其他可用模型,说明 Hy3在实际使用中建立起了足够的价值认知。但另一方面,这也暴露了算力基础设施在面对突发性需求增长时的弹性不足。
面对算力紧张的局面,腾讯方面迅速启动了紧急扩容程序。扩容工作涉及多个层面的协调:在硬件层面需要调配更多的 GPU 计算资源,在软件层面需要优化任务调度算法以提升资源利用效率,在服务层面需要在扩容过程中尽量减少对在线用户的影响。整个扩容过程在较短时间内完成,排队情况随之得到缓解。
这次紧急扩容的价值不仅在于解决了眼前的算力瓶颈,更重要的是它验证了 Hy3服务体系的弹性和可伸缩性。对于一款面向大规模用户群体的 AI 服务而言,能否在需求激增时快速响应并保障服务质量,是衡量其成熟度的重要标尺。此次事件的处置过程和结果,为用户继续信任和使用 Hy3提供了信心支撑。
腾讯公司公关总监张军在社交平台上表示,收到不少用户再来两周的强烈呼声,基于此决定将 Hy3限时免费活动延长至8月5日。这一决策背后反映的是用户在两周体验期内形成的使用习惯和路径依赖。
行为经济学中的禀赋效应可以部分解释这一现象——当用户在一段时间内习惯了某种更高水平的服务体验后,他们对这种体验的主观估值会显著提升。Hy3在任务成功率和处理速度上的优势,让用户在两周时间内建立了新的效率基准线。一旦这种基准线被确立,回到之前的体验水平就会产生明显的落差感。这种落差感正是用户呼吁延长限免期限的心理动因。
更深层次的原因在于,Hy3已经在这两周内嵌入了用户的日常工作流程。WorkBuddy 作为一个全场景 AI 办公工作台,其价值实现依赖于用户与智能体之间建立的默契配合——用户学会如何更精准地描述需求,智能体通过持久化记忆了解用户的工作习惯和偏好。当用户将 Hy3设定为默认模型后,这套人机协作体系就开始围绕 Hy3的能力特征进行自我优化。
在这种情况下,更换模型不仅仅是切换一个技术选项那么简单,而是意味着整个人机协作体系需要重新磨合。这种切换成本的存在,使得用户对继续使用 Hy3产生了实质性的依赖。用户呼吁延长限免,本质上是在争取维持已经建立起来的高效工作模式。
Hy3限免事件反映出大模型行业的竞争焦点正在发生转移。早期的大模型竞争主要集中在参数规模、评测分数等硬指标上,而当前的竞争则越来越聚焦于用户在真实使用场景中的实际体验。Hy3之所以能够在短时间内获得大量用户的青睐,关键不在于纸面参数的领先,而在于它在办公场景中带来的可感知效率提升。
这种体验驱动的竞争格局对用户而言是一个积极信号——它意味着厂商必须持续关注产品的实际使用效果而非仅仅追求技术指标的突破。对于 WorkBuddy 这样的应用平台来说,选择接入哪些模型、如何优化模型与产品功能的协同,都将成为影响用户满意度的关键决策。
此次 Hy3限免延期事件也展示了限免策略在大模型推广中的双向价值。对用户而言,限免降低了尝试新技术的门槛和风险,使他们能够在零成本的前提下评估模型的实际价值。对厂商而言,限免不仅是获取用户反馈的有效手段,更是培养用户习惯、建立品牌认知的长期投资。
值得注意的是,本次限免的对象明确指向 WorkBuddy 和 CodeBuddy 用户群体,这种针对性的策略设计体现了腾讯在 AI 产品矩阵内部的协同思路——通过核心产品的限免活动带动整个生态的用户活跃度和粘性。
Hy3限免延期至8月5日只是一个阶段性安排,更长远的挑战在于如何让高性能的 AI 能力以可持续的方式服务于广大用户。算力资源的有限性与用户需求的无限性之间的矛盾,是所有 AI 服务提供商都需要面对的结构性问题。
解决这一矛盾的可能路径包括技术层面的持续优化和商业模式的创新探索。在技术层面,MoE 架构本身就是一种提高参数效率的方向——通过只激活必要的专家网络来处理特定任务,可以在保持模型能力的同时大幅降低推理成本。在商业模式层面,分层化的服务体系和差异化的定价策略可以让不同需求的用户找到适合自己的使用方案。
WorkBuddy 在此方面的布局已经初具雏形——平台提供了从体验到旗舰的多档订阅方案,每种方案对应不同的积分额度和模型访问权限。这种分层设计既保障了基础用户的可及性,也为重度用户提供了充足的能力供给。Hy3限免事件的经验和数据,将为进一步优化这套体系提供有价值的参考。
目前混元 Hy3 已在 WorkBuddy 国内版上线,限时免费活动已延长至 8月5日。活动期间,WorkBuddy 和 CodeBuddy 用户均可在平台内切换至 Hy3 模型免费使用。限免结束后,Hy3 将纳入 WorkBuddy 常规模型矩阵,用户可通过以下订阅方案继续使用:
版本 | 月付价格 | 连续包月 | 连续包年 | 每月基础积分 | 每月加赠积分(限时) | 每月实得积分(限时) |
|---|---|---|---|---|---|---|
体验版 | 免费 | — | — | 500 | — | 500 |
标准版 | 99 元/月 | 70 元/月 | 672 元/年 | 2,000 | 2,000 | 4,000 |
高级版 | 199 元/月 | 140 元/月 | 1,344 元/年 | 4,000 | 5,000 | 9,000 |
旗舰版 | 999 元/月 | 700 元/月 | 6,720 元/年 | 20,000 | 30,000 | 50,000 |
订阅折扣说明:连续包月享 7 折,连续包年在年付 7 折基础上再享 8 折(即 5.6 折)。加赠积分自到账日起 1 个月内有效。
版本 | 按月购买 | 按年购买 | Credits 额度 | 起购要求 |
|---|---|---|---|---|
SaaS 企业版(旗舰版) | 198 元/人/月 | 2,376 元/人/年 | 2,000 Credits/人/月,每月刷新,团队内共享 | 1 个坐席起购 |
专有云企业版(专享版) | 316 元/人/月 | 3,792 元/人/年 | 2,000 Credits/人/月,每月刷新,团队内共享 | 100 个坐席起购 |
企业版限时活动:2026 年 7 月 1 日至 9 月 30 日期间,新购、续费或扩容企业旗舰版或企业专享版,系统将按 2,000 Credits / 账号 / 月 的标准额外赠送(基础积分之上再加赠同等额度,即每月实得翻倍),赠送 Credits 自到账日起 6 个月有效。
想了解更多关于 WorkBuddy 的功能详情与最新活动,欢迎访问 腾讯云 WorkBuddy 活动页 。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。