腾讯混元Hy4上线首日就把队列挤爆:770B参数到底有多猛
技术笔记 0 次阅读

腾讯混元Hy4上线首日就把队列挤爆:770B参数到底有多猛

cover

8月28日那天,腾讯混元在 WorkBuddy 里悄悄上线了 Hy4 preview,本来没多少人注意,结果上线首日任务队列直接排起了长队。腾讯自己都没想到这么火,赶紧发公告道歉,说已经对推理集群做了紧急扩容。

770B 参数的模型,排队排到道歉

这次排队的核心,就是 Hy4 preview 这个模型。总参数 770B,激活参数 49B,上下文长度拉到了 1M——这个配置在开源模型里属于第一梯队。腾讯官方说,它在模型尺寸、上下文长度、数据规模上都做了大扩展,Agent 能力提升尤其明显,所以 WorkBuddy 里的智能体任务体验好了不止一个档次。

但问题也来了:高端算力总量就那么多,高峰并发一集中,队列就堵住了。腾讯的解决方案是紧急扩容推理集群,同时动态调配资源。不过公告里也说得实在:不排除个别时段还会排队。说白了,算力瓶颈不是发个公告就能立刻解决的。

排队了怎么办?官方给了两个过渡方案

如果你在 WorkBuddy 里遇到排队,官方建议了两条路。一是切回 Hy3 等其他模型,Hy3 的限免期延长到了 9 月 30 日晚上 23:59,白嫖窗口还挺长。二是非紧急需求错峰,晚上用的人少,排队概率低很多。

另外有两个细节值得注意。Hy4 preview 的限免只到 9 月 10 日,而且每天有免费额度限制,触发限频后页面会提示重置时间。它还是个纯大语言模型,没有图像、视频生成能力——你在 WorkBuddy 里发起生图、视频任务时,系统会自动切到别的多模态模型执行,这部分按正常规则消耗积分,不占用 Hy4 preview 的免费额度。

这事对开发者意味着什么

说实话,一个 preview 版本上线首日就能把队列挤爆,说明 Agent 方向的需求比想象中猛。对做 AI 应用的开发者来说,这算是个信号:模型能力上来了,用户是真的愿意用的,但推理成本和大规模部署的难度,依然是绕不开的坎。

我自己试了一下排队高峰期的体验,等了大概几分钟才进。虽然有点磨人,但模型回答的质量确实比之前稳了不少,尤其是多步骤任务的理解上。如果腾讯能把扩容持续做下去,等到 9 月 10 日限免结束前,这波热度估计还能再冲一波。

分享

评论 (0)

评论通过后显示

暂无评论,来写第一条吧 ✍️