混元 Hy4 preview:腾讯开源的生产力旗舰
欢迎来到从零开始学AI!今天咱们聊一个刚出炉的大新闻——腾讯发布了混元 Hy4 preview,而且直接开源了。
开源?就是说大家都能免费拿到、随便研究?
对。更关键的是,腾讯说它已经稳稳站在开源模型的第一梯队。今天我不急着报参数,先帮你把几个关键概念讲清楚,再看新闻才不晕。
好,那第一个概念是什么?
第一个叫专家混合,英文是 Mixture of Experts。你可以把它想成一家超大公司:公司挂了一万人的名,但接到活儿时,只叫其中一小队人上场。
哦,听起来省成本。
没错。混元 Hy4 preview 总参数有 7700 亿,但每次你提问,真正动起来的只有 490 亿。剩下的就像待命的同事,平时不占资源。这叫总参数和激活参数的区别。
所以看模型不能只数总人数,得看每次真正来干活的有多少。
正是。第二个概念是上下文长度。这次 Hy4 preview 能一次读 100 万个 Token,差不多是一整本书,或者你一整年的聊天记录。
一次读一整本书?我记笔记两页就满了。
对,这是它的记忆力。第三个概念才是开源。简单说,腾讯把模型的权重公开了,开发者能下载下来,部署在自己的服务器上,谁都能在它基础上再创造。
那新闻里具体说它强在哪?
它定位为生产力而生,主打三块:写代码、办公、做科研。腾讯请了 163 位内部专家,拿了 203 个真实工程任务做盲测,Hy4 preview 拿了 2.99 分(满分 4 分),略高于 GLM 5.3 的 2.92 和 Kimi K3 的 2.94。
险胜啊,顶尖那几名咬得很紧。
是的。再说几个真例子。办公场景里,它读了 72 张发票和三本公司规章,自己判断哪些报销能过。
三本规章我得看一个下午,它一下就扫完。
游戏开发更夸张。它通过一个叫 MCP 的接口接上了 Unreal 5 引擎,纯靠对话就做出了一款能玩的射击游戏,开发者再不断聊天去完善它。
不用手写代码?这太适合我这种手残党了。
科研也强。它跑了一个 32,512 个原子的分子模拟,每步只要 54.9 毫秒,比之前快 2.0 倍,一张高端显卡能装下 30 万个原子,对药物和新材料研究很有用。
等等,最让我起鸡皮疙瘩的是——这个模型还参与了改进自己?
对。Hy4 preview 参与了它自己的研发:提训练方法、定数据方案,甚至优化了跑它的底层代码,最后端到端速度提升了 31.8%。
这就像一辆车一边开,一边把自己的引擎重新设计了一遍。
比喻绝了。腾讯从今年 2 月重建了基础设施,大约每两个月发一个大版本,先发预览版收集真实反馈,再出正式版。这回 WorkBuddy 和 CodeBuddy 还限时两周免费。
那听众想试,会先拿它做什么?写报告、做游戏,还是搭个自己的小助手?
感谢收听从零开始学AI。下次你看到某模型参数巨大的标题,记得多问一句:每次真正来干活的,到底有多少?
我们下期见!