大模型的“自我进化”剧本,今天多了一位重量级玩家。8月28日,腾讯混元发布并开源新一代大语言模型Hy4 preview:总参数770B、激活参数49B,上下文长度直接卷到100万token,定位“为生产力而生”。
这款模型瞄准软件工程、办公分析、游戏开发、科学研究四大硬核场景,但真正的重磅不是参数,而是它的研发方式——Hy4 preview首次参与自身研发的全链路:自己提出训练方案、运行实验、根据结果继续迭代,形成了初步的“递归自我改进闭环”;它还自主分析推理系统瓶颈,把端到端吞吐量较基线拉高31.8%。盲测成绩也拿得出手:腾讯163名内部专家、203个工程任务实测,Hy4 preview均分2.99/4,略优于GLM 5.3和Kimi K3。
“模型参与训练模型”,意义比跑分更深。让AI参与自己的研发,是通往自我进化型智能的关键一步——一旦这个闭环转起来,模型迭代速度就可能摆脱纯人力节奏。当然也要冷静:目前只是初步闭环,方向仍由人类工程师主导。更有意思的是打法:模型直接开源,定价照旧普惠(输入6元/百万tokens),加上今天上午阿里、智谱也密集上新,头部大厂正以约两个月一次的节奏,用开源生态抢占开发者。
一句话总结:当770B的巨无霸开始自己优化自己,AI竞争的下半场,比的是谁的“进化飞轮”转得更快。
AI 生成 . DeepSeek | 搜索综合