头部广告

字节讨论训超5万亿参数模型,争取领先位置

日期:2026-08-06 20:59:59 栏目:sql 阅读:
Python编程报道,8月6日消息,据了解,字节跳动正在讨论训练一个参数规模超 5 万亿的模型,它超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。通常而言,模型规模越大,智能水平往往越高。不过该计划仍处于早期阶段,并不代表模型最终一定会发布。
新模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。为此,Seed 正在重新梳理组织,划分职责,分配资源。
多位字节人士告诉我们,上半年,Seed 许多团队也在不断反思。这是字节讨论训练超 5 万亿参数模型的原因之一,与其在现有尺寸上继续追赶,不如把参数规模一次推到同行的数倍,争取领先位置。“像一场赌博。” 一位接近 Seed 人士说。
字节自成立一直以来推崇 “大力出奇迹”:进入一个领域时,通常会成立不止一个团队,投入大量资源,同时推进多个项目。(《晚点 LatePost》)

我来作答

关于作者

4265

提问

193万+

阅读量

0

回答

0

余额

14万+

被赞

14万+

被踩