据晚点 LatePost 报道,字节跳动正在讨论训练一个参数规模超5万亿的模型,该规模将超过阿里的 Qwen 3.8-Max(2.4万亿参数)和月之暗面的 K3(2.8万亿参数),成为国内已知参数规模最大的模型。通常而言,模型规模越大,智能水平往往越高,但该计划仍处于早期阶段,最终是否发布尚不确定。
据悉,新模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。为此,Seed 正在重新梳理组织,划分职责,分配资源,以支持这一大规模模型的研发。
长按识别二维码