据了解,字节跳动正在讨论训练一个参数规模超5万亿的模型,它超过阿里的Qwen 3.8-Max(2.4 万亿参数)和月之暗面的K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。通常而言,模型规模越大,智能水平往往越高。不过该计划仍处于早期阶段,并不代表模型最终一定会发布。
新模型将由Seed Foundation负责人项亮主导,与大语言模型预训练数据负责人沈科合作。为此,Seed正在重新梳理组织,划分职责,分配资源。
多位字节人士告诉我们,上半年,Seed许多团队也在不断反思。这是字节讨论训练超5万亿参数模型的原因之一,与其在现有尺寸上继续追赶,不如把参数规模一次推到同行的数倍,争取领先位置。“像一场赌博。” 一位接近Seed人士说。
字节自成立一直以来推崇 “大力出奇迹”:进入一个领域时,通常会成立不止一个团队,投入大量资源,同时推进多个项目。(《晚点 LatePost》)
风险提示及免责条款
市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。