2026 年 8 月 7 日,《金融时报》报道,字节跳动正在训练一款超大规模 AI 模型,目标参数规模最高可能达到 10 万亿。

目前仍处于该模型的预训练阶段。
通常情况下,大模型预训练需要 3 至 6 个月,完成后还需要进行模型微调,最终版本的参数规模将在后续阶段确定。
如果按照 10 万亿参数规模推进,字节跳动的新模型将成为中国目前已知规模最大的 AI 模型之一,并接近甚至超过业内对 Anthropic 下一代前沿模型的估计。
Anthropic 并未公开模型参数规模,但业内估计,其最先进的 Mythos 5 模型参数规模约为 8 万亿,另一款前沿模型 Fable 5 约为 5 万亿。
参数数量只是衡量模型规模的重要指标之一,模型实际能力还受到训练数据质量、算法优化以及工程能力等因素影响。
负责模型研发的 Seed 团队目前约有 2000 名成员,分布在中国及海外,包括 AI 研究人员、基础设施工程师、数据团队以及翻译团队。
8 月 6 日,《晚点 LatePost》报道,字节跳动正在讨论训练一个参数规模超 5 万亿的模型,新模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。《字节:筹划训练超 5 万亿参数模型》
云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。


网友留言2