据英国《金融时报》消息,字节跳动正秘密推进一项规模庞大的AI模型训练计划,其参数量级可能直逼美国顶尖实验室Anthropic的旗舰产品Mythos系统。这一动向被视为中国科技企业在人工智能领域加速追赶全球领先者的关键信号。
三位不愿具名的知情人士透露,字节跳动正在开发的超大型模型参数量最高可达10万亿级别,目前尚处于早期训练阶段。若按当前规划推进,该模型规模将超过国内已发布的最大模型——月之暗面Kimi K3的三倍以上。此前《晚点 LatePost》也曾报道字节跳动讨论过超5万亿参数的模型开发计划,但此次披露的规模上限远超预期。
训练进程显示,该模型目前处于预训练阶段,通常需要3-6个月完成基础能力构建。知情人士强调,最终参数规模可能根据训练效果动态调整,需待项目后期才能确定。这种"边训练边优化"的模式在超大规模模型开发中较为常见,旨在平衡计算资源消耗与模型性能。
对比国际竞争格局,Anthropic虽未公开Mythos系统具体参数,但行业估算其最新版本Mythos 5约含8万亿参数,另一型号Fable 5则约5万亿参数。值得注意的是,参数规模并非决定模型能力的唯一因素,数据质量、训练架构等要素同样关键。字节跳动此次选择直接冲击10万亿参数量级,被解读为试图在基础能力层面建立代际优势。
国内大模型竞争格局正发生微妙变化。阿里Qwen 3.8-Max以2.4万亿参数领跑,月之暗面K3以2.8万亿参数紧随其后。字节跳动若成功推出超5万亿参数模型,将重新定义国内技术天花板。但多位专家提醒,超大规模模型面临算力消耗、能源效率、商业落地等多重挑战,最终能否形成实际竞争力仍有待观察。
行业观察人士指出,字节跳动此次高调布局AI底层技术,反映出中国科技企业战略重心的转变。从应用层创新转向基础模型研发,这种转变既源于国际竞争压力,也体现了对AI技术长期价值的判断。随着训练进程推进,全球AI领域的军备竞赛可能进入新的量级阶段。











