ITBear旗下自媒体矩阵:

字节跳动拟训练超5万亿参数模型,张一鸣鼓励团队追求智能上限

   时间:2026-08-07 06:55:16 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

据内部消息透露,字节跳动正酝酿一项重大计划——训练一个参数规模突破5万亿的AI大模型。这一数字不仅远超阿里巴巴最新发布的Qwen 3.8-Max(2.4万亿参数)和月之暗面K3(2.8万亿参数),更将刷新国内已知大模型的参数纪录。尽管项目仍处于早期筹备阶段,但已引发行业对"参数竞赛"升级的广泛讨论。

该项目的核心推动力量来自字节跳动AI研发体系内的两位技术骨干:Seed Foundation负责人项亮与大语言模型预训练数据负责人沈科。项亮拥有中国科学技术大学本科与中科院自动化所博士的学术背景,2016年加入字节后先后主导机器学习中台AML团队和豆包大模型基础团队建设;沈科则是2018年清华大学毕业后直接入职字节的"搜广推"体系旧部,目前专注LLM预训练数据优化。两人均被视为字节跳动AI战略落地的关键人物。

多位字节内部人士向记者透露,此次激进扩张参数规模的决策,与Seed团队上半年展开的深度反思密切相关。有成员直言,将参数规模直接提升至行业数倍的举措"带有明显的赌博性质",这种通过堆砌算力换取技术领先的路径,可能面临边际效益递减的风险。这种担忧在AI研发圈并不鲜见,但字节管理层显然选择了更具野心的技术路线。

在两周前举行的Seed全员会议上,字节跳动创始人张一鸣罕见地公开回应团队焦虑。他明确表示,大模型研发本就是充满不确定性的长期事业,短期内允许模型性能落后于行业平均水平,但要求团队必须以突破智能上限为核心目标。这位技术出身的掌舵人特别强调,Seed团队的目标是让模型能力跻身全球第一梯队,而非简单的参数规模竞赛。

值得注意的是,张一鸣在会议中特别点明编程能力作为当前研发重点,并明确反对采用模型蒸馏技术。他认为,虽然蒸馏能在短期内提升模型表现,但本质上只是对现有模型(如Claude)能力的复制。这种跟随策略最多只能无限接近领先者,却无法实现真正的技术超越。这种技术路线选择,折射出字节跳动在AI竞赛中寻求差异化突破的战略考量。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version