ITBear旗下自媒体矩阵:

张一鸣拒绝“抄答案”:字节以自研为笔,绘就AI长期发展蓝图

   时间:2026-08-08 03:16:36 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

字节跳动创始人张一鸣近期在公司内部会议上明确表态,禁止旗下Seed团队采用“模型蒸馏”技术追赶竞争对手,这一决策引发行业广泛关注。面对团队内部持续一年多的技术路线争议,张一鸣强调:“字节跳动要为长期目标承受短期阵痛,不能通过复制他人成果消除差距。”

模型蒸馏技术由人工智能先驱辛顿于2015年提出,其核心是通过让小模型模仿大模型的输出模式,以较低成本实现性能接近。这项技术本身合法且被谷歌、OpenAI等企业用于开发轻量化模型,但当前行业出现滥用趋势——部分企业通过批量构造问题,收集头部闭源模型的回答数据训练自身模型,相当于用数小时获取他人数年研发成果。

2026年初,Anthropic公开指控三家中国AI企业利用超过2.4万个虚假账号,对Claude模型发起1600万次对话交互,系统性窃取其推理能力与工具调用数据。值得关注的是,涉事企业名单中并未出现字节跳动,这与其长期坚持的技术原则形成鲜明对比。

Seed团队内部围绕蒸馏技术的争论已爆发三次:2025年初DeepSeek-R1发布后,部分研究员提议通过蒸馏美国闭源模型快速提升性能;同年年底英伟达高端GPU出口管制导致算力受限时,该提议获得更多支持;2026年7月月之暗面推出Kimi K3后,要求采用蒸馏技术的呼声达到顶峰。面对团队质疑,张一鸣始终坚守底线,明确禁止任何形式的模型输出数据使用。

这种技术洁癖可追溯至2023年。当时字节跳动即建立严格规范,禁止将GPT生成数据纳入训练集,并开展内部抽检核查模型输出与GPT的相似度。公司内部将此视为不可逾越的红线,即便在算力受限、竞争对手通过蒸馏技术快速迭代的压力下,仍坚持自主创新路径。

行业分析指出,张一鸣的决策背后蕴含深层战略考量。表面看是规避美国制裁风险,实则瞄准技术定义权。若仅通过蒸馏追赶榜单排名,模型发展上限将永远受制于竞争对手。这种思路与其打造今日头条、抖音等产品的路径一脉相承——通过算法创新重新定义行业规则,而非跟随模仿国外模式。

字节跳动当前正推进5万亿参数超大模型研发,由Seed Foundation负责人项亮与预训练数据负责人沈科共同主导。在2026年度年中全员会上,CEO梁汝波重申自研路线:“接受短期落后,坚持长期优化。”这与张一鸣的表态形成双重定调,显示公司高层在技术路线上的高度统一。

尽管Seed模型在通用语言模型榜单上暂居下风,但若成功跑通自有超大模型,字节跳动将成为国内首个掌握原生预训练技术的企业。这种选择与开源模式形成鲜明对比——开源虽能快速集众家之长,但技术成果易被复制利用,难以建立持久竞争优势。

在行业普遍追求短期指标的背景下,字节跳动的技术坚守显得尤为突出。当多数企业通过蒸馏技术快速迭代时,这家公司选择用最“笨”的方法积累核心能力。这种看似偏执的坚持,或许正暗合技术突破的内在规律——真正改变行业格局的,往往是那些愿意慢下来深耕基础的企业。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version