ITBear旗下自媒体矩阵:

Meta与DeepSeek“一降一涨”背后:AI价格战打响,Agent竞争升级

   时间:2026-08-07 05:01:07 来源:快讯编辑:快讯 IP:北京 发表评论无障碍通道
 

meta近日正式推出其首款编程智能体Muse Code(测试版),并同步发布新一代模型Muse Spark 1.2。这款以“低成本、易上手”为卖点的产品迅速引发海外技术社区热议,其定价策略被指直接对标国产模型DeepSeek-V4-Flash——用户若允许meta使用其数据训练模型,可享受最高95折的优惠。

meta推出的“贡献者套餐”采用差异化定价模式:允许数据共享的API版本输入价格仅为0.10美元/百万Tokens,较非共享版本便宜12.5倍;缓存输入成本低至0.002美元/百万Tokens,降幅达75倍;输出价格则为0.20美元/百万Tokens,优惠幅度超过21倍。这种策略被部分网友解读为“以数据换市场”,有评论戏称:“meta根本不在乎利润,他们只想要用户数据来训练模型。”

就在meta掀起价格战的同时,国产模型阵营出现反向操作。DeepSeek宣布计划大幅上调API服务价格,智谱GLM等头部模型也透露出优惠结束后涨价的信号。这种“海降国涨”的对比,使得全球大模型竞争格局愈发复杂。拉美在线教育平台Platzi创始人公开盛赞DeepSeek-V4-Flash:“完全无法理解它是如何实现如此高的速度与质量,这简直不像Flash级模型。”在Almanbench测试中,该模型0731版本得分甚至逼近GPT-5.6 Sol xhigh,性能表现成为其口碑的核心支撑。

面对DeepSeek的强势表现,meta的新模型性能究竟如何?根据官方披露的基准测试数据,Muse Spark 1.2在Terminal‑Bench 2.1、DeepSWE 1.1等编程能力测试中整体排名第二,仅次于Claude Opus5,领先于GPT‑5.6、Grok4.5等模型。在复杂推理测试GDPVal‑AA V2中,该模型同样位居次席;而在Agent工具调用测试MCP Atlas中,则成功登顶榜首。不过,在长达24小时的1000次工具调用测试中,其表现虽优于Gemini 3.6 Flash和GPT-5.6 Terra,但仍不及GPT-5.6 Sol和Opus5。

Muse Code被定位为终端编码智能体,可处理大型代码库中的完整软件工程任务,包括变更规划、代码编写和结果验证。meta展示的案例中,该智能体通过简单的Agent循环配合异步后台Agent,实现了多步骤任务的自动化处理。例如,用户输入房屋漫游视频后,系统能自动生成包含视觉效果的营销预订页面;在创意生成方面,该模型可完成光子球模拟、游戏射击界面设计甚至“牛油果草坪”主题游戏开发。

值得注意的是,meta在人工智能分析指数(AII)测评中获得54分,智能体知识工作能力显著提升,使其与SpaceXAI并列美国实验室第三名。然而,技术社区对Muse Code的实际应用效果仍持观望态度。有开发者指出,尽管meta公布了系列演示案例,但该工具能否在真实开发场景中与Claude Code、Codex等成熟产品抗衡,仍需时间检验。特别是在DeepSeek持续强化模型质量、积极招聘Agent相关人才的背景下,全球大模型竞争已从单纯的价格比拼,转向算力、性能、生态等全维度的较量。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version