大数跨境

扎克伯格,跟DeepSeek拼了

扎克伯格,跟DeepSeek拼了 智东西
2026-08-06
4
导读:刚刚,DeepSeek预告大幅涨价!小扎刺刀拼了个寂寞?

低价换数据,Meta 的算盘能打响吗?
作者 |  李水青
编辑 |  云鹏
智东西 8 月 6 日报道,Meta 今日正式发布其首款编程 Agent——Muse Code(测试版),并同步推出搭载的新一代模型 Muse Spark 1.2。
该模型一经面世即引发海外热议,焦点直指其激进的定价策略:若用户授权 Meta 使用其数据进行训练,可享受最高达 95% 的价格优惠,成本甚至低于 DeepSeek-V4-Flash。
与之形成鲜明对比的是,DeepSeek 同日发布公告,计划近期大幅上调 API 服务定价。国内其他头部模型如智谱 GLM 也显现出价格战松动迹象,优惠结束后价格将明显回升。
当 OpenAI、Meta 等海外巨头纷纷卷入价格战,而 DeepSeek 等国产模型选择逆势涨价,全球大模型混战格局愈发引人深思。

01. 最高降价 99%,Meta 盯上用户数据

扎克伯格在推文中强调,该模型定位“入门简单且成本低廉”,用户仅需一行代码即可安装,并可选择加入“贡献者套餐”。
所谓“贡献者套餐”,即 Meta 提供两种 API 版本:允许数据共享版与禁止数据共享版。前者价格极具竞争力:输入价格为 0.10 美元/百万 Tokens(便宜 92%);缓存输入仅 0.002 美元/百万 Tokens(便宜 99%);输出价格为 0.20 美元/百万 Tokens(便宜 95% 以上)。
有网友调侃称,Muse Spark 的输入输出成本均低于 DeepSeek-V4-Flash,且拥有优化的缓存命中率,显示出 Meta“不在乎利润,只想要数据”的战略意图。
作为参照,DeepSeek-V4-Flash 于 7 月 31 日正式上线 API,其未命中缓存输入价为 1 元/百万 tokens,命中缓存为 0.2 元,输出价为 2 元。

02. DeepSeek“强得不像 Flash",Meta 跟得动吗?

当前,DeepSeek-V4-Flash 正在全球掀起新一轮热潮。自 API 上线以来,其超高性价比口碑持续攀升。
拉美头部在线教育平台 Platzi 联合创始人兼 CEO 近日感叹:“完全不明白 DeepSeek-V4-Flash 如何达到如此速度与质量,表现惊人。”更有网友直言,世界没有理由继续受制于价格高出百倍但性能相当的供应商。
DeepSeek-V4-Flash 的口碑不仅源于低价,更在于其卓越的性能表现。基准测试显示,该模型远超今年 4 月上线的 DeepSeek-V4-Pro-Preview。在 Almanbench 测试中,其 0731 版本得分超越 Kimi K3,几乎媲美 GPT-5.6 Sol xhigh,被海外网友评价为“完全不像一个 Flash 模型”。
试图以价格战挑战 DeepSeek 的 Meta,其最新的 Muse Spark 1.2 和 Muse Code 测试版性能究竟如何?

03. 编程测评仅次于 Opus5,前沿模型仍有距离

模型性能显著提升,但距顶尖仍有差距

从性能来看,Muse Spark 1.2 较前代提升明显,但与最前沿模型仍存在一定距离。
作为专为编程优化的版本,Muse Spark 1.2 在 Terminal‑Bench 2.1、DeepSWE 1.1 等代码能力基准测试中,整体成绩仅次于 Claude Opus5,优于 GPT‑5.6、Grok4.5 和 Gemini3.6。
在复杂推理 GDPVal‑AA V2 测试中,该模型同样仅次于 Opus5;而在 Agent 工具调用 MCP Atlas 基准上,Muse Spark 1.2 则登顶榜首。
Meta 测试了模型在超过 1000 次工具调用(长达 24 小时)内迭代优化 GPU 内核的能力。借助 Muse Code 的智能体编码环境,其表现优于 Gemini 3.6 Flash 和 GPT-5.6 Terra,但逊于 GPT-5.6 Sol 和 Opus5。

终端编码 Agent 实战表现

Muse Code 定位为终端编码 Agent,旨在处理大型代码库中的完整软件工程任务,涵盖规划变更、编写代码及验证结果。Meta 公布了系列案例,但其实际能否与 Claude Code、Codex 抗衡,尚待开发者在真实场景中检验。
Muse Code 采用简单的 Agent 循环,辅以一组异步后台 Agent 增强主 Agent 功能。这种持续运行机制有效降低了延迟,减少了复杂多步骤任务下的人工干预需求。

▲Muse Spark 1.2 生成的光子球模拟

▲Muse Spark 1.2 生成的游戏射击界面

▲Muse Spark 1.2 生成的牛油果草坪游戏

在另一案例中,用户将房屋漫游视频以 MP4 格式输入终端,Muse Code 解析后生成了视觉效果丰富的度假屋营销和预订页面。
此外,Muse Spark 1.2 在人工智能分析指数 (AII) 中获得 54 分,智能体知识工作能力显著提升,助力 Meta 与 SpaceXAI 并列美国实验室第三名。

04. 结语:价格战背后是 Agent 硬仗

紧随 OpenAI 之后,Meta 也在美国 AI 圈发起价格战,试图在 OpenAI 和 Anthropic 的统治下分一杯羹,并首次切入终端编程 Agent 市场。谷歌 DeepMind 近期的内部调整为 Meta 提供了机会窗口。
低价虽是有效的引流手段,但打开局面最终依靠的是模型性能和 Token 质量,这也是 DeepSeek-V4-Flash 在海外再次爆火的原因。
值得注意的是,DeepSeek 今日公告计划上调 API 定价,表明其竞争策略并未局限于价格战,而是聚焦于模型质量的比拼。目前,DeepSeek 正大力招聘 Agent Harness 人才,招揽优秀开源项目,其 Agent Harness 产品(或命名 DeepSeek Code)正在紧锣密鼓推进中。
可以预见,价格战仅是序章。围绕 Agent 的算力、性能、价格、应用及生态等全维度的竞争,将愈演愈烈。

9 月 22-23 日,智东西主办的 2026 全球 AI 芯片峰会将在上海举行,设有开幕式,大模型 AI 芯片、Agent 推理芯片、具身智能芯片 3 场高峰论坛,以及 Token 工厂异构混训混推、超节点、AI 芯片架构创新、新型存储器、大模型 KV Cache 5 场技术研讨会。

【声明】内容源于网络
0
0
智东西
各类跨境出海行业相关资讯
内容 11763
粉丝 0
智东西 各类跨境出海行业相关资讯
总阅读200.0k
粉丝0
内容11.8k