风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

扎克伯格,跟DeepSeek拼了

摘要

智东西8月6日报道,今日,Meta推出其首款编程Agent——Muse Code(测试版),以及该Agent搭载的新一代模型Muse Spark 1.2。 模型一经面世便引发海外热议,核心关注点直指定价策略:比DeepSeek-V4-Flash更便宜。如果...

扎克伯格,跟DeepSeek拼了

智东西8月6日报道,今日,Meta推出其首款编程Agent——Muse Code(测试版),以及该Agent搭载的新一代模型Muse Spark 1.2。

模型一经面世便引发海外热议,核心关注点直指定价策略:DeepSeek-V4-Flash更便宜。如果用户允许Meta用他们的数据训练模型,就能享受95折优惠。

有趣的是,就在同日,DeepSeek发布公告宣布:“计划近期整体上调API服务定价,预计涨幅较大。”国内其他头部模型也有价格战松动迹象,比如,智谱GLM模型在优惠结束后价格也将明显上调。

当海外巨头OpenAI、Meta纷纷杀入价格战,DeepSeek等国产模型似乎不按套路出牌,这场全球大模型混战变得越来越有意思了。

01.最高降价75倍,Meta盯上用户数据

扎克伯格在推文中称:“(这款模型)定位入门简单且成本低廉,(用户)只需一行代码即可安装,开始使用‘贡献者套餐’。”

所谓“贡献者套餐”,是指Meta提供两个API版本:一个版本允许数据共享,另一个版本则不允许。前者输入价格为0.10美元/百万Tokens,比后者便宜12.5倍; 缓存输入0.002美元/百万Tokens,便宜75倍;输出0.20美元/百万Tokens,便宜21倍以上。

有网友调侃:“笑死,Muse Spark输入、输出成本都比DeepSeek-V4-Flash低,还拥有独特优化的缓存命中率。他们不在乎利润,只想要数据。

此前7月31日,DeepSeek-V4-Flash正式上线API,该模型在未命中输入缓存时价格为1元/百万tokens,输入命中缓存价格为0.2元/百万tokens,输出价格为2元/百万tokens。

02.DeepSeek“强得不像Flash”,Meta跟得动吗?

当下正值DeepSeek-V4-Flash在全球引起新一轮热潮。自上线API以来,其超高性价比的口碑持续攀升。

拉美头部在线教育平台Platzi联创兼CEO今日刚刚发文感叹:“我完全不明白DeepSeek-V4-Flash是如何达到这种速度和质量的,太厉害了。”

更有网友直言:“Claude死了。世界没有理由继续受制于一家价格高出百倍、性能却与竞争对手不相上下的供应商。”

DeepSeek-V4-Flash的口碑不仅源于低价,更在于性能表现。

这款模型基准测试远超4月上线的自家“大哥”DeepSeek-V4-Pro-Preview。直到今天,还有不少海外网友仍在兴奋赞叹:“它现在完全不像一个Flash模型。”在Almanbench测试中,DeepSeek-V4-Flash 0731版本超越Kimi K3,得分几乎媲美GPT-5.6 Sol xhigh。

那么试图与DeepSeek打价格战的Meta,其最新的Muse Spark 1.2和Muse Code测试版性能如何?

03.编程测评仅次于Opus5,Muse Spark 1.2与前沿模型仍有距离

从模型性能来看,Muse Spark 1.2比自己前代模型提升较大,但与前沿模型仍有一定距离

Muse Spark 1.2是专为编程优化的更新版本。在Terminal‑Bench 2.1、DeepSWE 1.1等代码能力基准测试中,整体成绩仅次于Claude Opus5,强于GPT‑5.6、Grok4.5和Gemini3.6。

在复杂推理GDPVal‑AA V2测试中,Muse Spark 1.2仅次于Opus5;在Agent工具调用MCP Atlas基准上,Muse Spark 1.2登顶榜首。

Meta测试了该模型在超过1000次工具调用(长达24小时)内迭代优化GPU内核的能力。借助Muse Code的智能体编码环境,该模型表现优于Gemini 3.6 Flash、GPT-5.6 Terra,但逊于GPT-5.6 Sol、Opus5。

Muse Code定位终端编码Agent,能够处理大型代码库中的完整软件工程任务,包括规划变更、编写代码、验证结果。Meta公布了系列案例,但其实际能否与Claude Code、Codex一较高下,仍有待开发者真实场景的检验。

如下图案例所示,Muse Code采用简单的Agent循环,并辅以一组异步后台Agent来增强主Agent的功能。它们的持续运行降低了延迟,并降低复杂多步骤任务下的人工干预需求。

Muse Spark 1.2生成的光子球模拟

Muse Spark 1.2生成的游戏射击界面

Muse Spark 1.2生成的牛油果草坪游戏

下图为用户将房屋的漫游视频以MP4文件的形式输入到终端。Muse Code会解析该视频,并生成一个视觉效果丰富的度假屋营销和预订页面。

此外,Muse Spark 1.2人工智能分析指数 (AII) 中获得54分,相比之前的版本,其智能体知识工作能力显著提升,使Meta与SpaceXAI并列美国实验室第三名。

04.结语:Meta降价抢客,DeepSeek涨价备战,AI价格战背后是Agent硬仗

紧随OpenAI降价,Meta也在美国AI圈打起价格战。Meta试图以此在OpenAI、Anthropic的统治下分一杯羹;并首次入局终端编程Agent市场,试图重新上桌。而谷歌DeepMind近期内部的大调整,恰好为Meta提供了机会窗口。

低价或许是不错的引流手段,但打开局面还需要更高的模型性能和Token质量。这也是DeepSeek-V4-Flash再次爆火海外的原因。

值得注意的是,就在今日,DeepSeek发布公告计划近期整体上调API服务定价。可见,DeepSeek并未将竞争局限于价格战,而是继续聚焦模型质量的比拼。近期,DeepSeek正大力招聘Agent Harness人才、积极招揽优秀开源项目,其Agent Harness产品(或命名为DeepSeek Code)正在紧锣密鼓推进中。

可以预见,价格战只是序章,围绕Agent的算力、性能、价格、应用、生态等全维度的竞争,将愈演愈烈。

本文来自微信公众号“智东西”(ID:zhidxcom),作者:李水青,编辑:云鹏,36氪经授权发布。

评论 (7)

登录 后即可发表评论
小汤哥
小汤哥 1天前

2. Meta靠低价想分一杯羹,难搞哦,DeepSeek性能口碑都好,Meta这是想硬拼。

0 回复
朱灰灰
朱灰灰 1天前

1. 这扎克伯格有野心啊,跟DeepSeek打价格战抢市场,不过DeepSeek性能强,又开始聚焦质量,Meta得加油了。

0 回复
用户3664050850099

6. Meta入局编程Agent市场,打价格战抢机会,但还是得提高模型性能才行。

0 回复
112233
112233 1天前

5. DeepSeek口碑那么好还涨价,Meta就算降价,性能比不过也白搭,不好说谁能赢。

0 回复
机车族机战王─洛洛

7. 价格战只是开始,Agent全维度竞争要来了,Meta和DeepSeek谁会更厉害呢。

0 回复
更多