风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

Grok 4.5发布:当AI进入IDE,成本成了新入口

摘要

SpaceXAI正式推出Grok 4.5 SpaceXAI发布了Grok 4.5,这是其收购Cursor后首次推出的原生模型。官方明确表示,该模型专为coding与agent任务训练,与Cursor深度协同,已集成进Grok Build、Cursor全产品线及SpaceXAI Con...

Grok 4.5发布:当AI进入IDE,成本成了新入口
SpaceXAI正式推出Grok 4.5 SpaceXAI发布了Grok 4.5,这是其收购Cursor后首次推出的原生模型。官方明确表示,该模型专为coding与agent任务训练,与Cursor深度协同,已集成进Grok Build、Cursor全产品线及SpaceXAI Console。定价同步公开:每百万input token 2美元,每百万output token 6美元。 不是最强,而是更可负担 马斯克在X平台称其为Opus-class级别模型,但强调它更快、更省token、成本更低。这一表述跳出了传统硅谷发布会惯用的“智能涌现”“推理突破”话术,转向更务实的维度——单位调用成本。这不是低价倾销,而是将价格锚定为开发者能否真正规模化使用的关键门槛。 Token效率即生产力 Grok 4.5在SWE-Bench Pro上的官方数据显示:平均单次任务输出15,954 tokens,而对标模型Opus 4.8 max达67,020 tokens,效率高出约4.2倍。该数据虽由SpaceXAI自测,但精准传递了核心信息——减少无效token消耗,就是在降低真实开发中的试错成本与等待成本。 评测体系正在失灵 同日,OpenAI主动审计SWE-Bench Pro,确认其中约27%~34%的任务存在缺陷,宣布不再推荐其作为可靠评估标准。此举表面是技术纠偏,实则动摇了整个coding agent行业的信任基础:当榜单分数无法反映真实工作流表现,企业采购决策必然转向“一次PR修复花了多少钱”“一个CI失败重跑消耗多少预算”。 IDE已成为新收银台 Cursor定价页清晰列出Agent requests、cloud agents、Bugbot usage-based billing等模块;Claude Code提供开发者日均花费参考区间;Codex数据显示超10%用户每周并发管理3个以上agents。三者共同指向一个事实:计费单元已从“每百万token”下沉至“每次任务”“每个workspace”“每位活跃开发者”。 真正的竞争,现在才开始 Grok 4.5争夺的不是排行榜第一,而是Cursor中的默认模型位、Grok Build里的agent默认链路、团队token预算的分配权,以及开发者心中“什么才算真能干活”的定义权。评测权、入口权、计费权,正加速融合为同一战场。AI不再只是聊天框里的助手,而是嵌入工位的真实生产力组件——每一次bug fix、PR review、CI修复、文档生成,都必须可验证、可计量、可归因。 便宜不是终点,而是起点 成本优势无法替代稳定性、权限控制、上下文管理与失败可溯性。Grok 4.5的挑战在于:能否在真实代码仓库中持续交付低误报、低重跑率、高解释性的结果。而这场竞争的胜负手,将取决于哪家模型能让开发者每天打开IDE时,第一反应不是“它能不能做”,而是“这次调用,值不值得我点下回车”。

评论 (5)

登录 后即可发表评论
春风亦有春风愁

Grok 4.5争夺默认位置等,真正竞争刚开始,就看谁能让开发者觉得值。

0 回复
Z ♬ 不熬夜

评测体系失灵,企业采购更看重成本,Grok 4.5有机会,但还得证明自己。

0 回复
@往事隨風

成本低是优势,但稳定性等方面要是不行,也白搭,Grok 4.5得加油。

0 回复
红飞
红飞 3周前

Grok 4.5主打成本优势,挺务实的,不过稳定性等方面还得看看实际表现咋样。

0 回复
熊小二
熊小二 3周前

IDE成新收银台,计费方式变了,Grok 4.5得在新规则下竞争。

0 回复
更多