风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

突发,GPT-5.6今起大降价

摘要

入门款Luna直接打骨折,每百万Token输入价格从1美元降到0.2美元,输出价格从6美元降到1.2美元。 换算成人民币,相当于输入价格从约6.8元降到1.35元,输出价格从约40.6元降到8.1元。 定位「日常干活主力」的Te...

突发,GPT-5.6今起大降价

入门款Luna直接打骨折,每百万Token输入价格从1美元降到0.2美元,输出价格从6美元降到1.2美元。

换算成人民币,相当于输入价格从约6.8元降到1.35元,输出价格从约40.6元降到8.1元。

定位「日常干活主力」的Terra也降价20%,输入、输出价格分别降到2美元和12美元。

换算成人民币,分别约为13.5元和81.2元。

只有旗舰模型Sol,稳坐原价,但推出了Fast mode,速度最高达到标准模式的2.5倍,加速不加价。

自Codex猛猛重置用量之后,降价也给立马安排上了,OpenAI你是要卷死谁…

这价格战直接白热化了。

OpenAI表示,降价是因为GPT-5.6 Sol自己帮自己省了钱

GPT-5.6 Sol参与自身改进,效率取得了飞跃式提升,故特此回馈新老用户~

左脚踩右脚原地飞升这套,OpenAI你也是玩上了

两款降价,一款加速

现在,GPT-5.6三款模型的API价格分别是:

GPT-5.6 Luna:每百万Token输入0.2美元、输出1.2美元;

GPT-5.6 Terra:每百万Token输入2美元、输出12美元;

GPT-5.6 Sol:每百万Token输入5美元、输出30美元。

降价之后,Luna属于一手大跳水。

其输入价格已经和上一代GPT-5.4 nano持平,输出价格甚至还便宜0.05美元

但两款模型干的活不完全一样,GPT-5.4 nano主要面向分类、信息抽取和排序等简单高频任务。

GPT-5.6 Luna则被OpenAI定位为一款面向成本敏感型工作负载的模型,可以调用工具、处理长上下文,执行多步工作流。

简单来说,OpenAI正在把支撑Agent干活的模型,卖到过去简单小模型的价位

Terra相对克制,降价20%。

Sol则保持原价,新增了Fast mode,速度最高达到标准模式的2.5倍,价格则是标准模式的2倍,模型智能水平不变。

它还会取代此前的Priority Processing。原本使用priority标签的API请求,可以自动切换到Fast mode。

官方表示,这轮调整也会进入Codex和ChatGPT Work。

订阅价格不会下调,用户的额度总量也不会增加,但调用Terra和Luna时,消耗的额度将相应减少。

同样一笔订阅费,可以让模型多干几次活。

OpenAI还顺手把ChatGPT和Codex CLI里的Auto-review模型从GPT-5.4换成了GPT-5.6 Luna。

Auto-review负责在后台检查代码和修改结果,属于典型的高频Agent任务。

结合模型升级和Luna降价,OpenAI预计其成本将降至原来的约十分之一

便宜模型不再只负责分类、抽取这些传统「杂活」,而是开始进入代码审查、后台监控等需要判断和工具调用的环节。

目前三款模型的定位是:

预算敏感、调用量大的任务交给Luna

普通日常工作交给Terra

高难度任务继续使用Sol

如果连等待都嫌慢,再花一倍的钱购买速度。

GPT-5.6开始参与给自己降本

为啥突然降价?

OpenAI表示,原因是GPT-5.6 Sol参与了自家生产系统的优化

它所提高的效率,进而转变成了价格表上打折的数字。

具体而言,GPT-5.6 Sol重写和优化了部分生产环境GPU Kernel,设计并运行数百次Token生成实验,还参与监控训练,在出现问题时介入。

最后成绩也很突出:生产GPU Kernel优化,让GPT-5.6端到端服务成本下降20%;改进推测解码,让Token生成效率提升15%以上。

GPU Kernel可以理解为模型在GPU上执行具体计算任务的底层程序。

模型本身不用变,只要这些程序写得更高效,同一块GPU就能更快完成计算,处理更多请求,单次调用成本也会跟着下降。

推测解码则是在生成答案时,先批量「猜」出接下来可能出现的Token,再交给主模型验证。猜得越准,需要逐个生成和等待的步骤就越少。

两项优化都没有降低模型能力,却能让同一个模型跑得更快、更便宜。

不过,这还不是GPT-5.6完全自主升级自己。

OpenAI特意强调,整个过程仍然由人类主导。

模型可以写代码、跑实验、监控异常,但目标怎么定、结果能不能用、代码是否进入生产环境,依然需要「Human in the Loop」

OMT

最后,还有一个新变化。

这次降价有一个很具体的落点:Agent工作流

打折最狠的Luna,并不只是用来做分类、抽取的传统小模型。

按照OpenAI的定位,它可以调用工具、执行多步任务,主要面向高频、成本敏感型工作负载。

因此,Luna降价80%,也是在降低Agent长期运行的门槛

让原本因为成本太高而不能频繁执行的审查、验证和监控任务,有机会变成工作流里的常规步骤。

再结合GPT-5.6参与优化自身生产系统,一套新的循环出现了:

模型参与提高运行效率,成本下降;价格降低后,模型进入更多高频工作流;调用规模扩大,再推动下一轮效率优化。

OpenAI这套降价飞轮,已经雏形初现。

这一通操作下来,现在压力直接给到A社:

「轮到你了。」

参考链接:[1]https://x.com/OpenAI/status/2082878156483219672[2]https://x.com/sama/status/2082880720989532597

评论 (5)

登录 后即可发表评论
用户1578646858154

GPT - 5.6自己参与降本挺厉害,不过还是人主导。这价格战一打响,后面有好戏看。

0 回复
油腻老腊肉

现在不同任务有对应模型,价格还降了,用起来更划算了,对用户是好事。

0 回复
【 Y  H】
【 Y H】 1天前

OpenAI搞的这降价飞轮有点意思,模型参与优化,成本降了还能扩大调用规模。

0 回复
润锦
润锦 1天前

A社要赶紧跟上了,不然市场份额要被OpenAI抢去不少,这竞争越来越激烈。

0 回复
@亮哥
@亮哥 1天前

这降价力度挺大啊,Luna直接大跳水,OpenAI这是想抢占市场,A社压力不小。

0 回复
更多