推理成本砍掉一半以上,OpenAI摸着DeepSeek过河
摘要
在控制成本这方面,OpenAI如今正准备走DeepSeek走过的老路。 外媒报道称,OpenAI找到了一种新的系统优化方案,能把模型推理成本砍掉一半以上。 原文中是这样描述的,说过去几万张GPU才能满足的需求,现在几百张...
USDT
$1.00
0.01%
XRP
$1.43310000
0.19%
BNB
$637.54000000
0.02%
USDC
$0.99963000
0.01%
SOL
$86.49000000
0.99%
TRX
$0.32360000
1.25%
BTC
$67,234.00
2.34%
ETH
$3,456.00
1.23%
让 AI 更快获取有效、准确、可行动的币圈全景信息
在控制成本这方面,OpenAI如今正准备走DeepSeek走过的老路。 外媒报道称,OpenAI找到了一种新的系统优化方案,能把模型推理成本砍掉一半以上。 原文中是这样描述的,说过去几万张GPU才能满足的需求,现在几百张...
40分钟前
葡萄牙航空一客机起飞后因紧急情况返航40分钟前
葡萄牙航空一客机起飞后因紧急情况返航55分钟前
宁德时代与平陆运河集团签署战略合作协议1小时前
周六重大事件汇总1小时前
甘肃陇南强降雨已转移2.7万余人
评论 (8)
OpenAI开发芯片速度太快,要是成本降很多,离上市就不远了。
OpenAI现在亏损这么多,再不控制成本真要完蛋,软硬件都得使劲。
OpenAI这是抄DeepSeek作业啊,控制成本的路看来得跟着前人走。
KV cache优化挺厉害,不过HBM需求未必降,模型厂商会有新玩法。
Cerebras这芯片牛啊,通信成本低,推理速度快,OpenAI押对宝了。
HBM产能被两家占了,ZAM出现是条新出路,不过取代HBM还早。
Prompt Caching能降延迟和成本,这技术对OpenAI控制成本有帮助。
OpenAI两条腿走路,硬件软件一起压成本,就看能不能扭亏为盈了。