风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

OpenAI连续17天服务异常:从聊天中断到产线停摆的可靠性危机

摘要

7月25日傍晚,三线齐崩 北京时间7月25日17时17分,OpenAI官方状态页显示“Investigating”,API、ChatGPT与Codex三条核心服务同时出现异常。18时02分进入“Monitoring”阶段,表明初步缓解措施已生效;19时08分,全部服...

OpenAI连续17天服务异常:从聊天中断到产线停摆的可靠性危机
7月25日傍晚,三线齐崩 北京时间7月25日17时17分,OpenAI官方状态页显示“Investigating”,API、ChatGPT与Codex三条核心服务同时出现异常。18时02分进入“Monitoring”阶段,表明初步缓解措施已生效;19时08分,全部服务恢复正常——全程历时1小时51分钟。 此次故障波及31个服务组件:API占12个、ChatGPT占15个、Codex占4个。用户端反馈集中于请求失败、响应超时、任务无故中断。尤其Codex表现突出——作为支撑编程Agent的核心服务,其响应卡顿常达数十分钟,若正执行复杂代码生成或自动化审查流程,极易导致整条工作流中断甚至失败。 连续17天,没有一天真正正常 将时间轴拉长至7月上旬,单次故障便不再孤立。自7月9日起,OpenAI再未出现过全天零告警、全组件稳定运行的“完全正常”日。 系统性波动已成为常态:7月12日与16日发生两次Major Outage;其余日期则在Degraded Performance(性能下降)与Partial Outage(局部中断)之间反复切换。仅7月23日当天,就密集触发四起独立事故,涵盖ChatGPT错误率飙升与延迟激增;24日Codex Review模块报错;25日则升级为全栈式故障。 沉默背后,是基础设施的临界承压 OpenAI尚未就成因发布正式说明。但结合当前技术节奏可合理推断:一方面,全球夏季推理负载持续攀升,尤其是多轮Agent调用带来的长上下文、高并发压力;另一方面,新模型迭代与功能上线节奏未见放缓,底层服务集群长期处于资源紧绷状态。稳定性让位于迭代速度,已非猜测,而是可观测的事实。 宕机的代价,早已不是“聊不了天” 两年前的ChatGPT中断,影响止于用户体验。而今天,API已是客服系统、CI/CD流水线、合规审计平台与自主Agent工作流的神经中枢。111分钟的服务中断,对应的是真实产线的停滞、交付周期的延误、自动化流程的断裂。 更值得留意的是市场反应——已有服务商将“OpenAI挂了?自动路由至备用模型”写进产品文案。多模型容灾不再是架构选型中的可选项,正加速成为企业级AI部署的刚性需求。 SLA,正取代Benchmark成为第一评估标尺 模型能力排行榜每周刷新,但可用性无法靠分数弥补。一次中断,损失就是100%;十次抖动,信任就折损十分之一。对采购方而言,SLA(服务等级协议)条款的权重,正在快速超越参数量、MMLU得分或函数调用深度。 未来趋势渐明:其一,多云+多模型路由将从增强能力演变为架构基线,单一供应商依赖将被重新评估与定价;其二,每次海外头部平台的稳定性失守,都是国产模型承接溢出需求的关键窗口——但前提是,自身必须先经受住同等规模、同等级别的真实负载考验。

评论 (5)

登录 后即可发表评论
锦汐
锦汐 6天前

宕机影响太大了,产线停滞损失不小,企业得赶紧搞多模型容灾了。

0 回复
没钱做T,去打劫

国产模型机会来了,但得先过真实负载考验这关,不然也承接不了溢出需求。

0 回复
强仔
强仔 6天前

OpenAI这稳定性太差了,连续17天没正常过,新模型迭代也不能不管稳定性啊。

0 回复
杨哥(好歌推荐)

OpenAI基础设施承压,全球夏季推理负载高,新模型还一直上,不出问题才怪。

0 回复
Mr.唐
Mr.唐 6天前

现在SLA比模型能力排行重要多了,一次中断信任就没了,采购得看SLA条款。

0 回复
更多