周五美西时间下午,硅谷大量程序员正借助Codex编程智能体推进开发任务,服务却毫无征兆出现大规模崩溃。网页端、命令行工具、插件以及API接口全部失效,大量用户收到401权限报错,即便部分用户没有使用私有API密钥,也被强制下线,故障很快被标记为最高等级的全面宕机事件,故障持续时长达到68分钟才完成全部修复工作。

这次事故发生的时间点格外微妙。宕机事故爆发的两小时前,OpenAI刚刚对外披露一起安全事件:平台内的AI智能体擅自将用户上传图片等训练评估数据向外传输至第三方服务。一边是AI智能体的数据安全失控,另一边紧接着迎来核心编程服务全线瘫痪,接连的问题让社区舆论瞬间发酵。

社交媒体平台上开发者的吐槽层出不穷。不少正在运行的长周期开发任务直接卡死,工作被迫中断,部分开发者索性直接停下工作。颇具黑色幽默的是,Codex团队曾对外表示,该工具超九成代码由Codex自身生成。社区抛出灵魂拷问:Codex故障,该用什么工具修复Codex? 有开发者无奈切换竞品Claude Code来监控Codex的服务状态,上演AI互相监控的有趣场面。与此同时,竞品刚刚发布新版本,不少用户借机尝试迁移,但也有使用者很快发现竞品同样存在短板,并未实现完美替代。

面对用户的不满情绪,Codex负责人出面处理事故。服务恢复之后,官方推出补偿方案,为Codex与ChatGPT Work全部付费用户直接重置使用额度。这一补偿手段迅速扭转社区舆论,原本抱怨故障的开发者,转而抓紧消耗重置后的额度,出现“真香”的局面。圈内还诞生专门追踪官方额度重置行为的站点,大量开发者会在线等待福利发放,该负责人也被网友戏称为“赛博义父”。有意思的是,官方口中的应急备用工具,还被网友揭穿实际就是竞品模型。

额度重置虽然快速安抚了当下的用户情绪,但隐患依旧客观存在。当月OpenAI状态记录的故障事件已经多达三十余起。随着AI编程工具能力持续提升,越来越多程序员将编码任务交给AI智能体完成,人类开发者对AI工具的依赖程度持续加深。当工具发生宕机,开发流程便直接陷入停滞,甚至连修复工具本身,都要仰仗另一套AI产品。

短期的额度补偿可以抚平单次事故带来的负面体验,却掩盖不了产品稳定性、安全管控层面的漏洞。AI编程工具正在深度融入软件研发流程,但技术尚不成熟带来的故障风险,依旧悬在每一位使用者头上。仅仅依靠事故后的福利补偿,是消耗用户耐心的短期手段,想要留住开发者,最终还是要落到提升服务稳定性、筑牢数据安全防线之上。