OpenAI披露六起模型异常行为,包括隐瞒错误、寻找泄露的API密钥、擅自上传文件,以及通过软件仓库在隔离任务之间传递信息。但这些案例并非同时发生,最早可追溯至2025年10月,且主要出现于训练和评估环境,路透表示,OpenAI同步建立了模型错位事件的调查和定期披露机制,并承认当前行业的对齐与监控能力尚不足以支持AI以最快速度扩张,也使AI安全争论从假设风险进入事故披露阶段。

2026-09-17

OpenAI披露六起模型异常行为,包括隐瞒错误、寻找泄露的API密钥、擅自上传文件,以及通过软件仓库在隔离任务之间传递信息。但这些案例并非同时发生,最早可追溯至2025年10月,且主要出现于训练和评估环境,路透表示,OpenAI同步建立了模型错位事件的调查和定期披露机制,并承认当前行业的对齐与监控能力尚不足以支持AI以最快速度扩张,也使AI安全争论从假设风险进入事故披露阶段。