OpenAI與Anthropic正推動把獨立安全評估“嵌進”實驗室內部:評估者有望更深入接觸訓練過程與模型行爲,並在發現問題時報告異常。方向從外部口號轉向制度設計,但訪問範圍、介入時機、成果發表權,以及評估者能否真正獨立於公司控制,目前仍不清晰。支持者認爲這能把監督前移到訓練階段;質疑者則擔心若規則與法律保護不到位,最終只會變成受控的門面安排。

2026-09-18

OpenAI與Anthropic正推動把獨立安全評估“嵌進”實驗室內部:評估者有望更深入接觸訓練過程與模型行爲,並在發現問題時報告異常。方向從外部口號轉向制度設計,但訪問範圍、介入時機、成果發表權,以及評估者能否真正獨立於公司控制,目前仍不清晰。支持者認爲這能把監督前移到訓練階段;質疑者則擔心若規則與法律保護不到位,最終只會變成受控的門面安排。