編輯判斷
對前沿實驗室而言,安全控制開始決定發佈速度,而非在發佈後才補上。
OpenAI 在評測顯示未發佈 Astra 模型可能達到關鍵級網絡能力後,放慢部分開發工作。報道指,不符合更嚴格控制的活動會暫停,直至測試及基建防護得到加強。
事件重要之處,是能力門檻首次清楚連結到實際營運後果。安全框架往往在模型推出前已寫得完整;更嚴格的考驗,是當內部評測提出警號時,公司是否願意接受延誤、成本及研究速度下降。
暫停不等於證明模型不安全,公開證據亦仍不完整。不過它顯示網絡安全評測正由假設性跑分走向發佈治理。其他實驗室將面對更大壓力,不只要說明模型能做甚麼,也要交代哪些發現會令它們主動減速。
來源說明
本簡報綜合已報道事實並加入獨立脈絡,不複製來源文章的措辭或結構。