回上列表
專家於公開信中表示Anthropic與OpenAI需要獨立安全評估員
2026/09/21 09:06
逾100名人工智能專家及評估員聯署警告,指在人工智能技術面對日益嚴格審視之際,評估員將缺乏測試AI安全性所需的資源及保障,市場憂慮主要來自業內人士對前沿模型潛在風險的關注。

組織今次公開信的AI Evaluator Forum主席Conrad Stosz接受訪問時表示,目的是展示各方在基本原則上的共同立場,並確保獨立監督能成為廣泛管理AI風險的有效工具。

該團體於周五發表公開信,聯署者包括Geoffrey Hinton,以及來自約翰霍普金斯大學、史丹福大學及非牟利評估機構METR(Model Evaluation and Threat Research)等組織成員。公開信指出,他們希望促使基礎模型供應商確保第三方AI評估員能擁有所需的「科學客觀性、透明度、獨立性及強而有力的保障」,以有效及具公信力地履行職責。

Stosz表示,此舉亦是要求基礎模型公司履行近期承諾,支持更全面的第三方AI安全測試。

自Anthropic行政總裁Dario Amodei上周末提出,向部分評估員提供類似員工的權限,以檢查及審核最先進基礎模型及其開發流程後,原本較小眾的評估員社群受到市場關注。儘管部分業界領袖呼籲政府監管AI發展,以防技術失控,但美國總統Donald Trump及其前AI事務主管David Sacks一直反對相關措施。

Stosz表示,聯盟並非倡議單一方式確保AI模型安全開發,而是希望至少為獨立於大型實驗室運作的評估員及相關人士建立「基本原則」及「更高標準化」。

他指出,Amodei的建議似乎涉及向評估員提供遠較以往更多的權限,包括讓第三方評估員使用公司電腦、與員工坦誠交流,以及查閱敏感內部數據及未發布系統。

Stosz表示,這類權限將令評估員對實際風險有更高信心,特別是涉及企業內部使用而未公開發布的系統。他並提及Hugging Face攻擊事件中使用的未發布OpenAI模型。

OpenAI行政總裁Sam Altman、SpaceX行政總裁Elon Musk,以及微軟行政總裁Satya Nadella均公開支持Amodei的建議,但尚未回應相關執行問題,包括如何挑選AI評估員,以及他們可深入檢視多少受嚴密保護的技術。

公開信指出,聯署者希望評估工作能獨立於相關企業進行,提升技術透明度,並確保評估員「免受其所進駐公司報復」。(su)~

阿思達克財經新聞
網址: www.aastocks.com