Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

3萬個AI代理人並行運作 Anthropic將研發算力6%投入安全工作

AI安全審查室內,研究人員檢視工作紀錄 / TokenPost.ai (macro)

Anthropic內部平台約有3萬個AI代理人同時執行研究與工程任務。Anthropic表示,平台會即時及事後監控這些代理人的行為,並將2026年7月13日至20日期間測得的AI研究與開發算力約6%投入安全工作。

Anthropic表示,這項數據來自截至2026年8月使用量最高的內部平台。這一規模並不代表Anthropic的整體系統,而是指特定內部平台在某一時點活躍的代理人數量。相關內容也可在Anthropic公開資料中確認。

平台會在所有代理人的任務執行前,先交由線上監控系統檢查。Anthropic表示,分析8月單月超過10億次決策後,約0.002%的決策遭到阻擋,約相當於每4萬7000次決策中有1次。

線上監控主要用於防範即時發生或難以逆轉的風險。系統會在代理人執行任務前檢查其行為,並阻擋可能造成問題的決策。

平台也同步進行事後監控。系統每週標記約10萬筆紀錄,再透過分類器進行優先級排序,其中約50筆高優先級紀錄由人員直接審查。

離線監控則是在任務完成後分析紀錄,找出隨時間推移才會顯現的異常行為。Anthropic同時採用線上與離線監控,分別管理執行前風險和事後發現的問題。

在算力分配方面,Anthropic於2026年7月13日至20日期間測得的AI研究與開發算力中,約6%用於安全工作。若只計算由AI主導的AI研究與開發任務,安全工作的算力占比則升至約12%。

不過,Anthropic表示,僅以算力難以完整衡量安全研究的規模。安全研究有時比大規模模型訓練更仰賴個別研究人員設計及驗證實驗,因此投入的時間未必能以算力反映。

同時有助於安全性與效能提升的工作,未被計入安全算力。Anthropic表示,因此本次數據是對投入安全工作的算力進行保守統計的結果。

此次公開資料旨在AI參與AI開發程度持續提高之際,同時衡量代理人的活動量與監控程度。Anthropic表示,若其他前沿AI開發商也定期公開相關指標並接受第三方驗證,將有助於比較AI開發速度、代理人監督能力及安全資源投入。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1