Anthropic旗下Claude目前已能完成公司模型研究與開發工作的26%,但尚未達到無需人類指示與監督、可自行設計及開發後續模型的完整遞迴式自我改進(RSI)階段。
Anthropic於18日更新的報告中,將RSI定義為AI系統自行設計並開發更強後續系統的狀態。公司表示,目前尚未達到這一階段,RSI也不一定會發生。
目前,Claude只需高層級指示,便能從頭到尾完成部分研究與開發任務,包括撰寫程式碼、執行實驗、修正錯誤及評估結果。不過,在設定研究目標及決定要解決的問題方面,Claude與人類仍存在差距。
Anthropic表示,截至2026年5月,Claude撰寫的程式碼已占其程式碼庫中合併程式碼的80%以上。不過,公司也補充指出,程式碼數量並不能完全反映品質。
Claude在開放式問題解決任務上的成功率,已從2026年5月的76%升至9月約91%。該數據是根據Claude評估任務是否成功的方式計算。
RSI並不只是AI撰寫程式碼。關鍵在於AI是否能參與下一代模型的設計、實驗、評估與改進,並最終在沒有人類介入的情況下打造後續模型。
目前公開的案例顯示,人類仍負責設定研究目標與評估標準,AI則執行程式碼撰寫、實驗、錯誤修正及結果評估。Claude雖已大幅參與模型開發,但這與自行決定研究方向並完成後續模型仍有區別。
OpenAI也於9月6日表示,已達成開發自動化「研究實習生」的目標。該系統可依照人類研究人員的指示,完成資深研究人員可能需要數日處理的明確研究任務。
OpenAI正推動在2028年3月前開發自動化AI研究員。不過,公司表示,快速實現RSI不一定是應追求的結果,是否繼續推進,應取決於能否維持人類控制。
OpenAI也表示,目前仍不知道如何安全實現完全對齊的RSI。如果AI能力發展速度快於安全與對齊技術,監督強大系統可能會變得更加困難。
安東尼・阿吉雷(Anthony Aguirre)Future of Life Institute主席兼CEO表示:「AI承擔的工作越多,行動速度就會比人類快得多。」他更將完全自主的RSI形容為「人類歷史上最糟糕的想法」。這番話並不代表RSI已經完成,而是對失去控制風險的警告。
另一方面,康乃爾大學計算機科學助理教授約翰・蒂克斯頓(John Thickstun)表示,利用前一代模型的程式碼打造下一代系統的部分自我改進,已持續數年。不過,他認為這類進展至今仍較接有限度改進,而非大幅度的創意突破。
AI企業內部也在討論研究自動化速度與安全性之間的平衡。據報,Anthropic CEO達里奧・阿莫代(Dario Amodei)曾提議放慢開發速度,OpenAI CEO山姆・奧特曼(Sam Altman)與伊隆・馬斯克(Elon Musk)則表達支持。
Meta(META)CEO馬克・祖克柏(Mark Zuckerberg)雖與放慢開發速度的主張保持距離,但表示AI企業應優先開發安全的AI模型,而非自動自我改進系統。業界討論焦點並非研究自動化本身,而是如何維持人類控制及安全驗證。
本次公布內容未提出Claude擴大參與研究開發對虛擬資產、區塊鏈市場或半導體需求的直接影響。現階段已確認的下一步,是Anthropic持續評估Claude在模型開發中的應用程度,以及OpenAI以2028年3月為目標推動自動化AI研究員開發。
留言 0