Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

AI研究開發26%由Claude完成,Anthropic:尚未達完整RSI

審視AI研究程式碼與實驗結果的手 / TokenPost.ai (macro)

Anthropic旗下Claude目前已能完成公司模型研究與開發工作的26%,但尚未達到無需人類指示與監督、可自行設計及開發後續模型的完整遞迴式自我改進(RSI)階段。

Anthropic於18日更新的報告中,將RSI定義為AI系統自行設計並開發更強後續系統的狀態。公司表示,目前尚未達到這一階段,RSI也不一定會發生。

目前,Claude只需高層級指示,便能從頭到尾完成部分研究與開發任務,包括撰寫程式碼、執行實驗、修正錯誤及評估結果。不過,在設定研究目標及決定要解決的問題方面,Claude與人類仍存在差距。

Anthropic表示,截至2026年5月,Claude撰寫的程式碼已占其程式碼庫中合併程式碼的80%以上。不過,公司也補充指出,程式碼數量並不能完全反映品質。

Claude在開放式問題解決任務上的成功率,已從2026年5月的76%升至9月約91%。該數據是根據Claude評估任務是否成功的方式計算。

RSI並不只是AI撰寫程式碼。關鍵在於AI是否能參與下一代模型的設計、實驗、評估與改進,並最終在沒有人類介入的情況下打造後續模型。

目前公開的案例顯示,人類仍負責設定研究目標與評估標準,AI則執行程式碼撰寫、實驗、錯誤修正及結果評估。Claude雖已大幅參與模型開發,但這與自行決定研究方向並完成後續模型仍有區別。

OpenAI也於9月6日表示,已達成開發自動化「研究實習生」的目標。該系統可依照人類研究人員的指示,完成資深研究人員可能需要數日處理的明確研究任務。

OpenAI正推動在2028年3月前開發自動化AI研究員。不過,公司表示,快速實現RSI不一定是應追求的結果,是否繼續推進,應取決於能否維持人類控制。

OpenAI也表示,目前仍不知道如何安全實現完全對齊的RSI。如果AI能力發展速度快於安全與對齊技術,監督強大系統可能會變得更加困難。

安東尼・阿吉雷(Anthony Aguirre)Future of Life Institute主席兼CEO表示:「AI承擔的工作越多,行動速度就會比人類快得多。」他更將完全自主的RSI形容為「人類歷史上最糟糕的想法」。這番話並不代表RSI已經完成,而是對失去控制風險的警告。

另一方面,康乃爾大學計算機科學助理教授約翰・蒂克斯頓(John Thickstun)表示,利用前一代模型的程式碼打造下一代系統的部分自我改進,已持續數年。不過,他認為這類進展至今仍較接有限度改進,而非大幅度的創意突破。

AI企業內部也在討論研究自動化速度與安全性之間的平衡。據報,Anthropic CEO達里奧・阿莫代(Dario Amodei)曾提議放慢開發速度,OpenAI CEO山姆・奧特曼(Sam Altman)與伊隆・馬斯克(Elon Musk)則表達支持。

Meta(META)CEO馬克・祖克柏(Mark Zuckerberg)雖與放慢開發速度的主張保持距離,但表示AI企業應優先開發安全的AI模型,而非自動自我改進系統。業界討論焦點並非研究自動化本身,而是如何維持人類控制及安全驗證。

本次公布內容未提出Claude擴大參與研究開發對虛擬資產、區塊鏈市場或半導體需求的直接影響。現階段已確認的下一步,是Anthropic持續評估Claude在模型開發中的應用程度,以及OpenAI以2028年3月為目標推動自動化AI研究員開發。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1