本報訊
AI是否正開始「打造自己」?Anthropic最新公布的數據顯示,截至今年8月,旗下聊天機械人Claude已「主導」公司內部26%的AI研究與開發工作,而今年2月這一比例還不到1%。短短約半年,AI參與下一代AI研發的程度出現跳升,成為外界觀察「遞迴式自我改進」是否正在成形的重要指標。
鉅亨網報道,Anthropic將AI參與研發的程度分為六個層級,從完全沒有人工智能參與,到AI提供少量協助、AI協作、AI主導,最終才是完全自主。所謂「AI主導」,是指AI可根據高階指令,在人類監督下自行完成一項工作的多數流程;「AI協作」則代表AI能在密切的人類指導下完成大量工作。該公司強調,目前Claude尚未在任何已衡量的AI研發工作中達到完全自主,26%的「主導」仍有人類在旁監督,並不代表Claude已能在無人情況下獨立設計、訓練及推出下一代模型。
除26%的「主導」比例外,Anthropic也表示,超過90%的AI研發工作至少已達到「AI協作」程度。若按目前趨勢推估,AI主導的工作佔比甚至可能在2026年底接近80%,但公司強調這只是情境推估,並非正式預測。這些數據來自Anthropic建立的「R&D Automation Index」。該公司在2026年7月每周隨機抽取涉及模型研發的各部門20%員工,讓Claude研究代理人整理其一周工作,四周後取得約1.5萬項細分任務,再整理成包含542個節點的工作分類樹,涵蓋模型訓練、產品開發、強化學習、評估系統及工程問題排除等。之後由Claude代理人逐項研究實際執行方式與AI參與程度,再由另一個Claude模型按六級架構分類,並與員工獨立評分比對。結果顯示,模型與人工評估完全一致的比例為59%,若放寬至相差不超過一個等級,一致率達97%。
Anthropic同時揭露內部AI代理人的使用規模。截至8月,公司主要內部平台上約有3萬個AI代理人同時從事研究與工程工作,這些代理人並非單純回答問題,而是可在較長時間內半自主執行任務,部分情況下還會把工作交給其他AI代理人。

