Claude已「主導」Anthropic 26% AI研發工作,3萬Agent同時上崗,RSI仍未實現

華爾街見聞
3小時前

AI正在越來越多地參與開發下一代AI。

當地時間周四,Anthropic公布了一組用於追蹤前沿AI實驗室研發進展的新指標。數據顯示,截至今年8月,Claude已經「主導」Anthropic約26%的AI研發工作;與此同時,約3萬個AI Agent在該公司同時開展研究和工程工作。

不過,Anthropic的數據也顯示,AI距離完全自主開展AI研發仍有明顯距離。截至8月,Claude尚未在任何被測AI研發工作中達到完全自主運行的水平。

Anthropic表示,希望通過持續披露這些指標,縮小前沿AI實驗室內部實際進展與公衆所能了解的信息之間的差距。

Claude已主導26%的AI研發工作

根據Anthropic披露的數據,截至8月,Claude參與的AI研發工作中,約26%已經達到「AI主導」(AI leads)的自動化水平。

這一指標參考了Epoch AI的AI研發自動化分級體系。其中,「AI主導」意味着,人類可以提供較高層級的指令,而AI完成大部分具體工作,人類則負責監督。按此標準,Claude主導的研發佔比在今年2月尚不足1%。

目前超過90%的相關任務已經達到「AI協作」(AI collaborates)或更高的自動化水平。

不過,Anthropic同時強調,Claude目前尚未在任何被測的AI研發工作中達到完全自主的水平。這意味着,儘管AI已經深入參與模型研發和工程流程,但人類仍然處於研發流程的重要環節。

3萬個Agent同時開展研究和工程工作

Anthropic披露的另一項指標顯示,今年8月約有3萬個AI Agent同時在公司內部執行研究和工程工作。

這一規模反映出,AI Agent正在從單純的輔助工具逐漸成為企業研發流程中的實際生產力。

Anthropic還對8月超過10億次AI Agent決策進行了分析。數據顯示,在線監控系統攔截了約0.002%的Agent決策,即大約每4.7萬次決策中有1次被攔截。

這一數據衡量的是被監控系統阻止的決策比例,並不等同於AI的錯誤率或危險行為發生率。

AI研發越自動化,安全問題越受關注

Anthropic同時公布了AI研發計算資源的分配情況。

在7月13日至7月20日的一周內,公司約6%的AI研發計算資源用於安全工作;如果只計算由AI驅動的AI研發工作,約12%的計算資源被用於安全相關工作。

隨着AI越來越多地參與AI模型本身的研發,AI安全也成為一個越來越重要的問題。

Anthropic表示,公司計劃讓獨立第三方評估機構獲得對內部流程和數據的訪問權限,以便對安全實踐進行驗證,並幫助外部人士了解前沿AI實驗室內部AI研發的實際進展。

這一安排意味着,AI實驗室正在嘗試通過第三方評估,減少企業內部信息與外部公衆認知之間的差距。

從「AI輔助研發」走向「AI驅動研發」

Anthropic此次披露的數據提供了一個觀察AI產業發展的新角度:市場過去主要通過模型參數、基準測試成績和用戶數量衡量AI進步,而Anthropic開始嘗試衡量AI究竟在多大程度上參與了開發下一代AI。

從目前的數據來看,AI已經深度進入前沿AI實驗室的研發流程,大量Agent正在承擔研究和工程任務,但完全由AI獨立完成整個研發過程仍未實現。

這也意味着,當前AI產業正在經歷的變化,與其說是「AI已經能夠自主研發AI」,不如說是AI正在快速提高自身參與AI研發的程度。

隨着這一比例繼續提升,如何衡量研發自動化程度、如何監督AI Agent行為,以及如何確保安全投入跟上研發自動化速度,可能成為前沿AI實驗室未來需要持續回答的問題。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10