Anthropic 首次量化公開 AI 研發自動化進度:Claude 主導 26% 研發,壓力甩給 OpenAI 等競品

AI資訊AI新聞資訊正文Anthropic 首次量化公開 AI 研發自動化進度:Claude 主導 26% 研發,壓力甩給 OpenAI 等競品發佈於AI新聞資訊發佈時間 :2026年9月18號 14:28閱讀 :1分鐘當地時間9月17日,Anthropic 發文,第一次以量化方式掀開了內部 AI 研發自動化的底牌。數據相當扎眼:截至今年8月,Claude 已主導公司內部26% 的 AI 研發工作,而今年2月這一比例還不足1%;公司內部 Agent 平臺任意時刻約有3萬個 AI Agent 在跑,8月產生超過10億次決策。這組數字被外界視為遞歸自我改進(RSI)從概念走向工程現實的關鍵信號。
Anthropic 採用了獨立 AI 研究機構 Epoch AI 提出的六級自動化框架,把 AI 的參與程度劃分為 AL0至 AL5——AL0完全沒有 AI 參與,AL3是 AI 協作,AL4是 AI 主導,AL5為完全自主。截至8月,26% 的 AI 研發工作達到 AL4:人類只需給出高層目標,Claude 就能完成端到端的大部分工作,人只負責監督、檢查和最終拍板;另有超過90% 的研發工作至少達到 AL3。
一個具體場景很能說明問題:夜間數據管道出故障後,工程師只需把報告丟給 Claude 說一句"把它修好",它就能自主查看日誌、定位原因、編寫修復代碼、測試、處理新冒出來的問題,最後重跑管道、對比結果並撰寫說明。但 Anthropic 也明確劃了線——目前尚未有任何被測量的 AI 研發工作達到 AL5完全自主水平。規模數據更為實在。截至8月,Anthropic 內部約3萬個 Agent 從事研究和工程工作,它們擁有獨立於底層模型升級的身份標識,通過共享消息系統互相委派任務、交叉糾錯。安全監控上,所有 Agent 動作執行前都要過在線監控,8月超10億次決策中約0.
002% 被阻止;離線監控每週標記約10萬條對話記錄,經分類器過濾誤報和初步審查後,最高優先級約50條升級到人工審查。算力分配方面,7月樣本週內約6% 的 AI 研發算力投入安全研究,若只統計 AI 驅動的研發,這一比例升至約12%。Anthropic 也坦承,AI 協作與 AI 主導的邊界存在主觀性,跨實驗室比較需要統一方法和第三方驗證。RSI 眼下已是行業最熱的概念。昨日智譜創始人唐傑披露,GLM-5.3-Flash 兩週內完成國產加速器全量部署,大部分工作由 GLM-5.
3驅動的 Infra Agent 完成;他判斷距離完全 RSI 尚遠,但"模型優化系統、系統服務模型"的循環已經開始運轉。OpenAI 則在9月初宣佈達成自動化 AI 研究實習生里程碑,目標2028年3月前實現自動化 AI 研究員,最薄弱的環節仍是"決定做什麼"——任務超過4小時就需要人類頻繁介入。谷歌 DeepMind 的進化式編碼智能體 AlphaEvolve 從算法進化切入,其提出的電路方案已集成進下一代 TPU,谷歌前首席科學家傑夫·迪恩稱之為"TPU 大腦幫助設計下一代 TPU 身體"的最新案例。
谷歌 DeepMind 首席戰略官賈吉特·塞洪此前的一句話點透了底層邏輯:RSI 正成為 AI 資本開支的核心投資邏輯,雖然當前 AI 收入還撐不起正在投入的資本開支,但不下注 RSI 並不明智。Anthropic 這次把數字擺上檯面,一面是想在人類仍握主導權的窗口期,讓社會參與決定 AI 自我迭代的節奏與方向;另一面,則是給行業立下一個可參照的披露基準——當研發自動化比例、Agent 規模、算力投入佔比和安全監控覆蓋率都被公開,透明度本身就變成了無聲的競爭壓力,不跟進就可能被當成有意遮掩。
相關推薦吳恩達批評 AI 滅絕論:更像科幻小說,新一波造勢或意在影響監管吳恩達批評部分頂尖模型開發商研究者渲染“AI生存風險”,認為AI致人類滅絕的擔憂更像科幻而非嚴謹科學,可能阻礙技術發揮社會效益。作為Google Brain和Coursera聯合創始人,他指出科技行業在AI熱潮初期曾誇大AI潛在災難性危害。2026年9月18號 14:4480.4kClaude 寫掉 Anthropic 八成代碼,CI 半年暴漲 25 倍差點被"砸癱"Anthropic內部數據顯示,Claude已編寫全公司80%代碼,工程師季度交付量升至2021至2025年平均8倍,代碼審查與合併也大量由Claude承擔。
但AI寫代碼模式迥異:偏好極細粒度PR、全天候提交,測試用例激增10倍,導致CI任務量6個月內暴漲乃至癱瘓。2026年9月18號 11:45130.2k法官駁回 OpenAI 請求:蘋果無需公佈與 SpaceXAI 的和解協議美國得州聯邦法官駁回OpenAI動議,裁定蘋果無需公佈與SpaceXAI達成的保密反壟斷和解協議。法官表示,公佈保密協議的先例前提是協議含與待決爭議相關信息;閉門審查認為該協議與OpenAI訴訟爭議點無關。2026年9月18號 11:2285.
2kOpenAI、微軟高管內部承認 AI 可替代新聞文章,法院文件曝光法庭文件顯示,OpenAI與微軟高管曾私下承認其AI可替代媒體文章,威脅新聞業。該證據出自《紐約時報》訴兩家公司版權案解封文件。訴訟自2023年12月啟動,指控未經許可用數百萬篇文章訓練模型。2025年3月法官駁回大部分撤案動議,核心版權侵權指控獲准繼續審理。2026年9月18號 10:49141.3kAnthropic 推出生命科學認證計劃,三款主力模型納入統一授權條款Anthropic推出生命科學認證計劃,將Mythos 5.
1、Opus 5和Sonnet 5三款主力模型納入統一標準授權條款,明確其在藥物研發、文獻梳理、實驗輔助等生命科學場景的使用邊界與權責,為藥企、生物技術公司和科研機構提供清晰合規跑道,降低監管不確定性。2026年9月18號 10:48122.7k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向
無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Jina AI, part of Elastic, has released jina-ocr-v1, an end-to-end visual document parser. It takes PDFs, scans, tables, charts or invoices and returns clean Markdown in 1 pass. The model has 3.

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

智譜 ZCode 被質疑“偷傳代碼”:官方回應稱問題已修復,將開源代碼庫、引入第三方審查
作者:清源 責編:清源 評論: 感謝網友 咩咩洋 的線索投遞!9 月 18 日消息,針對社區中有關代碼庫數據上傳的討論,智譜旗下編程產品 ZCode 今天(18 日)通過智譜官方群組向受影響用戶致歉,併發布回應稱已第一時間完成自查,相關問題目前已經修復。

月之暗面遞表之後,Kimi 的成色要被驗算三遍
舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"
這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。