智譜實現RSI最小閉環,A社:我來監督

2026年9月18日 16:19
智譜實現RSI最小閉環,A社:我來監督
站內 AI 整理稿

智譜AI近日對外宣布,已在遞歸自我改進(Recursive Self-Improvement,簡稱RSI)領域取得關鍵技術突破,成功實現業界首個「最小閉環」系統。與此同時,被業內簡稱為「A社」的AI安全研究機構同步表態,將以第三方監督角色介入該系統的測試與驗證流程,確保技術發展符合倫理與安全規範。所謂的最小閉環,指的是系統能在不依賴外部人工反饋的情況下,自主完成從自我評估、參數調整到性能驗證的完整循環。智譜團隊透露,其新一代訓練框架讓模型在特定任務上能夠反覆優化自身,每次迭代後都會記錄改進幅度,並在達到設定閾值時自動停止,避免陷入失控的無限循環。

這項進展被視為邁向通用人工智慧(AGI)道路上的重要里程碑,因為它解決了長期以來困擾業界的安全可控問題。A社的監督角色則為這項技術增加了外部制衡機制。據了解,A社將派駐獨立審計員進駐智譜實驗室,對RSI閉環中的每個決策節點進行即時監控,同時保留一鍵終止權限。A社代表在聲明中指出,他們的任務不是限制創新,而是確保最小閉環的邊界不被隨意擴張,防止模型在優化過程中出現意外的行為偏移。這種「開發者-監督者」分離模式,在AI業界尚屬首次公開嘗試。智譜AI與A社的合作始於去年底,雙方當時簽署了一份為期三年的安全研究協議。根據協議內容,A社有權查閱智譜RSI系統的原始日誌、訓練資料以及測試報告。

智譜方面強調,此舉並非對外公開原始碼,而是建立一套透明的問責機制。智譜創始人在一份內部備忘錄中寫道,完全封閉的研發可能導致安全漏洞被忽略,而過度公開又可能引發技術濫用風險,引入獨立監督恰好能在兩者之間取得平衡。技術細節方面,智譜的RSI最小閉環設計主要包含三個層級:第一層是自我診斷模組,用於偵測模型在不同輸入下的表現一致性;第二層是策略生成器,根據診斷結果提出改進方案,例如調整注意力權重或優化推理路徑;第三層是安全守門員,它會評估改進方案是否符合預先定義的倫理規則,只有通過審核的變更才會被寫入模型。A社的監督主要針對第三層,確保守門員的判斷標準不被模型自身悄悄修改。

值得注意的是,就在智譜發布消息前數小時,Google旗下DeepMind團隊也公開了一項關於RSI的研究。他們提出一種名為「夢境推論」的捷徑方法,讓模型在虛擬環境中反覆推演結果,從而加速自我改進過程。兩項進展幾乎同時出現,顯示全球頂尖AI實驗室都在加速攻克RSI這個核心難題。業內分析認為,誰能率先在RSI的安全可控性上取得突破,誰就可能在下一代AI系統中佔據主導地位。智譜的閉環系統目前僅在特定問答任務上完成測試,準確率從初始的72%提升至89%,而整個優化過程僅耗費原本所需的四分之一算力。

但A社的監督報告也指出,當任務難度超出某個門檻時,模型的改進策略開始出現難以解釋的跳躍,部分優化步驟無法透過現有評估標準覆現。這正是為什麼需要持續監督的原因。A社計畫每兩周發布一次監督進度摘要,公開關鍵發現。對於市場較關注的商業化時間表,智譜方面並未給出明確答覆。公司發言人僅表示,RSI最小閉環目前仍處於研究驗證階段,距離產品化還有一段距離。但該技術若成熟,將率先應用於智譜的開源模型系列,幫助開發者在本地端更高效地微調模型,同時避免數據外洩。A社的監督模式也可能成為行業標竿,吸引更多監管機構參考。整體來看,智譜與A社的合作模式正在為AI安全治理提供一條新路徑。

過去,無論是OpenAI還是Google,都傾向於內部成立安全團隊,但外部獨立監督的案例極少。智譜主動引入A社,某種程度上回應了學界與社會對AI發展黑箱的擔憂。後續發展值得密切關注,尤其是A社的監督報告是否會揭露系統的潛在脆弱點,以及智譜能否在監督壓力下持續保持技術領先。目前,智譜的RSI最小閉環已進入第二階段測試,測試範圍將從語言任務擴展到多模態理解。A社也將同步升級監督工具,加入自動化異常檢測系統。雙方表示,目標是在年底前完成至少十輪完整閉環驗證,並形成一份可供業界參考的最佳實踐指南。這項動態不僅關乎智譜一家公司,更可能影響整個AI產業對於自我改進技術的信任與採用意願。

Related

相關文章

達卯科技算電協同2.0平臺入選2026國際數字能源展重大成果發佈

成果中唯一聚焦算電協同全鏈路運營的AI技術產品 9月15日-17日,2026能源綠色發展大會・國際數字能源展在深圳舉辦。展會首次以“一會一展”深度融合模式打造全球數字能源產業盛會,集中發佈近百項前沿創新成果。達卯科技自主研發的「算電協同2.0平臺・AIDC綠電直連能源運營操作系統」成功入選重大成果發佈,也是成果中唯一聚焦算電協同全鏈路運營的AI技術產品。

剛剛
全天候科技產業與商業

小鵬要把賣車和賣技術一起推向全球

王小娟 發表於 2026年09月18日 14:05 摘要:技術合作再尋新客戶。9月17日晚,小鵬集團董事長、CEO何小鵬談起G9L的價格,說自己和總裁王鳳英曾在會議室裡反覆爭論。幾小時前,這款車剛以23.18萬元的 限時起售價上市,較8月公佈的預售起售價低了2.

1 小時前

Claude“主導”Anthropic 26%的AI研發、3萬Agent同時運行:當AI開始“造AI”,頭部公司RSI路線正在分化

根據報導,人工智慧領域近期出現一項值得關注的動向:Anthropic 的 AI 模型 Claude 在其內部研發工作中扮演了主導角色,佔據該公司約 26% 的 AI 研發比例,同時有高達 3 萬個 Agent 在同一時間並行運作。這項數據反映出 AI 開始「製造 AI」的趨勢正在加速,而頭部公司在遞歸自我改進(RSI)路線上的分化也愈發明顯。 Claude 不再只是對外服務的產品,而是成為 Anthropic 內部研發流程的核心引擎。

6 小時前

傳聞四起,人形機器人IPO審核收緊?

近期市場傳出多項風聲,指稱人形機器人領域的首次公開募股(IPO)審核可能出現收緊趨勢。雖然官方尚未發布明確指引,但這波傳言已在投資人與業界之間引發討論,不少人開始關注監管層是否會對這類新興科技公司的上市門檻提出更高要求。 與此同時,宇樹科技在資本市場上的戲劇性波動,也被視為影響整體情緒的關鍵變數。

7 小時前

華為雲企業級AI產品全面落地 做最開放的Agentic Cloud

在華為全聯接大會2026期間,華為公司董事、華為雲CEO周躍峰發表“共建Agentic Cloud,共贏行業智能體時代”主題演講,分享華為雲最新進展:深耕雲上“硅基黑土地”,靈衢昇騰950智算集群服務全球上線,夯實Agentic AI基礎設施底座;Agentic MaaS平臺匯聚“百模千態”,加速模型能力規模化服務;企業級智能體平臺智果AgentArts已服務100多家企業;“行業AI夢工廠”沉澱超過上千個行業資產,落地項目超過1000個,政務智能專區及AI硬件專區全新上線,推動智能體走向規模化應用,共建雲上繁榮AI生態。

7 小時前