DeepMind成立新研究院

2026年9月18日 00:00
站內 AI 整理稿

首批四篇文章聚焦透明推理與前沿評估 谷歌旗下人工智慧研究機構DeepMind於9月16日正式對外宣布成立全新研究院,並同步發布首批四篇文章,作為新機構研究方向的首次公開亮相。此舉被視為DeepMind在既有研究版圖之外,進一步擴張組織架構與議題設定能力的重要一步。據公布的資料,新研究院初期對外釋放的核心議題集中於兩個方向:透明推理與前沿評估。前者指向模型推理過程的可解釋與可追溯,後者則關乎前沿模型能力的評估方法。兩條主線一內一外,分別回應了當前大型模型在「過程是否說得清」與「能力是否量得準」上的關鍵疑問。在透明推理方面,焦點在於讓模型的推理鏈條具備可讀性與可核查性。

隨著模型被廣泛應用於複雜任務,外界對其得出結論的路徑愈發關注,如何讓推理步驟可被檢視、追溯甚至驗證,成為研究與治理共同面對的課題。新研究院將此列為首批對外展示的方向之一,顯示其對模型內部運作透明度的重視。在前沿評估方面,重點則落在如何衡量最尖端模型的能力邊界。當模型能力快速迭代,傳統評測方式往往難以完整反映真實水準,評估方法的設計本身也成為一項前沿研究。研究院將評估視為獨立議題,意味著其不僅關注模型「能做什麼」,也關注「如何確認它真的能做到」。除了研究院的成立與首批文章方向,DeepMind負責人Hassabis在相關表態中提出了一項30天保密測試的提議。

該提議擬為前沿模型的發布與評估環節增加一道時間約束,讓模型在正式對外之前,先經歷一段受控的測試與觀察期。所謂30天保密測試,核心在於以時間換取更充分的檢驗。對前沿模型而言,發布節奏與安全評估之間長期存在張力,若能在發布前預留固定窗口進行封閉測試,理論上有助於在能力公開前發現潛在風險,並為後續的評估與決策提供更完整的依據。這項提議與前沿評估的方向彼此呼應。若評估方法本身仍待完善,那麼一段受控的測試期,便成為在方法成熟之前的過渡性安排。兩者共同構成了新研究院初期議題中,關於「如何更負責任地推進前沿能力」的一組配套思路。

值得注意的是,目前公開的資料僅涉及研究院的成立、首批文章方向以及該測試提議,更多具體的研究計劃與參與方資訊尚未披露。外界尚不清楚研究院的組織規模、人員構成、與DeepMind既有團隊的分工,以及後續是否會有更完整的路線圖公布。從議題設定來看,新研究院選擇以透明推理與前沿評估作為開場,具有一定的策略意涵。這兩個方向分別對應模型的可理解性與可衡量性,既是學術研究的前沿,也是監管與公眾關注的交會點,容易在技術社群與政策討論中同時獲得回應。在產業層面,成立獨立研究院並以首批文章定調,是一種常見的議題布局方式。

透過集中發布研究成果,機構可以在短時間內向外界傳達其關注的核心問題,並吸引相應的研究人才與合作方,為後續的長期投入鋪路。就目前資訊而言,這一步更像是議題的公開與定調,而非完整計劃的揭露。研究院的實際運作方式、資源投入與產出節奏,仍有待後續觀察。首批四篇文章作為方向宣示,其具體內容與方法貢獻,也將成為外界評估該研究院定位的重要依據。整體來看,DeepMind此次成立新研究院,圍繞透明推理與前沿評估兩大方向展開,並由Hassabis提出30天保密測試的構想,為前沿模型的發布與評估增設時間約束。在具體計劃與參與方仍待披露的情況下,這一系列動作已為其後續研究議程劃出了初步輪廓。

Related

相關文章

消息稱 Anthropic 低調建立生物實驗室,借 AI 推進藥學研究

作者:清源 責編:清源 評論: 9 月 18 日消息,路透社今天(18 日)晚間援引知情人士消息稱,Anthropic 在舊金山灣區低調建立了一座溼實驗室,把 AI 業務進一步延伸到需要實際動手操作的生物學研究和藥物科學領域。知情人士透露,在公眾對 AI 風險愈發擔憂之際,Anthropic 開始在溼實驗室進行實體實驗。Anthropic 此前提出,希望藉助 AI 推動罕見病治療方法的發展,公司的生物學研究也從“計算機模擬”和計算機評估進一步走向真實實驗。注:溼實驗室是一個科學概念,與“幹實驗室”相對。相比干實驗室,溼實驗室在實驗中需要用到較多的化學試劑。相比之下,幹實驗室則注重通過各種儀器進行計算,以歸納出實驗材料的物理模型。Anthropic 生命科學負責人埃裡克 · 考德勒-艾布拉姆斯證實了溼實驗室的存在。“我們認為,生物學研究最終還是要接受真實實驗室工作的檢驗,而且未來一段時間都會如此。我們現在確實在做這些工作。整體模式和大多數生物科技公司類似,一部分在自己的設施裡完成,另一部分則與外部合作伙伴共同開展。”Anthropic 發言人又進一步補充,這座實驗室並非專門用於藥物發現,並拒絕進一步說明具體用途。知情人士稱,建立溼實驗室只是 Anthropic 邁向更大目標的一小步。Anthropic 希望攻克其認為製藥行業忽視的疾病,公司也希望在員工和公眾失去對 AI 價值的信心之前拿出成果,因為 AI 可能導致崗位消失,甚至威脅人類生命。不過,任何藥物研發項目都無法保證成功,大多數候選藥物最終都無法通過臨床安全性和有效性試驗。這項工作對 Anthropic CEO 達裡奧 · 阿莫迪還有一層個人意義。

4 小時前

AGI最難一戰,竟在醫院!中國AI登上Science,醫生不怕失業還催著上線

。 2016年,Hinton老爺子就預言:“人們現在就應該停止培養放射科醫生。”他甚至認為,五年內,AI就會在醫療影像識別上超過放射科醫生。 老爺子一生謹慎,但歷史和他開了個玩笑。十年過去了,人們離AGI已經越來越近,但在醫療場景裡,即使圖像識別這樣的AI新手村任務,依然是hard模式。 如果從IBM的Watson算起,在醫療上遭遇滑鐵盧的AI專家數不勝數。

9 小時前

AGI最難一戰,竟在醫院,中國AI登上Science,醫生不怕失業還催著上線

我没办法凭这条标题写出符合要求的完整新闻稿,原因很直接: 现有"可用资料"其实只有一行标题,正文是空的。后面的内容全是的侧边栏推荐和网站导航(Anthropic华人、Manus估值、腾讯投资药企等),跟这条新闻没有关系。 如果硬写 900–1600 字,我就得自己编造这些关键事实: 是哪个团队、哪家医院、哪篇 Science 论文 论文的具体方法和结果数据 医生"催着上线"的具体场景和原话 这些一旦写出来就是假新闻,我不做这个。

11 小時前

AI製藥獨角獸Anew單飛,字節推了一把“最燒錢的慢生意”

Reuters:Anew Labs完成首輪外部融資2.9億美元、投後估值15億美元,HSG、IDG Capital、GL Ventures、五源資本等機構入股,字節跳動融資後持股56%。2. IQVIA 2026年分析:經確認有AI參與的新興生物科技項目I期、II期臨床成功率比較,及樣本有限的說明。3. 《Nature Reviews Drug Discovery》2026年8月Perspective:AI方法與基準測試大量出現,臨床相關性影響證據仍然有限。4. Deloitte全球大型生物製藥公司晚期研發管線年度研究:2025年平均藥物開發成本約26.7億美元,計算含研發失敗成本。

11 小時前