Figure發佈Helix2.5,30戶陌生家庭零樣本成功率達56%

2026年9月18日 10:53
Figure發佈Helix2.5,30戶陌生家庭零樣本成功率達56%
站內 AI 整理稿

AI資訊AI新聞資訊正文Figure發佈Helix2.5,30戶陌生家庭零樣本成功率達56%發佈於AI新聞資訊發佈時間 :2026年9月18號 10:30閱讀 :1分鐘Figure於9月17日發佈人形機器人神經網絡Helix2.5。該模型基於公司Index人類行為數據集預訓練,並在舊金山灣區30戶此前未採集數據的家庭中測試。結果顯示,相比從零開始訓練的同條件策略,Index預訓練將零樣本成功率從9%提升至56%。Helix2.5基於單一Index預訓練基礎模型,支持整理客廳、摺疊毛巾和鋪床三類全身動作。

評估過程中,家庭環境及玩具、毛巾、床上用品均未出現在任務規範數據中,且所有任務均要求完整完成才計為成功。Figure還表示,Helix2.5僅使用此前Helix02一半的適應性數據,即可取得相當的成功率,並展現出後退調整位置、改變站姿及在床上移動等全身自我糾正能力。為隔離預訓練貢獻,Figure保持模型架構、優化方式、超參數、下游數據及評估條件一致,僅改變初始化方式。公司稱,Index數據集中沒有任何一項評估任務佔比超過1.90%,上述結果直接體現了預訓練對泛化能力的貢獻。進一步實驗顯示,Index數據量每翻倍,動作預測損失均呈可預測下降趨勢,公司據此測量了人形機器人領域的數據縮放規律。

Index於8月25日正式推出,目前累計下載26.4萬次,每週活躍用戶超過4.4萬,已收集超1600萬個視頻,並向數據貢獻者支付1500萬美元。Figure稱,已投入35億美元計算資源訓練Helix系列。相關推薦谷歌最強數學推理模型曝光:代號 Mathematica,100 萬詞元上下文專攻數學難題谷歌被曝基於DeepThink V3打造實驗模型Mathematica,針對複雜計算與符號問題求解優化,或成最強數學推理AI。

API顯示其內部標識符為“models/deepthink-mathematica-tf-raw-thoughts”,支持百萬token上下文,輸出上限65536 token,並標註“不穩定實驗版”。2026年9月18號 9:2772.1kDeepMind成立新研究院,四篇文章直面AGI關鍵問題谷歌與DeepMind研究人員9月16日成立DeepMind研究院,旨在推動通用人工智能(AGI)跨學科討論。董事包括Shane Legg、James Manyika、Demis Hassabis,Legg任執行主編。

研究院強調呈現谷歌、DeepMind及全球研究界的不同觀點,首批發布四篇文章,聚焦AGI經濟政策、模型推理透明度、人類繁榮原則及前沿AI。2026年9月18號 9:01100.1k英國 AI 初創 Emulate 啟動融資,目標最高募資7億美元、估值37億美元英國AI初創公司Emulate啟動新一輪融資,目標最高7億美元,投後估值約37億美元,Index Ventures等領投。公司成立於2026年8月,創始人曾任職谷歌DeepMind,參與開發Genie世界模型,可據簡短提示生成逼真視頻與交互式3D環境,發佈時引發遊戲行業震動。2026年9月17號 17:31193.

9k冰島初創公司 Treble 斬獲 1800 萬美元 A 輪擴展融資音頻AI領域吸金數十億美元,應用涵蓋客服與銷售通話自動化、會議記錄普及,以及以語音為主交互的AI智能眼鏡。各大AI實驗室加速模型迭代,硬件商全力優化音頻體驗。但新技術須經嚴謹測試與反饋。冰島初創Treble正構建專屬仿真平臺,力圖成為大模型廠商和硬件製造商的測試優化關鍵樞紐。2026年9月17號 15:52174.

2kKimi 發佈金融行業 AI 解決方案:10 餘個數據源一站式接入,資料處理從天級壓到小時級月之暗面發佈Kimi金融行業解決方案,一站式接入10餘個數據源,內置9項金融專業技能與5項安全合規措施,具備機構級數據建模與報告交付能力。方案覆蓋持倉早報、財報點評、項目篩選、深度研究、組合覆盤等場景,將資料處理由“天”級壓縮至小時級,讓專業人員專注分析與決策。2026年9月17號 15:48195.8k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

IT之家模型更新

美國 AI 巨頭提議開發減速,歐洲同行和政界並不認同

作者:清源 責編:清源 評論: 9 月 18 日消息,據路透社今天(18 日)報道,此前,阿莫迪、奧爾特曼和馬斯克先後發出警告,能力不斷增強的 AI 系統可能帶來風險,故有必要控制其發展節奏,但歐洲企業和官員對此表現出明顯懷疑。法國初創企業 Mistral 在聲明中指出,這些風險早在幾個月前就已十分明確了。

1 小時前
IT之家模型更新

北京發佈“詞元經濟十條”:高標準建設詞元工廠,推動關鍵核心技術攻關

作者:浩渺 責編:浩渺 評論: 感謝網友 蛋殼兒 的線索投遞!9 月 18 日消息,北京市經濟和信息化局今日宣佈,北京市“詞元經濟十條”正式發佈。為貫徹落實《國務院關於深入實施“人工智能+”行動的意見》(國發〔2025〕11 號),率先培育智能經濟新形態,以詞元(Token)為抓手,發展詞元經濟新增量,制定《北京市加快詞元經濟發展的行動方案(2026—2028 年)》(注:以下簡稱《行動方案》)。

2 小時前
量子位模型更新

OpenAI剛曝光循環架構,這家公司更早將其用於世界模型

鍵詞只有一個:循環。 Astra採用了一種被稱為“循環深度”(Recurrent Depth)的架構,本質是讓同一組Transformer層被反覆複用,用更少的參數實現更深的計算。 這被外界視為OpenAI對傳統“堆參數、堆算力”路線的一次重大修正——不再只是把模型做大,而是讓模型學會“反覆思考”。 消息一齣,整個AI社區迅速升溫。

6 小時前

千問辦公接入高德門店經營專家套件 提升實體店選址與經營效率

此項新功能自9月18日起正式上線,用戶只需在千問辦公添加相應套件並完成高德賬號授權,即可實現從門店選址到日常經營分析的全鏈路工作。隨著實體商業的不斷發展,傳統的人工選址和經營分析方式顯得效率低下且容易出錯。個體創業者在開新店時,往往需要花費大量時間進行實地勘察,整體耗時可達一週,而商家在監測門店熱度變化及競爭對手動態時,也面臨數據整理繁瑣、分析結果不準確的問題。

7 小時前