
微軟測試其首款自研全雙工 AI 語音 MAI Realtime 模型:支持中文等 16 種語言、2 種風格
微軟正在測試其首款全雙工 AI 語音模型 MAI Realtime,支援中文等 16 種語言與兩種語音風格,可實現同步聆聽與回應。該模型目前僅開放給部分合作夥伴在 MAI Playground 進行測試,正式上線時間尚未公布。
分類頻道
共 302 篇文章,依最新發布時間排序。

微軟正在測試其首款全雙工 AI 語音模型 MAI Realtime,支援中文等 16 種語言與兩種語音風格,可實現同步聆聽與回應。該模型目前僅開放給部分合作夥伴在 MAI Playground 進行測試,正式上線時間尚未公布。

這篇消息聚焦「從實驗到產線——AI 工作流的規模化挑戰與協作生態 | 2026 ChinaJoy AI未來生態大會」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

這篇消息聚焦「Karpathy實測Opus 5:讀一段《魔戒》,10美元直出中土世界」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

楊植麟的美國博士導師Ruslan Salakhutdinov透露,楊植麟曾拒絕蘋果工作機會,選擇回中國創業,反映美國留不住頂尖人才。Salakhutdinov指出Kimi K3模型優勢在開源策略,但評估其實際能力仍為時過早。

知名AI學者Andrej Karpathy提出以「Show me《指環王》」作為評測大型語言模型的新基準,挑戰模型對複雜敘事與世界觀的理解。他認為過去簡化的測試已過時,需採用長篇史詩來區分不同模型的優劣。此提議引發開發者與研究者的關注與討論,凸顯業界對更嚴謹評測標準的需求。
AI資訊AI新閒資訊正文德國法院重磅裁定:AI音樂生成器Suno侵犯版權,被駁回合理使用抗辯發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘近日,慕尼黑一家法院對知名AI音樂生成器 Suno 做出了一項重要裁決。法院認定,Suno 在AI模型的訓練過程以及最終的輸出結果中均構成了版權侵權,並正式駁回了該公司提出的合理使用抗辯。這一判決目前尚未最終生效。
AI資訊AI新閒資訊正文OpenAI 新模型 Astra 數學領域表現出色,但被過分誇大了發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘OpenAI 內部測試的新模型 Astra 近期在數學領域表現驚豔,引發了科技界和社交媒體的廣泛熱議。然而,著名學者Gary Marcus撰文指出,外界對 Astra 的狂熱追捧犯了典型的“合成謬誤”,過分誇大了其通用性。
CausalVLBench測試視覺因果。 阿肯色團隊推出視覺因果基準。基準覆蓋因果乾預與反事實任務。現有多模態模型���仍明顯吃力。查看視覺因果評測論文開放實驗細節。配套代碼僅獲**4**仍便於復現。
MindMemOS讓記憶持續進化。 華為諾亞開源MindMemOS記憶層。它把記憶���從單個智能體中解耦。查看智能體記憶開源倉庫暫未展示星數。三維結構保存狀態與演化軌跡。雙榜成績達到94.03與70.63%。
OpenAI公開十項證明。 Astra主導十項數學成果。研究���覆蓋群論與量子複雜度。十項數學成果官方說明公佈詳情。形式化證明代碼倉庫同步開放。全部成果已用Lean 4驗證。
研究團隊推出全新物理世界模型PhiZero,有別於主流直接預測像素,改以「物理語言」離散表徵進行顯式物理推理。該模型採用「先推理、後渲染」架構,先推斷未來動態軌跡再交給擴散解碼器生成影片,在Physics-IQ Verified等基準測試中獲領先成績,有望助益具身智能與長時程模擬。
無Key注意力緩存減半。 新機制直接移除傳統Key表示。僅保留數值緩存���降低內存開銷。五款模型多數達到相當或更優表現。高效注意力研究論文解釋路由設計。長文本解碼吞吐有望明顯提高。
多款模型出現零字節輸出。 研究覆蓋31430次模型測試。十一款模型���出現無文本執行。嚴格配對記錄2505次空洞。跨模型驗證資料已開放複核。現象並非拒答或傳輸故障導致。

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 這這這…翁荔光速回OpenAI上班了 Jay 2026-07-30 08:31:19 來源:量子位 6位聯合創始人——只剩2名。
近年來,視覺語言動作模型(Vision-Language-Action Model,簡稱 VLA)在機器人領域逐漸成為主流,這類模型能將自然語言指令直接轉換為機器人的動作序列,讓機器人更直觀地與人類互動。然而,目前性能領先的系統大多依賴三到七十億參數的大型骨幹模型,龐大的記憶體需求往往超出嵌入式機器人的硬體預算,限制了這項技術在輕量級邊緣裝置上的應用。
通用視頻世界模型開發完成 近日,一款名為 Wonder 的通用視頻世界模型正式公開,迅速在人工智慧領域掀起討論。根據消息來源「何夕2077」指出,這項研究由 Jiacong Xu、Hanwen Jiang 等學者共同完成,實現了從靜態圖片或條件影片出發,即時生成可供使用者自由操控相機的動態三維世界。不同於傳統的影片生成工具,Wonder 讓使用者不再只是被動觀看,而是能像在遊戲中一樣主動探索場景,開創了影片生成的全新互動模式。 過去幾年間,影片生成模型雖然進步神速,但多數作品仍停留在「生成一段固定視角的短片」階段。

Mythos團隊在60小時內成功破解後量子密碼演算法,引發比特幣長期安全性疑慮。比特幣的橢圓曲線數位簽章演算法對量子電腦脆弱,業界呼籲盡快導入抗量子簽章方案。儘管目前無立即危險,但這項突破已為密碼學領域敲響警鐘。

這篇消息聚焦「“奧爾特曼”最新訪談:AGI即將到來,但權力集中才是真正威脅」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。
李飛飛團隊近期提出以世界模型訓練機器人的新方法,成功在五種不同真實機器人上進行測試,並達成連續運行一小時不出錯的穩健表現。這項成果顯示,透過世界模型的模擬與預測能力,能有效提升機器人在真實環境中的適應與執行任務的可靠度。 根據智東西的報導,該研究已在多種硬體平台上驗證,涵蓋不同形態的機器人,且長時間運作未發生失誤,展現世界模型在機器人領域的實用潛力。