Alibaba Qwen Releases Qwen3.8-Max: A 2.4 Trillion Parameter MoE Model and the Most Capable One in the Qwen Family to Date
重點摘要
Alibaba’s Qwen team has made Qwen3.8-Max broadly available and confirmed that its open weights ship next week. A second checkpoint, Qwen3.8-27B, is also going open-weights. Qwen3.8-Max is a 2.
阿里巴巴Qwen發布Qwen3.8-Max:2.4萬億參數MoE模型,開啟Qwen家族新紀元
近日,阿里巴巴旗下Qwen團隊正式宣布,其最新旗艦模型Qwen3.8-Max現已全面開放使用。這是一款擁有2.4萬億參數的混合專家(MoE)模型,被譽為Qwen家族迄今為止能力最強的代表作。與此同時,團隊確認該模型的开源權重將於下週正式對外發布,另一款同系列模型Qwen3.8-27B也將一併開源。 據了解,Qwen3.8-Max的發布標誌著阿里巴巴在大型語言模型領域的又一重大突破。作為一款Mixture-of-Experts架構的模型,它通過將龐大的參數空間劃分為多個專家子網絡,在推理時僅激活部分專家,從而在保持高效計算的同時,實現了模型容量的極大擴展。2.4萬億的參數規模,使其一舉超越此前家族內的所有型號,成為名副其實的「巨無霸」。 在輸入輸出能力上,Qwen3.8-Max展現了卓越的多模態理解水平。它不僅能處理純文本信息,還能同時接收圖像和視頻輸入,並生成對應的文本輸出。這意味著用戶可以將圖片、視頻等非結構化數據直接饋送給模型,用於場景描述、內容摘要、視覺問答等多種實際任務,為企業級應用提供了極大的便利。 開源策略一直是Qwen團隊的重要方向。此次Qwen3.8-Max及其兄弟版本Qwen3.8-27B確認將在下週開放模型權重,這無疑將進一步鞏固開源AI社區的活力。開發者可以在自己的基礎設施上自由部署、微調這些模型,或將其集成到各種應用中。這種開放姿態,也讓Qwen系列成為眾多企業和研究機構的首選之一。 針對企業用戶最關心的部署問題,Qwen團隊給出了明確答案:Yes, it is deployable. 但具體的部署方式則取決於所選擇的製品(artifact)。目前,用戶可以透過託管API(Hosted API)立即接入Qwen3.8-Max,並且該服務對任何規模的公司都開放。無論是初創團隊還是大型企業,都能在沒有額外硬件投入的情況下,快速體驗到這款頂級模型的性能。 在API兼容性方面,Qwen團隊特別強調,Qwen3.8-Max的託管API既兼容OpenAI的接口規範,也支持DashScope(阿里雲的模型服務平台)的標準。這意味著,現有用戶只需更換基本的URL和模型ID,就能完成無縫遷移,不需要對現有代碼進行大幅修改。這種設計極大降低了集成門檻,使得從其他模型切換到Qwen3.8-Max的過程變得異常簡單。 作為Qwen家族的最新成員,Qwen3.8-Max在多項任務上的表現備受矚目。根據部分早期測試和用戶反饋,該模型在複雜推理、代碼生成、數學解題以及多模態理解等維度均展現出強勁實力。雖然具體的基準測試數字尚未完全公開,但從其規模和架構來看,業界普遍預期它將在眾多榜單上佔據領先地位。 值得注意的是,Qwen3.8-Max的發布時機也頗具深意。當前,全球人工智能領域正處於大模型競爭的白熱化階段,各家科技巨頭紛紛推出超大規模參數模型。阿里巴巴此時選擇將這款旗艦產品開源,顯示出其希望通過開放生態來吸引更多開發者和企業用戶的戰略意圖。這不僅有助於提升Qwen在行業中的影響力,也可能重塑開源大模型的競爭格局。 從技術層面深入分析,Mixture-of-Experts架構的優勢在於它能夠在不太增加計算成本的情況下,大幅度提升模型容量。Qwen3.8-Max擁有2.4萬億總參數,但在實際推理時,可能只會激活其中的一部分。這種稀疏激活的特性,使得它即便運行在相對有限的硬件資源上,也能獲得較好的性能表現。這對於廣大希望自部署的中小型企業來說,無疑是一個利好消息。 然而,企業在實際部署時仍需考慮自身的需求。如果希望擁有完整的數據控制權,或者需要對模型進行深度定製,那麼等待下週開源權重並自建推理環境將是更合適的選擇。反之,如果希望快速上線、按需付費,則可以優先使用託管API。兩種方式各有優勢,關鍵在於匹配業務場景。 為了讓更多開發者快速上手,Qwen團隊也在積極完善配套工具鏈。據悉,後續將提供詳細的模型文檔、示例代碼以及遷移指南,同時社區也將有大量的第三方教程湧現。這一系列舉措將進一步降低使用門檻,讓更多人可以接觸到這款前沿模型。 在生態合作方面,阿里雲的DashScope平台上已經準備好了相關的接入能力。企業用戶可以透過DashScope直接調用Qwen3.8-Max,並享受阿里雲提供的穩定服務和技術支持。同時,由於兼容OpenAI接口,現有的OpenAI用戶也能輕鬆切換,享受更大的模型能力和更優惠的定價策略(如果有)。 總體而言,Qwen3.8-Max的發布不僅代表了Qwen團隊在技術創新上的重要里程碑,也再次證明了開源精神在AI領域的強大推動力。它提供的多模態輸入能力和極具彈性的部署方式,使其有望成為企業構建智能應用時的有力選項。未來,我們有理由期待Qwen團隊繼續推出更多突破性的產品。 需要注意的是,雖然Qwen3.8-Max目前已經可以通過API使用,但具體的服務穩定性、響應速度以及定價細節,仍需以官方發布為準。建議感興趣的用戶密切關注Qwen團隊的官方公告,以獲取最新信息。开源權重釋放後,我們也將看到更多社區驅動的創新應用。 最後,讓我們回顧一下這款模型的核心要點:2.4萬億參數MoE架構、文本/圖像/視頻多模態輸入、文本輸出、開放權重即將釋放、API即日可用、兼容OpenAI和DashScope。這些特性共同構成了Qwen3.8-Max的亮點,也為人工智能的未來發展注入了新的活力。對於那些一直在評估最前沿大模型的企業和研究人員來說,現在無疑是一個值得密切關注的時刻。
Related
相關文章
SK海力士與閃迪發佈HBF首個標準規範,為AI推理時代破解“內存牆”
美國閃存峰會(FMS 2026)在加利福尼亞州聖克拉拉會展中心開幕之際,SK海力士宣佈聯手閃迪(Sandisk)共同發佈下一代存儲技術:高帶寬閃存(High Bandwidth Flash,簡稱HBF)的首個標準規範。該規範由全球最大的開放式數據中心技術合作組織OCP(Open Compute Project)正式發佈,定位為行業通用開放標準。

美國政府完成先進 AI 模型自願性評估框架制定,內容未公開
美國政府已按期完成針對先進 AI 模型評估的自願性框架制定,但白宮未對外公開具體內容、審閱機構及採用時程。該框架原應涵蓋保密、網路安全、風險管理與智慧財產權等要求,不過相關基準測試與適用門檻被列為機密。白宮計劃與業界召開會議審查該框架,並與更多合作夥伴討論後續步驟。
智譜AI新一代大模型GLM-5.3意外曝光
智譜AI尚未正式發佈的新一代旗艦模型GLM-5.3,因官網頁面、搜索引擎緩存及開源代碼庫等多渠道的“意外”洩露而提前曝光。GLM-5.3的意外曝光,使得三大頭部廠商的頂級模型在短期內集中亮相,市場爭奪戰一觸即發。截至發稿,智譜AI官方並未就GLM-5.3的洩露事件及具體發佈時間做出正式回應。業內普遍預期,鑑於模型已進入公開測試或展示階段,智譜AI或將在近期擇機正式對外公佈GLM-5.3的詳細技術參數與上線計劃。
DeepSeek-V4-Flash登頂全球調用量榜首,國產大模型包攬前五
7月31日最新發布的DeepSeek-V4-Flash正式版以2.33萬億Token的調用量強勢登上榜單第八。DeepSeek-V4-Flash 0423版和DeepSeek-V4-Flash 0731版合計調用量斷層領先。僅8月3日一天,DeepSeek-V4-Flash 0731版的調用量就達到1.02萬億Token,超過此前霸榜的DeepSeek-V4-Flash 0423版。價格方面,V4-Flash的競爭力幾乎無人能敵。海外開發者集體沸騰DeepSeek V4-Flash正式版上線後,海外開發者社區的反應堪稱熱烈。研究機構Artificial Analysis更直言,DeepSeek-V4-Flash已成為全球知名模型中運行成本最低的一款。從7月31日API公測到8月3日登頂全球調用量榜首,DeepSeek-V4-Flash僅用了不到一週時間。

飛書變革的伏筆,字節早就埋好了
字節跳動將飛書產品團隊與豆包團隊整合,並將飛書GTM團隊併入火山引擎,這是字節跳動為加速AI商業化而進行的最大規模To B業務重組。此舉旨在讓飛書成為AI原生應用的載體,並整合豆包與火山引擎的能力,以搶佔桌面AI辦公入口,並應對高昂的AI基礎設施投入與商業化壓力。

阿里字節騰訊,為AI辦公拼了
字節跳動、阿里巴巴與騰訊在短短兩週內接連對AI辦公領域進行重大整合,分別將飛書、千問辦公及WorkBuddy等產品與AI能力深度綁定,意在搶佔下一代辦公入口。三家巨頭皆認為,辦公場景已成為大模型token變現效率最高的領域,且Agent技術已跨越可用性門檻,因此同步加速內部整合,以統一產品入口覆蓋全流程工作流。