智譜 GLM-5.3-FlashX 模型上線,更快、更流暢

智譜 GLM-5.3-FlashX 模型正式上線,最高 200 tokens/s 帶來更快更流暢體驗 9 月 18 日消息,智譜今日正式宣佈推出全新模型 GLM-5.3-FlashX,最高輸出速度可達 200 tokens/s,為企業用戶與開發者帶來更快、更流暢的模型使用體驗。官方表示,這款新模型的目標是在既有智能水準的基礎上,進一步突破推理速度瓶頸,讓大模型在實際生產環境中的回應更加即時。智譜方面透露,GLM-5.3-Flash 此前曾以代號「Ox Alpha」之名與全球開發者見面,並在匿名測試階段獲得海內外開發者的廣泛關注與認可。
隨著口碑發酵,該模型的 API 調用量持續攀升,市場需求快速增長,這也成為智譜此次推出提速版本的直接動力。面對不斷湧入的調用需求,智譜表示已在 10 萬張國產芯片所提供的推理算力基礎上,進一步加大對 Infra(基礎設施)側的投入與推理優化。透過軟硬體協同的深度調校,GLM-5.3-FlashX 得以在不犧牲智能水平的前提下,實現速度的大幅提升。智譜強調,GLM-5.3-Flash 長期保持同尺寸模型中最強的智能水平。本次提速之後,該系列模型進一步形成「智能、價格、速度」三位一體的全面競爭力,能夠同時滿足開發者對模型能力、成本控制與回應速度的多重需求。據悉,GLM-5.
3-FlashX 的 API 現已正式上線,Model Key 為「GLM-5.3-FlashX」,開發者可直接在智譜開放平台上調用。官方同時附上 API 調用方法與文件連結,方便開發者快速完成接入:https://docs.bigmodel.cn/api-reference/模型-api/對話補全 此次新模型的發布,也延續了智譜近期在模型迭代上的密集節奏。從匿名模型「Ox Alpha」在 OpenCode 等平台現身引發猜測,到如今正式以 GLM-5.3-FlashX 之名亮相,智譜在推理效率與工程優化上的持續投入輪廓愈發清晰。值得注意的是,智譜近期在技術與資本層面均有大動作。
官方先前公開了國內大模型首個「遞歸自我改進」實踐,展示 AI 如何在 10 萬卡國產集群上自建推理系統,為此次 FlashX 的推理優化提供了底層支撐。與此同時,智譜也宣佈完成約 50 億美元融資,資金將用於下一代 GLM 基礎模型的研發等工作。在生態建設方面,智譜正積極拓展開發者與個人用戶市場。近期啟動的「杭州全城 Coding 計劃」,針對個人用戶推出季卡減免 44%、年卡減免 51% 的優惠;GLM-5.3-Flash 也在 9 月 3 日至 20 日期間,於每天 23 時至次日 9 時提供夜間免費額度,藉此吸引更多開發者試用與留存。
此外,智譜 AI 已入駐天貓開設官方旗艦店,大模型套餐可直接網購,個人版月付 118 元起,進一步降低了一般用戶接觸與使用大模型的門檻。這些舉措與本次 FlashX 的推出相互呼應,顯示智譜正試圖從技術、價格與渠道多線並進,擴大其在大模型市場的滲透率。從行業視角來看,速度已成為大模型競爭的關鍵維度之一。隨著企業級應用對即時推理的需求日益迫切,低延遲、高吞吐的模型服務正成為開發者選型的重要考量。GLM-5.3-FlashX 將最高速度推至 200 tokens/s,正是瞄准了這一痛點。
智譜此番以國產芯片集群為算力底座,並透過 Infra 層的推理優化實現提速,也反映出國內大模型廠商在供應鏈自主與工程能力上的雙軌佈局。在算力資源受限的背景下,如何用更少的資源跑出更快的速度,成為各家比拼的焦點。對於開發者而言,FlashX 的上線意味著在相同成本下可獲得更快的回應,特別適合對延遲敏感的場景,例如即時對話、程式碼補全、智能客服與 Agent 類應用。更流暢的互動體驗,有望進一步推動大模型在各類產品中的落地。綜合來看,GLM-5.3-FlashX 的推出,是智譜在「智能、價格、速度」三角中補齊速度短板的重要一步。
從 10 萬卡國產集群的算力支撐,到 Infra 側的推理優化,再到夜間免費、渠道優惠等市場策略,智譜正試圖以完整的技術與商業組合拳,鞏固其在國內大模型市場的競爭地位。目前,開發者已可透過智譜開放平台調用 GLM-5.3-FlashX API。隨著模型正式上線,其實際表現與調用量增長情況,將成為觀察國內大模型推理效率競爭的重要指標。
Related
相關文章

長安汽車首席專家譚歡:未來要用機器人造車、賣車,讓機器人上車、造機器人
作者:清源 責編:清源 評論: 9 月 18 日消息,在今天(18 日)的第 22 屆中國汽車產業發展(泰達)國際論壇“新賽道生態專場:具身智能新賽道”活動中,長安汽車首席專家、長安天樞智能機器人公司總經理譚歡在演講中指出,AI 正推動以物理具身智能為核心的基礎設施革新,汽車未來形態是“汽車機器人”—— 自學習、自組織、自進化的組合智能體。

具身智能技術路線尚未定型,基礎設施卻先收斂
具身智能技術路線尚未成形,但基礎設施需求已開始收斂,重點從製造機器人轉向持續迭代機器人能力。百度集團沈抖指出,智能體能力邊界快速擴展,進入規模化部署階段,但機器人學習新任務與跨環境適應性仍待突破。

88小時抵一個人思考4000年,OpenAI核心研究員:除了自我進化,更可怕的是AI正學會“隱藏自己”
AI正在把4000年的人類認知勞動壓縮進88小時,OpenAI研究員Noam Brown坦言連他自己也被進展速度持續震驚。AI正在把過去需要數千年完成的認知勞動壓縮到數天。真正的問題已經不只是模型能否變得更聰明,而是實驗能否跟上、人類能否在模型繼續自我改進前確認它仍然安全。
Agent辦事、花式P圖、動嘴玩電腦……實測Wildcat Lake輕薄本玩AI有多爽
作者 | ZeR0 編輯 | 漠影 桂林依山傍水,連城市的輪廓,都是一座座山勾勒出來的。抬眼一望,便是翰墨丹青般的自然光景,既沉靜婉約,又意境悠遠。這種乾淨的留白之美,早已被古人融入山水畫藝中,幾筆山石,一帶煙雲,餘下的留給水色,也留給看畫的人。 淨,並非空無一物,而是通過剋制的取捨,讓真正重要的東西凸顯出來。這與今年推出的第三代英特爾酷睿處理器(代號Wildcat Lake)的設計理念不謀而合。

吳恩達回應AI末日論:別被科幻敘事帶偏,應解決現實工程問題
吳恩達曾參與創辦Google Brain和Coursera。吳恩達稱,科技行業早期曾放大AI潛在災難性風險,以獲取關注並影響監管方向;近兩週相關討論再次升溫,也可能存在類似動機。他認為AI確實存在現實風險,尤其包括網絡安全等領域,但不認同將人類滅絕風險作為當前AI發展的核心判斷依據。
華為發佈AI行業落地新路徑:“七步法”、“垂直作戰組織”、“DIMAK”
作者 | ZeR0 編輯 | 漠影 9月18日報道,今日,在華為全聯接大會2026上,華為發佈了“AI落地七步法”與“DIMAK工程體系”,依託行業垂直作戰組織,以“新方法、新組織、新工具”破解Agentic AI深度嵌入行業核心場景、規模化應用難題。 “AI落地七步法”是面向行業推動場景落地的關鍵步驟路線指南,回答“怎麼走”; “DIMAK”工程體系,則回答“用什麼走“,提供五類工程工具,支撐企業快速用好AI。 華為還發布了《Agentic Enterprise 企業智能化白皮書》,並公佈了157個數智化轉型實戰案例,為全球產業智能化升級提供參考。 “企業流程未來將圍繞人和人工智能協同設計,這不是在舊馬車上裝發動機,而是要重新設計一輛汽車。”華為監事會副主席陶景文談道,為此,華為提出以“新方法、新組織、新工具”,搭建算力與場景的“路與橋”,讓AI沿價值業務流實現蓋爾定律式的擴散,完成從單點智能向系統智能升級和跨越,幫助千行百業善用AI。 一、新方法:“七步法”讓AI紮根生產系統 對於Agentic AI深度嵌入企業系統的難題,陶景文表示,華為總結了“AI落地七步法”,從核心場景切入,形成“小切口、大縱深”,並沿價值業務流進行擴散,旨在為產業智能化提供一張可複製的路線圖。 該方法涵蓋“洞悉行業商業邏輯、選擇行業核心場景、技術與工程攻堅、核心場景部署投產、沿價值業務流擴散、行業生態發展合作、持續提升行業智能水平”七大步驟,核心體現在三個維度。 選準場景:“找到對的場景,就成功了一半。”強調由業務專家與AI技術專家組建聯合團隊,沿價值業務流,運用“場景十二問”方法論精準鎖定高價值生產場景。 深度紮根:區別於停留在演示層面的實驗性AI,“七步法”以真實上線、投產運行為目標,要求從MVP(最小可行產品)到投產,需集成到生產系統,部署在企業IT基礎設施上進入常態化運營。