中國AI新創 Z. ai(前身為智譜AI)正式發布GLM-4.5與GLM-4.5-Air兩大旗艦開源大語言模型,在全球AI生態再掀波瀾。官方稱,GLM-4.5現已成為全球開源頂尖標竿,不僅在推理、程式碼生成、智能代理(agentic)能力方面接近甚至超越美系巨頭,且價格遠低於業界現有主流。
技術創新,MoE架構與雙模式混合推理
GLM-4.5採用最新的混合專家(Mixture-of-Experts, MoE)深層架構,總參數規模達3550億(活躍參數320億),而輕量版Air則為1060億(活躍參數120億),兩者皆支援128,000長上下文,最大輸出長度高達96,000,充分應對複雜語境和多輪會話。
兩大模式是本次系列的核心創新:
- 思考模式(thinking mode):針對複雜問題觸發,多步推理、工具調用、計劃執行,模型內部透明化推理過程,有利調試與優化。
- 非思考模式(non-thinking mode):針對簡單任務迅速直接回覆,提升即時性與效率。
模型會自動按任務難度與語境選擇適合模式,極大優化效能及資源分配。
訓練規模與資料多元,全面貼近產業需求
GLM-4.5系列以驚人的數據量進行預訓練——泛用語料15兆tokens,針對程式、推理等領域特化語料再加7兆tokens,並開源底層訓練框架slime,歡迎技術社群二次創新。資料含蓋開源程式庫、技術文檔、多模態資料與推理特例,既兼顧廣度也把握專業深度,保證模型對複雜任務強大泛化與實戰能力。

原生功能調用,推論能力媲美商業旗艦
GLM-4.5強調原生函數調用(Native Function Calling),可在推理過程中直接調用外部工具、API或第三方服務,無需中介層,大幅強化現實應用中需求如資料查詢、知識鏈檢索或自動化操作的效率與準確度,特別適用於工業級AI代理及自動化開發情境。

實測表現,超越主流開源,緊逼美國閉源旗艦
依官方及多家第三方基準測評,GLM-4.5在12項國際主流推理、程式、代理任務評測中,穩居開源世界前三,僅次於o3與Grok-4,超越Claude Opus 4、Gemini 2.5 Pro等。其在工具運用(tool use)任務上成功率高達90%,整體性能接近DeepSeek、Kimi,並在程式生成領域表現尤為突出。例如,GLM-4.5在52項實戰編碼任務中,對Kimi K2勝率53.9%,對Qwen3-Coder勝率80.8%,僅在部分賽事小幅落後Claude-4-Sonnet。
運算與部署高效,滿足嚴苛合規
針對硬體限制與合規需求,GLM-4.5專為高效運算優化,最小化活躍參數、強化深度,支援國產Nvidia H20 GPU集群,能以半數GPU運行媲美競品性能,降低總體成本。此外開源權限極為寬鬆,採MIT授權,支持商用、調校與本地化部署,無需憂慮閉源限制或合規風險。
開源與社群開放,激發二次創新
官方已將GLM-4.5、GLM-4.5-Air全型號權重上傳HuggingFace、ModelScope,開放API供測試與融合,並開放程式碼與訓練框架,社群可自由二次訓練、部署或調校專屬版本,支持端側輕量部署與自定義應用。







