《Disney +》 迪士尼、Marvel、彼思、星球大戰…  協力合作引導列車!「Unrailed!」將於Nintendo Switch試玩同樂會登場!   是那個擁有烏黑亮麗直髮的男人!「村田」確定參戰「鬼滅之刃 火神血風譚」!   DualSense 無線控制器如何實現《KeyWe》混亂的郵務室   從《PES》到《eFootball》,今年秋天開始推出跨平台&基本免費遊玩!   鳥取與奈及利亞連結!電競活動「TNED2021」同時於兩地展開!   【實測】搭載可自訂多功能觸控板,精巧尺寸華碩電競鍵盤「ROG Falchion」!   日本最大汽車連鎖百貨AUTOBACS將進駐電競設施!「AUTOBACS REDEE Emotorsports Stadium」於4月16日隆重開幕!   《Gungrave G.O.R.E》:中村育美談論「育美式」的角色設計 

通義千問 Qwen3.5 發布 原生多模態智能體新紀元

商業

通義千問團隊正式發布 Qwen3.5 系列模型,並開放了該系列首個模型 Qwen3.5-397B-A17B 的權重。作為一個原生視覺-語言模型,Qwen3.5 在推理、編程、智能體能力與多模態理解等全方位的基準評估中均展現出優異性能,旨在為開發者與企業用戶顯著提升生產力。此次發布不僅標誌著模型能力的全面升級,更預示著通用人工智能向更實用、更整合的智能體系統演進。

創新的混合架構與效率突破

Qwen3.5-397B-A17B 採用了創新的混合架構,將線性注意力機制與稀疏混合專家模型相結合。該模型總參數量達到 3970 億,但每次前向傳播僅激活 170 億參數,在保持強大模型能力的同時,實現了出色的推理效率與成本優化。這種設計使得模型在處理複雜任務時,能夠在速度與資源消耗之間取得平衡。

在預訓練階段,團隊從能力、效率與通用性三個維度進行了推進。模型在更大規模的視覺-文本語料上進行訓練,並加強了中英文、多語言、科學技術工程數學領域與推理數據的訓練,同時採用更嚴格的資料過濾標準。結果顯示,Qwen3.5-397B-A17B 的性能與參數量超過 1 兆的 Qwen3-Max-Base 模型表現相當,實現了跨代的性能持平。

效率方面的提升尤為顯著。基於 Qwen3-Next 架構,包括更高稀疏度的混合專家模型、混合注意力機制以及穩定性優化,Qwen3.5 在長上下文處理上的解碼吞吐量獲得了飛躍。在 32K 與 256K 的上下文長度下,其解碼吞吐量分別是 Qwen3-Max 的 8.6 倍與 19.0 倍,同時性能保持相當。與 Qwen3-235B-A22B 相比,解碼吞吐量也分別有 3.5 倍與 7.2 倍的提升。

全方位的基準測試表現

根據官方發布的全面基準評估,Qwen3.5 在多個關鍵領域與前沿模型相比,表現出強勁的競爭力。在自然語言理解方面,於 MMLU-Pro、C-Eval 等知識性測驗,以及 IFEval、IFBench 等指令遵循任務上,Qwen3.5 的得分均位居前列,顯示其紮實的語言理解與任務執行能力。

在需要深度推理的科學技術工程數學領域與程式設計任務中,模型同樣表現出色。於 GPQA、MATH、GSM8K 等測驗,以及 LiveCodeBench、SWE-bench 等程式設計評測中,Qwen3.5 取得了與頂尖模型相當甚至更優的成績。其程式設計能力不僅體現在程式碼生成,更延伸至智慧體層面的工具調用與問題解決。

多語言支援是另一大亮點。Qwen3.5 將支援的語言與方言從 119 種大幅擴展至 201 種,並透過將詞表擴充至 25 萬詞元,在多數語言上帶來了約 10% 至 60% 的編碼與解碼效率提升。在 MMLU-ProX、NOVA-63、INCLUDE 等多語言評測集中,模型展現了優秀的跨語言理解與生成能力。

原生多模態與視覺推理能力

作為原生視覺-語言模型,Qwen3.5 透過早期文本-視覺融合與擴展的視覺資料訓練,實現了深度的多模態理解。在視覺語言評測中,模型於學科解題、文件理解、空間智能與影片理解等多個維度表現卓越。

在科學技術工程數學與謎題類視覺任務上,如 MMMU、MathVista、We-Math 等測驗,Qwen3.5 展現了強大的視覺推理能力。在文件理解與光學字元辨識任務,如 OmniDocBench、CharXiv、OCRBench 上,模型也能準確解析複雜版面與文字內容。特別是在空間智能任務,如物體計數、相對位置判斷與場景理解中,模型憑藉對圖像像素級位置資訊的建模,表現出更準確的空間感知潛力,為自動駕駛、機器人等具身智慧應用奠定了基礎。

影片理解能力同樣得到加強,在 VideoMME、VideoMMMU、MLVU 等評測中,模型能夠有效理解影片中的動態內容與時序資訊。

強大的智能體與工具調用潛力

Qwen3.5 的設計核心之一,是作為通用數位智能體的堅實基礎。在通用智能體、搜尋智能體與程式設計智能體等評測中,模型展現了整合工具使用、環境互動與多步推理的綜合能力。團隊透過對各類強化學習任務和環境的全面擴展來提升模型表現,更強調環境的難度與可泛化性,而非針對特定狹隘指標進行優化。

為了持續釋放強化學習的潛力,團隊構建了可擴展的非同步強化學習框架,全面覆蓋文本、多模態及多輪互動場景。該框架透過解耦式設計顯著提升了硬體利用率,並結合多項技術優化系統吞吐與訓練一致性。這種系統與演算法的協同設計,使得框架能夠擴展至百萬級規模的智能體腳手架與環境,從而顯著增強模型的泛化能力,最終取得了 3 至 5 倍的端到端加速。

便捷的使用方式

用戶可以透過多種管道與 Qwen3.5 進行互動。團隊提供了 Qwen Chat 平台,用戶可在此選擇自動、思考與快速三種模式使用模型。「自動」模式下可使用自適應思考並調用搜尋、程式碼解譯器等工具;「思考」模式會對難題進行深度思考;「快速」模式則直接回答問題。

此外,旗艦模型 Qwen3.5-Plus 的應用程式介面版本透過阿里雲百煉提供服務,支援高達 100 萬詞元的上下文視窗,並提供官方工具及自適應調用功能。開發者可以透過簡單的應用程式介面調用,開啟模型的推理模式與聯網搜尋等進階能力,輕鬆整合至各類應用中。該應用程式介面亦可與 Qwen Code、Claude Code、Cline 等第三方程式設計工具無縫集成,提供流暢的程式設計體驗。

面向未來的系統整合願景

通義千問團隊指出,Qwen3.5 憑藉高效的混合架構與原生多模態推理,已為通用數位智能體奠定了基礎。下一階段的重點將從模型規模轉向系統整合,目標是構建具備跨會話持久記憶的智能體、面向真實世界互動的具身接口,以及自我改進機制。最終願景是打造能夠長期自主運行、保持邏輯一致性的系統,將當前以任務為邊界的助手,升級為可持續、可信賴的夥伴。

參考來源:https://qwen.ai/blog?id=qwen3.5

TechApple

隨機商業新聞