《Disney +》 迪士尼、Marvel、彼思、星球大戰…  hololive的元宇宙虛擬世界!沙盒類遊戲「Holo Earth」最新情報公開!   K/DA聯名商品!羅技宣布將推出英雄聯盟官方電競產品「KDA COLLECTION」   HYDE個人活動20週年紀念遊戲《HYDE RUN》正式發布日確定!同時公開遊戲內畫面預告!   原神 x Razer 推出電競滑鼠和電競椅   《Destruction AllStars》下一波精彩內容: 指定賽事、挑戰系列賽等更新   「年末優惠」進駐PlayStation Store   [TGS2021] 到訪Capcom《魔物獵人》展位 騎上了1比1隨從加爾克!   《熱血硬派》系列35週年紀念新企劃啟動! 

百度發佈文心大模型X1.1深度思考模型,挑戰國際頂尖對手

商業

百度在9月9日舉行的WAVE SUMMIT深度學習開發者大會2025上重磅發佈了文心大模型X1.1深度思考模型,標誌著百度在AI領域再次取得重大突破。據百度首席技術官、深度學習技術及應用國家工程研究中心主任王海峰現場介紹,該模型在事實性、指令遵循、智能體等三大能力方面均展現出顯著提升表現。

文心大模型X1.1是基於文心大模型4.5訓練而來的深度思考模型,升級版本採用了迭代式混合強化學習訓練框架。王海峰詳細解釋,該框架透過混合強化學習同時提升通用任務和智能體任務的效果,另外通過自蒸餾數據的迭代式生產及訓練,不斷提升模型整體效果。

性能測試達業界頂尖水準,與GPT-5效果持平

在性能表現方面,文心X1.1相比前一代文心X1模型實現了令人印象深刻的提升幅度。具體數據顯示,事實性提升34.8%,指令遵循能力提升12.5%,智能體能力提升9.6%。這些數字反映了百度在技術創新方面的紮實進展。

更值得關注的是,在多個權威基準評測中,文心X1.1整體表現超越DeepSeek R1-0528,在部分任務上展現出領先優勢。同時,在與國際頂尖模型GPT-5和Gemini 2.5 Pro的比較測試中,文心X1.1的效果達到持平水準,這意味著百度已經在技術層面追上國際最先進的AI模型。

飛槳文心生態用戶規模創新高,開發者達2333萬

生態建設方面,百度公佈了飛槳文心生態的最新發展數據。飛槳文心生態開發者數量已突破2333萬,服務企業數量超76萬家,這些數字展現出百度AI平台的強大吸引力和影響力。

文心大模型的能力拓展和效率提升得益於飛槳文心的聯合優化。大會現場,百度還發佈了飛槳核心框架3.2版本,在大模型訓練、硬件適配和生態支持上全面升級,並同步升級大模型開發套件ERNIEKit和高效部署套件FastDeploy。

目前,用戶可以在文心一言官網、文小言APP使用文心大模型X1.1。文心大模型X1.1已正式上線百度智能雲千帆平台,對企業客戶及開發者全面開放使用。

文心快碼3.5S版本上線,開啟「一人即團隊」開發新模式

百度智能代碼助手文心快碼全新升級至3.5S(Super Synergistic AgentS)版本,強化多智能體自協同能力,實現「一人即團隊」開發新模式。據百度副總裁陳洋介紹,文心快碼3.5S版本從三個方面進行升級。

首先,智能體能力更強,能懂業務,會分解任務列表,執行更準確;其次,從單智能體到多智能體協同,動態生成多個智能體,自主協同一起解決複雜任務;最後,團隊協作更強,基於Rules與MCP構建統一的經驗庫,實現團隊知識傳承。

現場數據顯示,文心快碼目前已服務超過1000萬的開發者。在百度內部,整體新增代碼中已經有45%由AI生成,其中前10%的Agent用戶,AI完成的部分甚至超過了75%。

開源輕量化模型,推動學術科研發展

百度同時正式開源最新的思考模型ERNIE-4.5-21B-A3B-Thinking。該模型採用混合專家(MoE)架構,總參數規模達210億,每個token激活30億參數,通過指令微調及強化學習訓練,適用於需要長上下文的複雜推理任務。

ERNIE-4.5-21B-A3B-Thinking作為一款21B總參數量,激活僅3B的輕量級模型,在各項測試中的表現緊追業界頂級大尺寸模型,以輕量級規模實現了接近SOTA的智能表現。該模型不僅在邏輯推理、數學、科學,代碼與文本生成等需要人類專家的任務上實現了顯著提升,還具備高效的工具調用能力,能夠支持複雜任務的自動化處理。

推出AI助老公益計劃,科技向善展現社會責任

大會現場,百度文心大模型與中國老齡事業發展基金會聯合發起「AI助老公益計劃」,透過智能體、AI應用、AI公益志願活動等舉措,助力銀髮一族跨越數字鴻溝,推動老年群體樂享生活。

目前,「AI助老智能體」已正式上線,在百度搜索「AI助老智能體」或打開小度智能健康屏,每個老人都能享受到AI所帶來的暖心與便利。這項計劃展現了百度在技術創新的同時,對社會責任的重視和承擔。

編輯觀點

百度這次發佈的文心X1.1深度思考模型,確實在技術指標上展現出令人矚目的進步,特別是能夠與GPT-5達到效果持平的表現,打破了長期以來國外模型技術領先的格局。不過,真正的考驗還在於實際應用場景中的表現和用戶體驗。

值得思考的是,百度內部45%新代碼由AI生成這個數字,究竟是技術進步的里程碑,還是可能帶來代碼品質和安全性隱憂?當AI生成的代碼比例越來越高時,開發者的技能發展和創新思維是否會受到影響,這些問題值得業界深入探討。

另外,百度推出的AI助老公益計劃雖然展現了科技向善的一面,但如何確保老年用戶在使用AI服務時的隱私保護和資料安全,以及避免技術門檻過高導致的數位落差擴大,這些實際操作層面的挑戰同樣不容忽視。

TechApple

隨機商業新聞