DeepSeek宣布,推出DeepSeek-V4預覽版本,並同步開源相關模型,標誌著該公司在大型語言模型發展上邁出新步伐。
是次發布包含兩個主要版本。DeepSeek-V4-Pro版本的總參數量達一點六兆,活躍參數為四百九十億,官方表示其效能可與全球頂尖的閉源模型比擬。另一版本DeepSeek-V4-Flash則採用較為精簡的架構,總參數量为二百八十四兆,活躍參數為一百三十億,主打快速、高效及經濟實惠的特點。
長上下文處理能力成焦點
今次發布的亮點之一,在於两款模型均支援一百萬上下文長度的處理。官方形容這項能力開創了「符合成本效益」的百萬上下文時代,意味着用戶可在單一對話中處理極長的文件或代碼內容,而無需付出高昂的計算成本。
開源策略持續
除API服務外,DeepSeek亦同步公開模型權重,供開發者於Hugging Face平台下載。技術報告亦已同步發布,為研究社群提供更多模型訓練及應用的參考資料。
使用渠道
用戶可透過chat.deepseek.com平台,分別以專家模式或即時模式試用新模型。API接口亦已完成更新開放大眾使用。隨着大型語言模型競爭日益激烈,DeepSeek延續其開源策略,期望透過技術共享吸引更多開發者及企業採用其解决方案。






