《Disney +》 迪士尼、Marvel、彼思、星球大戰…  日本Amazon Black Friday優惠!Fire HD和Fire TV系列最多減價14,000日圓!   期待強作齊聚一堂!「State of Play 2021430」發表內容彙整!   傳聞中的能量飲料「KIIVA」!KIIVA ENERGY將贊助使用Unreal Engine的音樂直播活動「RECOILR」!   《對馬戰鬼》《魔物獵人崛起》同獲日本遊戲大賞2021年度首獎!   SIE正式宣布完全停止PS3、PS Vita、PSP遊戲購買服務   「異度神劍2」焰/光將參戰「大亂鬥SP」!・・・那個雷克斯呢?   《Ratchet & Clank: Rift Apart》神祕新主角蕾薇特首度曝光   公開發表實況轉播及遠端會議最適合的1080p / 30fps高畫質網路攝影機「ASUS Webcam C3」 

Claude 推出百萬 tokens 上下文視窗

商業

Anthropic 旗下 AI 助理 Claude 近日宣布,Opus 4.6 與 Sonnet 4.6 版本正式支援完整的 100 萬 tokens 上下文視窗,並以標準定價計費,不再收取長上下文附加費用。

標準定價全面適用

根據發布資訊,Claude Platform 上的 Opus 4.6 與 Sonnet 4.6 現在提供完整的 100 萬 tokens 上下文長度。定價方面,Opus 4.6 為每百萬 tokens 5 美元(輸入)與 25 美元(輸出),Sonnet 4.6 為 3 美元與 15 美元。這意味著無論是 9,000 tokens 還是 90 萬 tokens 的請求,都採用相同的單一計費標準。

此外,用戶帳戶的標準速率限制在整個上下文區間內皆可適用,無需額外申請。媒體處理能力也從原本的 100 張圖片或 PDF 頁面提升至 600 項,這項功能已同步上線於 Claude Platform、Microsoft Azure Foundry 及 Google Cloud 的 Vertex AI。

對於開發者而言,先前超過 20 萬 tokens 的請求需要加入測試標頭,如今這項限制已移除,系統將自動處理較長的上下文內容。

Claude Code 同步升級

訂閱 Claude Code 的 Max、Team 與 Enterprise 用戶現在也能直接使用 Opus 4.6 的 100 萬 tokens 上下文視窗。先前這項功能需要額外付費,現在已納入方案之中。由於上下文無需頻繁壓縮,使用者能夠在較長的對話中保持更完整的內容連貫性。

模型效能表現

根據基準測試數據,Opus 4.6 在 MRCR v2 測試中達到 78.3% 的準確率,這是在該上下文長度下目前公開數據中前沿模型裡的最高分數。隨著模型世代演進,長上下文檢索能力持續獲得改善。

這項技術突破讓使用者能夠將整個程式碼庫、上千頁的合約文件,或長期代理執行過程中的完整軌跡——包括工具呼叫、觀察與推理中介資料——全部載入單一對話中進行處理。過去長上下文工作所需的工程處理、具損耗性的摘要,以及上下文清除等步驟將不再必要。

企業應用案例

多家企業與開發團隊分享了實際應用經驗。在科學研究領域,有團隊利用 Claude 的百萬上下文能力,讓代理系統能夠同時綜整數百篇論文、數學證明與程式碼庫,加速基礎與應用物理學研究。

法務應用方面,內部律師現在能夠將長達 100 頁合作協議的五個修訂版本同時納入單一對話session中,完整掌握談判的全貌,無需在版本間切換而遺漏前三輪的變更記錄。

工程團隊的反饋指出,在處理大型生產系統事件時,100 萬 tokens 的上下文視窗能夠讓團隊從第一次警報到修復完成的整個過程中,保持所有實體、訊號與工作假設的完整視野,無需反覆壓縮或犧牲系統細節。

有 AI 研究團隊將 Opus 上下文從 20 萬提升至 50 萬後,發現代理程式的運行效率反而提升,總體 tokens 消耗量下降,顯示較大的上下文能夠減少overhead成本。

軟體工程師則提到,過去在使用 Datadog、Braintrust、資料庫與原始碼搜尋時,經常消耗超過 10 萬 tokens,隨後上下文壓縮機制啟動導致細節消失,陷入循環除錯的困境。現在有了百萬上下文,可以在同一視窗中進行搜尋、重搜尋、彙總邊緣案例並提出修復方案。

產品負責人分享指出,在 Opus 4.6 的百萬上下文視窗推出之前,團隊必須在使用者載入大型 PDF、資料集或圖片時立即壓縮上下文,導致關鍵工作內容的精確度流失。實施新功能後,壓縮事件減少了 15%,代理程式能夠連續運行數小時而不會忘記第一頁的內容。

在代理程式開發方面,有團隊指出大型程式碼差異無法容納於 20 萬上下文視窗中,導致代理必須將上下文分塊處理,造成更多處理次數並遺失跨檔案依賴關係。現在有了百萬上下文,可以直接餵入完整差異,透過更簡潔、tokens效率更高的框架獲得更高品質的審查結果。

法律科技公司 Eve 的機器學習工程師表示,該平台預設使用百萬上下文,因為原告律師面對的難題需要這麼大的上下文容量。無論是交叉參照 400 頁的證詞筆錄,還是從整個案件檔案中找出關鍵連結,擴展的上下文視窗都能提供比過往更高品質的答案。


資料來源: https://claude.com/blog/1m-context-ga?_bhlid=9a57cc130dd54f3bda6e231dac7b4b59020bebbd

TechApple

隨機商業新聞