Anthropic推出Claude 4 AI模型,編程基準測試表現超越競爭對手
9
1
Anthropic正式發布Claude 4系列,包含Opus與Sonnet兩款模型,標誌著AI性能的重大飛躍。 其中Opus版本在SWE-bench編程基準測試中獲得72.5%的高分,超越OpenAI的GPT-4.1(54.6%)與Google的Gemini 2.5 Pro(63.2%)。 該模型具備100萬token的上下文窗口與連續7小時的編程能力,為複雜推理任務樹立了新標竿。
定價為每百萬輸出token 75美元,Claude Opus 4定位高端市場——價格遠高於DEEPSeek R1等開源替代方案(3美元)。 GitHub採用Claude Sonnet 4作為其Copilot編程助手的基礎架構,顯示企業界對Anthropic技術的信心正持續增長。
來源: