GoogleGemini 3.1 Pro推理能力翻倍,引爆AI軍備競賽
7
3
btccSquare消息:Google發表Gemini 3.1 Pro,在短短三個月內實現AI推理能力翻倍躍升。 新模型在ARC-AGI-2基準測試中獲得77.1%分數,是前代效能的兩倍以上,同時維持API定價不變。 此加速發展凸顯AI軍備競賽白熱化,壓縮了每代模型的生命週期。
Gemini 3.1 Pro在16項基準測試中主導13項,包括在GPQA Diamond專家級科學知識測試獲得94.3%分數,在SWE-Bench Verified獨立代碼修復測試獲得80.6%分數。 其在MCP Atlas多步驟工具使用工作流程測試中69.2%的表現,領先競爭對手近10個百分點。
新增的「可調節推理」功能可讓開發者在低、中、高三種思考層級間切換,針對不同任務優化成本與效能。 此戰略升級正值Google在日益競爭的AI領域中,發揮其專有TPU晶片優勢之際。
來源: