DeepSeek 推出 v3.1 混合推理模型,具競爭力定價策略
DEEPSeek 正式發佈 v3.1 模型,採用混合推理架構,結合思考與非思考模式。 此次更新增強了代理能力、工具使用和任務執行效能,使其在人工智能領域成為強勁競爭者。 用戶可透過「深度思考」按鈕切換模式,功能類似於 Anthropic 的 Opus 和 Sonnet 模型。
基準測試顯示,該模型在 SWE 和 Terminal-Bench 指標上有所提升,在 Artificial Analysis 智能指數中獲得 60 分,略超前代 R1 模型。 儘管維持相同底層架構(總參數 671B,活躍參數 37B),v3.1 在推理模式下展現更高效率並減少代幣使用量。 然而,在原始性能上仍落後於阿里巴巴最新產品和 OpENAI 的 GPT-OSS,且推理模式缺乏函數呼叫功能,對代理工作流程仍有限制。
該模型本週初於 Hugging Face 首發,隨後登陸 Deepseek 官方平台。 定價調整顯示出在生成式 AI 領域競爭加劇之際,該公司正採取戰略性推動以擴大市場採用率。
登入回覆
登入分享您的看法評論
相關文章
|Square
下載BTCC APP,您的加密之旅從這啟程
立即行動 掃描 加入我們的 100M+ 用戶行列