BTCC / BTCC Square / Zombit /
馬斯克所言不虛!Grok 3 測試結果出爐,各方面皆吊打其他 AI 模型

馬斯克所言不虛!Grok 3 測試結果出爐,各方面皆吊打其他 AI 模型

Zombit
Author:
Zombit
發佈時間:
2025-02-18 06:26:43
0

xAI elon musk

根據知名 AI 模型排名開源平台 lmarena.ai 的最新測試數據顯示,xAI 早期版本的 GROK-3(代號「chocolate」) 在 Arena 排行榜上排名第一。

BREAKING: @xAI early version of Grok-3 (codename "chocolate") is now #1 in Arena!🏆

Grok-3 is:
– First-ever model to break 1400 score!
– #1 across all categories, a milestone that keeps getting harder to achieve

Huge congratulations to @xAI on this milestone! View thread🧵… https://t.co/p8z8lccNd5 pic.twitter.com/hShGy8ZN1o

— lmarena.ai (formerly lmsys.org) (@lmarena_ai) February 18, 2025

在這次測試結果中,Grok-3 創下多項紀錄,其中包括成為史上首個突破 1400 分的語言模型,並在數學、創意寫作、多輪對話、編程等測試類別中全數拿下第一名。

Gkcwqiawsaagvhw

使用者可以在此網站參與模型的測試,並投票選擇哪一個模型更為優秀。

根據 Zombit 此前報導,馬斯克在《世界政府高峰會》的活動上發表演說時透露,Grok 3 將在幾週內問世,並自信的表示 Grok 3 將超越迄今為止所有其他人工智慧模型。其在演講中說道:

如今從測試結果來看,馬斯克似乎並不是「老馬賣『Grok』,自賣自誇」。

Source

本站轉載文章皆來自公開網絡,部分由AI整理,僅為傳遞產業訊息,不代表BTCC立場。原創權益歸原作者所有。如發現版權問題,請透過[email protected]聯絡我們,我們將依法處理。 BTCC不對資訊準確性、時效性及完整性作任何保證,不承擔因依賴資訊而產生的任何責任。內容僅供參考,不構成投資、法律或商業建議。