中國AI迎頭趕上:Deepseek發布R1模型挑戰美國科技霸權
10
2
中國人工智慧實驗室Deepseek近日發布了其開源推理模型R1,引起了業界的廣泛關注。 這款被稱為'推理模型'的產品,在某些AI基準測試中表現與OpenAI的O1模型不相上下。 R1模型已根據MIT許可證透過人工智慧開發平台Hugging Face發布,可無限商業化。 Deepseek聲稱,在多項基準測試中,包括評估推理能力的AIME、專注於文本問題的Math-500,以及測試程式設計任務的Swe-Bench Verified,R1模型均超越了O1。 據稱,R1模型具有獨特的自我驗證能力,使其在物理、科學和數學等領域具有優勢。 然而,據報道,其性能受到政治因素的限制。 儘管具有諸多優勢,但推理模型通常需要較長的運行時間,從幾秒鐘到幾分鐘不等。