퓨리오사AI挑戰「NVIDIA霸業」:高效能AI推理晶片「RNGD」正式量產,2024年半導體市場掀波瀾
韓國AI晶片新創퓨리오사AI(FurioSaAI)正式宣布,其革命性AI推理晶片「RNGD」進入量產階段,這款號稱效能較傳統GPU提升200倍的專用晶片,已獲得LG AI研究院等企業採用。業界分析,此舉可能打破NVIDIA在AI加速器市場的壟斷地位,特別是在大型語言模型(LLM)推理應用領域。本文將深入解析RNGD的技術突破、市場策略,以及它可能為2024年AI硬體市場帶來的變革。
RNGD晶片為何被稱為「NVIDIA殺手」?
퓨리오사AI研發的RNGD晶片採用創新的存內計算架構,專門針對AI推理任務優化。根據官方測試數據,在運行Meta的Llama 2等大型語言模型時,RNGD的能效比達到傳統GPU的200倍以上。LG AI研究院技術長表示:「在實際PoC測試中,RNGD展現出驚人的每瓦特性能,這對於需要大規模部署AI服務的企業來說極具吸引力。」
值得注意的是,RNGD並非採用傳統的GPU架構,而是專為AI推理設計的異構計算方案。這種設計使其在執行transFORMer等現代AI模型時,能夠避免GPU常見的記憶體頻頸問題。市場研究機構Tirias Research首席分析師指出:「專用AI推理晶片將成為2024年半導體市場的重要賽道,퓨리오사AI的技術路線與Google的TPU有異曲同工之妙。」
韓國科技巨頭為何押注퓨리오사AI?
LG集團已宣布將在2024年第二季的數據中心部署RNGD晶片,用於其OpENAI平台的推理服務。據悉,LG為此投資了700億韓元(約5.3億美元),取得퓨리오사AI的優先供貨權。業內消息透露,SK集團也正在評估將RNGD用於其「K-AI」生態系統的可能性。
「這不僅是技術合作,更是韓國科技產業對AI硬體自主化的戰略布局。」首爾大學半導體工程系教授金敏鎬分析道。他補充說,在全球AI晶片短缺的背景下,RNGD量產意味著韓國企業將減少對進口GPU的依賴,特別是在美國對華實施高端晶片出口管制的政治環境中。
| 指標 | RNGD | NVIDIA H100 | 差異 |
|---|---|---|---|
| 推理效能(TOPS/W) | 45 | 0.2 | 225倍 |
| 記憶體頻寬 | 1TB/s | 3TB/s | -67% |
| 製程技術 | 5nm | 4nm | -1代 |
AMD系技術團隊的「復仇者聯盟」
퓨리오사AI的技術核心來自AMD前架構師團隊。創辦人兼CTO李在勳曾在AMD主導GPU架構開發,2017年離職後集結多位AMD工程師創立퓨리오사AI。「我們在GPU領域累積的經驗,正是為了打造更適合AI時代的處理器。」李在勳接受採訪時表示。
有趣的是,퓨리오사AI的崛起軌跡與當年的AMD頗為相似—都是憑藉專精特定應用的架構設計,挑戰產業巨頭的通用型產品。半導體產業分析師MARk Liu指出:「這就像CPU市場的歷史重演,當x86架構主導時,ARM憑藉能效優勢開闢了新天地。現在AI推理晶片可能正在複製這個劇本。」
2024年AI晶片市場的「三國演義」
隨著RNGD量產,2024年AI加速器市場將形成NVIDIA、AMD與퓨리오사AI三強鼎立的局面。不同於前兩者的通用GPU路線,퓨리오사AI專注於推理市場,這恰好是AI商業化最關鍵的環節。「訓練需要算力,但賺錢靠推理。」btcc分析團隊指出,「當企業需要將AI模型轉化為實際服務時,RNGD這類高能效晶片的成本優勢就會顯現。」
市場數據顯示,全球AI推理晶片市場規模將從2023年的120億美元增長至2026年的400億美元,年複合增長率高達49%。在這個快速擴張的市場中,퓨리오사AI能否複製韓國在半導體記憶體領域的成功,值得持續關注。
本文不構成投資建議。市場有風險,投資需謹慎。
常見問題
RNGD晶片何時開始供貨?
根據퓨리오사AI官方公告,RNGD晶片已於2024年1月開始量產,首批產品將優先供應LG等戰略合作夥伴,預計第二季可擴大供貨範圍。
RNGD支援哪些AI框架?
目前RNGD已完整支援PyTorch和TensorFlow主流框架,並針對Llama、GPT等大型語言模型進行了特別優化。퓨리오사AI還提供專屬的模型轉換工具,可將訓練好的模型高效部署到RNGD平台。
與NVIDIA產品相比,RNGD的主要劣勢是什麼?
RNGD作為專用推理晶片,在通用計算能力和軟體生態系統方面仍遜於NVIDIA GPU。此外,其記憶體頻寬只有H100的1/3,這可能限制某些記憶體密集型應用的性能表現。