阿里巴巴推出新一代AI模型Qwen3-Next,效能大幅提升
5
1
btccSquare新聞:
阿里巴巴通義千問發佈QWen3-Next,採用混合注意力機制和高稀疏度MoE結構的突破性AI模型架構。 這款800億參數的新模型每次推理僅激活30億參數,以極低成本實現與密集模型相當的性能。
Qwen3-Next-80B-A3B的訓練成本不到先前模型的十分之一,而在超過32k token的上下文長度下,推理吞吐量提升超過十倍。 這一成本效益的飛躍有望加速AI在雲計算和數據分析領域的企業級應用,為相關區塊鏈和加密貨幣項目帶來潛在利好。
來源: