阿里巴巴將發佈 Qwen 3.8-Flash-Next,預覽 Qwen 4 架構
阿里巴巴 Qwen 團隊將於週三發佈 Qwen 3.8-Flash-Next,這是一款混合專家(MoE)模型,總參數達 1250 億,但每個 token 僅激活…
阿里巴巴 Qwen 團隊將於週三發佈 Qwen 3.8-Flash-Next,這是一款混合專家(MoE)模型,總參數達 1250 億,但每個 token 僅激活 60 億參數。團隊將其定位為下一代 Qwen 4 架構的預覽版本,而非最終旗艦模型。該模型被描述為多模態,並基於即將推出的 Qwen 4 架構構建。團隊表示,提前發佈這一早期版本是為了讓開發者能夠為後續完整的 Qwen 系列做好準備。模型權重將託管在 Hugging Face 與 ModelScope 平臺。截至目前,Qwen 尚未公佈該模型的基準測試成績,也未發佈與自家 Qwen 3 系列或海外競品的對比數據,1250 億與 60 億參數的具體數字尚未得到官方證實。作為開放權重模型,開發者可免費下載、微調並運行,無需將數據發送至封閉 API,有助於降低託管模型的成本。
insigtX 內容為資訊/教育性質,非投資建議。