國產大模型近期密集迭代,繼Kimi K3震撼業界後,DeepSeek V4正式版即將發布,阿里巴巴旗下千問(Qwen)亦推出新一代旗艦模型Qwen-3.8 Max,預示國產AI進入新一輪競爭高潮。
千問官網已上線Qwen-3.8 Max的Token Plan,目前處於Preview預覽階段。據介紹,模型為最新一代基座模型,參數量高達2.4萬億,在代碼工程、專業辦公、深度推理等核心場景全面領先。雖然仍未公布跑分或實測數據,但2.4萬億參數量僅次於Kimi K3的2.8萬億,理論性能上限極高,業界預期其整體能力可達Claude Opus 4.8級別,足以與國際頂尖模型Fable 5一較高下。
今年4月DeepSeek V4發布時,Pro版參數量達1.6萬億,當時已屬國產頂尖水平。然而不到3個月,V4 Pro竟成為國產旗艦模型中參數量最低者。目前Kimi K3(2.8萬億)、Qwen-3.8 Max(2.4萬億)及MiniMax的M3 Pro(預計2.7萬億)三家已成功躋身「2至3萬億參數俱樂部」,標誌國產大模型正式邁入超萬億參數時代。
業界提醒,參數量並非唯一指標。DeepSeek V4 Pro雖規模較小,但後訓練(post-training)質量優異,實際能力依然強勁。智譜GLM-5.2僅7400多億參數,編程能力已達頂尖水平,未來GLM-5.3或5.5版本參數量亦將突破萬億。
國產大模型參數規模追至3萬億級別,反映各公司算力資源顯著提升,訓練能力已追上國際水平。然而,後期部署的推理算力仍顯不足,GLM-5.2及Kimi K3均出現服務可用性問題,分析指,如何提升推理算力以支撐大規模商用,將成為國產大模型下一階段的挑戰。