DeepSeek計劃訓練8萬億參數模型,規模直逼現有最大開放模型近3倍
2026-09-22 09:41:28
幣界網消息,DeepSeek CEO梁文鋒向投資人透露,公司正在訓練一個2萬億參數的模型,之後還計劃開發一個8萬億參數的模型。現有的旗艦v4-pro只有1.6萬億參數。根據公開權重,moonshot、ai、kimi、k3的參數達到2.8萬億,已是全球最大的開源模型。DeepSeek規劃中的8萬億模型規模將接近3倍。需要注意的是,總參數越多,并不代表每次運行都要調用全部參數,kimi、k3就是採用moe架構,2.8萬億總參數裏每個token只激活1040億。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注WalletJYS官方帳號,及時關注最新動態









