icon

DeepSeek计划训练8万亿参数模型,规模直奔现有最大开源模型近3倍

DeepSeek 又要把模型做大了。CEO 梁文锋向投资人透露,公司正在训练一个 2 万亿参数模型,之后还计划开发一个 8 万亿参数模型。现有旗舰 V4-Pro 只有 1.6 万亿参数。8 万亿是什么概念?目前已经公开权重的超大模型里,Moonshot AI 的 Kimi K3 达到 2.8 万亿参数,已经是全球最大的开源模型。DeepSeek 规划中的 8 万亿模型,规模还要再大接近 3 倍。不过总参数越多,不代表每次运行都要调用全部参数。Kimi K3 就是 MoE 架构,2.8 万亿总参数里每个 Token 只激活 1040 亿。
雷電財經提醒:請廣大讀者理性看待區塊鏈,切實提高風險意識,警惕各類虛擬代幣發行與炒作,站內所有內容僅系市場信息或相關方觀點,不構成任何形式投資建議。如發現站內內容含敏感信息,可通過 舉報 或 聯繫我們 ,我們會及時處理。
11:07 , 2026-09-22

DeepSeek计划训练8万亿参数模型,规模直奔现有最大开源模型近3倍