MiniMax 开源 M3 模型:428B 总参数,每次推理只激活 23B
MiniMax 在 Hugging Face 上放出了 M3 的权重。这是一个混合专家模型,总参数量约 4280 亿,但每次推理只调用其中约 230 亿参数,相当于用 23B 模型的算力撬动一个超大规模模型的知识。帖子没提训练数据、跑分成绩,也没说本地运行最低要多少显存,想自己部署的话得先做好硬件摸底。
推荐理由:MiniMax 把 M3 的完整权重扔上了 Hugging Face,一个 4280 亿参数的 MoE 模型,每次只叫醒 230 亿参数干活,在开源权重里属于效率很能打的那一档。帖子没给跑分、没提训练数据、也没说本地跑要多少显存,这些信息缺口把分拉下来了一点,但光凭权重公开这件事就值得看一眼。