# 开源模型这周炸了：25+ 个开放权重模型一口气放出，覆盖文本、图像、语音

> 原标题：Big week for open AI, with 25+ notable open-weight drops across every modality (from Victor M on 𝕏)

- 来源：r/LocalLLaMA
- 发布时间：2026-06-06T09:53:05.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/34860
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1tyd1zc/big_week_for_open_ai_with_25_notable_openweight/

## 摘要

Victor M 在 X 上整理了一份清单，过去一周有超过 25 个开放权重的模型发布，几乎覆盖了所有模态。其中最扎眼的是 NVIDIA 的 Nemotron 3 Ultra，一个 550B 参数的混合架构（Mamba-MoE），每次推理只激活 55B 参数，上下文窗口能塞进 100 万个 token。不过正文被 Reddit 的安全策略拦住了，具体还...

## 推荐理由

我会先打个折：消息源是 X 上的个人整理，Reddit 原文还被安全策略拦了，具体细节没法交叉验证。但一周 25+ 个开放权重模型这个密度本身就值得关注，NVIDIA 那个 550B 的 Nemotron 用 Mamba-MoE 架构，激活参数只有 55B，上下文能塞 100 万 token，如果实测靠谱，推理成本会省不少。这点先别太激动，等完整评测出来再说。

## 锐评

这条消息本身是个信号：一周内 25 个以上开放权重模型发布，说明开源生态的弹药库还在快速膨胀。最值得盯的是 NVIDIA 的 Nemotron 3 Ultra，550B 总参数但用 Mamba-MoE 混合架构把每次推理的激活参数压到 55B，这意味着跑起来对显存的要求可能比同体量密集模型友好不少，100 万 token 的上下文窗口也直接对标了当前闭源模型的上限。

但问题在于信息缺口很大。Reddit 原文被安全策略拦截，我们看不到 Victor M 原帖里的具体清单、基准测试分数、许可证类型，也不知道这 55B 激活参数在实际推理时吞吐量和延迟表现如何。混合架构在长文本场景下的稳定性、幻觉率这些关键指标，正文都没披露。

我会先打个折：参数规模和架构听着唬人，但没实测数据之前，只能当一条值得追踪的线索。如果你在选型，建议等一手技术报告和社区跑分，别急着冲。
