# 小米开源 MiMo-V2.5 系列模型，Pro 版 4 小时无人工干预搭出一个 macOS 桌面

> 原标题：小米双模型正式开源！MiMo-V2.5-Pro无中断肝出“macOS”：54个应用全开、浏览器真能冲浪

- 来源：量子位 · 公众号
- 发布时间：2026-04-28T12:56:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/11837
- 原文：https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247887537&idx=2&sn=ed9dfac76ce1fd72fb8417c2fed5d512

## 摘要

小米把 MiMo-V2.5 系列的权重放出来了，包含 Pro Agent、多模态基座、TTS 和 ASR 几个模型。MiMo-V2.5-Pro 在 4.3 小时内连续调用了 672 次工具，在 SysY 基准上拿了满分 233 分，全程没让人接手，直接跑通了一个带 54 个应用的类 macOS 桌面。对从业者来说，值得关注的是它支持 100 万 tok...

## 推荐理由

HKR 三项全中：小米把 MiMo-V2.5 系列权重直接放出来，Agent 和代码任务的数字够具体，4 小时无接管跑出完整桌面是个强钩子。作为国产旗舰模型开源，属于当天必须写的那类消息。

## 锐评

这条消息最值得看的是 SysY 基准拿了满分 233 分，而且全程无人工接管，说明模型在长时间、多步骤的工具调用上稳定性不错。100 万 token 的上下文窗口和 100T token 的训练量，意味着它吃进了大量代码和操作序列，能记住很长的任务链。

但我会先打个折。正文没交代这个 54 应用的桌面是真实 macOS 还是模拟环境，也没说 672 次工具调用里有多少是重复操作或失败重试。如果是在高度简化的沙箱里跑预设流程，那跟真实办公场景差距不小。另外，Agent 框架虽然免费开放，但模型权重本身对部署硬件的要求、推理延迟这些关键指标都没提。

对想试的人，可以先拿它跑长链路自动化任务看看实际掉链子频率。对观望的人，等第三方在真实桌面环境复现后再下判断不迟。
