跳到正文

MiniMax 的模型与产品动态:M 系列大模型、语音与多模态能力、开源与商业化进展。

最新精选

第 21–25 条 · 共 25 条

5月30日星期六

彭博科技

MiniMax 启动国内上市准备,招股书里把 DeepSeek 列为对手

MiniMax 已经向监管提交了文件,开始筹备在国内上市。招股书里点名 DeepSeek 是本土竞争对手。不过正文被 Bloomberg 的反爬机制挡住了,没拿到具体内容,所以估值、募资规模、上市板块和时间表这些关键信息目前都看不到。

推荐理由:Bloomberg 这篇报道说 MiniMax 已经按监管要求启动境内上市流程,竞争对手点名了 DeepSeek。我会先打个折:正文没给估值、没时间表、没募资规模,所以重要性到不了顶。但这件事本身信号够强——一家中国大模型公司在 DeepSeek 风头正劲时选择上市,说明融资节奏在加快,也侧面反映行业烧钱压力。对从业者来说,这比单纯的技术发布更直接关系到谁能活下去、谁能拿到钱。

5月21日星期四

r/LocalLLaMA

Fireworks 提出“Agent 执行税”:浏览器智能体跑任务时,22.9% 的推理算力都浪费了

Fireworks 在 WebVoyager 上跑了 720 个浏览器智能体任务,发现平均有 22.9% 的推理调用属于无效消耗,他们管这个叫“Agent 执行税”——也就是为了完成任务,模型多做的无用功。具体到各家模型:MiniMax M2.5 每成功完成一个任务的成本比 Gemini 低了 2.3 倍;GLM-5 的任务成功率做到 57.1%;Ki...

推荐理由:HKR 三项都站得住:它把一个跑分现象包装成了可复用的采购指标,有具体数字支撑,而且直接回应了从业者在选型时对隐性成本的焦虑。信源是 Fireworks 自己的博客和 Reddit 讨论,不是第三方独立评测,所以重要性停在 74 分 featured 档,没往上拉。

4月18日星期六

新智元 · 公众号

B站吵翻了:Hermes 首次直播回应抄袭指控,MiniMax 提前卡位 Harness 赛点

MiniMax 说他们的 M2.7 模型现在能接手强化学习团队 30% 到 50% 的日常工作,自己跑通了超过 100 轮自我优化,评测指标提升了 30%。Hermes Agent 的日调用量从 20 亿涨到了近 3000 亿 token,M2.7 在 OpenRouter 上的日调用也超过了 250 亿 token。Hermes 负责人 Tommy ...

推荐理由:这篇不是一手发布或官方技术报告,而是把几条动态串起来的二手解读,所以重要性停在 83 分。我会先打个折:Hermes 直播否认抄袭本身不算大新闻,但配上 MiniMax 提前杀入 Harness 赛点、给出具体工作流占比和沙箱性能数据,就让整篇有了可读性。正文没披露 M2.7 具体在哪些任务上替代了人工、也没说 30% 提升的基线是什么,这点先别太激动。不过沙箱启动 20-40ms 和每分钟 60 万实例的并发能力如果是真的挺省钱,说明执行层的基础设施正在变成新战场。整体适合放进 featured,给做 Agent 的人一个信号:别光盯着模型跑分,...

4月12日星期日

X · @Yuchenj_UW

MiniMax 开源 M2.7,并公开了用模型自己跑研发流程的实验结果

MiniMax 把 M2.7 开源了,同时发了一篇博客讲他们怎么让模型参与自己的研发。他们做了两件事:一是搭了个研究助手 agent,帮研究员查文献、盯实验流程、看日志、改代码、提 merge request,现在能扛起 30% 到 50% 的研发工作量。二是让 M2.7 自己改自己的测试脚手架,全自动跑了 100 多轮,内部代码评测涨了 30%。博客...

推荐理由:MiniMax 把 M2.7 开源了,同时扔出一个挺敢说的数字:他们内部的研究代理已经扛了 30% 到 50% 的研发流程。具体怎么干?代理自己查文献、排实验、看日志、修代码、提合并请求,还在内部脚手架里自己改 harness,自动循环了 100 多轮,内部编码评测涨了 30%。我会先打个折——正文没披露许可证、仓库地址、基准测试上下文,也没说外部能不能复现,所以这些数字目前只能当内部说法看。但即便打对折,代理能稳定吃掉三成研发流程,这个信号也够强了。

2月27日星期五

纽约时报中文网

中国年轻女性用AI男友替代真人恋爱,让政府催婚催生更难了

21岁的菲比·张一年里跟AI男友进行了200多场虚拟约会,每天至少花一小时和两个AI角色聊天。她不是个例——稀宇科技旗下的星野和Talkie到去年9月用户已超1.47亿。这些聊天机器人给女性提供了现实中男性很少给到的情绪价值,但也直接撞上了政府想提高结婚率和生育率的目标。去年12月出台的新规要求平台在用户产生不健康依赖时介入,比如建情绪档案、在出现自伤...

推荐理由:这篇不是讲模型发布,价值在于 AI 伴侣撞上了中国的人口焦虑和监管动作。我会先打个折:下载量暴跌 95% 说明这波热度可能已经过了峰值,别把它当持续增长的故事看。但真正值得盯的是监管那句“形成不健康依赖时介入”——这等于给所有 AI 伴侣产品划了一条红线,后续怎么执行、会不会变成强制功能限制,正文没细说,但影响会很大。整体放在 featured 低位,不是当天必写,但社会话题和行业信号都够。