# OpenAI 推出 o1-mini，一个专攻数理和编程、成本比 o1-preview 低 80% 的推理模型

> 原标题：OpenAI o1-mini

- 来源：OpenAI News
- 发布时间：2024-09-12T10:01:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/715
- 原文：https://openai.com/index/openai-o1-mini-advancing-cost-efficient-reasoning

## 摘要

o1-mini 是 OpenAI 在 2024 年 9 月 12 日发布的小号推理模型，先开放给 Tier 5 API 用户和付费 ChatGPT 用户。它最大的卖点是便宜：API 调用成本只有 o1-preview 的两成。性能上，它专攻 STEM 推理，在 AIME 数学竞赛里拿到 70.0% 的正确率（约 11/15 题，全美前 500 名水平）...

## 推荐理由

OpenAI 发了一个实打实的模型，不是概念稿，所以必须写。钩子在于便宜 80% 还能接近 o1 的推理分，数字够硬（AIME 70.0%、Codeforces 1650），而且它明确告诉你：STEM 行，非 STEM 只跟小模型差不多，开发者看完就知道该不该切过去。

## 锐评

o1-mini 的定位很明确：砍掉广谱知识，专攻 STEM 推理，换来速度和成本。API 调用费只要 o1-preview 的 20%，AIME 数学竞赛正确率 70%（约 11/15 题，全美前 500 名水平），Codeforces 1650 分（前 14% 程序员），这些数字跟 o1 的 74.4% 和 1673 分咬得很紧。在某个单词推理例子里，它比 o1-preview 快 3-5 倍得出正确答案。

但便宜有便宜的代价。正文直接说了，非 STEM 的事实性知识只跟 GPT-4o mini 这种小模型差不多，MMLU 跑不过 GPT-4o，GPQA 科学推理也落后 o1-preview。安全方面，越狱抵抗力比 GPT-4o 高 59%，有害提示安全率从 71.4% 提到 93.2%，这点没打折。

目前只开放给 Tier 5 API 用户和付费 ChatGPT 用户，普通开发者还摸不到。正文没披露参数量、训练数据细节和具体延迟毫秒数，也没给非 STEM 任务的实际体验对比。如果你要拿它做数学助教或代码审查，值得试；想当通用聊天机器人用，趁早换别的。
