# OpenAI 发布 o1 系列模型，先想清楚再回答，数学推理从 13% 飙到 83%

> 原标题：Introducing OpenAI o1

- 来源：OpenAI News
- 发布时间：2024-09-12T10:03:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/713
- 原文：https://openai.com/index/introducing-openai-o1-preview

## 摘要

OpenAI 在 9 月 12 日推出了 o1-preview 和 o1-mini 两个新模型，主打“先思考再回答”。在数学奥赛预选题上，GPT-4o 正确率只有 13%，o1 推理模型做到了 83%，编程能力也到了 Codeforces 前 11%。o1-mini 是个更小更快的版本，成本比 o1-preview 低 80%，适合写代码但不需要太广知...

## 推荐理由

这是一次 OpenAI 的重大推理模型发布，三个信号全中。H 来自“先想再答”的新玩法，K 来自具体的基准、安全和定价数字，R 来自从业者必须权衡的现实：推理能力上去了，但 API 基础功能还没跟上。

## 锐评

o1 这次最大的变化是让模型在回答前多花时间推理，像人一样试错、换策略。效果很直接：IMO 预选题正确率从 13% 拉到 83%，编程竞赛能进前 11%。安全测试上，防越狱得分从 22 提到 84，说明推理能力确实帮模型更守规矩。

但先别太激动。官方自己说这是早期预览版，API 不支持函数调用、流式输出和系统消息，也不能浏览网页或上传文件图片。对很多日常任务，GPT-4o 反而更实用。o1-mini 成本低了 80%，主打写代码，适合不需要广博知识的场景。

正文没披露推理过程具体多花了多少时间、延迟增加多少，也没给 o1-mini 在非编程任务上的对比数据。这些缺口让实际落地成本还不好算。
