# OpenAI 发布 GPT-4o mini，比 GPT-3.5 便宜六成，API 里首次用上指令层级防越狱

> 原标题：GPT-4o mini: advancing cost-efficient intelligence

- 来源：OpenAI News
- 发布时间：2024-07-18T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/742
- 原文：https://openai.com/index/gpt-4o-mini-advancing-cost-efficient-intelligence

## 摘要

OpenAI 在 7 月 18 日推出了 GPT-4o mini，直接替换掉 ChatGPT 里的 GPT-3.5。价格是输入每百万 token 0.15 美元、输出 0.6 美元，比 GPT-3.5 Turbo 便宜了超过 60%。模型跑分还行，MMLU 82 分、HumanEval 87.2 分，都压过 Gemini Flash 和 Claude ...

## 推荐理由

这不是小修小补，GPT-4o mini 带着新定价、长上下文、明确的基准成绩和一套新的安全机制出来，直接替掉 GPT-3.5，对开发者的钱包和安全方案都有实际影响。HKR 三项全中，放在 P1 没问题。

## 锐评

OpenAI 这次发布的 GPT-4o mini，核心就一件事：用更少的钱，干 GPT-3.5 干不了的活。输入每百万 token 0.15 美元、输出 0.6 美元，比 GPT-3.5 Turbo 便宜超过 60%，直接把门槛拉低了一个量级。跑分上，MMLU 82 分、HumanEval 87.2 分，都压过了 Gemini Flash 和 Claude Haiku，说明这个小模型在推理和写代码上确实有两下子。

但得打个折。这些分数是 OpenAI 自己测的，不是第三方独立评测，而且 LMSYS 排行榜上那个“聊天偏好超过 GPT-4”的说法，正文没给出具体胜率或统计显著性，更像一句营销话术。另外，文章提到了 Ramp 和 Superhuman 两家公司在用，但只说了“提取发票数据”和“生成邮件回复”这两个场景，其他复杂业务下的表现还是未知数。

对开发者来说，真正值得关注的是它首次在 API 里用了“指令层级”技术来防越狱和提示注入，这是安全上的一个硬升级。不过，目前只支持文本和图片输入，视频和音频还要等，上下文窗口 128K 是给了，但知识截止到 2023 年 10 月，时效性上别抱太高期待。
