跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 101–120 条 · 共 1,551 条

9月23日星期三

Latent Space

Claude Opus 5.5 发布:写作质量大幅提升,成本降了 40%,直接成了 AINews 的默认模型

Anthropic 发了 Claude Opus 5.5,这是新 5.5 系列的第一个模型。官方说它在大多数任务上能追平之前的旗舰 Fable 5.1,但运行成本比 Opus 5 低了 40%,速度也快了约 30%。这次发布很少见地把写作改进放在了显眼位置:模型会把关键信息放在最前面,也更听你的风格指令,长对话读起来没那么累。Latent Space ...

推荐理由:Anthropic 发了新旗舰系列的第一个模型,声称性能持平 Fable 5.1 但便宜 40%,还把写作体验改进摆上台面——这对 Claude 重度用户是直接可操作的升级信号。没给 90 分以上是因为目前只有官方说法和 Latent Space 的初步观察,缺独立验证,先别太激动。

AI 群聊日报

Anthropic Opus 5.5 和 OpenAI Sol/Luna 同日发布,群友拆解性价比与迁移踩坑

Anthropic 毫无预兆地放出 Opus 5.5,在终端操作和编程任务上跑分领先,但 max 档输出 token 量是 GPT-6 Astra 的三倍多。群友分析发现 high 档是性价比甜区:比 medium 多花 36% 的钱,智能指数涨 3 分,再往上边际成本陡增。两小时后 OpenAI 上线 Sol 和 Luna,Luna 输入价格打到每百...

推荐理由:Anthropic Opus 5.5 无预警发布,OpenAI 两小时后用 Sol 和 Luna 回击,一天内三次模型更新。日报提供了用户实测的 effort tier 性价比拆解和 prompt 迁移经验,信息密度高。扣分点:正文没展开 Sol/Luna 的具体跑分对比,但整体信号足够强,维持 featured。

AI HOT 精选

OpenAI 放出 GPT-6 系列新模型 Sol 和 Luna,API 价格直接打五折

OpenAI 在 GPT-6 家族里加了两个新模型:Sol 和 Luna。Sol 定位是干复杂编程和专业任务的,Luna 则负责速度快、量大的日常活儿。最直接的变化是价格——API 调用费比上一代 GPT-5.6 的推广价砍了一半,其中 Luna 的输出价格实际降了 58%,从每百万 token 1.2 美元降到 0.5 美元。性能上,Sol 在 Au...

推荐理由:OpenAI 一次放出两个新模型,还把价格砍到上一代推广价的一半,这个动作本身就值得上头条。Sol 的 Aura 分数和 Luna 的 0.5 美元输出价都是硬数字,能直接拿来判断性价比。我会先打个折——正文没给全量基准表,所以性能这块只能看单点,但价格信号已经足够强,做产品和做研究的人都会关注。

纽约时报中文网

美中元首峰会聊了 AI,但两边戒心太重,实质进展很难

这周美中高层会晤,AI 是核心话题。双方同意建一个 AI 安全热线,两个月后可能在深圳再谈,但分析人士普遍不看好能谈出具体结果。特朗普政府放松了芯片出口管制,允许英伟达卖 H200 芯片给中国,同时美方又指责中国公司用“蒸馏”技术(用小模型反向学习大模型输出)偷 AI 模型。参议员沃伦公开警告特朗普别只顾着照顾 AI 行业的生意,而不向中方施压谈 AI...

推荐理由:这条新闻的实质是政策博弈,不是产品或技术突破。我会先打个折:信号很强,但对一线做模型的人,眼下能立刻动手调整的东西不多。正文没披露安全热线的具体机制,也没说 H200 放松是临时还是长期,这些缺口让判断只能停在“值得盯着”的层面。

AI HOT 精选

AI 最赚钱的市场不在最前沿,而在中间那层

Tunguz 用网关数据算了一笔账:企业真正花钱买的不是最强模型。Anthropic 的 Opus 系列五次发布都没涨价,一直定在输入 5 美元、输出 25 美元每百万 token,直到昨天才首次降价;OpenAI 更狠,Luna 先砍 80%,昨天又砍 50%。开源模型更夸张,跑着大部分 token 量,价格比闭源模型混合价低 86%。最贵最强的 F...

推荐理由:Tunguz 用网关支出数据算了一笔反直觉的账:最贵的 Fable 5.1 在 12 天内只拿到 3.7% 的支出,企业真正花钱买的是中段模型。Opus 五次发布都没涨价,开源模型跑着大部分 token 量却比闭源混合价低 86%,这些数字说明预算流向的不是最强而是最划算的模型。我会先打个折——正文没披露网关覆盖的企业类型和样本量,所以这个结论的普适性还得看具体场景,但方向本身对做应用和管成本的人很有参考价值。

AI HOT 精选

Claude Opus 5.5 和 GPT-6 Sol/Luna 同日发布,新一轮价格战开打

Simon Willison 对比了同一天发布的三个模型。GPT-6 Luna 输入价格降到每百万 token 0.1 美元,是 GPT-5.6 Luna 的一半,也是 OpenAI 有史以来最便宜的模型之一。GPT-6 Sol 也比前代便宜了一半。Claude Opus 5.5 降了 20%,但价格仍是 GPT-6 Sol 的两倍。在测试中,Opus...

推荐理由:三个主力模型同一天发布,Simon Willison 给了第一手价格对比和初步体验。GPT-6 Luna 输入每百万 token 0.1 美元是 OpenAI 史上最低,直接改变了应用开发者的成本结构。不过文章只给了价格和简短测试印象,没有完整 benchmark,实际能力还得等更多评测。

AI HOT 精选

GPT-6 Sol 和 Luna 跑分跟前代差不多,但价格直接砍半

Artificial Analysis 的评测显示,GPT-6 的两个新模型 Sol 和 Luna,在智力指数上的得分跟 GPT-5.6 系列基本持平,没拉开明显差距。但 token 定价降了大约一半,跑一次任务的成本直接减半。他们放出的图表就是 OpenAI 各代模型在“聪明程度”和“单任务成本”之间的取舍曲线。正文没给出具体分数和定价数字,所以这个...

推荐理由:GPT-6 发布后第一个第三方性价比评测,成本减半、智力持平这个结论对选模型决策是直接信号。扣分是因为正文只给了图表趋势,没披露具体分数和定价数字,信息密度不够扎实。

AI HOT 精选

OpenAI 推出 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6 促销价还低一半

OpenAI 往 GPT-6 家族里塞了两个新模型:Sol 和 Luna。它们继承了 GPT-6 Astra 的大部分本事,但跑得更快、更便宜,适合大规模调用。API 定价直接比 GPT-5.6 的促销价再砍 50%,官方说靠的是缓存和推理效率的提升。不过正文没给出任何跑分、延迟数据或上线时间,实际效果和速度还得等实测。

推荐理由:OpenAI 往 GPT-6 家族塞了 Sol 和 Luna 两个新模型,API 价格比 GPT-5.6 促销价再砍一半,对开发者是个实打实的成本信号。分数没给更高是因为正文没给任何跑分、延迟数据或上线时间,实际效果还得等实测,这点先别太激动。

AI HOT 精选

OpenAI 给 GPT-6 的提示词缓存加了命中率仪表盘和诊断工具,默认就能省更多钱

GPT-6 的提示词缓存现在默认命中率更高,只要 30 分钟内复用相同的前缀内容就能拿到折扣。新上线的仪表盘可以看缓存的命中率走势,诊断工具能告诉你哪次没命中是因为工具定义变了、具体浪费了多少 token(比如一次 tools_changed 就丢了 5,629 个 token)。开发者现在可以手动设缓存断点、在不破坏缓存的前提下调整推理强度,还能提前...

推荐理由:这是 OpenAI 官方发的 GPT-6 缓存改进,不是新模型,但诊断仪表盘和手动断点对 agent 开发者是实打实的成本优化。给了 30 分钟复用窗口、5,629 token 浪费等具体数字,信息量够,所以重要性给 82,放在 featured 里。

AI HOT 精选

GPT-6 Sol 和 Luna 评测:价格砍半,但知识类任务表现有退步

OpenAI 新发布的 GPT-6 Sol 和 Luna 把价格直接砍了一半:Sol 输入/输出每百万 token 降到 2/10 美元,Luna 降到 0.1/0.5 美元。在 Artificial Analysis 的智能指数跑分中,Sol 单次任务成本从 1.99 美元降到 1.06 美元,Luna 从 0.18 美元降到 0.07 美元,整体分...

推荐理由:OpenAI 把 GPT-6 价格砍半,Sol 单次任务成本 1.06 美元,Luna 0.07 美元,但能力变化不是一边倒的好——Luna 在 Coding Agent 指数上还倒退了。有第三方跑分数据撑着,对开发者做决策很实用。没给 p1 是因为这属于模型迭代的价格调整,不是底层架构级的大新闻。

AI HOT 精选

Arena 开始测 GPT-6 Sol 和 Luna 了,分数还没出,但你可以上手跑真实任务

Arena 放出了 OpenAI 两个新模型 GPT-6 Sol 和 GPT-6 Luna 的测试入口,目前还没公布评分。你可以直接去 Arena 让它们跑真实的智能体任务,然后投票,结果会进排行榜。正文没提模型规模、发布时间和定价,所以这些先别猜。

推荐理由:GPT-6 首次公开出现,两个变体在 Arena 上跑智能体任务,悬念和信号都很强。扣分是因为正文没提模型规模、发布时间和定价,目前只是一个测试入口,信息偏薄,所以分数我会先打个折。

AI HOT 精选

GPT-6 Sol 和 GPT-6 Luna 上架 Arena,API 价格比 GPT-5.6 促销价还砍一半

OpenAI 在 Arena 上放出了两个新模型,Sol 和 Luna,都基于 GPT-6 Astra 的技术。卖点是推理更快、更便宜,针对高吞吐场景优化了缓存,API 定价直接比 GPT-5.6 的促销价再低 50%。正文没给跑分和延迟数据,这点先别太激动,等第三方实测出来再看值不值。

推荐理由:OpenAI 在 Arena 放出两个 GPT-6 新模型,API 价格比 GPT-5.6 促销价再砍一半,价格信号很强。但正文没给跑分和延迟数据,性能有没有缩水还不清楚,等第三方实测出来再下结论,分数先压在 85 以下。

AI HOT 精选

Sam Altman 说 GPT-6 Sol 和 Luna 按任务定价没对手,但没给具体数据和测试

Sam Altman 发帖说 GPT-6 系列里的 Sol 和 Luna 两个模型,如果按“完成一项任务花多少钱”来比,市面上没有能打的。他提到相比 5.6 系列,新模型在智力、对齐程度、工作产出、写代码和操作电脑上都有大提升,每个 token 的价格砍了一半,按任务算更便宜。不过帖子里没给出任何跑分、定价数字或第三方验证,我会先打个折看——等有独立测...

推荐理由:Sam Altman 亲自为 GPT-6 的按任务定价站台,声称没有对手,这对关注推理成本的人来说是个直接信号。但帖子缺跑分和定价数据,目前只是单方面说法,我会先打个折,等独立测试出来再调整判断。

AI HOT 精选

OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GPT-5.6 促销价还砍一半

这两款模型都基于 GPT-6 Astra 的技术,主打便宜和快,适合跑量大的任务。OpenAI 说靠缓存和推理环节的优化把成本打下来了,所以 API 定价直接比 GPT-5.6 的促销价再低 50%。Sam Altman 转发了公告,夸角色形象可爱。正文没给跑分、延迟数据和哪些地区能用,这点先别太激动。

推荐理由:OpenAI 把 GPT-6 的 API 价格定得比 GPT-5.6 促销价还低 50%,对高并发场景是直接的成本冲击。正文没给跑分、延迟和地区可用性,所以没法判断性能有没有缩水,分数先不打满。

AI HOT 精选

OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直接砍半

OpenRouter 刚挂出 OpenAI 两个新模型:GPT-6 Sol 和 GPT-6 Luna。定价比上一代 GPT-5.6 便宜一半——Sol 输入每百万 token 2 美元、输出 10 美元,Luna 更便宜,输入 0.1 美元、输出 0.5 美元。在 AutomationBench 测试里,两个模型都超过了之前的最好成绩,而且单任务成本更...

推荐理由:OpenAI 新一代旗舰直接上架,双版本加价格腰斩,属于行业级事件。正文没披露完整 benchmark 和上下文窗口,但光凭定价和 AutomationBench 的跃升就够上 featured。我会先打个折——Luna 那个 0.1 美元输入价确实便宜,但得看实际能力有没有缩水,这点先别太激动。

AI HOT 精选

GPT-6 Sol 和 Luna 价格砍半,智商分没变

Artificial Analysis 测了 OpenAI 新出的 GPT-6 Sol 和 Luna,两个模型的价格都只有 GPT-5.6 对应版本的一半。Sol 每百万 token 输入 2 美元、输出 10 美元,Luna 更便宜,输入 0.1 美元、输出 0.5 美元。Intelligence Index 得分跟 GPT-5.6 持平,等于花更少...

推荐理由:Artificial Analysis 给了 GPT-6 系列第一个第三方基准:Sol 和 Luna 价格都是 GPT-5.6 的一半,智能指数持平。我会先打个折——这是单一评测方的数据,样本量和任务覆盖还没交叉验证,别当定论。但价格数字够硬,对做模型选型和成本建模的人来说,这就是能直接上桌的信号。正文没披露延迟和吞吐量,这点先别太激动。

AI HOT 精选

OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半

OpenAI 开发者账号官宣了两个新模型 GPT-6 Sol 和 Luna,API 调用费比上一代 GPT-5.6 便宜了一半。Sherwin Wu 补了 Luna 的具体价格:每百万 token 输入 0.1 美元,输出 0.5 美元,还提了一嘴这个价格很快得按十亿 token 来算了,说明单价确实在往下走。不过正文没提 Sol 的单价,也没说这两个...

推荐理由:OpenAI 官宣了 GPT-6 Sol 和 Luna,Luna 的 API 价格比上一代便宜 50%,输入每百万 token 0.1 美元、输出 0.5 美元,Sherwin Wu 还暗示很快要按十亿 token 计价,单价下行趋势很明确。不过正文没给 Sol 的单价,也没说两个模型的能力差异和适用场景,这点先别太激动。这是旗舰模型换代加大幅降价,当天必须让读者知道。

AI HOT 精选

OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 Sol 和 GPT-6 Luna,付费用户现在就能用

OpenAI 官方账号发了一条简短通知,说 GPT-6 Sol 和 GPT-6 Luna 两个模型已经上线,Plus、Pro、Business、Enterprise 和 Edu 用户都能在 ChatGPT Work 和 Codex 里用到。正文没披露模型参数、价格有没有变、跟 GPT-5 比到底强多少——这些都得等后续跑分出来再看,现在先别急着下结论。

推荐理由:GPT-6 双模型上线是行业基线事件,通知极简但覆盖所有付费层级。分数没给到 95 是因为正文没有任何技术细节,K 轴目前是空的,得等跑分和实测报告出来才能填上。

TechCrunch · AI

OpenAI 发布 GPT-6 小模型 Sol 和 Luna,主打更便宜、更少出错

OpenAI 在旗舰模型 Astra 之后,又推出了两个“青春版”:Sol 和 Luna。Sol 负责写代码这类复杂任务,Luna 则用来干摘要、信息提取、快问快答这些目标明确、量大的活。公司说这两个模型比 Astra 更省钱、效率更高,但正文没公布具体定价、错误率对比和上线日期。所以“更少出错”这个说法,我建议先打个折,等实测跑分出来再说。

推荐理由:OpenAI 在 Astra 之后快速放出 Sol 和 Luna,产品线扩张的动静不小,TechCrunch 独家报道也拉高了关注度。但文章只说了定位和分工,没披露定价、错误率对比和具体上线日期,所以“更少出错”这个卖点我建议先打个折,等实测数据出来再说。分数维持 88,放在 featured 没问题。

AI HOT 精选

OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6 直接砍半

OpenAI 在 GPT-6 系列里加了两个更省钱的模型:Sol 和 Luna。API 价格全部对折,Sol 输入/输出每百万 token 收 2/10 美元,Luna 只要 0.10/0.50 美元。Sol 在 AutomationBench 上开足马力拿到 33.2% 的分数,但每次任务成本只有 Claude Opus 5 的 9%;在 Agent...

推荐理由:OpenAI 官方发新模型,API 价格砍半,Sol 在 agent 基准上的成本只有竞品 9%,对整个行业的成本结构冲击很大。H、K、R 全中,定价和基准数据都给了。扣 3 分是因为正文没把 Sol 和 Luna 的能力差距说透,只知道 Sol 更强但贵,Luna 更省但弱,具体弱在哪没展开。