跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 701–720 条 · 共 1,551 条

7月10日星期五

The Verge · AI

Fidji Simo 因病卸下 OpenAI 的 AGI 准备工作,转任兼职顾问

Fidji Simo 因为健康原因,不再负责 OpenAI 的通用人工智能(AGI)准备工作,转为兼职顾问。她几个月前就开始休病假了。Simo 同时还是 Instacart 的 CEO,2024 年 9 月加入 OpenAI 董事会,后来接手了 AGI 准备团队。目前 OpenAI 还没公布谁来接替她,也没说这件事会不会影响 AGI 准备的时间表。

推荐理由:AGI 准备团队的负责人因病转岗,这事本身就有新闻性,毕竟这个岗位直接关系到 OpenAI 最核心的长期目标。但文章信息量偏少——没提谁来接、时间表是否受影响,所以评分卡在 featured 门槛上,没往上走。

TechCrunch · AI

OpenAI 发布 GPT-5.6 系列,分三档,主打编程和省 token

OpenAI 这次一口气发了三个模型:Sol 是主力干活用的,Terra 算中配,Luna 是便宜版。Sam Altman 对 CNBC 说,Sol 在写代码任务上 token 效率提升了 54%,也就是说跑同样的活能省不少钱。公司还把它称为目前最强的网络安全模型,能干威胁建模、代码审查和蓝队演练(自己模拟攻击找漏洞)。不过正文没提具体定价和什么时候能...

推荐理由:OpenAI 旗舰模型更新,有两个能抓住人的点:54% 的 token 效率提升和网络安全定位,消息来自 TechCrunch 独家。没给 95 分是因为正文没提定价和上线时间,Sol 实际推理成本还不清楚,这点先别太激动。

The Verge · AI

OpenAI 的 ChatGPT 浏览器 Atlas 上线不到一年就宣布关停

OpenAI 在 2025 年 10 月推出 Atlas 浏览器,主打让 ChatGPT 帮你浏览网页、填表、订票。现在公司宣布它将在 2026 年 8 月 31 日关停,从发布到下线不到一年。公告里没解释为什么关,也没公布过用户量。一个浏览器这么快就砍掉,要么是没什么人用,要么是公司战略转向了。

推荐理由:OpenAI 的 Atlas 浏览器从发布到宣布关停不到一年,光这个速度就够反常。正文没给原因,也没提用户数据,所以没法判断是没人用还是战略收缩。我会先打个折,因为信息缺口太大,但这件事对做 AI 产品的人是个信号——大厂亲自下场试了,又亲手砍了,值得留意。

TechCrunch · AI

纽约时报指控 OpenAI 在版权案中隐瞒关键证据

纽约时报和每日新闻向法院提交了制裁动议,说 OpenAI 之前声称“技术上没法搜索训练数据和聊天记录来查侵权内容”是在撒谎。出版商指出,OpenAI 内部其实有现成的工具和数据集,正好能干这件事。OpenAI 之前一直以搜索成本太高、会涉及用户隐私为由拒绝提供这些数据。目前法院还没裁决,文章里也没有 OpenAI 对这次指控的回应。

推荐理由:这事挺大,纽约时报和每日新闻直接申请制裁,等于说 OpenAI 在法庭上撒谎。OpenAI 之前一直拿“技术上做不到”和“涉及用户隐私”当挡箭牌,现在出版商说他们内部其实有工具能干这事,这就把 OpenAI 的核心辩护捅了个窟窿。文章里没写 OpenAI 怎么回应,法院也还没判,但光是这个指控就够从业者重新掂量训练数据合规的风险了。

TechCrunch · AI

美国政府怎么判定 OpenAI 的 Sol 模型可以安全发布?没人说得清

OpenAI 正在向公众开放它的最新大模型 Sol,能力至少对标 Anthropic 的 Fable——后者曾让白宫紧张到短暂禁止公开访问。但这两家公司的模型是怎么拿到安全放行许可的,外界完全不清楚。乔治城大学 CSET 的高级研究员 Mina Narayanan 说,她自己也没有渠道了解政府的审查流程。Anthropic 提过他们跟政府有沟通,还做了...

推荐理由:文章把问题提得很清楚,但没有披露任何内部审查机制细节,所以分数卡在 78。我会先打个折,因为信息增量主要来自一位研究员的“不知道”,而不是流程本身的曝光。这点先别太激动,但问题确实扎在政策透明度的痛点上。

AI HOT 精选

OpenAI 把 Codex 和 ChatGPT 塞进了一个叫 ChatGPT Work 的桌面应用,背后是 GPT-5.6

ChatGPT Work 是一个新的桌面 agent,把 Codex 和 GPT-5.6 合在一起,能跨应用、跨文件干活,复杂项目可以连续跑好几个小时。它还带了一套新的编码流程、一个 Chrome 扩展、一个升级过的内置浏览器,以及用 GPT-5.6 加速的 Computer Use 功能。正文没提什么时候上线、怎么收费,也没说对电脑配置有什么要求。

推荐理由:OpenAI 发了一个桌面 agent,把 Codex 和 GPT-5.6 合在一起,直接跟 Cursor、Claude Code 抢地盘。产品形态和功能细节都摆出来了,当天就该写。正文没提上线时间、收费和配置要求,我会先打个折,但整体还是值得放头条。

The Verge · AI

OpenAI 结束数月预览,正式上线 GPT-5.6,同时预告企业版 ChatGPT Work

GPT-5.6 在拿到政府许可后终于全面开放,之前一直处于受限预览状态。OpenAI 还顺带提了一嘴 ChatGPT Work,说是面向企业的版本,但正文没披露具体功能、定价和上线时间。GPT-5.6 的性能提升和跑分数据也没给,文章只确认了发布和产品名字。

推荐理由:GPT-5.6 从受限预览转全面开放,这个节点本身值得从业者知道,所以 H 和 R 都站得住。但正文几乎没给任何硬数据,性能、跑分、技术方案全缺,K 完全撑不起来,分数也就卡在这里了。The Verge 的信源权威性有加分,但信息量实在太薄,我会先打个折。

FT · 科技

微软在 AI 上的先发优势,现在变成了一场信心考验

FT 这篇评论认为,微软靠着和 OpenAI 的绑定在 Copilot 上抢跑,但还没转化成实打实的收入。Azure 的增速在放缓,企业愿不愿意为 Copilot 持续付费仍是个问号,自家模型研发也落后。市场之前给微软的 AI 估值溢价,现在得看它能不能交出真金白银的业绩。

推荐理由:FT 这篇评论抓到了微软 AI 叙事的核心矛盾:靠 OpenAI 绑定拿到的估值溢价还在,但 Azure 增长和 Copilot 变现还没兑现。三个维度都踩中了,不过它是分析评论,不是一手数据,所以放在 featured 级别刚好。

7月9日星期四

TechCrunch · AI

Pitchbook 报告:SpaceX、Anthropic 和 OpenAI 三家公司的退出价值,将超过美国风投过去 25 年所有退出项目的总和

Pitchbook 最新报告扔了一个很夸张的数字:SpaceX 已经以 1.77 万亿美元上市,Anthropic 和 OpenAI 也在往万亿估值冲,这三家加起来的退出价值会超过 2000 年以来所有美国 VC 支持项目的退出总和。报告没给出精确的合并数字,但光 SpaceX 一家就已经把盘子撑得很大。这件事说明钱在极度向头部 AI 和航天公司集中,...

推荐理由:Pitchbook的数据给AI估值争论提供了一个历史标尺,对比尺度够大,数字也具体。扣分点有两个:SpaceX不是AI公司,硬塞进来有点凑数;正文没给出三家合并退出价值的具体数字,只有方向性判断。不过这种量级的对比本身就有信息量,值得推给从业者看看。

Ben's Bites

SpaceXAI 和 Cursor 联手训出 Grok 4.5,成本只有 Opus 的六分之一

SpaceXAI 和 Cursor 一起训了个新模型 Grok 4.5,性能大概卡在 Opus 4.7 和 4.8 之间,但按 token 算钱的话,比 Opus 便宜 6 倍,比 GPT-5.5 便宜 3 倍。现在 Cursor 里能用,API 也开放了。OpenAI 这边,GPT-5.6(Sol、Terra、Luna)今天会推给所有用户,早期测试的...

推荐理由:SpaceXAI 和 Cursor 联合发布 Grok 4.5,有具体性能区间和价格对比,三个维度都踩中了。扣分是因为来源是 newsletter 摘要而非一手公告,且正文截断,GPT-5.6 信息不全。跨源验证后加 3 分到 82,整体判断不变。

OpenAI News

OpenAI 把生物漏洞赏金变成常驻项目,GPT-5.6 起最高奖金翻倍到 5 万美元

OpenAI 把之前针对 GPT-5.5 的生物漏洞悬赏升级成一个长期运行的私密项目,叫 OpenAI Bio Bounty Program。核心目标没变:找那种能稳定绕过它预设生物安全挑战的通用越狱方法。奖金从 2.5 万涨到 5 万美元,GPT-5.6 和 GPT-5.5 都适用,没完全成功也可能拿到部分奖励。GPT-5.5 的测试窗口到 2026...

推荐理由:OpenAI 把生物安全悬赏从一次性测试升级为长期私密项目,奖金翻倍、覆盖新模型、还设了部分奖励机制,安全机制上算一次实质性更新。但话题太窄,生物越狱测试跟多数从业者的日常业务没什么交集,共鸣弱,所以虽然重要,共振分给低一点。

AI HOT 精选

OpenAI 发布 GPT-5.6 系列:Sol、Terra、Luna,主打用更少的钱跑出更高的分

OpenAI 在 7 月 9 日推出了 GPT-5.6 系列,包含旗舰模型 Sol、均衡型 Terra 和低成本 Luna。旗舰 Sol 在 Agents' Last Exam(一个覆盖 55 个专业领域的长流程测试)上拿了 53.6 分,比 Claude Fable 5 高出 13.1 分,但预估成本只有后者的四分之一左右。新加的 `ultra` 模...

推荐理由:OpenAI 旗舰模型换代,一次发三个变体,在长流程 agent 测试上直接赢了 Claude Fable 5 两位数,还打出四分之一成本的牌。这是 2026 年至今最重量的模型发布,会立刻影响 agent 工作流的选型决策。

AI HOT 精选

OpenAI 发布 ChatGPT Work:一个能跨应用自己干活、跟项目跟几小时的智能体

ChatGPT Work 是一个能直接操作你电脑上各种应用和文件的智能体,背后用的是今天同步推出的新模型 GPT‑5.6。它会把复杂项目拆成小步骤自己跑,中间你可以随时插手改方向或审批关键动作,跑出来的成果可以是幻灯片、表格、文档甚至网页应用。就算你人不在电脑前,它也能按预定任务继续推进,比如把 Teams 和 Slack 里的新消息自动更新到文档或幻...

推荐理由:OpenAI 官方发布 ChatGPT Work 和 GPT‑5.6,属于重大产品动作。跨应用自主操作、后台跑任务、人可以在中间插手审批,这些细节让消息有实感,不是纯营销。没给 95 分是因为目前只有官方博客,缺第三方实测和翻车案例,实际稳定性和权限边界还不清楚。

Hacker News 首页

AI 建设真正的瓶颈不是缺电,是排队并网要等 55 个月

美国不缺发电量,但新数据中心想接上电网,中位数等待时间已从 2005 年的不到 20 个月拉长到 2023 年的 55 个月。德州那个造价超 400 亿美元的 Stargate 园区,峰值用电 1.2 吉瓦,相当于 31.3 万户家庭。黄仁勋、扎克伯格、奥特曼都说过,能不能拿到电才是真正的限制。卡住的原因不是电不够,而是并网排队规则太死:先到先得,而且...

推荐理由:这篇文章把 AI 基建的真正瓶颈从“发电量不够”纠正为“并网排队规则太死”,有 Stargate 的具体案例和排队时间数据,对从业者很实用。来源是 Works in Progress 而非一线科技媒体,属于政策与基建分析,不是产品发布或技术突破,所以重要性给 72、tier 给 featured 是合适的。

AI HOT 精选

GPT-5.6 成为 Microsoft 365 Copilot 的首选模型,覆盖 Word、Excel、PPT 等办公套件

OpenAI 宣布 GPT-5.6 将作为 Microsoft 365 Copilot 的首选模型,集成到 Word、Excel、PowerPoint、Chat 和 Cowork 里。按官方说法,新模型能让每个 token 产出更多有用工作:Word 里写文档需要的提示轮次更少,Excel 里做分析更省 token,PPT 里从想法到幻灯片的转换更快。...

推荐理由:OpenAI 把最新旗舰模型 GPT-5.6 设为 Microsoft 365 Copilot 的默认引擎,覆盖 Word、Excel、PPT、Chat 和 Cowork。这是模型发布后第一个大规模企业落地动作,不是实验室指标。我会先打个折:正文没给出具体节省了多少 token 或时间的数据,也没说这些改进是在哪些测试集上验证的,所以效率提升的幅度暂时只能看官方说法。但就凭它直接进入几亿人的日常工作流这一点,重要性和共鸣感都拉满,值得放在头条。

Computing Life · Share · 鸭哥调研

GPT-5.5 的推理卡在 516 个 token:模型“想”的那一层会单独坏掉

开发者 vguptaa45 审计了 39 万条 Codex 响应,发现 GPT-5.5 在 44% 的编程任务里,推理部分刚好在 516 个 token 处截断,而 GPT-5.4 是 19.8%,GPT-5.2 只有 0.34%。被截断的任务全部答错,同一道题如果完整跑完 6000 到 8000 个 token 则全对。社区复现后,在 prompt ...

推荐理由:开发者 vguptaa45 翻查了 39 万条 Codex 回复,发现 GPT-5.5 在 44% 的编程任务里,推理部分会精准地在第 516 个 token 处断掉,断掉的题全错,而同一道题让它完整跑完 6000 到 8000 个 token 就全对。对比 GPT-5.4 的 19.8% 和 GPT-5.2 的 0.34%,这个 bug 像是新版本引入的。社区复现后找到了临时绕过的方法,对日常靠它写代码的人有直接参考价值。没给更高分是因为这更像一个具体版本的质量缺陷,影响面暂时局限在 Codex 的推理环节,正文没披露 OpenAI 是否已确认或修复。

Computing Life · Share · 鸭哥调研

GPT-Live 把语音交互和重推理拆开了,这才是真正的变化

OpenAI 在 7 月 8 日上线了 GPT-Live,给 ChatGPT 语音模式加了全双工和委托架构。全双工让你能随时插话、边聊边等,但原理不新——Moshi、Gemini Live、字节的 Seeduplex 都做过。真正的变化是委托:语音层只管跟你对话,后台并行跑 GPT-5.5 做搜索、推理、计算,结果分批返回。这打破了“越快越傻”的延迟悖...

推荐理由:OpenAI 刚上线 GPT-Live,这篇分析没停在表面吹全双工,而是把委托架构拎出来当真正的变化。作者有技术判断力,跟 Moshi、Gemini Live、字节 Seeduplex 的对比也列得明白。扣分是因为正文没给出具体延迟数据或实测验证,判断偏定性。

AI HOT 精选

Anthropic 秘密提交 IPO 申请,三季度利润预计超 10 亿美元

SemiAnalysis 的报告说,Anthropic 今年第三季度利润会超过 10 亿美元,并且在 6 月 1 日已经秘密交了上市申请。它和 OpenAI 两家现在的年度经常性收入加起来快 1000 亿美元了。Anthropic 能跑在前面,主要靠 Claude Code 在开发者里用得特别猛,帮它在企业生意上赚到了钱,成了 B2B 市场的领跑者。O...

推荐理由:SemiAnalysis 这篇爆料给出了硬数字和明确的时间节点,可信度不低,但正文没披露 S-1 细节,所以重要性先打个小折。Anthropic 靠 Claude Code 在企业端跑通赚钱,比 OpenAI 先一步秘密交表,这件事对行业排序有直接影响,值得放在头条。

TechCrunch · AI

OpenAI 发了 GPT-Live-1 系列语音模型,能边听边说,打断它也不卡壳

OpenAI 推出了 GPT-Live-1 和 GPT-Live-1 mini 两个新语音模型,最大的变化是支持“全双工”——也就是模型能同时听和说,你可以在它说话时直接插话,不用等它闭嘴。付费版 ChatGPT 用户默认会用上 mini 版,高阶套餐可以切到更大的 GPT-Live-1。新模型不再走以前“语音转文字→大模型思考→文字转语音”的老路,而...

推荐理由:OpenAI 发了两个端到端语音模型,全双工是最大卖点,TechCrunch 首发。没给 85 分以上是因为正文没披露延迟数字、支持语言和实际对比效果,现在只能看到功能描述,实际体验好坏还得等上手。

7月8日星期三

AI HOT 精选

OpenAI 发布国家安全合作原则,划出三条硬红线

OpenAI 今天公开了一份国家安全合作原则,讲清楚他们怎么跟政府和执法部门打交道。三条硬性禁令:不搞大规模国内监控、不指挥自主武器系统、不做高风险自动化决策。过去一个月,他们已经在网络防御上跟澳大利亚、加拿大、日本、韩国、法国、德国、波兰、荷兰以及欧盟机构建立了合作,还给部分美国及盟友的合作伙伴开放了 GPT-Rosalind 模型用于生物安全。这些...

推荐理由:OpenAI 首次系统性地公开国家安全原则,三条禁令和已合作国家名单让这份文件有了实质内容,GPT-Rosalind 的提及也加了点料。没给更高分是因为这还只是一份原则声明,不是产品发布,执行效果有待观察。