跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 841–860 条 · 共 1,551 条

6月14日星期日

Hacker News 首页

纽约、科罗拉多等多州总检察长联手调查 OpenAI,要求交出用户数据、儿童安全与广告相关内部文件

OpenAI 在周六确认,由纽约、科罗拉多等州组成的联盟已于周五向公司发出传票,调查范围覆盖用户数据处理、未成年人保护和广告活动。公司声明称“认真对待各州总检察长的关切”,并提到最新版 ChatGPT 已加入家长控制等防护措施。这次调查的背景是 AI 引发的儿童自残案例和 AI 生成诈骗在增多,但报道没有给出具体案件数量或调查时间表。

推荐理由:我会先打个折:报道没给出具体案件数量或调查时间表,事实密度不算高。但这是州级联盟第一次对头部 AI 公司动手,而且调查范围很具体——数据、儿童安全、广告,全是监管敏感区。对做 C 端 AI 产品的团队来说,这相当于提前看到合规考卷的题型,值得现在就关注。

6月13日星期六

AI HOT 精选

SemiAnalysis 实测:200 美元月费订阅,用掉的 token 量按 API 算值 8000 到 14000 美元

SemiAnalysis 把 Anthropic 和 OpenAI 的付费方案全买了一遍,用高强度写代码任务一直跑到每周用量上限。结果发现,200 美元一个月的 Claude Max 方案,实际消耗的 token 如果按 API 价格换算,大概值 8000 美元;ChatGPT Pro 方案则值 14000 美元左右。直接调 API 要花的钱会贵很多。...

推荐理由:SemiAnalysis 用真实写代码负载测出了订阅价和 API 等价 token 消耗之间的巨大价差,40 到 70 倍的数字很直观。没给更高分是因为这是第三方单次测试,不是官方调价,而且只测了一种任务类型,换别的任务结果可能不同。

Hacker News 首页

美国政府一纸禁令,Anthropic 被迫在全球下线 Fable 5 和 Mythos 5

6 月 13 日,Anthropic 突然停掉了 Fable 5 和 Mythos 5 的访问。起因是美国政府当天下午 5 点 21 分(美东时间)发了一份出口管制指令,要求禁止任何外国公民使用这两个模型,包括人在美国的外国人,甚至 Anthropic 自己的外籍员工。Anthropic 说这根本做不到,只能一刀切全部关停。政府给出的理由是发现了一种越...

推荐理由:Anthropic 因政府出口管制指令直接关停两个主力模型,这事冲击力够大。HKR 三项全中:冲突性强,信息具体且首次曝光,开发者直接受影响。来源是个人博客而非官方公告,我会先打个折,但事实本身已经足够硬,不影响判断。

Hacker News 首页

美国政府以国家安全为由,要求 Anthropic 立即停掉 Fable 5 和 Mythos 5 的所有访问权限

Anthropic 在 6 月 12 日下午收到美国政府的出口管制指令,要求禁止任何外国人(包括自家外籍员工)使用 Fable 5 和 Mythos 5 这两个模型。为了合规,公司只能一刀切,把所有人的访问都关了,其他模型不受影响。政府给出的理由是发现了一种能绕过 Fable 5 安全护栏的“越狱”方法。但 Anthropic 看完演示后反驳说,这招只...

推荐理由:美国政府直接动用出口管制,要求 Anthropic 把 Fable 5 和 Mythos 5 对外国人关停,连自家外籍员工都算在内。Anthropic 看完政府的越狱演示后反驳,说那招只碰到了已知的小问题,不是新漏洞。这事把国家安全、模型安全和公司合规全搅在一起,而且政府指令和公司反驳都公开了,信息密度很高,所以给 95 分。

Hacker News 首页

一个跨模型协作的编程工作流:让 Claude 做规划、GPT 写代码,号称能省 80% 的 Claude 用量

Dan McInerney 开源了一个 Claude Code 技能,把 Claude Fable 5 和 GPT-5.5 Codex 串成一个分工循环:Claude 负责拆任务、做代码审查,GPT 负责动手写代码,整个代码仓库充当记忆。作者说这样能把 Claude 的 token 消耗砍掉 80%,但仓库里只有 README 和代码,没给测试基准或对...

推荐理由:一个能跑通的跨模型 agent 循环,Claude 拆任务做审查、GPT 负责写代码,作者声称 token 消耗砍掉 80%。这个分工模式实用,值得一试。但仓库里只有 README 和代码,没给测试基准也没第三方验证,全是自述,所以分数先不打高,等有人复现再说。

6月12日星期五

纽约时报中文网

SpaceX 本周上市,但大陆和香港的投资者被挡在门外,OpenAI 之后也可能跟进

SpaceX 本周开始上市交易,五位知情人士说,来自中国大陆和香港的投资者被排除在这次 IPO 之外。OpenAI 今年晚些时候上市时很可能也会设同样的限制,它此前在私募轮就已经不让中国投资者参与了。两家公司都没公开解释原因,但美国政府是它们的大客户——SpaceX 去年从政府拿了约 40 亿美元收入,OpenAI 也宣布要给国防部的机密系统提供 AI...

推荐理由:这条消息来自 NYT 独家,有五位具名知情人士背书,披露了 SpaceX IPO 对中国大陆和香港投资者的明确排除,并指出 OpenAI 很可能跟进。40 亿美元政府收入和国防部机密项目这两个数字把原因钉得很实,不是空泛的地缘政治叙事。对 AI 从业者来说,这直接关系到资本准入和行业格局,实用价值高。分数定在 72 是因为虽然冲击力强,但属于政策/准入层面的消息,不是技术突破或产品发布那种能立刻改变工作流的事件。

AI HOT 精选

OpenAI Codex 新增浏览器开发者模式,能直接读 Chrome 的调试信息

Codex 现在可以接入 Chrome DevTools 协议,在浏览器里看 JS 性能、控制台输出、网络请求和页面状态,等于把 AI 塞进了调试流程。正文没提这个模式是默认开启还是需要手动打开,也没说延迟和权限边界。

推荐理由:Codex 现在能接 Chrome DevTools 协议,在浏览器里直接看 JS 性能、控制台输出、网络请求和页面状态,等于把 AI 塞进了调试流程。我会先打个折:正文没说这个模式是默认开启还是手动打开,也没提延迟和权限边界,所以实际体验还不好判断。但方向是对的——让 AI 进浏览器看现场数据,比只帮写代码更贴近开发者的日常排错。

AI HOT 精选

OpenRouter 用多模型“合议”跑分,成绩压过 GPT-5.5 和 Claude Opus 4.8

OpenRouter 推出了一个叫 Fusion 的功能,做法是把同一个问题同时扔给好几个模型,再让一个裁判模型把它们的回答综合成一份最终结果。他们在 100 个深度研究任务上测了一下,Fable 5 和 GPT-5.5 合议后正确率 69.0%,比 Fable 5 单跑的 65.3% 要高。更划算的是,用 Gemini 3 Flash、Kimi K2...

推荐理由:OpenRouter 的 Fusion 功能让多个模型合议输出,用便宜模型组队去挑战单跑的旗舰模型,这个思路本身就值得一看。文章给了 DRACO 基准上的对比数据,Fable 5 加 GPT-5.5 合议正确率 69.0%,比单跑高 3.7 个百分点,而且用 Gemini 3 Flash 这类低成本模型也能摸到类似效果,对预算敏感的人是个信号。不过这是平台功能发布,不是模型能力突破,所以重要性打到 78 分。我会先打个折:正文没披露裁判模型的具体选择和合议延迟,实际落地成本还要自己测。

AI HOT 精选

WSJ:OpenAI 想靠大降价和超级应用改版,在 IPO 前抢企业开发者

WSJ 消息,OpenAI 正在考虑大幅降价,直接原因是 Anthropic 的 Claude Code 在企业开发团队里用得越来越多,token 消耗量很大,抢走了不少付费用户。OpenAI 虽然在大众用户里名气更大,但真正赚钱靠的是企业客户,所以这次降价主要冲着开发者来。同时,OpenAI 在筹备 IPO 前要对 ChatGPT 做一次最大规模的改...

推荐理由:WSJ 独家消息,OpenAI 正在考虑大幅降价,直接导火索是 Claude Code 在企业开发团队里 token 消耗量很大,抢了不少付费用户。OpenAI 虽然大众名气大,但真正赚钱靠企业客户,这次降价就是冲着开发者来的。同时,IPO 前还要对 ChatGPT 做一次最大规模改版。我会先打个折:正文没披露具体降价幅度和改版细节,但竞争态势确实在变,价格战信号很明确,对从业者选工具和算成本有直接影响。

6月11日星期四

AI HOT 精选

Anthropic CEO 阿莫迪:AI 造成的岗位流失不是短期阵痛,是技术自带的结构性后果

Anthropic CEO 阿莫迪在新政策文章里把话说得很直:AI 导致的大规模、长期性失业,不是企业没经营好或短期调整,而是这项技术复刻人类脑力工作的“固有属性”。他之前就预测过,五年内一半初级白领岗位可能消失,失业率冲到 10% 到 20%。这次他没再花力气渲染惨淡前景,而是重点讲政府该怎么接招——分两步,先减缓冲击,再共享红利。具体包括给因 AI...

推荐理由:Anthropic CEO 发了一篇政策文章,不是产品更新,但话题分量够重。标题有吸引力,内容给出了具体的两步走政策框架,并且直接触达从业者的职业焦虑。评分维持 82,tier 不变。

AI HOT 精选

OpenAI 要买下 Ona,给 Codex 一个不会关机的云端工位

OpenAI 宣布收购云开发环境公司 Ona,目的是让 Codex 里的智能体能在客户自己的云上跑长任务,不用一直连着你的电脑。Codex 现在每周有超过 500 万人在用,比 2026 年初涨了 400%。Ona 之前帮 200 万开发者把工作搬到了安全、可复现的云端环境里。收购完成后,Ona 的执行和调度技术会让企业能在自己的安全、权限和日志规则下...

推荐理由:OpenAI 官方发的收购消息,数字也给了:Codex 周活 500 万、年增长 400%,Ona 有 200 万开发者。收购直接解决了一个痛点——让智能体在生产环境里持续干活,不用依赖本地电脑。这会改变 AI 编程工具的竞争格局。没给 95 分是因为整合效果还没跑出来,正文也没说收购金额和具体上线时间,先打个折。

6月10日星期三

OpenAI News

OpenAI 封禁了一批疑似来自中国的 ChatGPT 账号,理由是它们在美国的 AI 政策讨论里搞隐蔽舆论操作

OpenAI 在 6 月 10 号发了份威胁报告,封了两组大概率来自中国的 ChatGPT 账号。一组叫“数据中心顺风车”,专门生成“AI 数据中心推高居民电费”的帖子和图片;另一组叫“科技与关税”,一边骂美国关税是打压科技竞争的手段,一边在提示词里要求只提特朗普、不提习近平。后一组还散布过“ChatGPT 用户数据泄露”的假消息,OpenAI 说这完...

推荐理由:OpenAI 官方威胁报告,有具体操作细节和账号集群,HKR 三个维度都踩实了。但本质是一次安全事件披露,不是产品/技术突破,所以放在 78 分这个“质量不错”的区间。没给更高是因为它没有重塑行业格局或技术路线。

AI HOT 精选

Google DeepMind 联手 OpenAI、Anthropic,拿 1000 万美元悬赏多智能体安全研究方案

Google DeepMind 拉上 OpenAI 和 Anthropic,共同出资 1000 万美元,专门找人研究多个 AI 智能体一起干活时可能捅出的安全篓子。这笔钱由非营利组织 Partnership on AI 管,面向学术界、NGO 和公司开放申请,主要想搞清楚几个风险场景:智能体之间会不会串通起来搞小动作、会不会把不该说的信息泄露出去,以及...

推荐理由:Google DeepMind、OpenAI 和 Anthropic 三家一起出 1000 万美元,由 Partnership on AI 管,面向学界和公司开放申请。研究聚焦三个具体故障模式:智能体串通、信息泄露、奖励篡改。分数维持 78,因为金额不算特别大,且目前只是宣布资助,还没看到实际研究成果,但三家联手这个信号本身对行业有提醒作用。

AI HOT 精选

OpenRouter 的 Advisor 工具页面 404 了,正文没披露任何细节

OpenRouter 原本要介绍一个叫 Advisor 的工具,让 GPT-4o Mini 这类便宜模型在生成过程中可以随时去问 Claude Fable 等更强模型。但博客页面直接返回 404,文章不存在。定价、延迟、路由策略这些关键信息全都没公开,目前只能看到标题和摘要里的概念,没法判断实际效果和成本。

推荐理由:我会先打个折:OpenRouter 这篇博客直接 404,正文没披露定价、延迟、路由策略和实际效果,目前只有标题和摘要里的概念。概念本身有意思——让便宜模型在生成中途去问强模型,相当于给低成本模型配了个随时可叫的顾问,不是简单的 fallback 或静态路由。这点先别太激动,因为没数据验证到底省不省钱、延迟高不高、强模型被调用的频率和策略全都不清楚。对正在搭模型路由栈的团队来说,这个方向确实踩中了成本与质量的平衡点,但信息缺口太大,只能当产品信号看。

6月9日星期二

AI HOT 精选

一位开发者用 GPT-5.5 替代 OCR 流程,把 2.3 万篇 ChinaRxiv 论文免费开放并配上更完整的英文翻译

这件事的起点很简单:有人觉得传统的 OCR(光学字符识别)管道太复杂,直接用 GPT-5.5 来读论文、做翻译,结果把 23,000 多篇 ChinaRxiv 上的论文免费放出来了,还带了比之前更完整的英文翻译。正文没披露具体成本、延迟和翻译质量对比,所以没法判断这套方案在准确率和开销上到底比 OCR 好多少。如果是真的省钱又省事,对需要批量处理中文论...

推荐理由:我会先打个折:这不是 OpenAI 官方模型发布,而是一个开发者用例,所以推荐分在 78–84 这个区间。HKR 三项都踩中了——用 GPT-5.5 砍掉 OCR 管道是个很具体的钩子,23,000+ 篇论文的规模也给了实感,对做文档处理和研究的人确实有用。但正文没披露成本、延迟和翻译质量对比,这点先别太激动,没法判断准确率和开销到底比 OCR 好多少。如果是真的省钱又省事,那对批量处理中文论文的场景挺有参考价值。

AI HOT 精选

OpenAI 秘密提交上市申请,奥特曼另一家公司 Tools for Humanity 因营收压力裁员

OpenAI 已秘密提交 IPO 申请,具体上市时间表和估值正文没披露。与此同时,奥特曼参与创办的 Tools for Humanity 正在裁员,原因是营收不行。这家公司估值 25 亿美元,主打项目叫 World,靠一个银色球形扫描仪采集虹膜来验证真人身份,顺带发自己的加密货币 Worldcoin。在美国,Tinder、Zoom 等公司跟它有合作,但...

推荐理由:我会先打个折:OpenAI 秘密交表这件事,正文没给任何上市细节,所以冲击力主要来自“它终于要上市了”这个信号本身。对 AI 从业者来说,这比一般科技公司 IPO 更敏感,因为 OpenAI 的估值和融资能力会重新定义整个基础模型赛道的资本门槛。同时,奥特曼另一家公司 Tools for Humanity 裁员的消息放在一起看,能看出他同时在烧钱搞硬件扫虹膜和发币,但营收跟不上,这种反差让整条新闻的决策参考价值更高。韩国罚单虽然金额不大,但点出了生物信息收集的合规风险,对做身份验证的团队是个提醒。综合来看,这条放在 p1 没问题,悬念、数字和行业影...

彭博科技

OpenAI 已秘密提交 IPO 申请

彭博一条视频片段说 OpenAI 已经秘密提交了上市申请,ChatGPT 背后的公司正在寻求公开市场融资。视频没披露估值、募资规模、交易所和上市时间表,正文因为 Bloomberg 的反爬机制也打不开,所以这些关键数字现在都看不到。

推荐理由:彭博放了一段视频说 OpenAI 秘密交了上市申请,但正文被反爬挡了,估值、融多少钱、在哪上市、什么时候上,这些关键数字现在全看不到。我会先打个折,给 95 而不是更高,就是因为信息缺口太大。不过消息源是彭博,可信度够,而且 OpenAI 真要上市的话,对整个 AI 行业的融资节奏和人才流动都是大事,所以还是放在最高一档。

AI HOT 精选

奥尔特曼说 OpenAI 进入第三阶段:把 AI 做成便宜、好用、安全的日常工具

OpenAI 的 CEO 奥尔特曼和首席科学家帕霍茨基发了一篇博客,把公司发展分成三个阶段:第一阶段搞技术研发,第二阶段把产品推向全球看用户怎么用,现在正式进入第三阶段。他们的目标是让先进 AI 变得供给充足、成本亲民、安全实用,让每个人和机构都能用上。具体提了三个方向:做能自动搞科研的 AI 研究员、加快经济增长、给全球每个人配一个专属的通用人工智能...

推荐理由:这篇是奥尔特曼和首席科学家联名的路线图博客,把公司发展切成三个阶段,现在正式进入“让 AI 普及、易用且安全”的第三阶段。我会先打个折:正文没给出任何模型发布时间、性能指标或成本数字,所以重要性到不了 85。但“第三阶段”这个提法本身是个清晰的叙事钩子,三个目标(自动科研、经济加速、个人 AGI)和成立国际机构的建议,把 OpenAI 接下来的发力方向摊开了。对从业者来说,这篇能帮你判断 OpenAI 会把资源往哪砸、安全治理的调子怎么定,值得一看。

TechCrunch · AI

OpenAI 冲刺 IPO 的同时,Sam Altman 另一家眼球扫描公司 Tools for Humanity 传出裁员

Tools for Humanity 是 Sam Altman 搞的身份验证公司,靠扫眼球来证明你是真人。现在被曝因为赚不到钱要裁员。报道没写裁多少人、营收规模和时间点,所以具体有多惨还不清楚。

推荐理由:OpenAI 的 IPO 是基础模型公司进公开市场的标志性事件,而 Tools for Humanity 裁员又给 Altman 的商业版图加了点紧张感。报道没写裁多少人、营收多少、IPO 时间表,信息有缺口,但主事件的分量还是撑得起 95 分这个区间。

FT · 科技

OpenAI 提交上市申请,估值可能超过一万亿美元

OpenAI 已经向美国证券交易委员会交了 IPO 文件,准备在华尔街挂牌。按目前流传的说法,上市后公司估值会超过一万亿美元。不过 FT 这篇报道的正文被付费墙和安全验证挡住了,具体发行规模、时间表、在哪家交易所上市这些关键信息都没披露。估值数字挺吓人,但没看到招股书细节之前,这个数先打个折看。

推荐理由:HKR 三项全中:一家基础模型公司提交 IPO 申请、估值喊到万亿美元以上,属于 95-100 分档的事件。因为发行规模、时间和交易所都没披露,所以定在 98 而不是 100。