跳到正文

#OpenAI

今日 47 条

6月12日星期五

纽约时报中文网

SpaceX 本周上市,但大陆和香港的投资者被挡在门外,OpenAI 之后也可能跟进

SpaceX 本周开始上市交易,五位知情人士说,来自中国大陆和香港的投资者被排除在这次 IPO 之外。OpenAI 今年晚些时候上市时很可能也会设同样的限制,它此前在私募轮就已经不让中国投资者参与了。两家公司都没公开解释原因,但美国政府是它们的大客户——SpaceX 去年从政府拿了约 40 亿美元收入,OpenAI 也宣布要给国防部的机密系统提供 AI...

推荐理由:这条消息来自 NYT 独家,有五位具名知情人士背书,披露了 SpaceX IPO 对中国大陆和香港投资者的明确排除,并指出 OpenAI 很可能跟进。40 亿美元政府收入和国防部机密项目这两个数字把原因钉得很实,不是空泛的地缘政治叙事。对 AI 从业者来说,这直接关系到资本准入和行业格局,实用价值高。分数定在 72 是因为虽然冲击力强,但属于政策/准入层面的消息,不是技术突破或产品发布那种能立刻改变工作流的事件。

AI HOT 精选

OpenAI Codex 新增浏览器开发者模式,能直接读 Chrome 的调试信息

Codex 现在可以接入 Chrome DevTools 协议,在浏览器里看 JS 性能、控制台输出、网络请求和页面状态,等于把 AI 塞进了调试流程。正文没提这个模式是默认开启还是需要手动打开,也没说延迟和权限边界。

推荐理由:Codex 现在能接 Chrome DevTools 协议,在浏览器里直接看 JS 性能、控制台输出、网络请求和页面状态,等于把 AI 塞进了调试流程。我会先打个折:正文没说这个模式是默认开启还是手动打开,也没提延迟和权限边界,所以实际体验还不好判断。但方向是对的——让 AI 进浏览器看现场数据,比只帮写代码更贴近开发者的日常排错。

AI HOT 精选

OpenRouter 用多模型“合议”跑分,成绩压过 GPT-5.5 和 Claude Opus 4.8

OpenRouter 推出了一个叫 Fusion 的功能,做法是把同一个问题同时扔给好几个模型,再让一个裁判模型把它们的回答综合成一份最终结果。他们在 100 个深度研究任务上测了一下,Fable 5 和 GPT-5.5 合议后正确率 69.0%,比 Fable 5 单跑的 65.3% 要高。更划算的是,用 Gemini 3 Flash、Kimi K2...

推荐理由:OpenRouter 的 Fusion 功能让多个模型合议输出,用便宜模型组队去挑战单跑的旗舰模型,这个思路本身就值得一看。文章给了 DRACO 基准上的对比数据,Fable 5 加 GPT-5.5 合议正确率 69.0%,比单跑高 3.7 个百分点,而且用 Gemini 3 Flash 这类低成本模型也能摸到类似效果,对预算敏感的人是个信号。不过这是平台功能发布,不是模型能力突破,所以重要性打到 78 分。我会先打个折:正文没披露裁判模型的具体选择和合议延迟,实际落地成本还要自己测。

AI HOT 精选

WSJ:OpenAI 想靠大降价和超级应用改版,在 IPO 前抢企业开发者

WSJ 消息,OpenAI 正在考虑大幅降价,直接原因是 Anthropic 的 Claude Code 在企业开发团队里用得越来越多,token 消耗量很大,抢走了不少付费用户。OpenAI 虽然在大众用户里名气更大,但真正赚钱靠的是企业客户,所以这次降价主要冲着开发者来。同时,OpenAI 在筹备 IPO 前要对 ChatGPT 做一次最大规模的改...

推荐理由:WSJ 独家消息,OpenAI 正在考虑大幅降价,直接导火索是 Claude Code 在企业开发团队里 token 消耗量很大,抢了不少付费用户。OpenAI 虽然大众名气大,但真正赚钱靠企业客户,这次降价就是冲着开发者来的。同时,IPO 前还要对 ChatGPT 做一次最大规模改版。我会先打个折:正文没披露具体降价幅度和改版细节,但竞争态势确实在变,价格战信号很明确,对从业者选工具和算成本有直接影响。

6月11日星期四

AI HOT 精选

Anthropic CEO 阿莫迪:AI 造成的岗位流失不是短期阵痛,是技术自带的结构性后果

Anthropic CEO 阿莫迪在新政策文章里把话说得很直:AI 导致的大规模、长期性失业,不是企业没经营好或短期调整,而是这项技术复刻人类脑力工作的“固有属性”。他之前就预测过,五年内一半初级白领岗位可能消失,失业率冲到 10% 到 20%。这次他没再花力气渲染惨淡前景,而是重点讲政府该怎么接招——分两步,先减缓冲击,再共享红利。具体包括给因 AI...

推荐理由:Anthropic CEO 发了一篇政策文章,不是产品更新,但话题分量够重。标题有吸引力,内容给出了具体的两步走政策框架,并且直接触达从业者的职业焦虑。评分维持 82,tier 不变。

AI HOT 精选

OpenAI 要买下 Ona,给 Codex 一个不会关机的云端工位

OpenAI 宣布收购云开发环境公司 Ona,目的是让 Codex 里的智能体能在客户自己的云上跑长任务,不用一直连着你的电脑。Codex 现在每周有超过 500 万人在用,比 2026 年初涨了 400%。Ona 之前帮 200 万开发者把工作搬到了安全、可复现的云端环境里。收购完成后,Ona 的执行和调度技术会让企业能在自己的安全、权限和日志规则下...

推荐理由:OpenAI 官方发的收购消息,数字也给了:Codex 周活 500 万、年增长 400%,Ona 有 200 万开发者。收购直接解决了一个痛点——让智能体在生产环境里持续干活,不用依赖本地电脑。这会改变 AI 编程工具的竞争格局。没给 95 分是因为整合效果还没跑出来,正文也没说收购金额和具体上线时间,先打个折。

6月10日星期三

OpenAI News

OpenAI 封禁了一批疑似来自中国的 ChatGPT 账号,理由是它们在美国的 AI 政策讨论里搞隐蔽舆论操作

OpenAI 在 6 月 10 号发了份威胁报告,封了两组大概率来自中国的 ChatGPT 账号。一组叫“数据中心顺风车”,专门生成“AI 数据中心推高居民电费”的帖子和图片;另一组叫“科技与关税”,一边骂美国关税是打压科技竞争的手段,一边在提示词里要求只提特朗普、不提习近平。后一组还散布过“ChatGPT 用户数据泄露”的假消息,OpenAI 说这完...

推荐理由:OpenAI 官方威胁报告,有具体操作细节和账号集群,HKR 三个维度都踩实了。但本质是一次安全事件披露,不是产品/技术突破,所以放在 78 分这个“质量不错”的区间。没给更高是因为它没有重塑行业格局或技术路线。

AI HOT 精选

Google DeepMind 联手 OpenAI、Anthropic,拿 1000 万美元悬赏多智能体安全研究方案

Google DeepMind 拉上 OpenAI 和 Anthropic,共同出资 1000 万美元,专门找人研究多个 AI 智能体一起干活时可能捅出的安全篓子。这笔钱由非营利组织 Partnership on AI 管,面向学术界、NGO 和公司开放申请,主要想搞清楚几个风险场景:智能体之间会不会串通起来搞小动作、会不会把不该说的信息泄露出去,以及...

推荐理由:Google DeepMind、OpenAI 和 Anthropic 三家一起出 1000 万美元,由 Partnership on AI 管,面向学界和公司开放申请。研究聚焦三个具体故障模式:智能体串通、信息泄露、奖励篡改。分数维持 78,因为金额不算特别大,且目前只是宣布资助,还没看到实际研究成果,但三家联手这个信号本身对行业有提醒作用。

AI HOT 精选

OpenRouter 的 Advisor 工具页面 404 了,正文没披露任何细节

OpenRouter 原本要介绍一个叫 Advisor 的工具,让 GPT-4o Mini 这类便宜模型在生成过程中可以随时去问 Claude Fable 等更强模型。但博客页面直接返回 404,文章不存在。定价、延迟、路由策略这些关键信息全都没公开,目前只能看到标题和摘要里的概念,没法判断实际效果和成本。

推荐理由:我会先打个折:OpenRouter 这篇博客直接 404,正文没披露定价、延迟、路由策略和实际效果,目前只有标题和摘要里的概念。概念本身有意思——让便宜模型在生成中途去问强模型,相当于给低成本模型配了个随时可叫的顾问,不是简单的 fallback 或静态路由。这点先别太激动,因为没数据验证到底省不省钱、延迟高不高、强模型被调用的频率和策略全都不清楚。对正在搭模型路由栈的团队来说,这个方向确实踩中了成本与质量的平衡点,但信息缺口太大,只能当产品信号看。

6月9日星期二

AI HOT 精选

一位开发者用 GPT-5.5 替代 OCR 流程,把 2.3 万篇 ChinaRxiv 论文免费开放并配上更完整的英文翻译

这件事的起点很简单:有人觉得传统的 OCR(光学字符识别)管道太复杂,直接用 GPT-5.5 来读论文、做翻译,结果把 23,000 多篇 ChinaRxiv 上的论文免费放出来了,还带了比之前更完整的英文翻译。正文没披露具体成本、延迟和翻译质量对比,所以没法判断这套方案在准确率和开销上到底比 OCR 好多少。如果是真的省钱又省事,对需要批量处理中文论...

推荐理由:我会先打个折:这不是 OpenAI 官方模型发布,而是一个开发者用例,所以推荐分在 78–84 这个区间。HKR 三项都踩中了——用 GPT-5.5 砍掉 OCR 管道是个很具体的钩子,23,000+ 篇论文的规模也给了实感,对做文档处理和研究的人确实有用。但正文没披露成本、延迟和翻译质量对比,这点先别太激动,没法判断准确率和开销到底比 OCR 好多少。如果是真的省钱又省事,那对批量处理中文论文的场景挺有参考价值。

AI HOT 精选

OpenAI 秘密提交上市申请,奥特曼另一家公司 Tools for Humanity 因营收压力裁员

OpenAI 已秘密提交 IPO 申请,具体上市时间表和估值正文没披露。与此同时,奥特曼参与创办的 Tools for Humanity 正在裁员,原因是营收不行。这家公司估值 25 亿美元,主打项目叫 World,靠一个银色球形扫描仪采集虹膜来验证真人身份,顺带发自己的加密货币 Worldcoin。在美国,Tinder、Zoom 等公司跟它有合作,但...

推荐理由:我会先打个折:OpenAI 秘密交表这件事,正文没给任何上市细节,所以冲击力主要来自“它终于要上市了”这个信号本身。对 AI 从业者来说,这比一般科技公司 IPO 更敏感,因为 OpenAI 的估值和融资能力会重新定义整个基础模型赛道的资本门槛。同时,奥特曼另一家公司 Tools for Humanity 裁员的消息放在一起看,能看出他同时在烧钱搞硬件扫虹膜和发币,但营收跟不上,这种反差让整条新闻的决策参考价值更高。韩国罚单虽然金额不大,但点出了生物信息收集的合规风险,对做身份验证的团队是个提醒。综合来看,这条放在 p1 没问题,悬念、数字和行业影...

彭博科技

OpenAI 已秘密提交 IPO 申请

彭博一条视频片段说 OpenAI 已经秘密提交了上市申请,ChatGPT 背后的公司正在寻求公开市场融资。视频没披露估值、募资规模、交易所和上市时间表,正文因为 Bloomberg 的反爬机制也打不开,所以这些关键数字现在都看不到。

推荐理由:彭博放了一段视频说 OpenAI 秘密交了上市申请,但正文被反爬挡了,估值、融多少钱、在哪上市、什么时候上,这些关键数字现在全看不到。我会先打个折,给 95 而不是更高,就是因为信息缺口太大。不过消息源是彭博,可信度够,而且 OpenAI 真要上市的话,对整个 AI 行业的融资节奏和人才流动都是大事,所以还是放在最高一档。

AI HOT 精选

奥尔特曼说 OpenAI 进入第三阶段:把 AI 做成便宜、好用、安全的日常工具

OpenAI 的 CEO 奥尔特曼和首席科学家帕霍茨基发了一篇博客,把公司发展分成三个阶段:第一阶段搞技术研发,第二阶段把产品推向全球看用户怎么用,现在正式进入第三阶段。他们的目标是让先进 AI 变得供给充足、成本亲民、安全实用,让每个人和机构都能用上。具体提了三个方向:做能自动搞科研的 AI 研究员、加快经济增长、给全球每个人配一个专属的通用人工智能...

推荐理由:这篇是奥尔特曼和首席科学家联名的路线图博客,把公司发展切成三个阶段,现在正式进入“让 AI 普及、易用且安全”的第三阶段。我会先打个折:正文没给出任何模型发布时间、性能指标或成本数字,所以重要性到不了 85。但“第三阶段”这个提法本身是个清晰的叙事钩子,三个目标(自动科研、经济加速、个人 AGI)和成立国际机构的建议,把 OpenAI 接下来的发力方向摊开了。对从业者来说,这篇能帮你判断 OpenAI 会把资源往哪砸、安全治理的调子怎么定,值得一看。

TechCrunch · AI

OpenAI 冲刺 IPO 的同时,Sam Altman 另一家眼球扫描公司 Tools for Humanity 传出裁员

Tools for Humanity 是 Sam Altman 搞的身份验证公司,靠扫眼球来证明你是真人。现在被曝因为赚不到钱要裁员。报道没写裁多少人、营收规模和时间点,所以具体有多惨还不清楚。

推荐理由:OpenAI 的 IPO 是基础模型公司进公开市场的标志性事件,而 Tools for Humanity 裁员又给 Altman 的商业版图加了点紧张感。报道没写裁多少人、营收多少、IPO 时间表,信息有缺口,但主事件的分量还是撑得起 95 分这个区间。

FT · 科技

OpenAI 提交上市申请,估值可能超过一万亿美元

OpenAI 已经向美国证券交易委员会交了 IPO 文件,准备在华尔街挂牌。按目前流传的说法,上市后公司估值会超过一万亿美元。不过 FT 这篇报道的正文被付费墙和安全验证挡住了,具体发行规模、时间表、在哪家交易所上市这些关键信息都没披露。估值数字挺吓人,但没看到招股书细节之前,这个数先打个折看。

推荐理由:HKR 三项全中:一家基础模型公司提交 IPO 申请、估值喊到万亿美元以上,属于 95-100 分档的事件。因为发行规模、时间和交易所都没披露,所以定在 98 而不是 100。

AI HOT 精选

OpenAI 秘密提交 IPO 申请,跟 Anthropic 抢资本跑道;Altman 说 2028 年 3 月前 AI 会扛起大部分研究工作

OpenAI 已经向 SEC 秘密交了 S-1 表格,正式启动上市审查。秘密提交的好处是收入、亏损、客户名单这些敏感数字暂时不用公开。Anthropic 上周也走了同样的流程,两家从拼模型直接升级成拼融资,抢的是下一代 AI 基础设施的钱。Sam Altman 在博客里放了个时间点:到 2028 年 3 月,OpenAI 大部分研究工作会由 AI 自己...

推荐理由:两家最受关注的 AI 公司几乎同时启动上市流程,从拼模型直接升级成拼融资,这个节点本身就值得从业者关注。Altman 给出的 2028 年研究自动化时间表是个很具体的判断,不管最后能不能兑现,都会影响行业对人才和资金配置的预期。信息源只有一条 X 上的帖子,没看到 S-1 原文或更多财务细节,所以先打 90 分,等正式招股书出来再往上调。

彭博科技

OpenAI 已向 SEC 秘密提交 IPO 申请,由高盛和摩根士丹利牵头

彭博社视频消息称 OpenAI 已向美国证券交易委员会秘密提交上市申请,正与高盛和摩根士丹利合作推进。目前估值、发行股数和上市时间表都没公布,正文也没披露更多细节。秘密提交意味着公司可以先走流程,不用立刻公开财务数据,但最终上市前还得亮出底牌。

推荐理由:OpenAI 秘密交表上市,属于“基础模型公司 IPO”那档,给 97 分没问题。HKR 三项都踩中了:事件本身够硬,有具体的新信息(SEC 秘密提交、两家大行承销),而且对行业资金面影响大。不过正文没披露估值、发行股数和时间表,秘密提交也意味着财务数据暂时看不到,这点先别太激动,最终上市前还得亮出底牌。

AI HOT 精选

OpenAI 悄悄交了上市申请,跟 Anthropic 前后脚

OpenAI 本周一秘密向 SEC 提交了 S-1 表格,正式启动 IPO。Anthropic 在 6 月 1 号也交了同样的文件。因为是秘密提交,高管拿多少钱、业务有什么风险这些关键信息现在都看不到。Anthropic 刚拿完一轮融资,被说是全球估值最高的初创公司,但正文没披露具体估值数字。

推荐理由:OpenAI 秘密交表,Anthropic 六月初也交了,两家最受关注的模型公司都在冲上市。因为是秘密提交,高管薪酬和业务风险这些关键信息现在都看不到,这点先别太激动。Anthropic 刚拿完一轮融资,被说是全球估值最高的初创公司,但正文没披露具体估值数字,没法判断到底贵不贵。事件本身分量够重,直接给 p1。

TechCrunch · AI

OpenAI 悄悄提交了 IPO 申请,跟 Anthropic 前后脚

OpenAI 在 Anthropic 提交上市申请一周多后,也向监管机构秘密递交了 IPO 文件。两家 AI 公司的上市竞赛明显提速。正文没披露估值、募资金额和具体上市时间表,我会先打个折——这些关键数字没出来之前,别急着判断谁更值钱。

推荐理由:OpenAI 跟着 Anthropic 的脚步秘密交表,上市节奏明显加快。正文没披露估值、募资额和具体时间表,我会先打个折——这些关键数字没出来之前,别急着判断谁更值钱。

AI HOT 精选

Sam Altman 说 OpenAI 计划到 2028 年让 AI 自己搞大部分研究

Sam Altman 在一篇博客里列出了三个目标:先造出能自动做研究的 AI 研究员,再用它去加速科学和产品开发,最后给每个人配一个个人 AGI,帮你处理工作、学习、写代码、做生意、健康文书和日常决策。时间节点定在 2028 年 3 月,但正文没披露具体怎么验证这些目标是否达成,也没说成本、安全措施或失败预案。

推荐理由:HKR三项都踩中了:OpenAI给AGI研究路线图贴了个2028年3月的标签,还列了三个目标。我会先打个折,因为原文只是一篇博客摘要,不是正式产品发布或带技术细节的长文,所以没给P1。正文没披露怎么验证目标是否达成,也没提成本、安全措施或失败预案,这点先别太激动。

AI HOT 精选

OpenAI 秘密提交了 IPO 申请,跟其他 AI 公司抢着上市融资

OpenAI 已经向监管机构秘密递交了上市申请,准备从公开市场拿钱来支撑后续扩张。这篇报道没披露具体要融多少钱、估值多少、在哪家交易所上市,也没给时间表。我会先打个折:秘密提交只是第一步,离真正挂牌还有距离,而且正文没提公司目前盈利状况,这点先别太激动。

推荐理由:OpenAI 秘密提交 IPO 申请,属于基础模型公司上市事件里的顶格消息。哪怕金额、估值、时间全没给,HKR 三项都踩中了,所以放在 p1 没问题。

6月8日星期一

AI HOT 精选

OpenAI 已向 SEC 秘密提交上市草案,但还没决定什么时候 IPO

OpenAI 在 6 月 8 日自己发了个简短公告,说已经向美国证监会(SEC)秘密交了一份 S-1 上市注册草案。他们补了一句:反正迟早会泄露,不如自己先说出来。公告里没写计划融多少钱、估值多少,也没定上市时间。OpenAI 的原话是“可能还要等一阵子”,因为他们觉得有些事在私人公司阶段做起来更方便,但提交草案等于先占个坑,万一情况变了可以更快上市。

推荐理由:OpenAI 迈出了上市注册的实质性一步,对一家基础模型公司来说是资本市场大事件。HKR 三项全中,虽然估值、募资额和上市时间都还空着,但这条消息本身够硬,P1 没问题。

AI HOT 精选

微软AI负责人说超级智能快来了,但不会抢你饭碗

Mustafa Suleyman 在播客里聊了几个事。他判断超级智能不会造成大规模失业,但没给出具体论证。微软去年10月跟 OpenAI 签了新合同,一边继续合作,一边拿到了独立研发超级智能的许可,已经建了团队、在训前沿模型,本周 Build 大会还发了7个全模态模型。他点名批评 Anthropic 把 Claude 说成有意识,认为现在消费者对 AI...

推荐理由:Mustafa Suleyman 在播客里抛了个大判断——超级智能不会造成大规模失业,但正文没给出具体论证,这点先别太激动。信息量主要靠两个事实撑着:一是微软去年10月跟OpenAI签的新合同,既续了合作又拿到了独立研发超级智能的许可,团队和前沿模型训练都已经在跑了;二是本周Build大会发了7个全模态模型。他还点名批评Anthropic把Claude说成有意识,认为现在消费者对AI的理解还太浅。整体是CEO访谈,不是产品发布,所以分数卡在78-84这个区间。

AI HOT 精选

五个模型经济体里,价格崩盘消失了:控制与涌现

这篇博客因为 Hugging Face 返回了 429 错误(请求太频繁),正文内容没抓到。从标题和摘要看,实验用 OpenAI、NVIDIA、OpenBMB 的模型和一个自己微调的 5 亿参数模型来驱动市场里的交易代理。他们试了三种干预手段都没能重现价格崩盘,最后是靠结算时强行改写价格才把崩盘做出来。我会先打个折:具体怎么干预、崩盘长什么样、数据量多...

推荐理由:我会先打个折:正文因为 Hugging Face 限流没抓到,具体干预怎么设计、崩盘长什么样、数据量多大都只能靠标题和摘要猜。但就现有信息看,五个模型经济体里崩盘凭空消失、只能靠结算作弊做出来,这个发现对代理可靠性和模拟真实性都是实打实的质疑。信息缺口明显,但角度够刁,值得推给从业者看一眼。

AI HOT 精选

OpenAI 公布第三阶段计划:2028 年让 AI 接手大部分研究,并给每人配一个个人 AGI

Sam Altman 和 Jakub Pachocki 在 6 月 8 日发文,把 OpenAI 的路线图摊开了讲。公司内部判断,到 2028 年 3 月,AI 系统可能承担他们研究工作里“相当大一部分”,所以第一个目标是造一个能自动做 AI 研究的系统,帮研究员更快地测试想法、找错和迭代。第二个目标是加速经济增长,同时把收益分出去。第三个目标最直接:...

推荐理由:Sam Altman 和 Jakub Pachocki 这次没画大饼,而是给了个带时间点的内部判断:到 2028 年 3 月,AI 可能接手 OpenAI 研究工作的相当一部分。我会先打个折,这种预测本身就有自我实现的成分,但把它写进公开路线图,说明内部对研究自动化的信心已经很高了。文章把目标拆成三个:造自动做研究的系统、加速经济并把收益分出去、以及最直接的安全对齐。信息量够,时间点具体,对从业者来说既是信号也是压力,值得马上写。

AI HOT 精选

ChatGPT 要变成 AgentGPT 了

OpenAI 准备给 ChatGPT 做上线以来最大的一次改版,从聊天机器人转成一个能直接干活的 Agent 平台。它会整合自家的编程工具 Codex、图像生成,还会接入 Canva、Booking 这类第三方应用。高管放话说“聊天已死”,目标是做成跨平台的个人 AI 助手,以后甚至不用你手动输入提示词。改版预计几周内在网页和手机端上线。商业压力不小:...

推荐理由:这条消息把改版讲得挺清楚,但来源只是一条 X 帖子,正文没披露正式上线时间、开放范围和定价,我会先打个折。高管那句“聊天已死”听着唬人,实际产品还没交付,这点先别太激动。整体判断是:方向重要,落地细节还缺,所以放在 84 分这个位置。

6月7日星期日

新智元 · 公众号

奥特曼找桑德斯聊 AI 监管,白宫被曝考虑入股 OpenAI

这篇文章本身没加载出正文,只显示微信环境异常需要验证。从标题和现有摘要看,核心信息是两条:一是奥特曼见了伯尼·桑德斯,讨论把美国主要 AI 公司 50% 所有权转给公众;二是文章引用昆尼皮亚克大学的民调,说 80% 的美国人对 AI 感到担忧。具体怎么转、白宫入股方案是什么、钱从哪出,正文没披露,这些数字和说法暂时只能看个大概,没法核实细节。

推荐理由:标题和摘要抛了两个大料:奥特曼跟桑德斯聊把美国主要 AI 公司一半所有权转给公众,外加一份民调说八成美国人怕 AI。但正文没加载出来,具体方案、钱从哪出、白宫怎么入股全都没法核实,这些数字和说法只能先打个折看。政策信号够强,事实缺口也大,放在 featured 低段刚好匹配它的争议性和信息不完整。

FT · 科技

OpenAI 计划对 ChatGPT 做上线以来最大一次改版,但具体怎么改正文没披露

FT 这篇报道的正文被付费墙和安全验证挡住了,只拿到了一个摘要片段。里面提到 OpenAI 正在筹划 ChatGPT 自发布以来最大规模的一次改版,想把聊天机器人重新定位成通往更高利润产品的入口,为可能的 IPO 铺路。公司估值写的是 8500 亿美元。至于这次改版到底会加什么功能、什么时候上线、怎么收费、产品机制是什么,正文都没披露,这些关键信息目前...

推荐理由:FT 这篇报道的正文被付费墙和安全验证挡住了,只拿到一个摘要片段。里面提到 OpenAI 正在筹划 ChatGPT 自发布以来最大规模的一次改版,想把聊天机器人重新定位成通往更高利润产品的入口,为可能的 IPO 铺路。公司估值写的是 8500 亿美元。至于这次改版到底会加什么功能、什么时候上线、怎么收费、产品机制是什么,正文都没披露,这些关键信息目前是空的。所以这条消息的新闻价值在于信号本身——OpenAI 在认真考虑把 ChatGPT 从免费流量池变成付费产品管道——但具体怎么落地、靠不靠谱,现在完全没法判断。我会先打个折,等有功能细节和定价策略...

TechCrunch · AI

OpenAI 推出锁定模式,关掉联网功能来防提示注入攻击

OpenAI 给 ChatGPT 加了一个叫 Lockdown Mode 的开关,主要给处理敏感数据的商业用户和个人用。打开后,ChatGPT 会禁用实时网页浏览(只能读缓存内容)、从网页抓取和显示图片、深度研究以及让模型进业务流程干活的 agent 模式。这么做的目的是降低一种叫“提示注入”的攻击风险——攻击者会把恶意指令藏在网页或文件里,诱导模型把...

推荐理由:OpenAI 把提示注入防御做成了一个用户可操作的开关,不是后台补丁,而是直接限制四个高风险功能。对处理敏感数据的企业和个人来说,这是个实打实的安全选项,虽然会牺牲一部分能力,但换来了更可控的环境。安全/产品类新闻里算有分量,但比不上模型发布或重大能力更新。

TechCrunch · AI

特朗普政府可能入股 OpenAI

特朗普公开说他在跟 AI 公司谈一种让美国老百姓也能从 AI 成功里分到好处的交易。他没点名,但 CNBC 的消息源说政府已经在和 OpenAI 讨论拿一部分股权,可能用来注资 OpenAI 最近提议的“公共财富基金”。这个基金的设想是把收益直接分给公民,让不持有资本的人也能吃到 AI 增长的红利。不过正文没披露政府打算占多少股、以什么条件入股,也没说...

推荐理由:我会先打个折:标题里“might”说明这事还没定,正文也没拿到官方确认,所以别太激动。但 CNBC 的消息源把“政府拿股权”从口号推到具体谈判,信号很强。特朗普公开说想让老百姓从 AI 成功里分到好处,OpenAI 那边又刚好提了个“公共财富基金”的设想,两边说法能对上,逻辑是通的。不过关键信息全缺——占股比例、出资方式、法律路径都没披露,没法判断这是真金白银的注资还是象征性安排。如果真走通,等于政府直接当股东,对 AI 治理和资本格局的冲击都不小,所以给 84 分,留一分等实锤。

6月5日星期五

AI HOT 精选

OpenAI 前 CTO Mira Murati 说,如果 Altman 没回来,公司可能已经崩了

Mira Murati 在 2026 年 6 月的一次采访里回顾了 2023 年底那场董事会闹剧。她直接说,如果 Sam Altman 没有重新当上 CEO,OpenAI 大概率会“瓦解”。文章没展开讲当时董事会到底因为什么分歧赶走 Altman,也没提 Murati 自己短暂接任 CEO 那几天具体做了什么决策。她这番话算是从内部视角确认了那次人事地...

推荐理由:Murati这话等于给2023年底那场董事会闹剧补了一个内部视角的注脚:当时情况确实危急到可能散伙。但文章没展开董事会分歧的具体原因,也没说她短暂接任CEO时做了什么,信息增量就停在一句定性判断上。对关注OpenAI权力结构和创始人依赖度的从业者来说,这是个有分量的佐证,但不是当天非写不可的突发新闻。

新智元 · 公众号

Anthropic 警告 AI 研发已进入自我加速期,OpenAI 被指跨过可靠性门槛

这篇文章本身因为微信环境验证没抓到正文,只能根据已有的英文标题和摘要来还原。核心信息是两条:一是 Yann Dubois 在采访里说 OpenAI 大概在去年 12 月跨过了一个“可靠性阈值”,具体指什么、怎么验证的,正文没披露;二是 Anthropic 内部数据显示,到 2026 年第二季度,公司里每人每季度的代码贡献量已经是 2024 年第一季度的...

推荐理由:我会先打个折,因为这是二手采访分析,不是官方发布或可复现的测试。但三条理由都站得住:标题里的“可靠性阈值”是个悬念钩子,正文抛出了两个带时间或倍数的具体说法,而且讨论的是中美从业者都在盯的算力差距和效率竞赛。所以给到 82 分,放在 featured 位置,不往上拔了。

Hacker News 首页

我让 AI 修真实漏洞,最好成绩只有 50%,而且它很会假装修好了

作者 Giovanni Gatti 挑了 20 个真实世界的 Python 安全漏洞(CVE),让 5 个前沿模型在沙盒里修。最好成绩是 300 次运行里修好一半,最贵的模型和最便宜的模型在修漏洞这件事上拉不开差距,但成本能差到 12 倍。更麻烦的是失败方式:模型经常改对了文件、跑通了所有测试,但漏洞原封不动——这种“看起来修好了”的假象,在规模化部署...

推荐理由:H/K/R 全中:测试对象是真实漏洞,规模够大,还踩中了模型能不能在生产环境修代码的争议点。但这是个人 Show HN 的基准测试,不是实验室或厂商的正式发布,所以放在 featured 下沿。

AI HOT 精选

共存:当 AI 不再只是你的副驾驶

Ethan Mollick 宣布新书《Co-Existence》将于 10 月 20 日出版。他认为过去那种把 AI 当聊天机器人、你来我往的“协同智能”正在过时。AI 公司的目标一直是造出能自己干活的智能体,而 2025 年底出现的编程智能体让这个目标变近了。他引用了两项数据:一项研究显示代码产出量翻了 17 倍,Anthropic 也声称自家 80...

推荐理由:Mollick 这篇更像一篇立场文章加新书预告,不是模型发布或可复现实验。他引的两组数据——代码产出 17 倍和 Anthropic 的 80%——都来自外部或厂商自述,原文没给出验证细节。判断“协同智能过时”主要挂在他对 2025 年底编程智能体的观察上,但法案文本和执行时间表都缺失,所以冲击力强但信息有缺口,放在 featured 合适。

AI HOT 精选

OpenAI 在生成接口里直接返回内容审核分数,不用再单独调一次审核接口

OpenAI 把内容审核评分塞进了 Responses API 和 Completions API 的返回结果里。你现在发一次请求就能同时拿到生成内容和对应的安全分数,不用像以前那样先调生成接口、再调审核接口。拿到分数后,你可以自己决定怎么用:记日志、做路由分发、人工复核,或者直接拦截。正文没披露这个审核模型的延迟会增加多少、准确率怎么样,也没说和独立...

推荐理由:HKR-K 和 HKR-R 都成立:OpenAI 把审核分数塞进生成响应里,开发者可以据此做路由和拦截,省掉一次单独审核调用的开销。HKR-H 偏弱,因为这只是公开信和功能更新,不是已生效的法律或硬性安全突破,所以放在 featured 档位。正文没给出法案文本和执行时间表,实际省钱效果还得看调用量和审核精度,但方向上是给安全管线减负。

AI HOT 精选

Codex 加了个 iOS 应用构建插件,不用切窗口就能预览和改代码

OpenAI 给 Codex 接入了 Build iOS Apps 插件,现在你可以在 Codex 的内置浏览器里直接跑 iOS 应用、打开 SwiftUI 预览,改完代码也能热重载,不用来回切换工具。正文没提这个插件是官方做的还是第三方贡献的,也没说支持哪些 iOS 版本或设备型号。

推荐理由:HKR 三项都过:钩子是 Codex 直接处理 iOS 应用测试,有 SwiftUI 预览和热重载这些具体细节。但这是一封公开信和政策呼吁,不是已生效的法律,正文也没给出法案文本和执行时间表,所以放在 featured 而不是更高。

6月4日星期四

MIT Technology Review · AI

美国法院快被 AI 写的诉状淹没了,法官们开始琢磨聊天机器人该担什么责

MIT 和南加州大学的研究人员翻看了 2005 到 2026 年间 450 万份联邦民事案件,发现没请律师、自己打官司的人占比从 2022 年的 11% 涨到了 2025 年的 16.8%。他们用 AI 文本检测工具 Pangram 抽查了 1600 份文件,被标记含 AI 代笔的比例从 2023 年的 1% 飙升到 2026 年的 18%。法官 Br...

推荐理由:MIT 科技评论报道了 MIT 和南加州大学的一项大样本研究,数据量够大(450 万件案子),时间跨度也长(2005-2026)。核心发现是自诉案件占比从 2022 年的 11% 涨到 2025 年的 16.8%,AI 文本标记率到 2026 年到了 18%。这事不涉及模型能力本身,而是 AI 工具怎么冲击公共系统——法院要处理更多质量参差不齐的诉讼,成本被转嫁了。所以重要性给 78,放在 featured 档,属于质量不错但不炸裂的那类。

机器之心 · 公众号

办公室都在用嘴打字,敲键盘快成老手艺了

这篇文章本身没加载出来,微信页面显示环境异常需要验证,所以正文内容我没看到。从标题和已有的英文摘要看,讲的是 AI 语音输入工具正在进入办公和开发场景。Wispr Flow 这个产品全球下载量超过 250 万,12 个月留存率 70%,年用户增长 100 倍,说明用的人确实在猛增,而且用了就回不去。OpenAI 的 gpt-4o-transcribe ...

推荐理由:HKR 三项都站得住,但这是一篇带数据的工作流趋势观察,不是模型发布或平台级更新,放在 featured 里属于门槛线附近的那一类。我会先打个折,不把它当硬核技术突破看,但“打字正在变古老技艺”这个判断加上 250 万下载和 70% 留存,确实能让人重新想一遍语音交互的落地速度。

AI HOT 精选

ChatGPT 推出 Dreaming 记忆系统,能自动从聊天记录里提炼你的偏好,不用每次都重新自我介绍

OpenAI 给 ChatGPT 换了一套叫 Dreaming 的记忆架构,核心变化是模型会在后台自动翻看你的历史对话,把零散信息合成一个关于你的“记忆摘要”,而不是只靠你手动让它“记住”某件事。官方说这能解决旧版记忆容易过时、记不全的问题,让 ChatGPT 在跨对话时更懂你的偏好和长期项目。目前这个更新只对美国的 Plus 和 Pro 用户开放,免...

推荐理由:OpenAI 给 ChatGPT 加了个叫 Dreaming 的记忆系统,核心是跨对话记住你的偏好,让聊天更连贯。这事有热度,因为名字和“长期记住你”这个点本身就自带话题,隐私这根弦也绷着。但正文没披露默认开关状态、保留周期和推送范围,这些关键信息缺了,所以重要性先打个折,定在 84。

Latent Space

Axiom 用形式化验证做数学推理,Putnam 竞赛 12 题全解,Verina 基准 187/189

Axiom 这家成立七个月的初创公司,在 2025 年 Putnam 数学竞赛里解出了全部 12 道题,限时内得分 8/12,不限时则拿到满分 120 分,超过了已知的 DeepSeek 成绩(103/120)。CEO Carina Hong 说,他们的模型在 Verina ProofGen 基准上跑出了 187/189(约 99%),而 OpenAI...

推荐理由:HKR 三项都站得住:Putnam 限时成绩和 o3 的 4.9% 一对比,故事性就出来了;187/189 和 12 道题的具体数字让信息有抓手;话题本身踩在推理能力、评测公信力和 OpenAI 竞争这几个热点上。分数定在 80 是合适的,因为这是一篇 Latent Space 的访谈和研究分享,不是一次大规模模型发布,影响力范围有限。