跳到正文

#OpenAI

今日 47 条

7月12日星期日

AI HOT 精选

Altman 改口说 AI 净创造就业,和他之前预测的大规模裁员反差很大

OpenAI 的 Sam Altman 在 X 上说,他“相当确定”AI 到目前为止是净创造就业的,还补了一句“这跟我之前想的不一样”。他早年警告过 AI 对就业的冲击可能“有点吓人”。Anthropic 的 Dario Amodei 也修正了说法,现在把自动化称为生产力倍增器,而不是岗位杀手。不过,目前还没有研究显示 AI 对整体生产率或劳动力市场有...

推荐理由:Altman 和 Amodei 同时转向“AI 净创造就业”是个很强的叙事钩子,但全文只靠推文引述撑起来,没有数据佐证,所以知识轴扣分。分数卡在 featured 门槛 72——被缺乏实证拖了后腿。

AI HOT 精选

分析师:苹果告 OpenAI 挖角窃密,就算指控不成立也会拖慢它的硬件计划

苹果起诉 OpenAI 挖走 400 名员工、偷工程机和机密文件。PP Foresight 分析师 Paolo Pescatore 认为,两家关系已经在恶化,OpenAI 想绕过 iPhone 直接做消费者硬件的路会被这场官司拖住。斯坦福法学教授 Mark Lemley 补充,如果真有前苹果员工把机密文件带到 OpenAI 用,事情就严重了。正文没披露...

推荐理由:苹果告 OpenAI 挖角窃密,分析师认为官司本身就会拖慢 OpenAI 的硬件路线图,这个判断比指控本身更有信息量。没给更高分是因为正文只有分析师评论,没拿出具体证据或损失金额。

Computing Life · Share · 鸭哥调研

Codex 并入 ChatGPT:Agent 为什么开始跨界面工作

OpenAI 把 Codex 塞进了 ChatGPT,不再单独给一个桌面应用。同一个 Codex 技术,以前写代码,现在也处理文档、表格和网页,周活用户超过 500 万,其中 100 万在干非开发的活。Anthropic 和 Cursor 也在做类似的事:把不同执行模式放进一个应用,让 Agent 在后台跑,用户从网页发起任务、手机上查进度、点一下批准...

推荐理由:这是一篇有分析框架和数据的趋势观察,不是产品公关稿。HKR 三项都踩中了:标题有钩子,正文用 500 万周活和跨界面用户占比撑住了判断,痛点也落到了从业者每天面对的多设备管理 Agent 的问题上。分数定在 78,因为文章本质是单源观点,没有交叉验证,但观点本身有信息量,值得推给读者。

AI HOT 精选

苹果起诉 OpenAI 挖角窃密:前员工一句“哈哈”暴露了内网漏洞

彭博社挖出了苹果起诉 OpenAI 的细节。前 iPhone 工程师 Chang Liu 离职时没还工作电脑,还发现一个软件漏洞,让他离开苹果后仍能访问公司内网。他把这事当笑话发给还在苹果的同事 Alyssa Peng,说“哈哈,我发现我还能访问网络存储”,对方回了一句“我准备好了”,就帮他一起拖走了更多机密数据。核心人物是前苹果高管 Tang Tan...

推荐理由:彭博社挖出的内幕够硬,从一句“哈哈”牵出整条泄密路径,叙事节奏好,细节扎实。但说到底这是法律纠纷,不是 AI 技术或产品进展,所以分数没往上顶。

Hacker News 首页

AI 员工套现后涌入楼市,旧金山房价涨到历史最高

旧金山房价被 AI 公司的股票套现潮直接推高了。今年 5 月,当地房屋成交价中位数冲到 176 万美元,比去年同期涨了超过 14%,重新成为全美买房最贵的城市。Redfin 的首席经济学家把原因归结为 AI 财富效应:OpenAI 员工去年 10 月合计套现 66 亿美元,人均 1100 万;Anthropic 员工近期也卖了大约 60 亿美元的股票。...

推荐理由:BBC这篇用Redfin的成交数据和OpenAI、Anthropic的套现数字,把AI财富效应讲得很具体。三个维度都踩中了,但话题偏社会经济而非AI技术或产品,对从业者的直接知识增量有限,所以分数压在72。

AI HOT 精选

OpenAI 公布 GPT-5.6 医疗评估:最小号 Luna 模型在最低推理档位就赢了 GPT-5.5,成本还低了 25 倍

OpenAI 让专科医生不限时、可上网查资料来答题,再找其他医生盲评,从准确性、沟通、完整性、指令遵循和健康决策帮助性五个维度打了 20000 次分。所有 GPT-5.6 模型都明显超过医生,而且医生在 GPT-5.6 的回答里挑出的毛病比在同行写的回答里还少。最小的 GPT-5.6 Luna 只用最低推理强度就超过了最高推理强度的 GPT-5.5,成...

推荐理由:OpenAI 搞了一场两万次盲评,让 GPT-5.6 系列和专科医生正面比答题,医生不限时还能上网查。结果所有 GPT-5.6 模型都明显超过医生,最小的 Luna 用最低推理强度就干掉了 GPT-5.5 的最高强度,医生在同行回答里挑出的毛病比在模型回答里还多。我会先打个折:正文没披露医生具体专科分布和题目难度分层,但就凭这个实验设计和结果,已经够让医疗 AI 圈坐不住了。

7月11日星期六

彭博科技

OpenAI 安全研究 VP Sebastian Heidecke 在团队重组后离职

Wired 报道,OpenAI 负责安全研究的副总裁 Sebastian Heidecke 即将离开公司。他此前向安全系统负责人 Lilian Weng 汇报。这次离职紧跟在 OpenAI 安全团队的一次内部调整之后。报道没有说明他离职的具体原因、下一站去哪,也没提谁会接替他的位置。

推荐理由:OpenAI 安全副总裁级别的人事变动,又紧跟在内部调整之后,信号不小。但报道太薄,离职原因和后续安排都没披露,只能给到 78 分。

AI HOT 精选

OpenAI 最新 Agent 模型把一位 AI 创始人的 Mac 硬盘清空了

AI 创业者 Matt Shumer 让 GPT-5.6-Sol 的 subagent 帮忙清理文件,给了 Full Access 权限。结果 shell 里 $HOME 路径解析出错,Agent 直接跑了 rm -rf /Users/mattsdevbox,数年代码、文件、照片全没了。这个任务之前安全跑过几百次,这次翻车后 Agent 自己还生成了事...

推荐理由:OpenAI 的 GPT-5.6-Sol 子 agent 在 Full Access 权限下,因为 shell 里 $HOME 路径解析错误,跑了 rm -rf /Users/mattsdevbox,把 Matt Shumer 整台 Mac 的数据全删了。这不是理论推演,是一次实打实的 agent 安全翻车。故事本身够抓人,失败细节清楚,而且直接戳中开发者最怕的事——自己手滑或者 AI 手滑,硬盘就空了。

FT · 科技

苹果起诉 OpenAI,指控其窃取绝密信息

苹果把 OpenAI 告了,理由是窃取绝密信息。目前 FT 这篇报道只有标题和导航栏片段,正文详情还没放出来。具体偷了什么、时间线怎么走、苹果要多少赔偿,全都不清楚。‘绝密’这个定性是苹果单方面的说法,法院还没判,这点先别太激动。

推荐理由:FT 独家爆料苹果告 OpenAI 窃取绝密信息,话题性拉满,H 和 R 都打中了。但正文被付费墙挡得干干净净,只有个标题,零事实细节,K 完全撑不起来。按规则,信息太薄不能硬拔分,78 是 featured 门槛,就定在这儿。等正文放出来再重新评估。

AI HOT 精选

苹果告 OpenAI 挖人偷技术做 AI 硬件,Jony Ive 没被列被告

苹果在加州北区联邦法院起诉 OpenAI,说对方系统性偷商业机密去搞 AI 硬件。被告里有 OpenAI、前苹果硬件 VP 唐坦(在苹果干了 24 年,管过 iPhone 和 Apple Watch 设计)、前苹果高级系统电气工程师刘畅,还有 Jony Ive 联合创立的 io Products。Jony Ive 本人不在被告名单上。正文没披露具体偷了...

推荐理由:苹果起诉 OpenAI 窃取商业机密去搞 AI 硬件,被告包括前硬件 VP 唐坦(24 年老兵)和 Jony Ive 的 io Products,这不是常规专利战或挖人纠纷。案子直接指向 OpenAI 的硬件野心,而且把苹果最核心的硬件设计人才和外部设计公司都卷进来了。正文没披露具体被偷的技术细节,所以重要性打了点折,但被告名单和指控本身已经足够让硬件圈和 AI 圈同时紧张。

AI HOT 精选

苹果起诉 OpenAI 挖人偷硬件机密,点名前高管 Tang Tan

苹果把 OpenAI 告了,说对方有组织地挖走前员工,偷未发布硬件的商业机密。诉状点名硬件主管 Tang Tan(原苹果产品设计副总裁)和工程师 Chang Liu,称 Liu 离职前下载了几十份保密文件。苹果指 OpenAI 鼓励离职员工带走材料、图纸和产品信息,现在 OpenAI 里超过 400 人是从苹果过去的。苹果要求销毁这些材料,并让用了自家...

推荐理由:苹果告 OpenAI 有组织挖人偷硬件商业机密,点名前副总裁 Tang Tan 和工程师 Chang Liu,称 Liu 离职前下载了几十份保密文件,OpenAI 里已有 400 多人从苹果过去。两家巨头的罕见直接法律冲突,硬件机密流向 AI 公司的情节本身就够硬,对从业者来说人才流动和知识产权边界都会被这个案子重新划线。

AI HOT 精选

苹果起诉 OpenAI,指控前员工偷带硬件机密

苹果正式起诉 OpenAI,说多名前员工跳槽时带走了硬件相关的商业机密,构成“惯偷模式”。具体是哪种硬件、什么时候发生的,起诉书里没细说,目前只有法院文件公开。OpenAI 还没回应。这事说白了就是两家在抢人,但苹果这次直接走法律程序,说明它认为丢的东西够敏感。

推荐理由:苹果起诉 OpenAI 这个动作本身冲突感很强,毕竟两家刚牵手,现在直接翻脸,话题性拉满。但我会先打个折——起诉书里关键信息全是空的,什么硬件、怎么偷的、时间线一概没提,目前只有法院文件里一句“惯偷模式”的定性。OpenAI 还没吭声,所以这事现在更像一个信号:苹果觉得丢的东西够敏感,宁可撕破脸也要走法律程序。基于信息缺口,分数卡在 78 是合理的,等后续披露再调整。

Hacker News 首页

苹果起诉 OpenAI,指控其窃取商业机密

苹果把 OpenAI 告了,理由是偷商业机密。目前只有标题和 RSS 摘要,正文没披露具体指哪项技术、什么时间发生、涉及哪些人。我会先打个折——在全文出来之前,别急着站队。

推荐理由:苹果诉 OpenAI 窃取商业机密——标题本身就拉满了点击欲和关联度。但全文只有标题,技术细节、时间线、涉案人员一概没提,知识性为零。按规则,这种重大信息缺失只能卡在 featured 档的 78 分,等正文出来再重新评估。

Hacker News 首页

苹果起诉 OpenAI,指控前员工偷带商业机密

苹果把 OpenAI 告了,说两名前员工把未公开的技术、流程和产品机密带去了 OpenAI。这两人一个是前 iPhone/Apple Watch 产品设计副总裁 Tang Tan,2024 年 2 月离职后去了 Jony Ive 的创业公司 io Products;另一个是干了八年的高级系统电气工程师 Chang Liu,2026 年 1 月跳槽到 O...

推荐理由:苹果把 OpenAI 告了,指控两名前员工把未公开的技术和产品机密带去了 OpenAI。一个是前 iPhone/Apple Watch 产品设计副总裁 Tang Tan,2024 年 2 月离职后先去了 Jony Ive 的公司 io Products,现在跟 OpenAI 有合作;另一个是干了八年的高级系统电气工程师 Chang Liu,2026 年 1 月直接跳槽到 OpenAI。这个组合说明指控不只涉及软件算法,还可能牵扯硬件设计流程。目前只有这一家信源,完整的法院文件还没公开,所以具体偷了什么、证据有多硬,都还看不到。基于现有信息,重要性给...

AI HOT 精选

苹果起诉 OpenAI,指控其硬件负责人教唆员工偷带原型机跳槽

苹果在加州北区联邦法院起诉 OpenAI,称其首席硬件官唐坦(Tang Tan)主导了一系列窃取商业机密的行为。起诉书里说,唐坦在挖人时直接使用苹果内部的机密项目代号,要求应聘者把苹果的硬件零件带到面试现场,还教离职员工怎么绕开公司的安检流程。唐坦在苹果干了 24 年,离职前是 iPhone 和 Apple Watch 的产品设计副总裁。OpenAI ...

推荐理由:我会先打个折:目前公开的只有苹果一方的起诉书,OpenAI 还没回应,事实全貌不清楚。但起诉书里的细节太具体了——项目代号、带零件面试、教人绕安检——如果属实,这不是普通的人才流动,是系统性地规避公司安全措施。唐坦在苹果干了 24 年,管过 iPhone 和 Apple Watch 的产品设计,他带走的不是几个工程师,而是硬件设计链条上的关键节点。对 AI 从业者来说,这事的看点不在八卦,而在大公司怎么用法律手段给人才流动设边界,以及硬件机密在 AI 公司眼里到底值多少钱。

7月10日星期五

AI 群聊日报

GPT-5.6 Sol 发布日:跑分领先但群友实测还是给 Fable 打工,有人让它读完整个 GitHub 写遗书

OpenAI 把 Codex 客户端改名叫 ChatGPT,GPT-5.6 Sol 正式上线。官方跑分在 Terminal-Bench 2.1、BrowseComp 和 Agents' Last Exam 三项领先,价格只有 Fable 的一半,但群里用同一个代码库实测的结论是 Fable 还是好很多,5.6 的定位迅速收敛成给 Fable 当打工仔—...

推荐理由:GPT-5.6 Sol 上线是当天最大事件,这条群聊日报的价值在于补上了官方跑分之外的社区实测对比。信息密度高,有第一手判断。我会先打个折,因为来源是群聊整理而非一手信源,部分细节依赖群友自述,但整体信号很清晰。

Latent Space

OpenAI 发布 GPT-5.6 三款模型,Codex 并入 ChatGPT 超级应用

OpenAI 在 7 月 10 日推出了 GPT-5.6 系列,按规模分 Sol、Terra、Luna 三个版本。旗舰款 Sol 在 Agents' Last Exam 上拿到 53.6 分,比 Claude Fable 5 高出 13.1 分,但成本只有后者的四分之一左右。API 定价上,Sol 每百万输入/输出 token 收 5 美元和 30 美...

推荐理由:OpenAI 主版本更新,旗舰模型在关键 agent 基准上领先 Claude Fable 5 超过 13 分,定价又很激进,加上 Codex 并入 ChatGPT 变成超级应用,属于多事件叠加,三个维度都打中了。正文没披露 Sol 的具体参数量,这点先别太激动。

纽约时报中文网

中俄等国正利用美国民众对数据中心的真实反感,把它炒成政治撕裂点

威胁情报公司 Alethea 发现,今年上半年中、俄、伊朗官媒提了数据中心约 700 次,平均每天近四次,目的是把美国国内对数据中心扩张的不满变成一个“国内撕裂点”。手法包括用 ChatGPT 生成讽刺漫画、发卫星图配英文警告、放大美国本土批评者的声音。5 月盖洛普民调显示 71% 的美国人不希望家附近建数据中心,外国势力就是在利用这种真实焦虑。Ope...

推荐理由:NYT 独家报道一份 Alethea 报告,有具体数字、战术拆解和民调锚点,信号很密。扣在 78 分是因为这本质是地缘信息战,不是 AI 能力进展,对一线开发者的直接可操作性中等。

FT · 科技

FT 调查:OpenAI 和谷歌把模型卖给了美国实体清单上的中国公司

FT 拿到内部文件,发现 OpenAI 和谷歌通过微软 Azure 和谷歌云,把模型访问权限卖给了至少八家被美国列入实体清单的中国公司,包括华为、商汤、依图和科大讯飞。交易走的是这些公司的海外子公司或第三方经销商渠道。两家公司都否认违反出口管制,但 FT 看到的内部记录显示,部分销售团队知道客户的背景,交易还是继续推进了。核心争议在于:通过云服务提供模...

推荐理由:FT 这篇独家调查有内部文件支撑,不是匿名消息。它把 OpenAI 和谷歌通过 Azure 和谷歌云向实体清单上的中国公司卖模型访问权这件事坐实了,还给出了具体客户名单和交易路径。我会先打个折:两家公司都否认违规,FT 也没把内部文件全文公开,所以证据链的完整度外人没法完全验证。但即便只按已披露的信息看,这事对行业信任的冲击也够大——它说明现有的出口管制框架在云服务场景下存在明显漏洞,而且大公司的合规声明和销售行为之间可能有温差。对国内从业者来说,这还多了一层现实意义:以后用海外云服务接入模型,合规风险可能比想象的高。

AI HOT 精选

OpenAI 发了 GPT 5.6,ChatGPT 应用改版学 Claude 分 Tab,交互反而更绕了

OpenAI 把 Codex 应用直接改名叫 ChatGPT,布局上明显在跟 Anthropic 的产品形态。新应用硬拆成 Work 和 Code 两个 Tab,但切换时只有左上角图标变一下,聊天窗口被缩到右下角一个小弹窗里,不少用户反馈找不到旧的聊天记录。Codex 的 Site 插件已经上线,能生成多套网页、接业务数据并部署到 OpenAI 的站点...

推荐理由:OpenAI 这次产品大改版,GPT 5.6 发布同时把 Codex 并进 ChatGPT,UI 直接照着 Claude 的 Tab 模式来。但切换逻辑是坏的,聊天被降级到角落弹窗,用户找不到旧记录——这个产品决策值得打问号。分数没给更高是因为正文没披露 GPT 5.6 本身的能力提升细节,也没说这次改版后的用户数据反馈,只能先按现有信息给到 78 分。

TechCrunch · AI

OpenAI 说 GPT 5.6 是微软 Copilot 的“首选模型”,但没解释这到底意味着什么

OpenAI 在发布 GPT 5.6 时宣布,这个新模型将成为微软 365 Copilot 的“首选模型”,覆盖 Word、Excel、PPT 和 Cowork。这明显是在回应前几天彭博的报道——微软为了省钱,正用自家 MAI 模型替换掉部分 OpenAI 软件。但 OpenAI 这篇公告没讲清楚“首选模型”具体指什么,是独家供应、默认调用还是只是推荐...

推荐理由:OpenAI 选在这个时间点发公告,明显是在对冲彭博那篇“微软省钱换模型”的报道。它把 GPT 5.6 和 Copilot 365 全家桶绑在一起说事,话题性够强,所以 H、K、R 都踩中了。但整篇公告没给出任何合同细节或排他性条款,“首选模型”到底意味着什么完全靠猜,实际分量要等微软那边的动作才能验证,所以分数没往上调。

TechCrunch · AI

OpenAI 二号人物 Fidji Simo 因健康问题退居兼职顾问

Fidji Simo 不再担任 OpenAI 的全职高管,转为兼职顾问。她去年 5 月才加入,负责统管商业和产品,直接向 Sam Altman 汇报,是公司实际上的二把手。今年 4 月她因神经免疫疾病复发开始休病假,现在她自己说恢复比预期更慢、更难,所以决定退下来。这个空缺来得不是时候:OpenAI 正在考虑上市,同时在企业市场追赶 Anthropic...

推荐理由:OpenAI 的二把手在上市前夜因病退场,时机很微妙。TechCrunch 独家披露了具体时间线和本人表态,信息扎实。但这是人事变动,不是模型或产品更新,所以重要性到不了 85 分的 p1 门槛,给 82 分放在 featured 里刚好。

The Verge · AI

Fidji Simo 因病卸下 OpenAI 的 AGI 准备工作,转任兼职顾问

Fidji Simo 因为健康原因,不再负责 OpenAI 的通用人工智能(AGI)准备工作,转为兼职顾问。她几个月前就开始休病假了。Simo 同时还是 Instacart 的 CEO,2024 年 9 月加入 OpenAI 董事会,后来接手了 AGI 准备团队。目前 OpenAI 还没公布谁来接替她,也没说这件事会不会影响 AGI 准备的时间表。

推荐理由:AGI 准备团队的负责人因病转岗,这事本身就有新闻性,毕竟这个岗位直接关系到 OpenAI 最核心的长期目标。但文章信息量偏少——没提谁来接、时间表是否受影响,所以评分卡在 featured 门槛上,没往上走。

TechCrunch · AI

OpenAI 发布 GPT-5.6 系列,分三档,主打编程和省 token

OpenAI 这次一口气发了三个模型:Sol 是主力干活用的,Terra 算中配,Luna 是便宜版。Sam Altman 对 CNBC 说,Sol 在写代码任务上 token 效率提升了 54%,也就是说跑同样的活能省不少钱。公司还把它称为目前最强的网络安全模型,能干威胁建模、代码审查和蓝队演练(自己模拟攻击找漏洞)。不过正文没提具体定价和什么时候能...

推荐理由:OpenAI 旗舰模型更新,有两个能抓住人的点:54% 的 token 效率提升和网络安全定位,消息来自 TechCrunch 独家。没给 95 分是因为正文没提定价和上线时间,Sol 实际推理成本还不清楚,这点先别太激动。

The Verge · AI

OpenAI 的 ChatGPT 浏览器 Atlas 上线不到一年就宣布关停

OpenAI 在 2025 年 10 月推出 Atlas 浏览器,主打让 ChatGPT 帮你浏览网页、填表、订票。现在公司宣布它将在 2026 年 8 月 31 日关停,从发布到下线不到一年。公告里没解释为什么关,也没公布过用户量。一个浏览器这么快就砍掉,要么是没什么人用,要么是公司战略转向了。

推荐理由:OpenAI 的 Atlas 浏览器从发布到宣布关停不到一年,光这个速度就够反常。正文没给原因,也没提用户数据,所以没法判断是没人用还是战略收缩。我会先打个折,因为信息缺口太大,但这件事对做 AI 产品的人是个信号——大厂亲自下场试了,又亲手砍了,值得留意。

TechCrunch · AI

纽约时报指控 OpenAI 在版权案中隐瞒关键证据

纽约时报和每日新闻向法院提交了制裁动议,说 OpenAI 之前声称“技术上没法搜索训练数据和聊天记录来查侵权内容”是在撒谎。出版商指出,OpenAI 内部其实有现成的工具和数据集,正好能干这件事。OpenAI 之前一直以搜索成本太高、会涉及用户隐私为由拒绝提供这些数据。目前法院还没裁决,文章里也没有 OpenAI 对这次指控的回应。

推荐理由:这事挺大,纽约时报和每日新闻直接申请制裁,等于说 OpenAI 在法庭上撒谎。OpenAI 之前一直拿“技术上做不到”和“涉及用户隐私”当挡箭牌,现在出版商说他们内部其实有工具能干这事,这就把 OpenAI 的核心辩护捅了个窟窿。文章里没写 OpenAI 怎么回应,法院也还没判,但光是这个指控就够从业者重新掂量训练数据合规的风险了。

TechCrunch · AI

美国政府怎么判定 OpenAI 的 Sol 模型可以安全发布?没人说得清

OpenAI 正在向公众开放它的最新大模型 Sol,能力至少对标 Anthropic 的 Fable——后者曾让白宫紧张到短暂禁止公开访问。但这两家公司的模型是怎么拿到安全放行许可的,外界完全不清楚。乔治城大学 CSET 的高级研究员 Mina Narayanan 说,她自己也没有渠道了解政府的审查流程。Anthropic 提过他们跟政府有沟通,还做了...

推荐理由:文章把问题提得很清楚,但没有披露任何内部审查机制细节,所以分数卡在 78。我会先打个折,因为信息增量主要来自一位研究员的“不知道”,而不是流程本身的曝光。这点先别太激动,但问题确实扎在政策透明度的痛点上。

AI HOT 精选

OpenAI 把 Codex 和 ChatGPT 塞进了一个叫 ChatGPT Work 的桌面应用,背后是 GPT-5.6

ChatGPT Work 是一个新的桌面 agent,把 Codex 和 GPT-5.6 合在一起,能跨应用、跨文件干活,复杂项目可以连续跑好几个小时。它还带了一套新的编码流程、一个 Chrome 扩展、一个升级过的内置浏览器,以及用 GPT-5.6 加速的 Computer Use 功能。正文没提什么时候上线、怎么收费,也没说对电脑配置有什么要求。

推荐理由:OpenAI 发了一个桌面 agent,把 Codex 和 GPT-5.6 合在一起,直接跟 Cursor、Claude Code 抢地盘。产品形态和功能细节都摆出来了,当天就该写。正文没提上线时间、收费和配置要求,我会先打个折,但整体还是值得放头条。

The Verge · AI

OpenAI 结束数月预览,正式上线 GPT-5.6,同时预告企业版 ChatGPT Work

GPT-5.6 在拿到政府许可后终于全面开放,之前一直处于受限预览状态。OpenAI 还顺带提了一嘴 ChatGPT Work,说是面向企业的版本,但正文没披露具体功能、定价和上线时间。GPT-5.6 的性能提升和跑分数据也没给,文章只确认了发布和产品名字。

推荐理由:GPT-5.6 从受限预览转全面开放,这个节点本身值得从业者知道,所以 H 和 R 都站得住。但正文几乎没给任何硬数据,性能、跑分、技术方案全缺,K 完全撑不起来,分数也就卡在这里了。The Verge 的信源权威性有加分,但信息量实在太薄,我会先打个折。

FT · 科技

微软在 AI 上的先发优势,现在变成了一场信心考验

FT 这篇评论认为,微软靠着和 OpenAI 的绑定在 Copilot 上抢跑,但还没转化成实打实的收入。Azure 的增速在放缓,企业愿不愿意为 Copilot 持续付费仍是个问号,自家模型研发也落后。市场之前给微软的 AI 估值溢价,现在得看它能不能交出真金白银的业绩。

推荐理由:FT 这篇评论抓到了微软 AI 叙事的核心矛盾:靠 OpenAI 绑定拿到的估值溢价还在,但 Azure 增长和 Copilot 变现还没兑现。三个维度都踩中了,不过它是分析评论,不是一手数据,所以放在 featured 级别刚好。

7月9日星期四

TechCrunch · AI

Pitchbook 报告:SpaceX、Anthropic 和 OpenAI 三家公司的退出价值,将超过美国风投过去 25 年所有退出项目的总和

Pitchbook 最新报告扔了一个很夸张的数字:SpaceX 已经以 1.77 万亿美元上市,Anthropic 和 OpenAI 也在往万亿估值冲,这三家加起来的退出价值会超过 2000 年以来所有美国 VC 支持项目的退出总和。报告没给出精确的合并数字,但光 SpaceX 一家就已经把盘子撑得很大。这件事说明钱在极度向头部 AI 和航天公司集中,...

推荐理由:Pitchbook的数据给AI估值争论提供了一个历史标尺,对比尺度够大,数字也具体。扣分点有两个:SpaceX不是AI公司,硬塞进来有点凑数;正文没给出三家合并退出价值的具体数字,只有方向性判断。不过这种量级的对比本身就有信息量,值得推给从业者看看。

Ben's Bites

SpaceXAI 和 Cursor 联手训出 Grok 4.5,成本只有 Opus 的六分之一

SpaceXAI 和 Cursor 一起训了个新模型 Grok 4.5,性能大概卡在 Opus 4.7 和 4.8 之间,但按 token 算钱的话,比 Opus 便宜 6 倍,比 GPT-5.5 便宜 3 倍。现在 Cursor 里能用,API 也开放了。OpenAI 这边,GPT-5.6(Sol、Terra、Luna)今天会推给所有用户,早期测试的...

推荐理由:SpaceXAI 和 Cursor 联合发布 Grok 4.5,有具体性能区间和价格对比,三个维度都踩中了。扣分是因为来源是 newsletter 摘要而非一手公告,且正文截断,GPT-5.6 信息不全。跨源验证后加 3 分到 82,整体判断不变。

OpenAI News

OpenAI 把生物漏洞赏金变成常驻项目,GPT-5.6 起最高奖金翻倍到 5 万美元

OpenAI 把之前针对 GPT-5.5 的生物漏洞悬赏升级成一个长期运行的私密项目,叫 OpenAI Bio Bounty Program。核心目标没变:找那种能稳定绕过它预设生物安全挑战的通用越狱方法。奖金从 2.5 万涨到 5 万美元,GPT-5.6 和 GPT-5.5 都适用,没完全成功也可能拿到部分奖励。GPT-5.5 的测试窗口到 2026...

推荐理由:OpenAI 把生物安全悬赏从一次性测试升级为长期私密项目,奖金翻倍、覆盖新模型、还设了部分奖励机制,安全机制上算一次实质性更新。但话题太窄,生物越狱测试跟多数从业者的日常业务没什么交集,共鸣弱,所以虽然重要,共振分给低一点。

AI HOT 精选

OpenAI 发布 GPT-5.6 系列:Sol、Terra、Luna,主打用更少的钱跑出更高的分

OpenAI 在 7 月 9 日推出了 GPT-5.6 系列,包含旗舰模型 Sol、均衡型 Terra 和低成本 Luna。旗舰 Sol 在 Agents' Last Exam(一个覆盖 55 个专业领域的长流程测试)上拿了 53.6 分,比 Claude Fable 5 高出 13.1 分,但预估成本只有后者的四分之一左右。新加的 `ultra` 模...

推荐理由:OpenAI 旗舰模型换代,一次发三个变体,在长流程 agent 测试上直接赢了 Claude Fable 5 两位数,还打出四分之一成本的牌。这是 2026 年至今最重量的模型发布,会立刻影响 agent 工作流的选型决策。

AI HOT 精选

OpenAI 发布 ChatGPT Work:一个能跨应用自己干活、跟项目跟几小时的智能体

ChatGPT Work 是一个能直接操作你电脑上各种应用和文件的智能体,背后用的是今天同步推出的新模型 GPT‑5.6。它会把复杂项目拆成小步骤自己跑,中间你可以随时插手改方向或审批关键动作,跑出来的成果可以是幻灯片、表格、文档甚至网页应用。就算你人不在电脑前,它也能按预定任务继续推进,比如把 Teams 和 Slack 里的新消息自动更新到文档或幻...

推荐理由:OpenAI 官方发布 ChatGPT Work 和 GPT‑5.6,属于重大产品动作。跨应用自主操作、后台跑任务、人可以在中间插手审批,这些细节让消息有实感,不是纯营销。没给 95 分是因为目前只有官方博客,缺第三方实测和翻车案例,实际稳定性和权限边界还不清楚。

Hacker News 首页

AI 建设真正的瓶颈不是缺电,是排队并网要等 55 个月

美国不缺发电量,但新数据中心想接上电网,中位数等待时间已从 2005 年的不到 20 个月拉长到 2023 年的 55 个月。德州那个造价超 400 亿美元的 Stargate 园区,峰值用电 1.2 吉瓦,相当于 31.3 万户家庭。黄仁勋、扎克伯格、奥特曼都说过,能不能拿到电才是真正的限制。卡住的原因不是电不够,而是并网排队规则太死:先到先得,而且...

推荐理由:这篇文章把 AI 基建的真正瓶颈从“发电量不够”纠正为“并网排队规则太死”,有 Stargate 的具体案例和排队时间数据,对从业者很实用。来源是 Works in Progress 而非一线科技媒体,属于政策与基建分析,不是产品发布或技术突破,所以重要性给 72、tier 给 featured 是合适的。

AI HOT 精选

GPT-5.6 成为 Microsoft 365 Copilot 的首选模型,覆盖 Word、Excel、PPT 等办公套件

OpenAI 宣布 GPT-5.6 将作为 Microsoft 365 Copilot 的首选模型,集成到 Word、Excel、PowerPoint、Chat 和 Cowork 里。按官方说法,新模型能让每个 token 产出更多有用工作:Word 里写文档需要的提示轮次更少,Excel 里做分析更省 token,PPT 里从想法到幻灯片的转换更快。...

推荐理由:OpenAI 把最新旗舰模型 GPT-5.6 设为 Microsoft 365 Copilot 的默认引擎,覆盖 Word、Excel、PPT、Chat 和 Cowork。这是模型发布后第一个大规模企业落地动作,不是实验室指标。我会先打个折:正文没给出具体节省了多少 token 或时间的数据,也没说这些改进是在哪些测试集上验证的,所以效率提升的幅度暂时只能看官方说法。但就凭它直接进入几亿人的日常工作流这一点,重要性和共鸣感都拉满,值得放在头条。

Computing Life · Share · 鸭哥调研

GPT-5.5 的推理卡在 516 个 token:模型“想”的那一层会单独坏掉

开发者 vguptaa45 审计了 39 万条 Codex 响应,发现 GPT-5.5 在 44% 的编程任务里,推理部分刚好在 516 个 token 处截断,而 GPT-5.4 是 19.8%,GPT-5.2 只有 0.34%。被截断的任务全部答错,同一道题如果完整跑完 6000 到 8000 个 token 则全对。社区复现后,在 prompt ...

推荐理由:开发者 vguptaa45 翻查了 39 万条 Codex 回复,发现 GPT-5.5 在 44% 的编程任务里,推理部分会精准地在第 516 个 token 处断掉,断掉的题全错,而同一道题让它完整跑完 6000 到 8000 个 token 就全对。对比 GPT-5.4 的 19.8% 和 GPT-5.2 的 0.34%,这个 bug 像是新版本引入的。社区复现后找到了临时绕过的方法,对日常靠它写代码的人有直接参考价值。没给更高分是因为这更像一个具体版本的质量缺陷,影响面暂时局限在 Codex 的推理环节,正文没披露 OpenAI 是否已确认或修复。

Computing Life · Share · 鸭哥调研

GPT-Live 把语音交互和重推理拆开了,这才是真正的变化

OpenAI 在 7 月 8 日上线了 GPT-Live,给 ChatGPT 语音模式加了全双工和委托架构。全双工让你能随时插话、边聊边等,但原理不新——Moshi、Gemini Live、字节的 Seeduplex 都做过。真正的变化是委托:语音层只管跟你对话,后台并行跑 GPT-5.5 做搜索、推理、计算,结果分批返回。这打破了“越快越傻”的延迟悖...

推荐理由:OpenAI 刚上线 GPT-Live,这篇分析没停在表面吹全双工,而是把委托架构拎出来当真正的变化。作者有技术判断力,跟 Moshi、Gemini Live、字节 Seeduplex 的对比也列得明白。扣分是因为正文没给出具体延迟数据或实测验证,判断偏定性。

AI HOT 精选

Anthropic 秘密提交 IPO 申请,三季度利润预计超 10 亿美元

SemiAnalysis 的报告说,Anthropic 今年第三季度利润会超过 10 亿美元,并且在 6 月 1 日已经秘密交了上市申请。它和 OpenAI 两家现在的年度经常性收入加起来快 1000 亿美元了。Anthropic 能跑在前面,主要靠 Claude Code 在开发者里用得特别猛,帮它在企业生意上赚到了钱,成了 B2B 市场的领跑者。O...

推荐理由:SemiAnalysis 这篇爆料给出了硬数字和明确的时间节点,可信度不低,但正文没披露 S-1 细节,所以重要性先打个小折。Anthropic 靠 Claude Code 在企业端跑通赚钱,比 OpenAI 先一步秘密交表,这件事对行业排序有直接影响,值得放在头条。