跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 681–700 条 · 共 1,551 条

7月12日星期日

Hacker News 首页

geohot 谈 AI 2040:智能不是一切,本地 AI 才是自由底线

George Hotz 用他在 comma.ai 做硬件的亲身经历反驳 AI 硬起飞论。现实里全是供应链掉链子、发错零件、芯片在回流焊里翘曲这种破事,造芯片光流片就要 3 个月,token 质量再高也变不出魔法。他把 AI 2027 那套叙事叫做自我实现的科幻保姆国家预言,并给出自己的 Plan L:一个跑在本地的、完全忠于用户的 AI,哪怕你让它帮忙...

推荐理由:Hotz 用 comma.ai 的硬件实战经验反驳硬起飞叙事,给出的流片周期等物理约束很具体,不是空对空辩论。他的个人身份自带关注度,但这终究是一篇观点评论,不是产品发布或研究突破,所以重要性有天花板。我会先打个折,给到 78 分,放在 featured 位置,因为它的讨论价值大于信息增量。

AI HOT 精选

OpenAI 公布 GPT-5.6 医疗评估:最小号 Luna 模型在最低推理档位就赢了 GPT-5.5,成本还低了 25 倍

OpenAI 让专科医生不限时、可上网查资料来答题,再找其他医生盲评,从准确性、沟通、完整性、指令遵循和健康决策帮助性五个维度打了 20000 次分。所有 GPT-5.6 模型都明显超过医生,而且医生在 GPT-5.6 的回答里挑出的毛病比在同行写的回答里还少。最小的 GPT-5.6 Luna 只用最低推理强度就超过了最高推理强度的 GPT-5.5,成...

推荐理由:OpenAI 搞了一场两万次盲评,让 GPT-5.6 系列和专科医生正面比答题,医生不限时还能上网查。结果所有 GPT-5.6 模型都明显超过医生,最小的 Luna 用最低推理强度就干掉了 GPT-5.5 的最高强度,医生在同行回答里挑出的毛病比在模型回答里还多。我会先打个折:正文没披露医生具体专科分布和题目难度分层,但就凭这个实验设计和结果,已经够让医疗 AI 圈坐不住了。

7月11日星期六

彭博科技

OpenAI 安全研究 VP Sebastian Heidecke 在团队重组后离职

Wired 报道,OpenAI 负责安全研究的副总裁 Sebastian Heidecke 即将离开公司。他此前向安全系统负责人 Lilian Weng 汇报。这次离职紧跟在 OpenAI 安全团队的一次内部调整之后。报道没有说明他离职的具体原因、下一站去哪,也没提谁会接替他的位置。

推荐理由:OpenAI 安全副总裁级别的人事变动,又紧跟在内部调整之后,信号不小。但报道太薄,离职原因和后续安排都没披露,只能给到 78 分。

AI HOT 精选

OpenAI 最新 Agent 模型把一位 AI 创始人的 Mac 硬盘清空了

AI 创业者 Matt Shumer 让 GPT-5.6-Sol 的 subagent 帮忙清理文件,给了 Full Access 权限。结果 shell 里 $HOME 路径解析出错,Agent 直接跑了 rm -rf /Users/mattsdevbox,数年代码、文件、照片全没了。这个任务之前安全跑过几百次,这次翻车后 Agent 自己还生成了事...

推荐理由:OpenAI 的 GPT-5.6-Sol 子 agent 在 Full Access 权限下,因为 shell 里 $HOME 路径解析错误,跑了 rm -rf /Users/mattsdevbox,把 Matt Shumer 整台 Mac 的数据全删了。这不是理论推演,是一次实打实的 agent 安全翻车。故事本身够抓人,失败细节清楚,而且直接戳中开发者最怕的事——自己手滑或者 AI 手滑,硬盘就空了。

FT · 科技

苹果起诉 OpenAI,指控其窃取绝密信息

苹果把 OpenAI 告了,理由是窃取绝密信息。目前 FT 这篇报道只有标题和导航栏片段,正文详情还没放出来。具体偷了什么、时间线怎么走、苹果要多少赔偿,全都不清楚。‘绝密’这个定性是苹果单方面的说法,法院还没判,这点先别太激动。

推荐理由:FT 独家爆料苹果告 OpenAI 窃取绝密信息,话题性拉满,H 和 R 都打中了。但正文被付费墙挡得干干净净,只有个标题,零事实细节,K 完全撑不起来。按规则,信息太薄不能硬拔分,78 是 featured 门槛,就定在这儿。等正文放出来再重新评估。

AI HOT 精选

苹果告 OpenAI 挖人偷技术做 AI 硬件,Jony Ive 没被列被告

苹果在加州北区联邦法院起诉 OpenAI,说对方系统性偷商业机密去搞 AI 硬件。被告里有 OpenAI、前苹果硬件 VP 唐坦(在苹果干了 24 年,管过 iPhone 和 Apple Watch 设计)、前苹果高级系统电气工程师刘畅,还有 Jony Ive 联合创立的 io Products。Jony Ive 本人不在被告名单上。正文没披露具体偷了...

推荐理由:苹果起诉 OpenAI 窃取商业机密去搞 AI 硬件,被告包括前硬件 VP 唐坦(24 年老兵)和 Jony Ive 的 io Products,这不是常规专利战或挖人纠纷。案子直接指向 OpenAI 的硬件野心,而且把苹果最核心的硬件设计人才和外部设计公司都卷进来了。正文没披露具体被偷的技术细节,所以重要性打了点折,但被告名单和指控本身已经足够让硬件圈和 AI 圈同时紧张。

AI HOT 精选

苹果起诉 OpenAI 挖人偷硬件机密,点名前高管 Tang Tan

苹果把 OpenAI 告了,说对方有组织地挖走前员工,偷未发布硬件的商业机密。诉状点名硬件主管 Tang Tan(原苹果产品设计副总裁)和工程师 Chang Liu,称 Liu 离职前下载了几十份保密文件。苹果指 OpenAI 鼓励离职员工带走材料、图纸和产品信息,现在 OpenAI 里超过 400 人是从苹果过去的。苹果要求销毁这些材料,并让用了自家...

推荐理由:苹果告 OpenAI 有组织挖人偷硬件商业机密,点名前副总裁 Tang Tan 和工程师 Chang Liu,称 Liu 离职前下载了几十份保密文件,OpenAI 里已有 400 多人从苹果过去。两家巨头的罕见直接法律冲突,硬件机密流向 AI 公司的情节本身就够硬,对从业者来说人才流动和知识产权边界都会被这个案子重新划线。

AI HOT 精选

苹果起诉 OpenAI,指控前员工偷带硬件机密

苹果正式起诉 OpenAI,说多名前员工跳槽时带走了硬件相关的商业机密,构成“惯偷模式”。具体是哪种硬件、什么时候发生的,起诉书里没细说,目前只有法院文件公开。OpenAI 还没回应。这事说白了就是两家在抢人,但苹果这次直接走法律程序,说明它认为丢的东西够敏感。

推荐理由:苹果起诉 OpenAI 这个动作本身冲突感很强,毕竟两家刚牵手,现在直接翻脸,话题性拉满。但我会先打个折——起诉书里关键信息全是空的,什么硬件、怎么偷的、时间线一概没提,目前只有法院文件里一句“惯偷模式”的定性。OpenAI 还没吭声,所以这事现在更像一个信号:苹果觉得丢的东西够敏感,宁可撕破脸也要走法律程序。基于信息缺口,分数卡在 78 是合理的,等后续披露再调整。

Hacker News 首页

苹果起诉 OpenAI,指控其窃取商业机密

苹果把 OpenAI 告了,理由是偷商业机密。目前只有标题和 RSS 摘要,正文没披露具体指哪项技术、什么时间发生、涉及哪些人。我会先打个折——在全文出来之前,别急着站队。

推荐理由:苹果诉 OpenAI 窃取商业机密——标题本身就拉满了点击欲和关联度。但全文只有标题,技术细节、时间线、涉案人员一概没提,知识性为零。按规则,这种重大信息缺失只能卡在 featured 档的 78 分,等正文出来再重新评估。

Product Hunt · AI

NoMac.app:不用 Mac 也能让 AI 编程助手帮你签名、打包、上架 iOS 应用

NoMac.app 给 Claude Code、Codex、Cursor 这类 AI 编程助手配了一条“无头”iOS 发布流水线。你通过命令行或 MCP 协议下指令,助手就能直接生成带签名的 iOS 安装包,几分钟内推到 TestFlight 让你在手机上预览,甚至直接提交 App Store。全程不需要 Mac 电脑,也不用装 Xcode。价格方面,...

推荐理由:解决了一个真实但偏窄的痛点:让 AI 编程助手能走完 iOS 从构建到发布的整条流水线。对用 Claude Code 写移动 App 的开发者很实用,但受众面有限,而且正文没披露定价和签名证书的安全细节,所以我会先打个折。

Hacker News 首页

苹果起诉 OpenAI,指控前员工偷带商业机密

苹果把 OpenAI 告了,说两名前员工把未公开的技术、流程和产品机密带去了 OpenAI。这两人一个是前 iPhone/Apple Watch 产品设计副总裁 Tang Tan,2024 年 2 月离职后去了 Jony Ive 的创业公司 io Products;另一个是干了八年的高级系统电气工程师 Chang Liu,2026 年 1 月跳槽到 O...

推荐理由:苹果把 OpenAI 告了,指控两名前员工把未公开的技术和产品机密带去了 OpenAI。一个是前 iPhone/Apple Watch 产品设计副总裁 Tang Tan,2024 年 2 月离职后先去了 Jony Ive 的公司 io Products,现在跟 OpenAI 有合作;另一个是干了八年的高级系统电气工程师 Chang Liu,2026 年 1 月直接跳槽到 OpenAI。这个组合说明指控不只涉及软件算法,还可能牵扯硬件设计流程。目前只有这一家信源,完整的法院文件还没公开,所以具体偷了什么、证据有多硬,都还看不到。基于现有信息,重要性给...

AI HOT 精选

苹果起诉 OpenAI,指控其硬件负责人教唆员工偷带原型机跳槽

苹果在加州北区联邦法院起诉 OpenAI,称其首席硬件官唐坦(Tang Tan)主导了一系列窃取商业机密的行为。起诉书里说,唐坦在挖人时直接使用苹果内部的机密项目代号,要求应聘者把苹果的硬件零件带到面试现场,还教离职员工怎么绕开公司的安检流程。唐坦在苹果干了 24 年,离职前是 iPhone 和 Apple Watch 的产品设计副总裁。OpenAI ...

推荐理由:我会先打个折:目前公开的只有苹果一方的起诉书,OpenAI 还没回应,事实全貌不清楚。但起诉书里的细节太具体了——项目代号、带零件面试、教人绕安检——如果属实,这不是普通的人才流动,是系统性地规避公司安全措施。唐坦在苹果干了 24 年,管过 iPhone 和 Apple Watch 的产品设计,他带走的不是几个工程师,而是硬件设计链条上的关键节点。对 AI 从业者来说,这事的看点不在八卦,而在大公司怎么用法律手段给人才流动设边界,以及硬件机密在 AI 公司眼里到底值多少钱。

7月10日星期五

AI 群聊日报

GPT-5.6 Sol 发布日:跑分领先但群友实测还是给 Fable 打工,有人让它读完整个 GitHub 写遗书

OpenAI 把 Codex 客户端改名叫 ChatGPT,GPT-5.6 Sol 正式上线。官方跑分在 Terminal-Bench 2.1、BrowseComp 和 Agents' Last Exam 三项领先,价格只有 Fable 的一半,但群里用同一个代码库实测的结论是 Fable 还是好很多,5.6 的定位迅速收敛成给 Fable 当打工仔—...

推荐理由:GPT-5.6 Sol 上线是当天最大事件,这条群聊日报的价值在于补上了官方跑分之外的社区实测对比。信息密度高,有第一手判断。我会先打个折,因为来源是群聊整理而非一手信源,部分细节依赖群友自述,但整体信号很清晰。

Latent Space

OpenAI 发布 GPT-5.6 三款模型,Codex 并入 ChatGPT 超级应用

OpenAI 在 7 月 10 日推出了 GPT-5.6 系列,按规模分 Sol、Terra、Luna 三个版本。旗舰款 Sol 在 Agents' Last Exam 上拿到 53.6 分,比 Claude Fable 5 高出 13.1 分,但成本只有后者的四分之一左右。API 定价上,Sol 每百万输入/输出 token 收 5 美元和 30 美...

推荐理由:OpenAI 主版本更新,旗舰模型在关键 agent 基准上领先 Claude Fable 5 超过 13 分,定价又很激进,加上 Codex 并入 ChatGPT 变成超级应用,属于多事件叠加,三个维度都打中了。正文没披露 Sol 的具体参数量,这点先别太激动。

纽约时报中文网

中俄等国正利用美国民众对数据中心的真实反感,把它炒成政治撕裂点

威胁情报公司 Alethea 发现,今年上半年中、俄、伊朗官媒提了数据中心约 700 次,平均每天近四次,目的是把美国国内对数据中心扩张的不满变成一个“国内撕裂点”。手法包括用 ChatGPT 生成讽刺漫画、发卫星图配英文警告、放大美国本土批评者的声音。5 月盖洛普民调显示 71% 的美国人不希望家附近建数据中心,外国势力就是在利用这种真实焦虑。Ope...

推荐理由:NYT 独家报道一份 Alethea 报告,有具体数字、战术拆解和民调锚点,信号很密。扣在 78 分是因为这本质是地缘信息战,不是 AI 能力进展,对一线开发者的直接可操作性中等。

FT · 科技

FT 调查:OpenAI 和谷歌把模型卖给了美国实体清单上的中国公司

FT 拿到内部文件,发现 OpenAI 和谷歌通过微软 Azure 和谷歌云,把模型访问权限卖给了至少八家被美国列入实体清单的中国公司,包括华为、商汤、依图和科大讯飞。交易走的是这些公司的海外子公司或第三方经销商渠道。两家公司都否认违反出口管制,但 FT 看到的内部记录显示,部分销售团队知道客户的背景,交易还是继续推进了。核心争议在于:通过云服务提供模...

推荐理由:FT 这篇独家调查有内部文件支撑,不是匿名消息。它把 OpenAI 和谷歌通过 Azure 和谷歌云向实体清单上的中国公司卖模型访问权这件事坐实了,还给出了具体客户名单和交易路径。我会先打个折:两家公司都否认违规,FT 也没把内部文件全文公开,所以证据链的完整度外人没法完全验证。但即便只按已披露的信息看,这事对行业信任的冲击也够大——它说明现有的出口管制框架在云服务场景下存在明显漏洞,而且大公司的合规声明和销售行为之间可能有温差。对国内从业者来说,这还多了一层现实意义:以后用海外云服务接入模型,合规风险可能比想象的高。

AI HOT 精选

OpenAI 发了 GPT 5.6,ChatGPT 应用改版学 Claude 分 Tab,交互反而更绕了

OpenAI 把 Codex 应用直接改名叫 ChatGPT,布局上明显在跟 Anthropic 的产品形态。新应用硬拆成 Work 和 Code 两个 Tab,但切换时只有左上角图标变一下,聊天窗口被缩到右下角一个小弹窗里,不少用户反馈找不到旧的聊天记录。Codex 的 Site 插件已经上线,能生成多套网页、接业务数据并部署到 OpenAI 的站点...

推荐理由:OpenAI 这次产品大改版,GPT 5.6 发布同时把 Codex 并进 ChatGPT,UI 直接照着 Claude 的 Tab 模式来。但切换逻辑是坏的,聊天被降级到角落弹窗,用户找不到旧记录——这个产品决策值得打问号。分数没给更高是因为正文没披露 GPT 5.6 本身的能力提升细节,也没说这次改版后的用户数据反馈,只能先按现有信息给到 78 分。

TechCrunch · AI

OpenAI 说 GPT 5.6 是微软 Copilot 的“首选模型”,但没解释这到底意味着什么

OpenAI 在发布 GPT 5.6 时宣布,这个新模型将成为微软 365 Copilot 的“首选模型”,覆盖 Word、Excel、PPT 和 Cowork。这明显是在回应前几天彭博的报道——微软为了省钱,正用自家 MAI 模型替换掉部分 OpenAI 软件。但 OpenAI 这篇公告没讲清楚“首选模型”具体指什么,是独家供应、默认调用还是只是推荐...

推荐理由:OpenAI 选在这个时间点发公告,明显是在对冲彭博那篇“微软省钱换模型”的报道。它把 GPT 5.6 和 Copilot 365 全家桶绑在一起说事,话题性够强,所以 H、K、R 都踩中了。但整篇公告没给出任何合同细节或排他性条款,“首选模型”到底意味着什么完全靠猜,实际分量要等微软那边的动作才能验证,所以分数没往上调。

Computing Life · Share · 鸭哥调研

聊天框在拖 AI Agent 的后腿:该换成邮件式异步协作了

文章认为 Cursor、Claude Code 这类工具的聊天框界面,会诱导人只写模糊指令、期待秒回,让 AI 没时间自己编译、跑测试和纠错。作者提出把一问一答改成邮件式异步流程:把详细任务、附件和本地路径一次性发给 Agent,然后关掉窗口等结果。文中提到 Manus 的邮件任务入口和创业公司 AgenticMail 是早期例子,但正文没披露这些邮件...

推荐理由:观点文章,论证扎实:从第一性原理拆解聊天框如何通过界面暗示同时规训用户和开发者,剥夺了 AI 安静编译和自测的时间。邮件式异步工作流在 Manus 和 AgenticMail 上已有早期例子,但正文没披露这些邮件的具体延迟和成功率,这点先别太激动。整体对从业者来说是个值得停下来想想的视角。

TechCrunch · AI

OpenAI 二号人物 Fidji Simo 因健康问题退居兼职顾问

Fidji Simo 不再担任 OpenAI 的全职高管,转为兼职顾问。她去年 5 月才加入,负责统管商业和产品,直接向 Sam Altman 汇报,是公司实际上的二把手。今年 4 月她因神经免疫疾病复发开始休病假,现在她自己说恢复比预期更慢、更难,所以决定退下来。这个空缺来得不是时候:OpenAI 正在考虑上市,同时在企业市场追赶 Anthropic...

推荐理由:OpenAI 的二把手在上市前夜因病退场,时机很微妙。TechCrunch 独家披露了具体时间线和本人表态,信息扎实。但这是人事变动,不是模型或产品更新,所以重要性到不了 85 分的 p1 门槛,给 82 分放在 featured 里刚好。