跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 661–680 条 · 共 1,551 条

7月15日星期三

TechCrunch · AI

苹果在 iOS 27 公测版里把新版 Siri 放出来了,所有人都能试

苹果发了 iOS 27 的公测版,不用开发者账号也能用上大改后的 Siri。全球有 25 亿活跃设备,哪怕只有一小部分人装公测版,这也是苹果 AI 助手跟 ChatGPT、Gemini、Claude 正面打的最大规模真实测试。新版 Siri 最早在 WWDC 2026 上亮相,正式版要等今年秋天。正文没提底层模型架构、哪些任务在本地跑哪些上云端,也没给...

推荐理由:苹果 Siri 大改版进公测,25 亿设备规模本身就够有看头,TechCrunch 给了时间线但完全没碰模型架构和本地/云端分工,技术钩子缺位,K 只能给零。分数定在 82:信息密度不够上 85,但话题性和关注度撑住了这个段位。

7月14日星期二

The Verge · AI

苹果起诉 OpenAI 窃取商业机密,Sam Altman 的 IPO 之路又添堵

苹果把 OpenAI 告了,理由是窃取商业机密。官司本身可能拖好几年,这对正在推 IPO 的 Sam Altman 来说很要命——投资人最怕悬而未决的法律风险。不过文章没写苹果到底指控 OpenAI 偷了什么技术或数据,也没提索赔金额,目前只确认了起诉这个动作。

推荐理由:苹果告 OpenAI 窃取商业机密,这事本身冲突感很强,尤其卡在 IPO 窗口期,投资人最怕这种不确定性。但文章只确认了起诉,没披露具体指控内容和索赔金额,所以没法给更高分。

Ben's Bites

OpenAI 发布 GPT-5.6:三个模型、五档思考强度,外加一个会疯狂派生子智能体的 Ultra 模式

GPT-5.6 系列包含 Luna、Terra 和 Sol 三个模型,每个模型都提供从“轻度”到“最大”五档思考强度,以及一个 Ultra 模式。Ultra 模式会让模型大量派生子智能体来干活,非常消耗使用额度。OpenAI 还把 macOS 版 ChatGPT 和 Codex 应用合并成了新的 ChatGPT Work 应用,并推出了一个叫 Chat...

推荐理由:GPT-5.6 正式上线是本周最大的产品新闻之一,三模型加 Ultra 的设定值得从业者关注。扣分是因为这是一篇教程复盘而非官方发布公告,而且正文被截断,关键细节缺失,信息不够完整。

Hacker News 首页

分析师说 OpenAI 的广告收入可能比自家预测少 90%

OpenAI 今年 2 月开始试水广告,内部预测今年广告收入 25 亿美元、2030 年冲到 1000 亿。但 Emarketer 的数据显示,美国整个独立聊天机器人广告市场——包括 ChatGPT、Copilot、Google AI Mode 和 Alexa 购物版——今年加起来都不到 10 亿美元,到 2030 年也只有 54.1 亿。OpenAI...

推荐理由:OpenAI 的广告收入预测被第三方数据泼了盆冷水,差距大到没法忽视。Emarketer 把整个美国聊天机器人广告市场的天花板定在 2030 年 54.1 亿美元,OpenAI 自己的目标是 1000 亿,数字对比很扎眼。这事戳中了 AI 公司怎么赚钱的敏感神经,对从业者来说是个实打实的信号。

Latent Space

OpenAI Codex 半年用户涨了 10 倍到 700 万,可能已经超过 Claude Code

OpenAI 的编程工具 Codex 在 7 月 13 日达到了 700 万活跃用户,一天之内就多了 100 万。这个数字比年初的 55 到 70 万翻了 10 倍,3 月时还只有 200 万。作为对比,Anthropic 的 Claude Code 上次公布数据是 2 月,大约 200 万用户,之后就再没更新过。文章猜测 Anthropic 可能把重...

推荐理由:Codex 半年 10 倍增长、单日百万新增,数字够硬,值得拿出来说。Claude Code 从 2 月之后就没再报过数,这个信息空白本身就构成一个值得追问的点。扣分是因为来源是付费 newsletter 的二手整理,不是一手数据,标题也带问号,判断上我会先打个折。

Computing Life · Share · 鸭哥调研

一个不等你提问的 ChatGPT,会是什么样?

Greg Brockman 在 7 月 1 号的访谈里描述了一种“没有产品”的 AI:它常驻后台,不等你开口就发现冲突、起草动作。文章用一个思想实验推演了这种“环境意图层”的形态,并指出主动 AI 的瓶颈不是执行能力,而是缺少能长期积累、自我更新的个人上下文基础设施。

推荐理由:一篇把 Brockman 访谈做实的思想推演,用“环境意图层”这个框架把模糊愿景变成了可讨论的产品形态。场景拆得具体,对比也清楚,对正在琢磨 agent 产品方向的人有启发。扣分是因为它本质上是评论和推演,不是实证产品发布或研究产出,所以没给更高档位。

TechCrunch · AI

纳德拉警告:用闭源模型的公司,可能正在喂养未来的竞争对手

微软 CEO 纳德拉在个人博客里抛出一个观点:企业用 OpenAI、Anthropic 这类闭源模型,等于把敏感业务数据交出去。这些模型实验室未来可能利用这些信息,反过来跟客户抢生意。他把这叫做“逆向信息悖论”。文章还引了投资人 Jason Calacanis 和 Palantir CEO Alex Karp 的类似警告,但没给出具体数据或案例。有个背...

推荐理由:纳德拉亲自警告闭源模型的数据风险,角度很尖锐,但文章纯观点输出,没数据没案例。H 和 R 都打中了,K 明显缺失,刚好卡在 featured 门槛上。

Hacker News 首页

同一个 TypeScript 文件,Claude 的计费 token 数比 GPT 多 73%

Playcode 用各家官方的分词器测了 16 个真实文件,发现模型标价页上的“每百万 token 价格”会骗人。同一个 TypeScript 文件,GPT-5.x 算 681 个 token,Claude 新分词器算 1,178 个,直接多出 73%。更隐蔽的是,Claude Opus 4.8 和 4.6 标价完全一样,但 4.8 换了新分词器,同一...

推荐理由:用真实文件做分词器基准测试,把 token 定价不可比这个行业痛点变成了可复现的数据。HKR 三个维度都打中了,但本质是工具层面的洞察,不是产品发布或模型突破,落在 78 分档合理。没有跨源信号簇支撑,先不打更高。

TechCrunch · AI

苹果起诉 OpenAI 窃取商业机密,指控内容有多离谱

苹果在 7 月 11 日提交了一份 41 页的诉状,指控 OpenAI 有组织地从前苹果员工那里套取商业机密。诉状里最抓眼球的地方是那些细节:有 OpenAI 内部消息写着“哈哈,我发现我能访问(网络存储)了,太搞笑了”;还有指控说 OpenAI 面试时要求候选人带上苹果发的设备,教他们用个人邮箱传文件,并在 Slack 上开阅后即焚消息。苹果声称至少...

推荐理由:这篇报道的抓人之处全在诉状引用的细节,聊天记录和具体操作手法让指控变得很鲜活,HKR 三项都踩中了。分数没给更高是因为目前只是单方面指控,法院还没判,而且 TechCrunch 是转述诉状内容,不是一手法律文件。

The Verge · AI

苹果起诉 OpenAI:一份 41 页诉状里的 6 个离谱指控

苹果在一份 41 页的起诉书里指控 OpenAI 搞了一场系统性的挖人行动,手段相当激进。OpenAI 被指教苹果员工怎么绕过公司的安全检查,还在面试时要求对方“展示并讲解”手里的内部项目。诉状称 OpenAI 专门盯着能带走整支团队的经理下手,已经挖走了至少 20 名苹果员工,其中一些人可能带走了下一代芯片的设计。苹果要求归还数据并索赔,但诉状里没提...

推荐理由:苹果这份起诉书把抢人细节摊开了讲,从教人绕安检到面试时看内部项目,手段写得很具体。至少 20 人被挖、可能涉及芯片设计,这几个数字让事情不只是口水仗。不过目前只有苹果单方面的说法,OpenAI 还没回应,完整图景得等后续。

Hacker News 首页

实测苹果新语音 API:准确率超 Whisper Small,速度还快三倍

Inscribe 团队用 5,559 条标准语音样本,把苹果刚推出的 SpeechAnalyzer 跟老版 SFSpeechRecognizer 以及三个 Whisper 模型拉出来比了比。结果很直接:SpeechAnalyzer 在干净语音上的词错率只有 2.12%,嘈杂语音 4.56%,比 Whisper Small 分别低了 1.62 和 3.3...

推荐理由:这是 SpeechAnalyzer 第一个独立基准测试,方法扎实(5,559 条样本,全设备端推理),对语音产品团队有直接参考价值。没给更高分是因为这只是单家第三方在 LibriSpeech 一个数据集上的结果,不是苹果官方发布,覆盖场景也有限。

7月13日星期一

AI 群聊日报

GPT-5.6 Sol Pro 解密:Pro 不是新模型,只是个推理模式开关

群友抓包发现 OpenCode 里的 Sol Pro 并非独立模型,只是在调用 gpt-5.6-sol 时加了个 reasoning.mode: "pro" 的参数,跟 effort、service_tier 可以自由组合。开 Pro 后一句简单问候的输入 token 从 12 暴涨到 1527,贵了 100 多倍。另一边,GPT-5.6 开始对缓存写...

推荐理由:一手抓包数据带具体数字,不是转述。Sol Pro 的拆穿和缓存计费的发现都有实打实的信号,但来源是匿名群聊,没有官方确认,所以分数卡在 featured 门槛。

Hacker News 首页

我爱大语言模型,但讨厌炒作

George Hotz 对 GPT-5.6、GLM-5.2 和编程智能体很兴奋,但点名批评两件事:一是用“窗口正在关闭”或“永久底层阶级”这类制造焦虑的负面炒作;二是从“高级自动补全”直接跳到“控制整个光锥”的夸张叙事。他认为 AI 进步主要靠摩尔定律和商品化,不是前沿实验室的魔法,反开源的论调本质是害怕技术被商品化。他收回之前对模型编程能力的部分否定...

推荐理由:Hotz 这次不是泛泛聊趋势,而是把两类炒作手法拎出来骂,同时用自己跑通的实验修正了之前的判断,有观点有实证。文章本身信息量不算大,但情绪和立场很鲜明,对厌倦了 AI 公关话术的从业者来说,读起来像一次集体吐槽,推荐值高。

AI HOT 精选

Codex 和 ChatGPT Work 暂时取消 5 小时用量上限,GPT 5.6 Sol 开始省用量

过去两天上了三个更新:Plus、Business、Pro 套餐的 5 小时使用限制暂时拿掉了;GPT 5.6 Sol 做了效率优化,每次请求消耗的用量会变少,但具体能省多少正文说等量化后再公布;同时活跃用户到了 600 万,一小时内会重置用量。暂时取消的“暂时”是多久、效率提升的幅度多大,这两点正文都没给,先别急着算账。

推荐理由:Codex 和 ChatGPT Work 一起更新,取消 5 小时限制对重度用户是实打实的利好。GPT 5.6 Sol 说效率提升、每次消耗变少,但正文没给具体数字,600 万活跃用户和一小时内重置用量也算有料。不过“暂时”取消是多久、效率到底省多少都没说,所以分数没上 80。

Hacker News 首页

Ploy 把生产环境 AI 智能体从 Claude Opus 4.8 换到 GPT-5.6:快了 2.2 倍,成本降了 27%

Ploy 的 AI 智能体负责搭建真实的营销网站,过去四个月里没有模型能打过 Claude Opus,直到 GPT-5.6 Sol 出现。换模型后,网站生成时间从 8 分钟缩到 3 分 42 秒,单次成本从 3.06 美元降到 2.22 美元,视觉评分还略高一点。但切换不是即插即用:他们的评估工具、工具调用格式、缓存策略和推理回放都得重写,因为整个技术...

推荐理由:Ploy 发了篇当天从 Claude Opus 切到 GPT-5.6 的迁移报告,有具体的延迟和成本数字,还有工程细节,不是厂商软文。我会先打个折:这只是单团队经验,正文没披露失败案例和边缘场景,能不能复现不好说。但信息密度和时效性够,给 featured。

7月12日星期日

AI HOT 精选

Altman 改口说 AI 净创造就业,和他之前预测的大规模裁员反差很大

OpenAI 的 Sam Altman 在 X 上说,他“相当确定”AI 到目前为止是净创造就业的,还补了一句“这跟我之前想的不一样”。他早年警告过 AI 对就业的冲击可能“有点吓人”。Anthropic 的 Dario Amodei 也修正了说法,现在把自动化称为生产力倍增器,而不是岗位杀手。不过,目前还没有研究显示 AI 对整体生产率或劳动力市场有...

推荐理由:Altman 和 Amodei 同时转向“AI 净创造就业”是个很强的叙事钩子,但全文只靠推文引述撑起来,没有数据佐证,所以知识轴扣分。分数卡在 featured 门槛 72——被缺乏实证拖了后腿。

AI HOT 精选

分析师:苹果告 OpenAI 挖角窃密,就算指控不成立也会拖慢它的硬件计划

苹果起诉 OpenAI 挖走 400 名员工、偷工程机和机密文件。PP Foresight 分析师 Paolo Pescatore 认为,两家关系已经在恶化,OpenAI 想绕过 iPhone 直接做消费者硬件的路会被这场官司拖住。斯坦福法学教授 Mark Lemley 补充,如果真有前苹果员工把机密文件带到 OpenAI 用,事情就严重了。正文没披露...

推荐理由:苹果告 OpenAI 挖角窃密,分析师认为官司本身就会拖慢 OpenAI 的硬件路线图,这个判断比指控本身更有信息量。没给更高分是因为正文只有分析师评论,没拿出具体证据或损失金额。

Computing Life · Share · 鸭哥调研

Codex 并入 ChatGPT:Agent 为什么开始跨界面工作

OpenAI 把 Codex 塞进了 ChatGPT,不再单独给一个桌面应用。同一个 Codex 技术,以前写代码,现在也处理文档、表格和网页,周活用户超过 500 万,其中 100 万在干非开发的活。Anthropic 和 Cursor 也在做类似的事:把不同执行模式放进一个应用,让 Agent 在后台跑,用户从网页发起任务、手机上查进度、点一下批准...

推荐理由:这是一篇有分析框架和数据的趋势观察,不是产品公关稿。HKR 三项都踩中了:标题有钩子,正文用 500 万周活和跨界面用户占比撑住了判断,痛点也落到了从业者每天面对的多设备管理 Agent 的问题上。分数定在 78,因为文章本质是单源观点,没有交叉验证,但观点本身有信息量,值得推给读者。

AI HOT 精选

苹果起诉 OpenAI 挖角窃密:前员工一句“哈哈”暴露了内网漏洞

彭博社挖出了苹果起诉 OpenAI 的细节。前 iPhone 工程师 Chang Liu 离职时没还工作电脑,还发现一个软件漏洞,让他离开苹果后仍能访问公司内网。他把这事当笑话发给还在苹果的同事 Alyssa Peng,说“哈哈,我发现我还能访问网络存储”,对方回了一句“我准备好了”,就帮他一起拖走了更多机密数据。核心人物是前苹果高管 Tang Tan...

推荐理由:彭博社挖出的内幕够硬,从一句“哈哈”牵出整条泄密路径,叙事节奏好,细节扎实。但说到底这是法律纠纷,不是 AI 技术或产品进展,所以分数没往上顶。

Hacker News 首页

AI 员工套现后涌入楼市,旧金山房价涨到历史最高

旧金山房价被 AI 公司的股票套现潮直接推高了。今年 5 月,当地房屋成交价中位数冲到 176 万美元,比去年同期涨了超过 14%,重新成为全美买房最贵的城市。Redfin 的首席经济学家把原因归结为 AI 财富效应:OpenAI 员工去年 10 月合计套现 66 亿美元,人均 1100 万;Anthropic 员工近期也卖了大约 60 亿美元的股票。...

推荐理由:BBC这篇用Redfin的成交数据和OpenAI、Anthropic的套现数字,把AI财富效应讲得很具体。三个维度都踩中了,但话题偏社会经济而非AI技术或产品,对从业者的直接知识增量有限,所以分数压在72。