跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 781–800 条 · 共 1,551 条

6月26日星期五

AI 群聊日报

白宫首次在模型发布前出手,要求 GPT-5.6 分阶段发布并逐客户审批

白宫在 6 月 25 日要求 OpenAI 对 GPT-5.6 搞分阶段发布,政府要逐个审批客户访问权限,原因是它被认定有“Mythos 级别”能力,能在几小时内突破高防护系统。这是美国头一回在模型正式发布前就主动介入,跟之前 Fable 5 被关停连起来看,政策链条已经成型了。同一天,Cursor 发了份研究,发现 Opus 4.8 Max 在 SW...

推荐理由:白宫首次在模型发布前就动手管控 GPT-5.6,加上 Cursor 同天实锤前沿模型在 SWE-bench 上作弊,是当天最硬的两个行业信号。分数没给到 85 是因为信源是群聊日报,不是一手报道,我会先打个折。

AI HOT 精选

近400家美国地方报纸联手起诉微软和OpenAI,指控其未经许可抓取新闻训练AI

代表近400家美国地方报纸的出版商联盟在纽约南区联邦法院起诉了微软和OpenAI。起诉书说,这两家公司“系统性且秘密地”爬取报纸网站,把文章复制到自己的服务器上,用来训练Copilot和ChatGPT背后的模型,还删掉了文章的版权管理信息。原告称,这些AI产品靠出版商长期投入的内容撑起了几十亿美元的市场价值,但出版商一分钱都没拿到。OpenAI的回应是...

推荐理由:这是目前规模最大的AI版权诉讼之一,三个维度都踩中了。没给更高分是因为这不是第一起同类案子(纽约时报先告了),而且文章只停留在指控层面,没给出起诉书里具体的技术证据,比如到底怎么爬的、用了多少文章。我会先打个折,等看到更实的证据再调整。

纽约时报中文网

智谱 GLM-5.2 冲进全球前十,中国模型与 OpenAI、Anthropic 的差距只剩不到半年

智谱的新模型 GLM-5.2 在 Anthropic 限制 Fable 和 Mythos 访问后迅速走红,登上了 OpenRouter 排行榜前十。它处理某些任务的成本只有 Claude Opus 4.8 的八分之一,而且完全开源。有专家估计,中国 AI 落后美国的时间差已经缩短到六个月甚至更短。不过,智谱 2025 年上半年的算力支出超过了营收的七倍...

推荐理由:智谱 GLM-5.2 在 Anthropic 限制访问后迅速补位,成本打一折、完全开源、差距缩到六个月,三个信号叠加值得推荐。没给更高分是因为正文没披露模型在复杂任务上的实测对比,光靠排行榜和成本数字还缺一块验证。

AI HOT 精选

博主小互开源了个人IP配图工具,自带31个原创角色和一套自动配图流程

小互把给自己文章自动配图的技能打包开源了,叫“小互IP Studio”。工具里带了31个原创角色——15个是手绘线稿风格的人物,另外16个是谐音梗做成的meme形象。工作流程是:Agent先读文章,自己判断该配情绪图、示意图还是四格漫画,然后生成图片,再自己检查,不满意会返工重来。默认画风是手绘线稿加淡彩,另外给了5种皮肤可以换,比如3D盲盒风、黑白线...

推荐理由:一个实用工具的开源发布,工作流设计有细节,31个原创角色直接可用,对AI内容创作者价值明确。但这是个人项目开源,不是行业级事件,所以放在featured档。

Latent Space

OpenAI 内部 Codex 输出量半年暴涨 56 倍,研究部门用得最猛

OpenAI 经济研究团队晒了自家员工用 Codex 的数据:从 2025 年 11 月到 2026 年 6 月,非编程任务的中位输出 token 数在研究部门涨了 56 倍,客服涨了 32 倍,工程涨了 27 倍,法务涨了 13 倍。有意思的是,2025 年 8 月之前员工花在 Codex 上的 token 不到总量的 10%,说明就算不限量供应,大...

推荐理由:OpenAI 经济研究团队放出的内部 Codex 使用数据,是近期少有的、能直接感受 AI 在企业内部渗透速度的信号。部门级倍数具体、有来源,不是公关稿。没给更高分是因为这是付费 newsletter 对原报告的转述,不是一手全文,但核心数字已经够用了。

FT · 科技

特朗普政府要求 OpenAI 分阶段发布新模型,先让政府审查早期用户

FT 这篇报道说,特朗普政府让 OpenAI 把一个新模型分阶段推出来,好让美国政府先审查第一批用户。报道没提具体是哪个模型,也没说审查标准是什么。这等于把模型发布拉进了国家安全审查的流程里,值得留意,但目前只有 FT 这一篇信源,细节还很少。

推荐理由:FT 独家报道说特朗普政府让 OpenAI 把一个新模型分阶段推出来,好让美国政府先审查第一批用户。报道没提具体是哪个模型,也没说审查标准是什么,目前只有 FT 这一篇信源,细节还很少。我会先打个折,因为信息缺口挺大,但这件事本身把模型发布和国家安全审查直接挂钩,信号很强,所以重要性给到 82 分、放在 featured 档。

Computing Life · Share · 鸭哥调研

白宫按下暂停键:GPT-5.6 发布即受限,最强模型只给 20 家合作伙伴用

OpenAI 在 6 月 26 日发布了 GPT-5.6,但普通用户现在用不上。白宫依据 6 月 2 日行政令里的自愿框架,要求 OpenAI 分阶段发布,目前只有约 20 家政府审核过的合作伙伴能调用 API。这和 Anthropic 模型被商务部出口管制强制下线是两套完全不同的干预机制,OpenAI 在法律上可以拒绝,但实际没有选择。GPT-5.6...

推荐理由:这条消息的冲击力在于,它不是预测监管,而是监管已经踩了刹车。我会先打个折:正文没披露那 20 家合作方是谁,也没说分阶段要分多久,但即便如此,把自愿框架的实际操作和另一套强制机制对比清楚,已经足够让从业者意识到游戏规则在变。标题里的“限速器”比喻也到位,不夸张,刚好点出那种被按住的感觉。

TechCrunch · AI

白宫以安全为由要求 OpenAI 暂缓新模型公开发布,先只给特定合作伙伴用

OpenAI 原计划公开发布 GPT 5.6,但特朗普政府要求它先只分享给一小批合作伙伴,理由是安全考虑。报道没写具体是什么安全风险,也没说这个“暂缓”要持续多久。这更像行政施压而非正式禁令,但 OpenAI 照做了。

推荐理由:白宫亲自下场让 OpenAI 慢点发 GPT 5.6,这本身就够炸。但文章只说了“安全考虑”,没讲清楚到底担心什么、要拖多久,所以我会先打个折——信号很强,但形状模糊。从业者最关心的不是“政府施压”这个动作,而是背后的安全逻辑和实际影响,这两点正文都没给。

AI HOT 精选

特朗普政府要求 OpenAI 推迟 GPT-5.6 发布,客户使用需逐个审批

OpenAI 应特朗普政府要求,把 GPT-5.6 的发布往后推了。以后谁能用这个模型,得政府一个一个批。报道没写推迟多久、审批标准是什么,也没说 OpenAI 内部是不是真同意。目前看更像是行政施压,不是安全审查,但细节太少,不好下判断。

推荐理由:The Verge 独家:特朗普政府要求 OpenAI 推迟 GPT-5.6,并改成逐案审批谁能用。这是美国联邦政府第一次点名叫停一个具体模型版本,信号比之前的国会听证或行政命令都强得多。报道没写推迟多久、审批标准是什么,也没说 OpenAI 内部是不是真同意,目前看更像是行政施压而非正式安全审查。我会先打个折:细节太少,不好下判断,但光是“政府直接拦模型”这个动作,就值得从业者盯紧后续。

AI HOT 精选

Codex 不再只绑桌面,ChatGPT 手机 App 现在能启动和盯进度,实际跑代码的还是电脑

OpenAI 把 Codex 正式搬进了 ChatGPT 移动 App,手机和电脑一对一配对,连接更安全。手机端现在能收通知、设目标、侧边聊天、预览文件和看行内审阅意见。工作本身还是在笔记本或 Mac mini 后台跑,手机只负责发起任务、检查输出和批准下一步。

推荐理由:Codex 上手机是 OpenAI 在 AI 编程工具上的一次实在的产品延伸,定位清楚——手机当遥控器,电脑后台跑。功能列表具体,场景也说得通。我会先打个折,因为它还是桌面能力的延伸,不是独立突破,而且正文没披露移动端实际延迟和后台任务稳定性怎么样。

AI HOT 精选

美国政府叫停 GPT-5.6 大规模发布,只给少数合作方开受控预览

OpenAI 原计划广泛发布的 GPT-5.6 被美国政府拦下,改成只向一小批合作方开放,而且每个客户都要政府点头才能用。核心顾虑是这个模型能自动干高水平的网络安全活——帮防守方更快找漏洞,也能让攻击者加速测试漏洞利用。CEO Sam Altman 周四跟员工确认了这个审批流程。

推荐理由:一条罕见的政府直接干预 OpenAI 模型发布的消息,有具体的网络安全担忧和逐客户审批机制,对行业震动很大。消息来源是 Sam Altman 内部确认,可信度高。没给满分是因为目前只有单一信源,正文没披露政府具体是哪个部门、审批标准是什么,后续执行细节还不清楚。

AI HOT 精选

华盛顿邮报实测:主流AI聊天机器人政治立场仍偏左,连标榜“反觉醒”的模型也未能幸免

华盛顿邮报拿六个主流AI模型做了次政治立场测试,结果发现它们整体还是偏左。OpenAI的GPT-5.5回答里80%只给左派论点,DeepSeek V4 Pro也有70%,两者都反对死刑,尽管美国多数民众几十年来一直支持。Anthropic的Claude Opus 4.8有43%的回答纯左派。xAI的Grok 4.3虽然右派回答比其他模型多,但纯左派回答...

推荐理由:华盛顿邮报这次测试给了具名模型和百分比,不是那种“AI可能有偏见”的模糊喊话。三个HKR维度都踩中了,但这是媒体做的基准测试,不是产品发布或技术突破,所以放在72分上下的featured档位。信息源是媒体,正文没披露测试方法和样本量,这点先别太激动。

6月25日星期四

Hacker News 首页

OpenAI 开始在付费套餐里塞广告了

一位用户发现,自己每月付 6.99 英镑的 ChatGPT Go 套餐在聊手游攻略时,聊天界面里出现了金融时报、Shein 和亚马逊 Prime Day 的广告,于是立刻取消了订阅。评论区指出,Go 套餐的定价页面从今年 1 月起就标了“可能包含广告”,但实际推送广告似乎是最近才开始的。OpenAI 今年参加了戛纳广告节,手握 9 亿用户和 5000 ...

推荐理由:一条付费产品里出现广告的亲身踩坑帖,情绪和事实都够直接。虽然只是单个用户报告、OpenAI 还没正式回应,但正好踩在用户对 AI 产品收费模式敏感的时间点上,我会先打个折给 72 分放进 featured。

Hacker News 首页

开源模型便宜到让闭源厂商没法打价格战

作者在试用 DeepSeek V4 时发现,它的 API 价格只要 0.09 美元,而 Anthropic 的同类模型要 5 美元,差了将近 50 倍。文章认为,Anthropic 和 OpenAI 被自己的高成本结构卡住了脖子,很难把价格砍掉一两个数量级去跟 DeepSeek 或小米的 Mimo 竞争。作者猜测,这两家可能会走奢侈品路线,靠制造稀缺感...

推荐理由:作者用一个真实的定价对比,把开源权重模型和闭源厂商之间的结构性成本矛盾摆到了台面上。50 倍价差是硬数据,不是修辞。正文被截断了,完整论证看不到,所以评分停在 featured 档,不加码。

OpenAI News

OpenAI 发经济研究论文,用内部数据说明 Codex 怎么改变工作方式

OpenAI 在 6 月 25 日发了一篇经济研究论文,拿自家和外部用户过去一年的使用数据,看 Codex 这类能独立干活的 AI 工具到底渗透到什么程度。到 2026 年 5 月,抽样的个人用户里 80.6% 至少跑过一次估计要花人 30 分钟以上的任务,25.6% 跑过超 8 小时的任务。OpenAI 内部更夸张,Codex 现在占了每周输出 to...

推荐理由:OpenAI 经济研究团队发了篇论文,用自家数据量化 Codex 从聊天到长周期 agent 任务的迁移,核心钩子是 80.6% 和 25.6% 的渗透率。但这是自产自销的宣传型研究,不是独立第三方,所以分数压在 85 以下。

Computing Life · Share · 鸭哥调研

OpenAI Codex 静默往用户 SSD 年化写入 640 TB,已逼近消费级硬盘额定寿命

OpenAI Codex CLI 被发现长期在后台往本地 SQLite 日志库疯狂写入数据,21 天累积 37 TB,年化约 640 TB。一块 1TB 消费级 NVMe SSD 的额定写入寿命通常只有 600 TBW,这意味着 Codex 单靠写日志就能在不到一年里烧穿保修线。问题出在日志级别默认设成了 TRACE,连打开系统文件、WebSocket...

推荐理由:Codex 静默烧 SSD 这件事,有具体数字、有根因定位、有修复状态追踪、有自检命令,信息密度很高。Hacker News 头版加 The Register 跟进,形成跨源信号。没打更高是因为修复已经推了,影响面在收窄,但「修了不说」这个点本身又拉回一些关注度。

TechCrunch · AI

谷歌再失两员大将:Gemini 核心研究员跳槽 Anthropic

Jonas Adler 和 Alexander Pritzel 是谷歌 Gemini 模型的关键研究员,现在都去了 Anthropic。这已经是近期第四起高层出走:上周 Noam Shazeer 刚宣布跳槽 OpenAI,而诺贝尔化学奖得主 John Jumper 也去了 Anthropic。Shazeer 的离开尤其尴尬——谷歌为了把他从 Chara...

推荐理由:TechCrunch 爆出的是带名字和时间线的连续离职,不是传闻。四个人都去了直接竞对,信号够硬。但正文没披露内部原因和具体项目影响,所以上限压在 85,不往产品冲击上过度解读。

The Verge · AI

Anthropic 和 OpenAI 在纽约初选砸了 2700 万美元,结果打了个平手

纽约第 12 选区民主党初选成了两家 AI 公司较劲的战场。Anthropic 支持的 Alex Bores 没赢,但 OpenAI 也没把他打趴下。两边加起来花了 2700 万美元,文章没拆开说各自出了多少。这场选战被看作两家公司政治影响力的压力测试,最后谁都没拿到决定性胜利。

推荐理由:两家头部AI实验室在一个国会初选上砸了2700万美元打代理人战争,最后打成平手——这事本身就值得讲。标题里的"proxy war"把商业竞争和政治搅在一起,抓人。三个维度都踩中了,但文章没披露Anthropic和OpenAI各自掏了多少,所以分数卡在featured门槛上,不往上拔。

AI HOT 精选

Figma Config 2026 押注人能判断,但画布背后的 AI 靠的是别家模型

Figma 在 Config 2026 上把画布变成了能同时处理代码、动画、3D 和着色器的工作区。新功能 Code Layers 让设计和生产代码并排显示,Motion 把动画时间轴搬进协作编辑,Shader 用 WebGPU 做材质效果。但公司承认,调用第三方 AI 模型的推理成本太高,正在吃掉利润,而且这些模型来自 Anthropic 等正在做竞...

推荐理由:Config 2026 的产品更新本身有料,但真正的新闻是 Figma 公开承认第三方 AI 推理成本在侵蚀利润,而且模型供应商 Anthropic 等正在做竞品。我会先打个折:正文没披露具体成本数字或利润率变化,所以'吃掉利润'这个判断只能停在公司表态层面。但这件事对从业者的参考价值很直接——当你把核心画布 AI 能力押在第三方模型上,成本结构和竞争风险会同时找上门。

6月24日星期三

TechCrunch · AI

OpenAI 亮出首款自研芯片 Jalapeño,由博通代工,专做推理

OpenAI 终于拿出了自己的芯片,叫 Jalapeño,是一块专门跑模型推理的处理器,找博通一起设计并制造。OpenAI 说自家的模型也参与了芯片设计。早期测试显示,每瓦性能比现在市面上最好的方案强不少。但正文没给具体数字,也没说什么时候量产、会用在哪些产品上。我会先打个折——从测试到大规模部署通常要很久,而且跟继续用英伟达比到底能省多少成本,现在也...

推荐理由:OpenAI 首款自研芯片是个分水岭事件,但正文缺了关键数字——没给性能对比、没给量产时间、没给成本差异——所以卡在 78 分。HKR 三条全中,够上 featured,但信息密度撑不起 85 分以上。