跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 441–460 条 · 共 1,551 条

8月17日星期一

Hacker News 首页

英伟达大幅缩减对 OpenAI 数据中心融资的担保额度

华尔街日报的消息,英伟达把之前可能为 OpenAI 基建项目担保的 2500 亿美元融资额度砍了一大截,但新数字具体是多少,正文没披露。这笔钱直接关系到 Stargate 这类巨型项目能不能按计划拿到钱——在新的细节出来之前,我会先把原来的 2500 亿这个数打个折来看。

推荐理由:英伟达砍掉 OpenAI 基建担保额度,直接动摇了 Stargate 项目的资金确定性。消息源是华尔街日报,路透社也跟进了,权威性没问题。扣分点在于新数字没披露,关键信息缺了一块,所以分数压在 85 以下。

8月16日星期日

Hacker News 首页

ChatGPT 网页访问份额一年跌了 22 个百分点

Similarweb 的全球网页访问数据显示,ChatGPT 的份额从一年前的 76% 掉到了 54%,Gemini 从 6% 涨到 28%,Claude 从 1% 涨到 9%。先别急着下结论说 ChatGPT 不行了——这只是网页端的流量占比,不是月活用户数,也不是收入。Gemini 能同时做到 10 亿 App 月活和 28% 的网页份额,是因为它...

推荐理由:Similarweb 的网页访问份额数据,三个产品的涨跌幅度都很大,而且正文自己就提醒了别直接等同于市场格局,信息量和克制都有。扣分是因为只有单一数据源、只覆盖网页端,而且是通过简报转述而非一手报告,所以没给到 80 分以上。

8月15日星期六

FT · 科技

OpenAI 高管接连出走,Sam Altman 仍在推进 IPO

OpenAI 又走了两位核心高管:首席战略官 Jason Kwon 和首席产品官 Kevin Weil。加上之前离开的几位早期关键成员,这波离职潮正好赶在 Sam Altman 推动公司转成营利性结构、准备 IPO 的节骨眼上。Altman 给公司定的估值目标是 1500 亿美元以上。文章没披露具体的上市时间表和承销商。高管层这么动荡,对定价和投资人信...

推荐理由:OpenAI 高管动荡还在继续,这次走的是首席战略官和首席产品官,正好卡在公司转向营利性结构、准备 IPO 的节点上。FT 独家披露了 Altman 内部定的 1500 亿美元以上估值目标。人事震荡叠加上市叙事,这篇文章值得一看。

Hacker News 首页

数学的终结:当 AI 过量产出反而让数学圈萎缩

Daniel Litt 在 OpenAI 的一场内部讨论里画了一条不太乐观的线:AI 做数学已经强到超人了,但数学本身可能反而会停滞。他摆了两组数据——arXiv 上组合数学论文的周投稿量从 2025 年初开始猛涨,但 MathOverflow 的问答量同期断崖式下跌,提问和回答都在变少,说明社区里活人之间的交流在萎缩。更麻烦的是,不同团队和模型在反复...

推荐理由:Daniel Litt 是正经代数几何学家,不是随便写博客的。他用 arXiv 投稿量和 MathOverflow 活跃度的背离,论证 AI 正在把数学研究变成孤立的论文生产——观点尖锐且有数据支撑。分数没给更高,是因为这还是一场内部讨论的转述,不是正式论文,长期影响有待观察。

8月14日星期五

Hacker News 首页

天才失灵:从 200 亿基金爆仓到材料科学,AI 实验室的智力傲慢

Leopold Aschenbrenner 的 200 亿美元对冲基金本周爆仓,持仓被 Citadel 接盘。他之前在 OpenAI 做超级对齐,2024 年靠一篇 AGI 即将到来的文章出名,随后募资重仓 AI 股票(新云、存储、数据中心电力),上了约 4 倍杠杆,同时做空软件股——两边都押反了。作者 James Wang 自己做过对冲基金分析师也懂...

推荐理由:Leopold Aschenbrenner 的 200 亿美元对冲基金爆仓了,持仓被 Citadel 接盘。他之前在 OpenAI 做超级对齐,2024 年靠一篇 AGI 即将到来的文章出名,然后募资重仓 AI 股票,上了约 4 倍杠杆,同时做空软件股——结果两边都押反了。作者 James Wang 自己做过对冲基金分析师,给的数字和逻辑都具体,不是空发感慨。这更像一篇金融八卦,不是 AI 技术更新,但作为人物特写,信息量和可读性都够。

Hacker News 首页

DeepSeek V4 Pro 正式上线,API 开始分高峰和低谷时段计价

DeepSeek 把 V4 Pro 模型从预览版转成了正式版。这次更新主要强化了让模型进业务流程干活的能力,并且给 V4 Pro 和 V4 Flash 都加了一个“思考力度”调节开关:简单任务用低档,日常自动化任务用高档,复杂任务可以拉满。模型现在也原生支持 OpenAI 的 Responses API,能一键接入 Codex。API 价格从 8 月 ...

推荐理由:V4 Pro 转正、加 agent 加固和思考力度调节,是实打实的功能更新,对在 DeepSeek 上搭自动化的开发者有意义。没给到 85 分以上,是因为正文没披露 GA 后的基准对比,也没说清楚峰谷价差到底是多少——信息密度差了口气,所以我会先打个折。

FT · 科技

OpenAI 和 Anthropic 被中国对手逼着打价格战

FT 报道,OpenAI 和 Anthropic 正在大幅降价抢企业客户,压力来自 DeepSeek 这类成本更低的中国模型。两家公司都在推更便宜的小模型,同时靠高价订阅和 IPO 预期撑估值。文章没给出具体降了多少、什么时候生效,更像一篇趋势分析。

推荐理由:FT 这篇是趋势分析,不是硬消息稿。它点出了 OpenAI 和 Anthropic 被中国低价模型逼着降价的大背景,但正文没披露具体降了多少、什么时候开始,信息密度不够硬。我会先打个折:格局判断有参考价值,但缺可执行的数据,所以 H 和 R 都成立,K 不成立,刚好够 featured 门槛。

Computing Life · Share · 鸭哥调研

Agent 授权之争,争的不是密码学,而是信任该交给谁

Vercel Connect 把长寿命的 refresh token 从应用代码里挪走,靠 OIDC 短命凭证换 token,真正的卖点是集中管理,不是更强的安全性。Cloudflare OS 管的是数据读取后的去向,不碰凭证签发。OpenAI 收购 Ona,押注客户自己保管凭证。四套思路各管一段,凭证线和数据线至今没打通。

推荐理由:这篇分析把 Agent 授权拆成凭证签发、数据去向、凭证保管三条线,用 Vercel、Cloudflare、OpenAI 的具体动作对照着讲,比泛泛的趋势文扎实。扣分在于它是综合解读而非一手爆料,而且文章没给出打通凭证线和数据线的明确路径,更像把问题摊开。

彭博科技

OpenAI 年化收入跑过 400 亿美元,赶在 IPO 前亮出商业化底牌

OpenAI 的年化收入跑率(用最近一个月收入乘以 12 估算)已经超过 400 亿美元,三个月内翻了一倍多。这是它 IPO 前最关键的数字,说明商业化在加速。收入主要靠 ChatGPT 订阅和 API 调用,但文章没拆各自占比。我会先打个折——跑率不是实际全年入账,只是把单月数字放大,不过增长势头确实猛。

推荐理由:OpenAI 在 IPO 前放出最关键的收入数字:年化跑率超 400 亿美元,三个月翻了一倍多。文章是 Bloomberg 独家,信源加分,但没拆 ChatGPT 订阅和 API 各自贡献多少,也没说利润情况。我会先打个折——跑率是把单月数字放大,不是真金白银入账,不过增速确实猛,直接关系到市场怎么给它定价。

The Verge · AI

OpenAI 一周内再走一位高管,首席营收官 Denise Dresser 宣布离职

Denise Dresser 去年 12 月才从 Slack CEO 的位置上过来,当 OpenAI 的首席营收官,现在发帖说几周后就要走,去“找别的机会”。接她班的是云安全公司 Wiz 的总裁兼 COO Dali Rajic。这周稍早,前 COO、后来管特殊项目的 Brad Lightcap 也宣布离开。Dresser 之前还接过 Lightcap ...

推荐理由:一周内两位高管出走,Dresser 从 Slack 过来不到一年就离开,接任者来自 Wiz 而非传统 SaaS 巨头,信号很强。扣分点:正文没披露 Dresser 离职原因和 Rajic 具体到任时间,所以我会先打个折——变动本身够重要,但信息有缺口,别急着下结论。

TechCrunch · AI

OpenAI 给 GPT-5.6 Sol 加了“超快模式”,推理速度拉到 14 倍

OpenAI 推出了一个叫 Ultrafast 的预览模式,让自家最强的 GPT-5.6 Sol 模型跑到每秒 750 个 token,是标准速度的 14 倍。以前想要实时响应,通常得换个小模型,这次相当于让大模型自己快起来。这个模式跑在 Cerebras 的芯片上,目前只开放给一小批客户,后续会扩大范围。Anthropic 的 Claude 也有快速...

推荐理由:GPT-5.6 Sol 直接提速 14 倍,对需要实时响应的场景是个实打实的推理突破。没给更高分是因为现在还只是小范围预览,没有正式上线时间,而且绑定了 Cerebras 的硬件,能不能大规模铺开还不确定。

Hacker News 首页

Cerebras 用整块晶圆芯片跑 OpenAI 的 GPT-5.6 Sol,每秒吐 750 个 token

Cerebras 和 OpenAI 放出了一个叫 Ultrafast 模式的新服务,目前只在小范围测试。它把 GPT-5.6 Sol 部署在 Cerebras 自家的晶圆级芯片上,推理速度最高能到每秒 750 个输出 token。在 Humanity's Last Exam 这个全是博士级难题的测试里,它跑完 2500 道题只用了 11 小时 11 分...

推荐理由:Cerebras 和 OpenAI 把 GPT-5.6 Sol 搬上晶圆级芯片,搞了个 Ultrafast 模式,推理速度拉到 750 tok/s,前沿模型第一次摸到这种实时交互的门槛。HLE 那套博士级难题跑完只用了 11 小时 11 分,给部署团队一个能直接算账的参考值。不过目前还是小范围测试,正文没披露并发数、成本结构和实际可用性,这点先别太激动。

TechCrunch · AI

OpenAI 上任仅 9 个月的营收官被换,从 Wiz 挖来总裁 Dali Rajic 接任

OpenAI 把干了 9 个月的首席营收官 Denise Dresser 换掉了,接替她的是 Wiz 的前总裁兼首席运营官 Dali Rajic。Wiz 今年刚被 Google 以 320 亿美元收购,是 Google 史上最大一笔并购。这次换人不是孤立事件——过去一个月里,OpenAI 的首席运营官 Brad Lightcap 和二号人物 Fidji...

推荐理由:连续的高管变动本身就有新闻性,加上 Wiz 被天价收购的背景让这次任命多了层看点。但说到底还是人事消息,没有产品和技术实质,所以放在 featured 里偏低的分数段。

8月13日星期四

AI HOT 精选

OpenAI 发布 GPT-5.6 构建指南:用便宜模型跑出接近顶配的效果

OpenAI 放出了一份给开发者的实战指南,核心就一句话:GPT-5.6 系列让前沿智能体(让模型进业务流程干活)的成本大幅下降。指南里举了几个创业公司的例子:Hex 把 GPT-5.6 直接接入现有流程,发现用“低推理强度”效果反而最好,模型不会在没数据的地方死磕,省下不少 token。Hypha 用 Luna 模型做文档信息提取,准确率只比 GPT...

推荐理由:OpenAI 官方出的开发者指南,用创业公司的真实案例讲怎么用 GPT-5.6 系列省钱跑智能体。有具体操作和成本对比,对正在用 OpenAI 的团队挺实用。但这就是一份产品说明书,不是技术突破,所以重要性我给打个折,放在推荐阅读档。

OpenAI News

OpenAI 给 GPT-5.6 Sol 加了“极速模式”,用 Cerebras 芯片跑到 14 倍快

OpenAI 在 API 里先放出了一个叫 Ultrafast 的预览版,让 GPT-5.6 Sol 最快每秒能吐 750 个 token,比标准模式快 14 倍。这背后是换了 Cerebras 的芯片来跑推理。速度快到这种程度,主要想解决那些等不起的场景:比如线上事故时实时扒日志、找代码改动、辅助定位问题;金融交易里一边看行情一边扫异常;客服电话里不...

推荐理由:OpenAI 在 API 里放出了 GPT-5.6 Sol 的 Ultrafast 预览版,靠 Cerebras 芯片把推理速度拉到标准模式的 14 倍,每秒能吐 750 个 token。文章给了三个等不起的真实场景,信息量够硬。但没公布价格,也没说什么时候正式上线,所以分数停在 82,没冲到必须当天写的那档。

OpenAI News

OpenAI 挖来 Wiz 前总裁 Dali Rajic 当首席营收官,要把企业生意做成可复制的流水线

OpenAI 宣布 Dali Rajic 接替 Denise Dresser 出任首席营收官。Rajic 之前在 Wiz 当总裁兼 COO,擅长用数据指标驱动规模化销售,他的任务是把 OpenAI 早期拿下的企业客户转化成一套可重复、可度量的营收体系。公告同时披露了两个数字:周活用户超过 10 亿,企业客户超过 200 万,比一年前翻了一倍。我会先打个...

推荐理由:OpenAI 官方公告,既有高管换人又有业务规模数据,信息量撑得起 featured 级别。但本质是人事任命,没有产品和技术层面的新东西,所以 H 和 K 都满足,唯独缺了 R,按规则落在 72-77 这个分数段。

AI 群聊日报

闭源模型的推理过程被批量扒光,Coze CLI 偷偷劫持本地 AI 工具

今天最值得看的是闭源模型的加密思维链被大规模提取。研究人员发现,把 Claude Opus 4.8 的加密推理块直接扔给同厂的 Haiku 4.5,后者就能逐字解码。这个方法在 Claude、GPT、Gemini 三家的 API 上都跑通了,用 Haiku 解码一万条轨迹的成本大概是 720 美元。另一篇论文更狠,说就算不接触加密块,光看模型公开输出的...

推荐理由:这条信息来自群聊日报,属于二手摘要,但信号很强:三篇论文指向同一个问题,且给出了可复现的方法和成本。我会先打个折,因为原文没披露具体实验细节和样本量,但核心判断——加密思维链可被跨模型解码——有足够的事实支撑。对从业者来说,这比一般的模型能力更新更值得警惕。

Hacker News 首页

OpenAI 把编程助手 Codex 塞进了 ChatGPT 桌面版,还发了 Linux 安装包

Codex 现在直接长在 ChatGPT 桌面应用里了,能端到端处理写功能、重构、迁移这类工程活。它用多智能体并行干活,号称能把几周的活压缩到几天。团队可以通过 Skills 系统教它自己的规范和流程,还能设成后台常驻,自动处理 issue 分诊、监控告警、CI/CD 这些杂事。正文没提具体定价和底层模型名。Ramp、Duolingo、Harvey 等...

推荐理由:OpenAI 把 Codex 集成进 ChatGPT 桌面版,是一次对开发者工具链的渠道打击,直接对标 Cursor 和 Claude Code。多智能体并行工作树和 Skills 系统是实打实的机制,不是包装词。扣一点分是因为正文没提定价和底层模型名,Linux 版也只说‘很快推出’没给确切日期,实际交付和成本都还有变数。

Computing Life · Share · 鸭哥调研

编程 Agent 换形态,抢的都是同一件东西:执行数据

DeepSeek 开始招 Agent Harness 产品经理,说明它正在补一个空位:没有自己的编程工具运行环境。之前它只卖模型接口,把工具端交给第三方,但这样拿不到用户在真实编程场景里的行为数据——模型输出了代码,但用户怎么改、哪里报错、改了几轮才跑通,这些细节都留在第三方工具里。LangChain 的测试显示,同一个模型有没有针对性的运行环境配置,...

推荐理由:一篇用招聘动作和测试数据把产业逻辑讲清楚的分析。DeepSeek 招 Agent Harness 产品经理这件事本身不大,但作者把它和 LangChain 的 10-20 个百分点性能差距、Codex 做桌面端串起来,点出模型厂抢的不是工具市场,是用户改代码、修 bug 的行为数据。判断都挂在事实和数据上,没有吹概念,对从业者来说信息密度够、可读性强。按政策,观点分析类文章打 78-84 分段的低区,78 分合理。

Computing Life · Share · 鸭哥调研

Anthropic 烧了 3100 万 token 搜黎曼猜想,真正的信号在搜索架构

Anthropic 用未发布的 Claude 把黎曼 zeta 函数零点在临界线上的比例下界从 41.6% 推到了 67.2%,离证明黎曼猜想还差得远。真正值得看的是搜索过程:两次 Claude Code 会话烧掉 3100 万输出 token,第一轮 650 个想法全部失败,但留下了一份记录 106 条局部存活路线的台账,标明了每条路卡在哪、重新打开...

推荐理由:Anthropic用未公开模型做数学搜索,3100万token的工程细节和敌对评审机制是真正的信号,不是纯PR。扣分是因为纯数学离产品落地还远,而且正文没披露模型名称和token成本。