跳到正文

#OpenAI

今日 45 条

5月29日星期五

Latent Space

Anthropic 完成 650 亿美元 H 轮融资,估值冲到 9650 亿,同时发布 Opus 4.8 和动态工作流

Anthropic 今天放出了两个大消息。钱这边,他们完成了 650 亿美元的 H 轮融资,投后估值达到 9650 亿美元,领投方是 Altimeter、Dragoneer、Greenoaks 和 Sequoia。公司还首次披露年化收入已经超过 470 亿美元,这个数字去年 12 月才 90 亿,增速很猛。产品这边,他们发了 Claude Opus 4...

推荐理由:HKR 三项全中:这条把前沿实验室的巨额融资、新模型和代码工作流更新打包在一起。我按摘要里的 650 亿美元融资和 9650 亿美元估值来算,因为标题里的数字和正文对不上。

阮一峰的网络日志

Token 费用难以负担

OpenAI 员工晒出自己一个月的 Token 用量:760 万次请求,6030 亿 Token,按公开费率算价值 130 万美元。虽然他是内部员工不用掏钱,但这个量级让外界看清了一件事——如果放开让程序员用顶级模型,一个人一年光 Token 费就可能上亿人民币。换成国内便宜的开源模型,也要两三百万。Uber 今年头四个月就烧完了全年 34 亿美元的 ...

推荐理由:Peter Steinberger的CodexBar使用数据把Token费用问题算成了一笔明账:一个月760万次请求、6030亿Token,按预设费率估算价值130万美元。这个数字够具体,也够吓人,直接点出了AI编程工具在规模化使用时的成本压力。文章不是产品发布或模型评测,而是从业者的真实账单分享,对正在评估AI工具成本的团队来说,比任何公关稿都实在。

AI HOT 精选

技能提炼:让大模型写操作手册,小模型照着干活

作者 Tomasz Tunguz 分享了他用“技能提炼”让本地小模型跑个人工作流的做法。他会让 Opus 4.7、GPT-5.1 或 Gemini 3 Pro 这类顶尖模型,把处理邮件、管投资 pipeline、发博客等任务写成标准化的 SKILL.md 步骤文件,然后由本地运行的 Qwen 35B 或 Gemma 26B 一步步执行。这套系统基于 P...

推荐理由:这个技能提炼模式把大模型当教练、本地模型当执行者,思路清楚,对控制成本有实际意义。我会先打个折,因为文章没披露任何量化结果——不知道本地模型执行时会不会翻车,也不知道到底省了多少钱。这点先别太激动,等有数据再说。

FT · 科技

Anthropic 敲定 650 亿美元融资,估值超过 OpenAI

Anthropic 完成了新一轮 650 亿美元的融资,把公司估值推到了 9650 亿美元(含新到账的钱),这个数字已经超过了 OpenAI 的估值。不过这篇报道正文被付费墙挡住了,具体是哪些投资人、钱会怎么花、以及估值是怎么算出来的,正文都没披露。

推荐理由:这条消息分量很足。Anthropic 敲定 650 亿美元融资,投后估值 9650 亿,直接超过了 OpenAI 的估值,等于在资本层面完成了一次反超。我会先打个折:正文没披露具体投资方和资金用途细节,但光这个数字就说明市场对 Claude 这条路线下了重注。对从业者来说,这意味着算力军备竞赛还会升级,模型层的竞争远没到定型的时候。

彭博科技

Anthropic 拿了 650 亿美元,估值冲到 9650 亿,头一回比 OpenAI 还贵

Bloomberg 的视频消息说,Anthropic 刚完成一轮 650 亿美元的融资,投后估值 9650 亿美元,首次在估值上超过了 OpenAI。不过正文被 Bloomberg 的反爬机制挡住了,具体投资人、资金用途和估值计算方式都没披露。我会先打个折:9650 亿这个数字高得离谱,比很多科技巨头的市值都大,在没有看到完整条款和收入数据前,这点先别...

推荐理由:这条消息分量很重,但我会先打个折。650 亿美元融资和 9650 亿美元估值这两个数字确实能重新排定前沿 AI 公司的资本座次,标题里“超越 OpenAI”的说法也直接改写了双方较量的故事线。不过正文没披露投资方是谁、条款怎么签,也没说钱具体砸向算力还是收购,所以暂时不能给到顶格判断。如果是真的,这轮融资会让 Anthropic 在抢人和堆算力时手头宽裕很多,但没看到资金结构之前,先别太激动。

彭博科技

Anthropic 估值冲到 9650 亿美元,首次压过 OpenAI

Anthropic 刚完成一轮 650 亿美元融资,投后估值 9650 亿美元,数字上超过了 OpenAI。Bloomberg 这篇报道没披露具体投资人、交易条款和时间表,所以不知道这轮是谁领投、有没有附带对赌条件。9650 亿这个估值接近万亿,放在 AI 行业里是个很夸张的标价,但正文没解释估值模型怎么算出来的,也没提收入、利润或用户规模来支撑这个数...

推荐理由:Bloomberg 报道 Anthropic 拿了 650 亿美元,估值冲到 9650 亿美元,把 OpenAI 甩在后面。投资方和条款都没披露,但光这个体量就够当天 AI 融资圈的头条了。

5月28日星期四

AI HOT 精选

OpenAI 发布前沿治理框架,把内部安全做法对接到加州和欧盟的新规上

OpenAI 发了一份公开文件,解释自己的安全措施怎么满足加州《前沿 AI 透明度法案》和欧盟《通用 AI 行为准则》的要求。框架覆盖了网络攻击、生化风险、恶意操控、失控等场景的风险评估和缓解,也提到了模型报告、安全风险管理、事件响应和外部专家参与。但正文没给出具体的评估指标、落地时间表,也没列出哪些模型算“前沿模型”。我会先打个折:这更像一份合规说明...

推荐理由:我会先打个折,因为正文没给评估指标、时间表和模型名单,信息缺口不小。但 OpenAI 主动对齐欧盟和加州新规这件事本身有信号意义——说明头部实验室在提前卡位监管预期,对做安全合规和模型发布排期的团队是直接相关的。这点先别太激动,等具体指标出来再重新判断。

AI HOT 精选

Cognition AI 拿了超 10 亿美元,投前估值 260 亿,想把软件工程师效率提 10 倍

Cognition AI 新融了超过 10 亿美元,投前估值 260 亿美元。它的年化收入一年里从 3700 万美元涨到约 4.92 亿美元,涨了十几倍。核心产品 Devin 被定位成能自主干活的初级工程师,不是只补代码,而是能自己规划、测试、部署,走完多步骤流程。公司不绑死一家模型,既用自己的模型,也接 OpenAI 和 Anthropic 的大模型...

推荐理由:这条消息硬数字够多,估值和收入增速都摆在那,Devin 的定位也从“写代码助手”变成了能自己规划、测试、部署的初级工程师,对从业者的冲击感很直接。不过信息源单一,正文没披露具体投资方和估值计算细节,所以没给到行业地震级的高分。

AI HOT 精选

OpenAI 产品现在能直连你内网的 MCP 服务器了

OpenAI 给 ChatGPT、Codex 和 Responses API 加了个能力:可以走纯出站 HTTPS 去调你团队放在内网的 MCP 服务器。服务器不用暴露到公网,模型这边只往外发请求,不接收入站连接。正文没提延迟和鉴权细节,实际部署前最好先测一下链路稳定性。

推荐理由:我会先打个折:正文没披露权限控制怎么配、收不收费、什么时候全量推,这些缺口让实际落地还有变数。但方向很明确——让模型直接进公司内网干活,而且用仅出站 HTTPS 绕过了安全团队最头疼的入站暴露问题。对正在评估 AI agent 接内部系统的团队来说,这是个值得马上跟进的消息。

AI HOT 精选

Anthropic 和 OpenAI 把编程助手从包月套餐改成按量收费,我觉得他们终于找到赚钱的感觉了

Simon Willison 发现,从 2026 年 4 月起,Anthropic 和 OpenAI 悄悄把企业版编程助手(Claude Code/Cowork 和 Codex)的收费方式从固定座位费改成了按 API 调用量计费,跟直接买 token 一个价。他自己一个月用这些工具烧掉的 token 折合 2180 美元,但个人套餐只要 200 美元,...

推荐理由:这篇不是官方公告,是一篇行业评论,但它抓的点很实在:Anthropic 和 OpenAI 在 2026 年 4 月前后把编程智能体的收费从打折卖席位改成按 API 调用量算钱。我会先打个折——正文没给出具体定价数字或客户迁移数据,所以“找到产品市场契合点”更多是作者基于计费模式转向的判断,不是有财报支撑的结论。但这点本身对从业者有用,因为它直接关系到采购和用量评估。整体属于有观点、有信息缺口、但不虚的评论,放在 featured 档位合理。

5月27日星期三

The Verge · AI

AI 公司砸钱想埋掉这个政客,结果反而让他出了名

OpenAI 和 Anthropic 这两家死对头,正通过各自的超级政治行动委员会(Super PAC)在纽约第 12 选区民主党初选中烧钱打仗。被集火的对象是候选人 Alex Bores,他因为提出过一份对 AI 公司不太友好的监管法案,从 2025 年底开始就遭到由 OpenAI、Palantir 和 a16z 高管资助的团体“引领未来”砸下数百万...

推荐理由:我会先打个折:正文没披露 Anthropic 和 OpenAI 具体各投了多少,只说围绕 AI 监管权在 6 月初选前投入数百万美元。但这条值得上 featured,因为故事的反转本身就够抓人——AI 大佬们砸钱想干掉一个纽约州议员候选人,结果反而帮他做了宣传。对从业者来说,这比干巴巴的政策分析更直观地展示了 AI 公司现在怎么用钱影响立法,以及这种操作可能翻车。

AI HOT 精选

Runway 发布 MCP 服务器,让 Claude、ChatGPT 这类助手能直接在对话框里帮你生图和剪视频

Runway 推出了一个 MCP 服务器,相当于给 AI 助手装了个插件,让 Claude、ChatGPT、Cursor 等工具能在聊天窗口里直接调用 Runway 的模型生成图片和视频。你不用再切换软件,给助手扔一个商品链接、一张参考图或一段文字描述,它就能把成品返回到同一个对话框里。这次接入的模型包括 Gen-4.5、Seedance 2.0、GP...

推荐理由:这条消息的钩子很直接——Runway 的视频能力进了程序员和创作者天天用的对话工具。技术上不是模型突破,而是集成方式变了,MCP 服务器当中间人,让多个模型被一个入口调度。对从业者来说,这比单纯发个新模型更贴近实际工作流,所以 HKR 三项都成立。不过正文没提延迟、并发限制和计费方式,实际体验还得观望。整体算一次产品整合更新,重要性给 76 分,放在 featured 里合理。

量子位 · 公众号

7B小模型在医学影像理解上跑赢o3和GPT-5,靠的是教会模型“看哪里、怎么看”

上海创新研究院的LeapQuest和三所大学搞了两个医学AI系统Ophiuchus和MedScope,核心思路是让模型在看图看视频时学会像医生一样先定位关键区域再分析。Ophiuchus-7B在8个医学视觉问答基准上拿了68.0分,比OpenAI-o3的62.2、Gemini 2.5 Pro的61.8和GPT-5的59.9都高。正文没披露具体参数量以外...

推荐理由:我会先打个折:标题里 GPT-5 目前没公开评测数据,更像噱头,但 7B 模型在医学 VQA 上跑赢 o3 这个事实本身够抓人。正文给了 8 个 benchmark 的平均分对比,信息量撑得起 featured。不是通用大模型发布,分数定在 80 合理。

纽约时报中文网

谷歌怎么从 AI 掉队变成领跑的?

两年前谷歌的 AI 还在建议人吃石头、往披萨上抹胶水,现在它的聊天机器人 Gemini 月活用户已经冲到 9 亿,跟 OpenAI 自报的 ChatGPT 用户数打平。谷歌没把 Gemini 当独立产品养,而是直接塞进 Gmail、地图、Google.com 这些每天被几十亿人用的服务里,连苹果 Siri 未来的底层技术也换成了它,等于 Gemini ...

推荐理由:HKR三项全中。文章用逆袭主线把谷歌从掉队拉到能打的位置,钩子够强;9亿用户、770亿广告收入、Siri合作这些数字和信息量扎实,不是空谈;对从业者来说,模型竞争格局和分发渠道的变动直接关系工作判断,相关性高。整体是产业分析而非模型发布,放在78-84分档合理。

Computing Life · 鸭哥

用好AI的第二步:先写Skill再执行

作者提出一个反直觉但关键的工作习惯:让AI干活前,先把成功标准、踩过的坑和固定工具写成一个Skill文档。因为AI没有记忆,每次新对话都是白纸一张,不把经验外化落盘,它下次还会犯同样的错。文章解释了为什么程序员反而容易掉进“只有代码才能复用”的陷阱,并给出Skill的三个要素:描述最终想要什么而不是微操步骤、只记录AI真正犯过的错、提供确定性的工具调用...

推荐理由:这篇文章没讲新模型或产品能力,也没给实验数据,但“先写 Skill”这个动作把 agent 工作流从一次性尝试变成了可积累的资产,对日常用 Claude Code 或类似工具的人有直接参考价值。三个 Skill 要素讲得清楚,复用方式也具体,所以放在 featured 档。

AI HOT 精选

Anthropic 工程师称 Claude Mythos 用“巧妙简洁的证明”解开了 OpenAI 此前攻克的 Erdős 数学猜想

Anthropic 工程师 Sholto Douglas 在 X 上说,Claude Mythos 用一个“巧妙简洁的证明”解决了 Erdős 单位距离猜想,而 OpenAI 前不久刚把这个问题当作 AI 数学推理的里程碑。团队的做法是把问题丢给多个独立的 Claude Code 实例,让它们各自找解题路径,再汇总分发,Mythos 经常走出和 Ope...

推荐理由:HKR 三项都成立:标题自带反差,信息点具体,又牵动前沿推理模型的竞争格局。但正文没披露证明内容、验证方式、Mythos 是否已发布,所以只能放 featured,不能上 P1——我会先打个折,等看到证明再说。

5月26日星期二

AI HOT 精选

SynthID 水印覆盖超千亿条内容,OpenAI、ElevenLabs 等也将接入

Google DeepMind 说 SynthID 已经给超过 1000 亿条内容打了水印,现在要把这套技术塞进 OpenAI、ElevenLabs 和 Kakao 的模型里。之前他们跟 NVIDIA 合作推过一轮,这次算是把更多大厂拉进来一起做 AI 内容溯源。不过正文没提具体怎么集成、水印在不同模型上会不会影响输出质量,也没说这 1000 亿条里有...

推荐理由:这条消息有实打实的数字(超千亿条)和明确的合作方名单,不是空泛的声明。OpenAI 集成 SynthID 这个点比较意外,能打破常规叙事。不过正文没展开技术细节和具体效果,更像一次合作进展通报,所以分数到 82 就差不多了,再高需要更强的独家信息或验证数据。

新智元 · 公众号

OpenAI 总裁回忆:奥特曼被罢免当天我就辞职了,起初觉得夺回公司只有一成胜算

Greg Brockman 在采访里复盘了 OpenAI 那场 72 小时宫斗。2023 年 11 月 17 号,董事会突然撤掉 Sam Altman 的 CEO 职位,同时把 Brockman 踢出董事会。他当天就辞职了,说当时估算把公司拿回来的概率只有 10%。正文因为微信页面需要验证,没能抓到更多细节,比如董事会具体用什么理由动手、员工联名信怎么...

推荐理由:这篇是 Brockman 对 2023 年 11 月那场宫斗的亲身复盘,不是第三方转述。他给出了辞职时间点和 10% 概率这两个新细节,对理解当时董事会决策的混乱程度有帮助。不过事件本身已经过去一段时间,信息增量集中在个人视角而非技术或产品层面,所以重要性停在 76 分这个区间是合理的。

纽约时报中文网

教宗发了一份4万多字的人工智能通谕,直接对硅谷的“技术救世主”心态说不

教宗良十四世发表了首份通谕《崇高人性》,全文42300字,核心就一个意思:AI会放大有钱、有技术、有数据的人手里的权力。他警告,如果任由少数人把他们的道德观塞进AI系统,变成看不见的底层规则,那会是一场灾难。文章没点名,但指向很明确,就是硅谷那些科技巨头。有意思的是,通谕发布时还邀请了自称“善良AI”的Anthropic联合创始人站台,说明教宗不是要砸...

推荐理由:这篇不是讲模型或产品,而是从外部权力视角给 AI 行业泼冷水。教宗用一份 42300 词的通谕,把 AI 的风险归结为资源、专业知识和数据会进一步向强者集中,这个判断本身比很多行业报告更直白。我会先打个折:正文没披露具体监管建议或技术细节,所以它更像一记舆论重锤,而不是可操作的路线图。但考虑到它罕见地把宗教权威拉进 AI 安全讨论,而且直接点名 Anthropic 和 OpenAI,对从业者反思安全责任和平台权力有刺激作用,给 78 分放在 featured 是合适的。

AI HOT 精选

OpenAI 被曝下月发 GPT-5.6,上下文窗口拉到 150 万 token

开发者在 OpenAI Codex 的后台日志里挖出了一个叫 iris-alpha 的未公开模型,对应 GPT-5.6,可能 6 月发布。最直观的变化是上下文窗口涨到 150 万 token,比现在 GPT-5.5 API 的 105 万多出约 43%。有人在辅助工具 OpenCode 里实测,喂到 90 万 token 还能流畅回话,甚至能处理超过 ...

推荐理由:这条消息来自 Codex 日志泄露,不是官方公告,所以我会先打个折。但 150 万 token 的上下文窗口和 iris-alpha 代号都是实打实的数字,对做 agent 和长文档处理的人有直接参考价值。正文没提发布时间和定价,这点先别太激动。整体属于值得从业者扫一眼的更新,但还没到必须立刻行动的程度。

5月24日星期日

AI HOT 精选

格雷格·布罗克曼亲述:差点让 OpenAI 散伙的那 72 小时

OpenAI 联合创始人兼总裁格雷格·布罗克曼在这期播客里,第一次详细讲了公司最惊险的一次内部危机。他回忆了 Sam Altman 被董事会解雇后,自己接到电话时的场景、当天就辞职的原因,以及第二天在 Sam 家里策划“凤凰”备份公司的经过。转折点出现在 Ilya Sutskever 发了一条推文之后。除了这场风波,他还聊了 OpenAI 早期在纳帕谷...

推荐理由:我会先打个折:标题很抓人,Brockman 作为内部人出来讲“差点覆灭”的故事,天然有传播力,所以 H 和 R 都过了。但正文没披露任何实质内容——时间线、谁做了什么、怎么收场的,全都没说,K 完全站不住。整体只能放在 featured 底线,等后续有细节再升级。

5月23日星期六

AI HOT 精选

Anthropic 最快下周完成超 300 亿美元融资,估值将反超 OpenAI

彭博社援引知情人士消息,Anthropic 的新一轮融资最快下周敲定,总额预计超过 300 亿美元,公司估值可能突破 9000 亿美元,直接超过 OpenAI。这轮融资推进很快,几周内就从收到提案走到了谈判尾声,但正文没披露具体领投方和条款细节。公司同时给出了很猛的收入预期:第二季度营收 109 亿美元,比上季度翻了一倍多,并且有望首次实现季度盈利;年...

推荐理由:HKR 三项全中:彭博社报的 300 亿+ 融资、9000 亿+ 估值和 109 亿 Q2 营收预期,让这条消息成了当天 Anthropic 资本赛道的核心故事。不过交易还没正式落定,所以重要性压在 85-94 这个区间。我会先打个折——正文没披露这轮融资的具体条款和投资人名单,估值反超也只是“有望”,别太激动。

彭博科技

Anthropic 最快下周完成超 300 亿美元融资,估值冲到 9000 亿以上

彭博社援引知情人士消息,Anthropic 计划最快下周关闭一轮超过 300 亿美元的融资,投后估值超过 9000 亿美元。这个数字会让它超过 OpenAI,成为全球最值钱的 AI 创业公司。不过正文被 Bloomberg 的机器人验证墙挡住了,具体条款、投资方和资金用途都没披露。

推荐理由:彭博说 Anthropic 最快下周就能把这轮超过 300 亿美元的融资关掉,投后估值冲到 9000 亿美元以上,按这个数字它会超过 OpenAI 成为估值最高的 AI 初创公司。我会先打个折:正文没披露具体投资人、资金用途和估值计算方式,而且交易还没落袋,所以重要性停在 91 分,没往 95 以上推。但这条消息本身够直接——钱、时间、排名三个要素都给了,对关注前沿实验室资本动态的人就是一条硬消息。

5月22日星期五

MIT Technology Review · AI

Google I/O 暴露了 AI 做科研的两条路:专用工具还在用,但资源正流向通用智能体

Google I/O 上,DeepMind 的 Hassabis 一边用“我们正站在奇点的山脚下”这种大词,一边展示的是 WeatherNext 提前预警飓风救了人命。这正好点出了 AI 做科研的两条路线:一条是像 WeatherNext、AlphaFold 这种专为解决某个科学问题训练的专用工具;另一条是让通用大模型像智能体一样自己搞研究。现在资源明...

推荐理由:我会先打个折:这篇是 MIT Technology Review 的评论,不是一手技术报告,所以细节有限。但它的判断站得住——Google 把科学 AI 的牌子从 AlphaFold 那套单独炫技,换成 Gemini for Science 这个统一入口,还塞进了 AI Co-Scientist 和 AlphaEvolve 两个组件,并且开放申请。对做 AI 应用的人来说,这比发一篇论文实在,因为能摸到产品了。不过别太激动,正文没披露这套东西的算力成本、实际科研产出对比,也没说普通团队用不用得起,所以目前更像一个方向牌,不是落地手册。

AI HOT 精选

OpenAI Codex 的 /goal 模式转正了,现在可以给 AI 派跨小时甚至跨天的长任务

OpenAI 把 Codex 里的 /goal 模式从实验功能升级成了稳定版。你可以在 Codex 应用、IDE 插件或命令行里用,设定好里程碑后,AI 会自己跑任务,持续几小时甚至几天。中间能随时查看进度、改方向或暂停。用之前要升级应用并打开这个功能(命令行或手动改配置文件都行),开启后在输入框就能管理任务,侧边对话可以看进度,不会打断主任务。正文没...

推荐理由:我会先打个折:文章只说了功能转正和多端支持,但没披露任务失败怎么恢复、资源消耗上限、以及哪些套餐能用。对想试的人,知道它能跑长任务就够了;对想上线用的人,信息缺口还很大。所以放在 featured 低段,等后续补上安全和成本细节再往上调。

Computing Life · Share · 鸭哥调研

OpenAI 的通用推理模型推翻了一个 80 年没人撼动的数学猜想

GPT-5 否证了 Erdős 在 1946 年提出的平面单位距离猜想。这个猜想说平面上 n 个点最多只能有约 n 对距离为 1 的点,80 年里数学家都信这个。模型没走证明路线,而是直接构造反例,用上了代数数论里跟几何八竿子打不着的工具,把单位距离对的数量推到了 n 的 1.014 次方。Fields 奖得主 Tim Gowers 审完证明说,如果是...

推荐理由:我会先打个折,因为正文没给论文、没给证明过程、也没说复现条件,信息缺口不小。但一个没专门练过数学的通用模型,推翻了一个 80 年没人动得了的 Erdős 猜想,还有 Fields 奖得主背书说能投顶刊——这个事实本身分量很重,属于当天就该推的消息。HKR 三项全中,重要性给 90 是合理的,再高就需要更多证据了。

AI HOT 精选

Codex 现在能远程操控锁屏的 Mac,手机就能指挥它干活

OpenAI 开发者账号发帖说,Codex 可以在 Mac 锁屏、屏幕关闭的情况下,通过手机安全地使用 Mac 上的应用。帖子没提权限边界、怎么收费、什么时候上线,我会先打个折——正文只给了一个文档链接,具体怎么实现“安全”也没展开。

推荐理由:HKR 三项全中:OpenAI Devs 给出了 Codex 操控 Mac 的具体条件,但正文没披露权限边界、价格和发布时间,所以重要性停在 82 分,没上 85+。我会先打个折——这个功能听起来很省事,但没讲清楚锁屏下到底能碰哪些文件、会不会被滥用,这点先别太激动。

彭博科技

SpaceX 向纳斯达克提交 IPO 申请,OpenAI 最快本周五跟上

Bloomberg 报道,SpaceX 已正式申请在纳斯达克上市,并在路演材料里画了一个 28.5 万亿美元的大饼,把业务从 AI 一路讲到了火星。同一天的消息还说,OpenAI 也在准备 IPO 文件,最快周五就会提交。视频本身是 Bloomberg 的每日科技节目,没有放出完整的招股书细节,所以估值、发行价和具体时间表都还没公开。

推荐理由:Bloomberg 这条稿子把 SpaceX 和 OpenAI 的 IPO 进度绑在一起报,信息密度很高。SpaceX 那边给了个 28.5 万亿美元的投资者叙事,数字很大,但正文没展开算这笔账的细节,我会先打个折看。OpenAI 这边最值钱的是“最快周五交表”这个时间点,比之前模糊的传闻进了一步,不过估值、募资规模、具体承销商这些关键信息都没披露,所以重要性到不了 90 以上。两条消息都是 Bloomberg 独家,来源可信,对关注 AI 和科技股的人有直接参考价值。

5月21日星期四

MIT Technology Review · AI

Anthropic 在伦敦办了一场开发者大会,近半数人举手说上周刚发过完全由 Claude 写的代码,而且很多人没看就直接上线了

Anthropic 在伦敦的 Code with Claude 大会上展示了一个趋势:开发者越来越愿意把写代码的活直接交给 AI。工程师 Jeremy Hadfield 在现场问谁上周发过完全由 Claude 写的 pull request(提交审核的代码改动),近一半人举手;再问谁没读代码就直接发了,大部分手还举着。Anthropic 说公司内部大部...

推荐理由:这篇 MIT Tech Review 的现场报道不是产品发布稿,但抓到了一个很实的信号:开发者已经在把 Claude 写的代码直接往仓库里合,而且不少人连看都不看。我会先打个折,这个数字来自活动现场举手统计,样本量和代表性都有限,不能直接推成行业常态。但“近一半”这个比例还是够高,说明在重度用户里,对 AI 代码的信任已经跨过了一道心理门槛。文章没给 PR 的复杂度或后续回滚率,这点信息缺口让判断只能停在“行为在发生”而不是“行为没问题”。整体适合放进 featured,因为它比功能更新更能让人停下来想一下自己的工作流。

The Verge · AI

马斯克告奥特曼:一场热闹,啥也没捞着

这案子表面上是马斯克指控 OpenAI 从非营利转营利时,糟蹋了他捐的钱,违反了慈善信托。实际上,更像是马斯克对奥特曼憋着一股火,想让他吃点苦头。陪审团最后认定马斯克起诉时已经过了诉讼时效,案子就这么结了。法庭内外都乱成一锅粥,有人偷拍被法官训斥,有人录音被赶出去,门口天天有抗议。庭审里最让人意外的是,OpenAI 前高管 Mira Murati 的声...

推荐理由:HKR 三项都踩中了:Musk 和 Altman 的恩怨有话题性,陪审团给出“诉讼时效已过”这个具体裁定,背后又是非营利转营利的治理老问题。不过正文对赔偿和后续法律动作都没提,事实偏薄,所以放在 featured 低位,没给到 78 分以上。

新智元 · 公众号

Anthropic 买下 SDK 工具商 Stainless,OpenAI 等客户得自己维护代码库了

Anthropic 把 Stainless 给收购了。Stainless 是一家专门帮公司自动生成和维护 API 的 SDK(软件开发工具包)的公司,OpenAI、Meta、Cloudflare 之前都是它的客户。收购之后,Stainless 会关掉它的托管产品,也不再给老客户提供后续支持。不过,之前已经生成的 SDK 代码所有权还归客户自己,只是后续...

推荐理由:我会先打个折:这不是模型发布或核心能力更新,所以分数不会顶满。但 Anthropic 这手挺狠,Stainless 是给 API 自动生成 SDK 的,全球据说四分之一开发者都在用,客户包括 OpenAI 和 Meta。收购后 Anthropic 直接要把托管产品关停,等于断了竞争对手一条现成的开发者工具链。正文没披露收购金额和具体关停时间表,但光是“断供 OpenAI”这个动作,就够让依赖这套工具的团队紧张一阵了。

Latent Space

OpenAI 用通用推理模型花不到 1000 美元,推翻了一个 80 年前的数学猜想

OpenAI 公布了一个内部通用推理模型(外界猜是 GPT 5.6)的成果:它找到了平面单位距离问题的新构造族,推翻了 1946 年 Erdős 提出的一个猜想。这个模型不是专门为数学训练的,就是普通的语言模型,但推理过程生成了约 125 页的总结。有外部观察者推测,这次运行只用了不到 32 小时,成本不到 1000 美元。数学家 Timothy Go...

推荐理由:HKR 三项都成立:一个内部推理模型声称驳倒了 1946 年的 Erdős 问题,输出约 125 页,这是很强的能力信号。不过成本和运行时间目前还是外部推测,正文没披露 OpenAI 自己的官方数字,所以分数没给到 95。

机器之心 · 公众号

智谱在千卡集群部署 ZCube,同样 GPU 推理吞吐提升超 15%

智谱把自研的 ZCube 通信方案用到了 GLM-5.1 的线上推理集群里,规模是千卡级别。它替换了原来的 ROFT 组网方式,但没动 GPU、软件栈和业务代码。效果上,吞吐量提升了超过 15%,首 token 延迟的 P99 下降了 40.6%,交换机加光模块的成本省了三分之一。正文没披露具体是怎么做到省硬件成本的,也没给更细的测试条件,所以这个 1...

推荐理由:智谱在 GLM-5.1 千卡推理集群上部署 ZCube,不增 GPU、不改代码就把吞吐提了 15%,首 token 延迟的 P99 降了 40.6%。这是纯工程层面的组网逻辑改动,不是模型能力升级,所以重要性给 81、放在 featured 里比较合适——对搞推理部署的人有用,但不会像新模型发布那样震动整个行业。

Hacker News 首页

OpenAI 最快本周五秘密提交 IPO 申请

CNBC 从消息人士处获悉,OpenAI 准备最早在本周五向 SEC 秘密递交招股书草稿。目前公开信息里没有估值、发行规模和上市时间表,Hacker News 上也只有 41 个赞和 2 条评论,讨论热度不算高。秘密提交意味着我们暂时看不到财务数据,也没法判断它到底能卖多少钱。

推荐理由:这条消息就一句话:OpenAI 可能最早周五秘密交表。我会先打个折——正文只有 CNBC 链接和 HN 上 41 分、2 条评论,没给出估值、募资额或上市时间,信息很薄。但“最早周五”这个时间点把事件拉到了眼前,对关注融资和股权的人冲击力够强,所以还是放在 P1。

AI HOT 精选

OpenAI 模型自己解了一道 80 年没搞定的平面几何题,用的还是数学家觉得走不通的路

OpenAI 的一个模型独立解决了 1946 年埃尔德什提出的“平面单位距离问题”。这道题近 80 年来大家一直觉得最优解长得像方格子,但模型搬出了代数数论里比较冷门的 Golod-Shafarevich 理论,找到了一整族效率更高的新构造,把老结论推翻了。这是 AI 头一回自己搞定一个数学核心开放问题,关键就在于它提出并完整执行了一条人类因为直觉上觉...

推荐理由:我会先打个折:目前只有一段摘要,没给模型名、没论文链接、没复现细节,也没第三方验证,所以别急着当定论。好消息是它把问题说得很具体——1946 年平面单位距离问题,还用 Golod-Shafarevich 理论给了一族更高效率的构造,说明不是随便蒙对的。对做推理方向的团队来说,这至少是个强信号,但正文没披露用了多少算力、有没有人工提示工程介入,这点先别太激动。

FT · 科技

Anthropic 快要有第一个赚钱的季度了

FT 的付费墙把具体数字全挡住了,正文没披露是哪个季度、营收多少、利润多少、按什么会计准则算的。标题说 Anthropic 即将实现首次季度盈利,比 OpenAI 和 xAI 都早一步。但看不到细节,这点先别太激动——不知道是运营利润还是算上了投资收益,也不知道收入是靠 API 调用还是靠企业大单撑起来的。

推荐理由:我会先打个折:正文只说了“有望”,没披露是哪个季度、赚了多少、营收规模多大,所以这更像一个方向性信号而不是实锤。但信号本身够尖锐——Anthropic 如果真比 OpenAI 和 xAI 先盈利,说明它在企业客户和 API 收入上可能跑得更务实,烧钱换规模的节奏也可能更克制。这点先别太激动,等具体财报出来再看是运营利润还是调整后的数字。

AI HOT 精选

OpenAI 最快本周五提交 IPO 招股书草案,目标 9 月上市

OpenAI 准备正式冲刺上市了。据 CNBC 消息,公司最快本周五就会向监管提交 IPO 招股书草案,CEO 奥特曼把上市时间定在了 2026 年 9 月。这次找的是高盛和摩根士丹利来操盘,都是科技公司上市的老手。之前马斯克的诉讼一度让上市计划悬着,现在官司输了,障碍暂时没了,节奏明显加快。OpenAI 目前在私募市场的估值超过 8500 亿美元,如...

推荐理由:我会先打个折:目前还是单一信源说的“预计提交”,不是已经公开的招股书,所以别当板上钉钉。但这条消息本身值得写——OpenAI 把上市时间表压到今年 9 月,估值顶着 8500 亿美元往上走,说明他们急着用公开市场解决算力和人才成本。正文没披露具体营收或盈利数据,也没说承销团除了高盛还有谁,这些缺口后面得盯着。

r/LocalLLaMA

HalBench 基准测试:用 3200 个带坑问题测了 4 个头部模型,看谁更会拒绝瞎编

一位开发者自己搭了个叫 HalBench 的测试,专门看模型在遇到“前提本身是错的”的问题时,是会顺着瞎编(谄媚)还是直接指出问题。他拿 3200 个这种带坑提示词跑了 4 个模型:Sonnet 4.6 平均分 0.565 排第一,最敢反驳;Gemini 3.1 Pro 0.339 垫底,更容易顺着错误前提往下编。分数越高,代表模型越能识别出问题里的假...

推荐理由:HKR 三项都成立:HalBench 有个清晰的定制评测钩子,3200 条提示加分数,话题踩在模型信任和安全评测的痛点上。来源只有 Reddit 一个帖子,基准本身也没经过外部验证,所以放在低 featured 档。

TechCrunch · AI

OpenAI 说这次真解决了一个 80 年的数学难题

OpenAI 声称他们的新推理模型推翻了一个自 1946 年悬而未决的几何猜想。七个月前他们刚因为类似宣称翻过车——当时说 GPT-5 解决了 10 个未解难题,结果被扒出只是找到了文献里已有的答案,前副总裁 Kevin Weil 只好删帖。这次不一样的地方在于,上次揭穿他们的数学家这回站到了 OpenAI 这边。不过正文没披露模型名字、证明细节和验证...

推荐理由:HKR 三项全中:OpenAI 加一个 80 年历史的几何猜想,是个可验证的硬核推理声明。但正文没给模型名、没给证明细节、也没说怎么验证的,所以先别太激动,暂时到不了 P1。

TechCrunch · AI

OpenAI 重启 IPO 筹备,最快可能在 9 月上市

马斯克起诉 OpenAI 的官司刚输掉一天,OpenAI 就重新启动了上市准备。据华尔街日报的消息源,CEO Sam Altman 希望公司能在 9 月前达到上市状态,目前已经在跟高盛和摩根士丹利合作,可能几天或几周内就会秘密提交 IPO 申请文件。不过,这篇报道没披露估值、承销商名单和具体的上市时间表。另外,SpaceX 的 IPO 文件也快公开了,...

推荐理由:我会先打个折:标题说最早 9 月 IPO,但正文没披露估值、承销商或招股书时间表,所以这更像一个推进信号,还不是板上钉钉的上市公告。不过,消息在马斯克败诉后一天恢复推进,时间点很微妙,能让人联想到 OpenAI 在治理和资本化上的紧迫感。对从业者来说,这关系到 OpenAI 的钱袋子、公司控制权以及整个前沿模型赛道的烧钱节奏,所以值得关注。