跳到正文

#OpenAI

今日 45 条

5月21日星期四

FT · 科技

OpenAI 准备提交 IPO 申请,最快 9 月上市,目标估值 1 万亿美元

FT 这篇报道的正文被付费墙和安全验证挡住了,只拿到了标题和摘要。已知信息是:OpenAI 正在准备 IPO 文件,最快今年 9 月挂牌,目标估值冲到 1 万亿美元。承销商名单里有高盛、摩根士丹利和 Cooley 律所。但具体的发行条款、上市交易所、财务数据这些关键信息,正文没披露——或者说我们拿不到。1 万亿这个数字我先打个折看,毕竟现在连 S-1 ...

推荐理由:我会先打个折:1 万亿估值目标听着很吓人,但正文没披露这个数字是怎么算出来的,也没说收入、利润或用户增长的具体支撑,这点先别太激动。不过,FT 的报道把时间点、承销商和律所都点出来了,信息颗粒度够细,不是捕风捉影。一家基础模型公司走到 IPO 提交这一步,本身就是行业顶格的信号,所以重要性给到 95 没问题。

AI HOT 精选

ChatGPT 手机版接入 Codex,手机上问一半,回到电脑能接着聊

OpenAI Devs 发帖说 ChatGPT 移动端现在支持 Codex,你可以在手机 App 里提问,之后在桌面端继续同一个对话。帖子没提支持哪些平台、需要哪个 App 版本,也没说是不是逐步推送。

推荐理由:OpenAI Devs 是官方渠道,消息可信,HKR 三项都踩中了。但正文只确认了移动端能用 Codex 和跨设备接续对话,具体支持哪些平台、版本号、推送范围全都没提,所以信息量刚好卡在 featured 门槛上,先别当全量上线看。

Hacker News 首页

OpenAI 准备在近期提交 IPO 申请,高盛和摩根士丹利正在帮忙起草招股书

WSJ 独家消息说,OpenAI 已经在跟高盛和摩根士丹利的银行家合作,准备在未来几天或几周内秘密提交 IPO 申请,最快可能是本周五。正文没披露估值、募资规模和具体上市时间表。目前能看到的公开信息只有 Hacker News 上 25 个点赞和 5 条评论,市场反应还很小。

推荐理由:WSJ 放出的消息说 OpenAI 准备提交 IPO,但正文只给了 25 分和 5 条 HN 评论,没披露估值、募资规模或时间表。我会先打个折:这还不是正式申请,只是准备阶段,信息缺口很大。如果是真的,对行业资金流向和公司治理结构影响不小,但眼下缺关键数字,没法判断到底多值钱、多急迫。这点先别太激动,等更多细节出来再调权重。

5月20日星期三

AI HOT 精选

软银对 OpenAI 押注超 600 亿美元,内部担心孙正义对奥尔特曼是“追星式”信任

软银在 OpenAI 上的总承诺投资已超过 600 亿美元,持股超 10% 却没有董事会席位,连观察员席位都没拿到。部分高管私下担心孙正义把太多资本集中在一家公司身上,而且对奥尔特曼的信任近乎“追星”,下属提出极端风险问题时曾被不耐烦地驳回。软银为此卖掉了英伟达等资产,也没有投资其他竞品模型,这让一些内部人士联想到当年 WeWork 的灾难。目前 Op...

推荐理由:这条消息把软银对OpenAI的豪赌和内部质疑摆在一起,600多亿砸下去连个董事会席位都没换到,高管还觉得孙正义对奥特曼是粉丝心态,信息量够硬。对看AI投资的人来说,这既是资金面的信号,也是治理风险的案例,我会先打个折——正文没披露这600亿具体分几轮、什么条件,但光凭现有事实已经值得立刻推。

AI HOT 精选

OpenAI 给每家 YC 创业公司投 200 万美元 API 额度,换股权

OpenAI 要给 Y Combinator 当前批次的每家创业公司提供价值 200 万美元的 API 信用额度,不是现金,是直接抵扣调用 GPT 等模型的费用,换取一定股权。正文没披露具体占股比例、额度有效期和使用上限。这招有点像当年 Sam Altman 在 YC 当合伙人时,Yuri Milner 给每家创业公司投钱的打法,只不过这次 OpenA...

推荐理由:我会先打个折:正文没写股权比例、使用期限和额度上限,所以这笔账到底划不划算还不好说。但 OpenAI 直接拿 API 额度换 YC 系公司的股权,等于在早期就把自己嵌进一堆创业公司的技术栈里,锁客意图很明显。对缺钱的团队来说,200 万美元的 API 信用确实能省下一大笔早期推理成本,只是别忽略绑定的代价。这点先别太激动,等条款出来再算总账。

OpenAI News

OpenAI 一个没公开名字的模型推翻了一道 80 年的离散几何猜想

OpenAI 发了一篇博文,说他们内部一个通用推理模型自己解决了一道叫“平面单位距离问题”的数学难题,推翻了大家信了几十年的主流猜想。这道题是 Erdős 在 1946 年提出的,简单说就是平面上放 n 个点,最多能有多少对点距离刚好是 1。之前学界普遍认为正方形网格那种摆法已经接近最优了,但这个模型给出了一族新构造,把单位距离对的数量往上提了一个多项...

推荐理由:我会先打个折:正文没披露模型名称、证明机制和可复现条件,所以没法给更高分。但 OpenAI 模型推翻 80 年几何猜想这件事本身够新、够具体,也够有争议性,HKR 三项全中,85 分放在 P1 合理。

AI HOT 精选

大模型 API 的补贴期结束了,三家厂商开始涨价

Tomasz Tunguz 对比了 Google、OpenAI 和 Anthropic 三家最新旗舰模型的 API 定价,发现补贴正在退潮。Google Gemini 3.1 Pro 最便宜,输入每百万 token 2 美元、输出 12 美元;OpenAI GPT-5.5 短暂补贴后涨到输入 5 美元、输出 30 美元;Anthropic Claude...

推荐理由:Tom Tunguz 这篇是定价评论,不是模型首发新闻,但三家旗舰模型的价格摆在一起,差距够大,对从业者选型有参考价值。我会先打个折,给 featured 而不是 must-write,因为正文没披露补贴具体怎么算、能撑多久,判断还缺一手数据。

AI HOT 精选

Gemini 3.5 Flash 发布:价格涨了,但谷歌打算把它塞进所有产品里

谷歌在 I/O 大会上直接发布了 Gemini 3.5 Flash,跳过预览阶段。输入价格涨到每百万 token 1.5 美元,输出 9 美元,分别是上一代 Flash 预览版的 3 倍和 Flash-Lite 的 6 倍,已经快追上自家的 Pro 型号了。涨价不是谷歌一家的事,OpenAI 和 Anthropic 的新模型也都在提价,各家似乎都在试探...

推荐理由:我会先打个折:正文只给了价格和全面铺开的意图,没提能力提升、跑分或上下文窗口,所以没法判断涨得值不值。但涨价幅度本身对开发者是硬信号,值得放进精选。

AI HOT 精选

ChatGPT 图像生成周用量冲到 15 亿次,OpenAI 聊了聊 Images 2.0 带来的新玩法

OpenAI 发推说,现在大家每周在 ChatGPT 里生成超过 15 亿张图片。研究员 kenjihata、产品负责人 adele__li 和主持人 AndrewMayne 一起聊了 Images 2.0 上线后冒出来的新用法和趋势。正文没展开具体是哪些用例,也没给技术细节,就提了个数字和一场对谈。

推荐理由:我会先打个折:正文只给了 15 亿这个总数,没拆地区、模型版本或付费/免费比例,也没说 Images 2.0 具体改了啥。但光这个量级就够说明图像生成已经从尝鲜变成高频刚需,对算力规划和竞品压力都有参考价值。没有新能力或定价信息,所以分数停在 78 不往上拉。

彭博科技

软银内部对孙正义 600 亿美元押注 OpenAI 感到不安

孙正义在 OpenAI 上的总投资额达到 600 亿美元,这笔押注正在软银内部引发担忧。文章正文被付费墙拦截,没披露具体的交易条款、OpenAI 的估值、融资结构、是否已完成交割以及时间表。

推荐理由:Bloomberg 的信源和 600 亿这个数让标题、关键性和风险三项都过关,比普通融资传闻更有料。我会先打个折:正文没写条款、估值和时间表,所以没法给更高分。

彭博科技

软银孙正义押注 OpenAI 超 600 亿美元,内部有人觉得他对 Sam Altman 过于上头

软银已向 OpenAI 承诺投入超过 600 亿美元,部分内部人士对孙正义如此力挺 Sam Altman 感到不安。正文没披露具体交易条款、资金到位时间表,也没说有多少人表达了担忧,以及这些担忧在内部是否被正式讨论过。

推荐理由:我会先打个折:正文没披露具体的投资条款、时间表,也没说内部到底有多少人反对,所以很多判断还悬着。但 Bloomberg 能拿到“内部人士担忧”这种料,本身就说明 SoftBank 这笔超过 600 亿美元的押注在内部有争议。孙正义对 Altman 的个人投入被单独拎出来说事,这比单纯报一个融资额更有信号意义——它暗示了决策可能不够冷静,也把 OpenAI 的资本结构风险又翻了出来。这点先别太激动,但值得盯着后续条款和反对声浪会不会公开化。

TechCrunch · AI

马斯克告 Altman 偷了非营利组织,但庭审记录显示他自己当年也想过类似的事

陪审团很快就驳回了马斯克对 OpenAI 其他创始人和微软的诉讼。庭审记录暴露了马斯克一方的几个硬伤:他拖了太久才起诉,而且他早年发给 Altman 的邮件里,自己就提过要把 OpenAI 变成营利性公司、由他掌控。换句话说,他现在指责别人干的事,自己当年也盘算过。

推荐理由:我会先打个折:正文没披露庭审具体证据细节,只引了 TechCrunch 的复盘判断。但信息量够用——陪审团快速驳回、等待时间过长削弱案由,这两点本身就说明马斯克这轮法律攻势没站住脚。对 AI 从业者来说,这不是产品发布或架构调整,而是一份干净的法律事件复盘,所以重要性给到 80 没问题。

AI HOT 精选

OpenAI 卖算力期货:交钱锁定长期 GPU,正文没写价格和最低消费

OpenAI 上线 Guaranteed Capacity 服务,让客户提前锁定长期算力,避免高峰期排队。官方说法是帮企业在算力紧张时也能跑关键任务。但公告没披露价格、合同年限、最低配额,也没说锁的是哪种 GPU。我会先打个折——这更像给大客户吃定心丸,小团队暂时不用激动。

推荐理由:我会先打个折:正文没给价格、期限和容量配额,所以现在只能知道 OpenAI 开始卖算力预留,但不知道划不划算。H 来自 OpenAI 把算力稀缺变成一种可预订的服务,对 API 用户是个实在的钩子。K 只到产品名和规划机制这一步,缺关键商业细节。R 踩中了生产可靠性和预算规划这两个痛点,所以能进 featured,但信息缺口把分数压在中段。

TechCrunch · AI

Google 发布 Android CLI 1.0,让 Claude Code、OpenAI Codex 这类 AI 编程工具也能直接命令行开发安卓应用

Google 在 I/O 大会上把 Android CLI 推到了 1.0 稳定版。这东西是个命令行工具,主要作用是让各种 AI 编程助手(比如 Claude Code、OpenAI Codex,或者 Google 自家的 Antigravity)能直接通过命令行来构建安卓应用,不用非得打开 Android Studio 的图形界面。它内置了一个“an...

推荐理由:我会先打个折:正文没给版本号、发布时间,也没性能数据,所以只能当个信号看。但 Google 加 Android 加 agentic coding 这个组合,本身就够上 featured 线。它不是在秀技术指标,而是在开一扇门——让 agent 从命令行直接插手 Android 构建,这对移动端开发者的工作方式冲击不小。

TechCrunch · AI

OpenAI 给自家模型生成的图片加了两种防伪标记,查起来更方便了

OpenAI 宣布了两项措施来标记自家模型生成的图片。一是加入 C2PA 开放标准,在图片的元数据里直接写明“这是 AI 生成的”;二是把 Google 的 SynthID 水印技术集成到产品里,这是一种肉眼看不见的水印,想擦掉也没那么容易。这两招都只对 OpenAI 自家产品生成的图片生效,正文没提是否支持以前生成的老图,也没说具体什么时候上线。

推荐理由:我会先打个折:正文没写具体哪些产品上线、什么时候能用,也没说检测准确率或误判率,所以别当成熟方案看。OpenAI 这次做了两件事——一是加入 C2PA,相当于给图片贴上“数字出生证明”,记录谁、用什么工具生成的;二是在产品里塞进 Google 的 SynthID 水印,等于给图片打上肉眼看不见的标记,方便后续识别。有意思的是,OpenAI 没用自研方案,直接拿对手的技术来用,说明在图像溯源这块,行业更认开放标准而不是各搞各的。对从业者来说,这意味着以后做内容审核或平台合规,可能有一套更通用的检测路径,但前提是覆盖率和验证流程得跟上,这点先别太激动。

5月19日星期二

TechCrunch · AI

Andrej Karpathy 加入 Anthropic,负责 Claude 的预训练

Karpathy 这周已经入职,在 Nick Joseph 的团队做预训练——就是那种烧钱烧算力的大规模训练,用来给 Claude 打知识基础和核心能力。他之前在 OpenAI 是联合创始人,也管过特斯拉的 AI。目前公告没提他的具体职位、汇报线和合同细节,只说了他会在 X 上发帖表示看好接下来几年大模型前沿的研发。

推荐理由:HKR 三项全中:Karpathy 的 OpenAI 身份、Anthropic 预训练岗位、Claude 级别的大规模训练工作,让这条消息成了当天的人才战争故事。不过正文没披露职级、汇报线和加入时间,这些信息缺口我先标出来,别把这条当成全面的人事变动分析。

AI HOT 精选

Andrej Karpathy 加入 Anthropic,没回 OpenAI

Andrej Karpathy 在 X 上宣布自己加入了 Anthropic,要重新做前沿大模型研究。他之前是 OpenAI 早期核心成员,也主导过特斯拉 Autopilot,2024 年彻底离开 OpenAI 后去做了 AI 教育创业项目 Eureka Labs。这次选 Anthropic 而不是老东家,对 OpenAI 来说算是一次明显的人才流失。...

推荐理由:Karpathy 加入 Anthropic 是前沿实验室一次高信号的人事变动。正文只确认了他入职,没写团队、职级和研究方向,信息缺口明显,所以分数卡在 85 这一档的低位。我会先打个折:别脑补他具体在做什么,但光凭他选 Anthropic 而不是回 OpenAI,就够圈内讨论一阵了。

AI HOT 精选

微软前高管开撕老东家:Copilot 付费用户实际使用率不到 3%,AI 投入产出严重倒挂

微软前 Windows AI 合作总监韦洛索跳出来说,微软又错过了一波浪潮。他列了几个扎心数字:2023 到 2025 年,微软靠和 OpenAI 的合作赚了约 300 亿美元,但搭进去的成本高达 1000 亿美元。更惨的是 Copilot,虽然到处预装,付费用户里真正在用的不到 3%。他还提到,微软在必应搜索上砸了重金做 AI 化,市场份额纹丝不动;...

推荐理由:这条料来自微软前高管,不是官方口径,所以我会先打个折来看。但他甩出的数字很具体:300 亿营收对 1000 亿成本,Copilot 付费使用率不到 3%。如果属实,说明微软这波 AI 投入目前回本压力巨大,Copilot 叫好不叫座的问题比外界想的严重。正文没披露这些数字的统计口径和时间范围,这点先别太激动。

AI HOT 精选

OpenAI 给 AI 生图加了双重防伪:一层是信息标签,一层是隐形水印

OpenAI 公布了一套内容溯源方案,主要做三件事。第一,他们正式拿到了 C2PA 标准认证,以后用 DALL·E、Sora 等工具生成的图片都会自带一份可验证的“数字出生证明”,记录是谁做的、怎么改的。第二,他们和 Google DeepMind 合作,在 ChatGPT、Codex 和 API 生成的图片里嵌入了 SynthID 隐形水印。这层水印...

推荐理由:我会先打个折:正文没提覆盖哪些格式、上线范围多大、检测准确率多少,所以实际效果还得等。但这件事本身有信息量——OpenAI 没有单押一种溯源方案,而是把行业里两个主流标准(Content Credentials 做内容凭证,SynthID 做隐形水印)一起用,还给了验证工具。对开发者来说,这意味着以后接 OpenAI 模型出图、出视频,可以有一套现成的溯源管道,不用自己从零搭。这点先别太激动,因为没披露准确率,水印被裁切或压缩后还能不能认出来是未知数。但方向是对的,尤其对需要向用户或监管证明“这东西是 AI 生成的”的产品,省了不少事。

新智元 · 公众号

AI 创业公司一年收入冲到 800 亿美元,Anthropic 反超 OpenAI,两家吃掉近九成

The Information 统计了 34 家头部 AI 创业公司的年化收入,加起来约 800 亿美元。OpenAI 和 Anthropic 两家就占了 89%,其中 Anthropic 到 2026 年 4 月年化收入已超过 300 亿,反超 OpenAI 对外报的 250 亿。不过原文因为微信环境验证拦截,正文没披露具体统计口径和收入确认方式,这...

推荐理由:这条消息的钩子很清晰——Anthropic 收入反超 OpenAI,同时两家垄断近九成份额,比单纯说“行业总盘子大”更有信息量。The Information 给出的 800 亿年化收入和 89% 集中度是新的具体数字,不是泛泛的趋势判断。对 AI 从业者来说,收入集中度比融资额更能反映商业落地现状,所以值得推。不过这是二手财务报道,不是模型或产品发布,重要性定在 82 合理。

纽约时报中文网

马斯克告 OpenAI 败诉,陪审团没讨论核心问题,直接以诉讼时效过期结案

马斯克在奥克兰联邦法院输掉了对 OpenAI 的官司。陪审团没有审理他关于 OpenAI 违背非营利使命、变成赚钱机器的指控,而是直接裁定诉讼时效已过,案子没法继续。庭审里倒是抖出不少料:OpenAI 总裁布罗克曼的股份现在值近 300 亿美元,已离职的联合创始人苏茨克维尔手里有 70 亿美元的股份,奥尔特曼本人虽然一直说自己没直接持股,但他在跟 Op...

推荐理由:我会先打个折:正文只说了陪审团以时效为由结案,没披露对 OpenAI 架构或融资有没有直接冲击,所以分数卡在 78–84 这个区间。标题里的“这意味着什么”正文其实没展开,别被带偏。亮点是时效抗辩直接掐掉三周审判,省了双方在庭上撕实质问题,但信息缺口也在这儿——判决后 OpenAI 会不会改章程、马斯克会不会换路子再告,都没提。

Computing Life · Share · 鸭哥调研

代码都开源了,AI 巨头为什么还要花几亿美金去买这些公司

Anthropic 半年内连买四家公司:Bun、Vercept、Coefficient Bio 和 Stainless,OpenAI 则拿下了 Astral 和 Promptfoo。这些被收购的产品几乎全是开源的,MIT 或 Apache 2.0 许可证,理论上谁都能免费 fork 一份自己维护。但文章指出,fork 只能拿到代码,拿不到原团队对复杂内...

推荐理由:我会先打个折:正文没披露价格和条款,所以没法判断这几亿花得值不值。但文章抓的点很准——开源不等于免费获取控制权,大厂买的是维护者、路线图和社区信任,这些 fork 一份代码拿不到。对从业者来说,这比单纯报收购名单更有信息量,只是缺硬数字支撑,所以放在 featured 偏低的位置。

FT · 科技

马斯克告 OpenAI 的官司输了,陪审团只讨论了俩小时

陪审团只花了两个小时就裁定马斯克败诉,Sam Altman 赢下一场法律胜利。不过这篇 FT 文章正文被付费墙挡住了,具体指控内容、法律依据和 OpenAI 上市计划的细节都没披露。

推荐理由:H 和 R 都很强,因为这是马斯克与 OpenAI 纠纷里的一个快刀斩乱麻式判决,戏剧性和关联度都够。K 这边我会先打个折,正文只给了“两小时败诉”这一个点,诉讼请求和判决理由全都没披露,所以认知增量有限,但作为新进展仍然值得标出来。

TechCrunch · AI

Anthropic 收购了 OpenAI、Google 和 Cloudflare 都在用的开发者工具公司 Stainless

Anthropic 买下了一家叫 Stainless 的纽约初创公司,这家公司 2022 年成立,专门做一件事:自动生成和维护 API 的 SDK(就是开发者用来调接口的代码库)。有意思的是,Stainless 的客户名单里本来就有 OpenAI、Google 和 Cloudflare 这些 Anthropic 的直接对手。收购价和具体整合计划正文都没...

推荐理由:我会先打个折,因为没公布交易金额和整合细节,没法判断这笔收购到底有多大分量。但钩子确实强:Stainless 的客户名单里躺着 OpenAI 和 Google,Anthropic 把它买下来,等于把对手用的工具收进自己口袋。技术上,Stainless 干的事是自动生成和维护 API 的 SDK,省得开发者手动写调用代码,对想推 API 的模型公司来说是个实在的基建。正文没写收购后 Stainless 还会不会继续服务其他客户,这点先别太激动。整体看,这事对关注开发者工具和 API 生态的人有信息量,但缺关键数字,所以到不了更高分。

彭博科技

马斯克告奥特曼想阻止 OpenAI 重组,陪审团没支持

陪审团驳回了马斯克对 Sam Altman 和 OpenAI 的指控,核心理由是马斯克拖得太久才起诉。马斯克原本想通过诉讼阻止 OpenAI 转向营利性架构,但报道没披露具体在哪个法院打的官司、马斯克要求了哪些补救措施,也没说 OpenAI 这次重组的具体条款是什么。

推荐理由:马斯克输掉这场官司,核心就一句话:陪审团觉得他告晚了。正文没写具体在哪个法院、马斯克要了多少赔偿、OpenAI 重组方案到底怎么改,所以信息缺口不小。但光是“起诉过晚被驳回”这个结果,已经够让关注 AI 圈权力格局的人讨论一阵了。我会先打个折,因为细节太少,没法判断后续会不会上诉或者对 OpenAI 架构产生实质影响。

The Verge · AI

马斯克诉 Altman 案陪审团裁定马斯克败诉

陪审团只讨论了约两小时就一致裁定马斯克败诉。他提的三项指控里,有两项因超过诉讼时效被直接挡掉,第三项也因关联指控被驳回而站不住脚。这个陪审团是咨询性质的,裁决本身没有法律约束力,但主审法官 Yvonne Gonzalez Rogers 已经接受了这个结果。正文没披露具体是哪几项指控,也没说马斯克会不会上诉。

推荐理由:我会先打个折:这不是模型发布或技术突破,所以分数不会往 90 以上冲。但马斯克输给奥特曼这个结果,既有名人官司的传播力,又带出了具体的裁决机制——陪审团两小时就定了,时效问题和咨询性质都写得很清楚。对从业者来说,OpenAI 的治理裂缝和创始人之间的法律账,本身就是一种行业风险信号。信息够用,不用补设定,78–84 这个区间合理。

TechCrunch · AI

马斯克告 OpenAI 和 Altman 的官司输了,陪审团一致认定他起诉太晚

加州九人陪审团一致裁定马斯克败诉,理由是他的起诉已经超过法律允许的时限。马斯克原本指控 Sam Altman、Greg Brockman、OpenAI 和微软“偷走了一家慈善机构”,说他们通过成立营利性子公司把原本非营利的 AI 实验室变成了赚钱机器。但陪审团没去深究这些指控是否成立,而是直接卡在时间门槛上:他们认为马斯克所说的那些伤害,发生得比他正式...

推荐理由:HKR 三项全中:马斯克和 Altman 的官司自带话题,陪审团一致裁决“提交过晚”是个硬事实,而且涉及 OpenAI 治理和 xAI 竞争关系。分数留在 82 没动,因为赔偿金额、会不会上诉、对产品有啥影响,正文全都没提,信息缺口摆在那。

5月18日星期一

AI HOT 精选

OpenAI 和戴尔合作,把 Codex 编程助手搬进企业的混合云和本地机房

OpenAI 宣布与戴尔合作,让 Codex 这个编程助手能跑在企业的本地服务器和混合云环境里,而不是只能连 OpenAI 的云端。Codex 现在每周有超过 400 万开发者用,企业已经拿它做代码审查、写测试、处理事故,甚至开始用它整理跨工具的信息、写报告、筛选销售线索。这次合作主要对接戴尔的两个现成基础设施:一个是管企业本地数据的 AI Data ...

推荐理由:我会先打个折:正文没披露上线时间、价格、地区和安全机制,所以现在只能当个方向性信号看。H 和 R 都很强——Codex 进本地机房,意味着企业可以把编程代理放在自己环境里跑,代码隐私和合规部署的想象空间一下子打开了。K 这边,合作本身是新的部署条件,但关键信息全缺,没法判断落地有多快、成本多高。综合下来,这条值得放在 featured 位置,但别急着下结论。

r/LocalLLaMA

用 4B 小模型搭了个编程助手,跑分冲到 87%,作者把方法全摊开了

作者用 Gemma 4 的 4B 参数模型做了一个叫 SmallCode 的编程 agent,在 100 道题的基准测试里解出了 87 道。核心不是模型本身,而是给模型配了一套复合工具:写完代码自动编译、跑 lint 检查,出错就根据报错信息改;同一个任务连续失败两次后,会自动把问题拆成更小的子任务再试。遇到实在搞不定的题,还能把任务转给 Claude...

推荐理由:这是一篇 Reddit 个人实验帖,不是正式论文。我会先打个折:基准测试的具体身份和复现细节没给全,87 分到底是在哪个测试集上跑的、对比基线是谁,正文没披露。但作者把做法讲得很实在——用复合工具、编译反馈当纠错信号、任务拆解策略,这些工程思路对想自己折腾小模型编程智能体的人有直接参考价值。信息有缺口,但第一手实验的干货够,放在 featured 档合适。

FT · 科技

OpenAI 的万亿美元 IPO 命运,现在握在奥克兰一个陪审团手里

FT 这篇付费文章只露了个标题和摘要,正文被订阅墙挡了。标题说 OpenAI 的 IPO 估值可能到 1 万亿美元,但 Elon Musk 的法律挑战可能搅黄它的商业化计划。具体开庭时间、IPO 条款、Musk 的诉求是什么,正文没披露。

推荐理由:FT 这篇标题把 OpenAI 的万亿美元 IPO 和奥克兰陪审团直接挂钩,冲突感很强,但正文其实只说了马斯克的法律挑战可能阻碍其商业计划,审理时间表、IPO 具体条款都没披露。我会先打个折:钩子够猛,信息密度不够,所以放在 78 分这档,不是必写级别。

5月17日星期日

Google DeepMind

Google 在 Search、Gemini、Chrome 和 Pixel 扩展内容溯源与验证工具

Google 宣布在 Search、Gemini、Chrome、Pixel 和 Cloud 扩展内容透明度与验证工具,并深化行业合作。SynthID 已为超过 1000 亿张图片和视频、60000 年音频嵌入水印,Gemini 应用中的 SynthID 验证已被使用 5000 万次,该能力今日扩展到 Search、未来几周进入 Chrome。

推荐理由:原文列出 SynthID 与 C2PA 在 Search、Gemini、Chrome、Pixel 的落地范围,可据此判断内容溯源工具的可用边界。

新智元 · 公众号

马耳他全民上完 AI 课,就能免费用一年 ChatGPT Plus

OpenAI 和马耳他政府合作,给全国公民送一年 ChatGPT Plus 会员,前提是得先修完马耳他大学的一门 AI 素养课。首批用户预计 5 月拿到权限,由马耳他数字创新局负责发放。正文没披露课程具体内容、时长和考核标准,也没说这笔钱是谁出、OpenAI 有没有给政府折扣。

推荐理由:我会先打个折:这不是模型能力更新,是分发策略。马耳他政府出钱,公民上课换 Plus,OpenAI 拿到一个全国范围的付费转化实验场。正文没披露政府付了多少、课程通过率要求、Plus 到期后是否自动续费,所以“全民免费”的实际成本和持续性还看不清。这点先别太激动,但把 AI 素养课和产品权益挂钩的做法,确实给其他小国或地区打了个样。

机器之心 · 公众号

AI Agent 的隐性账单:多花 1000 倍 token,效果未必更好

这篇文章本身因为微信环境验证没抓到正文,所以具体实验细节没法展开。但从标题和已有摘要能看出,研究团队用 OpenHands 跑了 8 个前沿模型在 500 个 swe-bench 编程任务上的表现,发现 Agent 模式下输入输出 token 比能到 154:1,而且人类标注的任务难度和实际 token 消耗之间关联很弱,Kendall tau 只有 ...

推荐理由:我会先打个折:这不是新模型发布,而是一篇基于轨迹数据的分析,所以放在 78–84 这个推荐区间是合适的。它的钩子很直接——token 花了一千倍,效果未必更好,这对正在给 coding agent 算账的团队来说,比单纯刷榜的新闻更有实际参考价值。文章给出了 OpenHands 在 500 个 swe-bench-verified 任务上的具体数字,154:1 的输入输出比和 0.32 的 Kendall tau,说明模型在排行榜上的名次和实际干活的表现相关性很弱。这点先别太激动,正文没披露不同模型各自的成本曲线,但至少把 agent 的隐性账单摆...

机器之心 · 公众号

龙虾之父自曝月烧130万美元token,账单OpenAI全包

Peter Steinberger 晒出后台数据,30天里跑了760万次请求,烧掉6030亿个token,账单超过130万美元。他提到关掉“快速模式”后费用直接砍了七成,而且这笔钱目前由 OpenAI 承担,他自己不用掏。

推荐理由:我会先打个折:这是个人晒账单,不是 OpenAI 官方调价,但 130 万美元这个数本身就够从业者心里咯噔一下。文章给了很实的用量——6030 亿 token、760 万次请求,还点出关掉快速模式能砍掉七成费用,对正在跑 agent 的团队有直接参考价值。不过正文没披露他具体跑了什么任务、模型怎么选的,也没说 OpenAI 为什么免单,这点先别太激动。整体更像一条带数据的成本警示,不是产品发布,所以放在 featured 刚好。

TechCrunch · AI

AI 淘金热的“有产者”和“无产者”

Menlo Ventures 的合伙人 Deedy Das 算了笔账,说现在 OpenAI、Anthropic、英伟达这类公司的创始人和员工里,大概有 1 万人已经靠股权攒下了超过 2000 万美元的退休级财富。与此同时,其他软件工程师正面临裁员,年薪天花板卡在 50 万美元以下,还焦虑自己练了一辈子的编程手艺在市场上越来越不值钱。有人吐槽,这轮热潮里...

推荐理由:这篇文章不是讲模型、产品或融资,就是一篇评论。HKR 三项都踩中了:财富差距的标题够抓人,1 万人、2000 万美元这个估算有料,工程师对裁员和技能贬值的焦虑也很真实。我会先打个折,它没有新数据或一手信源,就是转述一个估算,所以放在 featured 这个档位刚好。

5月16日星期六

TechCrunch · AI

OpenAI 联合创始人 Greg Brockman 正式接管产品策略,计划把 ChatGPT 和编程工具 Codex 合并成一个产品

Greg Brockman 不再只是临时管产品,现在正式接手 OpenAI 的产品方向。Wired 拿到的一份内部备忘录显示,他打算把 ChatGPT 和 Codex 打通,做成一个统一的体验,不再让聊天和写代码割裂。Brockman 在备忘录里说,这是为了集中精力押注“智能体未来”,同时在消费者和企业市场两边赢。OpenAI 对 TechCrunch...

推荐理由:我会先打个折:正文没给出合并后的具体功能边界、上线时间或灰度计划,所以这更像一个方向信号而不是产品发布。Brockman 回归产品线本身是强信号,但 Wired 的合并说法目前只有一句话,细节全缺,这点先别太激动。如果合并成真,等于把对话和写代码两条主线拧成一股,对开发者工作流冲击不小;但没看到落地前,只能当人事+路线图变动来理解。

AI HOT 精选

OpenAI 在 IPO 前夜大洗牌:Brockman 接管所有产品,三大业务线合并,全力押注一个能自己干活儿的桌面超级应用

OpenAI 把 ChatGPT、Codex 和 API 三个原本各自为战的团队合并成一个产品组织,由总裁 Greg Brockman 正式接管产品战略。ChatGPT 原负责人 Nick Turley 被调去管企业业务,消费者端换上了前 Instagram 副总裁。这次重组的目标是集中力量搞一个代号“Super App”的桌面应用,把聊天、写代码和还...

推荐理由:HKR 三项都成立:这是 OpenAI 顶层产品重组,覆盖 ChatGPT、Codex 和 API。正文只有一条摘要,信息量不算深,但属于当天必须写的新闻。Anthropic 估值 9000 亿美元这个数字正文没给出处,我会先打个折,不把它当核心事实用。

Latent Space

Cerebras 上市市值冲到 600 亿美元,CFO 说已经在跑 OpenAI 的万亿参数内部模型

Cerebras 这次 IPO 收盘市值 600 亿美元,算是给坚持做大芯片的团队一个交代。CFO Bob Komin 公开说他们已经在服务万亿参数级别的模型,点名了 OpenAI 内部用的 5.4 和 5.5 版本,想打破“只适合小模型”的标签。不过正文没披露这些工作负载占多少流量、延迟在什么水平、单 token 成本多少,也没提晶圆供应受限的具体影...

推荐理由:Cerebras上市冲到600亿美元市值,CFO Bob Komin放话说他们已经在跑万亿参数的模型了,还点名了OpenAI内部用的5.4和5.5。我会先打个折:正文没披露5.4/5.5的具体规模、训练成本或实际性能,也没说Cerebras在这类模型里占多大份额,所以“服务万亿参数模型”更像一张路线图门票,别直接当成收入证明。但这条消息把IPO热度、算力硬件竞争和前沿模型进展串在一起,对关注推理芯片和训练基建的人挺有嚼头。

Computing Life · Share · 鸭哥调研

OpenAI 通过 Plaid 让 ChatGPT 能读你的银行流水了

ChatGPT 在美国向 Pro 用户开放了个人理财功能预览,通过 Plaid 连接银行账户后,能读取余额、交易记录和投资持仓,回答消费和储蓄问题。文章指出,OpenAI 的隐私承诺存在两个关键缺口:理财对话未被列入广告敏感话题排除清单,意味着消费和贷款讨论可以触发广告匹配;财务数据的模型训练默认是 opt-in,用户需主动关闭。作者认为,这个功能的主...

推荐理由:我会先打个折:正文只说了 OpenAI 通过 Plaid 让 ChatGPT 连接银行账户,没披露上线时间、授权流程和可访问的数据范围,所以这更像一个信号而不是一个可评估的产品更新。但信号本身够强——让模型直接碰银行数据,权限和安全的坑一个都不少,从业者看到标题就会想点进去看细节。HKR 三项都踩中了,只是信息缺口把分数压在 featured 档,没往上走。

MIT Technology Review · AI

马斯克和奥特曼互撕可信度,现在轮到陪审团站队了

马斯克诉奥特曼案第三周,双方律师都在攻击对方当事人的诚信。奥特曼被盘问过往的撒谎记录,以及他个人投资与 OpenAI 有业务往来的公司是否存在利益输送;他则反击马斯克是个想控制 OpenAI 的权力追求者。作为安全承诺的证据,OpenAI 一方还拿出了一座金色驴屁股奖杯——当年有员工因反对马斯克加速 AGI 的计划被骂“蠢驴”,事后收到了这个。两边结案...

推荐理由:我会先打个折:这不是最终判决,只是陪审团给意见,法官可以不采纳。但这场架把 OpenAI 从非营利转向营利的过程摊开了,马斯克索赔 1340 亿美元,数字大到让人想看一眼。正文没披露陪审团具体听到哪些证据,只知道双方都在撕对方说谎。这点先别太激动,等法官最终裁定才算数。