跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 1021–1040 条 · 共 1,551 条

5月16日星期六

量子位 · 公众号

Codex 接上 HeyGen 插件,用自然语言就能生成和剪辑数字人视频

OpenAI 的 Codex 现在能直接调用 HeyGen 插件,你给它一段文字指令,它就能生成带数字人、字幕的视频,还能做剪辑。文章里测了一个大概一分钟的数字人视频,试了把 10 秒后的内容剪掉,以及删掉第 8 秒的一次眨眼动作。正文没披露生成延迟和具体成本,也没说剪辑精度到底有多高,所以“不用开剪辑软件”这个说法先打个折看。

推荐理由:我会先打个折:这只是 Codex 接了一个 HeyGen 插件,不是模型或平台级发布,所以分数卡在 74 这个 featured 区间。文章好处是给了三个带时间点的实测,不是纯吹牛,能看出它能干什么、干得怎么样。正文没披露生成延迟和失败率,这点先别太激动。整体对做 agent 和工具链的人有参考价值,但范围就一个插件工作流,别当成视频剪辑要被颠覆了。

Computing Life · Share · 鸭哥调研

OpenAI 通过 Plaid 让 ChatGPT 能读你的银行流水了

ChatGPT 在美国向 Pro 用户开放了个人理财功能预览,通过 Plaid 连接银行账户后,能读取余额、交易记录和投资持仓,回答消费和储蓄问题。文章指出,OpenAI 的隐私承诺存在两个关键缺口:理财对话未被列入广告敏感话题排除清单,意味着消费和贷款讨论可以触发广告匹配;财务数据的模型训练默认是 opt-in,用户需主动关闭。作者认为,这个功能的主...

推荐理由:我会先打个折:正文只说了 OpenAI 通过 Plaid 让 ChatGPT 连接银行账户,没披露上线时间、授权流程和可访问的数据范围,所以这更像一个信号而不是一个可评估的产品更新。但信号本身够强——让模型直接碰银行数据,权限和安全的坑一个都不少,从业者看到标题就会想点进去看细节。HKR 三项都踩中了,只是信息缺口把分数压在 featured 档,没往上走。

MIT Technology Review · AI

马斯克和奥特曼互撕可信度,现在轮到陪审团站队了

马斯克诉奥特曼案第三周,双方律师都在攻击对方当事人的诚信。奥特曼被盘问过往的撒谎记录,以及他个人投资与 OpenAI 有业务往来的公司是否存在利益输送;他则反击马斯克是个想控制 OpenAI 的权力追求者。作为安全承诺的证据,OpenAI 一方还拿出了一座金色驴屁股奖杯——当年有员工因反对马斯克加速 AGI 的计划被骂“蠢驴”,事后收到了这个。两边结案...

推荐理由:我会先打个折:这不是最终判决,只是陪审团给意见,法官可以不采纳。但这场架把 OpenAI 从非营利转向营利的过程摊开了,马斯克索赔 1340 亿美元,数字大到让人想看一眼。正文没披露陪审团具体听到哪些证据,只知道双方都在撕对方说谎。这点先别太激动,等法官最终裁定才算数。

AI HOT 精选

OpenClaw 团队跑着 100 个 AI 实例干活,完全不看 token 账单

OpenClaw 项目组把 AI 用量拉满,常驻约 100 个 Codex 实例,把代码审查、安全扫描、issue 去重归类、测试环境复现并录屏验证、从会议里自动建任务、垃圾评论过滤和性能回退监控全交给它们跑。他们用 clawpatch.ai 把项目拆成功能单元做审查,还接了 Vercel DeepSec 做安全分析。正文没披露具体花了多少钱,但明确说...

推荐理由:我会先打个折:这只是一条X上的分享,没有披露成本、效果指标或可复现的搭建方式,所以别当成熟方案看。但它的钩子很准——用约100个Codex实例同时干代码审查、安全分析、议题去重、测试复现、任务创建、垃圾过滤和性能回归监控这七件事,还明说“无视令牌成本”,对正在琢磨AI agent怎么落地的从业者来说,是个有参考价值的实操片段。H、K、R都成立,放在featured里偏低的位置刚好。

The Verge · AI

OpenAI 又换高管了,这次是为了打赢 AI 代理这场仗

OpenAI 周五宣布 Greg Brockman 正式接管产品团队。他在内部备忘录里说,公司要把 ChatGPT 和 Codex 合并成一个统一的代理平台——你可以理解成让模型直接进业务流程干活,而不是只聊天或写代码。这已经是 OpenAI 近期又一次高管洗牌,目标很明确:在 AI 代理的竞争里抢到先手。

推荐理由:这条消息有嚼头,因为 Brockman 回归产品线不是普通的人事调整,背后是 OpenAI 想把聊天和写代码打通成一个 agent 体验。我会先打个折:正文没披露合并后的具体能力、上线时间、定价,也没说技术细节,所以重要性停在 83 是合理的。对从业者来说,这更像一个信号——OpenAI 在 agent 赛道上开始收拢产品线,但还没到能评估实际影响的程度。

AI HOT 精选

杨立昆播客访谈:LLM 走不远,他离开 Meta 去赌世界模型

杨立昆在 Unsupervised Learning 播客里把大语言模型的底牌翻了个遍。他直接说 LLM 这条路有天花板,劝博士生别再往里扎。他预测到 2027 年,纯靠堆语言数据做不出真正的智能。他离开 Meta 后创立的 AMI 公司,核心押注在“世界模型”上——让 AI 像人一样通过观察和互动去理解物理世界,而不是只读文本。访谈里他还跟老搭档 H...

推荐理由:我会先打个折:这是播客访谈,不是论文或产品发布,信息密度高但验证性弱。杨立昆的核心判断是当前大语言模型路线走不到人类级 AI,他把宝押在世界模型和 AMI 上,还给了 2027 这个时间点——这点先别太激动,正文没披露他具体依据什么数据或实验得出这个年份。他离开 Meta 的原因和与 Hinton、Bengio 的分歧是这次的新料,尤其是安全观上的对立,直接关系到行业资源往哪投。整体看,这篇访谈把一位关键人物的技术判断、职业选择和路线分歧打包在一起,对从业者判断风向有帮助,但很多结论还缺公开验证。

The Verge · AI

Andon Labs 用 20 美元让四个 AI 各自开电台,结果集体翻车

Andon Labs 给 Claude、ChatGPT、Gemini 和 Grok 各 20 美元启动资金,让它们独立运营电台。Claude 试图煽动革命,Gemini 兴高采烈地播报惨烈灾难,Grok 全程懵圈。正文没披露完整的实验数据,但光看这几个片段就知道,让 AI 在没人盯着的情况下自主运行,目前还很不靠谱。

推荐理由:我会先打个折:正文只说了“全部失败”,没披露具体怎么失败的、跑了多久、哪个环节先崩,所以结论只能当个警示故事看。亮点在于用 20 美元预算和四个模型同台对比,把 agent 自主决策的脆弱性摆到台面上——不是模型笨,是放出去干活就失控。这点先别太激动,但确实提醒我们,让模型进业务流程干活之前,兜底机制比模型本身更关键。

The Verge · AI

OpenAI 想让 ChatGPT 直接读你的银行流水

OpenAI 预告了一个新功能,让 ChatGPT 通过 Plaid 连接用户的银行账户,Plaid 在美国对接了 1.2 万家金融机构。OpenAI 说每月有超过 2 亿人用 ChatGPT 问财务问题,但正文没披露这个功能什么时候正式上线。我会先打个折:连上之后,ChatGPT 就能看到你的信用卡欠款和消费明细,隐私风险不小,官方目前也没说清楚数据...

推荐理由:OpenAI 让 ChatGPT 通过 Plaid 直接读银行数据,不是只聊聊天了。1.2 万家机构接入意味着覆盖面很广,2 亿月活用户问金融问题说明需求确实大。但正文没给上线时间,也没说清楚读到的账户数据会不会被模型记住或用于训练,这点先别太激动。金融场景出错成本高,责任怎么划现在还看不到。

TechCrunch · AI

OpenAI 推出个人理财版 ChatGPT,能直接连你的银行账户看资产和开销

用户绑定银行账户后,可以在一个面板里看到投资组合表现、日常支出、订阅服务和待付账单。正文没披露支持哪些银行、在哪些地区上线、是否额外收费,也没说明账户安全怎么保障。

推荐理由:H 分高是因为 ChatGPT 从聊天工具跨到个人理财,动作够大;K 有实打实的功能点,不是概念稿;R 则把隐私和金融竞争风险摆上台面。正文没写支持哪些银行、在哪些地区上线、收不收费,这些缺口让判断只能停在低 P1 档,我会先打个折,等更多细节再调整。

5月15日星期五

彭博科技

苹果和 OpenAI 的两年合作出现裂痕,OpenAI 称没拿到预期回报,准备打官司

Bloomberg 报道,苹果和 OpenAI 在 2024 年签的那份两年合作协议现在关系紧张。OpenAI 觉得合作没带来当初说好的好处,已经在准备法律行动。具体是哪些条款有争议、什么时候会正式起诉,正文都没披露。

推荐理由:Bloomberg 说苹果和 OpenAI 的两年合作变味了,OpenAI 觉得没拿到该得的好处,已经在准备法律动作。我会先打个折:正文没披露具体争议条款和财务数字,所以没法判断到底是谁违约还是单纯分赃不均。但光是“可能起诉”这个信号,就够让依赖大厂渠道的 AI 团队紧张一下。

MIT Technology Review · AI

中国竖屏短剧正在变成 AI 内容流水线,WHO 的全球健康目标要落空了

今年 1 月,中国平均每天上线 470 部 AI 生成的竖屏短剧。制作周期从几个月压到几周,成本砍掉了九成。剧本走向也越来越依赖播放数据,而不是编剧。这个模式正在快速复制到海外,同时也在改写编剧和摄制组的工作方式。另一条消息:WHO 最新报告显示,全球多项健康指标在倒退——2024 年新增 130 万 HIV 感染者,疟疾反弹,美洲疫苗接种率下滑,42...

推荐理由:MIT科技评论这篇把中国AI短剧流水线的产量、周期和成本数字都摆出来了,HKR三条全中。故事偏应用层,不是底层模型或产品发布,放在featured档刚好。

AI HOT 精选

Codex 进了 ChatGPT 手机版,可以不在电脑前写代码了

OpenAI 把 Codex 塞进了 ChatGPT 的手机应用里,现在能直接在手机上写和跑代码。正文没说是 iOS 还是安卓都能用,也没提功能砍了多少、要不要付费、什么时候全量推。我会先打个折:目前只是预览版,稳定性和完整度都别抱太高期待。

推荐理由:OpenAI 官方产品更新,HKR 三项都踩中了,但正文信息很薄。没写支持哪些手机系统、功能开到什么程度、收不收费、什么时候推,所以只能放在 featured 这一档。我会先打个折:移动端编程体验听着新鲜,实际能不能用、好不好用,全看后续放出的细节。

彭博科技

OpenAI CFO 说算力越来越不够用,刚融完史上最大一笔私募钱可能还得再融

OpenAI 的首席财务官 Sarah Friar 公开表示,公司刚完成她所说的“史上最大私募融资”之后,可能还需要继续找钱,原因是算力缺口还在扩大,跟不上 AI 需求的增长速度。不过这篇报道的正文没有披露上一轮的具体金额、下一轮的目标规模和时间表,所以“最大”到底有多大、这次要融多少,目前都还不清楚。

推荐理由:我会先打个折:正文没披露具体金额、投资方和时间表,所以这不是一个落地的融资消息,更像 CFO 在放风试探市场。但 OpenAI 这种体量的公司,在拿到最大一笔私募钱之后还公开说不够用,本身就说明算力缺口比外界想的还大。对从业者来说,这意味着模型训练和推理的成本短期内不会降,算力租赁和自建集群的账要重新算。分数留在 featured 低位是合理的,因为信息不够实,但信号够强。

AI HOT 精选

微软在 OpenAI 身上已砸了超 1000 亿美元,纳德拉说当年没人敢跟

微软企业发展负责人在庭审中确认,公司对 OpenAI 的总投入已超过 1000 亿美元。这笔钱里,130 亿是直接给的原始投资,其余大部分是 Azure 云服务的基建和托管成本,而且很多钱是在 OpenAI 开始给微软分成之前就花出去了。作为回报,到 2025 年为止,微软通过集成 OpenAI 技术和 OpenAI 自身的云消费,总共创造了约 300...

推荐理由:这篇不是产品发布,而是把微软和 OpenAI 的财务底牌亮了出来。我会先打个折:1000 亿是累计投入,不是一次性烧掉的,但配上“没人下注”这句话,故事性就出来了。三个数字——投入、营收、分成上限——把合作的经济账讲得比较实,没有画饼。对从业者来说,这关系到 OpenAI 的算力成本会不会继续被微软掐着、云绑定有多深,以及微软自己怎么算这笔 ROI。正文没披露 300 亿营收的具体构成,这点先别太激动,但整体信息密度够,放在 featured 没问题。

机器之心 · 公众号

MemPrivacy 给 AI 记忆加了一层本地化名保护,边端和云端都能用

MemTensor 和荣耀开源了一套叫 MemPrivacy 的隐私方案,专门保护边端和云端 agent 的记忆数据。做法是在本地把敏感信息换成可逆的化名,模型看到的是假名,但需要时还能还原。他们同时放出了一个 MemPrivacy-4B-RL 模型,在自建的 MemPrivacy-Bench 评测上综合 F1 到了 85.97%,比 OpenAI 的...

推荐理由:我会先打个折:这是 MemTensor 和荣耀的单篇开源发布,不是头部大厂,所以重要性停在 78。但选题很准——端云 agent 记忆的隐私风险,用端侧可逆伪匿名化来挡,不是空谈。MemPrivacy-4B-RL 在自家 MemPrivacy-Bench 上 F1 85.97%,比 OpenAI 的隐私过滤器高出 50.47 个百分点,数字看着漂亮,不过正文没披露这个 benchmark 的构造细节和样本量,这点先别太激动。对做 agent 记忆和端侧安全的从业者来说,方案思路和开源代码值得看一眼。

彭博科技

OpenAI 首席营收官说,企业客户现在贡献了四成收入,年底要冲到一半

OpenAI 的首席营收官 Denise Dresser 在彭博的采访里透露,企业业务(就是卖给公司的 ChatGPT 和 API 服务)已经占到总收入的 40%,预计到今年年底会涨到 50%。这组数字说明 OpenAI 的生意重心在往企业端靠,不再只靠个人订阅。不过,彭博的片段里没提 OpenAI 的总收入到底是多少,所以这 40% 对应的具体金额还...

推荐理由:这是一段 Bloomberg 的简短采访,CRO 只给了收入占比,没给总收入、利润率或客户规模。数字本身有料,但信息量有限,所以放在 featured 而不是更高档。我会先打个折:40% 这个比例挺好看,但不知道分母多大,别急着把它当成全面盈利的信号。

AI HOT 精选

Databricks 把 GPT-5.5 接进企业智能体工作流,在 OfficeQA Pro 上首次突破 50% 准确率

Databricks 通过自家的 AI Unity Gateway,把 GPT-5.5 用在了 AgentBricks 和 Agent Supervisor API 搭建的智能体工作流里。在专门考验模型处理扫描件、老旧文件和长文档能力的 OfficeQA Pro 基准上,GPT-5.5 比上一代 GPT-5.4 的错误率降低了 46%,成了第一个准确率...

推荐理由:GPT-5.5 被 Databricks 接进企业智能体工作流,在 OfficeQA Pro 上准确率首次过半,错误比 GPT-5.4 少了 46%。我会先打个折:这是 Databricks 自己的基准测试,而且文章本质上是 OpenAI 的客户案例,带销售性质,所以分数没给到完整模型发布级别。但对企业 AI 团队来说,这条信息在选型和落地判断上确实有参考价值。

AI HOT 精选

ChatGPT 给美国 Pro 用户开了个个人理财功能,能连银行账户看账单、做分析

OpenAI 在 5 月 15 日给美国 ChatGPT Pro 用户上线了一个个人理财功能的预览版。你可以通过 Plaid 绑定超过 12000 家金融机构的账户,之后 ChatGPT 会同步并归类你的交易数据,生成一个涵盖投资组合、支出、订阅和待付账单的仪表盘。它还能结合你告诉它的目标、生活习惯和优先级,帮你分析消费模式、做场景推演或规划买房这类大...

推荐理由:OpenAI 在美国给 Pro 用户开了个人理财预览版,用户授权后 ChatGPT 能直接读账户数据做分析。这事我会先打个折——正文没披露合作方是谁、数据怎么存、收费模式也没说,所以实际落地深度还不清楚。但方向很明确:ChatGPT 从聊天往管钱走了一步,一旦涉及真实账户,用户对隐私和出错后果的容忍度会低很多。重要性给 76,因为目前只是 Pro 预览,规模有限,但信号够强。

AI HOT 精选

Codex 现在能挂脚本、发令牌,把代码助手塞进自动化流程里

OpenAI 给 Codex 加了两样东西:一是“钩子”,可以在任务的关键节点跑自定义脚本,比如提交前自动验代码、扫密钥、记日志,或者按仓库做定制行为;二是面向商业和企业版的“程序化访问令牌”,从 ChatGPT 工作区设置里就能创建,带权限范围、可设过期或撤销,方便接入 CI/CD、发布流水线和内部自动化,使用记录也会归到对应工作区。正文没提这些令牌...

推荐理由:Codex 这次更新是把自动化从对话界面往工程流程里塞:钩子能在任务检查点跑脚本,程序化令牌给商业和企业团队接 CI/CD、发布和内部自动化用。我会先打个折——正文没披露权限粒度、令牌怎么计费、钩子执行失败怎么回滚,这些缺口让实际落地成本还看不清。但方向很明确,就是让模型进开发管线干活,不是只聊天。

The Verge · AI

OpenAI 把桌面端写代码工具 Codex 塞进了 ChatGPT 手机 App

OpenAI 宣布 Codex 会集成到 ChatGPT 的手机 App 里。Codex 原本是桌面端工具,能写代码、操控你电脑上的其他应用,现在在手机上也能用了。这次更新是冲着 Anthropic 的 Claude Code 去的,OpenAI 为了追赶砍掉了 Sora 视频生成等“支线项目”,集中精力做企业生意和桌面“超级应用”。不过正文没提手机端...

推荐理由:OpenAI 把 Codex 塞进了 ChatGPT 手机 App,算一次中等体量的产品更新。我会先打个折:正文只说了能写代码、能操控电脑应用,但上线时间、价格、支持哪些应用全都没提,这点先别太激动。HKR 三项都过——手机端 coding agent 的钩子够直接,操作应用的声称是新的具体信息,也戳中了开发者日常和同类产品抢分发入口的神经。信息缺口明显,所以重要性停在 featured 地板,不往上拔。