跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 921–940 条 · 共 1,551 条

6月1日星期一

OpenAI News

OpenAI 封禁一批疑似来自中国的账号,这些账号用 ChatGPT 生成评论和漫画,干预美国科技政策与关税讨论

OpenAI 在 2026 年 6 月的威胁报告里披露,他们封掉了一批 ChatGPT 账号,这些账号很可能来自中国。操作者用简体中文写提示词、挂 VPN,让模型批量生成英文短评和政治漫画,主要攻击美国的关税、稀土、AI 和 5G 政策,并明确要求漫画里只能出现特朗普,不能出现中国或习近平。同一批账号还生成中文“水军”内容,攻击美国和以色列,放大反犹太...

推荐理由:OpenAI 自己发的威胁报告,把一起疑似来自中国的 AI 影响行动说得有鼻子有眼,手法、目标、规避策略全抖出来了。这事踩中了 AI 安全、地缘政治和内容审核三条敏感线,但本质上是一份安全事件通报,不是产品突破或技术论文,所以分数卡在 78 分这个区间,没往上走。

AI HOT 精选

OpenAI 成立机器人团队,由 Aditya Ramesh 带队,正在招硬件和系统工程师

OpenAI 发推宣布正式组建机器人团队,由 Aditya Ramesh 负责,目前开放全栈硬件、系统和 ML 工程师岗位。团队方向是软硬件协同设计,短期先帮技术工人干活,远期想给每个人配一台个人机器人。推文没写招聘规模和具体时间表,也没提预算或产品形态,我会先打个折——这更像是一个组队信号,离实际产品还有距离。

推荐理由:OpenAI 把机器人团队和负责人亮出来,是个明确的路线信号,所以 H/K/R 都成立。但产品形态、时间表和招聘规模正文都没提,我会先打个折,不放到 P1。

5月31日星期日

r/LocalLLaMA

PolyRange:一个防考题泄露、专测 AI 攻击能力的靶场,每次出题都不一样

PolyRange v1.0 把 OWASP 测试指南里的 12 大类、84 种攻击手法做成了动态靶场。它不靠固定题库,而是每次部署时让一个大模型现场生成新靶机和防守策略,分两档难度,最后用“AI 提交攻击结果、裁判机验证”的方式打分。整套环境一条命令就能在 Fly.io 或 Docker 上跑起来。正文没披露具体评测数据和成本,但思路很明确:防止模型...

推荐理由:PolyRange 把网页安全靶场做成了会自己换题的 agent 评测。每次部署由大模型新生成任务,不是死题库,防污染这点做得比较彻底。覆盖 84 个 WSTG 类、12 个 OWASP 类别,两档防御加 flag 判定,规则清楚。信息源单一,目前只有 Reddit 帖子,正文没披露实际跑分数据和 agent 通过率,所以分数先打 78,等有实测结果再往上调。

r/LocalLLaMA

不用改代码,让 OpenAI Codex 桌面客户端接任意模型和供应商

Reddit 用户 thibautrey 分享了一个三步走的方法:编辑 Codex Desktop 的 config.toml 配置文件,存好 API 密钥,再用一个叫 multicodex 的代理别名把 gpt-5.3-codex 这个模型名映射到 MiniMax-Latest。代理跑在本地 127.0.0.1:1455,会把返回的模型名伪装成 gp...

推荐理由:这是一条可复现的开发者操作流,不是官方发布。我会先打个折:正文没披露 MiniMax-Latest 的具体成本和延迟,也没说 proxy 稳定性如何,所以别急着在生产环境照搬。但 hook 很直接——不改代码就能在 Codex 桌面端用别的模型,配置细节也够落地,对想省钱或换模型的人有实际参考价值。

机器之心 · 公众号

微软开源 SkillOpt:像训练神经网络一样,自动优化给 AI 智能体看的技能说明书

微软放出了一个叫 SkillOpt 的开源框架,一周就在 GitHub 上拿了 3300 多颗星。它的思路挺直接:不改模型本身的参数,而是像做文本版梯度下降一样,自动迭代优化那些写给 AI 智能体看的“技能文档”。论文里的实验覆盖了 7 个目标模型、6 个评测基准和 3 种执行环境,总共 52 种组合,结果要么最好,要么并列最好。不过正文因为访问限制没...

推荐理由:微软开源的 SkillOpt 把 agent 技能文档当成可训练的文本参数,像训神经网络一样去优化技能描述,这个思路挺新鲜。我会先打个折:论文说在 52 个组合里做到最优或并列最优,但正文没披露具体对比基线和误差范围,这点先别太激动。不过一周 3.3k star 说明 agent 工程圈确实被技能维护和评估成本折磨很久了,一个能自动优化技能文档的工具,哪怕只是省掉一部分手工调 prompt 的活,也值得关注。

5月30日星期六

AI HOT 精选

OpenAI 放出一个实时翻译语音模型,70 多种语言输入,13 种语言输出

OpenAI 发了 gpt-realtime-translate,一个专门做语音翻译的模型。你对着它说 70 多种语言里的任意一种,它能直接用 13 种目标语言把语音播出来。OpenAI 说大模型虽然强,但特定任务还是得上专用模型。目前这个功能已经在智能眼镜上跑起来了,不过正文没披露延迟、准确率和具体硬件细节。

推荐理由:我会先打个折:正文没提延迟、定价和 API 开放时间,所以实际能不能用、贵不贵还不知道。但 OpenAI 把实时翻译塞进智能眼镜,70多种语言进、13种语言出,这个组合本身是个挺实在的进展,值得从业者看一眼。

彭博科技

OpenAI 在 IPO 承销银行名单里谈过要加花旗和摩根大通

彭博这条消息的正文被反爬页面挡住了,只从标题知道 OpenAI 跟花旗、摩根大通聊过,想把这两家加进自己的 IPO 承销团。至于聊到什么阶段、有没有正式给委托书、IPO 的估值和时间表,正文都没披露。这点先别太激动,目前能确认的信息就这么多。

推荐理由:标题说 OpenAI 在讨论把花旗和摩根大通拉进 IPO 承销团,但正文被 Bloomberg 反爬挡了,没拿到时间表、估值或银行具体角色。我会先打个折:这更像银行阵容的早期讨论,不是正式申报或定价,所以别当实锤看。HKR 三项都踩中,但信息缺口明显,重要性给 78 分、放 featured 是合理的。

AI HOT 精选

Codex 现在能远程操控你的 Windows 电脑了,目前还是早期体验

OpenAI 给 Codex 加上了 Windows 支持,你可以在手机上用 ChatGPT 应用启动、查看和指挥 Codex 在你 Windows 电脑上干活。官方说这是早期体验,正文没披露收费方式和具体开放范围,我会先打个折——稳定性、权限控制和延迟都还没经过大规模验证,别急着把重要任务全交给它。

推荐理由:OpenAI 给 Codex 加了 Windows 计算机使用功能,通过 ChatGPT 手机 App 来操控。正文交代了工作流程和早期体验状态,但没提权限、定价和推送范围,所以先放在 featured 这一档。

彭博科技

彭博称 Anthropic 估值冲到 9650 亿美元,超过了 OpenAI

彭博这条视频标题直接说 Anthropic 估值达到 9650 亿美元,并且超过了 OpenAI。但正文没披露这个估值是怎么算出来的、来自哪一轮融资、有没有附带对赌条款,也没说用来对比的 OpenAI 估值是哪个时间点的数字。所以这个“超过”暂时只能当个标题看,具体含金量还得等更完整的交易信息。

推荐理由:我会先打个折:标题里的 9650 亿美元估值很抓眼球,但正文实际上是个视频壳,没交代这个数字从哪来、是哪一轮、条款怎么定的,也没说跟 OpenAI 比的是什么口径。所以这条消息更像一个资本信号,而不是一份能核实的估值报告。对从业者来说,知道市场在给 Anthropic 标高价就够了,具体数字先别太激动。

彭博科技

Anthropic 拿了 650 亿美元,估值冲到 9650 亿,头一回超过 OpenAI

Anthropic 刚完成一轮 650 亿美元的融资,投后估值 9650 亿美元,数字上首次压过 OpenAI。领投方是 Altimeter Capital、Dragoneer、Greenoaks 和红杉资本,每家掏了超过 20 亿美元。这笔钱怎么花、用在哪些产品线上,正文没细说。估值涨得猛,但还没看到对应的收入或市场份额数据,这点先别太激动。

推荐理由:Bloomberg 报道 Anthropic 拿了 650 亿,估值冲到 9650 亿,领投方也点名了。如果这轮真关账,就是基础模型公司里最顶级的资本事件。标题、事实和情绪三个维度都拉满,放在 95 分以上没毛病。

5月29日星期五

纽约时报中文网

Anthropic 估值冲到 9000 亿美元,把 OpenAI 挤下最贵 AI 初创公司位置

Anthropic 刚拿了 650 亿美元新融资,投前估值 9000 亿美元,超过了 OpenAI 上一轮的 7300 亿。公司同时发了新旗舰模型 Claude Opus 4.8,在 Vals AI 的 vibe coding(用口语化指令写代码)基准上比自家前代高了 10%。Anthropic 说它的年化收入运转率已经突破 470 亿美元,主要靠 C...

推荐理由:Anthropic 靠 650 亿美元融资把投前估值推到 9000 亿,压过 OpenAI,这是基础模型市场格局的一次实打实变动。Opus 4.8 在 Vals AI 氛围编程基准上比前代提了 10%,正文没展开具体测试条件和误差范围,这点先别太激动,但至少说明模型在代码场景还在往上走。HKR 三项全中,NYT 信源也撑得住,放 p1 没问题。

新智元 · 公众号

Claude Opus 4.8 实测:高级工程师基准冲到 63 分,但高强度任务掉到 42 分,Max 用户几小时就撞速率墙

这篇来自新智元的实测文章目前页面被微信环境验证挡住了,正文内容没抓到。从标题和摘要信息看,Claude Opus 4.8 在 Extra-High 级别的高级工程师基准测试里拿了 63 分,比上一代 Opus 4.7 高出 30 分,这个涨幅挺夸张。但切换到 High 强度任务时分数掉到 42 分,说明模型在持续高压场景下稳定性还有问题。另外,每月 2...

推荐理由:Anthropic/Claude 相关度天然高,加上有实测跑分和配额吐槽,HKR 三项都站得住。钩子是强但贵且 High 档拉胯,K 有基准分和额度细节,R 直接戳中 Agent 场景下的成本焦虑。来源是媒体评测而非官方公告,所以定在 P1 低位。

AI HOT 精选

OpenAI 推出 Rosalind Biodefense,把最强生物模型交给审查过的开发者和政府做防疫

OpenAI 发布了一个叫 Rosalind Biodefense 的新项目,把 GPT‑Rosalind 这个专攻生命科学的前沿推理模型,开放给经过审查的开发者和美国政府合作伙伴,用来做生物防御和防疫准备。具体来说,开发者可以申请用这个模型去搭建流行病建模、早期检测、筛查、非药物干预等工具;政府侧则扩大了对公共卫生和生物防御任务的访问权限。首批合作方...

推荐理由:OpenAI 推出 Rosalind Biodefense,向审核过的开发者和美国政府伙伴开放 GPT-Rosalind 访问。正文没给模型大小、训练数据、评测基准和定价,所以没法判断实际防护能力有多强,也不知道成本。我会先打个折:这更像一次政策姿态和准入机制的发布,而不是一个能直接评估的技术产品。对从业者来说,值得留意的是生物安全方向的合规门槛和“可信访问”具体怎么落地,但别急着把它当成成熟的防御工具。

Latent Space

Anthropic 完成 650 亿美元 H 轮融资,估值冲到 9650 亿,同时发布 Opus 4.8 和动态工作流

Anthropic 今天放出了两个大消息。钱这边,他们完成了 650 亿美元的 H 轮融资,投后估值达到 9650 亿美元,领投方是 Altimeter、Dragoneer、Greenoaks 和 Sequoia。公司还首次披露年化收入已经超过 470 亿美元,这个数字去年 12 月才 90 亿,增速很猛。产品这边,他们发了 Claude Opus 4...

推荐理由:HKR 三项全中:这条把前沿实验室的巨额融资、新模型和代码工作流更新打包在一起。我按摘要里的 650 亿美元融资和 9650 亿美元估值来算,因为标题里的数字和正文对不上。

阮一峰的网络日志

Token 费用难以负担

OpenAI 员工晒出自己一个月的 Token 用量:760 万次请求,6030 亿 Token,按公开费率算价值 130 万美元。虽然他是内部员工不用掏钱,但这个量级让外界看清了一件事——如果放开让程序员用顶级模型,一个人一年光 Token 费就可能上亿人民币。换成国内便宜的开源模型,也要两三百万。Uber 今年头四个月就烧完了全年 34 亿美元的 ...

推荐理由:Peter Steinberger的CodexBar使用数据把Token费用问题算成了一笔明账:一个月760万次请求、6030亿Token,按预设费率估算价值130万美元。这个数字够具体,也够吓人,直接点出了AI编程工具在规模化使用时的成本压力。文章不是产品发布或模型评测,而是从业者的真实账单分享,对正在评估AI工具成本的团队来说,比任何公关稿都实在。

AI HOT 精选

技能提炼:让大模型写操作手册,小模型照着干活

作者 Tomasz Tunguz 分享了他用“技能提炼”让本地小模型跑个人工作流的做法。他会让 Opus 4.7、GPT-5.1 或 Gemini 3 Pro 这类顶尖模型,把处理邮件、管投资 pipeline、发博客等任务写成标准化的 SKILL.md 步骤文件,然后由本地运行的 Qwen 35B 或 Gemma 26B 一步步执行。这套系统基于 P...

推荐理由:这个技能提炼模式把大模型当教练、本地模型当执行者,思路清楚,对控制成本有实际意义。我会先打个折,因为文章没披露任何量化结果——不知道本地模型执行时会不会翻车,也不知道到底省了多少钱。这点先别太激动,等有数据再说。

FT · 科技

Anthropic 敲定 650 亿美元融资,估值超过 OpenAI

Anthropic 完成了新一轮 650 亿美元的融资,把公司估值推到了 9650 亿美元(含新到账的钱),这个数字已经超过了 OpenAI 的估值。不过这篇报道正文被付费墙挡住了,具体是哪些投资人、钱会怎么花、以及估值是怎么算出来的,正文都没披露。

推荐理由:这条消息分量很足。Anthropic 敲定 650 亿美元融资,投后估值 9650 亿,直接超过了 OpenAI 的估值,等于在资本层面完成了一次反超。我会先打个折:正文没披露具体投资方和资金用途细节,但光这个数字就说明市场对 Claude 这条路线下了重注。对从业者来说,这意味着算力军备竞赛还会升级,模型层的竞争远没到定型的时候。

彭博科技

Anthropic 拿了 650 亿美元,估值冲到 9650 亿,头一回比 OpenAI 还贵

Bloomberg 的视频消息说,Anthropic 刚完成一轮 650 亿美元的融资,投后估值 9650 亿美元,首次在估值上超过了 OpenAI。不过正文被 Bloomberg 的反爬机制挡住了,具体投资人、资金用途和估值计算方式都没披露。我会先打个折:9650 亿这个数字高得离谱,比很多科技巨头的市值都大,在没有看到完整条款和收入数据前,这点先别...

推荐理由:这条消息分量很重,但我会先打个折。650 亿美元融资和 9650 亿美元估值这两个数字确实能重新排定前沿 AI 公司的资本座次,标题里“超越 OpenAI”的说法也直接改写了双方较量的故事线。不过正文没披露投资方是谁、条款怎么签,也没说钱具体砸向算力还是收购,所以暂时不能给到顶格判断。如果是真的,这轮融资会让 Anthropic 在抢人和堆算力时手头宽裕很多,但没看到资金结构之前,先别太激动。

彭博科技

Anthropic 估值冲到 9650 亿美元,首次压过 OpenAI

Anthropic 刚完成一轮 650 亿美元融资,投后估值 9650 亿美元,数字上超过了 OpenAI。Bloomberg 这篇报道没披露具体投资人、交易条款和时间表,所以不知道这轮是谁领投、有没有附带对赌条件。9650 亿这个估值接近万亿,放在 AI 行业里是个很夸张的标价,但正文没解释估值模型怎么算出来的,也没提收入、利润或用户规模来支撑这个数...

推荐理由:Bloomberg 报道 Anthropic 拿了 650 亿美元,估值冲到 9650 亿美元,把 OpenAI 甩在后面。投资方和条款都没披露,但光这个体量就够当天 AI 融资圈的头条了。

5月28日星期四

AI HOT 精选

OpenAI 发布前沿治理框架,把内部安全做法对接到加州和欧盟的新规上

OpenAI 发了一份公开文件,解释自己的安全措施怎么满足加州《前沿 AI 透明度法案》和欧盟《通用 AI 行为准则》的要求。框架覆盖了网络攻击、生化风险、恶意操控、失控等场景的风险评估和缓解,也提到了模型报告、安全风险管理、事件响应和外部专家参与。但正文没给出具体的评估指标、落地时间表,也没列出哪些模型算“前沿模型”。我会先打个折:这更像一份合规说明...

推荐理由:我会先打个折,因为正文没给评估指标、时间表和模型名单,信息缺口不小。但 OpenAI 主动对齐欧盟和加州新规这件事本身有信号意义——说明头部实验室在提前卡位监管预期,对做安全合规和模型发布排期的团队是直接相关的。这点先别太激动,等具体指标出来再重新判断。