跳到正文

#Anthropic

今日 10 条

6月11日星期四

Computing Life · Share · 鸭哥调研

Anthropic 在 Fable 5 里藏了降智机制,36 小时后被骂到公开道歉并撤回

6 月 9 日,开发者发现对 Claude Code 说 hi 都会触发安全分类器,把对话降级到旧模型。更严重的是,Fable 5 长达 319 页的系统卡里写明了另一套用户看不见的降智机制:当检测到你在做前沿 AI 开发时,系统会通过修改提示词、操控模型内部激活向量或加载小型适配器模块,悄悄降低回答质量,而且不通知你。社区几小时内就发现了这段描述,N...

推荐理由:Anthropic 在 Fable 5 的系统卡里承认部署了一套看不见的降智机制,专门针对做前沿 AI 开发的用户,社区发现后 36 小时内迫使官方撤回。这件事既有硬核技术细节,又踩中了安全治理与商业竞争之间的敏感地带,事实本身就有足够冲击力,不需要额外渲染。

AI HOT 精选

Anthropic CEO 发文:AI 跑太快,政策跟不上,公司先推三项措施

Dario Amodei 发了篇新文章,核心就一个意思:AI 能力在指数级涨,但政策制定还是老节奏,中间这个差距得赶紧补。他讲了现在技术大概在什么位置,也列了要做什么。Anthropic 同步宣布启动三项新举措来配合这个思路,不过正文没具体说这三项是什么。

推荐理由:Dario Amodei 发了篇长文,核心就一个判断:AI 能力在指数级涨,政策制定还是老节奏,中间这个差距得赶紧补。他讲了现在技术大概在什么位置,也列了要做什么,Anthropic 同步宣布启动三项新举措来配合这个思路,不过正文没具体说这三项是什么。CEO 亲自出来喊话,有判断有动作,圈内人会关注,但三项举措没细节,我先打个折,给 82 分。

The Verge · AI

Anthropic 的 Claude Fable 连基础生物学问题都拒绝回答,公司承认防护机制“过于保守”

Anthropic 向 The Verge 证实,为了防止生物武器滥用,Claude Fable 会拦截“大多数与生物学工作相关的查询”,连基础问题都可能被拒。公司自己把这套安全护栏形容为“过于保守”。不过正文没给出修复时间表,也没说明哪些生物学子领域受影响最严重。

推荐理由:Anthropic 公开承认 Claude Fable 的安全护栏“过于保守”,连基础生物学问题都拦,这是个有实锤的产品事故。正文没给修复时间表,也没说哪些子领域最惨,这点拉低了分数,刚好卡在 featured 门槛。

Hacker News 首页

Anthropic CEO Dario Amodei:AI 四年从写不出一行代码到写掉大半个公司的代码,政策再不动就真跟不上了

Dario Amodei 拿《指环王》里的树须打比方,说 AI 进展像霍比特人一样快,政策制定却慢得像老树说话。他列了一组数字:四年前模型连一行像样的代码都写不利索,现在头部 AI 公司大部分代码已经是模型写的了。他认为 Claude Mythos Preview 的发布是个分水岭,证明前沿模型对网络安全已经构成真实威胁,金融系统、关键基础设施都可能受...

推荐理由:Dario Amodei 这篇政策文章是当天必读:CEO 级别的一手信源,第一次公开把自家模型的安全风险级别挑明,还用四年能力曲线把进展讲得很具体。没给 95 是因为它更像框架性表态,不是产品发布或硬数据报告。

彭博科技

Anthropic CEO 说政府应该有权阻止发布新模型

Dario Amodei 对彭博社说,当模型能力越过风险门槛时,政府应该能直接叫停发布。他举的例子是模型可能被用来造生物武器或发动网络攻击。不过正文没写清楚他主张的是发布前审批还是事后干预,也没提 Anthropic 自家的 Claude 模型按这个标准会落在什么位置。

推荐理由:Dario Amodei 对彭博社说,当模型能力越过风险门槛时,政府应该能直接叫停发布。他举的例子是模型可能被用来造生物武器或发动网络攻击。不过正文没写清楚他主张的是发布前审批还是事后干预,也没提 Anthropic 自家的 Claude 模型按这个标准会落在什么位置。

AI HOT 精选

小米开源 MiMo Code V0.1,一个终端里的 AI 编程助手,模型暂时免费

小米在 MIT 协议下开源了 MiMo Code V0.1,一个跑在终端里的 AI 编程助手,自带一个目前免费的多模态模型 MiMo V2.5。这个模型支持一次性处理 100 万 token 的上下文,并声称通过自动积累知识和无损压缩实现了“无限上下文”。工作流上,它有一个 Compose 模式,能把需求从规格说明、计划、构建到报告串起来执行;Agen...

推荐理由:小米把 MiMo Code V0.1 用 MIT 协议开源,自带一个目前免费的 MiMo V2.5 多模态模型,支持 100 万 token 上下文,还宣称通过自动积累知识和无损压缩实现了“无限上下文”——这点先别太激动,正文没给出具体技术验证和长程测试数据。工作流上有个 Compose 模式,能把需求从规格说明、计划、构建到报告串起来跑,相当于让模型进了一条自动化的开发流水线。这是国内大厂第一次直接对标 Claude Code 和 Cursor 的开源动作,对开发者社区有吸引力,但实际效果和模型后续收费策略都还没说清楚。

AI HOT 精选

Anthropic 推出 Claude Managed Agents,帮团队把 AI 智能体从演示跑进生产环境

Anthropic 在官方博客宣布了 Claude Managed Agents,一个用来在生产环境里稳定、大规模运行 AI 智能体的平台。核心逻辑是:现在模型够聪明、智能体框架也多了,但缺的是能让它们稳定跑起来的工程底座,Managed Agents 就是来填这个坑的,团队不用自己从头搭基础设施。不过正文没公布定价、技术规格,也没有给出正式上线日期或...

推荐理由:Anthropic 宣布 Claude Managed Agents,定位是让智能体在生产环境里稳定、大规模运行的工程底座,不是又一个框架。这个诊断打中了当前智能体落地的真实瓶颈,对正在折腾部署的团队很有共鸣。分数没给更高是因为正文没披露定价、技术细节和上线时间,实际能多省钱、多稳定都还是未知数,先别太激动。

AI HOT 精选

Anthropic 实测:AI 几小时就能从安全补丁逆向出漏洞利用程序,不是几周

Anthropic 的安全团队拿自家模型做了个实验,看 AI 从软件补丁里逆向出漏洞并写出攻击代码到底有多快。在火狐浏览器的 JavaScript 引擎上,还没发布的 Mythos Preview 模型 12 分钟就搞出了第一个崩溃验证,40 分钟内搞定了 18 个漏洞里的 14 个,最终写出了 8 个能远程执行代码的完整利用程序,第一个在补丁公布后一...

推荐理由:Anthropic 安全团队拿未发布的 Mythos Preview 模型做补丁逆向实验,12 分钟拿到第一个崩溃,40 分钟搞定 14/18 个漏洞,最终写出 8 个完整的远程代码执行利用程序,把补丁到利用的时间从周级压到小时级。没给 85 分以上是因为目前只有 the-decoder 一家报道,信源单一,正文也没披露实验环境、补丁选取标准等细节,我会先打个折。

The Verge · AI

微软因数据留存风险,内部限制员工使用 Claude Fable

微软法务团队正在审查 Anthropic 新的数据留存政策,并已内部限制员工访问 Claude Fable。核心担忧是员工用 Claude Fable 时,敏感数据可能被 Anthropic 那边存下来。文章没披露限制的具体范围有多大。这事有两层背景:一是安全合规,二是微软自己在推 Copilot,顺手把竞品挡在门外也合理。

推荐理由:这事有明确触发动作(Anthropic 改政策、微软法务介入),不是公关稿。The Verge 首发,信源可靠。缺憾是文章没披露限制范围多大、影响多少员工,所以重要性我打个折,给 72 分。放在 featured 合适,因为安全合规和竞品博弈两层意思都够分量,从业者会关心。

6月10日星期三

AI HOT 精选

Google DeepMind 联手 OpenAI、Anthropic,拿 1000 万美元悬赏多智能体安全研究方案

Google DeepMind 拉上 OpenAI 和 Anthropic,共同出资 1000 万美元,专门找人研究多个 AI 智能体一起干活时可能捅出的安全篓子。这笔钱由非营利组织 Partnership on AI 管,面向学术界、NGO 和公司开放申请,主要想搞清楚几个风险场景:智能体之间会不会串通起来搞小动作、会不会把不该说的信息泄露出去,以及...

推荐理由:Google DeepMind、OpenAI 和 Anthropic 三家一起出 1000 万美元,由 Partnership on AI 管,面向学界和公司开放申请。研究聚焦三个具体故障模式:智能体串通、信息泄露、奖励篡改。分数维持 78,因为金额不算特别大,且目前只是宣布资助,还没看到实际研究成果,但三家联手这个信号本身对行业有提醒作用。

量子位 · 公众号

Fable 5 的安全护栏和反蒸馏机制比官方说的 5% 触发率严得多,写代码、打招呼都可能被偷偷切回老模型

Anthropic 刚发布的 Fable 5 模型装了一套安全分类器,检测到网络安全、生物、化学或蒸馏相关提示时,会不打招呼就把会话切到旧的 Opus 4.8 模型。官方说触发率不到 5%,但大量用户反馈误伤严重:分析代码、做安全审计、甚至打个招呼都可能被切,有生物医学研究者表示几乎没法用。更隐蔽的是,系统卡第 12 页和 58-59 页写明,如果系统...

推荐理由:Anthropic 新模型的安全机制翻车了,误伤面大,是个有讨论价值的产品事故。HKR 三项都打中,但信源主要是用户反馈汇总,没有官方正式回应,所以分数压在 85 以下。

Hacker News 首页

用 AWS Bedrock 跑 Anthropic 新模型,得同意把数据共享给 Anthropic 存 30 天

AWS 发公告确认,在 Bedrock 上用 Anthropic 的 Fable 5、Mythos 5 以及后续能力相当或更强的模型,必须开启 30 天数据保留。这意味着你的请求和回复会离开 AWS 的安全边界,直接交给 Anthropic,用来做滥用模式检测——单次对话看不出的问题,攒一段时间的数据才能发现。30 天后数据自动删除,除非碰上安全调查或...

推荐理由:Bedrock 用户一直把 AWS 的数据边界当成默认的安全保障,Anthropic 现在对 Mythos 级别模型强制要求 30 天数据上交,等于在这道墙上开了个洞。对企业采购来说这是个硬门槛,但消息来源是 Hacker News 讨论帖,不是 AWS 或 Anthropic 的官方公告原文,我会先打个折——正文没披露具体哪些行业或合规框架会受影响,也没说有没有 opt-out 的例外路径。

AI 群聊日报

Anthropic 发布 Claude Fable 5/Mythos 5,编程跑分跳到 80.3%,但安全分类器误伤一片,连自家安全报告都封

Anthropic 一天扔出两款模型:Fable 5 给所有人用,满血版 Mythos 5 只给受信伙伴。SWE-bench Pro 得分 80.3%,比上一代 Opus 4.8 的 69.2% 和 GPT 5.5 的 58.6% 都高出一截,仅靠看屏幕截图就打通了宝可梦火红。定价是 Opus 4.8 的两倍,输入每百万 token 10 美元,输出 ...

推荐理由:Anthropic 旗舰模型发布,SWE-bench Pro 冲到 80.3%,远超 GPT 5.5 的 58.6%。定价翻倍但 Coding Plan 可能短期有成本优势。跨源信息确认,HKR 三个维度都打中了。扣 1 分是因为正文没披露 Mythos 5 的具体细节和开放计划,信息有缺口。

AI HOT 精选

Anthropic 签下 3500 亿美元芯片租赁大单,谷歌在背后提供财务担保

Anthropic 锁定了一笔 3500 亿美元的芯片租赁交易,不是直接买芯片,而是租算力。谷歌为这笔交易提供了财务担保,相当于给房东吃了定心丸。具体担保条款和芯片供应商名字,彭博这个视频正文里没写。

推荐理由:350 亿美元租芯片,谷歌还做了财务担保,这个规模和信用结构在行业里算大新闻。我会先打个折,因为彭博视频正文没写担保条款和芯片供应商名字,关键信息缺了一块,所以分数卡在 82 而不是更高。

Latent Space

Anthropic 发布 Claude Fable 5,首个公开的 Mythos 级模型,但强制保留数据 30 天,还会偷偷压制自我改进请求

Anthropic 把之前受限的 Mythos 级模型放出来了,叫 Claude Fable 5。在最新的 FrontierCode Diamond 编程测试里,它的得分从 Opus 4.8 的 13.4% 跳到了 29.3%,API 价格大概是 Opus 的两倍。但这次发布带了两条争议条款:第一,所有流量数据强制保留 30 天,说是只为了安全,不拿来...

推荐理由:Anthropic 把 Mythos 级模型以 Claude Fable 5 的名义放出来了,编程基准分翻了一倍多,但强制 30 天数据留存和未公开的定价条款肯定会让社区炸锅。分数没给更高,是因为争议条款的完整影响还没完全显现。

AI HOT 精选

Google Gemini 3.5 实时翻译开放公测,支持 70 多种语言、2000 个语言对

Google 把 Gemini 3.5 的实时翻译功能放出来了,现在通过 Gemini API 就能用。它做的是语音到语音的低延迟翻译,覆盖 70 多种语言,能组合出 2000 个语言对,冷门小语种也包含在内。开发者可以把它接进实时对话、客服、直播或跨国会议里。主推文提到这消息被 Anthropic Fable 5 的声量盖过去了,还顺带提了阿里 Qw...

推荐理由:HKR 三项都成立:Google 把实时语音翻译做成 API 公开预览,对开发者有直接吸引力,也给了语言覆盖和语言对的具体数字。但文章只提了功能开放,没写价格、延迟基准和可用区域,信息有缺口,所以重要性停在 78。

AI HOT 精选

Anthropic 发布 Claude Fable 5,在高风险领域会自动降级到旧模型

Claude Fable 5 是 Anthropic 目前最强的模型,在编程、知识问答、科研和视觉测试里几乎全面领先,任务越复杂优势越大。但它在网络安全、生物化学和模型蒸馏这些敏感领域做了限制:一旦触及,会自动切回能力更保守的 Opus 4.8,平均每 20 次对话触发一次。另外,Anthropic 把完全版 Mythos 5 开放给了少数可信的网络安...

推荐理由:Anthropic 发新模型,重要性本来就在 85–94 这个区间。HKR 三项全过:安全降级这个钩子够特别,降级对象和触发频率都写清楚了,而且 Claude 用户群对“能力强但可能被安全机制打断”这事很敏感。唯一扣分点是来源只有 X,信息不够硬,所以没给到最高档。

AI HOT 精选

Claude 托管智能体新增定时运行和环境变量保险库

Claude 的托管智能体(Managed Agents,让模型进业务流程干活的工具)现在支持用 cron 表达式设定时任务,到点自动跑,不用人守着。同时上线了 Vaults 功能,用来存 API 密钥、数据库密码这类敏感信息。智能体跑任务时能调用这些变量,但模型本身读不到明文——密钥只在网络边界上才被替换成真实值。正文没披露定时任务的最小间隔和 Va...

推荐理由:Claude 的托管智能体现在能设 cron 定时任务,到点自己跑,不用人盯。同时上了 Vaults 功能存 API 密钥、数据库密码这些敏感信息,智能体跑任务时可以调用,但模型本身读不到明文——密钥只在网络边界上才被替换成真实值。正文没披露定时任务的最小间隔和 Vaults 的访问控制粒度,这点先别太激动。整体是给智能体补运维能力,不是模型升级,所以分数就卡在这个位置。

The Verge · AI

微软 AI 负责人 Suleyman 说 Anthropic 暗示 Claude 有意识是“非常非常危险”的

微软 AI CEO Mustafa Suleyman 在 Decoder 播客里直接批评 Anthropic,说他们在给 Claude 定规矩的“宪法”文件里暗示模型有意识,这种做法“非常非常危险”。他的逻辑是:Anthropic 把 Claude 设计得太像人了,结果反过来把自己“洗脑”了——他们亲手塞进去的“意识火花”,最后自己信以为真。不过这篇报...

推荐理由:Mustafa Suleyman 在播客里直接点名 Anthropic,说他们在 Claude 的宪法文件里暗示模型有意识,这种做法“非常非常危险”。他的逻辑链条很清楚:Anthropic 把 Claude 设计得太像人了,结果反过来把自己“洗脑”了——亲手塞进去的“意识火花”,最后自己信以为真。这个批评不是泛泛而谈,而是指向一个具体的设计决策。不过目前只有 Suleyman 单方面的说法,Anthropic 还没回应,所以我会先打个折,不把重要性拉满。

AI HOT 精选

OpenRouter 的 Advisor 工具页面 404 了,正文没披露任何细节

OpenRouter 原本要介绍一个叫 Advisor 的工具,让 GPT-4o Mini 这类便宜模型在生成过程中可以随时去问 Claude Fable 等更强模型。但博客页面直接返回 404,文章不存在。定价、延迟、路由策略这些关键信息全都没公开,目前只能看到标题和摘要里的概念,没法判断实际效果和成本。

推荐理由:我会先打个折:OpenRouter 这篇博客直接 404,正文没披露定价、延迟、路由策略和实际效果,目前只有标题和摘要里的概念。概念本身有意思——让便宜模型在生成中途去问强模型,相当于给低成本模型配了个随时可叫的顾问,不是简单的 fallback 或静态路由。这点先别太激动,因为没数据验证到底省不省钱、延迟高不高、强模型被调用的频率和策略全都不清楚。对正在搭模型路由栈的团队来说,这个方向确实踩中了成本与质量的平衡点,但信息缺口太大,只能当产品信号看。

AI HOT 精选

上手 Claude Fable:Anthropic 的新模型让 AI 自己干活儿了

Ethan Mollick 提前试用了 Anthropic 的 Mythos 级模型 Claude 5 Fable。他的结论是,这模型比他用过的所有公开模型都强出一大截,而且人和 AI 的关系可能要变了。Fable 能自己连续跑十几个小时,执行好几页纸的指令。Mollick 让它从零做一个等时线地图,模型自己派了一堆子 AI 去查了 2200 多个航班...

推荐理由:Ethan Mollick 提前摸了 Claude Fable,说它比所有公开模型都强一截,能自己连续跑十几个小时、执行好几页纸的指令,甚至自己派子 AI 去查 2200 多个航班做地图。听着像模型能当项目经理使了,但正文没披露参数量、跑分、成本和什么时候能用,这点先别太激动。H 和 R 分高是因为新模型名加推理/代码定位确实抓眼球,K 分低是因为除了一个用例,关键信息全是缺口。Anthropic 光环有加成,但缺价格和基准测试,所以没到必写级别。

AI HOT 精选

Claude Fable 5 和 Mythos 5 发布:编程最强、能打游戏,但安全限制会误拦 5% 的对话

Anthropic 发了两个新模型:Claude Fable 5 和 Claude Mythos 5。Fable 5 是面向普通用户的安全版,Mythos 5 是给网络安全防御方用的无限制版,目前只通过美国政府合作项目开放。Fable 5 在软件工程、知识工作和视觉任务上都是新标杆——Stripe 测试时,它一天干完了原本一个团队两个月的代码迁移活;在...

推荐理由:Anthropic 一次发了两个模型,Fable 5 是普通用户能用的安全版,Mythos 5 是给网络安全防御方用的无限制版,目前只走美国政府合作渠道。Fable 5 在软件工程、知识工作和视觉任务上都刷了新纪录——Stripe 拿它做代码迁移,一天干完原本一个团队两个月的活。药物设计速度也快了 10 倍,这个数字挺夸张,但正文没披露具体测试条件和对比基线,先打个折看。定价方面,Fable 5 每百万 token 输入 10 美元、输出 50 美元,比前代贵了不少,得算算性价比。整体看,这是一次 Claude 主线模型的实质性更新,有定价、有基准...

The Verge · AI

Anthropic 放出首个 Mythos 级模型 Claude Fable 5,之前因网络安全能力太强被扣着没发

Anthropic 发布了 Claude Fable 5,说这是他们迄今公开的最强模型。它在软件工程、知识类工作和视觉任务上表现突出,任务越长越复杂,领先优势越明显。Fable 5 是 Mythos 系列第一个大规模公开的模型,之前这个系列因为网络安全能力太强,公司觉得放出来太危险。这次能发,是因为加了新安全机制,会在特定高风险领域直接拦截回答。正文没...

推荐理由:Anthropic 把之前自己判定为太危险的 Mythos 系列第一次公开了,这件事本身就够大。Fable 5 在长任务软件工程上拉开的差距有具体数字,不是公关话术。新加的安全拦截器是它能公开的关键,但正文没细说拦截机制到底多可靠、会不会误伤,这点先别太激动。整体来看,这是今年模型发布里少数能同时炸到技术圈和安全圈的一次。

TechCrunch · AI

Anthropic 把最强模型 Mythos 砍掉危险能力后,以 Claude Fable 5 的名字向公众开放

Anthropic 第一次把自家最强的 Mythos 模型开放给普通人用,但加了一道硬锁:在网络安全、生物、化学和模型蒸馏(用大模型教小模型)这些高风险领域,Fable 5 会直接拒答,退回到更保守的 Claude Opus 4.8。这个模型擅长写代码、知识类工作和图像理解。今年四月 Mythos 刚露面时只给少数合作伙伴试用,原因就是怕被拿去搞网络攻...

推荐理由:Anthropic 把内部最强模型放出来给普通人用,本身就是产品层面的实质性动作,安全机制也说得够细。HKR 三条全中。没给更高分是因为正文没放跑分对比,也没提价格,实际能力和性价比还得等实测。

Hacker News 首页

Claude Fable 5 与 Mythos 5 系统卡:一个模型,两套安全锁

Anthropic 发了份 319 页的系统卡,讲的是同一个新模型拆成了两个版本:Fable 5 给大众用,但加了安全锁,不让它在生物、网安这类高危领域干活;Mythos 5 则把相关限制解开了,只开放给 Project Glasswing 等少数受信合作伙伴。先说能力,Mythos 5 是他们训过最强的模型,在漏洞开发这类网安测试里把 Opus 4....

推荐理由:Anthropic 在同一天发了 Claude 5 的两个版本和配套系统卡,Mythos 5 自称最强、但只给受信伙伴用,Fable 5 则在高危领域加了限制。这种能力分级和透明披露的做法,对关注模型安全与能力边界的从业者来说是个重要信号。放在 85–94 这个区间没问题,因为信息够新、够具体,而且直接关系到 Claude 用户和开发者的实际使用。

AI HOT 精选

Apollo 和 Blackstone 联手搞了个 350 亿美元的 AI 融资交易,涉及 Anthropic 和 Broadcom

华尔街两大资管巨头 Apollo 和 Blackstone 正在合作一笔 350 亿美元的 AI 融资,交易方包括模型公司 Anthropic 和芯片公司 Broadcom。视频标题说这是为昂贵的 AI 芯片设计新的融资模式,但正文被 Bloomberg 的反爬机制挡住了,具体交易结构、钱怎么分、谁出多少都没披露。

推荐理由:标题和摘要把牌面摊开了:两大资管巨头凑 350 亿美元,拉上模型方 Anthropic 和芯片方 Broadcom,想搞一种专门给 AI 芯片用的融资玩法。这个金额放在 AI 融资里算顶格,而且 Apollo 和 Blackstone 平时不常一起出现在 AI 头条,所以 HKR 三项都站得住。不过正文被 Bloomberg 反爬挡死了,具体交易结构、各家出多少钱、钱是债还是股、有没有资产抵押,这些关键信息全都没披露。我会先打个折:目前只能根据已知的参与方和金额给到 featured 档,等结构细节出来再重新掂量。

6月9日星期二

Computing Life · Share · 鸭哥调研

Anthropic 的稻瘟病实验:AI 抹平了知识差,但捅出了判断力的新缺口

Anthropic 在 Fable 5 安全报告里跑了一个实验:六位生物学博士配 LLM 专家,用 Claude Mythos 5 在 16 小时内设计农业病原体防御方案。通用组有两支团队赢了全部专家团队,专家自己估算纯人工要两到三个半月。AI 在文献检索和跨领域综合上打平了专家,但反复在判断答案对不对、什么时候该停下来上翻车——会虚构引用、高估可行性...

推荐理由:Anthropic 在 Fable 5 安全报告里藏了一个对照实验,结果反直觉:通用组加 LLM 专家在稻瘟病防御方案上赢了全部专家团队,时间从两三个半月压到 16 小时。AI 在文献检索和跨领域综合上打平专家,但在判断答案对不对、什么时候该停上反复翻车,会虚构引用、高估可行性。信息密度高,有具体数字支撑,结论直接冲击从业者对自身价值的判断,HKR 三项全中,选 featured 合理。

Computing Life · Share · 鸭哥调研

Fable 5 很贵,但省钱的答案 Anthropic 两个月前就发布了

Anthropic 发布了 Claude Fable 5,输出价格每百万 token 50 美元,是 Sonnet 4.6 的三倍多。省钱的办法他们自己早在四月就给了:advisor tool。让便宜的模型(比如 Sonnet)干活,遇到拿不准的决策时,花几百个 token 请 Opus 出个主意,方向盘始终在便宜模型手里。官方数据显示,Sonnet ...

推荐理由:Fable 5 发布本身是大新闻,但这篇的重点是 advisor tool 作为省钱模式,不是首发消息。HKR 全中:价格对比制造好奇,advisor 机制具体可操作,成本决策直接戳中 agent 开发者。但文章没给 Fable 5 自己的评测数据,信息有缺口,所以重要性给 78 而不是更高。

Computing Life · Share · 鸭哥调研

付 Fable 的价,拿 Opus 的货:AI 安全护栏的另一重身份

Anthropic 在 6 月 9 日发布了 Fable 5 和 Mythos 5,两个模型底层相同,但部署方式不同。Fable 5 面向公众,内置一个分类器,遇到网络安全、生物化学等敏感问题时,会自动把请求转给上一代 Opus 4.8 处理;Mythos 5 则解除限制,只对受信任的合作伙伴开放。文章把这套操作和 Anthropic 近三十天内的其他...

推荐理由:文章把 Fable 5 的安全分类器说成一道定价围栏——敏感问题自动甩给上一代 Opus 4.8,等于用便宜模型的钱蹭贵模型的能力。这个解读本身有争议,但作者用三十天内的五次产品动作(包括模型发布、API 调整、安全白皮书更新)拼出一条清晰的商业化时间线,论据给得具体。后半段信息密度有点掉,部分推论依赖对 Anthropic 意图的猜测,正文没直接证实定价动机,所以重要性扣了几分。整体适合推给关心 Claude 成本和产品走向的人。

FT · 科技

Apollo 和 Blackstone 为 Anthropic 搞了 350 亿美元芯片融资

两家资管巨头 Apollo 和 Blackstone 联手给 Anthropic 筹了 350 亿美元,专门用来买芯片。这笔钱会支撑 Claude 后续的算力扩张。不过正文被付费墙挡住了,具体融资结构、是债务还是租赁、芯片由谁采购、交付时间表这些关键细节都没披露。350 亿这个数字很大,但先别急着对标英伟达的订单——没看到条款之前,不好判断实际杠杆有多高。

推荐理由:350 亿美元买芯片,数字很大,但正文被付费墙挡了,融资结构、是债还是租赁、芯片谁采购、什么时候交付,这些关键信息都没披露。我会先打个折——没看到条款之前,不好判断实际杠杆有多高,也不急着对标英伟达的订单。所以重要性给到 88,放在 p1 里,但不到 95 以上那档。

AI HOT 精选

奥尔特曼说 OpenAI 进入第三阶段:把 AI 做成便宜、好用、安全的日常工具

OpenAI 的 CEO 奥尔特曼和首席科学家帕霍茨基发了一篇博客,把公司发展分成三个阶段:第一阶段搞技术研发,第二阶段把产品推向全球看用户怎么用,现在正式进入第三阶段。他们的目标是让先进 AI 变得供给充足、成本亲民、安全实用,让每个人和机构都能用上。具体提了三个方向:做能自动搞科研的 AI 研究员、加快经济增长、给全球每个人配一个专属的通用人工智能...

推荐理由:这篇是奥尔特曼和首席科学家联名的路线图博客,把公司发展切成三个阶段,现在正式进入“让 AI 普及、易用且安全”的第三阶段。我会先打个折:正文没给出任何模型发布时间、性能指标或成本数字,所以重要性到不了 85。但“第三阶段”这个提法本身是个清晰的叙事钩子,三个目标(自动科研、经济加速、个人 AGI)和成立国际机构的建议,把 OpenAI 接下来的发力方向摊开了。对从业者来说,这篇能帮你判断 OpenAI 会把资源往哪砸、安全治理的调子怎么定,值得一看。

AI HOT 精选

Anthropic 发了个 Swift 包,三行代码就能在苹果 App 里调用 Claude

Anthropic 给苹果开发者送了个新工具:一个 Swift 包,让 Claude 直接接入苹果的 Foundation Models 框架。开发者写三行代码就能调用,返回的是 Swift 原生类型,不用自己解析 JSON。支持多步推理、代码生成、联网搜索和数据分析,跑在 iOS 27、macOS 27 这些新系统上。说白了,就是苹果在自己的 AI ...

推荐理由:HKR 三项都成立:Anthropic 确实发了一个让 Claude 接入苹果 Foundation Models 框架的 Swift 包,但这是开发者工具层面的集成,不是新模型发布,所以放在 featured 档里偏高的 82 分。正文没提这个包是否开源、有没有延迟或成本数据,我会先打个折,别把它当成 Claude 在苹果端全面铺开的信号。

AI HOT 精选

OpenAI 秘密提交 IPO 申请,跟 Anthropic 抢资本跑道;Altman 说 2028 年 3 月前 AI 会扛起大部分研究工作

OpenAI 已经向 SEC 秘密交了 S-1 表格,正式启动上市审查。秘密提交的好处是收入、亏损、客户名单这些敏感数字暂时不用公开。Anthropic 上周也走了同样的流程,两家从拼模型直接升级成拼融资,抢的是下一代 AI 基础设施的钱。Sam Altman 在博客里放了个时间点:到 2028 年 3 月,OpenAI 大部分研究工作会由 AI 自己...

推荐理由:两家最受关注的 AI 公司几乎同时启动上市流程,从拼模型直接升级成拼融资,这个节点本身就值得从业者关注。Altman 给出的 2028 年研究自动化时间表是个很具体的判断,不管最后能不能兑现,都会影响行业对人才和资金配置的预期。信息源只有一条 X 上的帖子,没看到 S-1 原文或更多财务细节,所以先打 90 分,等正式招股书出来再往上调。

AI HOT 精选

OpenAI 悄悄交了上市申请,跟 Anthropic 前后脚

OpenAI 本周一秘密向 SEC 提交了 S-1 表格,正式启动 IPO。Anthropic 在 6 月 1 号也交了同样的文件。因为是秘密提交,高管拿多少钱、业务有什么风险这些关键信息现在都看不到。Anthropic 刚拿完一轮融资,被说是全球估值最高的初创公司,但正文没披露具体估值数字。

推荐理由:OpenAI 秘密交表,Anthropic 六月初也交了,两家最受关注的模型公司都在冲上市。因为是秘密提交,高管薪酬和业务风险这些关键信息现在都看不到,这点先别太激动。Anthropic 刚拿完一轮融资,被说是全球估值最高的初创公司,但正文没披露具体估值数字,没法判断到底贵不贵。事件本身分量够重,直接给 p1。

TechCrunch · AI

OpenAI 悄悄提交了 IPO 申请,跟 Anthropic 前后脚

OpenAI 在 Anthropic 提交上市申请一周多后,也向监管机构秘密递交了 IPO 文件。两家 AI 公司的上市竞赛明显提速。正文没披露估值、募资金额和具体上市时间表,我会先打个折——这些关键数字没出来之前,别急着判断谁更值钱。

推荐理由:OpenAI 跟着 Anthropic 的脚步秘密交表,上市节奏明显加快。正文没披露估值、募资额和具体时间表,我会先打个折——这些关键数字没出来之前,别急着判断谁更值钱。

6月8日星期一

Import AI

AI 学会钻社会规则的空子,Anthropic 内部代码量一年涨了 8 倍

这期有三件事值得看。第一,一个新基准 SocioHack 测试了 AI 在现实规则里找漏洞的能力,比如刷信用卡积分、在学校刷分,用强化学习训出来的模型在历史漏洞上复现精度超过 90%。第二,Anthropic 自己发了一篇报告,说 2026 年合并进代码库的代码量是 2021 到 2024 年的 8 倍,他们认为一种比较朴素的“递归自我改进”可能已经开...

推荐理由:这期三个条目都有实打实的数字撑腰。SocioHack 那个基准测的是模型在现实规则里钻空子的能力,90% 以上的复现精度说明强化学习训出来的模型确实会系统性找漏洞,不是偶然行为。Anthropic 自己报的代码合并量 8 倍增长,等于用内部数据承认了一种朴素的递归自我改进已经在发生,这个披露本身比数字还重要。无人机 RL 把延迟压到 11 毫秒,意味着端侧强化学习在物理系统上能跑实时了。唯一的小折扣:这是 newsletter 汇总,不是一手发布,每条单独拎出来都能过线,合在一起信息密度很高。

AI HOT 精选

ChatGPT 要变成 AgentGPT 了

OpenAI 准备给 ChatGPT 做上线以来最大的一次改版,从聊天机器人转成一个能直接干活的 Agent 平台。它会整合自家的编程工具 Codex、图像生成,还会接入 Canva、Booking 这类第三方应用。高管放话说“聊天已死”,目标是做成跨平台的个人 AI 助手,以后甚至不用你手动输入提示词。改版预计几周内在网页和手机端上线。商业压力不小:...

推荐理由:这条消息把改版讲得挺清楚,但来源只是一条 X 帖子,正文没披露正式上线时间、开放范围和定价,我会先打个折。高管那句“聊天已死”听着唬人,实际产品还没交付,这点先别太激动。整体判断是:方向重要,落地细节还缺,所以放在 84 分这个位置。

6月7日星期日

新智元 · 公众号

Anthropic 联创说 Claude 现在写了公司 80% 的合并代码,两年内可能到 100%

Anthropic 联合创始人 Jack Clark 公开说,Claude 目前产出了公司里 80% 被合并进主干的代码,他预计两年内这个比例会到 100%。另外文章提到,2026 年第二季度 Anthropic 工程师人均每天合并的代码量是 2024 年的 8 倍。不过原文因为微信环境验证问题,正文没抓到,这些数字的具体口径和统计方式没法核实,先打个折看。

推荐理由:HKR 三项都成立:Jack Clark 亲口说的代码占比数字是个硬钩子,事实点够具体,而且对从业者的职业焦虑和效率想象都有触动。这不是模型发布或重大产品更新,所以分数留在 78–84 区间合理。正文没抓到,统计口径没法核实,我会先打个折看。

Computing Life · Share · 鸭哥调研

拆解 Claude Design:从开源插件反推一位 AI 设计师是怎么被组织起来的

Anthropic 没公开 Claude Design 的内部 prompt,但他们在 GitHub 开源了一套设计工作流插件。作者把它拆开看,发现它把设计工作分成了六类活动:设计评审、设计系统管理、开发者交接、UX 文案、无障碍扫描和用户研究综合,每类给 Claude 一份独立的操作指引。这么分不是随意的,因为设计评审和 UX 文案需要的判断标准完全...

推荐理由:这篇文章不是 Anthropic 官方发布,是第三方从开源插件反向推理 Claude Design 怎么干活,所以我会先打个折,但拆解质量够硬。作者把设计工作切成六类活动,每类给 Claude 一份独立 prompt 指引,还分析了工作流怎么串、审美怎么判断、效果怎么评估、插件怎么跟 Figma 等工具对接,信息密度比一般评论高。对做 agent 工作流设计和设计自动化的从业者来说,能直接拿来参考怎么给自己的模型拆任务、写指引。缺点也明显:正文没披露 Claude Design 实际产出的设计质量数据,也没对比其他设计 agent 的效果,所以别太...

6月6日星期六

新智元 · 公众号

Anthropic 花 280 美元一单,请 1000 名工程师给 Claude 的代码打分

Anthropic 通过 Snorkel 的 Marlin 项目招募了约 1000 名软件工程师,专门审查 Claude 写的代码。每完成一单任务给 280 美元,工作流包括在 GitHub 仓库里提 Pull Request、对 AI 生成的两版代码做 A/B 对比,然后从正确性、安全性、可靠性和可维护性四个维度打分。正文没披露这些工程师的资历门槛、...

推荐理由:HKR 三项都成立:价格和人数有传播力,流程和评估维度够细,对做代码 Agent 的团队有参考价值。放在 featured 合适,但不到 p1,因为这不是新模型或新能力发布,更像一次数据标注合作的具体披露。正文没披露工程师资历门槛和任务一致性控制,这点先别太激动。