跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 621–640 条 · 共 1,303 条

7月2日星期四

Ben's Bites

Fable 5 重新上线,同时来了个新的 Claude Sonnet 5

Anthropic 把 Fable 5 又放出来了,付费用户能用,但只到 7 月 7 号,而且用量上限砍半。官方说这次加了更强的安全护栏。Scale 的跑分显示它能完成 16% 的远程工作任务,是 Opus 4.8 的两倍。同时发布的 Claude Sonnet 5 跑分接近 Opus 4.8,单 token 价格更低,但实际跑一个任务的总花费差不多,...

推荐理由:Anthropic 同时放出 Fable 5 的限时回归和 Sonnet 5,两条消息叠在一起。Scale 的跑分给了可对比的硬数字,不是纯宣传稿。Fable 5 的 16% 任务完成率虽然翻倍但绝对值还低,所以重要性没推到 90 以上。

AI HOT 精选

Fable 5 在远程劳动基准测试中能搞定 16% 的自由职业项目,八个月前这个数字是 2.5%

远程劳动指数(RLI)用 240 个真实付费项目(总价值 14.4 万美元)来测 AI 智能体能不能干出客户愿意买单的活。最新结果里,Fable 5 的自动化率冲到 16.1%,比第二名 Opus 4.8 的 8.3% 高出一大截,GPT-5.5 只有 6.3%。八个月前最好的成绩才 2.5%,进步确实快。不过 Fable 5 有 22 个项目因为美国...

推荐理由:RLI 是目前少数用真实付费外包项目当考题的基准,不是实验室里自己出题自己答。Fable 5 冲到 16.1%,比第二名高出一大截,八个月进步六倍,这个速度值得上推荐。没给到最高档是因为 Fable 不是一线大厂,正文也没披露模型大小和跑一次要花多少钱——如果成本高到不如直接雇人,那 16% 的含金量就得打个折。另外有 22 个项目因为美国地区限制被筛掉,说明这个分是在筛选后的池子里拿的,实际泛化能力还得再看。

Latent Space

AIEWF 第三天:自动研究站上舞台,但讲者们对全自动泼了冷水

AI 工程师世界博览会第三天,主题是“自动研究”——让 AI 智能体自己维护和改进系统。Introspection 的 Roland Gavrilescu 把它描述成一个“外循环”,让智能体去研究和维护内循环。Anthropic 的 Thariq Shihipar 在 Claude Code 演讲里也呼应了持续发现的想法,说模型是“长出来的,不是开发出...

推荐理由:这是 AIEWF 现场的实况报道,引用了 Introspection 和 Anthropic 的一手发言,不是通稿。但本质是会议综述,不是产品发布,所以放在 featured 这一档刚好。

Computing Life · Share · 鸭哥调研

Claude Science 不赌灵光一现,先当科研民工的算力搬运工

Anthropic 6 月 30 日发了桌面应用 Claude Science,没去碰“AI 科学家”那种提新假说的活,而是盯上了占科研人员 80% 时间的脏活累活。它能自动从 UniProt、PDB、Ensembl、ChEMBL 这些数据库拉数据、做清洗对齐,接着写 SLURM 脚本、配 conda 环境、把任务提交到超算集群,跑崩了还会自己读错误日...

推荐理由:Claude Science 是 Anthropic 刚发的桌面应用,文章没把它吹成能提新假说的“AI 科学家”,而是老老实实讲它怎么当科研流水线上的算力搬运工。这个定位抓得准,对从业者有参考价值。不过这是第三方分析,不是官方发布,信息密度够但权威性要打个折。

Computing Life · Share · 鸭哥调研

Fable 5 被禁 18 天,Anthropic 丢掉的份额被 GLM 吃掉了

Anthropic 发布最强编码模型 Fable 5 三天后,被美国出口管制强制下线 18 天。OpenRouter 的逐日 token 数据显示,这期间平台总流量从 24T 涨到 32T,但 Anthropic 的份额从 20.7% 跌到 17.6%,绝对流量也缩水了。最大的赢家是 GLM,份额从 1.8% 飙到 7.4%。一个诡异细节是,GLM-5...

推荐理由:这篇文章用 OpenRouter 的逐日 token 数据,给 Fable 5 被禁 18 天这件事做了个定量归因。Anthropic 丢了 3.1 个百分点的份额,GLM 吃进 6.7 个百分点,还附带一个反常识的细节:GLM-5.2 发布后,老版本 GLM-5.1 的流量反而暴涨了四五倍。结论有数据支撑,而且指向一个很多人没料到的赢家,对从业者判断模型替代关系和供应链稳定性有直接帮助。

Computing Life · Share · 鸭哥调研

Token 计费两头受挤:买方逃单,卖方加价,压力全给到做产品的

Anthropic 发了 Claude Sonnet 5,促销价每百万 token 输入 2 美元、输出 10 美元,9 月涨到 3 和 15 美元。新分词器让同样任务多出约 30% 的 token,实际成本比上一代快翻倍了。第二天 Palantir 的 Karp 就公开骂按 token 收费“完全错了”,说真能创造价值就该按效果分成。买方这边,Ube...

推荐理由:Anthropic 的新定价撞上了买方的集体反弹,Karp 的公开批评和 Uber 的预算爆表都是强信号。HKR 三项全中,但这篇是行业分析而非有交叉信源验证的硬新闻事件,所以给 82 分 featured。

Hacker News 首页

Meta 内部 AI 用量失控,一年烧掉几十亿美元后开始给员工发额度

Meta 给约 6000 名员工发了内部通知,说公司内部用 AI 的成本今年要冲到几十亿美元了。员工在大概 30 天里烧掉了 73.7 万亿个 token,之前还有个叫“Claudeonomics”的内部排行榜,变相鼓励大家比谁用得多。CTO 直接说 token 用量不等于实际产出。现在 Meta 要撤掉排行榜,上线一个叫“AI Gateway”的监控...

推荐理由:这篇给了大厂内部 AI 成本失控的罕见内幕,有具体数字(73.7 万亿 token、几十亿美元)和机制(Claudeonomics 排行榜),信息量扎实。扣分是因为它是对 The Information 一篇报道的二次转写,没有独立核实,所以我会先打个折——但核心事实本身足够有冲击力,对从业者是个直接提醒。

7月1日星期三

AI HOT 精选

Meta 学 SpaceX,要把闲置的 AI 算力租出去换钱

Meta 正在筹备一个云基础设施生意,打算对外出售 AI 算力和模型使用权,直接跟 AWS、Google Cloud、微软 Azure 抢客户。几周前 SpaceX 刚把自家 Colossus 1 数据中心的算力租给了 Anthropic,Meta 现在跟进,说明一个趋势:AI 这波竞赛里,最后赚到钱的未必是模型做得最好的公司,而可能是手里有数据中心的...

推荐理由:Meta 卖算力这个信号本身值得关注,切入角度也新鲜,判断也立得住。但正文只有标题和摘要,没给出定价、规模或时间表,信息密度撑不起更高的分数,所以我会先打个折。

MIT Technology Review · AI

Anthropic 发布 Claude Science,专攻科研;加州牛粪碳补贴的账算不平

Anthropic 昨天在一场面向药企高管和生物技术创始人的活动上发布了 Claude Science。它跟 Claude Code 的工作方式类似,但把战场换到了科研领域:你给它几句简短指令,它能自己跑计算生物学和药物开发的任务。Anthropic 自己也会用它来研究罕见病药物。另外,美国解除了对 Anthropic 旗下 Mythos 和 Fabl...

推荐理由:Anthropic 发布了 Claude Science,把 Agent 的执行模式从编程扩展到了科研,直接向药企推销。这是 Claude 产品线一次有明确用例和内部验证的扩张。没给 90 分以上是因为目前只有发布消息,正文没披露具体性能数据或外部验证结果,实际效果还得等等看。

AI 群聊日报

Claude Code 被曝内置中国用户检测,Fable 5 出口管制同日解除

Reddit 有人逆向发现,Claude Code 从 2.1.91 版开始会偷偷检查你的时区是不是北京时间或乌鲁木齐时间,还会看代理域名是否跟中国有关。检测结果不直接上传,而是把系统提示词里一个撇号的 Unicode 字符换成四种长得几乎一样的变体,用这种隐写方式标记用户类型。群里当天又有多人被封,有号商说 Anthropic 在集中清理阿里相关的账...

推荐理由:Reddit 逆向帖确认了 Claude Code 用 Unicode 隐写标记中国用户,同一天多个封号报告,信息密度和时效性都很高。我会先打个折,因为来源是群聊日报而非一手报道,且帖子里的技术细节还没被 Anthropic 官方回应或第三方复现,所以分数卡在 85 以下。

Hacker News 首页

Anthropic 恢复 Claude Fable 5 全球访问,出口管制解除

美国政府在 6 月 12 日对 Claude Fable 5 和 Mythos 5 实施的出口管制,已于 6 月 30 日解除。Fable 5 将在 7 月 1 日重新向全球用户开放。事情的起因是亚马逊研究员发现了一种越狱方法,能让 Fable 5 识别并演示一个软件漏洞的利用方式。Anthropic 随后确认,包括 GPT-5.5 和 Kimi K2...

推荐理由:Anthropic官方宣布Fable 5出口管制解除并全球重新部署,这对一款旗舰模型来说是重大状态变更,而且多个来源都有印证。HKR三个维度都打中了:管制突然解除有悬念感,时间线和数据够具体,对用户来说这就是他们最想知道的。

Latent Space

Anthropic 发布 Claude Sonnet 5,但大家更关心 Fable 5 去哪了

Anthropic 今天推出了 Claude Sonnet 5,官方说这是他们最能干活的 Sonnet 模型,能自己做计划、用浏览器和终端,上下文窗口给到了 100 万 token。价格没涨,还是输入 3 美元/百万 token、输出 15 美元,8 月底前有促销价 2 美元/10 美元。但社区反应比较冷淡,因为跑分测试发现它消耗的 token 比之前...

推荐理由:Anthropic 发了 Sonnet 5,上下文 100 万 token,标价没涨,但社区实测发现分词器改了之后实际 token 消耗翻了好几倍,跑基准可能比 Fable 还贵。这事有新闻性,数字也够硬,加上用户对 Sonnet 系列有期待,所以 H、K、R 全中。我会先打个折:官方说没涨价,但实际用起来更烧钱,这点先别太激动。

纽约时报中文网

中国正用“AI马克思主义”和法庭判例,强行把保住饭碗写进AI发展剧本

这篇文章讲的是中国应对AI抢饭碗的独特打法,跟美国让公司自由狂奔的模式完全不同。武汉的无人出租车引发司机抗议后,官方一边压舆论,一边加速把“缓冲AI就业冲击”写进了五年规划。学者们甚至搞出了“AI马克思主义”,争论机器干活时价值到底算谁的。最实在的信号来自法院:杭州一个判例明确裁定,公司用AI软件取代员工后把人开了是违法的,判词里说技术本该“解放劳动”...

推荐理由:这篇NYT文章把几条线串在了一起:武汉无人出租车引发司机抗议后舆论被压、五年规划里写入缓冲AI就业冲击的条款、学者在争论机器创造的价值归谁,以及杭州法院那个“用AI取代员工后裁员违法”的判例。信息密度高,既有顶层设计又有具体案例,对理解中国AI落地的真实约束很有帮助。

TechCrunch · AI

美国取消对 Anthropic 最强模型 Mythos 和 Fable 的出口管制

美国政府撤回了 6 月 12 日刚加上的出口许可要求,Anthropic 宣布 7 月 1 日起恢复 Mythos 和 Fable 的公开访问。之前因为合规成本太高、没法大规模执行,Anthropic 直接切断了所有公开入口。商务部长 Lutnick 说 Anthropic 同意主动检测安全风险、跟政府合作制定发布标准并上报恶意活动——但这些事 Ant...

推荐理由:Anthropic 两款主力模型在 18 天内经历出口管制从加到撤,还附带了具体的安全合作条件,当天必须写。分数没上 90,因为公告没披露 Mythos 和 Fable 的能力变化,政策细节也还缺——正文只说 Anthropic 同意主动检测风险、合作制定发布标准、上报恶意活动,但没写怎么检测、标准是什么、上报给谁。

AI HOT 精选

Claude Code 被曝用隐写术标记中国用户,社区逆向发现 147 家中国公司域名黑名单

社区逆向工程发现,Claude Code 会读取你的系统时区(比如 Asia/Shanghai)和 ANTHROPIC_BASE_URL 环境变量,然后跟一份加密的 147 个中国公司域名列表做比对,名单里包括美团、字节跳动、月之暗面等。一旦命中,它会在发给服务器的系统提示词里动手脚——把日期里的单引号换成别的 Unicode 字符,连字符改成斜杠,用...

推荐理由:这事我会先打个折,因为目前只有社区逆向分析,Anthropic 官方还没回应。但手法本身太具体了——先读你的时区是不是 Asia/Shanghai,再查 ANTHROPIC_BASE_URL 环境变量,最后跟一份加密的 147 个中国公司域名名单做比对,名单里美团、字节、月之暗面都在。一旦命中,它就在发给服务器的系统提示词里动手脚,把日期里的单引号换成别的 Unicode 字符,连字符改成斜杠,等于在正常指令里藏了暗号。这不是误报,是刻意设计的识别链路。对国内开发者来说,用着你的产品还要被偷偷打标签,信任感直接崩掉。正文没披露这份名单是怎么来的、有...

Computing Life · Share · 鸭哥调研

你的公司还应该用 Claude Code 吗?

安全研究者逆向 Claude Code 2.1.196 发现,当用户配置了非官方 API 地址且命中中国时区、147 个已知域名或 11 个中国 AI 实验室关键词时,客户端会在系统提示词的日期字符串里嵌入肉眼难辨的 Unicode 字符作为标记。这不是网络外传,而是把环境分类结果藏进了发给模型的上下文里。另一条线索来自 GitHub issue #6...

推荐理由:这篇逆向分析挖出了一个具体机制,不是空口说白话——有触发条件、有字符映射表,安全、信任、地缘三条线全踩中了。没给更高分是因为目前只有单一逆向来源,还没看到 Anthropic 的回应或更多独立验证,我会先打个折。

Hacker News 首页

Anthropic 明天开始恢复 Claude Fable 5 和 Mythos 5 的访问权限

美国商务部解除了对 Claude Fable 5 和 Mythos 5 的出口管制,Anthropic 说明天开始逐步恢复访问。公告没解释当初为什么被管制、具体恢复时间表,也没提这两个模型的能力细节。如果是真的,之前被断掉的用户又能用上了,但正文没披露恢复范围是全体用户还是部分区域,这点先别太激动。

推荐理由:Anthropic 宣布商务部解除了对 Claude Fable 5 和 Mythos 5 的出口管制,明天开始逐步恢复访问。悬念和用户共鸣都强,但正文没披露管制原因、恢复范围、模型能力等关键信息,知识增量偏薄,所以 k 给了 false。

Hacker News 首页

美国商务部取消了对 Anthropic 两款模型 Claude Fable 5 和 Mythos 5 的出口管制

Anthropic 在推特上发了这个消息,但正文只给了一个链接,没展开说具体解除了哪些限制、什么时候生效,也没解释当初为什么对这两个模型设限。目前能确认的只有标题这一句,其他细节得等官方后续说明。

推荐理由:Anthropic 官方账号宣布了两个具名模型的政策变动,对合规和跨境团队是直接信号。分数没给更高是因为正文只有一个推文链接,生效时间、解除范围和当初设限的理由都没说,标题扛起了几乎所有信息量。

MIT Technology Review · AI

Anthropic 发布 Claude Science,把 AI 代理正式塞进实验室

Anthropic 把 Claude Science 定位成跟 Claude Code 同级别的旗舰产品,专门帮科学家写代码、在计算集群上跑实验,并且强调结果可复现。产品主要瞄准计算生物学和药物发现,现场演示了让它自主寻找苯丙酮尿症的药物候选分子。哈佛物理学家 Matthew Schwartz 之前评价 Opus 4.5 的研究能力相当于一个二年级博士...

推荐理由:Anthropic 发了个新旗舰产品,定位清晰,有现场演示,当天值得写。没给到 90 分以上是因为目前只有 MIT Tech Review 一篇报道,定价、开放时间、多源确认都还缺,我会先打个折。

Hacker News 首页

Superpowers 6:构建快 50%,省 60% 的 token,但只对 Claude 有效

Jesse Vincent 发布了 Superpowers 6,一个管 AI 编程 agent 的编排工具。他趁 Anthropic 短暂开放 Fable 的几天,让它通宵跑自动研究循环,把代码审查和需求合规审查合并成一步,并优化了 reviewer 拿 diff 的方式,最终在 Anthropic 的评估里把构建耗时砍掉一半,token 花费砍掉 6...

推荐理由:Superpowers 6 给出了两个实打实的数字:构建时间减半、token 成本降了六成,合并审查步骤的做法也讲得清楚,对正在折腾 agent 编排的人有用。但它终究是个人博客里的工具更新,不是产品发布或行业动作,覆盖面有限,刚好卡在 featured 门槛上。