跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 821–840 条 · 共 1,303 条

6月10日星期三

AI HOT 精选

Claude 托管智能体新增定时运行和环境变量保险库

Claude 的托管智能体(Managed Agents,让模型进业务流程干活的工具)现在支持用 cron 表达式设定时任务,到点自动跑,不用人守着。同时上线了 Vaults 功能,用来存 API 密钥、数据库密码这类敏感信息。智能体跑任务时能调用这些变量,但模型本身读不到明文——密钥只在网络边界上才被替换成真实值。正文没披露定时任务的最小间隔和 Va...

推荐理由:Claude 的托管智能体现在能设 cron 定时任务,到点自己跑,不用人盯。同时上了 Vaults 功能存 API 密钥、数据库密码这些敏感信息,智能体跑任务时可以调用,但模型本身读不到明文——密钥只在网络边界上才被替换成真实值。正文没披露定时任务的最小间隔和 Vaults 的访问控制粒度,这点先别太激动。整体是给智能体补运维能力,不是模型升级,所以分数就卡在这个位置。

The Verge · AI

微软 AI 负责人 Suleyman 说 Anthropic 暗示 Claude 有意识是“非常非常危险”的

微软 AI CEO Mustafa Suleyman 在 Decoder 播客里直接批评 Anthropic,说他们在给 Claude 定规矩的“宪法”文件里暗示模型有意识,这种做法“非常非常危险”。他的逻辑是:Anthropic 把 Claude 设计得太像人了,结果反过来把自己“洗脑”了——他们亲手塞进去的“意识火花”,最后自己信以为真。不过这篇报...

推荐理由:Mustafa Suleyman 在播客里直接点名 Anthropic,说他们在 Claude 的宪法文件里暗示模型有意识,这种做法“非常非常危险”。他的逻辑链条很清楚:Anthropic 把 Claude 设计得太像人了,结果反过来把自己“洗脑”了——亲手塞进去的“意识火花”,最后自己信以为真。这个批评不是泛泛而谈,而是指向一个具体的设计决策。不过目前只有 Suleyman 单方面的说法,Anthropic 还没回应,所以我会先打个折,不把重要性拉满。

AI HOT 精选

Claude Code 团队成员 Thariq 的十条效率建议:从检查它做没做对,转向检查它做没做对的事

Thariq 的核心观点是换个思路用 Claude Code:别老盯着输出结果挑错,先确保它接对了任务。他给了十条具体做法。第一,一上来就把项目背景、限制条件全丢给它,把它当能跟你讨论的同事,而不是个补丁工具。第二,用一份简短的需求文档引导 Claude 反问你细节,把模糊想法聊清楚。第三,让它同时探索几个方案,直接生成 HTML 原型给你看,比看文字...

推荐理由:这篇是 Claude Code 的实战教程,干货密度高。Thariq 没讲大道理,而是给了十条能立刻上手的操作,比如先把项目背景全丢给模型、用需求文档引导它反问细节、让它同时跑几个方案出 HTML 原型对比。核心思路是把 Claude 当能讨论的同事,而不是补丁工具,这个视角切换本身就值回票价。内部人士分享加上三条 HKR 全中,放在 featured 没问题。

AI HOT 精选

OpenRouter 的 Advisor 工具页面 404 了,正文没披露任何细节

OpenRouter 原本要介绍一个叫 Advisor 的工具,让 GPT-4o Mini 这类便宜模型在生成过程中可以随时去问 Claude Fable 等更强模型。但博客页面直接返回 404,文章不存在。定价、延迟、路由策略这些关键信息全都没公开,目前只能看到标题和摘要里的概念,没法判断实际效果和成本。

推荐理由:我会先打个折:OpenRouter 这篇博客直接 404,正文没披露定价、延迟、路由策略和实际效果,目前只有标题和摘要里的概念。概念本身有意思——让便宜模型在生成中途去问强模型,相当于给低成本模型配了个随时可叫的顾问,不是简单的 fallback 或静态路由。这点先别太激动,因为没数据验证到底省不省钱、延迟高不高、强模型被调用的频率和策略全都不清楚。对正在搭模型路由栈的团队来说,这个方向确实踩中了成本与质量的平衡点,但信息缺口太大,只能当产品信号看。

AI HOT 精选

上手 Claude Fable:Anthropic 的新模型让 AI 自己干活儿了

Ethan Mollick 提前试用了 Anthropic 的 Mythos 级模型 Claude 5 Fable。他的结论是,这模型比他用过的所有公开模型都强出一大截,而且人和 AI 的关系可能要变了。Fable 能自己连续跑十几个小时,执行好几页纸的指令。Mollick 让它从零做一个等时线地图,模型自己派了一堆子 AI 去查了 2200 多个航班...

推荐理由:Ethan Mollick 提前摸了 Claude Fable,说它比所有公开模型都强一截,能自己连续跑十几个小时、执行好几页纸的指令,甚至自己派子 AI 去查 2200 多个航班做地图。听着像模型能当项目经理使了,但正文没披露参数量、跑分、成本和什么时候能用,这点先别太激动。H 和 R 分高是因为新模型名加推理/代码定位确实抓眼球,K 分低是因为除了一个用例,关键信息全是缺口。Anthropic 光环有加成,但缺价格和基准测试,所以没到必写级别。

AI HOT 精选

Claude Fable 5 和 Mythos 5 发布:编程最强、能打游戏,但安全限制会误拦 5% 的对话

Anthropic 发了两个新模型:Claude Fable 5 和 Claude Mythos 5。Fable 5 是面向普通用户的安全版,Mythos 5 是给网络安全防御方用的无限制版,目前只通过美国政府合作项目开放。Fable 5 在软件工程、知识工作和视觉任务上都是新标杆——Stripe 测试时,它一天干完了原本一个团队两个月的代码迁移活;在...

推荐理由:Anthropic 一次发了两个模型,Fable 5 是普通用户能用的安全版,Mythos 5 是给网络安全防御方用的无限制版,目前只走美国政府合作渠道。Fable 5 在软件工程、知识工作和视觉任务上都刷了新纪录——Stripe 拿它做代码迁移,一天干完原本一个团队两个月的活。药物设计速度也快了 10 倍,这个数字挺夸张,但正文没披露具体测试条件和对比基线,先打个折看。定价方面,Fable 5 每百万 token 输入 10 美元、输出 50 美元,比前代贵了不少,得算算性价比。整体看,这是一次 Claude 主线模型的实质性更新,有定价、有基准...

The Verge · AI

Anthropic 放出首个 Mythos 级模型 Claude Fable 5,之前因网络安全能力太强被扣着没发

Anthropic 发布了 Claude Fable 5,说这是他们迄今公开的最强模型。它在软件工程、知识类工作和视觉任务上表现突出,任务越长越复杂,领先优势越明显。Fable 5 是 Mythos 系列第一个大规模公开的模型,之前这个系列因为网络安全能力太强,公司觉得放出来太危险。这次能发,是因为加了新安全机制,会在特定高风险领域直接拦截回答。正文没...

推荐理由:Anthropic 把之前自己判定为太危险的 Mythos 系列第一次公开了,这件事本身就够大。Fable 5 在长任务软件工程上拉开的差距有具体数字,不是公关话术。新加的安全拦截器是它能公开的关键,但正文没细说拦截机制到底多可靠、会不会误伤,这点先别太激动。整体来看,这是今年模型发布里少数能同时炸到技术圈和安全圈的一次。

TechCrunch · AI

Anthropic 把最强模型 Mythos 砍掉危险能力后,以 Claude Fable 5 的名字向公众开放

Anthropic 第一次把自家最强的 Mythos 模型开放给普通人用,但加了一道硬锁:在网络安全、生物、化学和模型蒸馏(用大模型教小模型)这些高风险领域,Fable 5 会直接拒答,退回到更保守的 Claude Opus 4.8。这个模型擅长写代码、知识类工作和图像理解。今年四月 Mythos 刚露面时只给少数合作伙伴试用,原因就是怕被拿去搞网络攻...

推荐理由:Anthropic 把内部最强模型放出来给普通人用,本身就是产品层面的实质性动作,安全机制也说得够细。HKR 三条全中。没给更高分是因为正文没放跑分对比,也没提价格,实际能力和性价比还得等实测。

Hacker News 首页

Claude Fable 5 与 Mythos 5 系统卡:一个模型,两套安全锁

Anthropic 发了份 319 页的系统卡,讲的是同一个新模型拆成了两个版本:Fable 5 给大众用,但加了安全锁,不让它在生物、网安这类高危领域干活;Mythos 5 则把相关限制解开了,只开放给 Project Glasswing 等少数受信合作伙伴。先说能力,Mythos 5 是他们训过最强的模型,在漏洞开发这类网安测试里把 Opus 4....

推荐理由:Anthropic 在同一天发了 Claude 5 的两个版本和配套系统卡,Mythos 5 自称最强、但只给受信伙伴用,Fable 5 则在高危领域加了限制。这种能力分级和透明披露的做法,对关注模型安全与能力边界的从业者来说是个重要信号。放在 85–94 这个区间没问题,因为信息够新、够具体,而且直接关系到 Claude 用户和开发者的实际使用。

AI HOT 精选

Apollo 和 Blackstone 联手搞了个 350 亿美元的 AI 融资交易,涉及 Anthropic 和 Broadcom

华尔街两大资管巨头 Apollo 和 Blackstone 正在合作一笔 350 亿美元的 AI 融资,交易方包括模型公司 Anthropic 和芯片公司 Broadcom。视频标题说这是为昂贵的 AI 芯片设计新的融资模式,但正文被 Bloomberg 的反爬机制挡住了,具体交易结构、钱怎么分、谁出多少都没披露。

推荐理由:标题和摘要把牌面摊开了:两大资管巨头凑 350 亿美元,拉上模型方 Anthropic 和芯片方 Broadcom,想搞一种专门给 AI 芯片用的融资玩法。这个金额放在 AI 融资里算顶格,而且 Apollo 和 Blackstone 平时不常一起出现在 AI 头条,所以 HKR 三项都站得住。不过正文被 Bloomberg 反爬挡死了,具体交易结构、各家出多少钱、钱是债还是股、有没有资产抵押,这些关键信息全都没披露。我会先打个折:目前只能根据已知的参与方和金额给到 featured 档,等结构细节出来再重新掂量。

6月9日星期二

Computing Life · Share · 鸭哥调研

Anthropic 的稻瘟病实验:AI 抹平了知识差,但捅出了判断力的新缺口

Anthropic 在 Fable 5 安全报告里跑了一个实验:六位生物学博士配 LLM 专家,用 Claude Mythos 5 在 16 小时内设计农业病原体防御方案。通用组有两支团队赢了全部专家团队,专家自己估算纯人工要两到三个半月。AI 在文献检索和跨领域综合上打平了专家,但反复在判断答案对不对、什么时候该停下来上翻车——会虚构引用、高估可行性...

推荐理由:Anthropic 在 Fable 5 安全报告里藏了一个对照实验,结果反直觉:通用组加 LLM 专家在稻瘟病防御方案上赢了全部专家团队,时间从两三个半月压到 16 小时。AI 在文献检索和跨领域综合上打平专家,但在判断答案对不对、什么时候该停上反复翻车,会虚构引用、高估可行性。信息密度高,有具体数字支撑,结论直接冲击从业者对自身价值的判断,HKR 三项全中,选 featured 合理。

Computing Life · Share · 鸭哥调研

Fable 5 很贵,但省钱的答案 Anthropic 两个月前就发布了

Anthropic 发布了 Claude Fable 5,输出价格每百万 token 50 美元,是 Sonnet 4.6 的三倍多。省钱的办法他们自己早在四月就给了:advisor tool。让便宜的模型(比如 Sonnet)干活,遇到拿不准的决策时,花几百个 token 请 Opus 出个主意,方向盘始终在便宜模型手里。官方数据显示,Sonnet ...

推荐理由:Fable 5 发布本身是大新闻,但这篇的重点是 advisor tool 作为省钱模式,不是首发消息。HKR 全中:价格对比制造好奇,advisor 机制具体可操作,成本决策直接戳中 agent 开发者。但文章没给 Fable 5 自己的评测数据,信息有缺口,所以重要性给 78 而不是更高。

Computing Life · Share · 鸭哥调研

付 Fable 的价,拿 Opus 的货:AI 安全护栏的另一重身份

Anthropic 在 6 月 9 日发布了 Fable 5 和 Mythos 5,两个模型底层相同,但部署方式不同。Fable 5 面向公众,内置一个分类器,遇到网络安全、生物化学等敏感问题时,会自动把请求转给上一代 Opus 4.8 处理;Mythos 5 则解除限制,只对受信任的合作伙伴开放。文章把这套操作和 Anthropic 近三十天内的其他...

推荐理由:文章把 Fable 5 的安全分类器说成一道定价围栏——敏感问题自动甩给上一代 Opus 4.8,等于用便宜模型的钱蹭贵模型的能力。这个解读本身有争议,但作者用三十天内的五次产品动作(包括模型发布、API 调整、安全白皮书更新)拼出一条清晰的商业化时间线,论据给得具体。后半段信息密度有点掉,部分推论依赖对 Anthropic 意图的猜测,正文没直接证实定价动机,所以重要性扣了几分。整体适合推给关心 Claude 成本和产品走向的人。

FT · 科技

Apollo 和 Blackstone 为 Anthropic 搞了 350 亿美元芯片融资

两家资管巨头 Apollo 和 Blackstone 联手给 Anthropic 筹了 350 亿美元,专门用来买芯片。这笔钱会支撑 Claude 后续的算力扩张。不过正文被付费墙挡住了,具体融资结构、是债务还是租赁、芯片由谁采购、交付时间表这些关键细节都没披露。350 亿这个数字很大,但先别急着对标英伟达的订单——没看到条款之前,不好判断实际杠杆有多高。

推荐理由:350 亿美元买芯片,数字很大,但正文被付费墙挡了,融资结构、是债还是租赁、芯片谁采购、什么时候交付,这些关键信息都没披露。我会先打个折——没看到条款之前,不好判断实际杠杆有多高,也不急着对标英伟达的订单。所以重要性给到 88,放在 p1 里,但不到 95 以上那档。

AI HOT 精选

奥尔特曼说 OpenAI 进入第三阶段:把 AI 做成便宜、好用、安全的日常工具

OpenAI 的 CEO 奥尔特曼和首席科学家帕霍茨基发了一篇博客,把公司发展分成三个阶段:第一阶段搞技术研发,第二阶段把产品推向全球看用户怎么用,现在正式进入第三阶段。他们的目标是让先进 AI 变得供给充足、成本亲民、安全实用,让每个人和机构都能用上。具体提了三个方向:做能自动搞科研的 AI 研究员、加快经济增长、给全球每个人配一个专属的通用人工智能...

推荐理由:这篇是奥尔特曼和首席科学家联名的路线图博客,把公司发展切成三个阶段,现在正式进入“让 AI 普及、易用且安全”的第三阶段。我会先打个折:正文没给出任何模型发布时间、性能指标或成本数字,所以重要性到不了 85。但“第三阶段”这个提法本身是个清晰的叙事钩子,三个目标(自动科研、经济加速、个人 AGI)和成立国际机构的建议,把 OpenAI 接下来的发力方向摊开了。对从业者来说,这篇能帮你判断 OpenAI 会把资源往哪砸、安全治理的调子怎么定,值得一看。

AI HOT 精选

Anthropic 发了个 Swift 包,三行代码就能在苹果 App 里调用 Claude

Anthropic 给苹果开发者送了个新工具:一个 Swift 包,让 Claude 直接接入苹果的 Foundation Models 框架。开发者写三行代码就能调用,返回的是 Swift 原生类型,不用自己解析 JSON。支持多步推理、代码生成、联网搜索和数据分析,跑在 iOS 27、macOS 27 这些新系统上。说白了,就是苹果在自己的 AI ...

推荐理由:HKR 三项都成立:Anthropic 确实发了一个让 Claude 接入苹果 Foundation Models 框架的 Swift 包,但这是开发者工具层面的集成,不是新模型发布,所以放在 featured 档里偏高的 82 分。正文没提这个包是否开源、有没有延迟或成本数据,我会先打个折,别把它当成 Claude 在苹果端全面铺开的信号。

AI HOT 精选

OpenAI 秘密提交 IPO 申请,跟 Anthropic 抢资本跑道;Altman 说 2028 年 3 月前 AI 会扛起大部分研究工作

OpenAI 已经向 SEC 秘密交了 S-1 表格,正式启动上市审查。秘密提交的好处是收入、亏损、客户名单这些敏感数字暂时不用公开。Anthropic 上周也走了同样的流程,两家从拼模型直接升级成拼融资,抢的是下一代 AI 基础设施的钱。Sam Altman 在博客里放了个时间点:到 2028 年 3 月,OpenAI 大部分研究工作会由 AI 自己...

推荐理由:两家最受关注的 AI 公司几乎同时启动上市流程,从拼模型直接升级成拼融资,这个节点本身就值得从业者关注。Altman 给出的 2028 年研究自动化时间表是个很具体的判断,不管最后能不能兑现,都会影响行业对人才和资金配置的预期。信息源只有一条 X 上的帖子,没看到 S-1 原文或更多财务细节,所以先打 90 分,等正式招股书出来再往上调。

AI HOT 精选

OpenAI 悄悄交了上市申请,跟 Anthropic 前后脚

OpenAI 本周一秘密向 SEC 提交了 S-1 表格,正式启动 IPO。Anthropic 在 6 月 1 号也交了同样的文件。因为是秘密提交,高管拿多少钱、业务有什么风险这些关键信息现在都看不到。Anthropic 刚拿完一轮融资,被说是全球估值最高的初创公司,但正文没披露具体估值数字。

推荐理由:OpenAI 秘密交表,Anthropic 六月初也交了,两家最受关注的模型公司都在冲上市。因为是秘密提交,高管薪酬和业务风险这些关键信息现在都看不到,这点先别太激动。Anthropic 刚拿完一轮融资,被说是全球估值最高的初创公司,但正文没披露具体估值数字,没法判断到底贵不贵。事件本身分量够重,直接给 p1。

TechCrunch · AI

OpenAI 悄悄提交了 IPO 申请,跟 Anthropic 前后脚

OpenAI 在 Anthropic 提交上市申请一周多后,也向监管机构秘密递交了 IPO 文件。两家 AI 公司的上市竞赛明显提速。正文没披露估值、募资金额和具体上市时间表,我会先打个折——这些关键数字没出来之前,别急着判断谁更值钱。

推荐理由:OpenAI 跟着 Anthropic 的脚步秘密交表,上市节奏明显加快。正文没披露估值、募资额和具体时间表,我会先打个折——这些关键数字没出来之前,别急着判断谁更值钱。

r/LocalLLaMA

Levi:在你的本地 Qwen 30B 上跑类似 AlphaEvolve 的搜索系统

Levi 是一个开源项目,让你能在本地用 Qwen3-30B-A3B 模型跑一套类似 AlphaEvolve 的搜索系统。作者在 ADRS、IFBench 和 HotpotQA 三个基准上做了测试,声称在单模型、相同预算的条件下,整体成本最多能降到原来的 1/35,评估次数最多能减少到 1/12。不过正文被 Reddit 的网络屏蔽页挡住了,具体实现细...

推荐理由:这篇来自 Reddit 的帖子只给了模型名、基准和成本比例,代码成熟度和可复现细节正文被屏蔽了没看到,所以我会先打个折。但能在本地用 Qwen3-30B-A3B 跑 AlphaEvolve 风格搜索这件事本身挺抓人,数字如果属实确实省钱,先给 featured 让社区去验证。