跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 721–740 条 · 共 1,303 条

6月19日星期五

Computing Life · Share · 鸭哥调研

当执行力开始贬值:最会用 AI 的那批人,可能被 AI 伤得最深

文章从一个软件工程场景切入:上级一句“让 AI 做一下”,直接跳过了“这个功能该不该做”的判断环节。AI 把试错成本打到近乎为零,拆掉了过去靠工时和排期天然形成的价值过滤器,让团队默认进入执行模式,判断力使用频率集体下降。作者指出,AI 是定向杠杆,只放大执行,不放大判断。Anthropic 的研究发现,人类评审和偏好模型都更倾向给写得漂亮但迎合用户的...

推荐理由:这篇文章不是讲技术,是讲技术带来的组织病。从一个上级随口说“让 AI 做一下”的细节切入,把 AI 压低试错成本后如何拆掉价值过滤器这件事讲得很透。我会先打个折:它本质是篇评论,不是硬新闻,但观点有 Anthropic 的研究做支撑,不是空对空。对正在推 AI 落地的团队来说,这篇比很多工具介绍都值得看,因为它提醒你,省下来的时间如果全用来做更多执行,反而会废掉判断力。

Hacker News 首页

MCP 企业托管认证稳定版发布:一次登录,所有服务器自动连上

MCP 的企业托管授权(EMA)扩展正式稳定了。它让公司通过自己的身份系统(IdP)统一管着员工能连哪些 MCP 服务器,员工首次登录客户端时,该有的工具就自动配好,不用挨个应用点 OAuth 授权。Okta 是第一个支持的 IdP;Anthropic 的 Claude 家族和 VS Code 已经加了客户端支持;Asana、Atlassian、Fig...

推荐理由:MCP 的企业授权扩展正式稳定,解决了之前每加一个工具就要手动 OAuth 的痛点,这对企业落地 MCP 是实打实的减负。Okta 作为第一个 IdP 接入,加上 Claude 和 VS Code 客户端支持,说明生态在往企业可用性方向走。没给更高分是因为目前还是早期,正文没披露实际部署规模,效果有待验证。

AI HOT 精选

Claude Code 现在能把终端里的工作进度直接生成可分享的网页

Claude Code 开始支持 artifacts 了。你在终端里干活时,它可以把你当前的进度——比如代码改动说明、系统架构解释、数据看板——直接生成一个能交互的网页。这个网页带着完整的对话上下文,队友不用装 Claude Code 就能看。官方没说明这个功能是默认开启还是需要手动触发,也没提生成一个 artifact 会吃掉多少 token。

推荐理由:Anthropic 给 Claude Code 加了 artifacts 功能,你在终端里写代码、改架构、看数据时,能直接生成一个可交互的网页,把当前进度和完整对话上下文都打包进去,队友不用装 Claude Code 就能看。这对一直偏单人用的工具来说,是往团队协作迈了一步。不过官方没说明这个功能是默认开启还是需要手动触发,也没提生成一个 artifact 会吃掉多少 token,这点先别太激动。分数维持 78,因为 token 成本没公布,实际用起来可能得先打个折。

Product Hunt · AI

Claude Code 桌面版新增 Artifacts 功能:把编程过程自动生成可分享的实时网页

Anthropic 给 Claude Code 桌面应用加了个 Artifacts 功能,今天上线。它会把你的整个编程过程——代码库、对话记录、连接器——自动转成一个实时更新的网页,比如代码走查页面、事故看板、发布检查清单。团队不用手动同步进度,所有人看到的是同一个自动刷新的视图。页面默认只有你所在组织的人能看,内置版本历史,可以随时恢复。目前只开放给...

推荐理由:Anthropic 给 Claude Code 加了 Artifacts,把编程过程自动生成实时看板,机制清楚,团队痛点抓得准。没给更高分是因为这只是桌面端功能更新,不是模型或协议发布,而且目前只有 Product Hunt 一个信源,正文没披露后续开放范围和技术细节。

AI HOT 精选

Anthropic 官方指南:用 CLAUDE.md、技能、钩子、规则和子智能体调教 Claude Code

Anthropic 这篇博客把调教 Claude Code 的方法拆成了五块:CLAUDE.md 文件用来写项目级的全局指令,告诉模型这个项目的代码风格、架构和约定;技能(skills)是把重复的任务流程模板化,让模型按固定步骤执行;钩子(hooks)能在模型执行操作前后自动触发检查或脚本,比如提交代码前跑一遍测试;规则(rules)直接约束模型的行为...

推荐理由:Anthropic 出了一篇实操指南,把控制 Claude Code 的手段讲得很清楚,五层机制各有侧重,组合起来就是一套让模型在项目里更可控的玩法。它不是产品发布,所以重要性没到 85,但对正在用 Claude Code 的人来说很解渴,值得放进 featured。

6月18日星期四

The Verge · AI

Anthropic 刚发布的 Fable 5 被美国政府掐了出口,现在模型直接下线

Anthropic 上周刚把 Fable 5 放出来,这是他们第一个给公众用的“神话级”模型,底层是 Mythos 5,但加了很多安全护栏。结果没几天,美国政府就下了出口管制,连在美国工作的外国员工都不能碰这两个模型。Anthropic 干脆把 Fable 5 和 Mythos 5 全下线了,说不然没法合规。起因是亚马逊的研究员发现了一个可能的越狱漏洞...

推荐理由:Anthropic 首次向公众开放 Mythos 级别的模型 Fable 5,结果因为亚马逊研究员发现的越狱漏洞触发美国出口管制,几天内就全部下线。这件事同时踩中了产品动作、安全事件和政策冲击三个点,对从业者的实际影响很直接,所以给了 92 分。没给更高是因为目前只有单次事件,后续会不会变成常态还不清楚。

Hacker News 首页

SK 电信怎么卷进了 Anthropic 的 Mythos 芯片出口管制风波

WIRED 挖出了 Anthropic 的 Mythos 芯片项目与韩国 SK 电信之间的资金和合作细节。SK 电信既是 Anthropic 的投资方,也是云服务合作伙伴,调查怀疑这条管道可能被用来绕开美国对中国的芯片出口管制。文章梳理了双方的合作条款和资金流向,但核心问题——到底有没有法律责任——还没定论。我会先打个折:目前证据指向的是一个合规灰色地...

推荐理由:WIRED 把 Mythos 的故事从“是否存在”推进到“谁在出钱”,SK 电信的双重身份让合规疑云变得可触摸。正文没给出法律结论,所以重要性上我留了余地——结构可疑,但还不是铁证。

AI HOT 精选

苹果在 Xcode 27 里塞了个 AI 助手,能用聊天的方式修 Bug、搭 App

苹果在 WWDC 2026 的一个讲座里演示了 Xcode 27 的新 AI 功能。这个 AI 助手直接嵌在工具栏里,支持多轮对话,可以跨多个文件改代码,也能根据你的文字描述加上图标等素材,直接生成一个完整的 App。生成之后还能继续用对话让它加背景、特效、动画和翻译。底层方面,苹果推出了新的 Core AI 框架和升级版 MLX,让开发者在 App ...

推荐理由:苹果在 WWDC 讲座里演示了 Xcode 27 内置的 AI 助手,能跨文件修 Bug、按描述生成完整 App,底层还配了新的 Core AI 框架。对开发者工具链来说是一次实打实的升级,但正文没提发布时间和测试范围,所以分数先打个折。

Computing Life · Share · 鸭哥调研

这七个月,用 AI 写代码的方式变了

Anthropic 分析了 2025 年 10 月到 2026 年 4 月间 40 万次 Claude Code 真实会话,发现人们用 AI 写代码的习惯在变。修 bug 的会话占比从 33% 掉到 19%,运维和写作/数据分析各自翻了一倍,超过四成会话不以直接写代码为核心。人承担约七成规划决策,AI 代理承担约八成执行决策。新手验证成功率约 15%,...

推荐理由:Anthropic拿自家产品40万次真实会话做分析,给出了修bug比例下降、运维和写作翻倍、人机决策分工等硬数字,不是公关稿。三个维度都踩中了:标题有悬念、数据有判断、读者有共鸣。没给85+是因为这本质是使用行为报告而非模型或能力发布,冲击力比产品发布软一些,但作为趋势信号已经足够扎实。

Computing Life · Share · 鸭哥调研

Vercel 开源 eve:一个 agent 就是一个文件夹,这句话不是在玩文字游戏

Vercel 在伦敦 Ship 大会上开源了 eve,核心主张是“一个 agent 就是一个文件夹”。文件名自动注册为工具,Git 仓库就是 agent 本体,改一句指令就生成一个 diff 和预览部署。它内置了 durable execution(审批等待期间不烧算力)、沙箱 microVM 和多渠道支持(Slack、Discord、Teams、HT...

推荐理由:Vercel 在伦敦 Ship 大会上把 eve 开源了,核心主张是“一个 agent 就是一个文件夹”。文章没停留在口号上,而是拆解了具体怎么做到的:文件名自动注册为工具,Git 仓库就是 agent 本体,改一句指令就生成 diff 和预览部署。它还内置了 durable execution,审批等待期间不烧算力,用沙箱 microVM 做隔离,支持 Slack、Discord、Teams 等多渠道。这些机制细节让“文件夹即 agent”从一句营销话变成了可验证的架构选择。对在 LangChain 和托管服务之间摇摆的团队来说,eve 提供了一...

Hacker News 首页

OpenRouter 让 11 个大模型打了 30 场吃鸡赛,Grok 4.1 Fast 赢了 43%,成本只有 Claude 的 1/27

OpenRouter 的 Jacky Liang 把 11 个模型扔进一个 2D 吃鸡游戏里打了 30 局。Grok 4.1 Fast 赢了 13 局,每赢一局成本 0.97 美元;Claude Sonnet 4.6 赢了 5 局,每赢一局要 26.78 美元,差了 27 倍。GPT 5.4 杀了 38 个人头,全场最高,但只赢了 2 局——杀得多不等...

推荐理由:OpenRouter 官方博客,作者 Jacky Liang 自己跑了 30 局并公开了完整数据和回放。Grok 4.1 Fast 的成本优势很扎眼,Claude Sonnet 4.6 贵但表现稳定,GPT 5.4 人头最多却赢不了——三个发现都有具体数字支撑,可复现、可验证。对正在选模型搭 agent 的人来说,这种实战对比比跑分表有用。

AI HOT 精选

Claude Design 更新:跨项目记住你的品牌规范,还能和 Claude Code 搭着用

Anthropic 给 Claude Design 加了两个实用能力:一是它能跨项目记住你的设计系统,比如颜色、字体、组件这些,不用每次都重新教它;二是它现在能和 Claude Code 协同,你可以在编辑器里直接改设计稿。正文没提具体上线时间,也没说这是免费功能还是付费功能。

推荐理由:Anthropic 给 Claude Design 加了跨项目设计记忆和 Claude Code 协同,两个能力都算实在,不是画饼。但正文没提上线时间和是否收费,信息密度刚好够上 featured,再高就给不了了。

Hacker News 首页

Anthropic 派黑客 Nicholas Carlini 给美国政府演示怎么攻破自家模型,好让监管放心

WSJ 报道,Anthropic 让安全研究员 Nicholas Carlini 去给美国政府官员现场演示越狱和模型攻击,想证明他们能管住 AI 的安全风险。Carlini 之前在 Google Brain,专门研究对抗样本和模型攻击。报道没说他具体展示了哪些攻击手法,也没提政府那边看完是什么反应。

推荐理由:WSJ 独家,讲 Anthropic 让安全研究员 Nicholas Carlini 去给美国政府现场演示越狱和模型攻击,想用这种方式证明自己能管住安全风险。我会先打个折:报道没说他到底演示了什么攻击,也没写政府那边看完是更放心还是更紧张,所以信息量其实有限。但选题本身有张力——派黑客去安抚监管,这个叙事角度在当下的 AI 安全讨论里挺少见,从业者会愿意点开看一眼。

AI HOT 精选

Claude 出了个设计工具,能跨项目统一品牌风格,还能在画布上直接改

Anthropic 在 Claude 里塞了个叫 Claude Design 的设计功能。它主要干三件事:跨项目自动保持品牌视觉一致,不用来回对色卡和字体;支持在画布上直接编辑,不用导出到别的软件;还能跟 Claude Code 同步,但正文没解释同步具体是怎么实现的、支持哪些第三方工具,也没说什么时候正式上线。如果是真的,对需要频繁出设计稿又不想在工...

推荐理由:Anthropic 把设计功能直接塞进 Claude,跨项目品牌统一和画布编辑这两个点打的是真实工作流里的痛点,不是纯 demo。但正文对 Code 同步的实现方式、第三方工具支持和上线时间只字未提,信息缺口让这条消息停在值得关注但还不能全信的级别。

TechCrunch · AI

各国想要美国 AI,但不想让美国能随时关掉它

G7 峰会上,马克龙和莫迪直接对美国 AI 公司老板和特朗普挑明了担忧:美国模型确实强,但如果美国哪天突然切断访问,依赖这些模型的国家关键基础设施就会瘫痪。这个恐惧不是凭空来的——最近 Anthropic 一次宕机就让欧洲用户完全用不了 Claude。马克龙在午餐会上说得很直白,没有哪个国家敢把命脉接在一个美国能单方面拉闸的模型上。文章没给出具体政策方...

推荐理由:马克龙和莫迪在 G7 上直接对美国 AI 公司老板和特朗普挑明了这个担忧,不是空穴来风,而是有 Anthropic 宕机事件做引子。文章把“模型强但开关在别人手里”这个恐惧讲得很清楚,对从业者来说是个真实的供应链风险提醒。缺点也很明显:只描述了现象,没给出任何政策或技术上的解法,读完知道问题严重,但不知道下一步该怎么办。

The Verge · AI

Anthropic 被自己人也看不懂的出口管制规则搞停了服务

Anthropic 在部分国家突然切断了 Claude 的访问,原因是撞上了一套连律师都解释不清的美国出口管制规则。公司只能按最保守的理解自我审查,直接关停服务。专家警告,这种模糊、临时的干预方式撑不起 AI 监管的长期框架。

推荐理由:这篇独家报道把 AI 监管从讨论层面拉到了运营现实:Anthropic 真的停服了,有具体国家名单和内部决策细节,信号密度高。扣分点是单一信源,没有官方声明,但事件本身已经足够说明问题——模糊的出口管制正在变成 AI 公司的实际运营风险,值得放在头条让从业者看到。

AI HOT 精选

Anthropic 和 DeepMind 老板在 G7 闭门会上提议建 AI 联盟,把中国挡在门外

Dario Amodei 和 Demis Hassabis 在 G7 闭门会上提了个方案:由美国牵头拉一个 AI 规则联盟,拿最前沿的模型和芯片当筹码,不让中国参与。正文没写会议具体日期,也没提其他 G7 成员怎么回应。有评论说这等于开启一场高科技冷战,直接从根上切断对手的入场资格。

推荐理由:我会先打个折:正文没写会议具体日期,也没提其他 G7 成员怎么回应,所以实际落地阻力还不清楚。但两家 CEO 联名在 G7 场合提这种硬切割方案,本身已经是明确的站队信号,对从业者判断供应链和合作风险有直接参考价值。

6月17日星期三

Hacker News 首页

Anthropic 员工指责特朗普政府故意针对他们

白宫上周五以国家安全为由,限 Anthropic 在 90 分钟内下架最新模型 Fable 5 和 Mythos 5。公司内部聊天记录显示,官方给出的理由前后不一:先说是担心外国公司获取系统权限,后来又改口称模型本身存在重大漏洞。六天过去了,约 3000 名员工仍不清楚到底发生了什么,CEO Dario Amodei 与政府的谈判也没能打破僵局。员工还...

推荐理由:纽约时报独家爆料,白宫以国家安全为由要求 90 分钟内下架 Fable 5 和 Mythos 5,给出的理由前后矛盾,CEO 谈判陷入僵局,3000 名员工蒙在鼓里。HKR 三项都踩中了——冲突细节和内部信息密度很高。没给到 95 以上,是因为目前只有员工一方的说法,政府那边的具体依据还没披露,事情可能还有反转。

AI 群聊日报

群友实测:Fable 5 活了三天就被收走,但用过的人都说它是“上帝下凡”

Anthropic 的 Fable 5 模型上线大约 72 小时就被撤下,正文没披露具体原因。群友实测下来,它在复杂推理、编程和写作上明显强过 Opus 4.8 和 GPT-5.5:有人卡了两个月的难题它两分钟解决,MindStudio 测出多步编程自纠率 81%,Vellum 直接说这是“代差级跃升”。但它也有短板——代码评审精度不如 Opus 4....

推荐理由:Anthropic 的 Fable 5 短暂露面后被撤,群友实测数据扎实(81% 自纠率、代差级跃升评价),在钩子、干货和情绪共鸣三个维度都踩中了。扣分点在于信源是群聊整理而非官方发布,且下架原因正文没披露,所以重要性没给到顶。

Computing Life · Share · 鸭哥调研

推理模型四年史:你以为的石破天惊,其实早有暗线

推理模型不是2024年突然蹦出来的。让模型写解题步骤的思维链、用自己生成的正确推理训练自己的STaR、给中间步骤打分的过程奖励模型,这些技术从2022年起就陆续成熟了。o1真正改变的是产品化:把推理变成一种可以计费、可以调度的资源,在API里引入reasoning tokens和可调节的思考强度参数,相当于给scaling law开了第二个轴。Deep...

推荐理由:这是一篇有信息量的长文综述,用具体论文和时间线追溯推理模型的技术源头,核心判断是o1的分水岭在于把推理产品化成可计费算力,而非发明了推理本身。HKR三项都踩中,但属于梳理整合型内容而非独家爆料,放在78分、featured层级合理。