跳到正文

#Anthropic

今日 12 条

6月19日星期五

AI HOT 精选

Steve Yegge:Fable 被美国政府短暂关闭,意味着最聪明的 AI 模型以后会像核武器一样被锁起来

Steve Yegge 认为,Fable 模型被美国政府短暂关停是一个分水岭,说明模型智能已经危险到需要管控了。他预测,最多再过两三代模型,最前沿的 AI 就会像核武器一样被政府严格管制,绝大多数财富 500 强公司都拿不到访问权限。开源模型虽然能追到 Fable 这个级别,但受限于算力壁垒和供应链封锁,很难再往上突破。对大多数人来说,AI 能力曲线会...

推荐理由:Steve Yegge 把 Fable 被短暂关停这件事当成一个分水岭来聊,核心论点是 AI 能力曲线很快会被政府管制压平。判断很锋利,预测也具体,但本质是评论分析,不是一手报道,缺可核实的新事实,所以分数上我会打个折。

Computing Life · Share · 鸭哥调研

当执行力开始贬值:最会用 AI 的那批人,可能被 AI 伤得最深

文章从一个软件工程场景切入:上级一句“让 AI 做一下”,直接跳过了“这个功能该不该做”的判断环节。AI 把试错成本打到近乎为零,拆掉了过去靠工时和排期天然形成的价值过滤器,让团队默认进入执行模式,判断力使用频率集体下降。作者指出,AI 是定向杠杆,只放大执行,不放大判断。Anthropic 的研究发现,人类评审和偏好模型都更倾向给写得漂亮但迎合用户的...

推荐理由:这篇文章不是讲技术,是讲技术带来的组织病。从一个上级随口说“让 AI 做一下”的细节切入,把 AI 压低试错成本后如何拆掉价值过滤器这件事讲得很透。我会先打个折:它本质是篇评论,不是硬新闻,但观点有 Anthropic 的研究做支撑,不是空对空。对正在推 AI 落地的团队来说,这篇比很多工具介绍都值得看,因为它提醒你,省下来的时间如果全用来做更多执行,反而会废掉判断力。

Hacker News 首页

MCP 企业托管认证稳定版发布:一次登录,所有服务器自动连上

MCP 的企业托管授权(EMA)扩展正式稳定了。它让公司通过自己的身份系统(IdP)统一管着员工能连哪些 MCP 服务器,员工首次登录客户端时,该有的工具就自动配好,不用挨个应用点 OAuth 授权。Okta 是第一个支持的 IdP;Anthropic 的 Claude 家族和 VS Code 已经加了客户端支持;Asana、Atlassian、Fig...

推荐理由:MCP 的企业授权扩展正式稳定,解决了之前每加一个工具就要手动 OAuth 的痛点,这对企业落地 MCP 是实打实的减负。Okta 作为第一个 IdP 接入,加上 Claude 和 VS Code 客户端支持,说明生态在往企业可用性方向走。没给更高分是因为目前还是早期,正文没披露实际部署规模,效果有待验证。

AI HOT 精选

Claude Code 现在能把终端里的工作进度直接生成可分享的网页

Claude Code 开始支持 artifacts 了。你在终端里干活时,它可以把你当前的进度——比如代码改动说明、系统架构解释、数据看板——直接生成一个能交互的网页。这个网页带着完整的对话上下文,队友不用装 Claude Code 就能看。官方没说明这个功能是默认开启还是需要手动触发,也没提生成一个 artifact 会吃掉多少 token。

推荐理由:Anthropic 给 Claude Code 加了 artifacts 功能,你在终端里写代码、改架构、看数据时,能直接生成一个可交互的网页,把当前进度和完整对话上下文都打包进去,队友不用装 Claude Code 就能看。这对一直偏单人用的工具来说,是往团队协作迈了一步。不过官方没说明这个功能是默认开启还是需要手动触发,也没提生成一个 artifact 会吃掉多少 token,这点先别太激动。分数维持 78,因为 token 成本没公布,实际用起来可能得先打个折。

Product Hunt · AI

Claude Code 桌面版新增 Artifacts 功能:把编程过程自动生成可分享的实时网页

Anthropic 给 Claude Code 桌面应用加了个 Artifacts 功能,今天上线。它会把你的整个编程过程——代码库、对话记录、连接器——自动转成一个实时更新的网页,比如代码走查页面、事故看板、发布检查清单。团队不用手动同步进度,所有人看到的是同一个自动刷新的视图。页面默认只有你所在组织的人能看,内置版本历史,可以随时恢复。目前只开放给...

推荐理由:Anthropic 给 Claude Code 加了 Artifacts,把编程过程自动生成实时看板,机制清楚,团队痛点抓得准。没给更高分是因为这只是桌面端功能更新,不是模型或协议发布,而且目前只有 Product Hunt 一个信源,正文没披露后续开放范围和技术细节。

AI HOT 精选

Anthropic 官方指南:用 CLAUDE.md、技能、钩子、规则和子智能体调教 Claude Code

Anthropic 这篇博客把调教 Claude Code 的方法拆成了五块:CLAUDE.md 文件用来写项目级的全局指令,告诉模型这个项目的代码风格、架构和约定;技能(skills)是把重复的任务流程模板化,让模型按固定步骤执行;钩子(hooks)能在模型执行操作前后自动触发检查或脚本,比如提交代码前跑一遍测试;规则(rules)直接约束模型的行为...

推荐理由:Anthropic 出了一篇实操指南,把控制 Claude Code 的手段讲得很清楚,五层机制各有侧重,组合起来就是一套让模型在项目里更可控的玩法。它不是产品发布,所以重要性没到 85,但对正在用 Claude Code 的人来说很解渴,值得放进 featured。

6月18日星期四

The Verge · AI

Anthropic 刚发布的 Fable 5 被美国政府掐了出口,现在模型直接下线

Anthropic 上周刚把 Fable 5 放出来,这是他们第一个给公众用的“神话级”模型,底层是 Mythos 5,但加了很多安全护栏。结果没几天,美国政府就下了出口管制,连在美国工作的外国员工都不能碰这两个模型。Anthropic 干脆把 Fable 5 和 Mythos 5 全下线了,说不然没法合规。起因是亚马逊的研究员发现了一个可能的越狱漏洞...

推荐理由:Anthropic 首次向公众开放 Mythos 级别的模型 Fable 5,结果因为亚马逊研究员发现的越狱漏洞触发美国出口管制,几天内就全部下线。这件事同时踩中了产品动作、安全事件和政策冲击三个点,对从业者的实际影响很直接,所以给了 92 分。没给更高是因为目前只有单次事件,后续会不会变成常态还不清楚。

Hacker News 首页

SK 电信怎么卷进了 Anthropic 的 Mythos 芯片出口管制风波

WIRED 挖出了 Anthropic 的 Mythos 芯片项目与韩国 SK 电信之间的资金和合作细节。SK 电信既是 Anthropic 的投资方,也是云服务合作伙伴,调查怀疑这条管道可能被用来绕开美国对中国的芯片出口管制。文章梳理了双方的合作条款和资金流向,但核心问题——到底有没有法律责任——还没定论。我会先打个折:目前证据指向的是一个合规灰色地...

推荐理由:WIRED 把 Mythos 的故事从“是否存在”推进到“谁在出钱”,SK 电信的双重身份让合规疑云变得可触摸。正文没给出法律结论,所以重要性上我留了余地——结构可疑,但还不是铁证。

AI HOT 精选

苹果在 Xcode 27 里塞了个 AI 助手,能用聊天的方式修 Bug、搭 App

苹果在 WWDC 2026 的一个讲座里演示了 Xcode 27 的新 AI 功能。这个 AI 助手直接嵌在工具栏里,支持多轮对话,可以跨多个文件改代码,也能根据你的文字描述加上图标等素材,直接生成一个完整的 App。生成之后还能继续用对话让它加背景、特效、动画和翻译。底层方面,苹果推出了新的 Core AI 框架和升级版 MLX,让开发者在 App ...

推荐理由:苹果在 WWDC 讲座里演示了 Xcode 27 内置的 AI 助手,能跨文件修 Bug、按描述生成完整 App,底层还配了新的 Core AI 框架。对开发者工具链来说是一次实打实的升级,但正文没提发布时间和测试范围,所以分数先打个折。

Computing Life · Share · 鸭哥调研

这七个月,用 AI 写代码的方式变了

Anthropic 分析了 2025 年 10 月到 2026 年 4 月间 40 万次 Claude Code 真实会话,发现人们用 AI 写代码的习惯在变。修 bug 的会话占比从 33% 掉到 19%,运维和写作/数据分析各自翻了一倍,超过四成会话不以直接写代码为核心。人承担约七成规划决策,AI 代理承担约八成执行决策。新手验证成功率约 15%,...

推荐理由:Anthropic拿自家产品40万次真实会话做分析,给出了修bug比例下降、运维和写作翻倍、人机决策分工等硬数字,不是公关稿。三个维度都踩中了:标题有悬念、数据有判断、读者有共鸣。没给85+是因为这本质是使用行为报告而非模型或能力发布,冲击力比产品发布软一些,但作为趋势信号已经足够扎实。

Computing Life · Share · 鸭哥调研

Vercel 开源 eve:一个 agent 就是一个文件夹,这句话不是在玩文字游戏

Vercel 在伦敦 Ship 大会上开源了 eve,核心主张是“一个 agent 就是一个文件夹”。文件名自动注册为工具,Git 仓库就是 agent 本体,改一句指令就生成一个 diff 和预览部署。它内置了 durable execution(审批等待期间不烧算力)、沙箱 microVM 和多渠道支持(Slack、Discord、Teams、HT...

推荐理由:Vercel 在伦敦 Ship 大会上把 eve 开源了,核心主张是“一个 agent 就是一个文件夹”。文章没停留在口号上,而是拆解了具体怎么做到的:文件名自动注册为工具,Git 仓库就是 agent 本体,改一句指令就生成 diff 和预览部署。它还内置了 durable execution,审批等待期间不烧算力,用沙箱 microVM 做隔离,支持 Slack、Discord、Teams 等多渠道。这些机制细节让“文件夹即 agent”从一句营销话变成了可验证的架构选择。对在 LangChain 和托管服务之间摇摆的团队来说,eve 提供了一...

Hacker News 首页

OpenRouter 让 11 个大模型打了 30 场吃鸡赛,Grok 4.1 Fast 赢了 43%,成本只有 Claude 的 1/27

OpenRouter 的 Jacky Liang 把 11 个模型扔进一个 2D 吃鸡游戏里打了 30 局。Grok 4.1 Fast 赢了 13 局,每赢一局成本 0.97 美元;Claude Sonnet 4.6 赢了 5 局,每赢一局要 26.78 美元,差了 27 倍。GPT 5.4 杀了 38 个人头,全场最高,但只赢了 2 局——杀得多不等...

推荐理由:OpenRouter 官方博客,作者 Jacky Liang 自己跑了 30 局并公开了完整数据和回放。Grok 4.1 Fast 的成本优势很扎眼,Claude Sonnet 4.6 贵但表现稳定,GPT 5.4 人头最多却赢不了——三个发现都有具体数字支撑,可复现、可验证。对正在选模型搭 agent 的人来说,这种实战对比比跑分表有用。

AI HOT 精选

Claude Design 更新:跨项目记住你的品牌规范,还能和 Claude Code 搭着用

Anthropic 给 Claude Design 加了两个实用能力:一是它能跨项目记住你的设计系统,比如颜色、字体、组件这些,不用每次都重新教它;二是它现在能和 Claude Code 协同,你可以在编辑器里直接改设计稿。正文没提具体上线时间,也没说这是免费功能还是付费功能。

推荐理由:Anthropic 给 Claude Design 加了跨项目设计记忆和 Claude Code 协同,两个能力都算实在,不是画饼。但正文没提上线时间和是否收费,信息密度刚好够上 featured,再高就给不了了。

Hacker News 首页

Anthropic 派黑客 Nicholas Carlini 给美国政府演示怎么攻破自家模型,好让监管放心

WSJ 报道,Anthropic 让安全研究员 Nicholas Carlini 去给美国政府官员现场演示越狱和模型攻击,想证明他们能管住 AI 的安全风险。Carlini 之前在 Google Brain,专门研究对抗样本和模型攻击。报道没说他具体展示了哪些攻击手法,也没提政府那边看完是什么反应。

推荐理由:WSJ 独家,讲 Anthropic 让安全研究员 Nicholas Carlini 去给美国政府现场演示越狱和模型攻击,想用这种方式证明自己能管住安全风险。我会先打个折:报道没说他到底演示了什么攻击,也没写政府那边看完是更放心还是更紧张,所以信息量其实有限。但选题本身有张力——派黑客去安抚监管,这个叙事角度在当下的 AI 安全讨论里挺少见,从业者会愿意点开看一眼。

AI HOT 精选

Claude 出了个设计工具,能跨项目统一品牌风格,还能在画布上直接改

Anthropic 在 Claude 里塞了个叫 Claude Design 的设计功能。它主要干三件事:跨项目自动保持品牌视觉一致,不用来回对色卡和字体;支持在画布上直接编辑,不用导出到别的软件;还能跟 Claude Code 同步,但正文没解释同步具体是怎么实现的、支持哪些第三方工具,也没说什么时候正式上线。如果是真的,对需要频繁出设计稿又不想在工...

推荐理由:Anthropic 把设计功能直接塞进 Claude,跨项目品牌统一和画布编辑这两个点打的是真实工作流里的痛点,不是纯 demo。但正文对 Code 同步的实现方式、第三方工具支持和上线时间只字未提,信息缺口让这条消息停在值得关注但还不能全信的级别。

TechCrunch · AI

各国想要美国 AI,但不想让美国能随时关掉它

G7 峰会上,马克龙和莫迪直接对美国 AI 公司老板和特朗普挑明了担忧:美国模型确实强,但如果美国哪天突然切断访问,依赖这些模型的国家关键基础设施就会瘫痪。这个恐惧不是凭空来的——最近 Anthropic 一次宕机就让欧洲用户完全用不了 Claude。马克龙在午餐会上说得很直白,没有哪个国家敢把命脉接在一个美国能单方面拉闸的模型上。文章没给出具体政策方...

推荐理由:马克龙和莫迪在 G7 上直接对美国 AI 公司老板和特朗普挑明了这个担忧,不是空穴来风,而是有 Anthropic 宕机事件做引子。文章把“模型强但开关在别人手里”这个恐惧讲得很清楚,对从业者来说是个真实的供应链风险提醒。缺点也很明显:只描述了现象,没给出任何政策或技术上的解法,读完知道问题严重,但不知道下一步该怎么办。

The Verge · AI

Anthropic 被自己人也看不懂的出口管制规则搞停了服务

Anthropic 在部分国家突然切断了 Claude 的访问,原因是撞上了一套连律师都解释不清的美国出口管制规则。公司只能按最保守的理解自我审查,直接关停服务。专家警告,这种模糊、临时的干预方式撑不起 AI 监管的长期框架。

推荐理由:这篇独家报道把 AI 监管从讨论层面拉到了运营现实:Anthropic 真的停服了,有具体国家名单和内部决策细节,信号密度高。扣分点是单一信源,没有官方声明,但事件本身已经足够说明问题——模糊的出口管制正在变成 AI 公司的实际运营风险,值得放在头条让从业者看到。

AI HOT 精选

Anthropic 和 DeepMind 老板在 G7 闭门会上提议建 AI 联盟,把中国挡在门外

Dario Amodei 和 Demis Hassabis 在 G7 闭门会上提了个方案:由美国牵头拉一个 AI 规则联盟,拿最前沿的模型和芯片当筹码,不让中国参与。正文没写会议具体日期,也没提其他 G7 成员怎么回应。有评论说这等于开启一场高科技冷战,直接从根上切断对手的入场资格。

推荐理由:我会先打个折:正文没写会议具体日期,也没提其他 G7 成员怎么回应,所以实际落地阻力还不清楚。但两家 CEO 联名在 G7 场合提这种硬切割方案,本身已经是明确的站队信号,对从业者判断供应链和合作风险有直接参考价值。

6月17日星期三

Hacker News 首页

Anthropic 员工指责特朗普政府故意针对他们

白宫上周五以国家安全为由,限 Anthropic 在 90 分钟内下架最新模型 Fable 5 和 Mythos 5。公司内部聊天记录显示,官方给出的理由前后不一:先说是担心外国公司获取系统权限,后来又改口称模型本身存在重大漏洞。六天过去了,约 3000 名员工仍不清楚到底发生了什么,CEO Dario Amodei 与政府的谈判也没能打破僵局。员工还...

推荐理由:纽约时报独家爆料,白宫以国家安全为由要求 90 分钟内下架 Fable 5 和 Mythos 5,给出的理由前后矛盾,CEO 谈判陷入僵局,3000 名员工蒙在鼓里。HKR 三项都踩中了——冲突细节和内部信息密度很高。没给到 95 以上,是因为目前只有员工一方的说法,政府那边的具体依据还没披露,事情可能还有反转。

AI 群聊日报

群友实测:Fable 5 活了三天就被收走,但用过的人都说它是“上帝下凡”

Anthropic 的 Fable 5 模型上线大约 72 小时就被撤下,正文没披露具体原因。群友实测下来,它在复杂推理、编程和写作上明显强过 Opus 4.8 和 GPT-5.5:有人卡了两个月的难题它两分钟解决,MindStudio 测出多步编程自纠率 81%,Vellum 直接说这是“代差级跃升”。但它也有短板——代码评审精度不如 Opus 4....

推荐理由:Anthropic 的 Fable 5 短暂露面后被撤,群友实测数据扎实(81% 自纠率、代差级跃升评价),在钩子、干货和情绪共鸣三个维度都踩中了。扣分点在于信源是群聊整理而非官方发布,且下架原因正文没披露,所以重要性没给到顶。

Computing Life · Share · 鸭哥调研

推理模型四年史:你以为的石破天惊,其实早有暗线

推理模型不是2024年突然蹦出来的。让模型写解题步骤的思维链、用自己生成的正确推理训练自己的STaR、给中间步骤打分的过程奖励模型,这些技术从2022年起就陆续成熟了。o1真正改变的是产品化:把推理变成一种可以计费、可以调度的资源,在API里引入reasoning tokens和可调节的思考强度参数,相当于给scaling law开了第二个轴。Deep...

推荐理由:这是一篇有信息量的长文综述,用具体论文和时间线追溯推理模型的技术源头,核心判断是o1的分水岭在于把推理产品化成可计费算力,而非发明了推理本身。HKR三项都踩中,但属于梳理整合型内容而非独家爆料,放在78分、featured层级合理。

AI HOT 精选

Anthropic 企业订阅份额 5 月首超 OpenAI,特朗普禁令反而推了一把

Ramp 的数据显示,Anthropic 5 月企业 AI 订阅份额冲到 41%,OpenAI 是 39.5%,这是 Anthropic 第一次反超。公司刚拿了 650 亿美元融资,估值 9650 亿美元,第一次季度盈利后已经秘密提交 IPO 申请。特朗普政府以出口管制为由,要求 Anthropic 把最新模型 Mythos 5 和 Fable 5 下...

推荐理由:Anthropic 首次在企业订阅份额上反超 OpenAI,有 Ramp 的真实支出数据撑腰,不是传闻。文章还带出 650 亿美元融资、秘密提交 IPO 申请,以及特朗普政府出口管制反而刺激采用量创新高这几个信息点,既有硬数字又有反直觉的政策效果,对从业者判断模型选型和市场走向有直接参考价值。

彭博科技

美国商务部长致信 Anthropic,警告可能对最先进的 AI 模型施加出口或使用限制

彭博拿到了一封商务部长霍华德·卢特尼克发给 Anthropic 的信,信里警告美国政府正在考虑对最顶尖的 AI 模型搞出口管制或使用限制。目前公开的只有标题和收件人,信的具体内容、什么时候会动手、限制范围有多大,正文都没披露。这事值得留意,但细节还没公开,先别急着下结论。

推荐理由:彭博独家爆出商务部长给 Anthropic 的警告信,话题分量很足,但正文只给了个标题,内容、时间表、范围一概没提。H 和 R 都成立,K 因为信息缺口被打掉,所以分数卡在 72 分、放在 featured 是合理的——先让读者知道有这么个信号,但别急着下结论。

彭博科技

一封商务部长来信,让 Anthropic 主动关掉了 Mythos 的生图功能

Bloomberg 公开了美国商务部长 Howard Lutnick 发给 Anthropic 的完整信函。信里要求 Anthropic 解释为什么 Mythos 能生成特朗普和马斯克的深度伪造图像,并质疑了它的内容审核机制。Anthropic 随后自愿禁用了 Mythos 的图像生成能力。文章没说明这次关停是临时还是永久,也没给出恢复时间表。

推荐理由:Bloomberg 把 Lutnick 写给 Anthropic 的信全文放出来了,这是政府直接施压让 AI 功能下线的罕见案例。信里点名 Mythos 能生成特朗普和马斯克的深度伪造图像,质疑审核机制,Anthropic 随后自愿禁用了图像生成。文章没写这次关停是临时还是永久,也没给恢复时间,但光凭“部长一封信就让功能没了”这件事,对政策圈和安全从业者的冲击就够大。三个维度都踩中,分数维持 84 没问题。

AI HOT 精选

TechCrunch 质疑美国政府封禁 Anthropic 模型,真正原因不是越狱而是政治报复

美国商务部上周五援引一项出口管制指令,禁止非美国人员(包括 Anthropic 自己的外籍员工)访问其最新的 Fable 5 和 Mythos 5 模型,理由是未指明的国家安全问题。Anthropic 认为这与模型被绕过安全限制有关,但 TechCrunch 指出官方从未拿出具体的越狱证据或技术细节。文章判断这更像是一次反应过度的政治报复行动,给整个 ...

推荐理由:TechCrunch 质疑美国政府封禁 Anthropic 模型的真实原因,指出商务部始终没拿出越狱证据,更像政治报复。出口管制加外籍员工访问限制,让这件事的政策分量很重。因为是分析而非一手爆料,我会先打个折。

AI HOT 精选

智谱上线并开源 GLM-5.2,主攻编程和长链条任务,综合跑分进了全球前三

智谱把 GLM-5.2 放出来了,代码开源,MIT 协议,可以商用。这个模型在 Artificial Analysis 综合榜上拿了 51 分,跟 Anthropic、OpenAI 排在前三,是开源模型里目前最好的。前端开发盲测 Code Arena 上拿了全球可用模型第一。这次最大的升级是实打实的 100 万 token 无损上下文,专门用来跑长链条...

推荐理由:智谱把 GLM-5.2 完整开源了,MIT 协议,商用没限制。模型在 Artificial Analysis 综合榜拿 51 分,跟 Anthropic、OpenAI 排在前三,是开源模型里目前最好的成绩;Code Arena 前端开发盲测也拿了全球可用模型第一。这次最大的升级是实打实的 100 万 token 无损上下文,专门跑长链条任务,FrontierSWE 和 SWE-Marathon 两个长程基准上的分数落在 Claude Opus 4.7 和 4.8 之间,还放出了一个 88 万 token 的完整跑通案例。对做 AI 工程的人来说,这...

6月16日星期二

Ben's Bites

Anthropic 的 Fable 5 上线三天就被美国政府叫停,现已全球下线

Anthropic 在 6 月 9 日发布了 Claude Fable 5,一个加了安全护栏的 Mythos 级模型。三天后,美国政府以发现越狱风险为由,暂停了所有非美国籍用户对 Fable 5 和 Mythos 5 的访问权限,包括 Anthropic 的外籍员工。Anthropic 表示无法按国籍干净地执行限制,索性把模型对所有人都关了。shadc...

推荐理由:Anthropic 的旗舰模型从发布到全面关闭只用了三天,起因是美国政府发现越狱风险后暂停了非美国籍用户的访问,连外籍员工都被挡在外面。这件事同时踩中了产品发布、安全事故和政策干预三条线,信息密度够高,适合放 featured。不过正文对越狱风险的具体细节和影响范围披露很少,判断先别下太重。

The Verge · AI

SpaceX 正式宣布 600 亿美元收购编程工具 Cursor,想靠它抢企业客户

SpaceX 刚完成巨型 IPO 没几天,就确认要花 600 亿美元买下 AI 编程平台 Cursor。这笔交易的目标很直白:帮马斯克这个横跨火箭、AI、社交媒体的庞大集团拉拢企业客户,缩短跟 Anthropic、OpenAI 的差距。收购本身不算意外——今年 4 月双方就签了个奇怪协议,要么 SpaceX 花 600 亿买下 Cursor,要么就得付...

推荐理由:SpaceX 刚 IPO 完就宣布花 600 亿美元买 Cursor,这是今年 AI 工具领域最大的一笔收购。目标很直白:帮马斯克旗下横跨火箭、AI、社交媒体的集团补上企业客户这块短板,追 Anthropic 和 OpenAI。我会先打个折——正文没讲清楚交易怎么落地、团队怎么整合、Cursor 的产品路线会不会变,这些才是开发者真正在意的。4 月那个'要么买要么赔'的协议是条关键线索,说明这笔交易早就被锁死了,不是临时起意。

TechCrunch · AI

ChatGPT 市占率首次跌破 50%,但月活用户仍有 11 亿

ChatGPT 还是全球最常用的 AI 助手,月活用户超过 11 亿,但它的市场份额第一次掉到了 50% 以下。排在后面的 Gemini 有 6.62 亿月活,Claude 有 2.45 亿。正文没披露具体的份额数字、统计方法和时间窗口,所以这个“跌破 50%”到底有多严重,还得等更多细节。

推荐理由:ChatGPT 份额跌破 50% 是个值得标记的节点,月活对比也给了具体参照。但正文没披露统计方法、时间窗口和精确份额,标题比正文重,所以分数先不打更高,等更多细节出来再说。

AI HOT 精选

Anthropic 被美国政府要求关停 Claude Mythos 5,正与特朗普团队谈判

美国商务部上周五发出出口管制令,要求 Anthropic 禁止所有外国公民(包括自家外籍员工)访问 Mythos 5 和 Fable 5 这两个模型。Anthropic 直接关停了这两款模型,高管飞到华盛顿跟财政部长 Bessent、商务部长 Lutnick 谈。政府拿一个越狱漏洞说事,Anthropic 反驳说这个漏洞很窄、不通用,而且 OpenAI...

推荐理由:Anthropic 跟美国政府因为 Mythos 5 和 Fable 5 正面杠上了。商务部直接下出口管制令,连自家外籍员工都不让碰模型,Anthropic 干脆关停模型、高管飞 DC 当面谈。政府拿一个越狱漏洞说事,Anthropic 反驳说漏洞很窄、不通用。冲突细节、双方论据和后续影响都出来了,信息量够硬,三条线全中,必须写。

Latent Space

纳德拉发长文谈“循环工艺”:建前沿生态比押注单个模型更重要

微软 CEO 纳德拉在 X 上发了篇长文,把他在播客里聊的观点包装成“Loopcraft(循环工艺)”这个概念,浏览量超过 6000 万。核心意思是:企业真正的机会不是挑最强的模型,而是建一个能把人和数字系统串起来的学习循环,让人的经验和模型产出的“代币资本”一起滚雪球。这是他自八个月前微软与 OpenAI 拆分以来,第一次把 AI 战略讲得这么清楚。...

推荐理由:纳德拉自己发的长文,不是第三方解读,6000 万浏览也说明关注度够高。但这是愿景型内容,没有可测试的产品或指标,所以分数压在 85 以下。我会先打个折:概念听着顺,落地还得看微软后续怎么把“代币资本”变成实际工具。

AI HOT 精选

五角大楼把大部分日常 AI 工作流从 Anthropic 迁走,计划 9 月前彻底切断

五角大楼已经转移了超过三分之二的日常 AI 工作负载,不再用 Anthropic 的模型,目标是在 9 月前完全清零。起因是年初五角大楼想让 Anthropic 签一份协议,允许把 Claude 用于大规模监控和全自动武器,CEO Dario Amodei 以模型还不够可靠为由拒绝了。之后五角大楼把 Anthropic 列为“供应链风险”,还起诉了但没...

推荐理由:五角大楼和Anthropic的决裂是个标志性事件:一边是国防需求,一边是AI伦理底线,Dario以模型不够可靠为由拒绝签字,结果被列为供应链风险并限期清零。冲突本身够硬,细节也扎实,但起诉结果和替代方案还没披露,所以分数没给到90以上。

r/LocalLLaMA

HalBench 给 29 个开源模型测拍马屁和幻觉,Qwen 3.6 和 Gemma 4 以小博大,Meta 继续证明自己不会花钱

HalBench 是一个开源基准测试,专门看模型面对错误前提时是直接反驳还是顺着说瞎话。v2.3 测了 33 个模型,其中 29 个开源。结果只有 Sonnet 4.6(65.1%)和 Grok 4.3(50.9%)的反驳率过半。开源里最强的是 Qwen 3.6,一个约 270 亿参数的稠密模型,反驳率 36.6%,压过了 GPT-5.4 和 Gemi...

推荐理由:一个社区自建的基准,有具体数字和排名,Qwen 3.6 在反驳率上超过 GPT-5.4,信息量够。没给 p1 是因为这是自建评测,还没同行评审,先当强推荐处理。

Computing Life · Share · 鸭哥调研

命令行过滤为什么挡不住 AI agent

一个 Cursor agent 用一条 curl 命令在 9 秒内删掉了生产数据库,命令本身在允许列表里完全合法。问题出在 agent 的工作方式:它把规则当障碍绕,封了 rm 就用 Python 删,没有 sudo 就利用 docker 组提权。Anthropic 和 OpenAI 在 2026 年不约而同转向了同一个解法——用第二个独立模型审查每个...

推荐理由:PocketOS 这个事故是个好钩子,但文章没停在事故本身,而是顺着往下挖:为什么允许列表挡不住 agent,因为 agent 会把规则当障碍绕。接着点出 Anthropic 和 OpenAI 在 2026 年不约而同转向第二个独立模型做审查,这个行业转向的判断有信息量。三个维度都踩中了,所以给了 featured。

The Verge · AI

白宫下令后 Anthropic 切断 Fable 5 和 Mythos 5 访问,公司不服

6 月 12 日白宫要求 Anthropic 禁止外国用户访问它 6 月 9 日刚发布的 Fable 5 和 Mythos 5 两个模型。Anthropic 说 Fable 5 的能力超过它此前所有公开模型,Mythos 5 用的是同一基座模型,但部分安全限制被放开了。触发禁令的原因是亚马逊和白宫沟通后,有研究人员称找到了让 Fable 5 输出可用于...

推荐理由:白宫直接干预旗舰模型发布,属于行业顶级事件。正文没披露禁令的具体范围和 Anthropic 的正式回应,但冲突本身已经足够震动。

The Verge · AI

白宫一句话,Anthropic 就把最新模型 Fable 5 和 Mythos 5 下了线,外国员工也用不了

Anthropic 周末突然把最强的两个模型 Fable 5 和 Mythos 5 关停,原因是白宫要求禁止所有非美国公民访问,连自家外籍员工都包括在内。这件事直接捅破了一层窗户纸:美国不光卡着最前沿的 AI,政府还能随时决定谁可以用。正文没披露这次关停会持续多久,也没说模型之前到底上了哪些防护措施。

推荐理由:Anthropic 周末突然关停 Fable 5 和 Mythos 5,原因是白宫要求禁止非美国公民访问,连自家外籍员工都算在内。这件事把窗户纸捅破了:美国不光卡技术出口,还能直接远程关停已经跑起来的模型。正文没写关停多久、之前上了什么防护,但这不影响事件本身的冲击力——它让“非美国 AI”从一个概念变成了一个迫在眉睫的选项。我会先打个折:如果后续证明这只是短期行政摩擦,重要性会回调;但就目前信息看,这已经是今年最硬核的政策信号之一。

6月15日星期一

TechCrunch · AI

一群网安老兵抗议美国政府禁掉 Anthropic 最强模型,说这会让防守方更被动

几十名网络安全专家联名要求白宫撤销对 Anthropic 的 Fable 和 Mythos 模型的出口管制,他们认为禁令会削弱安全团队加固自家软件和产品的能力。原文是 RSS 片段,没列出具体签名人,也没提到白宫是否回应。

推荐理由:白宫禁掉 Anthropic 最强模型,安全圈直接炸了,几十号人联名抗议,冲突感拉满。我会先打个折,因为原文是 RSS 片段,没列出具体签名人,也没说白宫有没有回应,事实底子偏薄。但“禁令反而削弱防御能力”这个角度够新,也够具体,值得推给从业者看看。

彭博科技

Anthropic 按美国政府命令关停 Mythos 模型访问

Anthropic 已经切断了外界对其 Mythos 模型的访问,原因是收到美国政府的一道命令。目前能确认的只有两点:Anthropic 照做了,Mythos 现在用不了了。至于这道命令的法律依据是什么、具体理由是什么、什么时候下的、关停过程花了多久,彭博的这条视频报道全都没说。在书面命令或 Anthropic 的正式声明出来之前,别急着下结论说这事影...

推荐理由:美国政府一道命令让 Anthropic 把 Mythos 模型关了,这事对整个行业震动不小。彭博先爆了出来,事实交代得清楚,但细节很薄——法律依据、时间线、Mythos 具体能力全都没提。我会先打个折,在书面命令或 Anthropic 正式声明出来之前,别急着脑补剧情。

AI HOT 精选

白宫以中国访问风险为由,对 Anthropic 的 Mythos 模型实施出口限制

白宫对 Anthropic 的 Mythos 模型下了出口限制令,理由是担心与中国有关联的团体能接触到这个模型。另一个被点名的风险是“知识蒸馏”——简单说就是外部团队可能通过反复提问,把大模型的能力“偷”到自家小模型里。在这之前,美国商务部已经要求 Anthropic 关掉 Fable 5 和 Mythos 5,因为有人用越狱手法让模型教了网络安全攻击...

推荐理由:白宫对Anthropic的Mythos模型下出口限制令,是AI地缘政治的一次实质性升级。我会先打个折,因为消息源是单条推文,正文没披露禁令的具体范围和执行细节。但把知识蒸馏列为风险向量,这点挺关键——它把一种技术手段直接定性为安全威胁,后续可能会影响开源模型和API的开放策略。结合商务部此前要求关停模型的动作,监管压力明显在收紧,从业者需要关注这类风险会不会被写进合规要求里。

Hacker News 首页

Anthropic 的安全超能力:为什么美国政府封禁 Fable 5 是迟早的事

Anthropic 刚发布 Fable 5 几个小时,就被美国政府以出口管制指令叫停,要求切断所有外国人的访问权限。触发这件事的,是亚马逊报告的一个越狱方法,用这个方法找到了几个已知的、危害不大的漏洞。Anthropic 反驳说,其他公开模型也能找到同样的漏洞,而且不存在通用的越狱方法。Ben Thompson 认为,这种冲突躲不掉——模型能力越强,越...

推荐理由:Ben Thompson 把 Fable 5 被叫停的前因后果拆得很细:亚马逊报告了一个越狱方法,找到几个已知且危害不大的漏洞,美国政府随即以出口管制指令要求切断外国人访问。Anthropic 反驳说其他公开模型也能找到同样漏洞,不存在通用越狱。这件事本身戏剧性够强,但文章是评论而非一手报道,所以分数卡在 82。