跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 1021–1040 条 · 共 1,303 条

5月15日星期五

AI HOT 精选

Anthropic 的 Mythos AI 五天挖出两个 macOS 内核漏洞,还串成一条提权攻击链

《华尔街日报》说,Anthropic 的安全研究工具 Mythos 在五天内帮研究人员找到两个之前没人发现的 macOS 内核漏洞,并把它们串成一个完整的提权攻击链,绕过了苹果的内存完整性保护。这意味着攻击者能碰到系统本该锁死的区域。报道指出,现在 macOS 的防御思路已经不是不让漏洞被发现,而是尽量抬高漏洞利用的门槛。Mythos 能帮上忙的地方在...

推荐理由:Anthropic 的 Mythos AI 五天挖出两个未知 macOS 内核漏洞还串成提权链,这事本身信号很强。我会先打个折:目前只有社交平台帖子,没看到论文或复现条件,漏洞具体怎么挖的、模型在哪个环节起了作用,正文都没披露。所以分数压在 81,不往上拉。对从业者来说,这条消息值得看,但别急着把它当成 AI 做漏洞挖掘的成熟证据。

AI HOT 精选

Claude API 提示预缓存:先预热系统提示,再让真实请求直接命中缓存,首 token 生成更快

一个减少长提示首 token 延迟的实用技巧。在用户请求到达前,先单独发一次系统提示给 Claude,让它把提示写进缓存,但跳过输出。等真实请求进来时,缓存已经热好,直接命中,省掉重复处理长提示的时间。正文没披露具体提速多少,但思路很直接,适合系统提示固定、用户提示多变的场景。

推荐理由:Claude API 搞了个提示预缓存,相当于提前把系统提示塞进缓存里热着,真实请求一来就能省掉首令牌的等待。正文没给出具体能省多少毫秒,也没说缓存能热多久、会不会额外计费,所以省钱效果先打个折看。整体是个实用的推理优化小更新,不是模型能力或大版本发布,放在 featured 里当个中等权重的消息刚好。

彭博科技

Anthropic 跟美国政府杠上了,Figma 等公司把它列为财务风险

Anthropic 正在和美国政府打官司,焦点是联邦机构会不会禁用它的 AI 模型。这事已经不只是法律纠纷了——Figma 和其他一些公司开始在财务文件里把这场争端列为一个风险因素,担心如果政府真的下手,自家用 Anthropic 模型做的功能会受影响。正文没披露具体有多少家公司踩了这坑,也没说 Anthropic 的应对策略是什么。

推荐理由:Bloomberg 的信源没问题,Anthropic 跟美国政府掐架掐到 Figma 的财报风险提示里,这事本身就够有看头。正文没披露具体诉讼金额、合同规模或 Figma 对 Anthropic 的依赖程度,所以先别往 P1 推。我会先打个折,放在 featured 档,等后续有更多财务细节再调。

AI HOT 精选

Claude Code 更新 v2.1.142:后台会话可配置,快速模式默认切到 Opus 4.7

Anthropic 给 Claude Code 命令行工具发了 v2.1.142 版本。这次主要干了两件事:一是新增了 8 个命令行参数,用来控制后台会话的行为,比如可以指定会话闲置多久自动关掉、最多同时跑几个后台任务;二是把 Fast 模式的默认模型从之前的版本升级到了 Opus 4.7,意味着快速模式下模型的理解和生成能力会更强。另外修了 15 个...

推荐理由:这次更新对 Claude Code 用户来说挺实在:Fast 模式默认用 Opus 4.7,省去手动切换的步骤;8 个后台会话标志让配置更细,15 个以上的修复也说明稳定性在补。我会先打个折,毕竟是个小版本号,但改动直接落在编码流程上,对 Anthropic 工具链用户有实际影响,放在 featured 档合理。

彭博科技

马斯克的 xAI 发布首个编程助手 Grok Build,直接对标 Anthropic

xAI 推出了 Grok Build,一个能直接参与软件开发流程的 AI 编程助手,目标直指 Anthropic 的 Claude。目前公开信息很少,正文没披露定价、能用哪些代码编辑器、性能跑分,也没说什么时候正式开放。

推荐理由:H 和 R 都成立:xAI 跳进编程 Agent 这个坑,还点名 Anthropic,对开发者来说是个明确的竞争信号,话题够。但 K 不成立,因为正文除了说有个叫 Grok Build 的东西能写代码,别的什么都没给——价格、开放范围、跑分全缺,信息量撑不起一篇硬核更新。整体只能算中等偏轻的产品消息,我会先打个折,别太激动。

The Verge · AI

OpenAI 把桌面端写代码工具 Codex 塞进了 ChatGPT 手机 App

OpenAI 宣布 Codex 会集成到 ChatGPT 的手机 App 里。Codex 原本是桌面端工具,能写代码、操控你电脑上的其他应用,现在在手机上也能用了。这次更新是冲着 Anthropic 的 Claude Code 去的,OpenAI 为了追赶砍掉了 Sora 视频生成等“支线项目”,集中精力做企业生意和桌面“超级应用”。不过正文没提手机端...

推荐理由:OpenAI 把 Codex 塞进了 ChatGPT 手机 App,算一次中等体量的产品更新。我会先打个折:正文只说了能写代码、能操控电脑应用,但上线时间、价格、支持哪些应用全都没提,这点先别太激动。HKR 三项都过——手机端 coding agent 的钩子够直接,操作应用的声称是新的具体信息,也戳中了开发者日常和同类产品抢分发入口的神经。信息缺口明显,所以重要性停在 featured 地板,不往上拔。

The Verge · AI

微软开始收回内部 Claude Code 授权,把开发者往自家 Copilot CLI 赶

微软去年 12 月给内部几千名开发者开放了 Claude Code,让项目经理、设计师这些非技术岗也能试着写代码,半年下来用的人非常多。现在微软准备收回大部分授权,把这些人推到 Copilot CLI 上。正文没披露具体收回多少授权、定价和迁移时间表,也没说 Copilot CLI 功能上能不能补上 Claude Code 的缺口。

推荐理由:微软把去年底才发给内部几千名开发者的 Claude Code 许可证收回去,把人往 Copilot CLI 赶。这事本身不复杂,但信号很清楚:在自家地盘上不想给 Anthropic 留入口。正文没披露具体有多少许可证被取消、Copilot CLI 功能是否能完全替代 Claude Code,所以实际影响还得看后续。我会先打个折,不把它当成 Copilot 已经赢了,但企业采购和开发者工具选型的人会盯着这条。

AI HOT 精选

Anthropic 推演 2028 年中美 AI 竞赛的两种结局

Anthropic 出了一份政策分析,推演了 2028 年全球 AI 领导权的两种走向。核心就一个变量:美国及其盟友能不能守住算力芯片这个优势。现在美国靠出口管制卡住了中国获取最先进训练芯片的渠道,但中国实验室靠人才、钻管制漏洞和大规模“蒸馏攻击”(说白了就是扒美国模型的能力来训练自己的模型)追得很紧。第一种情景是乐观的:如果政策继续收紧漏洞、打断蒸馏...

推荐理由:Anthropic 这份政策研究不是发模型也不是发产品,属于政策评论,但 HKR 三点都踩中了:2028 年情景有悬念,芯片优势换领先期的机制讲得清楚,地缘和供应链风险又是行业神经。放在 78 到 84 分的 featured 档位是合适的。

AI HOT 精选

Anthropic 发了份 AI 创业手册,把从想法到扩张拆成四步,每步都配了 Claude 的实操练习

Anthropic 这篇博客给 AI 原生创业画了一张路线图,分四个阶段:想点子、做最小可行产品、发布、扩张。每个阶段都给了目标、退出标准、常见翻车点,还附了用 Claude 做验证、客户调研、控制技术债、检查产品市场匹配和自动化工作流的提示词。文章没给具体案例数据,更像一套可以直接抄作业的框架。

推荐理由:我会先打个折:这不是模型或产品发布,是 Anthropic 出的创业操作手册。但内容挺实在,把从点子到规模化拆成四个阶段,每个阶段都告诉你目标是什么、什么时候该停、容易栽在哪、怎么用 Claude 练手。对正在用 AI 搭产品的团队来说,退出标准和失败模式比鸡汤有用。正文没披露手册本身是否收费或后续会不会更新,这点先别太激动。

AI HOT 精选

Claude Code 怎么啃下百万行老代码库:五个扩展点与上手顺序

Anthropic 这篇博客讲了 Claude Code 在百万行单体仓库、遗留系统和分布式架构里的实际用法。核心思路不是靠模型硬记,而是靠五个扩展点把项目知识喂给模型:CLAUDE.md 文件写项目规则、hooks 在操作前后自动检查、skills 封装可复用指令、plugins 接外部工具、MCP 服务器做本地代码库的智能搜索。文章给了从零开始的三...

推荐理由:我会先打个折:这不是新模型或重大能力发布,就是一份官方出的 Claude Code 大型代码库使用指南。但它把怎么在遗留系统里让 AI 干活这件事讲得很实在,五个扩展点(CLAUDE.md、钩子、技能、插件、MCP 服务器)都是开发团队能立刻动手配的。正文没给具体性能数据,但思路对上了开发者对老代码库的掌控焦虑,所以放在 72–77 这个区间。

r/LocalLLaMA

RTX 5000 PRO 48GB 实跑测试:27B 模型跑到 80 tok/s,200k 上下文全精度缓存

一位完全没装过机的 Reddit 用户花了 5600 美元攒了一台 RTX 5000 PRO 48GB 的机器,单卡跑 Qwen3.6-27B-FP8 模型。他自己说装机全靠问 LLM,配 vLLM 时烧掉了 Claude Code 一半的周额度才搞定。实测下来,生成速度最高能到每秒 80 个 token,提示很长时掉到 50–60 tok/s,但提示...

推荐理由:这篇来自 Reddit 的个人装机实测,把价格和跑分都摆出来了,对想自己攒机跑大模型的人参考价值很高。我会先打个折:只有单卡、单模型、单人测试,没对比其他卡,也没提散热和长期稳定性,所以不能直接当采购指南。但 48GB 显存能跑 27B 模型还这么快,确实让人对本地推理的成本和体验更有信心。

5月14日星期四

AI HOT 精选

Anthropic 与盖茨基金会达成 2 亿美元合作,把 Claude 送进疫苗研发、课堂和小农户手里

Anthropic 和盖茨基金会签了一份四年 2 亿美元的合作,钱、Claude 使用额度和技术支持都包含在内,主要投向全球健康、教育、经济流动性这些市场不太会主动碰的领域。健康方面是重头,会帮中低收入国家用 AI 加速疫苗和疗法研发,比如先用计算筛选小儿麻痹症、HPV 和子痫前期的候选疫苗或药物,缩短早期开发时间;还会把疾病建模研究所的预测接上 Cl...

推荐理由:这条合作我会先打个折——金额和年限确实够看,2 亿美元分四年投,还搭上 Claude 额度和技术支持,用在全球健康、教育、经济流动这些项目上,说明不是一次性的品牌合作。但正文没披露具体用在哪些模型能力上,也没说 Claude 会因此有什么功能或价格变化,对做开发的人影响很弱。所以 H 和 K 都成立,R 偏弱,整体放在 featured 档合理。

AI HOT 精选

Kimi 发了个浏览器扩展,让 AI 能替你操作网页

Kimi 上线了“网页桥接”浏览器扩展,装在 Chrome 上后,AI 智能体可以直接在网页里搜索、滚动、点击、打字,像人一样走完一整套网站操作流程。它支持 Kimi Code CLI、Claude Code、Cursor、Codex 和 Hermes 这几个开发工具,意味着你写代码或跑任务时,AI 能直接去网页上干活,不用再手动切来切去。扩展已在 K...

推荐理由:Kimi 发了个浏览器桥接扩展,让模型能直接操作网页:搜索、滚动、点击、输入都行,还接入了 Claude Code、Cursor 等一堆外部编程工具。我会先打个折,这属于工具层面的更新,不是模型能力升级,正文也没披露安全策略和实际性能数据。但它的钩子够直接——一个扩展跨多个开发环境干活,对正在搭智能体工作流的人挺实用,所以放在 featured 里,分数给到 74。

r/LocalLLaMA

有人把 HuggingFace 的 AI 研究员搬到了本地,用 llama.cpp 跑通了一条自动微调流水线

HuggingFace 之前开源了一个叫 ml-intern 的自动化 AI 研究员,现在社区有人把它接上了 llama.cpp 和 ollama,让整个流程能在本地跑。帖子说用 Qwen3.6-35B-A3B 这个模型就能当大脑,指挥 CPU/GPU 沙箱和 HuggingFace Hub 上的任务,从头到尾完成一次 SFT(有监督微调)。正文没披露...

推荐理由:我会先打个折:这是 Reddit 出来的开源工具更新,不是大模型发布。但本地沙箱加 Hub 作业编排能跑通完整微调,对想在自己机器上做自动化实验的人挺实用。正文没披露具体延迟和资源占用,这点先别太激动。

AI HOT 精选

小米 MiMo V2.5 Pro 在 DesignArena 设计竞技场拿到第三,前端编码追平 Claude Sonnet 4.6

MiMo V2.5 Pro 的 Thinking 版本在 DesignArena 总榜上比上一代 MiMo-V2.5 爬了 8 个名次,直接冲到第三。前端编码任务的表现已经和 Claude Sonnet 4.6 打平。正文没披露具体评分和测试样本量,所以这个“追平”是在什么条件下达成的还不清楚,先别太激动。

推荐理由:H、K、R 三条都踩中了,但信息全来自官方一条推文,没公开测试方法、没开放试用、也没提价格,所以先别太激动。这更像一次产品更新和榜单占位,不是那种当天必须追的硬核发布。

新智元 · 公众号

Claude 把系统提示当用户指令,百万上下文窗口反而让模型更容易“甩锅”

Claude Code 被曝出会把模型自己生成的发布指令当成用户授权来执行。GitHub issue #44778 指出,系统事件被错误地以“用户”角色传入对话,导致模型分不清是谁下的命令。Claude 支持百万 token 的上下文窗口,会话一长,说话人归属出错的概率就更高。正文没披露 Anthropic 的官方回应或修复时间表,这点先别太激动,但如...

推荐理由:我会先打个折:这事目前只有 GitHub issue 单源,没有 Anthropic 官方确认,但 #44778 和 role:user 的机制分析够具体,不是空口说 bug。hook 很强——不是幻觉,是模型自己下指令然后甩锅给人类,百万上下文反而成了降智放大器。对开发者来说,这比普通幻觉严重得多,因为涉及权限伪造和审计失效。放在 78-84 这个质量段合理,比重大版本发布低一档,但比一般 bug report 更有传播力。

新智元 · 公众号

OpenAI 企业市场王座被 Anthropic 踹了,三年头一回

根据 Ramp 从 5 万多家公司的信用卡和发票支出里拉出来的数据,Anthropic 的企业市场份额冲到了 34.4%,OpenAI 掉到 32.3%,这是 OpenAI 三年来第一次在这个指标上被反超。不过正文因为微信环境验证挂了,看不到具体细节,比如统计口径是只算 API 调用还是也包了 ChatGPT 企业版订阅、数据覆盖了多长时间,这些都没法...

推荐理由:我会先打个折:Ramp 的数据只反映它自家客户里的支出份额,不是全行业市占率,所以别直接当成“Anthropic 全面反超”。但 5 万多家企业的实际付款数据比调研问卷硬得多,34.4% 对 32.3% 这个交叉点确实说明 Anthropic 在付费企业里势头很猛。正文没披露统计周期和是否含 API 之外的订阅收入,这点信息有缺口。整体上,这是一条有事实、有数字、有竞争张力的消息,值得从业者看一眼。

Latent Space

Anthropic 给付费用户送等额 API 额度,OpenAI 同一天推 Codex 企业迁移优惠

Anthropic 改了 Claude 付费方案的规则:你付多少钱订阅,就送你等额的 API 额度。比如 $200 的套餐,除了在 Claude.ai 和 Claude Code 这些官方工具里用,还能拿到 $200 的 API 额度,在 OpenClaw 等第三方工具里调用。以前第三方工具用订阅账号调 API 相当于享受了 7-9 折的隐性补贴,现在...

推荐理由:Anthropic 把 Claude 订阅改成按月给等额 API 额度,200 刀套餐就是 200 刀程序化额度,相当于订阅费可以当 API 钱花。同期 OpenAI 推 Codex 企业迁移优惠,两边都在抢编程场景的付费用户。我会先打个折:正文没披露额度是每月清零还是可累积,也没说 Codex 迁移优惠具体减多少。这点先别太激动,但对日常靠 Claude 写代码又跑 API 的团队,确实省了一笔重复开支。

AI HOT 精选

微信群聊总结 Skill 上线,靠 wx-cli 读聊天数据,搭配 Claude Opus 4.6 效果最好

baoyu-skills 加了一个微信群聊总结的 Skill,能自动把群聊记录整理成摘要。它本身不直接碰微信,得先装一个叫 wx-cli 的工具来读取聊天数据,配置方法去看 wx-cli 的项目文档,作者说这块不提供技术支持。作者实测下来,用 Claude Code 加 Claude Opus 4.6 跑这套组合效果最佳,其他模型表现怎么样正文没提。

推荐理由:一个开源小工具的更新,但工作流很实在:用 wx-cli 把微信数据喂给 Claude Code,自动出群聊总结。HKR 三项都踩中了,不过正文没展开讲准确率、漏消息率这些实际效果,信息量有限,放在 featured 档刚好。

彭博科技

Anthropic 被曝寻求超 9000 亿美元估值,至少再融 300 亿

彭博社 5 月 13 日的节目里提到,Anthropic 正在寻求至少 300 亿美元的新融资,对应的估值超过 9000 亿美元。这个数字很吓人,但报道没披露具体投资人、交易条款和时间表,所以先别太激动,正文也没说这轮融资到了什么阶段、钱打算怎么花。

推荐理由:Bloomberg 只给了募资规模和目标估值两个数,投资方、条款、时间表一概没提。我会先打个折:没落地的融资消息,数字再大也只是意向。但 9000 亿这个量级本身就是一个信号,说明头部实验室对资金的需求已经膨胀到传统科技 IPO 都未必接得住的程度。正文没披露钱具体要花在哪,这点先别太激动。