跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 1041–1060 条 · 共 1,303 条

5月14日星期四

AI HOT 精选

Anthropic 发布 Claude 电脑与浏览器操控最佳实践,附不同模型截图分辨率上限

Anthropic 给开发者写了一份指南,讲怎么让 Claude 去操作电脑和浏览器。里面给了两个硬指标:用 Claude 4.6 API 时,截图长边不能超过 1568 像素,总像素控制在 115 万以内;换到 Opus 4.7,上限放宽到长边 2576 像素、总像素 375 万。分辨率越高模型能看到的界面细节越多,但推理成本也会跟着涨。正文没披露不...

推荐理由:Anthropic 这份第一方指南给了可操作的截图限制,不是公关稿。HKR 三项都踩中,但本质是实践手册而非模型或能力大更新,所以分数放在 72–77 这个区间。

彭博科技

Anthropic 正谈一轮 300 亿美元融资,估值可能冲到 9000 亿

彭博社援引知情人士消息,Claude 的开发商 Anthropic 正在跟投资人早期接触,打算融至少 300 亿美元,对应估值超过 9000 亿美元。目前还在谈,条款没定,正文因为 Bloomberg 的反爬机制没能拿到更多细节,所以不清楚这轮是纯股权还是含债务、钱主要投向算力还是研发。9000 亿这个数字先别太激动——一级市场估值和二级市场定价是两回...

推荐理由:Bloomberg 报的是早期谈判,300 亿融资、9000 亿估值,数字够大所以 HKR 全中。分数没给到顶,因为交易还没落地,正文也没披露条款细节和资金用途,先别太激动。

AI HOT 精选

企业付款数据首次显示 Anthropic 的 B2B 客户占比超过 OpenAI

企业支付平台 Ramp 的 AI 指数显示,2026 年 4 月 Anthropic 在美国企业客户中的付费采用率达到 34.4%,首次超过 OpenAI 的 32.3%。Anthropic 的覆盖率一年翻了四倍,而 OpenAI 几乎没动,只涨了 0.3 个百分点。这个数据来自通过 Ramp 走信用卡或账单付款的公司,主要反映美国市场,不直接代表全球...

推荐理由:这是一份来自企业支出平台 Ramp 的账单数据,不是模型发布或产品更新,所以先打个折。但 Anthropic 在美国企业采用率上首次压过 OpenAI,34.4% 对 32.3%,差距不大但信号明确。一年内业务覆盖涨了四倍,说明 Claude 在企业端确实在抢份额。正文没披露样本量和统计口径,所以不能直接当市场全貌看,但作为花钱投票的结果,比单纯比跑分更有参考价值。

AI HOT 精选

Claude 付费计划从 6 月 15 日起送月度编程额度,覆盖 Agent SDK 和第三方应用

Anthropic 给付费用户加了一个月度编程使用额度,6 月 15 日开始可以申领。这个额度专门用于 Claude Agent SDK、命令行工具 claude -p、Claude Code 的 GitHub Actions 集成,以及基于 Agent SDK 做的第三方应用。正文没披露额度具体有多少、会不会用完降速,也没说不同付费档位是不是一样。这...

推荐理由:HKR 三项都成立:时间、额度机制、覆盖的编程入口都写清楚了。重要性维持 featured 低段,因为这是计费和访问规则调整,不是模型发布,但对付费开发者的实际影响不小。

AI HOT 精选

Anthropic 给小型企业做了个 Claude 服务包,直接连 QuickBooks、PayPal 等工具跑自动化流程

Anthropic 推出 Claude for Small Business,一个在 Claude Cowork 里一键开启的服务包。它把 Claude 接进了小企业常用的工具:Intuit QuickBooks、PayPal、HubSpot、Canva、Docusign、Google Workspace 和 Microsoft 365。自带 15 个...

推荐理由:Anthropic 这次把 Claude 做成小企业套餐,给了 15 个现成工作流和几个常用工具的连接器,还加了手动审批环节,产品更新挺实在。不过正文没提价格、具体铺开范围和实际用量数据,所以先别太激动,重要性到不了必写级别。

5月13日星期三

TechCrunch · AI

Ramp 的企业支出数据里,付费用 Anthropic 的公司比例首次超过了 OpenAI

金融科技公司 Ramp 扒了自家客户的企业支出账单,发现 34.4% 的公司在给 Anthropic 花钱,OpenAI 这个比例是 32.3%,Anthropic 小胜一局。不过正文没披露到底统计了多少家公司、这些公司是初创还是大企业、以及每家每月花多少钱。光看这个比例,只能说在 Ramp 的客户池子里,Anthropic 的付费渗透率暂时领先,但差...

推荐理由:Ramp 是一家企业支出管理平台,它统计的是自己客户里的付费情况,不是全市场收入份额。34.4% 对 32.3%,差距不大,样本也局限在 Ramp 的客群,所以别直接当成“Anthropic 全面反超”。但至少说明在 Ramp 覆盖的那批公司里,Claude 的付费渗透已经压过 OpenAI 一头。正文没披露样本总量和客户行业分布,这点先打个折。

Hacker News 首页

Rotunda:一个专为 AI 智能体设计的浏览器,能模拟人类打字节奏

Pierce 发布了 Rotunda,一个基于 Firefox 150 的浏览器,专门给 Claude、Codex 这类 AI 智能体用。它最大的不同是能模拟人类的鼠标移动和键盘输入节奏——作者用自己一周的操作数据训练了一个 RNN 模型来生成这些时序,让智能体操作网页时看起来更像真人。控制方式有两种:命令行或者 Playwright API,方便接入...

推荐理由:Rotunda 把 Firefox 150 改成了给 Claude、Codex 这类工具用的浏览器,核心卖点是拿 RNN 模拟人类敲键盘、动鼠标的时序,让网站不容易识别出是机器在操作。接入方式走 CLI 或 Playwright API,对已经在用 Playwright 的人上手成本低。不过目前只是一个 Show HN 的开源仓库,正文没披露实际跑在哪些业务里、也没给延迟或成功率数据,所以效果到底怎么样还得看后续验证。

r/LocalLLaMA

小米把 1 万亿参数的 MiMo-V2.5-Pro 开源了,但自己跑真的划算吗?

小米放出了 MiMo-V2.5-Pro,参数总量 1.02 万亿,但每次推理只激活 420 亿参数,上下文窗口能塞进 100 万个 token,用 MIT 许可证。作者拿它跑了 125 次 Claude Code 任务,走 API 总共花了 70.12 美元,处理了约 3.87 亿个 token,缓存命中率高达 96.3%。这个命中率说明大部分请求其实...

推荐理由:我会先打个折:正文没披露 MiMo-V2.5-Pro 的评测跑分,所以性能好坏只能靠参数规模猜。但这条信息本身够直接——小米把一个 1.02 万亿参数、42B 激活的模型开源,另一边作者用 Claude Code 跑了 125 次会话,3.87 亿 token 花了 70.12 美元,缓存命中率 96.3%。这两组数字摆在一起,自建成本和 API 开销的对比就出来了。对做工程的人,这种一手成本数据比技术报告更有参考价值。

纽约时报中文网

中国智库向Anthropic要Mythos模型被拒,美方视作AI竞赛升级信号

上个月在新加坡一场非官方对话中,一家中国智库要求Anthropic向北京开放其最新的Mythos模型,被直接拒绝。Mythos是个擅长找软件漏洞的模型,Anthropic目前只给美国政府和40多家机构用,理由是怕引发网络安全危机。美方官员认为这次接触虽非正式外交,但背后大概率有中国政府授意,并把它看作中美AI竞赛升温的又一个迹象。文章提到,美国最新模型...

推荐理由:这条消息我会先打个折:正文没披露中国智库具体是哪家、怎么谈的、Anthropic 拒绝的细节也没展开。但核心信息够硬——Mythos 是个找漏洞的模型,Anthropic 只给美国政府和 40 多个组织用,中国想要但拿不到。这比一般的模型封锁更敏感,因为直接关系到软件供应链安全。对从业者来说,说明顶尖漏洞挖掘能力正在变成国家级的受控资源,以后这类模型可能越来越难公开拿到。

AI HOT 精选

Anthropic 被曝正谈判新一轮融资,投前估值超 9000 亿美元,要筹至少 300 亿

彭博社消息,Anthropic 正在跟投资者初步谈新一轮融资,目标是按 9000 亿美元以上的投前估值,筹至少 300 亿美元。这个数字比它今年 2 月融 G 轮时的 3800 亿投后估值翻了一倍多。交易还没签条款清单,预计最快本月底完成。Anthropic 计划今年晚些时候 IPO,现在急着筹钱主要是为了填算力资源的开销。

推荐理由:这条消息的冲击力全在数字上:投前估值超过 9000 亿美元,还要再融至少 300 亿。我会先打个折,因为正文明确说只是初步谈判,投资方和条款都没披露,月底能不能完成还两说。但即便按传闻看,这个估值已经比 OpenAI 上一轮高出一大截,说明大模型军备竞赛还在加码,算力烧钱没停。对从业者来说,这轮钱到不到位,直接影响 Claude 后续的模型迭代和算力储备,所以关注度不会低。

AI HOT 精选

Claude Code 加了个 /goal 指令,让模型自己跑到任务做完

Claude Code 新上线了 /goal 功能,你下完指令后 Claude 会持续干活直到任务完成,不用人在旁边盯着。帖子没写这个功能怎么触发、哪些版本能用、要不要额外付费,也没提任务卡住或跑偏时怎么处理。

推荐理由:HKR 三项都过,因为 /goal 解决的是 Claude Code 用户常遇到的 agent 中途停摆问题。这只是 Anthropic 单功能更新,细节披露不多,所以放在 featured 低位,不算当天重磅消息。

彭博科技

Anthropic 正谈新一轮融资,估值冲到 9000 亿美元,想再融至少 300 亿

彭博拿到消息,Anthropic 已经在和投资人早期接触,打算按 9000 亿美元估值再融至少 300 亿美元。这个数字有多夸张?做个对比:现在全球市值最高的公司也就 3 万多亿美元,Anthropic 这一轮估值已经接近三个英伟达(2023 年初的体量)。不过正文没披露具体是哪些投资人、交易条款和时间表,目前还只是初步谈判阶段。我会先打个折——早期谈...

推荐理由:Bloomberg 给了两个硬数字:至少 300 亿美元融资额、9000 亿美元估值,谈判还在早期。我会先打个折——正文没披露投资方是谁、条款怎么定、时间表也没有,所以别急着把这当成板上钉钉的事。但同一天出这种量级的 AI 资本消息,本身就说明军备竞赛还在加码,从业者看到估值和融资额就知道这行烧钱的速度没慢下来。

AI HOT 精选

Anthropic 安全团队用自家 Claude Code 搭了个威胁检测平台,一天出原型、一周上线

Anthropic 的检测平台工程团队用 Claude Code 开发了 CLUE 威胁检测与响应平台。他们一天就做出了概念验证,一周完成交付。这个平台把安全分析员查日志的时间从几小时压缩到了几分钟。文章是团队技术负责人 Jackie Bow 写的,主要讲他们怎么用 Claude Code 自动处理告警、加速调查,但没披露具体用了哪些模型、实际误报率多...

推荐理由:这是 Anthropic 安全团队自己吃狗粮的案例,不是 Claude Code 功能发布。CLUE 平台和一天 PoC、一周交付的时间线让它刚好够上 featured 门槛,但我会先打个折——内部案例的通用性还没验证,正文也没披露误报率、处理量这些硬指标。

AI HOT 精选

Claude Opus 4.7 快速模式开放研究预览,API 和 Claude Code 都能用

Anthropic 把 Claude Opus 4.7 的快速模式放出来了,现在可以在 API 和 Claude Code 里用,但还挂着研究预览的标签。正文没提模型参数量、具体定价、调用频率限制,也没说什么时候转正式版。如果是真的快又便宜,对日常开发场景会挺实用,不过这些关键信息都缺着,先别急着切生产环境。

推荐理由:我会先打个折:正文只说了开放研究预览,没披露模型大小、定价、速率限制和正式上线时间,所以别当成品看。但这条消息对用 Claude Code 干活的人很实在——快速模式意味着写代码、调工具的等待时间可能明显缩短,工作流会顺很多。信息缺口主要在成本和规模上,没这些数字就没法算账,这点先别太激动。整体判断挂在延迟改善和开发者体验上,信息不够的部分也标清楚了。

AI HOT 精选

Claude 给律师和法务做了一套专用工具,能直接进 Word 和 Outlook 干活

Anthropic 发布了 20 多个 MCP 连接器和 12 个法律专用插件,让 Claude 能直接操作合同管理系统、研究平台、文档管理和电子取证软件。具体来说,它可以在 Word 里起草和修改合同,在 Outlook 里处理日常法律流程,还能做条款对比。正文没披露这些工具的实际准确率、客户测试数据或定价,所以效果和成本现在还没法判断。

推荐理由:Anthropic 这次不是发模型,而是给 Claude 配了一套法律行业的“工具包”:20 多个 MCP 连接器加 12 个插件,直接嵌进 Word 和 Outlook 里干活,合同起草、修订、条款比对都能做。我会先打个折——正文没披露这些连接器具体覆盖哪些系统、插件是自己做的还是第三方接的,也没给实际客户案例或效率数据,所以“省了多少时间”现在说不清。但方向很明确:让模型进业务流程干活,而且选了一个对准确率要求极高、人工成本也高的行业。如果是真的跑通了,律所和法务团队的重复劳动会被吃掉一大块。这点先别太激动,等看有没有律所站出来说实测结果。

TechCrunch · AI

Anthropic 也下场了,给律所做了五类文书自动化工具

Anthropic 发布了一套面向律所的工具,覆盖文档检索与审阅、判例法资源查找、庭前证词准备、文书起草等五类事务性工作。文章没披露具体定价、上线时间和背后用的是哪个模型,也没给出实际律所的测试数据。我会先打个折——目前看更像是一个产品方向声明,能不能在合同审查这种容错率极低的场景里用,还得等更多验证。

推荐理由:Anthropic 这次不是发模型,是直接卖法律行业工具,把文档搜索、审查、判例调取、证词准备和起草这五件事串成一个产品。我会先打个折:正文没披露定价、客户数量和底层模型有没有专门为法律微调,所以现在还看不出是认真做行业方案还是先占个坑。但方向本身值得关注,因为法律文书工作量大、容错率低,能跑通一部分就能验证 AI 在专业服务里的付费意愿。这点先别太激动,等看到实际律所采用数据和准确率再说。

AI HOT 精选

Anthropic 在 Code w/ Claude SF 2026 上给开发者工具加码:Claude Code 调用频率翻倍,托管智能体新增记忆审查、多...

Anthropic 在旧金山的年度开发者大会上宣布了几项更新。Claude Code 的速率限制直接翻了一倍,Opus 模型的 API 调用上限也提高了,对重度用户来说不用那么频繁撞墙了。Claude 平台上的托管智能体(hosted agents)这次加了四个新功能:记忆审查,让智能体能回顾之前的对话;多智能体委派,可以把任务分给其他智能体去干;输出...

推荐理由:Anthropic 这次更新有具体数字和功能列表,不是画饼。速率翻倍对重度用户是实打实的改善,托管智能体加 4 项功能也说明他们在推 agent 落地。没有新模型发布,所以重要性在 78–84 这个区间合理。

5月12日星期二

AI HOT 精选

在 Claude Code 里装 OpenAI 官方 Codex 插件,让两个模型搭伙干活

作者在 Claude Code 的插件市场里加了 OpenAI 的官方库,把 Codex 插件装好、重载、配完就能用。这么做的思路来自 HeavySkill 论文的“重思考”方法:让多个模型各自独立推理,再找一个模型当主持人把思路揉到一起,提高最终回答质量。作者现在搭的 Skill 就是 Claude Code 负责推理,Codex 当主持人。正文没提...

推荐理由:HKR 三项都成立:跨模型插件调用有新闻性,安装路径可操作,对 AI 开发工作流有实际影响。但这是一篇教程型分享,不是模型或平台发布,所以只给 featured 低档。

量子位 · 公众号

OpenClaw 悄悄更新,Peekaboo v3 让龙虾在 Mac 上长出手脚

OpenClaw 的 Peekaboo v3 给 Mac 加了 agent 能力,能直接截取像素级屏幕、读取 UI 位置,然后模拟点击、打字、快捷键、滚动和拖拽。它还把 MCP 服务接进了 Cursor、Claude Code 和 Codex,等于让模型能进桌面软件里干活。正文没披露延迟和准确率数据,这点先别太激动。

推荐理由:OpenClaw 的 Peekaboo v3 给 Mac agent 加了一套完整的 GUI 感知和操作原语,还打通了 MCP,让 Cursor、Claude Code、Codex 都能调用。对搞桌面自动化的开源玩家来说是个实用更新,但毕竟只是一篇 Reddit 帖子,没有论文或代码仓库佐证,所以放在 featured 低段,78 分。

量子位 · 公众号

Anthropic 工程师提议用 HTML 替代 Markdown,Karpathy 也表态支持

Anthropic 工程师 Thariq 发了条推,列出 5 个理由主张模型输出 HTML 而不是 Markdown,Karpathy 随后转发表示认同。他的核心论点是 Markdown 的语法歧义太多,解析器各家实现不一致,模型生成时容易出错;HTML 虽然啰嗦但结构明确,对自动化处理和前端渲染更友好。正文没披露具体是哪 5 个理由,只提到生成 HT...

推荐理由:Anthropic 工程师 Thariq 主张用 HTML 替代 Markdown,Karpathy 也表态支持,这事在开发者圈子里容易吵起来。我会先打个折:这不是模型发布或产品更新,只是一场格式辩论。但文章给了具体数字——HTML 生成时间是 Markdown 的 2 到 4 倍,说明成本差距不小,从业者会关心 token 消耗和维护复杂度。正文没披露实验环境或代码,所以别太激动,目前只是一篇 Reddit 帖子,没有独立复现或论文支撑。