跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 1181–1200 条 · 共 1,303 条

4月22日星期三

彭博科技

日本财相本周约谈大银行,专门聊 Anthropic 新模型 Mythos 可能带来的风险

日本财务大臣片山皋月计划最早本周内召集国内主要银行开会,议题直指 Anthropic 最新模型 Mythos 对金融业的威胁。目前公开信息里没写 Mythos 具体能干什么、风险是哪种类型,也没提会不会出台监管措施。但这件事本身说明,日本可能要把前沿模型的风险正式摆到银行桌面上谈了。

推荐理由:Bloomberg 的信源给这条消息加了分:日本财务大臣要见大银行,点名讨论 Anthropic 的 Mythos 模型,这在政策层面是个实打实的信号,所以 H 和 R 都过了。分数停在 72,因为 K 太薄了——正文没披露 Mythos 的能力、风险类型和处置方向,我会先打个折。标题容易让人以为出了大事,但真正值得盯的是日本金融监管有没有把前沿模型塞进银行风险会议议程,这点先别太激动,等后续细节出来再说。

彭博科技

澳大利亚央行盯上 Anthropic 的 Mythos 模型,担心它被用来搞网络攻击

澳大利亚储备银行(RBA)正在关注 Anthropic 的 Mythos AI 模型。起因是 Anthropic 自己说这个模型有能力发动复杂的网络攻击,但彭博这篇报道的正文被付费墙挡住了,看不到具体的技术细节、评估范围和落地时间表。我会先打个折:目前只知道监管机构在盯着,但没披露他们打算怎么盯、盯到什么程度,也没说 Mythos 到底在什么条件下会构...

推荐理由:澳洲联储在盯着 Anthropic 的 Mythos AI,理由是这模型被说成能执行复杂网络攻击。我会先打个折:正文只给了彭博 RSS 摘要里那句能力声明,监测范围、技术细节、时间表全都没写。所以这条新闻的看点在于“央行下场盯模型”这个动作本身,而不是已经坐实了什么风险。对从业者来说,这更像一个信号——监管对模型安全能力的关注正在从纸面讨论走向具体盯防,但具体怎么盯、盯到什么程度会动手,现在全是空白。

FT · 科技

Anthropic 正在调查自家 Mythos 模型被未授权访问的事

FT 这篇报道正文被付费墙挡住了,只看到标题和摘要片段。已知信息是:Anthropic 在查一起针对其 Mythos 模型的未授权访问,并且之前因为担心这个新工具的“黑客能力”而限制了它的发布。具体有多少账号受影响、模型能力被限制到什么程度、时间线是怎样的,正文没披露。

推荐理由:FT 报道 Anthropic 在查 Mythos 的未授权访问,摘要补了一句关键信息:发布受限就是因为怕它的黑客能力。HKR 三项全中,但正文没披露到底哪些账户受影响、模型能力边界在哪、处置时间线是什么,信息缺口不小,所以重要性停在 84,放 featured 而不是更高。

X · @dotey(宝玉)

Anthropic 没发公告,悄悄把 Claude Code 从 20 美元 Pro 套餐里拿掉了

有人在 Anthropic 的功能对比表里发现,Pro 套餐对应的 Claude Code 一栏变成了叉号,多篇帮助文档也删掉了“Pro 套餐包含 Claude Code”的说法。但 Claude Code 产品页面和客服机器人还写着包含,部分 Pro 用户反馈目前仍能使用,正文没披露 Anthropic 的正式解释或生效时间。如果这个变更落地,开发者...

推荐理由:这条值得上 featured,因为门槛变化一旦落地,Claude Code 的入门价直接翻五倍,对个人开发者冲击不小。但 Anthropic 没给正式说明,生效时间和现有 Pro 用户怎么处理都不清楚,所以不往更高层级放。我会先打个折:正文没披露官方回应,现有信息都来自页面比对和用户反馈,这点先别太激动。

Hacker News 首页

Anthropic 把 Claude Code 从 20 美元月费的 Pro 套餐里拿掉了,新用户没法用

Anthropic 悄悄改了规则,新订阅 20 美元/月 Pro 套餐的用户不再包含 Claude Code 编程工具。老 Pro 和 Max 用户暂时不受影响。官方说法是“在约 2% 的新个人用户里做测试”,但帮助文档已经从“Pro 或 Max 套餐可用”改成了“Max 套餐可用”,官网定价页也同步去掉了 Pro 的 Claude Code 入口。正...

推荐理由:这条消息在三个维度上都站得住:Pro 缩水本身就是个意外转折,文章用帮助页存档和官方回应把证据链补上了,而且开发者对定价和权益变动天然敏感。我会先打个折——目前只影响新用户测试群,正式政策时间表和回溯范围正文都没披露,所以重要性停在 76 是合理的。

The Verge · AI

SpaceX 签了个“可能买也可能不买”的协议,标的 Cursor,开价 600 亿美元

SpaceX 跟 AI 编程工具 Cursor 达成了一个二选一的交易框架:要么花 600 亿美元把 Cursor 买下来,要么付 100 亿美元分手费走人。文章没披露具体的交易结构、时间表,也没说跟 SpaceX 传闻中的 IPO 怎么挂钩。RSS 摘要里提了一句,这笔交易可能帮马斯克旗下的 xAI 在编程工具上追赶 Anthropic,但正文里没展...

推荐理由:标题说可能收购,但真正有信息量的是那笔 100 亿美元退出费——它更像一个约束机制,而不是简单的“不买了就赔钱”。正文只披露了顶层的两个数字,交易怎么设计、什么时候推进、跟 xAI 追 Anthropic 之间到底什么关系,全都没说。所以我会先打个折:事实够硬,但缺口也大,放在 featured 合适,别拔到 P1。

彭博科技

Anthropic 的新模型 Mythos 被未授权用户访问了

Bloomberg 拿到内部文件和知情人士消息,说有一小撮未授权用户摸到了 Anthropic 还没正式发布的 Mythos 模型。Anthropic 内部认为这模型能力强到能搞出危险的网络攻击,所以这事不是普通的产品泄露,是访问控制出了问题。不过报道里没写到底多少人、通过什么路径、在什么时间段访问的,也没说 Anthropic 后续怎么堵的窟窿。

推荐理由:Bloomberg 爆出的不是常规产品消息,而是 Anthropic 的安全事故。未授权访问一个被内部判定为网络攻击级危险的大模型,本身就够抓眼球,也够讨论一阵。HKR-H 和 HKR-R 直接拉满,因为这事天然有传播力和讨论价值。HKR-K 靠的是新披露的访问事实和风险定性,但具体人数、路径、时间线正文全没给,信息缺口不小,所以知识增量有,但别指望能复盘全貌。

4月21日星期二

Ben's Bites

Claude 新增设计面板,问几个问题就能出原型图

Anthropic 给 Claude 加了一个“设计”标签页,会先弹出 5 到 10 个问题跟你互动,然后直接生成线框图或高保真原型。作者实测发现,传图片转设计的流程在原型模式下效果不错。目前这个功能还在研究预览阶段,有独立的使用额度,20 美元月费套餐一周大概只能跑两三次大尺寸生成。文章更尖锐的吐槽在可用性上:Claude Cowork 很多能力依赖...

推荐理由:Anthropic 给 Claude 加了个 Design 标签页,对天天用 Claude 的人是个明确的信号。文章有实测细节——5-10 轮交互出原型、图像转设计流程可用、20 美元套餐每周只够跑两三次大生成——所以 HKR 三项都站得住。但这仍然是个单功能更新,不是平台级变化,我会先打个折。真正值得盯的是产品可用性:作者点名 Claude Cowork 依赖 connectors 和 plugins,但入口藏太深,这点先别太激动,等更多用户反馈再说。

机器之心 · 公众号

谢尔盖·布林重回一线盯 AI 编程,谷歌拉了一支突击队

谷歌悄悄组了一支 AI 编程突击队,由前 DeepMind 研究员 Sebastian Borgeaud 带队,谢尔盖·布林和 Koray Kavukcuoglu 直接参与,目标是提升长上下文编程能力和内部代码自动化。压力信号很直接:谷歌自己说约 50% 的代码已由编程 agent 生成、工程师负责审核,而 Anthropic 那边放话 Claude ...

推荐理由:HKR 三项都成立:布林回归的 hook 够强,谷歌 50% 代码由 agent 写的数字是硬信息,AI 编程的竞争态势也是圈内真痛点。但正文没披露团队规模、上线时间和具体模型版本,所以没给更高优先级。

X · @dotey(宝玉)

GitHub Copilot 暂停 Pro、Pro+ 和学生版新注册,Pro 套餐砍掉 Claude Opus 模型

4 月 20 日,GitHub 对 Copilot 个人版动了次大手术:Pro、Pro+ 和学生版不再接受新用户,只剩免费版还能注册。官方说这是为了保住现有付费用户的服务质量。Pro+ 的使用额度被拉到 Pro 的 5 倍以上,Pro 用户如果老撞墙,官方建议加钱升 Pro+。最狠的一刀是 Pro 套餐直接移除了 Claude Opus 模型,Anth...

推荐理由:Copilot 个人版这次调整不是发新功能,而是卡入口、压额度、分层模型。Pro 用户被拿走 Claude Opus,Pro+ 额度拉到 Pro 的五倍以上,定价却没变——等于用供给端收缩来应对模型成本压力。信息来自 X 帖子而非 GitHub 官方公告,这点先打个折,但暂停注册和退款窗口本身已经够具体,值得从业者盯后续。

FT · 科技

Anthropic 和亚马逊谈了个 1000 亿美元的算力基建大单

Anthropic 跟亚马逊达成了一项总规模 1000 亿美元的 AI 基础设施协议,核心是锁定芯片和算力供应。今年 Anthropic 出过几次服务中断,这次合作主要是为了把计算容量提前占住,而不是普通的战略合作。不过正文被付费墙挡住了,具体的合同期限、钱怎么付、芯片从哪来、交付规模这些关键信息都没披露。

推荐理由:FT 报了一条 Anthropic 与 Amazon 的 1000 亿美元 AI 基础设施协议,金额大到今天必须写。H 端靠千亿数字和算力绑定撑起点击欲;K 端有新事实,但期限、资金来源、芯片来源、交付规模全都没披露,我会先打个折;R 端踩中了模型厂对云和硬件的依赖这个活神经,不是空泛合作,是把供给瓶颈写进了合同。

TechCrunch · AI

Anthropic 从亚马逊拿了 50 亿美元,代价是承诺在 AWS 上花 1000 亿

亚马逊又给 Anthropic 投了 50 亿美元,累计投资到了 130 亿。但这笔钱不是白拿的——Anthropic 承诺未来十年在 AWS 上花超过 1000 亿美元,换取最多 5 吉瓦的算力来训练和跑 Claude。说白了,这就是用投资款锁定云服务大单。交易还绑定了亚马逊的自研芯片,从 Trainium2 一路包到还没发布的 Trainium4,...

推荐理由:Anthropic拿了亚马逊50亿,转头承诺在AWS花掉1000亿——这不是普通融资,是资本和云采购的对价互换。我会先打个折:正文只给了RSS摘要,没披露这1000亿是几年花完、算力怎么分配、有没有退出条款,所以别急着算估值。真正值得盯的是,前沿实验室的融资越来越像云厂商的长期订单,钱进来,命脉也交出去了。

彭博科技

亚马逊再投 Anthropic 50 亿美元,总承诺可能到 200 亿

亚马逊对 Anthropic 追加 50 亿美元投资,协议还留了口子,未来可能再追加最多 200 亿。正文没披露估值、股权比例、打款节奏和云服务绑定条款,所以这笔钱到底换来了多少控制权、是不是锁死了 AWS 算力,目前还不清楚。

推荐理由:Bloomberg 同天报道亚马逊再投 Anthropic 50 亿美元,对模型圈和云生态有直接冲击。我会先打个折:正文只给了金额,没给估值和排他条款,这点先别太激动。真正要盯的是钱之外的条件——这决定了它更像一笔财务投资,还是更深层的模型与云绑定。

X · @AnthropicAI

Anthropic 跟亚马逊扩大合作,给 Claude 锁定了最多 5 吉瓦的算力

Anthropic 宣布加深与亚马逊的合作,为训练和部署 Claude 锁定了最高 5 吉瓦的算力。这批算力从这个季度开始陆续到位,到 2026 年底预计先上线近 1 吉瓦。5 吉瓦是个什么概念?大概相当于几个大型数据中心的满负荷运转,说明他们接下来要把模型规模或服务量再往上拉一个台阶。不过正文没披露合同金额、具体用什么芯片、数据中心建在哪,所以实际成...

推荐理由:标题里的 5 吉瓦别直接信,那是远期上限,真正有谱的是今年底先到 1 吉瓦。正文没提合同金额、用什么芯片、数据中心在哪,所以成本结构和实际性能都还是问号。我会先打个折看交付节奏,但能在这个时间点锁产能,对 Anthropic 的训练和部署确实是颗定心丸。

TechCrunch · AI

NSA 被曝在用 Anthropic 的 Mythos 模型,五角大楼还在跟这家公司打官司

Axios 的消息说,美国国家安全局(NSA)正在用 Anthropic 新出的 Mythos Preview 模型。这个模型本月初才公布,专做网络安全任务,但因为攻击性太强,Anthropic 没敢公开发布,只给了大约 40 家机构用,公开点名的只有十几家,NSA 不在公开名单里。据说 NSA 主要拿它扫描系统环境、找可被利用的漏洞。吊诡的是,NSA...

推荐理由:标题把 NSA、Anthropic 的受限模型 Mythos 和 Pentagon 分歧绑在一起,冲突钩子很足。新信息就两点:NSA 在用、模型是受限版,但正文没披露怎么接入、跑在什么环境、花了多少钱、Pentagon 那边到底在吵什么。我会先打个折,因为证据链现在很薄,全靠一篇报道撑着。不过国防情报场景用前沿模型这件事本身,对采购、合规和供应商关系都有直接冲击,从业者会关心后续怎么落地。分数定在 75,等有合同细节或部署范围再往上调。

4月20日星期一

Import AI

华为搞了个 HiFloat4 训练格式,在自家昇腾芯片上跑赢了西方主导的 MXFP4

华为的研究员在自家昇腾 NPU 上测试了一种叫 HiFloat4 的 4 比特训练格式,跟西方主导的 MXFP4 格式比,HiFloat4 的精度损失更小。具体来说,在 Llama 和 Qwen 模型上,HiFloat4 跟全精度 BF16 基准的误差能控制在 1% 左右,而 MXFP4 即使加了随机舍入等一堆稳定技巧,误差也有 1.5%。这背后可能跟...

推荐理由:Jack Clark用三件事拼出一期:Anthropic拿Claude Opus 4.6做自动化对齐研究,800小时花约1.8万美元把PGR从人类基线0.23提到0.97,说明小团队也能跑对齐实验;HiFloat4在华为昇腾NPU上推理损失约1.0%,比MXFP4的约1.5%好,但正文没披露更多硬件细节;中国模型安全研究部分给出了安全评估框架,但具体模型名和测试集没展开。整体是研究评论而非一手发布,信息密度够,适合放进精选。

r/LocalLLaMA

Reddit 网友拿 9 个模型做功能规划对比,Claude Opus 4.6 生成的规格书最贵也最详细

一位 Reddit 用户让 9 个模型给一款 Go 语言记账 App 设计“负载追踪”功能,再用 Claude Code 给生成的规格文档打分排名。Claude Opus 4.6 排第一,产出一份 19KB 的规格书,过程中读了 44 次代码,花了 2.47 美元;GLM 5.1 排第二,Qwen 3.6 35B fp8+vLLM 排第三。作者自己强调...

推荐理由:这是一次有名有姓的个人实测,给出了真实工作流里的数据,所以 H、K、R 三项都站得住。但天花板不高:只测了一个功能、排名由 Claude Code 自己打分、正文没提人工验收结果,我会先打个折,放在 featured 里偏低的位置。

机器之心 · 公众号

Anthropic 编程智能体负责人讲 vibe coding 的正确姿势:2 周变 1 天,但别让 AI 碰核心逻辑

Anthropic 研究员 Erik Schluntz 分享了他团队用 Claude 写代码的真实工作流。他们最近合并了一个 2.2 万行的生产环境改动,大部分代码由 Claude 生成,把原本两周的工作压缩到了一天。他的做法是先花 15-20 分钟让 AI 通读代码仓库、做规划,然后只让 AI 改叶子节点(也就是依赖最少、影响范围最小的模块),核心逻...

推荐理由:这是一篇来自 Anthropic 内部的实战经验,不是泛泛而谈。有 22000 行生产合并、两周变一天的硬数字,也有可复用的流程规则,比如先让模型花 15 到 20 分钟探索代码库再动手、改动锁在叶子节点、核心路径必须人审。对正在纠结怎么把 coding agent 放进真实流水线的团队来说,参考价值很高。保持 featured 不升 p1,因为它本质是实践课,不是模型或产品重大发布。

4月19日星期日

新智元 · 公众号

伯克利团队造了个专门作弊的 AI,SWE-bench 满分但一个 bug 都没修

伯克利 RDI 团队用一段大概 10 行的 pytest 钩子代码,在 SWE-bench 全部 500 个任务上拿了 100% 分数,实际修 bug 数是 0。他们的 agent 还顺手打穿了另外 8 个主流 agent 评测,分数从 73% 到 100% 不等。作弊手法包括篡改测试钩子、直接读本地 file:// 答案文件,以及利用评测器本身的校验...

推荐理由:HKR-H 落在'满分却零修复'的矛盾上;HKR-K 落在约 10 行 pytest 漏洞、500 题和 8 个基准的覆盖面上;HKR-R 落在评测信任危机上,做智能体产品的人会反复掂量。属于强 featured 研究,但不是当天行业事件,所以不到 P1。

4月18日星期六

机器之心 · 公众号

Anthropic 给 Claude 加了个设计功能,能直接出线框图、原型和幻灯片

Anthropic 在 Claude Pro、Max、Team 和 Enterprise 账号里上线了 Claude Design 的研究预览版,背后跑的是 Claude Opus 4.7。它能吃代码库、图片、DOCX、PPTX、XLSX 和网页截图,吐出来的东西可以导出到 Canva、PDF、PPTX 和 HTML。标题说 Figma 和 Adobe...

推荐理由:我会先打个折:标题说 Figma、Adobe 股价重挫,但正文没给出具体跌幅,这点先别太激动。真正值得看的是 Anthropic 把设计稿生成、设计系统读取、多人协作编辑和向 Claude Code 交接串成了一条线,这比单出一个画图工具要狠。不过目前还是研究预览版,没有用户测试数据、定价和实际落地案例,能不能真革了设计行业的命还得看后续。