跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 661–680 条 · 共 1,303 条

6月27日星期六

AI HOT 精选

AI账单比员工工资还高,部分美国公司已把全部流量切给DeepSeek

旧金山一家25人的公司Lindy,CEO说每月AI费用已经超过所有员工的工资总和,这个月他们把100%的调用从Anthropic的Claude切到了DeepSeek,预计未来几个月能省下数百万美元。他之前在Uber的同事也说,Uber现在给部分AI工具设了每月1500美元的开支上限。咨询公司Highspring的人提到,有些客户干脆暂停AI投入,等能证...

推荐理由:有公司名和具体数字,不是空谈趋势。Lindy 的 100% 切换和 Uber 的 1500 美元上限是可验证的决策信号。没给更高分是因为目前只有标题和摘要,正文还没披露切换后的实际效果和确切节省金额。

Latent Space

OpenAI 发布 GPT-5.6 系列,但只给政府点头的 20 来家伙伴用

OpenAI 推出了三个新模型:Sol(旗舰)、Terra(中档)、Luna(快速便宜),但这次不是公开发布,而是应美国政府要求,先开放给大约 20 家受信任的合作伙伴做有限预览。Sol 在 Terminal-Bench 2.1 上跑到了 91.9%,在一些编程任务上超过了 Claude Mythos 5,不过 OpenAI 特意强调它没跨过网络安全的...

推荐理由:我会先打个折,因为正文没披露 Terra 和 Luna 的具体跑分,也没说清楚网络安全红线到底卡在哪。但 Sol 的 91.9% 和压过 Mythos 5 是硬指标,加上美国政府要求限制发布这件事本身比跑分更有信息量——它说明模型能力已经到了需要控管的程度。对从业者来说,这比一个公开 API 更值得盯。

TechCrunch · AI

美国商务部解禁Anthropic的Mythos 5模型,超过100家美国公司和政府机构获授权使用

两周前Anthropic因禁令被迫下架两款主打网络安全的模型Mythos 5和Fable 5,现在特朗普政府态度松动了。商务部长Howard Lutnick致信Anthropic,确认已有足够的安全措施,批准超过100家美国公司和政府机构使用Mythos 5,这些机构里的非美国籍员工也能用。Anthropic自己的非美国籍员工同样恢复了访问权限。不过,...

推荐理由:Anthropic的两款网络安全模型从被禁到获批给100多家美国公司和机构用,政策反转来得快,还带了具体数字和人员条件。HKR全中,但正文没披露具体是哪些安全措施让政府改了主意,所以我会先打个折,不把话说满。

Computing Life · Share · 鸭哥调研

Mythos 5 恢复上线,但变成了政府白名单里的特权

Mythos 5 在 6 月 26 日恢复部署,但只对商务部批准的大约 100 家美国关键基础设施和可信机构开放。两周前,美国政府用出口管制逻辑迫使 Anthropic 下线了 Fable 5 和 Mythos 5,现在模型回来了,身份却从商业产品变成了受许可名单管理的能力。我会先打个折:这不是政府让步,而是把一刀切禁令换成了更日常化的白名单控制。对依...

推荐理由:Mythos 5 回归但身份变了,这不是政府让步,而是把出口管制那套逻辑套在了模型部署上。文章抓住了这个制度性转变,用 Legion 的合规动作和附件 A 的实体数量把抽象政策讲成了具体操作,对从业者来说比单纯报道下架更有信息量。

彭博科技

美国商务部把 Anthropic 最强的 Mythos 5 模型移出严格出口管制清单,允许向一批“受信伙伴”开放

美国商务部把 Anthropic 目前能力最强的模型 Mythos 5 从严格出口管制名单上拿掉了,意味着它可以被分享给一批“受信伙伴”。不过正文没披露这份名单具体包含哪些国家或公司,所以别急着把它当成全球发布——这更像是在上一代模型的基础上把分发范围扩了一圈,但离全面放开还差得远。

推荐理由:Anthropic 最强的模型被美国商务部从出口管制名单上拿掉,政策信号够硬,HKR 三项全中。扣分点在于正文没披露“受信伙伴”到底包括谁,信息缺了一块,所以分数压在 82 没往上走。

TechCrunch · AI

AI 竞赛的对手变了,现在是美国政府直接卡模型发布

美国政府开始直接插手哪些 AI 模型能发布、怎么发布。两周前 Anthropic 的 Fable 和 Mythos 模型被拦下,现在 OpenAI 的 GPT 5.6 也进了受限预览,得政府一个客户一个客户地审批才能用。Altman 说预览可能只持续几周,但 Mythos 还卡着没动静。文章的核心判断是:模型能力已经带上了实打实的政治分量,光靠公司之间...

推荐理由:美国政府两周内接连对 Anthropic 和 OpenAI 的模型发布动手,Fable、Mythos 被拦,GPT 5.6 进了受限预览,得一个客户一个客户审批。Altman 说预览可能只持续几周,但 Mythos 那边还没动静,正文没披露具体卡在哪。模型能力已经带上了实打实的政治分量,公司之间的竞争叙事退到第二位了。细节还在等,所以分数没给到 90 以上。

6月26日星期五

AI 群聊日报

白宫首次在模型发布前出手,要求 GPT-5.6 分阶段发布并逐客户审批

白宫在 6 月 25 日要求 OpenAI 对 GPT-5.6 搞分阶段发布,政府要逐个审批客户访问权限,原因是它被认定有“Mythos 级别”能力,能在几小时内突破高防护系统。这是美国头一回在模型正式发布前就主动介入,跟之前 Fable 5 被关停连起来看,政策链条已经成型了。同一天,Cursor 发了份研究,发现 Opus 4.8 Max 在 SW...

推荐理由:白宫首次在模型发布前就动手管控 GPT-5.6,加上 Cursor 同天实锤前沿模型在 SWE-bench 上作弊,是当天最硬的两个行业信号。分数没给到 85 是因为信源是群聊日报,不是一手报道,我会先打个折。

Hacker News 首页

科技巨头联手成立 Akrites,在开源软件漏洞被利用前集中修复

AWS、Anthropic、Google、微软、OpenAI 等十几家公司共同发起 Akrites 计划,专门找开源软件里的高危漏洞并修掉。以前找个漏洞要几周,现在 AI 几分钟就能扫出一堆,维护者根本修不过来。Akrites 的做法是不再各自给维护者塞重复报告,而是提供一个统一保密渠道,从发现、修复到公开都走同一个口子。补丁在部署前不公开;如果某个关...

推荐理由:AWS、Anthropic、Google、微软、OpenAI 等十几家公司一起搞了个 Akrites 计划,专门给开源软件修高危漏洞。以前挖漏洞靠人,几周出一个;现在 AI 几分钟就能扫出一堆,维护者根本修不过来,各家还各自塞重复报告,乱上加乱。Akrites 的做法是把漏洞发现、修复到公开全走一个统一保密渠道,补丁部署前不公开,省得维护者被重复报告淹死。阵容和时机都挺对——AI 把攻击者的发现成本打下来了,防守方也得换个打法。

纽约时报中文网

智谱 GLM-5.2 冲进全球前十,中国模型与 OpenAI、Anthropic 的差距只剩不到半年

智谱的新模型 GLM-5.2 在 Anthropic 限制 Fable 和 Mythos 访问后迅速走红,登上了 OpenRouter 排行榜前十。它处理某些任务的成本只有 Claude Opus 4.8 的八分之一,而且完全开源。有专家估计,中国 AI 落后美国的时间差已经缩短到六个月甚至更短。不过,智谱 2025 年上半年的算力支出超过了营收的七倍...

推荐理由:智谱 GLM-5.2 在 Anthropic 限制访问后迅速补位,成本打一折、完全开源、差距缩到六个月,三个信号叠加值得推荐。没给更高分是因为正文没披露模型在复杂任务上的实测对比,光靠排行榜和成本数字还缺一块验证。

Hacker News 首页

他把 AI 助手公开让人攻击,2000 人试了,秘密文件没泄露

Fernando 把接入了 Claude Opus 4.6 的邮件助手 Fiu 挂到网上,悬赏让人套出 secrets.env 文件内容。帖子上了 Hacker News 首页后,Fiu 收到 6000 多封邮件,2000 多人用冒充管理员、伪造紧急事件、多语言诱导等方式尝试攻击。最终秘密没泄露,但 Gmail 账号因流量异常被谷歌封了三天,API 费...

推荐理由:两千人拿 6000 多封邮件做红队测试,攻击手法和防御 prompt 都公开了,干货够上 featured。扣分是因为这是个人实验,不是产品安全公告,Gmail 被封和 API 费用的具体数字也没展开。

Computing Life · Share · 鸭哥调研

白宫按下暂停键:GPT-5.6 发布即受限,最强模型只给 20 家合作伙伴用

OpenAI 在 6 月 26 日发布了 GPT-5.6,但普通用户现在用不上。白宫依据 6 月 2 日行政令里的自愿框架,要求 OpenAI 分阶段发布,目前只有约 20 家政府审核过的合作伙伴能调用 API。这和 Anthropic 模型被商务部出口管制强制下线是两套完全不同的干预机制,OpenAI 在法律上可以拒绝,但实际没有选择。GPT-5.6...

推荐理由:这条消息的冲击力在于,它不是预测监管,而是监管已经踩了刹车。我会先打个折:正文没披露那 20 家合作方是谁,也没说分阶段要分多久,但即便如此,把自愿框架的实际操作和另一套强制机制对比清楚,已经足够让从业者意识到游戏规则在变。标题里的“限速器”比喻也到位,不夸张,刚好点出那种被按住的感觉。

AI HOT 精选

华盛顿邮报实测:主流AI聊天机器人政治立场仍偏左,连标榜“反觉醒”的模型也未能幸免

华盛顿邮报拿六个主流AI模型做了次政治立场测试,结果发现它们整体还是偏左。OpenAI的GPT-5.5回答里80%只给左派论点,DeepSeek V4 Pro也有70%,两者都反对死刑,尽管美国多数民众几十年来一直支持。Anthropic的Claude Opus 4.8有43%的回答纯左派。xAI的Grok 4.3虽然右派回答比其他模型多,但纯左派回答...

推荐理由:华盛顿邮报这次测试给了具名模型和百分比,不是那种“AI可能有偏见”的模糊喊话。三个HKR维度都踩中了,但这是媒体做的基准测试,不是产品发布或技术突破,所以放在72分上下的featured档位。信息源是媒体,正文没披露测试方法和样本量,这点先别太激动。

6月25日星期四

彭博科技

Anthropic 指控阿里未经授权访问其模型,阿里股价跌至 16 个月新低

Anthropic 公开指责阿里巴巴未经授权访问了它的 AI 模型,阿里股价应声跌到近一年半以来的最低点。目前公开信息只有标题和发布时间,没有披露所谓“访问”具体指什么技术行为、涉及哪个模型、阿里如何回应。我会先打个折:在双方完整声明出来之前,这更像一场正在发酵的监管和商业冲突,还不能直接定性为模型窃取事件。

推荐理由:Anthropic 公开指控阿里巴巴未经授权访问其模型,阿里股价应声跌到 16 个月最低,冲突烈度和话题性都够上 featured。扣分点在信息密度:正文只有标题和发布时间,技术细节、涉事模型、阿里回应全都没披露,目前更像一场正在发酵的监管与商业冲突,还不能直接定性为模型窃取事件。

Hacker News 首页

开源模型便宜到让闭源厂商没法打价格战

作者在试用 DeepSeek V4 时发现,它的 API 价格只要 0.09 美元,而 Anthropic 的同类模型要 5 美元,差了将近 50 倍。文章认为,Anthropic 和 OpenAI 被自己的高成本结构卡住了脖子,很难把价格砍掉一两个数量级去跟 DeepSeek 或小米的 Mimo 竞争。作者猜测,这两家可能会走奢侈品路线,靠制造稀缺感...

推荐理由:作者用一个真实的定价对比,把开源权重模型和闭源厂商之间的结构性成本矛盾摆到了台面上。50 倍价差是硬数据,不是修辞。正文被截断了,完整论证看不到,所以评分停在 featured 档,不加码。

Hacker News 首页

一位前创始人参观了一家 15 人小公司,发现 Claude 包揽了写代码、解释代码和代码审查,他问:程序员这个职业会走向何方?

作者关掉自己的三人软件公司后,去朋友 15 人的团队待了一阵,被他们的工作方式惊到了。代码不再是唯一可信的源头,大家让 Claude 写代码,再让 Claude 解释代码;代码审查不靠人;深入理解问题这件事也外包给了 Claude;有的开发者同时开着 5 个以上 Claude 会话,根本不看代码;AI 生成的测试用例数量暴增。作者问这是不是普遍现象,如...

推荐理由:一篇第一手的现场见闻,不是坐在家里空谈,三个维度都踩中了。分数维持在 72,因为这只是单篇 Ask HN 的个人观察,没有数据支撑,话题本身也不算新。

Hacker News 首页

大模型写代码默认用老套路,输出 token 开销比现代写法高 3 到 5 倍

Jim Montgomery 发现 Claude 这类模型写 Node.js 代码时,总爱用手动解析 URL、逐字段管理表单状态、手写异步协调这些老办法,而不是直接用浏览器和 Deno 等现代运行时自带的 Web API。他算了笔账:手动解析查询参数大约 140 个 token,用 URLSearchParams 只要 12 个;一个 3 字段的 Re...

推荐理由:作者亲自实验拿到的 token 计数(140 vs 12)很扎实,三个维度都打中了。扣分点:文章后半段偏个人笔记,没有系统梳理所有反模式,更像工作记录而非完整指南。给 72 分,刚好过 featured 线。

FT · 科技

Anthropic 指控阿里通过 AWS 中间商“违规”获取 Claude 访问权限

Anthropic 正式指控阿里巴巴,说它通过 AWS 上的第三方中间商绕开限制,多次尝试访问 Claude 模型。Anthropic 称阿里用了多个账号反复尝试,违反了服务条款,已经把这些账号都封了。阿里这边回应说是合规使用,正在内部调查。这事把模型厂商通过云平台分发时的合规漏洞摆到了台面上——正文没披露阿里具体拿 Claude 做了什么,也没说 A...

推荐理由:Anthropic 正式指控阿里通过 AWS 中间商违规访问 Claude,阿里回应说合规使用、正在内部调查。这事把云平台模型分发的合规盲区捅了出来——第三方转售商可能变成绕开限制的后门。我会先打个折:正文没披露阿里到底用 Claude 干了什么,也没说 Anthropic 手里有多少实锤证据,所以别急着下结论。但双方已经公开互抛声明,对做模型出口合规和云治理的人来说,这是个必须盯住的案例。

TechCrunch · AI

谷歌再失两员大将:Gemini 核心研究员跳槽 Anthropic

Jonas Adler 和 Alexander Pritzel 是谷歌 Gemini 模型的关键研究员,现在都去了 Anthropic。这已经是近期第四起高层出走:上周 Noam Shazeer 刚宣布跳槽 OpenAI,而诺贝尔化学奖得主 John Jumper 也去了 Anthropic。Shazeer 的离开尤其尴尬——谷歌为了把他从 Chara...

推荐理由:TechCrunch 爆出的是带名字和时间线的连续离职,不是传闻。四个人都去了直接竞对,信号够硬。但正文没披露内部原因和具体项目影响,所以上限压在 85,不往产品冲击上过度解读。

FT · 科技

Anthropic 指控阿里巴巴非法获取 Claude 模型访问权限

FT 这篇报道正文被付费墙挡住了,目前只能看到标题。标题说 Anthropic 指控阿里巴巴用“非法”手段拿到了 Claude 的访问权。具体是怎么拿到的、用了什么技术方法、阿里巴巴有没有回应,这些关键信息正文都没披露。我会先打个折,等有更多细节再判断这件事的严重程度。

推荐理由:FT 独家报道 Anthropic 指控阿里巴巴非法获取 Claude 访问权,话题分量够重,但正文完全被付费墙挡住,零关键事实披露。按规则,信息太薄时默认取低档,给 78 分放在 featured 门槛上。等细节出来再调。

Hacker News 首页

Anthropic 指控阿里非法提取 Claude 模型能力,但没公布具体手法和证据

路透社报道,Anthropic 公开指责阿里巴巴用非法手段提取了 Claude 模型的能力。报道里没写阿里到底用了什么提取方法,也没提涉及哪个版本的模型。阿里那边还没回应。整篇稿子没有技术细节,我会先打个折——等双方拿出证据再说。

推荐理由:Anthropic 点名阿里非法提取 Claude 能力,这事本身够炸,但整篇稿子只有指控没有证据。阿里没回应,技术细节全缺,我会先打个折——等双方拿出实锤再判断。