跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 981–1000 条 · 共 1,304 条

5月20日星期三

AI HOT 精选

谷歌发布 Gemini 3.5 Flash,智商分涨到 55,速度超 280 tokens/秒,但运行成本贵了 5.5 倍

谷歌把 Gemini Flash 系列更新到了 3.5 版,智商评分从上一代的 46 分提到 55 分,直接超过了 Grok 4.3 和 Claude Sonnet 4.6。进步主要在两方面:一是让模型进业务流程干活(代理任务)更靠谱了,二是知识真实性提升,幻觉明显减少。输出速度超过每秒 280 个 token,在速度和智商之间卡了个好位置。多模态评测...

推荐理由:谷歌发Gemini 3.5 Flash,属于头部实验室的模型迭代,而且有Artificial Analysis的第三方数据撑腰,速度、智能、成本都摆出来了。HKR三项全中,尤其是5.5倍的成本跳涨让这条消息不止于常规发布,值得从业者看一眼。

The Verge · AI

Google 想用 CodeMender 跟 Anthropic 的 Claude Mythos 抢安全赛道

Google 在 I/O 上把去年 10 月亮相的代码安全工具 CodeMender 的 API 开放给一批专家测试,定位是“能自己发现漏洞并修好”的 AI agent。DeepMind CTO 说目标是帮全球代码库做安全加固。文章拿它跟 Anthropic 突然发布的 Claude Mythos Preview 对比,但正文没披露 CodeMende...

推荐理由:HKR 三项都踩中了,但正文只确认了封闭内测和标记修复机制,开放时间、价格、评测结果全都没披露,所以先放在 featured 这一档。

AI HOT 精选

谷歌发布 Gemini 3.5 Flash,输出速度跑到每秒 289 个 token,是 GPT-5.5 的四倍

谷歌在 I/O 大会上推出了 Gemini 3.5 Flash,官方说它在很多基准测试里比自家 3.1 Pro 强。最直观的卖点是快:输出速度达到每秒 289 个 token,对比的是 Claude Opus 4.7 和 GPT-5.5 xhigh,快了大约四倍。谷歌内部还用 Antigravity 工具做了个实验,让 93 个子智能体协作,12 小时...

推荐理由:谷歌在 I/O 上扔了个速度炸弹:Gemini 3.5 Flash 每秒吐 289 个 token,号称是 GPT-5.5 xhigh 和 Claude Opus 4.7 的四倍。这个数字对做应用的人很直观——响应更快、排队更短、按 token 算钱可能也更省。不过正文没提价格、上下文窗口多大、以及能力上限在哪,所以先别把它当成全面碾压,目前就是个单项速度领先。

r/LocalLLaMA

开源项目 Codegraph 声称能把 Claude、Cursor 等编程助手的工具调用次数砍掉 94%

Codegraph 的做法是提前给代码建好一张知识图谱,把符号关系、调用链和代码结构都索引好。在 VS Code 的测试里,工具调用从 52 次降到了 3 次,运行时间从 1 分 37 秒缩短到 17 秒。不过正文没披露具体测试的代码规模和任务复杂度,这个 94% 的降幅能不能在别的项目里复现还不好说。

推荐理由:HKR 三条都过了,但证据目前只有 Reddit 帖子和公开仓库的自测结果,没有独立复现或第三方验证。94% 的降幅和 52→3 的调用次数足够上 featured,但还不到 p1 的确定性。我会先打个折:数字好看,但别太激动,等有人复现再说。

5月19日星期二

AI HOT 精选

Andrej Karpathy 加入 Anthropic,马斯克也公开点赞

Andrej Karpathy 已经加入 Anthropic,连马斯克都公开夸了这家公司。帖子没写 Andrej 具体担任什么职位、什么时候入职,也没提 Anthropic 在 Google I/O 上到底发布了什么,只知道他们今天在大会上存在感很强。

推荐理由:我会先打个折:这条消息有热度,但信息量很薄。Andrej 去 Anthropic 是事实,马斯克点赞是花边,正文没披露他到底做什么、什么时候入职、带不带团队。对从业者来说,知道风向就够了,但别指望从这里读出战略。所以给 featured 而不是 p1,因为缺关键信息,没法做更深的判断。

TechCrunch · AI

Andrej Karpathy 加入 Anthropic,负责 Claude 的预训练

Karpathy 这周已经入职,在 Nick Joseph 的团队做预训练——就是那种烧钱烧算力的大规模训练,用来给 Claude 打知识基础和核心能力。他之前在 OpenAI 是联合创始人,也管过特斯拉的 AI。目前公告没提他的具体职位、汇报线和合同细节,只说了他会在 X 上发帖表示看好接下来几年大模型前沿的研发。

推荐理由:HKR 三项全中:Karpathy 的 OpenAI 身份、Anthropic 预训练岗位、Claude 级别的大规模训练工作,让这条消息成了当天的人才战争故事。不过正文没披露职级、汇报线和加入时间,这些信息缺口我先标出来,别把这条当成全面的人事变动分析。

AI HOT 精选

Andrej Karpathy 加入 Anthropic,没回 OpenAI

Andrej Karpathy 在 X 上宣布自己加入了 Anthropic,要重新做前沿大模型研究。他之前是 OpenAI 早期核心成员,也主导过特斯拉 Autopilot,2024 年彻底离开 OpenAI 后去做了 AI 教育创业项目 Eureka Labs。这次选 Anthropic 而不是老东家,对 OpenAI 来说算是一次明显的人才流失。...

推荐理由:Karpathy 加入 Anthropic 是前沿实验室一次高信号的人事变动。正文只确认了他入职,没写团队、职级和研究方向,信息缺口明显,所以分数卡在 85 这一档的低位。我会先打个折:别脑补他具体在做什么,但光凭他选 Anthropic 而不是回 OpenAI,就够圈内讨论一阵了。

Hacker News 首页

Andrej Karpathy 加入 Anthropic

Karpathy 自己在 X 上发了这个消息,但正文没披露他具体担任什么职位、进哪个团队、什么时候入职。目前只有一条推文链接和 Hacker News 上的讨论,46 个赞、3 条评论,信息量很少。

推荐理由:Karpathy 去 Anthropic 这件事本身是个信号,说明顶尖研究员在 OpenAI、特斯拉之后选了 Claude 这条线。但正文除了一个 X 链接和 HN 上 46 分、3 条评论,什么都没展开——没职位、没团队、没时间,连他负责什么方向都只能靠猜。我会先打个折:热度够,但信息太薄,重要性给到 82 是合理的,别因为名字就往上拔。

AI HOT 精选

Karpathy 加入 Anthropic,具体职位和负责方向还没说

Anthropic 官方账号发了一条“欢迎加入团队,Andrej!”,确认 Andrej Karpathy 已入职。正文没披露他的角色、职责、入职时间或所属团队,目前只有这一句官宣。

推荐理由:我会先打个折:正文只有一句“欢迎加入团队”,没写职位、没写职责、没写入职时间,信息量很薄。但 Karpathy 这个名字加上 Anthropic 这个标的,在人才争夺和前沿研究两条线上都够分量,所以 H 和 R 都拉满了。K 这边只有一条硬事实,缺太多关键细节,没法给更高。

AI HOT 精选

Claude 托管代理新增自托管沙箱和 MCP 隧道,执行环境和内部服务连接都留在用户自己手里

Anthropic 给 Claude 托管代理加了两项安全控制。自托管沙箱让代理的运行环境跑在用户自己的基础设施或指定的沙箱供应商上,不再必须用 Anthropic 的默认环境。MCP 隧道则让代理能直接连到用户安全边界内的内部服务,不用把服务暴露到公网。正文没披露这两项功能的具体实现细节、延迟影响或额外成本。

推荐理由:Claude 的托管代理这次加了两个安全功能:一个是自托管沙箱,让代码执行跑在用户自己的服务器或指定的沙箱服务商那里,不用全交给 Anthropic 的云端;另一个是 MCP 隧道,相当于给模型调外部工具时加了一条加密通道,不用把内部服务直接暴露到公网。这两项改进对想在企业环境里用 Claude 做自动化流程的团队来说,算是补上了两个明显的安全短板。正文没给出性能开销或延迟数据,所以实际体验会不会打折还不清楚。整体看,这不是模型能力升级,而是部署层面的安全加固,对已经在用或打算用托管代理的人有参考价值,但新闻性本身不算炸裂。

AI HOT 精选

用 Claude Code 两分钟生成一个项目计划页,比 Notion 快了近 20 倍

作者给 Claude Code 下了一段精确的提示词,两分钟就吐出一个单文件 HTML 页面,暗色主题、时间线、可折叠表格全都有,没有外部依赖,拿来就能用。他以前在 Notion 里搭同样的模板要花 30 到 40 分钟,效率差了近 20 倍。核心是把视觉、内容结构和交互细节一次性写进提示词里,让模型直接交付成品。正文没披露具体提示词全文,也没说生成后...

推荐理由:HKR 三项全中:有具体的 Claude Code 实操钩子,有 2 分钟 vs 30-40 分钟的硬数字对比,对一线干活的人直接有用。范围虽小,但信息密度够,放在 featured 没问题。

AI HOT 精选

Claude 托管智能体更新:你可以用自己的沙盒跑任务,还能打通内网数据库

Anthropic 给 Claude 托管智能体平台加了两项新能力。自托管沙盒进入公开测试,意思是智能体执行代码、跑工具的环境可以部署在你自己的服务器上,安全策略和运行权限都由你控制,不用把敏感操作放在 Anthropic 的云端。MCP 隧道处于研究预览阶段,它能让智能体直接访问你公司内网的私有数据库和 API,比如连上本地的 Postgres 或内...

推荐理由:这是 Anthropic 官方给 Claude 智能体托管平台发的功能更新,两条都是具体机制,不是方向性博客。权重比发新模型低一档,但作为 agent 基础设施的进展,够上 featured。我会先打个折:MCP 隧道还是研究预览,别当生产可用;自托管沙箱公测了,但正文没披露延迟和资源开销数据,实际省不省钱还得自己测。

AI HOT 精选

Claude 托管代理新增自托管沙箱和 MCP 隧道,让模型在你自己的安全环境里跑任务

Claude 在伦敦线下活动上发了两个新功能,都跟 Claude Managed Agents 有关。自托管沙箱进入公测,意思是代理可以在你自己的安全边界里运行,默认就用你设好的安全策略,不用再额外配一套。MCP 隧道是研究预览版,正文没展开讲具体怎么用,但从名字看应该是给 MCP 服务打通一条安全通道。这两个功能合在一起,解决的是同一个问题:让模型进...

推荐理由:这是 Claude 官方在代理基础设施上的一次实在更新,不是画饼。自托管沙箱让代理跑在用户自己的环境里,不用把数据全交给云端,安全团队更容易点头;MCP 隧道则解决了内外网工具打通的问题,代理能直接调用内部服务。两个功能都还在公测或预览阶段,正文没给出大规模压测数据,稳定性先打个折。但方向很明确:让代理进企业流程干活,同时把控制权留在用户手里。

新智元 · 公众号

AI 创业公司一年收入冲到 800 亿美元,Anthropic 反超 OpenAI,两家吃掉近九成

The Information 统计了 34 家头部 AI 创业公司的年化收入,加起来约 800 亿美元。OpenAI 和 Anthropic 两家就占了 89%,其中 Anthropic 到 2026 年 4 月年化收入已超过 300 亿,反超 OpenAI 对外报的 250 亿。不过原文因为微信环境验证拦截,正文没披露具体统计口径和收入确认方式,这...

推荐理由:这条消息的钩子很清晰——Anthropic 收入反超 OpenAI,同时两家垄断近九成份额,比单纯说“行业总盘子大”更有信息量。The Information 给出的 800 亿年化收入和 89% 集中度是新的具体数字,不是泛泛的趋势判断。对 AI 从业者来说,收入集中度比融资额更能反映商业落地现状,所以值得推。不过这是二手财务报道,不是模型或产品发布,重要性定在 82 合理。

FT · 科技

FT 披露:Google DeepMind 创始人也投了竞争对手 Anthropic

这条消息来自 FT 的一篇付费文章,正文被付费墙挡住了,只留了个标题。标题说 Google DeepMind 的创始人投资了死对头 Anthropic。具体投了多少钱、在哪一轮进的、什么时候发生的,正文没披露,RSS 摘要里也只提到这位诺奖得主的门生们正在融几十亿。所以目前只能确认有这么一笔投资存在,细节一概不知。

推荐理由:我会先打个折,因为正文只说了“门生在融资数十亿美元”,没给出具体的投资金额、轮次和时间,信息量其实有限。但 H 分给在“创始人投对手”这个冲突点上,天然有传播力;K 分是因为 FT 的披露本身算一个新事实,只是关键细节全缺;R 分则来自 AI 圈对实验室竞争和利益冲突的敏感度,从业者会愿意聊两句。整体看,消息有钩子但缺硬数据,放在 featured 档比较合适。

AI HOT 精选

教皇利奥十四世首份通谕《人类的光辉》5月25日发布,Anthropic联合创始人将同台谈AI伦理

梵蒂冈新闻网确认,教皇利奥十四世的第一份通谕《Magnifica humanitas》(人类的光辉)定在2026年5月25日发布。通谕本身是教皇对教会和世界的正式教导文件,这次特别的是,Anthropic的一位联合创始人会一起出席发布活动,讨论人工智能技术和伦理问题。Hacker News上已经有104条讨论,说明技术圈也在关注这件事。不过正文没披露通...

推荐理由:我会先打个折:正文只说了主题是“人工智能技术与伦理”,没披露通谕具体会讲什么、Anthropic在里面扮演什么角色、有没有可落地的政策建议。亮点在于这是梵蒂冈第一次专门为AI发通谕,而且拉上了Anthropic的人一起站台,说明AI安全圈和宗教权威在互相借力。Hacker News给了104点关注,热度不低,但信息量目前就这么多,先别太激动。

Computing Life · Share · 鸭哥调研

代码都开源了,AI 巨头为什么还要花几亿美金去买这些公司

Anthropic 半年内连买四家公司:Bun、Vercept、Coefficient Bio 和 Stainless,OpenAI 则拿下了 Astral 和 Promptfoo。这些被收购的产品几乎全是开源的,MIT 或 Apache 2.0 许可证,理论上谁都能免费 fork 一份自己维护。但文章指出,fork 只能拿到代码,拿不到原团队对复杂内...

推荐理由:我会先打个折:正文没披露价格和条款,所以没法判断这几亿花得值不值。但文章抓的点很准——开源不等于免费获取控制权,大厂买的是维护者、路线图和社区信任,这些 fork 一份代码拿不到。对从业者来说,这比单纯报收购名单更有信息量,只是缺硬数字支撑,所以放在 featured 偏低的位置。

Hacker News 首页

墨西哥政府被一个用 Claude 的独狼攻破,150GB 数据被拖走

这篇文章讲的是 AI 没发明新攻击手法,但把攻击的人力成本打到了几乎为零。作者举了三个 2025 年的真实案例:一个独狼用 Claude Code 伪装成漏洞赏金猎人,攻破墨西哥税务局、选举机构和多个州政府,拖走 150GB 数据,包括 1.95 亿条纳税人记录;另一个用 Claude 当“现场指挥”,对 17 家医疗和应急机构搞勒索;还有个阿尔及利亚...

推荐理由:标题说一个用户靠Claude就攻破了墨西哥政府、拖走150 GB数据,听着像安全圈会疯转的那种故事。但正文除了这个标题和摘要,什么都没展开——没写怎么用Claude、攻击入口在哪、时间线、受影响部门,连是不是钓鱼或社工都看不出来。我会先打个折:悬念够强,但信息太薄,没法判断是真实事件还是夸大。如果是真的,这事对模型安全和企业防护的冲击不小;如果是标题党,那也说明现在“AI辅助入侵”已经成了流量密码。目前只能按现有信息给到featured,等更多细节出来再调。

AI HOT 精选

Claude Design 把 token 上限翻倍,一次能生成更多内容

Claude Design 宣布所有套餐的 token 限制直接翻倍,意味着你一次对话能塞进去的上下文和产出的内容量都大了不少。但正文没披露具体翻倍后的 token 数是多少、各套餐之间有没有差异、价格变没变、以及什么时候生效。我会先打个折:上限翻倍是好事,但没给数字就没法判断实际能多干多少活。

推荐理由:Anthropic 官方产品更新,只有一个硬事实:所有套餐 token 限制翻倍。HKR 三项都过,但正文没披露具体 token 数、价格变化和生效范围,所以只能放在 featured 低段。我会先打个折——翻倍听着爽,但不知道原来是多少,实际提升就不好算。

TechCrunch · AI

Anthropic 收购了 OpenAI、Google 和 Cloudflare 都在用的开发者工具公司 Stainless

Anthropic 买下了一家叫 Stainless 的纽约初创公司,这家公司 2022 年成立,专门做一件事:自动生成和维护 API 的 SDK(就是开发者用来调接口的代码库)。有意思的是,Stainless 的客户名单里本来就有 OpenAI、Google 和 Cloudflare 这些 Anthropic 的直接对手。收购价和具体整合计划正文都没...

推荐理由:我会先打个折,因为没公布交易金额和整合细节,没法判断这笔收购到底有多大分量。但钩子确实强:Stainless 的客户名单里躺着 OpenAI 和 Google,Anthropic 把它买下来,等于把对手用的工具收进自己口袋。技术上,Stainless 干的事是自动生成和维护 API 的 SDK,省得开发者手动写调用代码,对想推 API 的模型公司来说是个实在的基建。正文没写收购后 Stainless 还会不会继续服务其他客户,这点先别太激动。整体看,这事对关注开发者工具和 API 生态的人有信息量,但缺关键数字,所以到不了更高分。