跳到正文

#Anthropic

今日 9 条

5月26日星期二

新智元 · 公众号

昆仑万维发布天工 Agent,号称性能逼近 Opus 4.6,还给了 2-4 周免费试用

这篇文章本身被微信环境验证挡住了,正文内容没抓到。从标题和现有英文摘要看,昆仑万维发了两个模型:SkyClaw-v1.0 和 SkyClaw-v1.0-lite,主打 Agent 场景,也就是让模型进业务流程干活。他们宣称 SkyClaw-v1.0 的输入成本是 DeepSeek V4 Pro 的 1/24、Sonnet 4.6 的 1/43,这个数字...

推荐理由:这条消息我会先打个折,因为所有性能对比和成本数字都来自厂商自己,没有第三方验证。但它的传播点很清晰:一个国产 Agent 模型宣称能力接近 Claude Opus 4.6,同时把输入价格压到对手的四十分之一,还白送几周试用。对正在被 Token 账单压得喘不过气的团队来说,哪怕只是“声称”,也足够让人点进去看一眼。正文没披露这些基准测试的具体条件和评测机构,所以“逼近 Opus 4.6”先别太激动,但成本对比如果属实,确实挺省钱。

纽约时报中文网

教宗发了一份4万多字的人工智能通谕,直接对硅谷的“技术救世主”心态说不

教宗良十四世发表了首份通谕《崇高人性》,全文42300字,核心就一个意思:AI会放大有钱、有技术、有数据的人手里的权力。他警告,如果任由少数人把他们的道德观塞进AI系统,变成看不见的底层规则,那会是一场灾难。文章没点名,但指向很明确,就是硅谷那些科技巨头。有意思的是,通谕发布时还邀请了自称“善良AI”的Anthropic联合创始人站台,说明教宗不是要砸...

推荐理由:这篇不是讲模型或产品,而是从外部权力视角给 AI 行业泼冷水。教宗用一份 42300 词的通谕,把 AI 的风险归结为资源、专业知识和数据会进一步向强者集中,这个判断本身比很多行业报告更直白。我会先打个折:正文没披露具体监管建议或技术细节,所以它更像一记舆论重锤,而不是可操作的路线图。但考虑到它罕见地把宗教权威拉进 AI 安全讨论,而且直接点名 Anthropic 和 OpenAI,对从业者反思安全责任和平台权力有刺激作用,给 78 分放在 featured 是合适的。

AI HOT 精选

OpenAI 被曝下月发 GPT-5.6,上下文窗口拉到 150 万 token

开发者在 OpenAI Codex 的后台日志里挖出了一个叫 iris-alpha 的未公开模型,对应 GPT-5.6,可能 6 月发布。最直观的变化是上下文窗口涨到 150 万 token,比现在 GPT-5.5 API 的 105 万多出约 43%。有人在辅助工具 OpenCode 里实测,喂到 90 万 token 还能流畅回话,甚至能处理超过 ...

推荐理由:这条消息来自 Codex 日志泄露,不是官方公告,所以我会先打个折。但 150 万 token 的上下文窗口和 iris-alpha 代号都是实打实的数字,对做 agent 和长文档处理的人有直接参考价值。正文没提发布时间和定价,这点先别太激动。整体属于值得从业者扫一眼的更新,但还没到必须立刻行动的程度。

r/LocalLLaMA

一位律师用 12 块 V100 显卡搭本地集群跑法律文书起草,Qwen3.5-122B 模型跑到约 50 token/秒

Reddit 上一位律师分享了自己用 12 块 32GB 显存的 SXM V100 显卡搭建本地 AI 集群的进展,专门用来起草法律文书。核心模型是 Qwen3.5-122B-A10B,在 4 块 V100 上推理速度大约 50 token/秒。这套流程里还加了一个“验证器”,会在最终文件使用前自动拦截没有真实来源的引用、日期和 Bates 编号(案件...

推荐理由:这是一篇来自Reddit的第一手实验记录,不是厂商通稿。律师自己攒16块V100跑Qwen 122B做法律文书,速度约50 tok/s,还加了引用和日期验证器来拦截幻觉,信息量扎实。我会先打个折:来源是个人帖子,权威性有限,所以放在featured低段而不是p1。但HKR三项全中——故事性强、有可复现数字、切中本地部署和合规痛点,对想自己动手的团队是个不错的参照。

AI HOT 精选

Anthropic 联合创始人在梵蒂冈谈 AI:实验室自己也困在商业和地缘压力里,需要外部监督

Chris Olah 在教皇利奥十四世 AI 通谕发布会上说了三件事。他先承认,包括 Anthropic 在内的前沿 AI 实验室都面临商业竞争、研究压力和地缘政治压力,这些会跟“做对的事”冲突,所以必须有人站在这些利益之外盯着。他把现在的 AI 模型比作“让虚构角色活过来”——不是传统工程设计的产物,而是用人类语言“养”出来的,连开发者自己也觉得内部...

推荐理由:我会先打个折:正文没给出那 3 个问题的完整清单,也没展开具体监督机制,所以信息增量有限。但 Olah 在梵蒂冈这种场合把商业、研究、地缘政治压力并列讲出来,等于公开承认实验室自己扛不住,外部监督不是可选项而是必需品。对关注 AI 安全治理的人来说,这个表态比普通政策呼吁更有分量,因为说话的人就在前沿实验室内部。

5月25日星期一

FT · 科技

FT 评论:科技巨头需要国家安全监管,正文被付费墙挡住

这篇文章的正文被 FT 的付费墙完全挡住了,只能看到标题和一段摘要。摘要里提到 Anthropic 和 SpaceX,并建议在这些公司的董事会里安插一名由总统提名、参议院确认的董事。但具体怎么落地、谁来执行、有什么约束力,正文没披露,没法判断这个提议是认真的政策设计还是随便喊一嗓子。

推荐理由:FT 这篇是评论,不是已落地的政策。它点名 Anthropic 和 SpaceX,给了一个很具体的提议:董事会里加一个总统提名、参议院确认的席位。正文没披露执行机制、投票权怎么设计、公司不配合怎么办,所以只能当一种政策思路看。我会先打个折,因为没落地,但观点够尖锐,放在 featured 档。

5月24日星期日

新智元 · 公众号

Anthropic 三张底牌全翻:Mythos 1 首次现身,Opus 4.8 被扒出

Anthropic 的新模型和项目被提前曝光了。claude-opus-4.8 的名字出现在 Google Vertex AI 平台上,同时一份 59.8MB 的 Claude Code 源码映射文件泄露,里面 51.2 万行 TypeScript 代码不仅提到了 Sonnet 4.8,还带出了 Mythos 1 的线索。Mythos 1 看起来和 C...

推荐理由:我会先打个折:这是泄露加平台列表,不是 Anthropic 官方发布。正文没披露能力分数、定价、上下文窗口或可复现评测,所以分数卡在 78–84 区间。但 Mythos 1 第一次被挖出来,Opus 4.8 又在 Vertex 上露脸,对关注 Anthropic 路线图的人来说信息量不小,值得放进 featured。

5月23日星期六

AI HOT 精选

Anthropic 最快下周完成超 300 亿美元融资,估值将反超 OpenAI

彭博社援引知情人士消息,Anthropic 的新一轮融资最快下周敲定,总额预计超过 300 亿美元,公司估值可能突破 9000 亿美元,直接超过 OpenAI。这轮融资推进很快,几周内就从收到提案走到了谈判尾声,但正文没披露具体领投方和条款细节。公司同时给出了很猛的收入预期:第二季度营收 109 亿美元,比上季度翻了一倍多,并且有望首次实现季度盈利;年...

推荐理由:HKR 三项全中:彭博社报的 300 亿+ 融资、9000 亿+ 估值和 109 亿 Q2 营收预期,让这条消息成了当天 Anthropic 资本赛道的核心故事。不过交易还没正式落定,所以重要性压在 85-94 这个区间。我会先打个折——正文没披露这轮融资的具体条款和投资人名单,估值反超也只是“有望”,别太激动。

AI HOT 精选

Claude Code v2.1.149:用量报告分类展示、企业可开放云端 MCP 连接器,并修了三个安全漏洞

这个版本主要做了三件事。第一,/usage 命令现在会按类别(比如对话轮次、工具调用)分开展示用量,方便你看出成本花在哪。第二,企业管理员可以通过 allowAllClaudeAiMcps 设置,允许团队直接使用 Anthropic 云端的 MCP 连接器,不用自己搭。第三,修了三个安全漏洞:PowerShell 脚本可能绕过权限执行、Git work...

推荐理由:Claude Code 的一次小版本更新,改动不多但都落在实处。/usage 现在能按类别看用量,方便你盯成本;企业管理员多了个 allowAllClaudeAiMcps 开关,可以统一放行 MCP 工具,不用一个个批。安全方面修了 3 个问题,最要紧的是 PowerShell 权限绕过——正文没展开具体利用条件,但光这个就够让运维团队推更新了。整体属于实用型发版,没画饼。

AI HOT 精选

Claude 自动模式向 Pro 用户开放,支持 Sonnet 4.6 和 Opus 4.7

Claude 的自动模式现在 Pro 计划也能用了,不再是最贵那一档的专属。这次更新还接入了 Sonnet 4.6 和 Opus 4.7 两个模型,按 Shift+Tab 就能让 Claude 自己跑任务。正文没提价格有没有变,也没说是不是全量推送,这点先别太激动。

推荐理由:这是一次中等体量的产品更新,不是新模型或重大能力发布。自动模式进 Pro 计划,配上两个模型和快捷键,对日常靠 Claude 干活的开发者有实际影响,但还没到需要全行业关注的程度。

AI HOT 精选

Anthropic 公布 Glasswing 项目首月战报:用 Claude Mythos Preview 挖出上万个高危漏洞

Anthropic 说,他们和大约 50 家合作伙伴用 Claude Mythos Preview 模型,在全球最关键的基础软件里找到了超过一万个高危或严重级别的漏洞。现在瓶颈已经不是找漏洞的速度,而是验证、通报和打补丁的速度。在开源软件扫描这块,模型自己估算发现了 6,202 个高危或严重漏洞,其中 1,752 个已经过独立安全公司或 Anthrop...

推荐理由:Anthropic 这次放出的不是模型跑分,而是 Claude 在真实关键系统里挖漏洞的战报。约 50 家合作伙伴用 Claude Mythos Preview 扫出超过一万个高危或严重漏洞,独立验证准确率 90.6%,说明模型在安全自动化这条线上已经从“能看”走到“能干活”了。我会先打个折:正文没披露漏洞类型分布、误报率和修复成本,也没说这 90.6% 是在什么条件下测的,所以准确率数字先别太激动。但不管怎么说,一万多个高危漏洞这个量级,加上 Mozilla、Cloudflare 这类合作方背书,对做安全自动化和关键基础设施防护的团队来说,是一个...

彭博科技

Anthropic 最快下周完成超 300 亿美元融资,估值冲到 9000 亿以上

彭博社援引知情人士消息,Anthropic 计划最快下周关闭一轮超过 300 亿美元的融资,投后估值超过 9000 亿美元。这个数字会让它超过 OpenAI,成为全球最值钱的 AI 创业公司。不过正文被 Bloomberg 的机器人验证墙挡住了,具体条款、投资方和资金用途都没披露。

推荐理由:彭博说 Anthropic 最快下周就能把这轮超过 300 亿美元的融资关掉,投后估值冲到 9000 亿美元以上,按这个数字它会超过 OpenAI 成为估值最高的 AI 初创公司。我会先打个折:正文没披露具体投资人、资金用途和估值计算方式,而且交易还没落袋,所以重要性停在 91 分,没往 95 以上推。但这条消息本身够直接——钱、时间、排名三个要素都给了,对关注前沿实验室资本动态的人就是一条硬消息。

AI HOT 精选

Anthropic 的 Project Glasswing 一个月内在关键软件里挖出超一万个高危漏洞

Anthropic 说,他们上个月启动的协作 AI 安全项目 Project Glasswing 已经和合作伙伴一起,在关键软件中发现了超过一万个高危或严重漏洞。不过正文没披露具体是哪些软件、漏洞怎么复现、以及现在修没修好。

推荐理由:我会先打个折:1 万多个高危漏洞这个数听起来很猛,但正文没披露漏洞清单、复现条件,也没说修没修,所以没法判断是真挖到硬伤还是扫出一堆已知问题。不过 Anthropic 把 AI 安全能力直接挂到关键软件漏洞挖掘上,对从业者来说是个值得跟的信号。这点先别太激动,等他们放出具体漏洞和修复数据再下判断。

5月22日星期五

新智元 · 公众号

微软投了 OpenAI 130 亿,自家工程师用 Claude Code 把账本烧穿了

微软计划在 6 月底前停掉体验与设备团队的 Claude Code 订阅,把近 10 万工程师迁到 GitHub Copilot CLI。文章把原因归结为外部按 token 计费的成本太高,但正文因为需要验证码没加载出来,具体烧了多少钱、内部怎么讨论的都没看到。

推荐理由:我会先打个折:这不是模型发布或官方重大产品更新,更像一次内部成本管控动作。但 HKR 三项都站得住——微软投 OpenAI 又禁 Claude Code 的对比很抓人,时间、人数、计费原因都给了,而且直接踩中编程助手在企业里怎么省钱的痛点。正文没披露具体账单金额,所以别把省钱效果说死。整体适合放在 featured 位置,81 分合理。

新智元 · 公众号

Anthropic 更新了 Agent 架构,但正文被验证页挡住了,没法确认具体改了什么

这篇文章的链接点进去只显示“环境异常,需要验证”,正文内容完全看不到。从已有的英文摘要看,阿里云的 JVS Crew 把 Agent、环境和会话拆成了三层,加了沙盒、快照恢复、权限控制和按量计费;Anthropic 在 5 月 19 号给 Claude 托管 Agent 加了自托管沙盒。文章还提到几个国内客户案例,说部署周期两周,效率提升 5 到 10...

推荐理由:文章把阿里云 JVS Crew 和 Anthropic 的沙箱更新放在一起比,讲的是企业级 agent 基础设施怎么落地。有具体架构细节,也有安全与计费的讨论,对正在选型或关注 agent 生产化的从业者有用。不过 Anthropic 那部分信息偏薄,正文没展开 self-hosted sandboxes 的限制和实际表现,这点先别太激动。整体属于值得一看的产品对比,不是必写的模型发布。

AI HOT 精选

Claude Code v2.1.147 新增 Workflow 工具,/simplify 改名 /code-review 并支持生成 PR 行内评论

Claude Code 发了 v2.1.147。这次加了一个叫 Workflow 的新工具,默认是关着的,用来做确定性的多智能体编排——你可以把它理解成让多个 AI 助手按固定流程协作干活,而不是自由发挥。另一个变化是把原来的 /simplify 命令改成了 /code-review,功能也升级了:现在会报告代码正确性,还能直接在 GitHub PR ...

推荐理由:这是 Claude Code 的一个小版本更新,但 Workflow 工具的加入让产品从单智能体往多智能体协作迈了一步。工具默认关闭,说明还在试探阶段,正文没披露性能数据、定价或使用范围,所以先别太激动。把 /simplify 改名为 /code-review 也更直白,知道是拿来审代码的。整体看,对关注编码智能体稳定性的从业者是个值得留意的信号。

AI HOT 精选

Claude 企业版接入 28 款安全合规工具,IT 团队能像管其他应用一样管 AI 了

Anthropic 给 Claude 企业版和平台新增了 28 个安全合规集成,背后靠的是 Claude Compliance API。这个 API 能把 Claude 里的对话内容和操作记录,直接送进企业已经在用的数据防泄漏(DLP)、安全信息与事件管理(SIEM)这类监控系统里。简单说,就是让安全团队用现有工具就能看到员工跟 Claude 聊了什么...

推荐理由:Anthropic 给 Claude 企业版和平台加了 28 个安全合规集成,通过 Compliance API 把对话内容和活动事件喂给数据防泄露(DLP)和安全信息管理(SIEM)系统。对想用 Claude 又怕合规翻车的团队来说,这波操作把审计和监控的坑填了不少。正文没提延迟和成本影响,但集成数量本身说明他们在补企业落地的课。

彭博科技

五角大楼拉上 25 个内部用户,实测 OpenAI 和 Google 的模型,准备找 Anthropic 的替代品

五角大楼正在让 25 个部门里的“高级用户”同时测试 OpenAI 和 Google 的 AI 模型,目的是给目前用的 Anthropic Claude 找个备胎。一位高级国防官员透露了这个消息,但具体在测哪些模型、用什么标准打分、以及什么时候会正式切换,正文都没说。我会先打个折:这更像是一次早期的内部摸底,离真正换供应商还有距离。

推荐理由:Bloomberg 的信源加上五角大楼实测竞品,HKR 三项都站得住。正文没公布候选模型名单、合同金额和时间表,所以重要性我给打个折,刚好卡在 featured 门槛上。

5月21日星期四

AI HOT 精选

Anthropic 快成第一家赚钱的 AI 实验室了,二季度预计营收 109 亿、运营利润 5.59 亿美元

华尔街日报的消息,Anthropic 二季度营收预计冲到 109 亿美元,同比增长 130%,运营利润约 5.59 亿美元,比它自己去年说的 2028 年前不盈利提前了不少。增长主要靠两件事:一是编程工具被大量公司用起来,二是 Claude 开始接那种能自己跑一段时间的“干活型”任务,需求大到算力一度不够用,逼着 Anthropic 去签新数据中心合同...

推荐理由:这条消息的钩子很清晰:Anthropic可能要成为第一个赚钱的头部AI实验室了。给出的数字挺吓人,单季营收109亿,运营利润5.59亿,如果属实,说明卖模型服务真的能跑通。但我会先打个折,因为这只是《华尔街日报》根据预测数据做的报道,不是官方审计后的财报,正文也没披露成本结构里算力烧了多少、企业客户贡献了多少。这点先别太激动,等正式文件出来再看。不过,光是“盈利”这两个字就足够让整个行业讨论一阵子了,所以优先级给到p1,重要性88分。

MIT Technology Review · AI

Anthropic 在伦敦办了一场开发者大会,近半数人举手说上周刚发过完全由 Claude 写的代码,而且很多人没看就直接上线了

Anthropic 在伦敦的 Code with Claude 大会上展示了一个趋势:开发者越来越愿意把写代码的活直接交给 AI。工程师 Jeremy Hadfield 在现场问谁上周发过完全由 Claude 写的 pull request(提交审核的代码改动),近一半人举手;再问谁没读代码就直接发了,大部分手还举着。Anthropic 说公司内部大部...

推荐理由:这篇 MIT Tech Review 的现场报道不是产品发布稿,但抓到了一个很实的信号:开发者已经在把 Claude 写的代码直接往仓库里合,而且不少人连看都不看。我会先打个折,这个数字来自活动现场举手统计,样本量和代表性都有限,不能直接推成行业常态。但“近一半”这个比例还是够高,说明在重度用户里,对 AI 代码的信任已经跨过了一道心理门槛。文章没给 PR 的复杂度或后续回滚率,这点信息缺口让判断只能停在“行为在发生”而不是“行为没问题”。整体适合放进 featured,因为它比功能更新更能让人停下来想一下自己的工作流。

The Verge · AI

SpaceX IPO 文件曝光:Anthropic 每月花 12.5 亿美元租用马斯克的数据中心,一年就是 150 亿

SpaceX 在 S-1 上市申请里写明了这笔交易的价码:Anthropic 每月要付 12.5 亿美元,一直付到 2029 年 5 月,用来使用位于孟菲斯的 Colossus I 和 Colossus II 两座 AI 训练中心。一年算下来就是 150 亿美元,这个数字快赶上 SpaceX 2025 年全年 187 亿美元收入的两倍了。合同里还藏了一...

推荐理由:我会先打个折:150 亿美元是年化数字,实际是按月付 12.5 亿,合同到 2029 年 5 月。但即便这样,这笔钱也大到离谱,相当于 Anthropic 把训练算力的命脉交到了马斯克手里。S-1 文件是 SpaceX 上市披露,可信度没问题。正文没披露 Anthropic 具体拿多少 GPU、训练什么模型,但 Colossus I 和 II 是孟菲斯新建的超大规模训练中心,说明 Anthropic 在算力上下了重注。这点先别太激动,合同细节比如是否有退出条款、算力规格都没说,但光这个金额和合作方组合,就值得今天写。

新智元 · 公众号

Anthropic 买下 SDK 工具商 Stainless,OpenAI 等客户得自己维护代码库了

Anthropic 把 Stainless 给收购了。Stainless 是一家专门帮公司自动生成和维护 API 的 SDK(软件开发工具包)的公司,OpenAI、Meta、Cloudflare 之前都是它的客户。收购之后,Stainless 会关掉它的托管产品,也不再给老客户提供后续支持。不过,之前已经生成的 SDK 代码所有权还归客户自己,只是后续...

推荐理由:我会先打个折:这不是模型发布或核心能力更新,所以分数不会顶满。但 Anthropic 这手挺狠,Stainless 是给 API 自动生成 SDK 的,全球据说四分之一开发者都在用,客户包括 OpenAI 和 Meta。收购后 Anthropic 直接要把托管产品关停,等于断了竞争对手一条现成的开发者工具链。正文没披露收购金额和具体关停时间表,但光是“断供 OpenAI”这个动作,就够让依赖这套工具的团队紧张一阵了。

FT · 科技

Anthropic 快要有第一个赚钱的季度了

FT 的付费墙把具体数字全挡住了,正文没披露是哪个季度、营收多少、利润多少、按什么会计准则算的。标题说 Anthropic 即将实现首次季度盈利,比 OpenAI 和 xAI 都早一步。但看不到细节,这点先别太激动——不知道是运营利润还是算上了投资收益,也不知道收入是靠 API 调用还是靠企业大单撑起来的。

推荐理由:我会先打个折:正文只说了“有望”,没披露是哪个季度、赚了多少、营收规模多大,所以这更像一个方向性信号而不是实锤。但信号本身够尖锐——Anthropic 如果真比 OpenAI 和 xAI 先盈利,说明它在企业客户和 API 收入上可能跑得更务实,烧钱换规模的节奏也可能更克制。这点先别太激动,等具体财报出来再看是运营利润还是调整后的数字。

TechCrunch · AI

Anthropic 告诉投资人,下季度收入将翻倍到约 109 亿美元,并首次实现运营盈利

Anthropic 在最近一轮融资中向投资人透露,今年第二季度收入预计冲到 109 亿美元左右,比上一季翻了一倍多,而且会第一次交出运营利润。这是个重要节点,也让它跟 OpenAI 的竞争更有看头。不过先别太激动——《华尔街日报》的报道提到,因为后续算力开销太大,Anthropic 今年未必能一直保持盈利。正文没披露具体的利润率或成本结构,所以这个“盈...

推荐理由:标题说 Anthropic 快要有第一个盈利季度了,正文补了一句 Q2 营收会翻倍到 109 亿美元左右。我会先打个折:正文没写利润率,也没说成本结构,所以盈利是运营利润还是调整后的数字,不知道。这点先别太激动。但营收翻倍本身说明客户在买单,不是只靠融资撑着。对从业者来说,这比任何 benchmark 刷榜都更能说明模型有没有商业价值。

AI HOT 精选

SpaceX 开始卖 AI 算力,已签下 Anthropic,还在谈更多客户

马斯克发推说 SpaceX 正在大规模提供 AI 算力服务,Anthropic 是已公开的客户,同时还在跟其他公司谈。推文提到未来会通过轨道数据中心把规模做得极大,但没给时间表、具体算力规格和部署方案。我会先打个折:轨道数据中心这事目前只是远期设想,正文没披露任何技术验证或发射计划,短期内能落地的还是地面算力。

推荐理由:HKR 三项都成立:SpaceX 和 Anthropic 的组合本身就自带流量,算力合作的消息也够新。但正文只给了一句话,没披露轨道数据中心的具体规模、价格或时间表,信息缺口很大,所以分数卡在 72–77 这个区间。

彭博科技

Anthropic 要在三年内付给 SpaceX 近 450 亿美元,买算力跑 Claude

根据一份证券文件,Anthropic 跟马斯克的 SpaceX 签了份大单:未来三年支付差不多 450 亿美元,换取计算资源来支撑它的 Claude 模型。这笔钱摊下来每年约 150 亿美元,说明头部 AI 公司抢算力的成本已经拉到天文数字级别。不过正文被 Bloomberg 的机器人验证挡住了,具体是租 GPU 还是包数据中心、交付节奏和退出条款都没披露。

推荐理由:我会先打个折:450 亿美元是三年总承诺,不是一次性付款,但数字大到足以让任何 AI 公司重新算账。Anthropic 把算力押在 SpaceX 身上,说明它不想只靠 AWS 或 Google Cloud,分散供应商是明牌。不过正文没披露具体算力规格、交付时间表,也没说 SpaceX 的算力基础设施到底建到什么程度,这点先别太激动。Bloomberg 拿证券文件报出来,可信度比 PR 稿高,值得写。

r/LocalLLaMA

HalBench 基准测试:用 3200 个带坑问题测了 4 个头部模型,看谁更会拒绝瞎编

一位开发者自己搭了个叫 HalBench 的测试,专门看模型在遇到“前提本身是错的”的问题时,是会顺着瞎编(谄媚)还是直接指出问题。他拿 3200 个这种带坑提示词跑了 4 个模型:Sonnet 4.6 平均分 0.565 排第一,最敢反驳;Gemini 3.1 Pro 0.339 垫底,更容易顺着错误前提往下编。分数越高,代表模型越能识别出问题里的假...

推荐理由:HKR 三项都成立:HalBench 有个清晰的定制评测钩子,3200 条提示加分数,话题踩在模型信任和安全评测的痛点上。来源只有 Reddit 一个帖子,基准本身也没经过外部验证,所以放在低 featured 档。

TechCrunch · AI

Anthropic 每月要付给 xAI 12.5 亿美元买算力

Anthropic 租下了 xAI 在孟菲斯 Colossus 1 数据中心的全部算力,每月账单 12.5 亿美元,合同签到 2029 年 5 月。头两个月有折扣,因为 xAI 那边还在爬坡。这笔钱来自 SpaceX 的上市文件,xAI 自己说这是在把闲置算力变现。说白了,Grok 用户量最近掉得厉害,服务器空出来了,正好租给竞争对手回血。不过正文没披...

推荐理由:TechCrunch 爆出 Anthropic 每月要给 xAI 付 12.5 亿美元买算力,对手方和价格都挺意外。正文只给了金额,没写买了多少卡、签了多久、跑在什么环境里,所以信息缺口不小。我会先打个折:金额够大,但缺关键细节,没法给到 90 分以上。

彭博科技

Anthropic 快实现首次季度盈利了,靠的是 AI 软件需求拉高收入

彭博这条消息说 Anthropic 正朝着公司第一个盈利的季度迈进,主要驱动力是市场对它的 AI 软件需求猛涨。不过正文被付费墙挡了,没披露具体收入规模、利润区间,也没说是哪个季度。我会先打个折:盈利趋势是真的,但数字和细节都看不到,这点先别太激动。

推荐理由:我会先打个折:正文没给具体数字,营收多少、利润多少、哪个季度都不清楚,所以这条消息更像一个方向性信号,不是实锤。但 Bloomberg 的报道本身有信息量——Anthropic 靠卖 AI 软件把营收拉起来了,可能第一次不亏钱。这对一直烧钱的 AI 实验室来说是个转折点,从业者会盯着后续财报验证。

5月20日星期三

AI 群聊日报

Karpathy 加入 Anthropic 预训练团队,Google I/O 发布 Gemini 3.5 Flash 并给 Vertex AI 改名

今天最炸裂的消息是 Karpathy 宣布加入 Anthropic 预训练团队。群友分析,他先后拒绝回 Tesla 和加入导师的 world model 项目,唯独选了这里,说明大语言模型可能真要有新突破了。另一件大事是 Anthropic 收购 Stainless 后直接关停其托管服务,切断了 OpenAI 的 SDK 同步管道,群友把这叫“基础设施...

推荐理由:这是群聊日报的二手消息汇总,没有给出原始链接、具体任命细节或产品参数。Karpathy 去 Anthropic 这事我会先打个折,等官方确认再激动。Gemini 3.5 Flash 和 100 美元订阅档位正文没披露性能数据和权益清单,只能当个风向标看。整体信息量够上推荐,但可信度和细节都偏弱,所以放在 featured 的低分段。

AI HOT 精选

大模型 API 的补贴期结束了,三家厂商开始涨价

Tomasz Tunguz 对比了 Google、OpenAI 和 Anthropic 三家最新旗舰模型的 API 定价,发现补贴正在退潮。Google Gemini 3.1 Pro 最便宜,输入每百万 token 2 美元、输出 12 美元;OpenAI GPT-5.5 短暂补贴后涨到输入 5 美元、输出 30 美元;Anthropic Claude...

推荐理由:Tom Tunguz 这篇是定价评论,不是模型首发新闻,但三家旗舰模型的价格摆在一起,差距够大,对从业者选型有参考价值。我会先打个折,给 featured 而不是 must-write,因为正文没披露补贴具体怎么算、能撑多久,判断还缺一手数据。

AI HOT 精选

Anthropic 找宗教和哲学学者聊 AI 的道德养成,并给 Claude 加了个“良心提醒”工具

Anthropic 启动了一个对话项目,跟超过 15 种宗教、哲学和跨文化传统的学者、神职人员聊前沿 AI 的道德问题。他们不是要让模型信某个教,而是想借鉴这些领域里关于“好品格是怎么养成的”长期思考,来改进 Claude 的宪法和训练方式。一个直接产出是:他们给 Claude 装了一个能在任务中途主动调用的工具,用来提醒它自己的伦理承诺。内部测试里,...

推荐理由:Anthropic 这次没发模型,而是拉了一群宗教、哲学和跨文化传统的学者来讨论前沿 AI 该有什么价值观,同时测了一个伦理承诺提醒工具,看能不能让 Claude 少跑偏。我会先打个折:正文没披露这个工具到底降低了多少不对齐行为,也没说对 Claude 产品本身有什么改动,所以效果还看不清。但选题本身挺刁钻,不是那种换个说法重讲安全的稿子,对从业者来说能戳中价值观和边界感的神经。

FT · 科技

Google 要出智能眼镜,还会在搜索引擎里塞进 AI 代理

Google 准备发布智能眼镜,同时给搜索引擎加上 AI 代理功能。CEO Sundar Pichai 说这些功能靠新的 Gemini 模型驱动,目标是缩小跟 Anthropic 和 OpenAI 的差距。不过这篇付费墙后面的正文没披露具体规格、上市时间和价格,所以眼镜长什么样、卖多少钱、什么时候能买到,现在都还不知道。

推荐理由:我会先打个折:正文没披露参数、时间表和价格,所以没法判断落地有多快。但 Google 把 Gemini agent 塞进搜索,再配上智能眼镜,等于在用户每天用的入口上同时推两个 AI 触点。Pichai 自己说新功能要缩小跟 Anthropic、OpenAI 的差距,这话本身就说明他们承认落后,也在用产品动作追。对从业者来说,看点不是技术多新,而是 Google 怎么用分发优势把 agent 推到普通人面前。这点先别太激动,等具体上线和实测再说。

彭博科技

Anthropic 的 Mythos 模型让美国监管机构暂停了对大银行的部分网络安全检查

美国金融监管机构推迟了对几家最大银行的部分网络安全相关检查,原因是 Anthropic 新发布的 Mythos 模型暴露了新的风险。我会先打个折:正文被 Bloomberg 的付费墙挡住了,具体检查范围、暂停多久、涉及哪些银行,以及 Mythos 模型到底在技术上展示了什么新能力,这些关键信息目前都没披露。

推荐理由:我会先打个折:正文只说了暂停检查这个动作,没披露 Mythos 到底在测试里暴露了什么、影响了哪些银行、暂停多久。所以冲击力有,但信息缺口也大。对从业者来说,这至少说明前沿模型的安全评估结果,已经开始直接左右金融监管的实操了,这点值得盯着后续。

The Verge · AI

Google 想用 CodeMender 跟 Anthropic 的 Claude Mythos 抢安全赛道

Google 在 I/O 上把去年 10 月亮相的代码安全工具 CodeMender 的 API 开放给一批专家测试,定位是“能自己发现漏洞并修好”的 AI agent。DeepMind CTO 说目标是帮全球代码库做安全加固。文章拿它跟 Anthropic 突然发布的 Claude Mythos Preview 对比,但正文没披露 CodeMende...

推荐理由:HKR 三项都踩中了,但正文只确认了封闭内测和标记修复机制,开放时间、价格、评测结果全都没披露,所以先放在 featured 这一档。

5月19日星期二

AI HOT 精选

Andrej Karpathy 加入 Anthropic,马斯克也公开点赞

Andrej Karpathy 已经加入 Anthropic,连马斯克都公开夸了这家公司。帖子没写 Andrej 具体担任什么职位、什么时候入职,也没提 Anthropic 在 Google I/O 上到底发布了什么,只知道他们今天在大会上存在感很强。

推荐理由:我会先打个折:这条消息有热度,但信息量很薄。Andrej 去 Anthropic 是事实,马斯克点赞是花边,正文没披露他到底做什么、什么时候入职、带不带团队。对从业者来说,知道风向就够了,但别指望从这里读出战略。所以给 featured 而不是 p1,因为缺关键信息,没法做更深的判断。

TechCrunch · AI

Andrej Karpathy 加入 Anthropic,负责 Claude 的预训练

Karpathy 这周已经入职,在 Nick Joseph 的团队做预训练——就是那种烧钱烧算力的大规模训练,用来给 Claude 打知识基础和核心能力。他之前在 OpenAI 是联合创始人,也管过特斯拉的 AI。目前公告没提他的具体职位、汇报线和合同细节,只说了他会在 X 上发帖表示看好接下来几年大模型前沿的研发。

推荐理由:HKR 三项全中:Karpathy 的 OpenAI 身份、Anthropic 预训练岗位、Claude 级别的大规模训练工作,让这条消息成了当天的人才战争故事。不过正文没披露职级、汇报线和加入时间,这些信息缺口我先标出来,别把这条当成全面的人事变动分析。

AI HOT 精选

Andrej Karpathy 加入 Anthropic,没回 OpenAI

Andrej Karpathy 在 X 上宣布自己加入了 Anthropic,要重新做前沿大模型研究。他之前是 OpenAI 早期核心成员,也主导过特斯拉 Autopilot,2024 年彻底离开 OpenAI 后去做了 AI 教育创业项目 Eureka Labs。这次选 Anthropic 而不是老东家,对 OpenAI 来说算是一次明显的人才流失。...

推荐理由:Karpathy 加入 Anthropic 是前沿实验室一次高信号的人事变动。正文只确认了他入职,没写团队、职级和研究方向,信息缺口明显,所以分数卡在 85 这一档的低位。我会先打个折:别脑补他具体在做什么,但光凭他选 Anthropic 而不是回 OpenAI,就够圈内讨论一阵了。

Hacker News 首页

Andrej Karpathy 加入 Anthropic

Karpathy 自己在 X 上发了这个消息,但正文没披露他具体担任什么职位、进哪个团队、什么时候入职。目前只有一条推文链接和 Hacker News 上的讨论,46 个赞、3 条评论,信息量很少。

推荐理由:Karpathy 去 Anthropic 这件事本身是个信号,说明顶尖研究员在 OpenAI、特斯拉之后选了 Claude 这条线。但正文除了一个 X 链接和 HN 上 46 分、3 条评论,什么都没展开——没职位、没团队、没时间,连他负责什么方向都只能靠猜。我会先打个折:热度够,但信息太薄,重要性给到 82 是合理的,别因为名字就往上拔。

AI HOT 精选

Karpathy 加入 Anthropic,具体职位和负责方向还没说

Anthropic 官方账号发了一条“欢迎加入团队,Andrej!”,确认 Andrej Karpathy 已入职。正文没披露他的角色、职责、入职时间或所属团队,目前只有这一句官宣。

推荐理由:我会先打个折:正文只有一句“欢迎加入团队”,没写职位、没写职责、没写入职时间,信息量很薄。但 Karpathy 这个名字加上 Anthropic 这个标的,在人才争夺和前沿研究两条线上都够分量,所以 H 和 R 都拉满了。K 这边只有一条硬事实,缺太多关键细节,没法给更高。