跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 161–180 条 · 共 1,303 条

9月15日星期二

TechCrunch · AI

OpenAI、Anthropic、Google 已就 AI 安全私下谈了几周,但还没拿出具体方案

OpenAI 全球政策负责人 Chris Lehane 周二对记者说,公司已与 Anthropic 和 Google DeepMind 就 AI 安全问题沟通了数周。他本人正在华盛顿游说议员关注灾难性风险。这轮接触的背景是 Anthropic CEO Dario Amodei 上周六发了篇文章,呼吁行业一起放慢前沿模型的研发节奏。不过,目前公开的信息里...

推荐理由:三家顶级实验室私下聊安全,这件事本身信号很强,HKR 三个维度都踩中了。分数卡在 82 分,因为正文只确认了有沟通和 Lehane 在游说,但具体聊了什么、聊得多深、有没有初步共识,一概没提,信息量撑不起 85 分以上的段位。

Hacker News 首页

AI 正在打碎我们判断专业能力的旧标尺

近五千名数学家联名发声明,不是反 AI,而是指出一个具体问题:数学界一直用“解出难题”作为衡量学术贡献的代理指标,但现在的 AI 能跳过概念创新、直接用蛮力啃下这些难题,把名声拿走,却没留下人能理解的新想法。作者把数学拆成两块:一是外人看得懂的“解题”,二是真正核心的“造概念”。AI 证明破坏了这两层关系——解题不再能间接奖励造概念的人,就像古德哈特定...

推荐理由:近五千名数学家联名声明,不是反 AI,而是指出一个具体 bug:数学界一直用“解出难题”当硬通货,来间接奖励那些真正造概念、开新方向的人。现在 AI 能跳过概念创新,直接用算力啃下难题,把名声拿走,却没留下人能理解的新想法。文章用古德哈特定律把这个机制讲透了——当一个指标变成目标,它就不再是好指标。我会先打个折,正文没给出联名声明的具体名称或链接,但逻辑链条本身站得住,对从业者来说是个值得提前想一想的信号。

Hacker News 首页

Anthropic 联合创始人:AI 可能需要强制安装“紧急停止开关”

Anthropic 联合创始人 Jack Clark 对 BBC 说,社会最终可能需要立法,强制 AI 公司安装一个可被第三方验证的“紧急停止开关”。他说多数实验室(包括 Anthropic)现在都有办法拔掉电源,但应该让这成为硬性要求。同一篇报道里,Anthropic 科学家 Evan Hubinger 个人认为 AI 在十年内导致人类灭绝的概率超过...

推荐理由:Anthropic 联合创始人通过 BBC 公开呼吁立法强制安装可验证的 AI 紧急停止开关,同篇报道还披露了内部科学家对灭绝风险的个人估计。跨源验证确认了这条政策信号,不是孤例。分数没给更高,是因为目前只有标题和摘要细节,正文没展开具体技术方案和立法路径。

AI HOT 精选

Anthropic 和 OpenAI 提议联手放慢前沿 AI 研发,Cohere CEO 直指这是“披着羊皮的垄断联盟”

Anthropic 的 CEO Dario Amodei 最近呼吁政府出面协调,让行业放慢最前沿 AI 模型的研发速度,并为此申请反垄断豁免,Sam Altman 和 Elon Musk 都表示赞同。Cohere 的 CEO Aidan Gomez 发博客反驳,说这套方案会通过极高的算力、监控和合规门槛把竞争对手挡在门外,本质是“披着羊皮的垄断联盟”。...

推荐理由:Anthropic 和 OpenAI 联手提议放慢前沿研发,Cohere 老板公开怼回去说这是垄断玩法,三家头部公司正面冲突,信号很强。因为目前只有标题和摘要,完整提案细节还没看到,分数先压在 85 以下。

AI 群聊日报

空仓库让 Astra 写代码翻车,喂了 code review 经验后质量飞升

今天最直观的教训来自 @搞仁义毛义仁:给 Astra 一个空白 C++ 仓库,代码写得一塌糊涂;把积累了大量 code review 经验的 GacUI 上下文导进去,质量立刻飙升。这说明模型不是不会写,是得用具体规则去“规训”。@今天群内信息量极大 实测了 Ollama Cloud 跑 DeepSeek V4.1 Flash,解码吞吐是官方 API ...

推荐理由:今天群聊里两条实操经验比大多数论文都实在。第一条来自 @搞仁义毛义仁:用 Astra 写 C++,给个空仓库代码质量很差,但把积累了多年 code review 规则的 GacUI 上下文喂进去,质量立刻上来了。这说明模型不是不会写,是得用具体、有约束的规则去“规训”,光靠模型自己发挥不行。第二条是 @今天群内信息量极大 实测 Ollama Cloud 跑 DeepSeek V4.1 Flash,解码吞吐比官方 API 高出一截,但正文没披露具体延迟和成本数字,所以这个“快”到底在什么条件下成立、性价比如何,还得自己测了才知道。两条都指向同一个方向...

纽约时报中文网

Anthropic 老板喊停 AI 军备竞赛,但中国让这事几乎没戏

Anthropic 的 CEO 达里奥·阿莫迪发了一篇文章,直接呼吁给最前沿的 AI 能力踩刹车。他担心未来 6 到 12 个月内,成群的 AI 智能体可能具备“接管整个互联网”的能力。他提出的第一步是把外部安全专家请进实验室常驻,盯着安全流程并向公众汇报。奥特曼、马斯克和哈萨比斯都公开点赞,奥特曼还说 OpenAI 会照做。但作者 Sebastian...

推荐理由:Anthropic CEO 直接喊刹车,加上奥特曼、马斯克、哈萨比斯三人公开背书,信号强度很高。阿莫迪给出了 6-12 个月的“接管互联网”时间线和驻场安全专家的具体方案,不是空泛表态。扣分点在于:这是一篇评论文章,不是政策公告,实际约束力有限;作者 Sebastian 把焦点转向中国,但正文没披露中国方面的具体回应或数据,更多是抛出一个地缘政治疑问。我会先打个折,但整体仍然值得从业者关注。

Latent Space

第三方评估标准 AEF-1 出炉,xAI、OpenAI、Anthropic 都签了,Dario 还承诺给评估员发工牌

AI 评估论坛发布了 AEF-1 标准,给独立第三方评估立了规矩,包括访问权限、利益冲突、资金来源、回避和透明度怎么处理。同一天,Dario Amodei 发了篇个人博客,说 Anthropic 会单方面先干起来:让评估团队像员工一样进驻办公室,拿公司工牌、用公司电脑,权限跟内部风险团队差不多。他还提了个两层协调框架,一层是民主国家内部定规矩,一层是跟...

推荐理由:我会先打个折:正文没披露具体有多少家机构签了,也没说执行机制和违规后果,所以别当它已经落地。但同一天 AEF-1 发布、Dario Amodei 发博客,三家公司一起站台,这个时间点本身就说明行业在抢着给第三方评估定规矩。AEF-1 把利益冲突、资金来源这些容易和稀泥的地方写得很具体,Amodei 又提出让评估员像员工一样进驻,权限跟内部风险团队差不多,等于把透明度的门槛拉高了一大截。对从业者来说,这就是一份现成的 checklist,可以拿来比对自己的评估流程缺了什么。

纽约时报中文网

特朗普把 AI 安全警告叫“骗局”,明确说不会加新监管

特朗普在社交媒体上直接驳回了 Anthropic 等公司对 AI 风险的警告,称安全担忧是“骗局”,唯一需要的护栏是“一位强大且聪明的总统”。他点名 Anthropic 的 CEO 达里奥·阿莫迪,说他“假装是个完美的小天使”,但正文没具体说特朗普认为自己阻止了哪些政府行动。副总统万斯和众议长约翰逊的态度稍微开放一些,万斯觉得行业主动求监管“有点像特洛...

推荐理由:总统亲自点名 Anthropic 的 CEO,把 AI 安全直接定性为“骗局”,这是对行业核心叙事的正面攻击。H、K、R 三项全中:冲突烈度高,白宫内部权力温差被首次挑明,从业者的身份认同被直接冒犯。正文没披露特朗普具体阻止了哪些政府行动,信息有缺口,所以分数压在 85 以下。

纽约时报中文网

国安部长陈一新发文,把AI定性为可能直接威胁中共执政,点名美国模型

国安部部长陈一新在《中国网信》发了一篇长文,把AI风险直接拉到政治安全层面。他点名了Claude Mythos和GPT-5.5-Cyber这类美国模型,说它们可能被用来搞深度伪造、发动舆论战、偷数据,甚至攻击关键基础设施。文章还拿美军在伊朗战争里用AI举例,说算法优势决定战场主动权。新加坡教授高树超解读,这等于在中美AI安全谈判前划了红线:数据主权和政...

推荐理由:国安部长陈一新在《中国网信》发长文,把AI风险直接拉到政治安全层面,点名Claude Mythos和GPT-5.5-Cyber可能被用来搞深度伪造、发动舆论战、偷数据甚至攻击关键基础设施。文章还拿美军在伊朗战争里用AI举例,说算法优势决定战场主动权。新加坡教授高树超解读,这等于在中美AI安全谈判前划了红线:数据主权和政治安全没得商量。我会先打个折——文章没给出这些模型被实际用于攻击的证据,更多是战略喊话。但部长亲自下场、点名具体模型,这个信号本身就很重,从业者得知道自己的技术已经被放在这个框架里审视了。

AI HOT 精选

Anthropic 重写了测试影响分析服务,因为 Claude Code 这类 AI 编程工具把 CI 系统快冲垮了

Anthropic 内部用 Claude Code 写代码后,PR 数量暴增,CI 流水线被大量提交淹没。他们干脆重写了测试影响分析服务,核心思路是用 Merkle 树给文件依赖关系做缓存,只跑真正受影响的测试。效果很直接:单次分析延迟从 11 秒降到不到 1 秒,每天能处理 1000 次分析。这是他们内部单一代码仓库的配置,直接搬到别的项目不一定行,...

推荐理由:Anthropic 自己工程博客放出来的东西,有真实数字和具体技术方案,不是公关稿。11 秒到不到 1 秒的延迟压缩很扎实,但话题偏基础设施,非编码向的读者不太会点,所以放在 72 分 featured 档位。

AI HOT 精选

Amodei 发文呼吁放慢前沿 AI 研发,Altman、Hassabis、Nadella 几小时内接连表态同意

Anthropic 的 Dario Amodei 发了篇近 4000 字的文章,核心就一句话:前沿模型的能力提升速度必须降下来,不然商业竞争会把灾难性风险推得更猛。几个小时后,Sam Altman、Demis Hassabis 和 Satya Nadella 都公开表示赞同。Ars Technica 提醒,这帮人过去几年一直在搞 AGI 军备竞赛,现在...

推荐理由:Amodei 这篇近 4000 字的文章直接呼吁放缓前沿 AI 开发,把商业竞争定性为灾难性风险的核心驱动力。几小时内 Altman、Hassabis、Nadella 相继公开赞同,形成了一次罕见的行业头部共识转向。Ars Technica 提醒这些人过去几年一直在搞军备竞赛,现在集体喊停的反差让这条消息更有分量。对从业者来说,这不只是新闻,是直接关系到日常决策的信号。

9月14日星期一

Hacker News 首页

Anthropic 跟投资人说自己连续两个季度赚钱了

Anthropic 对投资人表示,公司已经连续两个季度实现盈利。在烧钱如流水的 AI 模型公司里,能靠现金流养活自己算是个稀罕信号。不过目前只有标题,正文没披露具体营收、利润数字,也没说成本结构,所以先别太激动,等看到财报再下判断。

推荐理由:Anthropic 连续盈利对行业是个信号,但正文只有标题,没给任何具体数字。H 和 R 都成立,K 因为信息缺失不成立。按 featured 门槛给 78 分,等财报细节出来可以再往上调。

AI HOT 精选

Anthropic 准备在纳斯达克上市,用连续两个季度“调整后盈利”冲刺 2 万亿美元估值

Anthropic 告诉投资人自己连续第二个季度赚钱了,但这个“盈利”是调整后的数字,没算股权激励这类成本。毛利率号称超过 80%,不过这个数是在跟亚马逊等伙伴分账、以及花大钱训练模型之前算出来的。季度收入同比翻了 14 倍,达到 115 亿美元,7 月底的年化收入跑到了 650 亿美元。有分析师说,投资人预期年底年化收入能到 1200 亿,2027 ...

推荐理由:Anthropic 瞄准纳斯达克,带着连续第二个季度调整后盈利、115 亿美元季度收入、650 亿美元年化跑速和 2 万亿估值目标。三个维度都打中了:标题抓人,数字够硬,话题跟从业者钱包直接相关。没给更高分是因为盈利是调整后的,毛利率也没算分账和训练成本,实际财务健康度还得等招股书出来再看。

Hacker News 首页

iOS 27 代码暗示 Siri 的后台 AI 可以换成 ChatGPT 或 Claude

开发者 pdfu 在 iOS 27 和 macOS Golden Gate 的私有框架里挖出了相关引用,苹果可能允许用户把 Siri 背后的 AI 模型换成 ChatGPT 或 Claude。目前还不清楚这个切换是系统级的,还是只针对某些特定功能,也没有任何发布时间。代码里出现不代表一定会实装,但方向很明确:苹果正在系统底层给第三方模型留接口。

推荐理由:代码证据很实在,方向信号也强,但正文没披露发布时间和具体功能范围,目前只是底层留了接口。我会先打个折,给 72 分放在 featured 档;等苹果正式官宣再往上调。

Hacker News 首页

四大 AI 巨头联手推监管框架,The Register 直指这是“监管俘获”

Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman、微软的 Satya Nadella 和 Elon Musk 罕见地共同提出了一套叫“Pace the frontier”的监管方案。这套方案只盯着他们口中“最前沿的模型”管,小公司和开源项目完全不受影响。The Register 直接点破:这就是典型的监管俘获——...

推荐理由:四家大厂罕见联名推监管方案,被 The Register 点名是监管俘获。提案只卡前沿模型、放生小玩家和开源,护城河画得太明显。目前只有一家媒体深挖,分数先压在 85 以下,后续如果有更多信源跟进再往上调。

纽约时报中文网

Anthropic 老板发长文,呼吁全球给 AI 模型迭代踩刹车

Anthropic 的 CEO 达里奥·阿莫迪发了篇 3800 词的文章,直接说现在 AI 模型能力跑太快,安全措施根本追不上。他担心模型会“递归自我改进”,也就是自己学会进化,最后失控。他提议让第三方审计员进驻公司查安全标准,还喊话民主国家一起定规矩。OpenAI 的奥尔特曼、谷歌 DeepMind 的哈萨比斯和马斯克都公开表示同意。不过英伟达的黄仁...

推荐理由:Anthropic 的 CEO 发了篇 3800 词的文章,核心就一句话:AI 现在进化太快,安全措施根本追不上。他担心模型会“递归自我改进”,也就是自己学会进化,最后失控。他提了两个具体办法,一是让第三方审计员进驻公司查安全标准,二是喊话民主国家一起定规矩。OpenAI 的奥尔特曼、谷歌 DeepMind 的哈萨比斯和马斯克都公开表示同意,这种头部玩家集体喊慢的情况很少见。不过文章里没给出具体的时间表或技术验证手段,更像是一次立场表态。英伟达的黄仁勋那边信息被截断了,正文没披露他的完整回应,这点先别急着下判断。

Computing Life · Share · 鸭哥调研

谁在改尺子:AI 榜单的两重张力

OpenAI 发布 GPT-6 Astra 后,评测机构 Artificial Analysis 一周内两次修改评分规则,让 Astra 从落后 5 分变成与 Claude Fable 5.1 并列第一,模型本身没动过。榜单是门生意:评测方卖高价订阅需要大厂背书,厂商需要排名做营销,双方利益绑在一起。DeepSeek V4 Flash 只重训了后训练阶...

推荐理由:这篇评论用一件具体的事——Artificial Analysis 在 GPT-6 Astra 发布后一周内两次改评分规则,让排名从落后 5 分翻成并列第一——把 AI 榜单的商业逻辑讲透了。有版本号、有分数、有权重变化,信息扎实。对从业者来说,它不是在复述新闻,而是在提醒:你花钱订阅的排行榜,尺子可能随时跟着大厂的新模型重画。我会给高分,因为这种“拆台”视角比单纯报分数更有价值。

AI HOT 精选

Amodei 呼吁行业“放慢脚步”,但没人说清楚到底要多慢

Amodei 九月的文章提议给前沿模型踩刹车,但通篇没给出一个具体速度。Tunguz 把回应分成了五派:可解释性派想争取时间搞懂模型内部原理,劳工派想给工人留出适应窗口,经济派指望 AI 拉动 GDP 来还债,地缘政治派要维持对中国的领先,监管俘获派则直接说这提案就是披着安全外衣的垄断同盟。每一派都算了暂停的代价,但没人报出一个数字。唯一能产生数字的机...

推荐理由:Tunguz 这篇不是一手新闻,是评论综述,也没有新数字,但五派框架干净,把 Amodei 原文里没明说的利益格局摊开了。用 2023 年算力门槛的失败当锚点,让讨论不至于飘在口号上。78 分放在 featured 低位合适——值得推给关注治理的人看,但别当硬新闻用。

彭博科技

Anthropic 跟 FT 说本季预计能实现调整后营业利润,收入约 30 亿美元

Anthropic 告诉《金融时报》,本季度预计会交出调整后营业利润,收入大约 30 亿美元,是去年同期的三倍左右。这个“调整后”扣掉了股权激励等非现金支出,不是按通用会计准则算的净利润,所以别直接当纯利看。收入涨得猛,说明企业客户还在持续买单,但正文没披露毛利率、研发和推理成本怎么分摊,也没说现金流有没有转正。

推荐理由:Anthropic 首次声称调整后营业利润,季度收入约 30 亿美元、同比约三倍,标志着从烧钱叙事转向商业验证。分数没给更高,因为“调整后”剔除了股权激励,正文也没披露毛利率和现金流状况,盈利成色还得打个折。

Hacker News 首页

Claude Fable 5.1 破解了 370 年前的 Cyphral Distich 密码

Vals 团队让 Claude Fable 5.1 去解一个 370 年没人解开的密码,模型花了 44 分钟、用了 17.6 万个 token 就搞定了。关键发现是:密码本不在外面,就在书里。那 64 个数字不是对应外部字母表,而是指向书中 32 段“Proquiritations”里的第几个词,取首字母拼出来就是“O GOD UPHOLD KING ...

推荐理由:这事本身够硬——370 年没解开的密码被一个模型在不到一小时搞定,而且推理路径公开了,不是黑箱猜答案。标题自带传播力,技术细节也够从业者拆解。扣分点在于:这是 Vals 的博客,不是 Anthropic 官方发布;密码学加 AI 的交叉领域偏窄。分数打在 78-84 这个区间的低位,78 分合理。