跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 901–920 条 · 共 1,303 条

5月30日星期六

彭博科技

彭博称 Anthropic 估值冲到 9650 亿美元,超过了 OpenAI

彭博这条视频标题直接说 Anthropic 估值达到 9650 亿美元,并且超过了 OpenAI。但正文没披露这个估值是怎么算出来的、来自哪一轮融资、有没有附带对赌条款,也没说用来对比的 OpenAI 估值是哪个时间点的数字。所以这个“超过”暂时只能当个标题看,具体含金量还得等更完整的交易信息。

推荐理由:我会先打个折:标题里的 9650 亿美元估值很抓眼球,但正文实际上是个视频壳,没交代这个数字从哪来、是哪一轮、条款怎么定的,也没说跟 OpenAI 比的是什么口径。所以这条消息更像一个资本信号,而不是一份能核实的估值报告。对从业者来说,知道市场在给 Anthropic 标高价就够了,具体数字先别太激动。

彭博科技

Anthropic 拿了 650 亿美元,估值冲到 9650 亿,头一回超过 OpenAI

Anthropic 刚完成一轮 650 亿美元的融资,投后估值 9650 亿美元,数字上首次压过 OpenAI。领投方是 Altimeter Capital、Dragoneer、Greenoaks 和红杉资本,每家掏了超过 20 亿美元。这笔钱怎么花、用在哪些产品线上,正文没细说。估值涨得猛,但还没看到对应的收入或市场份额数据,这点先别太激动。

推荐理由:Bloomberg 报道 Anthropic 拿了 650 亿,估值冲到 9650 亿,领投方也点名了。如果这轮真关账,就是基础模型公司里最顶级的资本事件。标题、事实和情绪三个维度都拉满,放在 95 分以上没毛病。

5月29日星期五

纽约时报中文网

Anthropic 估值冲到 9000 亿美元,把 OpenAI 挤下最贵 AI 初创公司位置

Anthropic 刚拿了 650 亿美元新融资,投前估值 9000 亿美元,超过了 OpenAI 上一轮的 7300 亿。公司同时发了新旗舰模型 Claude Opus 4.8,在 Vals AI 的 vibe coding(用口语化指令写代码)基准上比自家前代高了 10%。Anthropic 说它的年化收入运转率已经突破 470 亿美元,主要靠 C...

推荐理由:Anthropic 靠 650 亿美元融资把投前估值推到 9000 亿,压过 OpenAI,这是基础模型市场格局的一次实打实变动。Opus 4.8 在 Vals AI 氛围编程基准上比前代提了 10%,正文没展开具体测试条件和误差范围,这点先别太激动,但至少说明模型在代码场景还在往上走。HKR 三项全中,NYT 信源也撑得住,放 p1 没问题。

新智元 · 公众号

Claude Opus 4.8 实测:高级工程师基准冲到 63 分,但高强度任务掉到 42 分,Max 用户几小时就撞速率墙

这篇来自新智元的实测文章目前页面被微信环境验证挡住了,正文内容没抓到。从标题和摘要信息看,Claude Opus 4.8 在 Extra-High 级别的高级工程师基准测试里拿了 63 分,比上一代 Opus 4.7 高出 30 分,这个涨幅挺夸张。但切换到 High 强度任务时分数掉到 42 分,说明模型在持续高压场景下稳定性还有问题。另外,每月 2...

推荐理由:Anthropic/Claude 相关度天然高,加上有实测跑分和配额吐槽,HKR 三项都站得住。钩子是强但贵且 High 档拉胯,K 有基准分和额度细节,R 直接戳中 Agent 场景下的成本焦虑。来源是媒体评测而非官方公告,所以定在 P1 低位。

机器之心 · 公众号

Meta 烧了 1830 亿 token,把 26 本数学教材翻译成了机器可验证的 Lean 代码库

Meta 放出了一个叫 ATLAS 的数学形式化库,用 Lean 4 语言把 26 本数学教材里的定义和证明搬了进去。整个工程消耗了 1830.57 亿个 token,生成了约 63 万行代码,包含 46203 条声明。其中 42837 个证明已经跑通,证明通过率 92.7%。说白了就是让 AI 把教科书上的数学推理,转成机器能严格检查的代码,以后训练...

推荐理由:HKR三项都站得住:token量、Lean库规模和已验证证明数都是硬数字。没给P1是因为这还是个偏专的研究开源发布,不是通用模型或产品级发布。

机器之心 · 公众号

马嘉祺让大模型翻车,背后是低频词退化问题,有人一年前洗澡时就发现了

文章页面被微信环境验证挡住了,正文内容没拿到。从现有标题和英文摘要看,讲的是 FaceMind 团队把大模型在“马嘉祺”这类低频词上翻车的现象,和两篇论文串了起来:一篇是 EMNLP 2025 的 SLoW,另一篇是刚被 ACL 2026 接收为 Oral 的 Adam's Law。摘要里还提到一个具体数字——用高频词改写的方法,把 DeepSeek-...

推荐理由:这篇文章把马嘉祺让大模型翻车这个意外事件,和低频 token 退化这个技术问题绑在一起讲,切入点很巧。它不光讲现象,还给出了两篇顶会论文的机制解释,以及 DeepSeek-V3 上 8 个百分点的准确率提升,对做模型评测和提示工程的人有直接参考价值。不是大模型发布那种重磅消息,但属于扎实的研究信号,值得放进精选。

Latent Space

Anthropic 完成 650 亿美元 H 轮融资,估值冲到 9650 亿,同时发布 Opus 4.8 和动态工作流

Anthropic 今天放出了两个大消息。钱这边,他们完成了 650 亿美元的 H 轮融资,投后估值达到 9650 亿美元,领投方是 Altimeter、Dragoneer、Greenoaks 和 Sequoia。公司还首次披露年化收入已经超过 470 亿美元,这个数字去年 12 月才 90 亿,增速很猛。产品这边,他们发了 Claude Opus 4...

推荐理由:HKR 三项全中:这条把前沿实验室的巨额融资、新模型和代码工作流更新打包在一起。我按摘要里的 650 亿美元融资和 9650 亿美元估值来算,因为标题里的数字和正文对不上。

Computing Life · Share · 鸭哥调研

Claude Code 动态工作流:把确定性边界画在了控制流、执行和验证之间

Anthropic 给 Claude Code 加了个动态工作流功能,本质是用一段 JS 脚本接管控制流,让脚本决定先做什么、后做什么、什么时候并行,但具体干活还是交给多个子 agent 各自在自己的上下文窗口里跑。这么设计是因为 agent 跑久了会忘事、自己验自己也不靠谱,所以把不会忘的控制流交给代码,把需要灵活探索的执行交给 agent,把验证拆...

推荐理由:这篇文章不是 Anthropic 官方发布,也没有实验数据,但它的价值在于把 Claude Code 动态工作流里“哪里该写死、哪里可以放手让模型跑”这个边界问题讲透了。三层机制拆得干净,对正在踩坑的从业者来说,比泛泛讲 agent 靠谱多了。我会先打个折,因为正文没披露具体验证指标,判断更多是架构层面的分析,所以放在 featured 里偏中上的位置。

FT · 科技

Anthropic 敲定 650 亿美元融资,估值超过 OpenAI

Anthropic 完成了新一轮 650 亿美元的融资,把公司估值推到了 9650 亿美元(含新到账的钱),这个数字已经超过了 OpenAI 的估值。不过这篇报道正文被付费墙挡住了,具体是哪些投资人、钱会怎么花、以及估值是怎么算出来的,正文都没披露。

推荐理由:这条消息分量很足。Anthropic 敲定 650 亿美元融资,投后估值 9650 亿,直接超过了 OpenAI 的估值,等于在资本层面完成了一次反超。我会先打个折:正文没披露具体投资方和资金用途细节,但光这个数字就说明市场对 Claude 这条路线下了重注。对从业者来说,这意味着算力军备竞赛还会升级,模型层的竞争远没到定型的时候。

彭博科技

Apollo 正为 Anthropic 拉一笔 360 亿美元贷款,用来买谷歌芯片

Apollo 和 Blackstone 在找其他投资人一起凑约 360 亿美元的债务融资,给 Anthropic 建 AI 基础设施。标题说这笔钱会用来买谷歌的芯片,但正文因为 Bloomberg 的反爬墙没抓到,具体买什么型号、多少量、什么时候交付都没披露。我会先打个折:360 亿这个数字很大,但它是债务融资不是纯股权,结构上可能带杠杆,实际落到芯片...

推荐理由:Bloomberg 这条消息把三件事串起来了:Anthropic 要算力、Apollo 和 Blackstone 出钱、钱指定买 Google 芯片。360 亿这个数字很大,但正文没写具体买什么芯片、分几年执行,所以我会先打个折——这更像是一个融资框架,不是已落地的采购单。对从业者来说,看点在于:一,AI 实验室开始用债务而不是股权来扛算力成本,杠杆风险怎么算;二,Google 芯片在这个单子里替代了 NVIDIA 的位置,如果属实,对供应链是个信号。标题里的“购买 Google 芯片”是钩子,但信息缺口也很明显,别急着当定论。

彭博科技

Anthropic 拿了 650 亿美元,估值冲到 9650 亿,头一回比 OpenAI 还贵

Bloomberg 的视频消息说,Anthropic 刚完成一轮 650 亿美元的融资,投后估值 9650 亿美元,首次在估值上超过了 OpenAI。不过正文被 Bloomberg 的反爬机制挡住了,具体投资人、资金用途和估值计算方式都没披露。我会先打个折:9650 亿这个数字高得离谱,比很多科技巨头的市值都大,在没有看到完整条款和收入数据前,这点先别...

推荐理由:这条消息分量很重,但我会先打个折。650 亿美元融资和 9650 亿美元估值这两个数字确实能重新排定前沿 AI 公司的资本座次,标题里“超越 OpenAI”的说法也直接改写了双方较量的故事线。不过正文没披露投资方是谁、条款怎么签,也没说钱具体砸向算力还是收购,所以暂时不能给到顶格判断。如果是真的,这轮融资会让 Anthropic 在抢人和堆算力时手头宽裕很多,但没看到资金结构之前,先别太激动。

FT · 科技

马斯克一条推文,让 SpaceX 对 Anthropic 数据中心交易的描述站不住脚了

SpaceX 在 IPO 文件里说跟 Anthropic 签的是三年数据中心租约,但马斯克自己在 X 上发帖说这单生意只持续 180 天。两边说法直接打架,正文没披露合同具体条款,所以不知道是 IPO 文件在画饼,还是马斯克随口一说。

推荐理由:HKR 三项都成立:英国《金融时报》挖出一个具体矛盾——马斯克公开说 SpaceX 与 Anthropic 的数据中心合作只有 180 天,但 SpaceX 在 IPO 申报材料里把它描述成三年协议。这不是模型发布或产品更新,而是基础设施层面的合同可信度问题,对关注算力供应和行业八卦的从业者有直接信息增量。

AI HOT 精选

Anthropic 拿了 650 亿美元,估值冲到 9650 亿,说这可能是上市前最后一次私募

Anthropic 刚完成 H 轮融资,融了 650 亿美元,投后估值 9650 亿美元。公司放风说这大概率是 IPO 前最后一轮私募了。正文没披露具体投资方和资金用途,也没提这轮估值比上一轮涨了多少。9650 亿这个数字先别太激动——一级市场估值和二级市场定价是两回事,得等招股书出来才能看到真实财务底子。

推荐理由:Anthropic 这轮 650 亿美元的融资和 9650 亿的估值,已经接近基础模型公司 IPO 的量级了。正文没披露具体投资方和运营指标,所以还没到 95 分以上的绝对重磅。我会先打个折,但这个消息本身对行业资金流向的判断很有用。

彭博科技

Anthropic 估值冲到 9650 亿美元,首次压过 OpenAI

Anthropic 刚完成一轮 650 亿美元融资,投后估值 9650 亿美元,数字上超过了 OpenAI。Bloomberg 这篇报道没披露具体投资人、交易条款和时间表,所以不知道这轮是谁领投、有没有附带对赌条件。9650 亿这个估值接近万亿,放在 AI 行业里是个很夸张的标价,但正文没解释估值模型怎么算出来的,也没提收入、利润或用户规模来支撑这个数...

推荐理由:Bloomberg 报道 Anthropic 拿了 650 亿美元,估值冲到 9650 亿美元,把 OpenAI 甩在后面。投资方和条款都没披露,但光这个体量就够当天 AI 融资圈的头条了。

Hacker News 首页

Anthropic 完成 650 亿美元 H 轮融资,估值冲到 9650 亿美元

Anthropic 拿了 650 亿美元,领投方是 Altimeter、Dragoneer、Greenoaks 和红杉,投后估值 9650 亿美元。这笔钱主要用来扩算力、做安全研究和把 Claude 塞进更多企业流程里。公司说月经常性收入(run-rate revenue)这个月刚过 470 亿美元,比 2 月份 G 轮时又涨了一截。算力方面,他们跟亚...

推荐理由:Anthropic 这轮 H 轮融了 650 亿美元,投后估值冲到 9650 亿,离万亿美金私人公司只差临门一脚。正文没披露谁投的、钱怎么花、交易有什么附加条款,所以这笔钱是纯股权还是带了其他结构、估值怎么算出来的,都还不清楚。但光这个规模就足以震动整个 AI 行业——它把前沿实验室的烧钱速度和资本期待同时拉到了一个新刻度。

TechCrunch · AI

Anthropic 发了 Opus 4.8,带了个能调度一群子模型干活的动态工作流工具

Opus 4.8 这次配了一个叫 Dynamic Workflows 的工具,核心作用是让一个主模型像工头一样,协调一堆子模型分头执行任务。正文没提价格、上下文窗口多大、跑分成绩,也没说什么时候能用上。

推荐理由:Anthropic 发新模型还配了个管 agent 群的工具,信息量够上当天重要档位。但价格、窗口大小、什么时候能用全都没说,我会先打个折,等这些补上再往上调。

The Verge · AI

Claude Opus 4.8 发布,主打“老实”:不确定时会直说,瞎编的概率降到前代的四分之一

Anthropic 周四放出 Claude Opus 4.8,这次没吹性能天花板,而是强调模型更“诚实”。公司说早期测试者发现它更愿意主动标注自己没把握的地方,而不是硬编一个听起来合理的答案。内部评测给了一个具体数字:Opus 4.8 做出无据论断的概率大约是前代模型的四分之一。不过正文没披露这个评测的具体基准和对比对象,我会先打个折——四倍改善听起来...

推荐理由:我会先打个折:正文只说了“评估中少约 4 倍无依据声明”,但没披露具体用了哪些基准测试、测试规模多大、在什么任务上测的,也没提价格和上下文窗口有没有变。所以这个“4 倍”只能当个方向性信号看,别直接当成绝对指标。不过对从业者来说,模型肯承认自己不确定而不是硬编,本身就是个值得关注的转向,尤其在需要高可靠性的工作流里。整体信息量够上头条,但细节缺口明显,分数给在 85–94 这个区间是合理的。

Hacker News 首页

Claude Code 支持动态工作流,让模型自己决定下一步做什么

Anthropic 给 Claude Code 加上了动态工作流能力,Claude 在写代码时可以自己规划步骤、调用工具,而不是死板地跑预设脚本。博客正文没披露具体的技术实现方式、支持哪些触发条件、会不会增加额外费用,也没说这个功能是默认开启还是需要手动配置。从 Hacker News 上的 70 分和 62 条评论来看,开发者社区关注度不低,但实际效...

推荐理由:这条消息本身信息量很薄,就是 Claude Code 发了一篇讲动态工作流的文章,HN 上讨论热度还行。但 RSS 正文没披露任何机制细节,比如工作流是自动编排还是需要手动配置、支持哪些触发条件、有没有用量限制,这些全不知道。所以我会先打个折,重要性给到 73,放在 featured 低位。好处是标题够直白,目标用户一看就懂,坏处是除了标题和 HN 互动数,没有可验证的事实可以展开。

Hacker News 首页

Anthropic 发布 Claude Opus 4.8,主打代理任务判断力和诚实度,价格不变

Anthropic 推出了 Claude Opus 4.8,直接升级自 4.7,价格没涨。这次的重点不是刷榜,而是让模型在干具体活时更靠谱:多位早期测试者提到它判断力变好,会主动质疑不靠谱的计划、自己揪错,而不是硬着头皮往下编。模型还新增了“诚实”倾向,遇到证据不足时会主动说“不确定”,而不是假装有进展。同时发布的还有几个配套功能:网页版可以控制模型思...

推荐理由:我会先打个折:这条只有标题和 HN 热度,正文没披露任何能力、参数或发布时间,所以别当正式发布来看。但 Claude Opus 4.8 这个名字本身就是信号,Anthropic 的旗舰线更新,从业者一定会盯。HN 139 分、49 条评论说明社区已经在猜了,这种关注度本身就值得推一条。如果是真的,模型选型和工具链可能都要跟着调,这点先别太激动,等官方补信息再说。

5月28日星期四

AI HOT 精选

英伟达开源 Polar 框架,不改代码就能让 Codex 跑分涨近 6 倍

英伟达搞了个叫 Polar 的开源框架,专门解决一个实际问题:怎么在不重写 Codex、Claude Code 这些现成代码工具的前提下,用强化学习(GRPO,一种让模型在多步任务里根据奖励信号自己学会更优操作的训练方法)去训练它们。Polar 的做法很取巧,它不碰工具本身的执行逻辑,而是在模型和工具之间的 API 接口上做文章,把对话记录、采样结果这...

推荐理由:英伟达开源 Polar,用 GRPO 训练小模型 Qwen3.5-4B,Codex 在 SWE-Bench Verified 上从 3.8% 冲到 26.4%,这个提升幅度在代码 agent 圈子里很能打。技术细节和基准分都给得清楚,属于扎实的研究开源项,不是大模型或产品发布,所以放在 featured 档、82 分合理。