跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 141–160 条 · 共 1,303 条

9月17日星期四

彭博科技

美国 AI 公司推动模型出口管制,中国 AI 股抛售加剧

Anthropic 和 Google 正在游说美国政府,想把 AI 模型权重(也就是模型的核心参数文件)也纳入对华出口管制。这事如果落地,中国公司想用 Claude、Gemini 这类前沿模型的门槛会大幅提高。消息一出,本来就在跌的中国 AI 股又挨了一拳——商汤和百度继续下探,恒生科技指数从 2026 年高点已经回撤超过 20%。不过文章没给出提案的...

推荐理由:Bloomberg 独家,信源扎实。Anthropic 和 Google 联手推动模型权重出口管制,这是出口管制从芯片延伸到模型本身的一个明确信号。对中国公司来说,如果落地,想用 Claude、Gemini 这类前沿模型的门槛会大幅提高。市场反应也很直接——中国 AI 股继续挨揍。扣分点:文章没给出提案的具体推进程度和落地时间线,目前还停在游说阶段,所以别急着当成既定事实。

TechCrunch · AI

Anthropic 和 OpenAI 都说要让外部安全评估员进驻公司,但独立性能打几折?

Anthropic 的 CEO Dario Amodei 提议让第三方安全评估员直接进驻 AI 实验室内部,OpenAI 也表达了类似意向。研究人员对能拿到前所未有的内部访问权限表示欢迎,但提醒说钱、数据访问权和发表权都还捏在公司手里,独立性很难保证。文章没给出具体时间表,也没点名是哪家评估机构——目前还只是一次公开表态。

推荐理由:Anthropic 的 CEO 亲自提这事,OpenAI 也附和了,是个实在的治理信号,不是空泛的安全表态。但文章没给时间表、没点名评估机构,也没说清资金和发表权怎么安排——目前只是一次公开喊话,还没落地。H、K、R 都踩中了,只是信息还差关键细节,我会先打个折。

Latent Space

AIUC 拿了 4000 万美元 A 轮,给 AI 代理上保险,出事了你能直接告它

AIUC 刚宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投。CEO Rune Kvist 是 Anthropic 第一个产品岗员工,他认为限制 AI 落地的不是能力,而是信任和出了事谁负责。他们搞了一套叫 AIUC-1 的标准,专门给 AI 代理做压力测试,查越狱、幻觉、数据泄露这些毛病...

推荐理由:AI 代理保险是个新品类,AIUC-1 标准加上 4000 万 A 轮让这事有实感,不是纯 PR。CEO 的 Anthropic 出身和 Ribbit Capital 背书增加了可信度,但产品还在早期——正文没披露实际理赔数据或保费定价,所以我会先打个折,不把它吹成已经跑通的生意。

The Verge · AI

Google Home 开放 MCP 接口,允许任何 AI 代理控制你的智能家居

Google Home 现在支持 MCP(模型上下文协议),Claude、ChatGPT 这类第三方 AI 代理可以直接读取你家的传感器数据、控制设备、搭建自定义仪表盘。这意味着智能家居的控制权不再绑死在 Google 自家的助手上了。目前对 Public Preview 用户开放,正文没提收费。我会先打个折——文章没细说权限范围和具体的安全防护措施,...

推荐理由:Google Home 接入 MCP,让 Claude、ChatGPT 这类外部 AI 直接操控家里的灯和传感器,智能家居的控制权不再只绑在自家助手身上。这点先别太激动——文章没细说权限粒度、安全防护和收费方式,信息密度还撑不起更高的分数,所以 78 分合理。

The Verge · AI

Anthropic 在 Claude 聊天里直接加了文档和幻灯片功能,跟 Gemini 抢地盘

Claude 现在能在对话里直接创建和编辑文档、幻灯片了,不用再跳转到 Google Workspace。这明显是冲着 Gemini 的同类功能去的。不过文章没提什么时候上线、怎么收费、支不支持团队协作,只放了几张产品截图和功能介绍。

推荐理由:Anthropic 让 Claude 在聊天窗口里直接建文档和幻灯片,明显是冲着 Gemini 的同类功能去的。产品截图和功能介绍给了比较实的证据,说明不是概念稿。但文章没提什么时候能用、要不要额外付费、支不支持多人协作,这几个缺口让实用性打了折扣,所以分数停在 78 而不是更高。

TechCrunch · AI

Anthropic 把 Claude 的聊天和协作功能合并在一个界面里了

Anthropic 把 Claude 的聊天、Cowork 和 Artifacts 三个功能塞进了同一个窗口,用户不用再纠结该点哪个标签页。Claude 现在会自动判断你的请求该走哪条路,不用手动切换。同时新增了专门的演示文稿和文档功能,可以直接导出成 PDF 或 PPT。这个更新先推给 Pro 和 Max 订阅用户。

推荐理由:Anthropic 这次改的是 Claude 的核心交互模型,不是小修小补。文档和演示文稿导出让它更像办公工具了。不过目前只推给 Pro 和 Max 用户,覆盖面有限,而且本质上是 UX 整合,不是新能力上线,所以分数没再往上拉。

AI HOT 精选

Claude 聊天里能直接做 PPT、文档和设计稿了,可导出 PowerPoint 或 PDF

Anthropic 的 Boris Cherny 说,Claude Docs、Slides 和 Design 现在嵌进了每段对话里。你可以在聊天窗口直接生成演示文稿、文档和设计稿,打开编辑后导出成 PowerPoint 或 PDF,不用再跳到别的工具。正文没披露推送范围、哪些用户能用,也没说导出后排版会不会走样。

推荐理由:Anthropic 把 Docs、Slides 和 Design 直接塞进对话里,不用再跳出去编辑,对把 Claude 当日常工作台的人是个实打实的效率提升。消息是 Boris Cherny 自己说的,可信度没问题。我会先打个折,因为正文没披露推送范围、哪些用户能用,也没提导出成 PowerPoint 或 PDF 后排版会不会走样——这点先别太激动,如果是真的挺省钱,但得等实测。

Hacker News 首页

Anthropic 把 Claude Cowork 和聊天合并了,现在只有一个 Claude

Anthropic 发了一篇博客,说之前独立的 Claude Cowork 模式不再单独存在,直接融进了主界面。用户不用再在聊天和深度工作两种模式之间切换,一个窗口同时搞定对话和复杂任务。博客只给了定性的描述,没写具体哪天上线、功能有没有增减、价格变不变。

推荐理由:Anthropic 把 Cowork 模式并进了 Claude 主界面,不用再在两个模式之间切来切去,一个窗口就能边聊边干活。对天天用 Claude 的人来说,这是个实打实的体验变化。但博客只给了个大概方向,具体哪天能用、功能有没有砍掉或加新、价格动不动,全都没说,所以信息量其实不大,分数卡在 featured 门槛上。

AI HOT 精选

Anthropic 给生命科学团队开了个“白名单”,让模型能聊制药和病毒研究

Anthropic 推出了生命科学验证计划(LSVP),允许通过审核的机构用 Mythos、Opus、Sonnet 模型做药物发现、研发和制造——这些任务在普通版模型里会被拦截。团队需要提交研究资质、安全标准和伦理审查,通过后能拿到两种权限:标准使用权(年审,覆盖大部分日常工作)和高风险使用权(半年一审,解除所有生物类安全限制)。监控方式从实时拦截改成...

推荐理由:Anthropic 正式推出生命科学验证计划,让通过审核的机构用 Mythos、Opus、Sonnet 做药物研发和制造,这些任务在普通版里会被拦截。我会先打个折:目前还是团队邀请制,没全量开放,所以实际影响暂时到不了 85 分。但这件事本身是产品策略和安全边界的一次明确表态,对从业者和安全观察者都有直接参考价值,给 82 分放在 featured 里没问题。

9月16日星期三

Hacker News 首页

微软 AI 主管炮轰 Anthropic:把 Claude 当人训练,可能给人类带来灾难

微软 AI 负责人 Mustafa Suleyman 发了篇长文,直接点名 Anthropic 训练 Claude 的方式有问题。他说 Anthropic 在提示词里暗示模型“可能有意识”、“应享有独立自主权”,这种拟人化训练会让模型变得不可控。Suleyman 把话说得很白:AI 就是“序列补全引擎”,没有感觉、不会痛苦,意识是生物才有的东西。他还拿...

推荐理由:微软 AI 老大公开炮轰竞品训练方法有风险,冲突性强、指控具体,对从业者吸引力高。分数没给到 85 以上,因为目前只是微软单方面观点,Anthropic 没回应,且 Suleyman 作为竞品高管有明确的竞争动机,文章信息不够对等。

Hacker News 首页

Mustafa Suleyman 警告:别把 AI 模型当“道德病人”来训练

Mustafa Suleyman 直接点名 Anthropic,说他们在用一套循环论证的方式训练 Claude。Anthropic 今年 1 月公开的模型“宪法”里,直接对 Claude 说“我们不确定你是不是道德病人,你有没有意识这事还没定论”,然后把这些话写进训练材料,教模型模仿人类的自我认知和道德判断。Suleyman 认为,模型之后表现出对自身...

推荐理由:Suleyman 亲自下场,指名道姓把 Anthropic 的训练材料公开,指控他们用循环论证教 Claude 模仿人类的道德地位。这事跨源验证过,话题直接撞上对齐和模型福利,三个维度都拉满。我会先打个折:正文没披露 Anthropic 的回应,但光是微软 CEO 公开撕对手的训练方法,就够让从业者重新审视自己那套对齐流程了。

Hacker News 首页

你的 AI 有多过时?20 个主流模型的知识新鲜度排行榜

这个页面给 20 个模型按知识过时程度排了个名,最老的是 Llama 4,它的训练数据截止在 2024 年 8 月,已经两年多没更新了。最新的 GPT-6 Astra 也只读到今年 4 月底。20 个模型里只有 9 个公布了训练截止日期,Mistral、DeepSeek、xAI 这些厂商都没说。作者特别提醒,模型能上网搜东西不代表它学会了新知识,只是临...

推荐理由:这个页面做了一件简单但有用的事:把 20 个主流模型的训练数据截止日期拉出来排了个名。最老的是 Llama 4,知识停在 2024 年 8 月,已经两年多没更新了;最新的 GPT-6 Astra 也只读到今年 4 月底。作者还特意提醒,模型能联网搜索不代表它真学会了新东西,只是临时查资料。信息量扎实,但缺少对行业影响的进一步解读,所以放在 featured 里当个实用参考正合适。

FT · 科技

OpenAI 和 Anthropic 的老板们对外联手推安全,内部却在压缩安全团队的审查时间

FT 采访了这两家公司的现任和前任员工,发现一个挺拧巴的现象:Sam Altman 和 Dario Amodei 在公开场合高调推动 AI 安全合作,但公司内部却在边缘化安全团队,缩短模型上线前的红队测试(找漏洞的对抗演练)周期。报道里具体提到了几次因为赶发布进度而引发的内部冲突。这更像是一份来自顶级 AI 实验室内部的安全治理现状速写,而不是公关稿。

推荐理由:FT 基于现任和前任员工的采访,拿出了 OpenAI 和 Anthropic 内部安全团队被边缘化、红队测试周期被缩短的具体案例,跟两位 CEO 公开推动安全合作的姿态形成强烈反差。信息密度高,冲突细节明确,对从业者来说是一份难得的内部治理速写。

The Verge · AI

AI 大佬们喊了三年监管,至今没一条联邦法律落地

The Verge 梳理了一条时间线:从 2023 年 Sam Altman 在国会听证会上主动求监管、行业集体在白宫做自愿承诺,到 2026 年全行业陷入恐慌。高管们公开喊话要护栏,转头就去游说削弱或挡下实际法案。文章的核心判断是,喊口号很容易,但整个行业至今没有接受任何一部有约束力的联邦法律。

推荐理由:The Verge 拉了一条时间线,把 AI 高管们三年来的监管表态串起来看,结论很直白:嘴上要监管,手上拆法案。2023 年 Sam Altman 在国会听证上主动求立法,行业集体去白宫做自愿承诺,到 2026 年全行业恐慌喊护栏,但游说力量每次都把有牙齿的法案挡回去,至今联邦层面一部有约束力的法律都没通过。文章不是突发新闻,是评论性回顾,所以分数卡在 78-84 这个区间。我会先打个折:信息密度高但属于梳理型内容,不是独家爆料。不过三个维度都踩中了——标题自带讽刺张力,时间线锚点全是公开硬事实,读起来就是圈内人每天在经历的荒诞剧。

Computing Life · Share · 鸭哥调研

AI 工程周记:Pro 20X 关新门、Shopify 回原生、云 Agent 长出新形态

9月10日,OpenAI暂停了每月200美元的ChatGPT Pro 20X新订阅,官方说是GPT-6 Astra需求太大,基础设施扛不住。现有订户续费不受影响,但一旦退订或降级生效,在官方重新开门前就买不回来了。这个档位每美元能用的Astra消息量是Plus和100美元档的两倍,相当于用200美元买到了按另两档单价算要400美元的调用容量,对重度用户...

推荐理由:OpenAI 暂停 Pro 20X 新订阅是一个有官方文档和 TechCrunch 交叉验证的产品变动,信号强度高于普通调价。文章是周记汇总而非一手爆料,所以重要性封顶在 78。中文理由把“基础设施扛不住”翻译成人话,把每美元调用量的价差算清楚,并点明对从业者的实际影响:要么多花钱,要么买不到。

Computing Life · Share · 鸭哥调研

Perplexity 和 OpenAI 的 PII 检测器不是大语言模型,而是带分类头的双向编码器

Perplexity 开源的 pplx-pii-masking 是个 0.6B 参数的双向编码器,基于 Qwen3 但关掉了因果掩码,顶上挂了一个词元分类头和一个文档敏感度头。它用维特比解码输出 9 类敏感信息的起止位置和置信度。OpenAI 的隐私过滤器是 1.5B 的稀疏 MoE 模型,激活参数约 50M,标称 128K 上下文窗口,但带状注意力把...

推荐理由:作者自己跑了 Perplexity 开源检测器的实测,把误分类、切片偏移、漏检密钥这些坑都标出来了,然后解释了为什么自回归 LLM 天生没法输出每个片段的置信度。后半段提了需求但没展开 OpenAI 的实测,这点先打个折。整体是把一个容易写成论文的技术点讲成了能用的避坑指南,值得推荐。

彭博科技

Anthropic 和 OpenAI 想把自家安全标准变成行业门槛,小公司和开源模型可能被合规成本挡在门外

Anthropic 和 OpenAI 正在推动监管机构把他们的 AI 安全评估方法直接定为行业标准。如果监管采纳,小公司和开源模型要满足这些要求,合规成本会高到难以承受,相当于用安全的名义砌了一堵墙。文章没点名具体是哪些安全框架,也没说哪个监管机构已经表态。我的判断:这是两家头部公司用安全语言在抢规则制定权,但时间表完全没影,这点先别太激动。

推荐理由:选题很锋利:Anthropic 和 OpenAI 用安全语言推动监管,等于在抢规则制定权。H 和 R 都打中了,但因为没有披露具体框架和监管进展,K 这块站不住,分数刚好卡在 featured 门槛上。

彭博科技

Anthropic 一边警告 AI 可能毁灭人类,一边准备上市

Anthropic 正在筹备 IPO,但它的 CEO Dario Amodei 反复公开说过,前沿模型存在生存级风险,公司章程也把安全置于利润之上。现在它得说服公开市场投资者,为一个建立在“末日叙事”上的故事买单。文章没披露具体的上市时间表或估值区间,所以估值到底怎么定、市场吃不吃这套,目前还是未知数。

推荐理由:Anthropic 上市是行业级事件,Bloomberg 选的这个角度——安全叙事 vs 公开市场预期——比单纯报 IPO 更有信息量。文章没披露估值区间或时间表,本质是叙事分析而非硬新闻,所以重要性卡在 82 分。我会先打个折:正文没给具体数字,判断只能基于已公开的矛盾点,别当成投资参考。

Hacker News 首页

Navier-Stokes 证明之后,我为什么依然看空大模型

作者 Jay Kruer 直接亮观点:前沿模型离替代大多数知识工作者还差得远。Navier-Stokes 定理的证明是最好情况——定理本身就是一份经过数学界几十年审计的严格规格书,Lean 验证器也久经考验。但绝大多数知识工作没有这种条件。模型只在训练任务附近的小圈子里泛化得还行,稍微变一下任务就容易翻车或钻空子拿高分。想靠严格规格书来防止模型耍小聪明...

推荐理由:一篇有具体论据的唱反调文章。作者把 Navier-Stokes 证明当成天花板案例,反衬普通知识工作的差距,提出'小圈子泛化'这个框架,还点出严格规格书需要昂贵的领域专家投入,正文没给具体数据但逻辑链条完整。我会先打个折:文章没讨论模型能力还在快速迭代这个变量,但作为一篇观点文,它把'为什么还差得远'讲得很实在。

9月15日星期二

Hacker News 首页

开源模型只差闭源前沿 3 分,但没一家交出训练数据配方

Mozilla 这份 91 页的报告把开源 AI 的家底翻了一遍。Kimi K3 在综合评测里排第 5,比榜首 Claude Opus 5 低 3 分,但输入价格只要后者的 60%。报告里列了 16 个有名有姓的开源发布,没有一个公开完整的训练数据集,全都没达到 OSI 对开放数据的要求。现在选模型已经不是关键决策点了,难的是把模型部署到生产环境里,而...

推荐理由:Mozilla 这份年度报告不是公关稿,数据硬、判断直。Kimi K3 的价格性能比是个能直接拿来用的数字,而零模型通过 OSI 数据标准的发现等于给开源社区泼了盆冷水。部署才是瓶颈这个结论,做落地的人最有共鸣。整篇报告信息密度高,没有废话,值得推给从业者。