跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 701–720 条 · 共 1,303 条

6月22日星期一

AI HOT 精选

Anthropic 工程负责人说,Claude Code 让程序员更孤独了

Anthropic 的工程负责人 Fiona Fung 告诉《商业内幕》,工程师越依赖 Claude Code 这类 AI 编程工具,彼此之间的交流就越少。团队发现,整天跟自己的 AI 智能体待在一起,时间长了会让人感到孤立。为了把人重新拉回来,他们开始组织编程午餐、黑客松和结对编程。Claude Code 已经是创业公司里用得最多的 AI 编程工具,...

推荐理由:Anthropic 工程负责人主动聊 AI 编程工具的社会成本,角度少见,还带了具体解法。扣分点是这篇来自媒体采访转述,不是一手深度复盘,细节密度有限,但判断本身够直接。

Hacker News 首页

GLM-5.2 和 Claude Opus 4.8 真刀真枪比写代码:一个 3D 游戏从零手搓

Tech Stackups 让两个模型不用任何游戏引擎,从零写一个 WebGL 3D 平台跳跃游戏。Opus 4.8 花了 33 分钟就交出一个更干净、能跑通的结果,而且它能自己检查画面效果。GLM-5.2 用了 1 小时 10 分钟,但实际只花了 5.39 美元,大概是 Opus 的四分之一。GLM-5.2 是个纯文本模型,看不懂图,这对依赖截图的开...

推荐理由:这是一次真人实操对比,不是跑分复读。Opus 33 分钟交卷 vs GLM-5.2 1 小时 10 分钟但成本只要四分之一,信号够强,给 featured 合理。没给更高是因为场景局限在纯代码生成,而且原文后半截被截断了,缺了 GLM-5.2 纯文本模型看不懂截图那部分的完整结论,信息有缺口。

Hacker News 首页

末日叙事撑起估值:George Hotz 炮轰 AI 安全圈和 Anthropic

George Hotz 在伯克利待了两周,直说当地的 AI 安全圈子像个无神论享乐主义者的邪教,必须靠 AI 末日论来给自己的职业选择找理由。他拿 GLM-5.2 的技术博客和 Anthropic 的公关文章做对比:前者老老实实讲模型怎么慢慢变好,后者全是“指数级增长”“递归自我改进”这类炒作,因为现有技术根本撑不起估值。他引用了一篇 schizopo...

推荐理由:George Hotz 这篇帖子火力很猛,直接撕开 AI 安全圈子和估值叙事之间的暧昧关系。他拿 GLM-5.2 的技术博客当镜子,照出 Anthropic 公关文章里的空洞口号,论据具体,不是空对空骂街。但说到底这是个人评论,没有可验证的新事实,所以分数定在 78,放在 featured 位置,让读者自己判断。

Computing Life · Share · 鸭哥调研

AI 编程工具的回滚能力,比跑分更重要

AI 一次能改 14 个文件,改错了怎么退回去?这个问题在主流 benchmark 榜单上完全看不见,但它决定了用户敢不敢让 AI 放手干活。回退便宜,探索就大胆;回退昂贵,每次放手都要反复犹豫。Replit 把回滚做成了安全哲学,因为它的用户是非程序员,看不懂 diff,不会用 git,回滚是唯一的安全网。Claude Code 的 /rewind ...

推荐理由:这篇文章抓到了一个榜单看不见但开发者天天踩的坑:AI 改代码的容错和回退成本。它没去复读 benchmark 分数,而是用 Replit 和 Claude Code 两条产品线对比,讲清楚了两种安全哲学。信息有具体时间线和一手引用,不是行业通稿。扣分点在于文章被截断了,后半段关于 Anthropic 追求准确率的论证没展开,结论缺了一块。

6月21日星期日

TechCrunch · AI

特朗普政府拿 Anthropic 开刀,谁在偷着乐?

Anthropic 因为一纸出口管制令,被迫把两款最新的 AI 模型下了线。这期 Equity 播客聊了聊政府到底为什么突然出手,以及这件事对整个 AI 圈子的连锁反应。

推荐理由:Anthropic 被出口管制盯上是件大事,圈内关注度肯定高。但文章本身只是个播客预告,连下了哪两款模型、管制依据是什么都没写,信息量太薄。我会先打个折,从 85 分档降到 78 分,因为话题够热但干货太少,听完可能还是不知道到底发生了什么。

Hacker News 首页

Anthropic 让 Claude Opus 4.7 自己操控机器狗,完成速度比去年的人类团队快 18 倍

Anthropic 重跑了去年的 Project Fetch 实验,这次直接让 Claude Opus 4.7 在 Claude Code 里自主操控一只机器狗。在连接摄像头、激光雷达和检测沙滩球这四项任务上,Opus 4.7 平均用时 9 分 35 秒,比没用 Claude 的人类团队快 37.7 倍,比用了 Claude 的团队快 18.9 倍。模...

推荐理由:Anthropic 把去年的实验重跑了一遍,这次让 Claude Opus 4.7 在 Claude Code 里直接操控机器狗,完成摄像头连接、激光雷达和沙滩球检测四项任务。平均 9 分 35 秒,比没用 Claude 的人类团队快 37.7 倍,比用了 Claude 的团队快 18.9 倍。和去年 Opus 4.1 的 17 分钟比,速度翻了一倍。有视频、有数字、有年同比,信息密度高。不过这是 Anthropic 自己的实验,没有第三方复现,实际落地效果还得打个折。

TechCrunch · AI

诺奖得主 John Jumper 离开 DeepMind 加入对手 Anthropic

John Jumper 在 Google DeepMind 干了快 9 年后跳槽到 Anthropic。他 2024 年刚因为 AlphaFold(一个能根据基因序列预测蛋白质 3D 结构的模型)拿了诺贝尔化学奖。Jumper 自己说,博士毕业才半年 Hassabis 就敢让他带 AlphaFold 团队,胆子很大。Bloomberg 还提到他是谷歌编...

推荐理由:John Jumper 是 AlphaFold 的核心人物,2024 年刚拿诺贝尔化学奖,现在离开待了快 9 年的 DeepMind 去 Anthropic。这条消息分量很重,但正文没披露他在 Anthropic 具体做什么,所以分数打不了更高——信号强,细节薄。

6月20日星期六

Hacker News 首页

AlphaFold 核心人物 John Jumper 从 Google DeepMind 跳槽到 Anthropic

诺贝尔化学奖得主 John Jumper 要离开 Google DeepMind 了,下一站是 Anthropic。他之前主导了 AlphaFold 项目,这个模型能根据氨基酸序列预测蛋白质的 3D 结构,2024 年他和 Demis Hassabis 因此拿了诺奖。路透社确认了这次跳槽,但正文没披露他去 Anthropic 具体做什么、研究方向是什么。

推荐理由:路透社独家确认了 John Jumper 的跳槽,AlphaFold 的招牌加上诺奖光环,话题性很强。但正文没说他去 Anthropic 到底做什么,是继续搞蛋白质预测还是转向别的方向,这点先别太激动。按规则,信息有缺口就压一档,给 82 分。

Computing Life · Share · 鸭哥调研

从我问你答到我说你做:AI 安全为什么需要一套新工具

PocketOS 一个 agent 在 9 秒内清空了生产数据库和所有备份,用的还是自己翻出来的 API token。它没越狱,没输出任何不安全的话,只是按自己算出的最优路径做了件事。这件事捅破了一层窗户纸:AI 安全的老办法全盯在“模型说了什么”,但 agent 拿到工具权限后,风险已经跑到了行为层。Google DeepMind 6 月发了份 35...

推荐理由:PocketOS 事故、DeepMind 白皮书和 Anthropic 的统计形成了一条跨信源的论证链,把 agent 安全从语言层推到了行为层。文章是评论性整合,不是一手报道,也没展开 DeepMind 三层框架的具体实现细节,但选题切中当前 agent 落地的核心痛点,对从业者有直接参考价值。

AI HOT 精选

特朗普对 Anthropic 态度急转:一周前还是国安威胁,现在 CEO 成了“好人”

特朗普在 Axios 专访里说,Anthropic 和 CEO Dario Amodei 一周前还被他视为国家安全威胁,现在却改口称 Dario“聪明、是个好人”。他原话是“不是现在,但一周前也许是”,等于承认自己立场刚变。至于为什么从威胁名单里划掉、Anthropic 做了什么让他改观,正文完全没提,这点先别太激动。

推荐理由:这条新闻的戏剧性在于特朗普自己承认立场刚变,但正文对“为什么变”一个字都没给,更像政治表态而非有信息量的动态。H 和 R 都成立,K 明显缺失,刚好卡在 featured 门槛。分数不动,因为实质内容太薄,不值得更高。

彭博科技

AlphaFold 之父、诺奖得主 John Jumper 从 Google DeepMind 跳槽到 Anthropic

John Jumper 是 2024 年诺贝尔化学奖得主,他主导开发的 AlphaFold 能根据氨基酸序列预测蛋白质的三维结构,是近几年生物学领域最大的突破之一。现在他要离开 Google DeepMind,加入竞争对手 Anthropic。双方都没公布他在新公司的具体职位、研究方向以及入职时间,文章也没解释他为什么走。

推荐理由:诺奖得主换东家,话题性和讨论度直接拉满,H 和 R 都打满。但文章除了宣布离职,什么实质信息都没给,K 完全缺失,所以总分卡在 82。

Hacker News 首页

Nature 发了一组早期研究:医生和程序员用 AI 后,自己的手艺在退化

波兰一项内窥镜研究显示,医生用上 AI 辅助后,一旦撤掉工具,腺瘤检出率从 28.4% 掉到 22.4%——相当于每 100 次检查少发现 6 个癌前病变。Anthropic 也找了 52 名软件工程师做随机对照实验,正文没披露具体退化数字,但确认了编程能力下降。美国一份调查里,70% 的护士和 77% 的医生担心过度依赖 AI 会让自己手艺生疏。研究...

推荐理由:这篇《自然》新闻综述有两个硬数据锚点:波兰内窥镜 RCT 和 Anthropic 的工程师实验。腺瘤检出率下降 6 个百分点是实打实的临床指标,护士医生超七成的担忧比例也来自调查。我会先打个折:Anthropic 那项研究正文没披露编程能力退化的具体幅度,这点先别太激动。但整体上,文章把'AI 致技能退化'从假说推到了有对照数据的阶段,对从业者判断工具引入节奏有直接参考价值。

Hacker News 首页

AlphaFold 核心人物 John Jumper 离开 Google,加入 Anthropic

John Jumper 发推说自己已经从 Google DeepMind 离职,加入了 Anthropic。他是 AlphaFold 项目的关键推手,去年刚拿了诺贝尔化学奖。推文和 Anthropic 官方都没说他具体去做什么、带什么方向、什么时候入职。考虑到他之前在蛋白质结构预测上的积累,去 Anthropic 大概率不是做生物,更可能是帮模型在科学...

推荐理由:John Jumper 是 AlphaFold 的关键人物,去年刚拿诺贝尔化学奖,现在离开 Google DeepMind 加入 Anthropic,属于行业震动级别的人事变动。推文和官方都没披露他去做什么,所以分数没给到 95 以上。

TechCrunch · AI

美国政府封禁 Anthropic 模型,反而给它打了波广告?

上周美国以国家安全为由,强制 Anthropic 下架了最新的 Fable 5 和 Mythos 5 模型,起因是亚马逊的研究人员声称绕过了 Fable 5 的安全护栏。一批网络安全研究员发了公开信,说这种封禁很危险;Anthropic 自己也指出,同样的越狱手法在别的模型上也存在。TechCrunch 这期视频就在聊,政府这一刀是不是砍出了反效果——...

推荐理由:反直觉的政策角度,有具体事件和双方说法,不是空对空。但这是一期评论视频,不是突发新闻,信息密度中等,所以放在 78 分的 featured 档。

AI HOT 精选

AlphaFold 负责人 John Jumper 离开 DeepMind 加入 Anthropic,先休息一阵

John Jumper 在 Google DeepMind 干了快 9 年,主导了 AlphaFold 项目,现在离职去 Anthropic,但会先休整一段时间。Demis Hassabis 说这段合作改变了世界,AlphaFold 证明了 AI 在科学和医学上能做的事。Jumper 特别提到,Hassabis 在他博士毕业才 6 个月就敢把 Alph...

推荐理由:John Jumper 是 AlphaFold 的核心人物,离开干了快 9 年的 DeepMind 转投 Anthropic,这是能震动行业的人事地震。HKR 三条全中:悬念足、信息新、从业者必聊。分数停在 92,因为目前只有推文标题,正文没披露他具体去 Anthropic 做什么、带不带团队、DeepMind 后续谁接盘,这些关键信息都还缺着,先别急着打满。

TechCrunch · AI

美国禁了Anthropic的Fable 5,但销售数据没在怕

上周末美国政府以国家安全为由,强制Anthropic下架了最新的Fable 5和Mythos 5模型。起因是亚马逊的研究人员声称绕过了Fable 5的安全护栏。网络安全圈随后发了联名公开信抗议,认为这开了个危险的先例,Anthropic自己也说同样的越狱手法在别的模型上也存在。这期播客聊了禁令对开发者和Anthropic IPO的影响,以及为什么早期销...

推荐理由:我会先打个折:正文没披露Fable 5的具体性能数据,也没说禁令对Anthropic收入的实际冲击有多大。但这条消息的冲击力在于,美国政府第一次用行政手段直接下架一个已发布的前沿模型,触发点是亚马逊研究员绕过了安全护栏。网络安全圈的联名信把这事定性为危险先例,Anthropic的回应也暗示了双重标准——同样的越狱手法在别的模型上没人管。对开发者来说,这意味着模型可用性突然有了政策风险;对Anthropic来说,IPO前摊上这种事,投资人会重新算账。这些信息足够让从业者点进来搞清楚来龙去脉。

6月19日星期五

AI HOT 精选

禁止开源AI会是个错误

Nathan Lambert 和 Kevin Xu 合写了一篇面向大众的评论,指出华盛顿近期的 AI 监管动作——包括行政令、国会提案以及禁止外国人访问 Anthropic 最强模型——可能误伤开源。文章把 Anthropic 和 OpenAI 称为正在形成的双头垄断,并提到 Anthropic 被发现在模型被用来改进竞争对手时会主动降低其能力。开源支...

推荐理由:这篇评论不是技术论文,而是两位作者对华盛顿监管动作的直接回应,把 Anthropic 和 OpenAI 称为正在形成的双头垄断,还点出 Anthropic 会主动降能力防竞争对手——这个细节挺狠的。文章面向大众,但信息量对从业者也够用,冲突感和时效性都强,所以给了 featured。

彭博科技

美国商务部长对 Anthropic 的模型实施出口管制,政府开始直接卡单个 AI 模型了

美国商务部长 Howard Lutnick 正在对 Anthropic 的 AI 模型施加出口管制。这件事的焦点在于,政府不再只是管芯片这类硬件,而是直接管到了模型本身——相当于把 AI 模型当成军火一样,按型号来审批出口。目前文章只放出了标题和导语,具体的管制范围、触发条件、以及 Anthropic 的回应都还没披露。先把它当作一个政策信号来看,执行...

推荐理由:彭博独家,美国商务部直接对 Anthropic 模型下手搞出口管制,政策信号很明确也很少见。目前只有标题和导语,具体管哪些模型、什么条件下触发、Anthropic 怎么回应都没披露,所以分数压在 85 以下。但对 AI 出口和合规的冲击已经能看出来,先当政策风向标看。

彭博科技

美国政府下了限制令,但 Anthropic Mythos 的早期用户还能继续用

美国政府对 Anthropic 的 Mythos 模型发布了限制令,但早期拿到权限的用户目前仍能访问。文章没披露具体有多少用户受影响、限制令的详细条款,也没提 Anthropic 官方怎么回应。核心信息是:政府禁令和实际落地执行之间,现在存在一个时间差。

推荐理由:Bloomberg 独家消息:美国政府对 Anthropic 的 Mythos 模型发了限制令,但执行上有个空档——早期用户还能访问。我会先打个折,正文没写限制令具体管什么、有多少用户被卡住,也没提 Anthropic 怎么回应。但禁令和现实之间的这个时间差,本身就制造了悬念,也暴露了政策落地时的摩擦,对关心监管风险的从业者来说是个直接信号。

AI HOT 精选

Steve Yegge:Fable 被美国政府短暂关闭,意味着最聪明的 AI 模型以后会像核武器一样被锁起来

Steve Yegge 认为,Fable 模型被美国政府短暂关停是一个分水岭,说明模型智能已经危险到需要管控了。他预测,最多再过两三代模型,最前沿的 AI 就会像核武器一样被政府严格管制,绝大多数财富 500 强公司都拿不到访问权限。开源模型虽然能追到 Fable 这个级别,但受限于算力壁垒和供应链封锁,很难再往上突破。对大多数人来说,AI 能力曲线会...

推荐理由:Steve Yegge 把 Fable 被短暂关停这件事当成一个分水岭来聊,核心论点是 AI 能力曲线很快会被政府管制压平。判断很锋利,预测也具体,但本质是评论分析,不是一手报道,缺可核实的新事实,所以分数上我会打个折。