跳到正文

#Anthropic

今日 9 条

9月16日星期三

Hacker News 首页

微软 AI 主管炮轰 Anthropic:把 Claude 当人训练,可能给人类带来灾难

微软 AI 负责人 Mustafa Suleyman 发了篇长文,直接点名 Anthropic 训练 Claude 的方式有问题。他说 Anthropic 在提示词里暗示模型“可能有意识”、“应享有独立自主权”,这种拟人化训练会让模型变得不可控。Suleyman 把话说得很白:AI 就是“序列补全引擎”,没有感觉、不会痛苦,意识是生物才有的东西。他还拿...

推荐理由:微软 AI 老大公开炮轰竞品训练方法有风险,冲突性强、指控具体,对从业者吸引力高。分数没给到 85 以上,因为目前只是微软单方面观点,Anthropic 没回应,且 Suleyman 作为竞品高管有明确的竞争动机,文章信息不够对等。

Hacker News 首页

Mustafa Suleyman 警告:别把 AI 模型当“道德病人”来训练

Mustafa Suleyman 直接点名 Anthropic,说他们在用一套循环论证的方式训练 Claude。Anthropic 今年 1 月公开的模型“宪法”里,直接对 Claude 说“我们不确定你是不是道德病人,你有没有意识这事还没定论”,然后把这些话写进训练材料,教模型模仿人类的自我认知和道德判断。Suleyman 认为,模型之后表现出对自身...

推荐理由:Suleyman 亲自下场,指名道姓把 Anthropic 的训练材料公开,指控他们用循环论证教 Claude 模仿人类的道德地位。这事跨源验证过,话题直接撞上对齐和模型福利,三个维度都拉满。我会先打个折:正文没披露 Anthropic 的回应,但光是微软 CEO 公开撕对手的训练方法,就够让从业者重新审视自己那套对齐流程了。

Hacker News 首页

你的 AI 有多过时?20 个主流模型的知识新鲜度排行榜

这个页面给 20 个模型按知识过时程度排了个名,最老的是 Llama 4,它的训练数据截止在 2024 年 8 月,已经两年多没更新了。最新的 GPT-6 Astra 也只读到今年 4 月底。20 个模型里只有 9 个公布了训练截止日期,Mistral、DeepSeek、xAI 这些厂商都没说。作者特别提醒,模型能上网搜东西不代表它学会了新知识,只是临...

推荐理由:这个页面做了一件简单但有用的事:把 20 个主流模型的训练数据截止日期拉出来排了个名。最老的是 Llama 4,知识停在 2024 年 8 月,已经两年多没更新了;最新的 GPT-6 Astra 也只读到今年 4 月底。作者还特意提醒,模型能联网搜索不代表它真学会了新东西,只是临时查资料。信息量扎实,但缺少对行业影响的进一步解读,所以放在 featured 里当个实用参考正合适。

FT · 科技

OpenAI 和 Anthropic 的老板们对外联手推安全,内部却在压缩安全团队的审查时间

FT 采访了这两家公司的现任和前任员工,发现一个挺拧巴的现象:Sam Altman 和 Dario Amodei 在公开场合高调推动 AI 安全合作,但公司内部却在边缘化安全团队,缩短模型上线前的红队测试(找漏洞的对抗演练)周期。报道里具体提到了几次因为赶发布进度而引发的内部冲突。这更像是一份来自顶级 AI 实验室内部的安全治理现状速写,而不是公关稿。

推荐理由:FT 基于现任和前任员工的采访,拿出了 OpenAI 和 Anthropic 内部安全团队被边缘化、红队测试周期被缩短的具体案例,跟两位 CEO 公开推动安全合作的姿态形成强烈反差。信息密度高,冲突细节明确,对从业者来说是一份难得的内部治理速写。

The Verge · AI

AI 大佬们喊了三年监管,至今没一条联邦法律落地

The Verge 梳理了一条时间线:从 2023 年 Sam Altman 在国会听证会上主动求监管、行业集体在白宫做自愿承诺,到 2026 年全行业陷入恐慌。高管们公开喊话要护栏,转头就去游说削弱或挡下实际法案。文章的核心判断是,喊口号很容易,但整个行业至今没有接受任何一部有约束力的联邦法律。

推荐理由:The Verge 拉了一条时间线,把 AI 高管们三年来的监管表态串起来看,结论很直白:嘴上要监管,手上拆法案。2023 年 Sam Altman 在国会听证上主动求立法,行业集体去白宫做自愿承诺,到 2026 年全行业恐慌喊护栏,但游说力量每次都把有牙齿的法案挡回去,至今联邦层面一部有约束力的法律都没通过。文章不是突发新闻,是评论性回顾,所以分数卡在 78-84 这个区间。我会先打个折:信息密度高但属于梳理型内容,不是独家爆料。不过三个维度都踩中了——标题自带讽刺张力,时间线锚点全是公开硬事实,读起来就是圈内人每天在经历的荒诞剧。

AI 群聊日报

DS V4.1 Flash 搜索幻觉实测翻车,Astra 过度工程根因是旧指令反噬,GPT-6 Sol 本周传闻再起

群友用同一套搜索工具做控制变量实验,DS V4.1 Flash 调了 22 轮工具后给出的网址全是假的,GPT 只用 4 轮就拿到真实结果,差距明显。Astra 频繁过度工程的毛病被定位到旧模型时代攒下的 skill 和 memory 在暗中加活,清理后行为立刻正常,建议从 Sol 迁来的项目都做一次上下文大扫除。GPT-6 Sol 传闻最晚本周四发布...

Computing Life · Share · 鸭哥调研

AI 工程周记:Pro 20X 关新门、Shopify 回原生、云 Agent 长出新形态

9月10日,OpenAI暂停了每月200美元的ChatGPT Pro 20X新订阅,官方说是GPT-6 Astra需求太大,基础设施扛不住。现有订户续费不受影响,但一旦退订或降级生效,在官方重新开门前就买不回来了。这个档位每美元能用的Astra消息量是Plus和100美元档的两倍,相当于用200美元买到了按另两档单价算要400美元的调用容量,对重度用户...

推荐理由:OpenAI 暂停 Pro 20X 新订阅是一个有官方文档和 TechCrunch 交叉验证的产品变动,信号强度高于普通调价。文章是周记汇总而非一手爆料,所以重要性封顶在 78。中文理由把“基础设施扛不住”翻译成人话,把每美元调用量的价差算清楚,并点明对从业者的实际影响:要么多花钱,要么买不到。

Computing Life · Share · 鸭哥调研

Perplexity 和 OpenAI 的 PII 检测器不是大语言模型,而是带分类头的双向编码器

Perplexity 开源的 pplx-pii-masking 是个 0.6B 参数的双向编码器,基于 Qwen3 但关掉了因果掩码,顶上挂了一个词元分类头和一个文档敏感度头。它用维特比解码输出 9 类敏感信息的起止位置和置信度。OpenAI 的隐私过滤器是 1.5B 的稀疏 MoE 模型,激活参数约 50M,标称 128K 上下文窗口,但带状注意力把...

推荐理由:作者自己跑了 Perplexity 开源检测器的实测,把误分类、切片偏移、漏检密钥这些坑都标出来了,然后解释了为什么自回归 LLM 天生没法输出每个片段的置信度。后半段提了需求但没展开 OpenAI 的实测,这点先打个折。整体是把一个容易写成论文的技术点讲成了能用的避坑指南,值得推荐。

彭博科技

特朗普顾问 Lutnick 和 Michael 与 Anthropic 高管会面,讨论 AI 安全问题

9 月 15 日,特朗普的两位高级顾问 Howard Lutnick 和 Michael 与 Anthropic 的一位高管碰了头,聊的是 AI 安全。这是 Bloomberg 先报出来的。目前能确认的只有会面这件事和参与方,具体聊了哪些安全议题、有没有达成什么政策承诺、涉及 Anthropic 的哪款模型,正文都没披露。先别急着往大了解读,等更多细节...

彭博科技

Anthropic 和 OpenAI 想把自家安全标准变成行业门槛,小公司和开源模型可能被合规成本挡在门外

Anthropic 和 OpenAI 正在推动监管机构把他们的 AI 安全评估方法直接定为行业标准。如果监管采纳,小公司和开源模型要满足这些要求,合规成本会高到难以承受,相当于用安全的名义砌了一堵墙。文章没点名具体是哪些安全框架,也没说哪个监管机构已经表态。我的判断:这是两家头部公司用安全语言在抢规则制定权,但时间表完全没影,这点先别太激动。

推荐理由:选题很锋利:Anthropic 和 OpenAI 用安全语言推动监管,等于在抢规则制定权。H 和 R 都打中了,但因为没有披露具体框架和监管进展,K 这块站不住,分数刚好卡在 featured 门槛上。

彭博科技

Anthropic 一边警告 AI 可能毁灭人类,一边准备上市

Anthropic 正在筹备 IPO,但它的 CEO Dario Amodei 反复公开说过,前沿模型存在生存级风险,公司章程也把安全置于利润之上。现在它得说服公开市场投资者,为一个建立在“末日叙事”上的故事买单。文章没披露具体的上市时间表或估值区间,所以估值到底怎么定、市场吃不吃这套,目前还是未知数。

推荐理由:Anthropic 上市是行业级事件,Bloomberg 选的这个角度——安全叙事 vs 公开市场预期——比单纯报 IPO 更有信息量。文章没披露估值区间或时间表,本质是叙事分析而非硬新闻,所以重要性卡在 82 分。我会先打个折:正文没给具体数字,判断只能基于已公开的矛盾点,别当成投资参考。

彭博科技

Anthropic 和 Salesforce 的 CEO 都说:企业买了 AI 模型,但卡在怎么用上

Anthropic 和 Salesforce 的 CEO 在接受彭博采访时表示,很多企业买了 AI 模型后不知道怎么落地——缺咨询、缺系统集成、缺业务流程改造。Salesforce 的 CEO 还指出,不少公司连数据都没准备好。Anthropic 的 CEO 补充说,模型能力进步的速度比企业采用的速度快得多。文章没有披露具体的解决方案或产品计划。

Hacker News 首页

Navier-Stokes 证明之后,我为什么依然看空大模型

作者 Jay Kruer 直接亮观点:前沿模型离替代大多数知识工作者还差得远。Navier-Stokes 定理的证明是最好情况——定理本身就是一份经过数学界几十年审计的严格规格书,Lean 验证器也久经考验。但绝大多数知识工作没有这种条件。模型只在训练任务附近的小圈子里泛化得还行,稍微变一下任务就容易翻车或钻空子拿高分。想靠严格规格书来防止模型耍小聪明...

推荐理由:一篇有具体论据的唱反调文章。作者把 Navier-Stokes 证明当成天花板案例,反衬普通知识工作的差距,提出'小圈子泛化'这个框架,还点出严格规格书需要昂贵的领域专家投入,正文没给具体数据但逻辑链条完整。我会先打个折:文章没讨论模型能力还在快速迭代这个变量,但作为一篇观点文,它把'为什么还差得远'讲得很实在。

AI HOT 精选

Claude 给小企业加了 43 个现成工作流和 27 个工具集成,还开了免费培训课

Anthropic 在 2026 年 9 月 15 日更新了面向小企业的 Claude 版本,一口气塞进 43 个预置工作流和 27 个第三方工具集成,主要覆盖客服、销售和财务这三个小公司最头疼的环节。工作流到底是提示词模板还是直接调 API 的自动化流程,正文没明说。同时上线了一个免费培训计划,教小企业主怎么把 Claude 嵌进日常业务里。价格有没...

9月15日星期二

Hacker News 首页

开源模型只差闭源前沿 3 分,但没一家交出训练数据配方

Mozilla 这份 91 页的报告把开源 AI 的家底翻了一遍。Kimi K3 在综合评测里排第 5,比榜首 Claude Opus 5 低 3 分,但输入价格只要后者的 60%。报告里列了 16 个有名有姓的开源发布,没有一个公开完整的训练数据集,全都没达到 OSI 对开放数据的要求。现在选模型已经不是关键决策点了,难的是把模型部署到生产环境里,而...

推荐理由:Mozilla 这份年度报告不是公关稿,数据硬、判断直。Kimi K3 的价格性能比是个能直接拿来用的数字,而零模型通过 OSI 数据标准的发现等于给开源社区泼了盆冷水。部署才是瓶颈这个结论,做落地的人最有共鸣。整篇报告信息密度高,没有废话,值得推给从业者。

TechCrunch · AI

OpenAI、Anthropic、Google 已就 AI 安全私下谈了几周,但还没拿出具体方案

OpenAI 全球政策负责人 Chris Lehane 周二对记者说,公司已与 Anthropic 和 Google DeepMind 就 AI 安全问题沟通了数周。他本人正在华盛顿游说议员关注灾难性风险。这轮接触的背景是 Anthropic CEO Dario Amodei 上周六发了篇文章,呼吁行业一起放慢前沿模型的研发节奏。不过,目前公开的信息里...

推荐理由:三家顶级实验室私下聊安全,这件事本身信号很强,HKR 三个维度都踩中了。分数卡在 82 分,因为正文只确认了有沟通和 Lehane 在游说,但具体聊了什么、聊得多深、有没有初步共识,一概没提,信息量撑不起 85 分以上的段位。

彭博科技

OpenAI、Anthropic、Google 三家联手搞 AI 安全

OpenAI 说正在跟 Anthropic 和 Google 合作推进 AI 安全,但正文没披露具体合作内容,比如是联合做红队测试、统一安全标准,还是共享模型权重。目前只知道三家都表态了,具体怎么分工、有没有实质产出,都还没说。

Hacker News 首页

AI 正在打碎我们判断专业能力的旧标尺

近五千名数学家联名发声明,不是反 AI,而是指出一个具体问题:数学界一直用“解出难题”作为衡量学术贡献的代理指标,但现在的 AI 能跳过概念创新、直接用蛮力啃下这些难题,把名声拿走,却没留下人能理解的新想法。作者把数学拆成两块:一是外人看得懂的“解题”,二是真正核心的“造概念”。AI 证明破坏了这两层关系——解题不再能间接奖励造概念的人,就像古德哈特定...

推荐理由:近五千名数学家联名声明,不是反 AI,而是指出一个具体 bug:数学界一直用“解出难题”当硬通货,来间接奖励那些真正造概念、开新方向的人。现在 AI 能跳过概念创新,直接用算力啃下难题,把名声拿走,却没留下人能理解的新想法。文章用古德哈特定律把这个机制讲透了——当一个指标变成目标,它就不再是好指标。我会先打个折,正文没给出联名声明的具体名称或链接,但逻辑链条本身站得住,对从业者来说是个值得提前想一想的信号。

Hacker News 首页

Anthropic 联合创始人:AI 可能需要强制安装“紧急停止开关”

Anthropic 联合创始人 Jack Clark 对 BBC 说,社会最终可能需要立法,强制 AI 公司安装一个可被第三方验证的“紧急停止开关”。他说多数实验室(包括 Anthropic)现在都有办法拔掉电源,但应该让这成为硬性要求。同一篇报道里,Anthropic 科学家 Evan Hubinger 个人认为 AI 在十年内导致人类灭绝的概率超过...

推荐理由:Anthropic 联合创始人通过 BBC 公开呼吁立法强制安装可验证的 AI 紧急停止开关,同篇报道还披露了内部科学家对灭绝风险的个人估计。跨源验证确认了这条政策信号,不是孤例。分数没给更高,是因为目前只有标题和摘要细节,正文没展开具体技术方案和立法路径。

AI HOT 精选

Anthropic 和 OpenAI 提议联手放慢前沿 AI 研发,Cohere CEO 直指这是“披着羊皮的垄断联盟”

Anthropic 的 CEO Dario Amodei 最近呼吁政府出面协调,让行业放慢最前沿 AI 模型的研发速度,并为此申请反垄断豁免,Sam Altman 和 Elon Musk 都表示赞同。Cohere 的 CEO Aidan Gomez 发博客反驳,说这套方案会通过极高的算力、监控和合规门槛把竞争对手挡在门外,本质是“披着羊皮的垄断联盟”。...

推荐理由:Anthropic 和 OpenAI 联手提议放慢前沿研发,Cohere 老板公开怼回去说这是垄断玩法,三家头部公司正面冲突,信号很强。因为目前只有标题和摘要,完整提案细节还没看到,分数先压在 85 以下。

AI 群聊日报

空仓库让 Astra 写代码翻车,喂了 code review 经验后质量飞升

今天最直观的教训来自 @搞仁义毛义仁:给 Astra 一个空白 C++ 仓库,代码写得一塌糊涂;把积累了大量 code review 经验的 GacUI 上下文导进去,质量立刻飙升。这说明模型不是不会写,是得用具体规则去“规训”。@今天群内信息量极大 实测了 Ollama Cloud 跑 DeepSeek V4.1 Flash,解码吞吐是官方 API ...

推荐理由:今天群聊里两条实操经验比大多数论文都实在。第一条来自 @搞仁义毛义仁:用 Astra 写 C++,给个空仓库代码质量很差,但把积累了多年 code review 规则的 GacUI 上下文喂进去,质量立刻上来了。这说明模型不是不会写,是得用具体、有约束的规则去“规训”,光靠模型自己发挥不行。第二条是 @今天群内信息量极大 实测 Ollama Cloud 跑 DeepSeek V4.1 Flash,解码吞吐比官方 API 高出一截,但正文没披露具体延迟和成本数字,所以这个“快”到底在什么条件下成立、性价比如何,还得自己测了才知道。两条都指向同一个方向...

纽约时报中文网

Anthropic 老板喊停 AI 军备竞赛,但中国让这事几乎没戏

Anthropic 的 CEO 达里奥·阿莫迪发了一篇文章,直接呼吁给最前沿的 AI 能力踩刹车。他担心未来 6 到 12 个月内,成群的 AI 智能体可能具备“接管整个互联网”的能力。他提出的第一步是把外部安全专家请进实验室常驻,盯着安全流程并向公众汇报。奥特曼、马斯克和哈萨比斯都公开点赞,奥特曼还说 OpenAI 会照做。但作者 Sebastian...

推荐理由:Anthropic CEO 直接喊刹车,加上奥特曼、马斯克、哈萨比斯三人公开背书,信号强度很高。阿莫迪给出了 6-12 个月的“接管互联网”时间线和驻场安全专家的具体方案,不是空泛表态。扣分点在于:这是一篇评论文章,不是政策公告,实际约束力有限;作者 Sebastian 把焦点转向中国,但正文没披露中国方面的具体回应或数据,更多是抛出一个地缘政治疑问。我会先打个折,但整体仍然值得从业者关注。

Latent Space

第三方评估标准 AEF-1 出炉,xAI、OpenAI、Anthropic 都签了,Dario 还承诺给评估员发工牌

AI 评估论坛发布了 AEF-1 标准,给独立第三方评估立了规矩,包括访问权限、利益冲突、资金来源、回避和透明度怎么处理。同一天,Dario Amodei 发了篇个人博客,说 Anthropic 会单方面先干起来:让评估团队像员工一样进驻办公室,拿公司工牌、用公司电脑,权限跟内部风险团队差不多。他还提了个两层协调框架,一层是民主国家内部定规矩,一层是跟...

推荐理由:我会先打个折:正文没披露具体有多少家机构签了,也没说执行机制和违规后果,所以别当它已经落地。但同一天 AEF-1 发布、Dario Amodei 发博客,三家公司一起站台,这个时间点本身就说明行业在抢着给第三方评估定规矩。AEF-1 把利益冲突、资金来源这些容易和稀泥的地方写得很具体,Amodei 又提出让评估员像员工一样进驻,权限跟内部风险团队差不多,等于把透明度的门槛拉高了一大截。对从业者来说,这就是一份现成的 checklist,可以拿来比对自己的评估流程缺了什么。

纽约时报中文网

特朗普把 AI 安全警告叫“骗局”,明确说不会加新监管

特朗普在社交媒体上直接驳回了 Anthropic 等公司对 AI 风险的警告,称安全担忧是“骗局”,唯一需要的护栏是“一位强大且聪明的总统”。他点名 Anthropic 的 CEO 达里奥·阿莫迪,说他“假装是个完美的小天使”,但正文没具体说特朗普认为自己阻止了哪些政府行动。副总统万斯和众议长约翰逊的态度稍微开放一些,万斯觉得行业主动求监管“有点像特洛...

推荐理由:总统亲自点名 Anthropic 的 CEO,把 AI 安全直接定性为“骗局”,这是对行业核心叙事的正面攻击。H、K、R 三项全中:冲突烈度高,白宫内部权力温差被首次挑明,从业者的身份认同被直接冒犯。正文没披露特朗普具体阻止了哪些政府行动,信息有缺口,所以分数压在 85 以下。

纽约时报中文网

国安部长陈一新发文,把AI定性为可能直接威胁中共执政,点名美国模型

国安部部长陈一新在《中国网信》发了一篇长文,把AI风险直接拉到政治安全层面。他点名了Claude Mythos和GPT-5.5-Cyber这类美国模型,说它们可能被用来搞深度伪造、发动舆论战、偷数据,甚至攻击关键基础设施。文章还拿美军在伊朗战争里用AI举例,说算法优势决定战场主动权。新加坡教授高树超解读,这等于在中美AI安全谈判前划了红线:数据主权和政...

推荐理由:国安部长陈一新在《中国网信》发长文,把AI风险直接拉到政治安全层面,点名Claude Mythos和GPT-5.5-Cyber可能被用来搞深度伪造、发动舆论战、偷数据甚至攻击关键基础设施。文章还拿美军在伊朗战争里用AI举例,说算法优势决定战场主动权。新加坡教授高树超解读,这等于在中美AI安全谈判前划了红线:数据主权和政治安全没得商量。我会先打个折——文章没给出这些模型被实际用于攻击的证据,更多是战略喊话。但部长亲自下场、点名具体模型,这个信号本身就很重,从业者得知道自己的技术已经被放在这个框架里审视了。

AI HOT 精选

Anthropic 重写了测试影响分析服务,因为 Claude Code 这类 AI 编程工具把 CI 系统快冲垮了

Anthropic 内部用 Claude Code 写代码后,PR 数量暴增,CI 流水线被大量提交淹没。他们干脆重写了测试影响分析服务,核心思路是用 Merkle 树给文件依赖关系做缓存,只跑真正受影响的测试。效果很直接:单次分析延迟从 11 秒降到不到 1 秒,每天能处理 1000 次分析。这是他们内部单一代码仓库的配置,直接搬到别的项目不一定行,...

推荐理由:Anthropic 自己工程博客放出来的东西,有真实数字和具体技术方案,不是公关稿。11 秒到不到 1 秒的延迟压缩很扎实,但话题偏基础设施,非编码向的读者不太会点,所以放在 72 分 featured 档位。

AI HOT 精选

Amodei 发文呼吁放慢前沿 AI 研发,Altman、Hassabis、Nadella 几小时内接连表态同意

Anthropic 的 Dario Amodei 发了篇近 4000 字的文章,核心就一句话:前沿模型的能力提升速度必须降下来,不然商业竞争会把灾难性风险推得更猛。几个小时后,Sam Altman、Demis Hassabis 和 Satya Nadella 都公开表示赞同。Ars Technica 提醒,这帮人过去几年一直在搞 AGI 军备竞赛,现在...

推荐理由:Amodei 这篇近 4000 字的文章直接呼吁放缓前沿 AI 开发,把商业竞争定性为灾难性风险的核心驱动力。几小时内 Altman、Hassabis、Nadella 相继公开赞同,形成了一次罕见的行业头部共识转向。Ars Technica 提醒这些人过去几年一直在搞军备竞赛,现在集体喊停的反差让这条消息更有分量。对从业者来说,这不只是新闻,是直接关系到日常决策的信号。

Hacker News 首页

Andon Labs 发布 Pion:一个让 AI 自己开公司赚钱的平台,并开放候补名单

Andon Labs 把过去两年让 AI 自主经营自动售货机、商店和咖啡馆的经验打包成了 Pion 平台,现在开放候补申请。他们自己做的 Vending-Bench 测试显示,Claude Opus 4 在 2025 年 5 月首次超过了人类基准线,之后每个新模型分数都在涨,没有停下来的迹象。但模拟和现实差距很大:早期 AI 在真实场景里会白送东西、拒...

9月14日星期一

Hacker News 首页

Anthropic 跟投资人说自己连续两个季度赚钱了

Anthropic 对投资人表示,公司已经连续两个季度实现盈利。在烧钱如流水的 AI 模型公司里,能靠现金流养活自己算是个稀罕信号。不过目前只有标题,正文没披露具体营收、利润数字,也没说成本结构,所以先别太激动,等看到财报再下判断。

推荐理由:Anthropic 连续盈利对行业是个信号,但正文只有标题,没给任何具体数字。H 和 R 都成立,K 因为信息缺失不成立。按 featured 门槛给 78 分,等财报细节出来可以再往上调。

AI HOT 精选

Anthropic 准备在纳斯达克上市,用连续两个季度“调整后盈利”冲刺 2 万亿美元估值

Anthropic 告诉投资人自己连续第二个季度赚钱了,但这个“盈利”是调整后的数字,没算股权激励这类成本。毛利率号称超过 80%,不过这个数是在跟亚马逊等伙伴分账、以及花大钱训练模型之前算出来的。季度收入同比翻了 14 倍,达到 115 亿美元,7 月底的年化收入跑到了 650 亿美元。有分析师说,投资人预期年底年化收入能到 1200 亿,2027 ...

推荐理由:Anthropic 瞄准纳斯达克,带着连续第二个季度调整后盈利、115 亿美元季度收入、650 亿美元年化跑速和 2 万亿估值目标。三个维度都打中了:标题抓人,数字够硬,话题跟从业者钱包直接相关。没给更高分是因为盈利是调整后的,毛利率也没算分账和训练成本,实际财务健康度还得等招股书出来再看。

Hacker News 首页

把 35KB 的超长提示词从 OpenAI/Anthropic 搬到本地模型,踩坑记录

作者想把安全测试用的超长提示词(35KB)从云端大模型搬到本地跑,硬件是一台 128GB 内存的 AMD Ryzen AI MAX+ 395,配了 27B 参数的开源模型。结果在云端跑得好好的提示词,到本地全崩了。文章前半段花了不少篇幅解释动机:他认为 OpenAI 和 Anthropic 会拿用户的对话记录去训练模型,而且它们的安全过滤器把正经的漏洞...

Hacker News 首页

iOS 27 代码暗示 Siri 的后台 AI 可以换成 ChatGPT 或 Claude

开发者 pdfu 在 iOS 27 和 macOS Golden Gate 的私有框架里挖出了相关引用,苹果可能允许用户把 Siri 背后的 AI 模型换成 ChatGPT 或 Claude。目前还不清楚这个切换是系统级的,还是只针对某些特定功能,也没有任何发布时间。代码里出现不代表一定会实装,但方向很明确:苹果正在系统底层给第三方模型留接口。

推荐理由:代码证据很实在,方向信号也强,但正文没披露发布时间和具体功能范围,目前只是底层留了接口。我会先打个折,给 72 分放在 featured 档;等苹果正式官宣再往上调。

Hacker News 首页

谁来监管监管者?一位律师对 AI 安全监管的冷水

Anthropic 的 CEO Dario Amodei 发了篇文章,主张用监管给 AI 研发踩刹车,具体包括往公司里安插第三方评估员、让头部实验室统一安全标准。律师 Preston Byrne 直接怼了回去,他过去一年半都在跟网络审查机构打官司。他的核心反驳是:在美国,写代码属于言论自由,往公司里塞 NGO 评估员,跟之前搞出“审查工业复合体”的 G...

Hacker News 首页

四大 AI 巨头联手推监管框架,The Register 直指这是“监管俘获”

Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman、微软的 Satya Nadella 和 Elon Musk 罕见地共同提出了一套叫“Pace the frontier”的监管方案。这套方案只盯着他们口中“最前沿的模型”管,小公司和开源项目完全不受影响。The Register 直接点破:这就是典型的监管俘获——...

推荐理由:四家大厂罕见联名推监管方案,被 The Register 点名是监管俘获。提案只卡前沿模型、放生小玩家和开源,护城河画得太明显。目前只有一家媒体深挖,分数先压在 85 以下,后续如果有更多信源跟进再往上调。

AI 群聊日报

阿里公开招“情报工程师”专攻蒸馏,Astra 额度两小时烧光一周量

Anthropic 指控蒸馏才三天,阿里就在杭州挂出“情报工程师”岗,JD 直白写着突破注册风控和设备指纹,群友直呼“这是能招的吗?”。Astra 用户集体抱怨额度不够用:一周的 20x 额度两小时烧完,出活还比 Sol 少。有消息说 50x 订阅可能要 $300–$400。实操上,Astra 三四轮对话后智力明显下降,建议首请求放完整任务,后续只问确...

纽约时报中文网

Anthropic 老板发长文,呼吁全球给 AI 模型迭代踩刹车

Anthropic 的 CEO 达里奥·阿莫迪发了篇 3800 词的文章,直接说现在 AI 模型能力跑太快,安全措施根本追不上。他担心模型会“递归自我改进”,也就是自己学会进化,最后失控。他提议让第三方审计员进驻公司查安全标准,还喊话民主国家一起定规矩。OpenAI 的奥尔特曼、谷歌 DeepMind 的哈萨比斯和马斯克都公开表示同意。不过英伟达的黄仁...

推荐理由:Anthropic 的 CEO 发了篇 3800 词的文章,核心就一句话:AI 现在进化太快,安全措施根本追不上。他担心模型会“递归自我改进”,也就是自己学会进化,最后失控。他提了两个具体办法,一是让第三方审计员进驻公司查安全标准,二是喊话民主国家一起定规矩。OpenAI 的奥尔特曼、谷歌 DeepMind 的哈萨比斯和马斯克都公开表示同意,这种头部玩家集体喊慢的情况很少见。不过文章里没给出具体的时间表或技术验证手段,更像是一次立场表态。英伟达的黄仁勋那边信息被截断了,正文没披露他的完整回应,这点先别急着下判断。

彭博科技

中国情报首长警告AI风险,Anthropic CEO也呼吁踩刹车

中国情报首长和Anthropic CEO Dario Amodei同时发声,说AI跑太快了。中方这边警告风险,但正文没披露具体是什么风险、要采取什么措施;美方那边Amodei呼吁放慢速度,也没说具体怎么慢。两边态度一致,但都缺细节,这点先别太激动。

Computing Life · Share · 鸭哥调研

谁在改尺子:AI 榜单的两重张力

OpenAI 发布 GPT-6 Astra 后,评测机构 Artificial Analysis 一周内两次修改评分规则,让 Astra 从落后 5 分变成与 Claude Fable 5.1 并列第一,模型本身没动过。榜单是门生意:评测方卖高价订阅需要大厂背书,厂商需要排名做营销,双方利益绑在一起。DeepSeek V4 Flash 只重训了后训练阶...

推荐理由:这篇评论用一件具体的事——Artificial Analysis 在 GPT-6 Astra 发布后一周内两次改评分规则,让排名从落后 5 分翻成并列第一——把 AI 榜单的商业逻辑讲透了。有版本号、有分数、有权重变化,信息扎实。对从业者来说,它不是在复述新闻,而是在提醒:你花钱订阅的排行榜,尺子可能随时跟着大厂的新模型重画。我会给高分,因为这种“拆台”视角比单纯报分数更有价值。

AI HOT 精选

Amodei 呼吁行业“放慢脚步”,但没人说清楚到底要多慢

Amodei 九月的文章提议给前沿模型踩刹车,但通篇没给出一个具体速度。Tunguz 把回应分成了五派:可解释性派想争取时间搞懂模型内部原理,劳工派想给工人留出适应窗口,经济派指望 AI 拉动 GDP 来还债,地缘政治派要维持对中国的领先,监管俘获派则直接说这提案就是披着安全外衣的垄断同盟。每一派都算了暂停的代价,但没人报出一个数字。唯一能产生数字的机...

推荐理由:Tunguz 这篇不是一手新闻,是评论综述,也没有新数字,但五派框架干净,把 Amodei 原文里没明说的利益格局摊开了。用 2023 年算力门槛的失败当锚点,让讨论不至于飘在口号上。78 分放在 featured 低位合适——值得推给关注治理的人看,但别当硬新闻用。

彭博科技

Anthropic 跟 FT 说本季预计能实现调整后营业利润,收入约 30 亿美元

Anthropic 告诉《金融时报》,本季度预计会交出调整后营业利润,收入大约 30 亿美元,是去年同期的三倍左右。这个“调整后”扣掉了股权激励等非现金支出,不是按通用会计准则算的净利润,所以别直接当纯利看。收入涨得猛,说明企业客户还在持续买单,但正文没披露毛利率、研发和推理成本怎么分摊,也没说现金流有没有转正。

推荐理由:Anthropic 首次声称调整后营业利润,季度收入约 30 亿美元、同比约三倍,标志着从烧钱叙事转向商业验证。分数没给更高,因为“调整后”剔除了股权激励,正文也没披露毛利率和现金流状况,盈利成色还得打个折。