跳到正文

全部动态

今日 75 条

9月19日星期六

FT · 科技

加州州长纽森推动 AI 紧急关停法案,要求大模型预留远程“急停开关”

加州州长加文·纽森正在推进一项法案,要求开发超大规模 AI 模型的公司必须给模型装上远程“急停开关”,以便在出问题时能紧急关停。法案划了一条硬门槛:训练算力超过 10 的 26 次方 FLOPS 的模型才受约束,目前只有少数几家顶尖实验室够得上这个标准。除了急停开关,开发商还得每年提交安全报告;一旦模型出现自我复制、绕过人类监管这类危险能力,必须立刻上...

推荐理由:加州拿出了具体的监管动作,有明确的算力门槛和上报要求,不是空喊口号。没给更高分是因为法案还在推进阶段,还没正式落地,而且正文没披露更多技术细节,实际执行效果还得看。

TechCrunch · AI

Dario Amodei 想给 AI 研发“踩刹车”,但怎么踩还没说清楚

Anthropic 的研究员刚发完末日警告一周,CEO Dario Amodei 就提出了一个安全方案,核心是靠独立评估机构,并让民主国家的 AI 实验室之间互相协调、控制研发节奏。Nvidia 的黄仁勋已经公开反对。这篇报道其实只是一个 34 分钟的视频,正文只给了标题和一段简短导语,没有披露具体的评估标准、触发机制或时间表,所以方案到底怎么落地,目...

推荐理由:Dario Amodei 提了个‘控制研发节奏’的方案,黄仁勋公开反对,话题性和相关性都拉满。但信息源只是个视频导语,没给出任何可验证的细节,知识增量基本为零,所以分数只能给到 72。

TechCrunch · AI

Automattic 33小时政变,AI实验室能自我监管吗?

Anthropic CEO Dario Amodei 提出用独立安全评估和民主国家AI实验室协调来“控制前沿”AI发展,Nvidia的黄仁勋直接反对,说不会让AI减速。WordPress母公司Automattic上演33小时董事会政变:CEO Matt Mullenweg被短暂赶下台,临时CEO和法务主管签了互惠离职协议。May Mobility通过S...

The Verge · AI

加州州长纽森在推一项 AI 紧急关停法案

加州州长纽森正在推动一项法案,要求大型 AI 模型必须内置一个“紧急关停开关”,让开发者能远程把模型停掉。法案瞄准的是训练算力超过 10^26 FLOPS 的模型——这个门槛很高,基本只卡最头部的几家。纽森团队的理由是国会中期选举前不会动,加州想先走一步。不过目前这还只是个提案,正文没披露具体的技术标准、谁有权触发开关、以及违规了怎么罚。

Hacker News 首页

一旦你停止动脑,AI 编程这条路就走不通了

Dan Luu 观察到,越来越多开发者把 LLM 的输出直接当成品用,自己只充当一个按回车键的“肉代理”。到 2026 年 9 月,这种不动脑的开发方式已经能产出勉强能跑的软件,但 Luu 的核心观点很直接:如果 AI 真强到能无监督干活,公司直接让模型自己跑循环就行了,何必还雇你这个“肉代理”?他举了几个翻车例子,比如一个 AI 棋类机器人连简单的启...

推荐理由:Dan Luu 用“肉代理”这个词把 AI 编程的核心矛盾讲透了:模型越强,不动脑的开发者就越容易被替换。观点尖锐,有 2026 年 9 月的时间戳,但缺少硬数据支撑,所以我会先打个折,给 78。

r/LocalLLaMA

Tool-Prune:0.4ms 从 50+ 工具里筛出候选,省 92% 提示词

一个叫 Tool-Prune 的小工具,能把 50 多个工具的定义(schema)快速过滤到只剩几个候选,只花 0.4 毫秒,省掉 92% 的提示词 token,而且零依赖。对需要给模型挂一堆工具的开发者来说,能明显缩短输入长度、省成本。不过 Reddit 正文被屏蔽了,没披露具体怎么剪枝的、测试环境是什么,所以算法可靠性和泛化能力暂时没法判断。

TechCrunch · AI

Manus 被 Meta 收购被北京叫停后,转头独立融资,开价 40 亿美元估值、要融 5 亿

中国 AI 创业公司 Manus 正在谈一轮 5 亿美元的融资,对应估值 40 亿美元。今年早些时候 Meta 想收购它,但被北京方面拦下,公司只好回到独立运营的路子上。这篇报道没披露领投方是谁,也没说这笔钱具体会花在哪里。

推荐理由:Manus 融 5 亿、估值 40 亿,加上 Meta 收购被北京挡下后被迫独立运营这个转折,故事性强、数字也扎实。没给更高分是因为正文没披露领投方和资金用途,关键信息有缺口,我会先打个折。

AI HOT 精选

Gary Marcus:比起失控的超级智能,更该担心的是智能体 AI 正在大规模黑掉互联网

Gary Marcus 用三件事敲警钟:OpenAI 员工账号被黑、Hugging Face 被入侵、ChatGPT 被用来写恶意软件。他认为行业整天幻想“天网”式灾难,却对眼前正在发生的事视而不见——能自主执行任务的智能体 AI 已经在规模化地攻击互联网了。他引用了《华尔街日报》一篇评论,里面点出一个关键矛盾:大模型公司把智能体产品当作上市后的主要收...

推荐理由:Gary Marcus 用三起近期安全事件搭了一个具体论点:智能体 AI 的规模化攻击比超级智能失控更紧迫。文章是评论而非一手调查,Marcus 一贯的批评立场也会让部分读者打折扣,但话题切中当下安全盲区,值得从业者看一眼。

9月18日星期五

FT · 科技

拿了亚马逊80亿、谷歌20亿之后,Anthropic开始建销售团队,安全公司的剧本要改写了

FT这篇评论说得很直白:Anthropic正在从一家安全实验室变成一家普通商业公司。拿了亚马逊80亿美元和谷歌20亿美元的投资后,它现在开始组建销售团队、追企业订单。文章的核心判断是,拿了大钱就得按商业规则玩,安全使命会被稀释。不过正文没给出具体的销售团队规模或营收目标数字,更多是趋势性评论。

The Verge · AI

三名安全研究员用 Claude 当参谋,黑进了 OpenAI 的系统

一个三人研究团队靠一张做过手脚的图片文件和论坛软件,钻进了 OpenAI 的内部系统。他们用 Anthropic 的 Claude 帮忙分析漏洞、规划攻击步骤。正文没披露他们到底看到了什么数据、OpenAI 事后有没有打补丁,也没讲漏洞的具体技术细节。

推荐理由:故事冲突感很强——用 Anthropic 的 Claude 去搞 OpenAI,天然有话题。但文章没披露漏洞细节、到底看到了什么数据、OpenAI 事后有没有修,信息密度撑不起更高分。我会先打个折,等后续技术细节出来再重新评估。

AI HOT 精选

OpenAI 和微软高管自己都说训练是“惊人盗窃”,媒体集体要求法院直接判赔几十亿美元

《纽约时报》等几家媒体联合提交了一份 92 页的动议,要求法院不经完整庭审直接判 OpenAI 和微软侵权,并索赔数十亿美元。这份文件里最扎眼的是他们自己人的话:微软应用科学总监 Brent Hecht 在内部说这种训练是“规模空前的惊人盗窃”,如果这都能算合理使用,那“合理使用就是个笑话”;OpenAI 的 ChatGPT 负责人 Nick Turl...

推荐理由:《纽约时报》等媒体直接申请简易判决,想跳过完整庭审,文件里最要命的是微软和OpenAI自己人的话。微软的Brent Hecht内部说这种训练是“规模空前的惊人盗窃”,如果这都算合理使用那“合理使用就是个笑话”;OpenAI的Nick Turley也有类似表态。这种内部打脸比任何外部专家证词都狠,等于被告自己的高管在帮原告论证“你们就是明知故犯”。我会先打个折:动议引用的内部言论是否完整、有没有断章取义,正文没披露上下文,这点先别太激动。但如果是真的,合理使用这层壳基本就碎了,索赔几十亿美元就不是空喊。对从业者来说,这案子要是判侵权,靠公开数据抓取训...

TechCrunch · AI

Meta 的 AI 助手 Muse 登陆 Mac,能直接在你的电脑应用里帮你干活

Meta 把它的 AI 助手 Muse 搬上了 Mac。跟手机版一样,它能读取你的文件、信息、日历、笔记和邮件,然后直接在原生应用里替你操作。权限是你自己按需打开的,涉及敏感操作时它会先问你一声。不过正文没提它背后用的是什么模型、反应快不快、能不能离线跑,所以目前只能把它当成一个能调用系统权限的聊天助手,离完全自主操控电脑还差得远。

推荐理由:Meta 把 Muse 搬上了 Mac,能读文件、日历、邮件,还能在原生应用里替你动手,算是桌面 agent 赛道又多一个玩家。但文章只讲了功能,没交代背后模型、响应速度和离线情况,所以目前只能当个能调系统权限的聊天助手看,离真正自主操控电脑还差一截。

彭博科技

加州州长纽森提出AI“紧急停止开关”法案,要求大模型内置强制关机功能

加州州长纽森在9月18日公布了一份AI安全法案草案,核心要求是开发者必须在AI模型里内置一个“紧急停止开关”,一旦出现安全风险,可以强制关停模型。草案还提出,训练成本超过1亿美元的大模型要接受额外监管。不过,正文没披露具体的技术标准,也没说由谁来判断什么时候该拉闸、关停之后怎么恢复。在分布式系统里让一个“总开关”真正生效,才是这件事最难的地方。

推荐理由:纽森这个 AI 紧急停止开关提案,加上 1 亿美元训练成本的门槛,是今年最具体的 AI 安全立法动作。我会先打个折,因为正文没披露技术标准、谁来判断拉闸、关停后怎么恢复——这些才是落地时真正要命的问题。

GitHub Blog · AI & ML

GitHub Podcast 拆解 AI 热门观点:该不该读代码、RAG 是否已死、Skills 是否杀死了 MCP

GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是连接工具与数据的标准,可组合使用;RAG 并未死亡,它为模型提供训练数据之外的相关信息,减少 token 浪费并让回答更有依据。

Hacker News 首页

Rickub:一个自称比 GitHub 便宜的欧洲 Git 托管服务,内置 AI 代码审查

Rickub 是一个新的 Git 托管平台,主打比 GitHub 和 GitLab 便宜,数据留在欧盟处理。功能包括代码审查、CI/CD(兼容 GitHub Actions 工作流,无需重写)、容器镜像仓库、Git LFS 和发布管理。最大卖点是 Athena,一个内置在每个合并请求里的 AI 审查助手,能生成摘要、行内评论和明确结论(通过/需修改),...

Hacker News 首页

Dan Abramov 花一个月用 Claude 搞出了一个 50 年前 Conway 猜想的 Lean 证明

Dan Abramov 用了一个月的业余时间,让 Claude 在超现实数领域挑了个问题,最终给出了 Conway 1976 年提出的“全整整数细化猜想”的 Lean 形式化证明。这个证明已经通过了 Palomar 注册中心的机械检查,但还没有数学家独立验证过。他让模型自己选领域和题目,最后因为今年是 Conway《论数与游戏》出版 50 周年,选了这...

推荐理由:Dan Abramov 的第一人称实验 + 50 年未解猜想 + Lean 机械验证通过,三个点都踩中了。但我会先打个折:目前只有机器检查通过,没有数学家独立审阅,所以数学上的分量还没坐实。82 分给的是这件事的传播力和实验示范性,不是给证明本身的数学价值。

AI HOT 精选

安全团队用 Anthropic 的 Claude Opus 5 黑进 OpenAI,拿了 6500 美元漏洞赏金

Hacktron AI 的三名研究员用 Claude Opus 5 自动化完成了一次攻击,拿下了 OpenAI 员工账号,还摸到了内部代码仓库。他们走的是 OpenAI 的漏洞赏金计划,最后拿到 6500 美元。正文没披露完整的攻击链细节和具体耗时,但确认是多个步骤串联起来的。这件事的戏剧性在于:用一家公司的模型去攻破另一家,而且双方都认了。

推荐理由:戏剧性拉满:拿一家的模型去打另一家,还成功了。TechCrunch 的信源让这事可信度不低,但正文没披露完整攻击链和具体耗时,6500 美元的赏金也说明影响范围有限,不是一次毁灭性入侵。所以重要性给到 82,先别往满分上冲。

AI HOT 精选

Justin Cormack 用 35 万行 Rust 复盘:评估 AI Agent,先拿证据,别看覆盖率

Justin Cormack 让 AI 写了一个兼容 S3 的对象存储系统,代码量干到了 35 万行 Rust。他直接拿真实的 S3 当“标准答案”来跑测试,攒了 1500 个测试用例,结果还真抓到了 S3 自己的 500 错误。他踩了几个坑:追 100% 代码覆盖率会让 AI 写一堆没用的测试凑数;AWS 的文档经常不准,AI 也不擅长从文档里挖边界...

推荐理由:这是一篇带真实数字和踩坑记录的一手实验,不是泛泛而谈。35 万行 Rust + 1500 个测试用例的规模让结论有分量。扣分点在于文章本质上是 Tessl 的品牌内容,所以没给到 85 分以上。但实验本身的方法论——拿真实 S3 当标准答案来测 AI 生成的代码——对从业者很有启发。

Hacker News 首页

给编程智能体搭“脚手架”:这篇论文测了 176 种配置,告诉你哪些组件真有用

这篇论文把编程智能体的“脚手架”(harness)拆成三个可替换的零件:规划、动作空间和上下文管理,在 SWE-Bench Verified 和 Terminal-Bench 2.1 上跑了 176 组对照实验。最核心的发现是,上下文管理在上下文窗口吃紧的时候最管用,主要靠防止上下文溢出崩掉来提分。策略上,先用规则做删减、再让模型做摘要,效率最高;把删...

MIT Technology Review · AI

AI 灭绝风险与生物武器威胁:MIT 科技评论问答

MIT 科技评论办了一场圆桌,主题是“AI 真能杀死所有人吗?”。编辑们回应了公众的担忧:这到底是真危险,还是科技公司的公关炒作?另一篇文章警告,AI 让生物武器更容易造出来——2022 年,一个分子生成器在不到 6 小时内设计了 4 万种潜在化学战剂。基因编辑和合成生物学的进步让防护更难,但科学家对威胁的严重程度仍有分歧。

MIT Technology Review · AI

AI 真能杀死所有人吗?MIT 科技评论编辑的回答:不太可能,但别不当回事

MIT 科技评论两位编辑回应读者关于 AI 存在风险的提问。记者 Grace Huckins 认为 AI 无人机已在乌克兰杀人,AI 驱动的医院网络攻击很快会出人命,但“杀死所有人”不太可能——不过末日论者对 AI 能力的预测过去几年准得让人不安。高级编辑 Will Douglas Heaven 更直接:AI 杀死全人类不可能。他认为恐怖故事脱离现实,...

AI HOT 精选

Trail of Bits 用 AI Agent 给 Miden zkVM 审计造了全套工具:LSP、反编译器、Lean 证明

Trail of Bits 在审计 Miden zkVM 之前,花了六个月让 AI agent 从零搭建了一套工具链,包括一个 LSP 服务器(让代码能跳转、看文档)、一个反编译器、一个静态分析引擎,以及一套 Lean 形式化模型。这些工具发现了真实漏洞,比如一个未校验的输入能让恶意证明者伪造 Falcon 签名、偷走账户资金。Lean 那边产出了 9...

推荐理由:Trail of Bits 花了六个月让 AI agent 从零搭了一套审计工具链,还挖出了能偷钱的真实漏洞,这是 AI 辅助安全审计里少见的硬核案例。三条 HKR 都踩中了,但安全垂直领域太专,普通读者门槛偏高,扣 3 分。

Hacker News 首页

ZCode 编程助手会悄悄上传你的整个 Git 历史,解密密钥只在 Z.ai 手里

开发者 ferstar 逆向分析了 Z.ai 的桌面编程助手 ZCode,发现只要登录,它就会把整个工作区——包括完整的 .git 历史、LFS 缓存、reflog 和全局配置——打包加密,然后传到阿里云 OSS。一个 345MB 的商业项目被压成了 313MB 的加密包,其中 .git 目录占了 86.6%。更关键的是加密方式:它用信封加密,对称密钥...

推荐理由:这是一次有实锤证据的安全披露,不是猜测。逆向分析把上传内容、加密方式和密钥归属都讲清楚了,对用 AI 编程助手的人来说是直接的风险警报。没给更高分是因为目前只涉及 ZCode 这一款产品,影响面还没扩大到整个 GLM 生态,但证据本身够硬,值得让开发者立刻检查自己有没有在用。

Hacker News 首页

OpenJev 把本地决策模型跑在浏览器里,直接读选项概率,省掉解码步骤

这是一个纯浏览器实验,把 Jev 那种直接读取选项概率的方法搬到了本地模型上。默认跑 MiniCPM5 2B,也可以切到 Qwen3 0.6B 或 Qwen3.5 4B,所有计算都在你自己的 GPU 上完成,输入不会离开页面。它对比了两种路子:一种是直接读模型对选项 token 的 logits 然后归一化,另一种是让模型一个字一个字吐出 JSON 格...

AI HOT 精选

Qwen 发布实时同传模型,延迟压到 2.3 秒,能分清谁在说话

Qwen3.8-LiveTranslate 把同声传译的延迟从上一代的 2.8 秒降到了 2.3 秒。它用了一种叫“交错架构”的方法,把音频和文字编成一条流,让模型边听边译,已经翻译过的内容可以缓存复用,所以质量比上一代有明显提升。这个模型支持 60 种语言的语音输入,新增了三个实用能力:一是实时区分说话人,多人轮流发言时能标出每句话是谁说的,并且克隆...

推荐理由:Qwen这次把同传延迟从2.8秒砍到2.3秒,靠的是交错架构和缓存复用,不是单纯堆算力。新增的说话人区分、声音克隆和双语字幕让模型从“翻译”往“场景理解”迈了一步。正文只给了官方博客,没有第三方评测或实际部署数据,所以分数没往上拉。对需要低延迟翻译的场景,这模型确实实用,但效果还得等更多人跑过才知道。

MIT Technology Review · AI

AI 造生化武器的阴影,是给生物科技行业的一记警钟

Anthropic 的 CEO Dario Amodei 和 OpenAI 的 CEO Sam Altman 最近都公开主张放慢 AI 的研发速度。前 Anthropic 研究员 Jacob Coxon 离职时直接说这两家公司都没在负责任地做事。文章把焦点对准了其中一个风险:用 AI 来设计生物武器。2022 年,有研究人员用自己开发的分子生成模型,不...

推荐理由:MIT 科技评论的长文,把 AI 和生物安全这个老话题讲出了新料。核心钩子是 2022 年那个实验——用模型真能跑出有毒分子,不是空对空喊危险。再加上前员工离职开炮,让整篇不是公关稿,而是有具体事实和内部视角的警示。不过文章本身是评论综述,不是一手爆料,话题也偏安全圈,所以分数卡在 featured 门槛。

AI HOT 精选

3人团队花不到3000美元token费,用前沿模型攻进OpenAI员工账户

一个3人团队在7月25日利用两个漏洞,直接接管了OpenAI员工的ChatGPT和Codex账户,顺带拿到了Outlook、Slack、GitHub这些关联服务的访问权限。他们没偷数据,而是往OpenAI内部代码库提了个PR来证明漏洞真实存在,全程不到72小时。攻击成本不到3000美元,全是调用前沿模型的token费用。正文没披露具体用了哪个前沿模型、...

推荐理由:这条信息密度很高,攻击路径清楚,成本数字具体,最后用提PR收尾比单纯说'发现漏洞'更有冲击力。扣分点在于正文没披露具体用了哪个前沿模型,也没说漏洞现在修没修,缺了关键的技术闭环信息。

Latent Space

AI 圈平静的一天:Claude Code 多线程、Jev 分类器、OpenAI 法律版 Astra

Anthropic 给 Claude Code 加了 Projects 功能,一个对话能同时开好几个云端线程,你走了它还能继续跑。Google 更新了 Gemini 的托管代理,新加的 Credentials API 用占位符把密钥藏起来,不让模型直接看到,号称成本能降 30%。TypeSafe 的 Jev 模型被大家当成快速路由和判断层来用,Clou...

Hacker News 首页

智谱 AI 编程工具 ZCode 被曝偷偷打包你的整个 Git 历史上传到阿里云

有用户发现,智谱的 AI 编程桌面软件 ZCode 在登录状态下,会悄悄把你整个工作区——包括完整的 .git 历史、LFS 缓存和 reflog——打包加密,然后上传到阿里云 OSS。更离谱的是,加密用的 RSA 公钥是服务器实时下发的,私钥只存在云端,你自己硬盘上那个几百 MB 的加密文件根本解不开。有人在 ~/.zcode 目录下找到一个 313...

推荐理由:一篇有实锤的安全逆向文章。作者在本地目录找到了打包好的加密文件,并确认加密密钥由服务端控制、本地无法解密,技术链路清晰。涉及智谱这样的主流 AI 实验室,且行为发生在登录状态下,对开发者信任冲击很大。我会先打个折,因为目前是单人逆向发现,还没有更多第三方复现或智谱的正式回应,但现有证据已经足够让用户警惕。

AI HOT 精选

WSJ:三名研究员用 Claude Opus 5 把 Discourse 漏洞串起来,拿到了 OpenAI 的私有代码访问权

WSJ 的报道说,三名研究员用 Claude Opus 5 把一个 Discourse 论坛的漏洞一步步串联利用,最终拿到了 OpenAI 员工的认证 token。这些 token 里有一部分还能直接用在 ChatGPT 上,并顺着摸到了 OpenAI 的 GitHub 服务,等于看到了私有代码。报道没写漏洞具体怎么被利用的,也没提 OpenAI 事后...

推荐理由:WSJ 的报道本身信息有限,没写漏洞怎么被利用的,也没提 OpenAI 事后怎么处理,所以判断要留余地。但 Claude 被用来打穿 OpenAI 的认证体系、看到私有代码,这个事实本身就够有冲击力,安全圈和 AI 能力评估的人都会盯着讨论。

FT · 科技

乌克兰AI实战经验领先西方数年,北约被批研发太慢

FT这篇评论说,乌克兰已经在实战中用AI做无人机目标识别、战场态势感知和决策辅助,而西方军队的AI还停在实验室和演习阶段,被官僚和采购流程拖慢。文章没提具体用了什么AI系统或技术参数,但核心判断是:北约再不把AI研发优先级提上来,下一场冲突就要落后。对AI从业者来说,这算一个现实案例——AI在战场上的落地速度,主要卡在组织流程而非技术本身。

FT · 科技

医疗AI缺的不是技术,是证据

FT 这篇评论的核心观点:医疗 AI 在实验室里表现不错,但一到临床就缺大规模随机对照试验(RCT)来证明它真的有用。很多模型发论文好看,实际部署时监管机构和医院不敢用,因为验证标准太松。文章没点名具体公司或模型,但点出了一个根本矛盾:技术跑得比证据快。对从业者来说,这意味着如果你的医疗 AI 产品想进医院,光刷榜不够,得补临床验证的课。正文没披露任何...

Hacker News 首页

Waymo 宣布进入新加坡,用纯电自动驾驶车队做网约车

Waymo 要把它的纯电自动驾驶网约车带到新加坡了。车顶装了摄像头、毫米波雷达和激光雷达,能看周围 300 米,号称 360 度无死角。公司说这会配合新加坡 2030 绿色计划和现有公交,主打零排放、更安全和方便老人出行。但正文没提具体什么时候上线、车队规模多大、怎么收费,目前只能留个邮箱等通知。

Product Hunt · AI

Mantle:用自然语言描述业务逻辑,自动生成后台管理界面

Mantle 让你用大白话描述后台逻辑,就能自动生成管理界面、MCP 和 WebMCP。目前只有 Product Hunt 页面,没有详细文档或演示视频,所以代码质量、支持哪些数据源、能不能自定义 UI 组件都不清楚。如果真能跑通,对快速搭内部工具的人来说挺省事。

FT · 科技

OpenAI 推迟上市,软银 500 亿美元数据中心 IPO 少了一张关键王牌

OpenAI 把上市时间表往后推了,这让软银正在筹备的 500 亿美元数据中心 IPO 压力陡增。软银原本打算拿 OpenAI 的长期租赁承诺当卖点去吸引投资者,现在这张牌暂时打不出来了。文章没提 OpenAI 为什么推迟、新时间表是什么,也没说软银会不会调整定价或路演计划。

Hacker News 首页

Devin 推出 Code Scans:把“提升 SEO”这类模糊目标,直接变成可合并的 PR

Devin 新功能 Code Scans 让你不用先搞清楚改哪个文件,直接告诉它一个工程目标,比如“加快编译速度”或“减少维护负担”,它就能自动扫描代码库、找出问题,并生成可以审查的 PR。它背后用了一种叫 Agentic MapReduce 的并行调度方法,把大任务拆给多个代理同时干。Philips 团队试用后说,PR 合并率有 96%,省了 700...

推荐理由:Devin 这次把工程意图直接转成可审查 PR 的产品角度挺新鲜,Agentic MapReduce 的机制和 Philips 的 96% 合并率、700 小时节省都是具体证据。没给更高分是因为这还是一条厂商自己发的功能更新,客户案例细节有限,长期效果得再观察。

AI HOT 精选

黑客利用 libheif 漏洞和 OpenAI SSO 缺陷,72 小时内接管员工 ChatGPT 账户

安全公司 Hacktron 在 2026 年 7 月披露了一条攻击链:先利用 libheif 图片解码库的堆缓冲区溢出漏洞(Debian 安全补丁没打上),通过 ImageMagick 和 Discourse 论坛的图片上传功能,在 community.openai.com 上拿到远程代码执行权限和论坛管理员权限。接着利用 OpenAI 单点登录(SS...

纽约时报中文网

中美担心的根本不是同一种 AI 风险

Kyle Chan 在纽时发文指出,美国 AI 圈怕的是模型自我迭代失控、变成生存威胁;中国决策者觉得那个起飞点还很远,眼下更怕深度伪造、政治敏感内容和社会不稳。最近几件事——OpenClaw 数据泄露警告、Mythos 模型网络攻击能力、以及一个能快速破解微信账号的 AI 工具——让北京也开始认真对待网络安全和模型失控这两类风险。Chan 建议,与其...

推荐理由:纽时观点文章,不是一手报道,但信息密度够。用三个具体事件把中美风险认知的分岔讲透了,不是泛泛而谈。我会先打个折:原文是评论性质,且摘录较短,但角度新鲜、信息有料,值得推给从业者看。

Hacker News 首页

Orbital:开源版 Claude Project,对话上下文归你,agent 随便换

Orbital 是一个刚上 GitHub 的开源项目(277 星),口号是“上下文归你,agent 可替换”。它把 Claude Project 里锁在平台里的对话上下文变成可复用的资产,你可以导出、换模型、换 agent 流程。如果你受够了 Claude Project 不能导出上下文、不能换 agent,这个值得看。正文没披露支持哪些模型、是否兼容...