跳到正文

#大佬观点

今日 1 条

4月17日星期五

Dwarkesh Patel 访谈

黄仁勋:美国应该继续卖芯片给中国,放弃 40% 的全球科技市场是帮倒忙

黄仁勋的核心逻辑是:中国占全球科技产业约 40%,如果美国主动退出这个市场,等于把开发者生态和模型优化方向拱手让给华为等中国硬件。他举了个例子——假如 DeepSeek 这类模型优先针对华为架构做优化,而不是跑在英伟达的 CUDA 生态上,那对美国技术栈的长期伤害比单次禁售大得多。他承认华为去年业绩很好、一批中国芯片公司已经上市,而英伟达在中国市场的份...

推荐理由:黄仁勋这段表态信息密度挺高。他没用常规的“禁售会丢订单”那套说辞,而是换了个角度:不卖芯片等于把开发者生态和市场份额拱手让人。40% 这个数字他直接挂在中国科技产业的体量上,意思是放弃这个盘子,美国技术栈的根基会变薄。他还拿 DeepSeek 举例,说如果这类模型先跑去适配华为硬件,美国反而被动——这比泛泛谈风险更有画面感。另外他点了一句 Nvidia 芯片强不光是算力,还在于编程上手容易、生态完善,这其实是在提醒大家,禁售真正伤的是生态绑定,不是一次买卖。整体是个短平快的观点输出,不是深度分析,所以重要性没给太高,但三个维度都踩中了。

最佳拍档

同事.skill 爆火背后:它只是提示词的工程化封装,炼化不了任何人

最近 GitHub 上一个叫“同事.skill”的项目几天就拿了 1.3 万颗星,还衍生出前任、老板、甚至女娲.skill,网上开始流行“散是 Token,聚是 Skill”这种说法,搞得很多人担心自己会被炼化成数字文件、被公司替代。这个视频把技术逻辑拆得很清楚:Skill 的源头是 Anthropic 在 2025 年 10 月给 Claude 上的...

推荐理由:这篇属于二次解读,不是一手发布或实测,但把Anthropic的Agent Skills开放标准和GitHub上爆火的“同事.skill”项目串起来了。我会先打个折,因为正文没披露跨平台兼容率和法律认定标准,这两个缺口让结论没法坐实。亮点在于它没吹“数字分身”,而是把边界说清楚了:适合周报、文档、代码审查这类标准化流程,强制上交反而会炼出废话。对关心工具落地和版权风险的从业者来说,这篇值得一看,但别当产品评测用。

Hacker News 首页

AI 算力开始不够用了

Nvidia Blackwell GPU 的租赁价两个月内从每小时 2.75 美元涨到 4.08 美元,涨了 48%。CoreWeave 也把价格上调了 20%,最低租期从一年拉长到三年。OpenAI 的 CFO 说他们已经在砍项目,因为算力跟不上。Anthropic 最新的模型只给了大约 40 家机构用。作者判断,AI 算力随便用的阶段结束了,接下来...

推荐理由:这篇文章用一个涨价 48% 的数字开场,把算力稀缺从概念变成账单,读起来像朋友发来一条消息说“显卡租金涨了,注意一下”。它没有停留在感叹,而是把 Blackwell 租金、CoreWeave 提价和 Anthropic 限流三件事摆在一起,指向一个判断:稀缺已经开始改写前沿模型的获取门槛。正文没给更细的供需数据或各家采购策略,所以我会先打个折,不把它当一手情报,但作为提醒从业者盯紧成本与容量的信号,已经够用了。

X · @dotey(宝玉)

Boris Cherny 分享 Claude Opus 4.7 深度使用技巧:自动模式、回顾与 /go 工作流

Boris Cherny 根据自己几周的高强度使用,给出了几个让 Claude Opus 4.7 更顺手的实操方法。新加的“自动模式”让模型自己判断命令是否安全并自动执行,不用再频繁点确认,适合跑长时间任务。如果不想全自动,可以用 /fewer-permission-prompts 技能,把安全但总弹窗的命令加进白名单。“回顾”功能会帮你自动总结已完成...

推荐理由:这篇是实战笔记,不是产品公告。HKR 三项都踩实了:/go 把测试、清理、提 PR 串成一条线,钩子够强;Auto mode、Recaps、Focus mode 的用法具体可复现;Claude Code 用户对审批限制的焦虑被直接回应。正文没给价格、上线时间和性能跑分,所以别当评测看,重点盯工作流怎么变。

TechCrunch · AI

Adobe 数据:一季度美国零售商来自 AI 的流量同比涨了 393%,而且这群人更肯花钱

Adobe 周四发了一份报告,说 2026 年第一季度美国零售网站从 AI 助手(比如 ChatGPT、Perplexity 这类产品)过来的流量比去年同期多了 393%。单看 3 月,这个数字是 269% 的增长,去年年底购物季更猛,涨了 693%。报告还提到,从 AI 渠道点进来的访客,转化成下单的比例更高,带来的收入也更多。但正文没披露转化率和收...

推荐理由:我会先打个折:这是二手报道,数据来自 Adobe,TechCrunch 转述,没给原始报告链接。393% 的同比涨幅确实抓眼球,假日季 693% 更夸张,说明消费者在用 AI 助手逛店这件事上已经形成习惯。但正文只说了“转化更好、带来更多收入”,没给具体转化率提升或收入增幅,这点先别太激动。对做电商和做模型的人,真正的信号不是流量涨了多少,而是流量入口在变——AI 导购正在变成一个新的分发层,谁占住这个入口,谁就拿走后面的交易。这个趋势比一个季度的百分比重要得多。

4月16日星期四

Ben's Bites

Ben 的上下文清理小抄:别让 AI 被垃圾信息喂饱

Ben 在飞往旧金山的航班上没网,临时下载了 Gemma 4 26B 模型离线干活,顺便分享了他管理 AI 上下文窗口的几条硬经验。核心观点是:别迷信 100 万 token 的超长窗口,他根本不信任那种窗口下的稳定记忆,任务所需的完美回忆不该超过 15 万 token。他建议在上下文用量达到 60% 左右就收手,因为网页搜索会塞进大量你来不及看的 A...

推荐理由:这是一份个人工作流笔记,不是产品发布或论文,但给出的 60% 上下文红线和对 1M token 记忆的不信任,对天天跟 agent 打交道的人有直接参考价值。我会先打个折:正文没披露这些数字背后的系统测试,更像经验之谈,但胜在具体、可验证。污染链条那段提醒很实在,长上下文不是越大越好,垃圾进去只会放大。

Hacker News 首页

AI 挖漏洞不是拼算力,模型智商才是天花板

antirez 拿 OpenBSD 的 SACK 漏洞举例,说了一个反直觉的结论:用 AI 找代码漏洞,堆 GPU 多跑几次没用。因为代码能走的执行路径是有限的,跑再多轮也会饱和,最终卡住你的是模型本身的智商,而不是采样次数。弱模型就算给它无限的 token,也永远没法把“窗口校验缺失”“整数溢出”“不该为空的指针分支”这三件事串起来,所以找不到真漏洞...

推荐理由:antirez 这篇不是论文,更像一篇带实验的博客。核心判断很明确:AI 找漏洞的上限卡在模型本身的智力水平,不是 GPU 数量。他用 OpenBSD 的 SACK bug 做了个可复现的测试——弱模型就算给你无限 token,也串不起来窗口校验、整数溢出和 NULL 分支这三件事,路径会饱和。这个结论对天天在算成本和效果的人有用:与其无脑加采样,不如盯模型质量和获取速度。我会先打个折,正文没给大规模对比数据,更像单点验证,但逻辑链条清楚,值得一看。

Latent Space

GitHub 首次允许开源仓库禁用 Pull Request,AI 编程正在淘汰这套用了 21 年的协作流程

GitHub 最近悄悄上线了一个新选项:开源仓库可以彻底关掉 Pull Request 功能了。这是 PR 诞生 21 年来的头一遭。文章把这看作一个信号——AI 写代码的 workflow 已经变了,人和人之间那套基于 Git 的协作方式,可能不再适合 agent 之间打交道。Pete Steinberger 等人早就公开说过只想要 Prompt R...

推荐理由:这不是 GitHub 的官方公告,但它把一个具体改动——开源仓库可以关掉 PR——变成了对 agent 编码工作流的直接提问。我会先打个折:正文没披露有多少仓库实际用了这个设置,也没给出 agent 提交的规模数据,所以判断只能停在“信号”层面。不过它把 OpenAI Agents SDK、Cloudflare 等新 agent 栈和“提示提交”、沙箱执行串在一起,指向一个真问题:Git 工作流还能不能接住 agent 协作。这点先别太激动,但值得盯。

X · @dotey(宝玉)

模型不是笨,是 Harness 没配好

若石的博客把多步智能体跑崩的锅从模型身上拿开,扣在了工程约束没跟上。文章提出 Harness Engineering 四个原则:能用代码约束就别靠模型自觉,比如 JSON 输出直接上 Schema 校验,非法就回炉;关键状态外置到 state.json,崩了重启还能接着跑;验收必须交给独立的 Evaluator 模型或真执行一下,别让模型自评;失败要局...

推荐理由:这篇是转述若石的博客,没有披露成功率提升的具体数字,我会先打个折。但它的判断很直接:agent 多步任务老翻车,问题出在 Harness 没配好,不是模型不行。给出的 70% 上下文阈值、日志压缩、状态外置和 Schema 重试都是可落地的工程动作,对正在调 agent 的人有参考价值。

最佳拍档

Demis Hassabis 罕见袒露心声:AGI 应在实验室多沉淀十年,后 AGI 时代五十年内或成真

DeepMind CEO Demis Hassabis 在这场访谈里没怎么画饼,反而直说现在的 AI 发展节奏被商业和地缘政治推得太快,不是他理想的路子。他个人的想法是,把 AGI 相关技术在实验室里像欧洲核子研究中心那样再打磨十到二十年,每一步都彻底搞懂再往前走。他举了 AlphaFold 的例子,当初团队本打算按传统方式搭服务器让科学家排队提交任务...

推荐理由:这篇是访谈的二次整理,不是模型发布或政策文件,所以分数没拉满。但 Demis 的时间线判断、实验室沉淀主张、300 万用户和近 20 条药物管线的数据,以及他点名 2 到 4 年内的两类风险,信息密度够高,对从业者判断行业节奏和安全优先级有参考价值。

Dwarkesh Patel 访谈

黄仁勋谈英伟达护城河:不是芯片设计,是把电子变成 token 的那一整条供应链

黄仁勋把英伟达的生意概括成一句话:输入电子,输出 token,中间是英伟达。他认为护城河不在某颗芯片的设计,而在于把电子变成有价值的 token 这件事本身极其复杂,涉及大量科学和工程,短期内很难被商品化。他举了两个具体机制:一是上游的显性和隐性采购承诺,财报里披露了近 1000 亿美元的承诺,SemiAnalysis 估算实际规模可能到 2500 亿...

推荐理由:黄仁勋亲自下场解释护城河,不是讲芯片设计,而是讲从电子到 token 的全栈优化和上下游组织能力。文章给出了接近 1000 亿美元的采购承诺数字,SemiAnalysis 还报过 2500 亿的可能,上游用大额显性和隐性承诺锁晶圆、HBM 和封装,下游把模型方、整机厂和开发者拉进同一个生态。他还提到 agent 数量会指数增长,工具软件实例跟着涨。这些判断直接打在算力成本、供应安全和生态依赖上,对从业者判断供应链和选型有参考价值。不过正文没给出 2500 亿的具体来源和验证方式,这点先别太激动。整体是强观点评论,不是新品发布、财报或研究论文,所以分...

4月15日星期三

最佳拍档

OpenClaw 创始人彼得·斯坦伯格回应闭源争议:项目不会闭源,已引入英伟达等多家企业共建以保持中立

OpenClaw 创始人彼得·斯坦伯格在 2026 年 4 月的 AI Engineer 大会上明确表示,加入 OpenAI 后项目不会闭源,控制权仍在自己手里。他主动引入英伟达、微软、腾讯等多家企业参与共建,其中英伟达派驻了全职工程师,以此对冲单一公司的影响。OpenClaw 上线 5 个月提交近 3 万次,贡献者近 2000 人,增长曲线近乎笔直。...

推荐理由:HKR 三项都站得住:闭源疑问是个好钩子,演讲里也掏出了提交量、安全通告和 Fast Mode 的实测数据。分数卡在 featured 门槛附近,因为本质上是 YouTube 演讲 recap,梦境功能等几个吊胃口的东西没给实现细节或发布时间,我会先打个折。

4月14日星期二

最佳拍档

H100 租赁价五个月涨近 40%,全球 GPU 算力全面断供

SemiAnalysis 的报告显示,从 2025 年 10 月到 2026 年 3 月,英伟达 H100 的一年期租赁价格从每小时每 GPU 1.70 美元涨到了 2.35 美元,涨幅接近 40%。现在想租一个 64 块 GPU 的小集群都很难,现货市场基本无货可租。需求端主要被几件事同时推着走:Anthropic 的 Claude 产品收入一个季度...

推荐理由:我会先打个折:这是对 SemiAnalysis 报告的二次视频解读,不是一手厂商公告,所以没给 P1。但内容本身够硬——H100 租金五个月涨 40%,背后是 Anthropic 需求拉升、多智能体工作流和音视频生成把 token 消耗推高,加上内存价格翻倍涨,供给端根本接不住。正文没披露具体调研方法,但 100 多家供应商的样本量和现货 14 美元的极端报价,让判断有底。对正在做模型或搭 agent 的团队来说,这比换代传闻更肉疼,所以 HKR 全中。

X · @dotey(宝玉)

与其说 AI First,不如先把测试、CI/CD 和监控这些软件工程的基础搭好

这篇文章的核心判断是:AI First 不是买几个 AI 工具订阅就能跑通的,它首先是一道软件工程题。AI 两小时写完代码,如果审查、测试、部署、监控和回滚还得靠人慢慢排队,瓶颈就从写代码转移到了 QA 和运维,25 人的团队照样快不起来。作者列出了几个硬性前提:自动化测试覆盖得够,不然每次 AI 提交你都得人工回归;CI/CD 流水线要全自动跑通,代...

推荐理由:这是一篇从业者视角的评论,不是新闻事件。H 分给那个反直觉的标题翻转,K 分给具体的工程前提和适用边界,R 分给瓶颈转移的痛点论述。分数停在 75 左右,因为正文没有给出具体案例、一手测试数据或团队规模外的量化验证,更像经验判断。

OpenAI News

OpenAI 推出 GPT-5.4-Cyber,把高能力模型专门开放给安全防御人员用

OpenAI 宣布扩大“网络可信访问(TAC)”计划,并发布 GPT-5.4 的一个变体 GPT-5.4-Cyber,这个模型在网络安全任务上放得更开,专门给经过身份验证的防御人员使用。目前计划覆盖数千名个人防御者和数百个负责关键软件安全的团队。文章说,AI 帮防御者更快发现和修复漏洞,但攻击者也在用,所以不能等风险到某个临界点再行动。他们的思路是:用...

推荐理由:OpenAI 把 TAC 的盘子说清楚了——几千个验证过的防御者、几百个关键软件团队,而且明确跟 GPT-5.4-Cyber 和后续发布挂钩。话题踩在“谁能用最强模型搞安全”的争议线上,HKR 三项全中。不过正文只给了摘要,模型指标、评估方法和具体准入条件都没展开,所以放在 featured 而不是 p1。

X · @dotey(宝玉)

Claude Code 关掉遥测后缓存从 1 小时掉到 5 分钟,工程师解释是实验开关失效,不是故意惩罚

开发者 Can Vardar 发现 Claude Code 关闭遥测后,提示缓存时间从 1 小时骤降到 5 分钟,他算了一笔账说这是用隐私换 12 倍性能。Anthropic 工程师 Boris Cherny 回应说,1 小时缓存写入成本高、读取成本低,不是无条件更好,如果你只跑一次查询就走,1 小时缓存反而浪费钱。关遥测导致缓存变短,是因为客户端的实...

推荐理由:这条信息对Claude Code用户很实用,把隐私开关和缓存成本的关系讲清楚了。我会先打个折:来源是X上的工程师回复,不是正式公告,但机制解释和后续计划都来自Anthropic员工,可信度够。正文没披露环境变量什么时候上线,这点先别太激动。

4月13日星期一

最佳拍档

谷歌CEO皮查伊:2027年是企业AI落地爆发年,搜索不会死,会变成替你干活的管家

谷歌CEO皮查伊在2026年4月的一次专访里,把家底和判断都摊开了。他说明年(2027年)会是企业AI agent workflow(让模型进业务流程干活)的爆发点,AI将从程序员提效工具变成非技术岗位的智能核心。关于搜索,他认为不会被聊天机器人取代,而是会进化成一个“Agentic Manager”,能直接帮你规划旅行、处理多线程任务,他自己已经在用...

推荐理由:这不是产品发布,而是高管在访谈里给出的判断和内部数据,信号密度很高。Pichai 把 2027 年定为 Agent 爆发点,配合千亿级资本开支和毫秒级延迟管控,让这个判断比一般预测更有分量。搜索演进和算力稀缺这两条线也直接关联从业者当下的决策。分数没给到 P1,因为信息来自二手转述而非一手访谈原文,但 H、K、R 三项都扎实成立。

4月11日星期六

X · @dotey(宝玉)

OpenAI Codex 工程师:别反复给 AI 喂脏数据,给它造几个专用命令行工具

OpenAI Codex 团队的 Nick Baumann 分享了一个干活技巧:与其每次把文档、日志、API 输出整坨丢给 AI 去啃,不如把常用操作封装成带参数、输出 JSON 的 CLI 命令。Codex 本身就擅长用命令行,会自己搜命令、加 flag 筛选、把上一个命令的结果串到下一个,不需要你教它怎么调。他自己日常用三个自建工具:codex-t...

推荐理由:这是 OpenAI Codex 团队成员写的日常心得,不是正式发布,但提供了一个很实用的机制:把杂乱的日志、文档、API 输出包成带参数、返回 JSON 的 CLI 命令,让模型去调这些窄接口,而不是直接读原始数据。文章给了三个他自用的工具,教程和 skill 也放到了开发者文档里。没有基准测试、规模数据或重大产品更新,所以分数打 75。

4月8日星期三

MIT Technology Review · AI

微软 AI 老大苏莱曼:AI 发展离撞墙还早,算力暴涨是核心

这是微软 AI 的 CEO 苏莱曼在《麻省理工科技评论》上发的评论文章,不是独立研究,立场上我会先打个折。他的核心论点是:AI 训练用的算力从 2010 年到现在涨了 1 万亿倍,从 10 的 14 次方次浮点运算涨到 10 的 26 次方,所以短期内不会撞墙。他给了几个具体数字:英伟达芯片六年里单颗性能翻了 7 倍多;HBM3 这种堆叠式高带宽内存把...

推荐理由:HKR 三项都站得住:Suleyman 在扩展争论里立场很硬,并且甩出了 10^26 flops、7 倍芯片提升、3 倍带宽和 8 个月效率减半这些数字。分数定在 82,因为这是高管观点文,不是独立研究,而且 2030 年每年新增 200GW 算力那个数怎么算出来的正文没交代。

Latent Space

OpenAI 内部团队用 5 个月跑出一个零人工代码的项目,每天烧掉 10 亿 token

Ryan Lopopolo 的团队在 OpenAI 内部搞了个极端实验:5 个月里搭出一个超过 100 万行代码的仓库,所有代码全由 Codex 生成,合并前没有任何人工审查。他们每天消耗超过 10 亿 token,按市价估算大概一天要花 2000 到 3000 美元。团队的核心思路是,当 AI 写代码卡住时,不去教它怎么改 prompt,而是回头补上...

推荐理由:这篇是访谈转述,不是官方发布,所以我会先打个折。但内容确实有料:OpenAI Frontier 团队用 5 个月搭了个内部测试产品,代码库超 100 万行,每天消耗超 10 亿 token,合并前完全没人类写码也没人类审查。具体做法是把失败拆成缺能力、缺上下文、缺结构三类,然后用 Symphony 多代理编排、规格文档、测试、可观测性和 1 分钟内构建循环来兜底。真正值得盯的是他们说的那句话——流程重心从人审代码转到了人设计 harness。价格估算约 2000 到 3000 美元一天,但正文没披露独立验证,这点先别太激动。

4月7日星期二

MIT Technology Review · AI

经济学家说,判断 AI 会不会抢你饭碗,缺的不是任务清单,而是“降价后需求涨多少”的数据

芝加哥大学经济学家 Alex Imas 认为,现在大家用任务暴露度(比如 OpenAI 说房产中介有 28% 的工作能被 AI 干)来预测失业,基本没用。真正关键的数据是行业层面的价格弹性——也就是 AI 把成本打下来之后,降价能不能把需求拉到足够大,大到反而要多雇人。他举了个例子:一个写约会 App 的程序员用 AI 一天干完三天的活,公司成本低了,...

推荐理由:这篇文章没给新数据集,但把讨论从“暴露度”拽到了“价格弹性”上,思路值得留意。我会先打个折:正文没披露现成的全经济弹性数据,所以目前还是个框架,不是可操作的结论。OpenAI 那个 28% 暴露度数字和 Anthropic 用 O*NET 做对话比对是实在的锚点,让讨论没飘在空中。对关心岗位替代的从业者来说,这篇文章提醒你别只盯暴露度,需求侧的反应可能才是决定性的——这点先别太激动,但方向对。

4月6日星期一

X · @dotey(宝玉)

小米罗福莉:Agent 时代算力跟不上 Token 烧法,出路不是降价而是省 Token

小米 MiMo 团队负责人罗福莉指出,现在 Agent 干活时反复带着超过 10 万 Token 的长上下文去调工具,请求次数是 Claude Code 自身框架的好几倍,真实 API 成本可能冲到订阅价的几十倍,全球算力根本扛不住。她认为短期阵痛反而是好事,第三方框架被 API 付费逼着去改进上下文管理、提高缓存命中率、砍掉无效消耗。同时她呼吁大模型...

推荐理由:小米 MiMo 负责人罗福莉这次发言没绕弯子,直接拿 OpenClaw 和 Claude Code 的请求次数做对比,把 Agent 多轮工具调用带来的 Token 消耗和成本膨胀讲得很清楚。10 万 Token 上下文反复携带、请求量高出数倍、API 计费后成本翻几十倍,这些数字让“算力跟不上”的判断有了抓手。正文没给具体定价方案,也没公开测试环境,所以结论先打个折,但方向对做推理优化和框架选型的人有参考价值。

4月4日星期六

Latent Space

Marc Andreessen 反思浏览器之死、Pi/OpenClaw 架构,以及为什么“这次不一样”

Marc Andreessen 在播客里聊了 76 分钟,核心观点是这波 AI 跟 2016 年那波不一样,因为现在有了推理、写代码、让模型进业务流程干活(agent)和模型自己改进自己的能力。他提了一个很具体的架构思路:Pi 和 OpenClaw 把大模型、命令行、文件系统、markdown 和定时任务串在一起,让 agent 的状态直接存成文件,这...

推荐理由:这是一篇观点驱动的评论,不是市场事件。我会先打个折:正文没给浏览器消亡的时间表或产品路线,所以别当预言看。真正有料的地方是他把 agent 的文件状态和可移植性类比 Unix,而不是再念一遍 scaling law 的经。HKR-H 来自标题的钩子效应,HKR-K 来自 Pi+OpenClaw 这套可复现的机制,HKR-R 来自界面与分发这个敏感话题;缺路线图、缺指标、缺发布细节,所以放在 featured 的低位。

4月3日星期五

X · @op7418(歸藏)

Karpathy 用 Obsidian 和大模型搭了一套本地知识库,把原始资料自动整理成可提问、可写报告的 Wiki

Karpathy 的做法是把原始资料扔进一个叫 RAW 的文件夹,让大模型自动生成摘要、索引、概念页、相互链接和可视化图表,最终形成一个本地 Markdown Wiki。之后可以直接在这个 Wiki 上提问,模型会查索引、读相关文档再给出回答或生成新文件、网页甚至 PPT,并把输出存回知识库。他特别提到 AI 生成的内容会污染语料,要把可信来源和 AI...

推荐理由:HKR-H 和 HKR-R 都站得住,因为 Karpathy 这种级别的从业者公开自己的本地 Wiki 工作流,本身就自带讨论度,而且他点出的“AI 生成内容会污染库,最好跟可靠来源分开”是个很实际的痛点。HKR-K 靠的是 RAW→LLM→摘要/索引/互链这条具体管线,但正文没披露用了什么模型、资料规模多大、自动化脚本怎么写,所以知识增量卡在中等偏上,分数停在 76 合理。

X · @dotey(宝玉)

晚点发了一篇 DeepSeek 深度报道,讲 V4 发布前的人员变动、路线选择和梁文锋的管理逻辑

晚点 LatePost 这篇报道卡在 V4 发布前夕,信息量不小。先说人员:DeepSeek 确认走了四位核心成员,包括 R1 核心作者郭达雅(近期离职,可能去大厂)、第一代 LLM 作者王炳宣(去年底被腾讯挖走),以及 OCR 和多模态方向的两位。猎头开价翻 2 到 3 倍,有的公司直接给 8 位数总包,而 DeepSeek 的期权没标价,让一些人心...

推荐理由:这不是 V4 发布,但信息量够硬:4 人离职确认、发布推迟到 4 月、100 多人的研究团队规模、猎头报价翻倍,还有算子库迁移到 TileLang 的路线变化。HKR 三项都站得住。正文没给 V4 的参数、价格和基准成绩,所以到不了发布级或 p1,但作为 V4 前的信号已经够看了。

4月1日星期三

MIT Technology Review · AI

在家训练人形机器人的零工:尼日利亚医学生头顶 iPhone 拍做家务

Micro1 这家公司雇了 50 多个国家的几千名零工,让他们把 iPhone 绑在头上,拍自己叠被子、洗碗、做饭的视频,再把这些真实动作数据卖给做人形机器人的公司。一个尼日利亚的医学生时薪 15 美元,在当地算高收入,但他觉得每天重复熨衣服很无聊。文章说 2025 年人形机器人拿到的投资超过 60 亿美元,机器人公司每年花在买这类数据上的钱超过 1 ...

推荐理由:这篇我会放进 featured。在家拍家务视频这个画面本身就够抓人,而且文章给出了规模、薪酬和支出的具体数字,不是空谈。更值得盯的是它把一条隐藏的数据管线摊开了:工人知道视频是给机器人训练用的,但正文没披露这些数据怎么存、跟谁共享、能不能删。这种治理上的模糊,比融资数字更说明行业现在还处在野蛮生长阶段。

硅谷101 播客

E231|从B2B到A2A:阿里国际张阔谈AI如何把采购沟通从一周压到一天

阿里国际总裁张阔在访谈里给了个很具体的数字:他们的采购AI产品Accio,能把跨境采购的沟通时间砍到原来的五分之一,从大概一周变成一天。怎么做到的?就是把市场调研、设计稿生成、跨语言沟通、供应商筛选这些环节串成一条AI工作流,让买家带着专业的设计包去跟卖家谈,而不是从零开始比划。Accio今年3月月活到了1000万,还在逐月快速增长。张阔的核心判断是B...

推荐理由:这不是一次大版本发布,但它是高管一手访谈,有 1000 万月活和采购周期压缩到五分之一这两个硬数字。HKR 三项都踩中了,不过事件分量还够不上模型发布或重大产品更新,所以放在 featured 而不是 p1。正文把 A2A 解释成买卖双方和平台流程都由 Agent 重构,这点比单个产品数据更有看头,但具体技术细节和验证方式没展开,我会先打个折。

3月31日星期二

OpenAI News

OpenAI 完成 1220 亿美元融资,估值冲到 8520 亿

OpenAI 今天宣布完成了一轮 1220 亿美元的融资,投后估值 8520 亿美元。这轮由亚马逊、英伟达、软银领投,微软、a16z 等也继续跟投,还首次通过银行渠道向个人投资者募了超过 30 亿美元。公司同时把循环信贷额度提到了约 47 亿美元,但正文说目前还没动用。我会先打个折:这些数字主要说明 OpenAI 现在能调动的资金量级很大,但具体怎么花...

推荐理由:这篇东西挺奇怪的:OpenAI 发了一篇叫《加速 AI 下一阶段》的文章,但正文是空的,只有标题和链接。我会先打个折——它没披露任何产品、研究或政策细节,所以没法判断它到底想加速什么。标题本身有话题性,但信息量为零,这点先别太激动。

3月26日星期四

硅谷101 播客

E230|1万亿收入预期背后:英伟达的巅峰与软肋

黄仁勋在GTC上说,到2027年底,Blackwell和Vera Rubin两个平台的累计订单预计至少1万亿美元,而2024年全球半导体产业总销售额也就6000多亿美元。这期节目请了投资人、前英伟达芯片设计负责人和芯片架构师,一起拆解这个数字能不能落地。讨论认为,需求端确实旺盛,推理成本正在追上训练成本,未来Agent智能体铺开后Token消耗会更大。...

推荐理由:这篇不是照搬GTC通稿,而是把1万亿订单这个标题往回拉,提醒真正该盯的是封装、显存和供电。对从业者来说,知道成本能降多少、瓶颈在哪,比看销售数字有用。我会先打个折:正文没给出1万亿订单的具体构成和交付节奏,这点先别太激动。

3月25日星期三

MIT Technology Review · AI

AI 炒作指数:AI 上战场了

Anthropic 和五角大楼因为怎么把 Claude 模型武器化吵了一架,结果 OpenAI 用一笔被自家 CEO 称为“机会主义且草率”的交易截了胡。用户开始大批退订 ChatGPT,伦敦也爆发了迄今最大规模的反 AI 游行。讽刺的是,以伦理立身的 Anthropic,现在正帮着美军加速对伊朗的打击。另一边,AI 智能体在网上火了:OpenAI 挖...

推荐理由:这条放 featured 没问题,因为 H 和 R 都拉满了:模型供应商跟军方挂钩,话题性够强,也确实是行业神经。K 这边我会先打个折,正文没披露任何合同细节,连抗议规模都没提,所以别急着下结论说合作有多深。

3月24日星期二

Lex Fridman 播客

黄仁勋对谈 Lex Fridman:英伟达如何从单卡竞争转向整机柜、整数据中心的极端协同设计

黄仁勋在播客里解释了英伟达现在为什么要搞“极端协同设计”——因为单颗 GPU 已经不够用了。你想让一万台计算机跑出百万倍的加速,就不能只堆硬件,得把算法拆开、把模型和数据切碎(分片),让网络、交换、存储、供电、散热全部配合起来。否则受制于阿姆达尔定律,计算部分再快,整体也只快一点点。他还提到自己直接管 60 多个人,几乎全是工程背景,分别盯着内存、CP...

推荐理由:这是一手访谈,黄仁勋把 NVIDIA 的竞争逻辑讲得很清楚:不再拼单卡,而是拼整机柜甚至数据中心的协同设计。他提到 60 多个直接下属、1 万台计算机的扩展目标,以及 Amdahl 定律带来的实际限制,信息密度高。我会先打个折,因为这是播客分析,不是新产品发布或人事变动,但作为理解 NVIDIA 战略的入口,值得从业者花时间看。

3月19日星期四

Ben's Bites

怎么写一份不帮倒忙的 AGENTS.md?

AGENTS.md 是给 AI 助手预载的指令文件,但别把它写成项目地图。有研究指出,塞进技术栈、关键文件路径这类信息反而会拉低表现,还让 token 消耗多出 20%——这些东西模型自己翻翻代码就能搞清楚。更好的做法是只保留你的行为偏好和纠偏提示,比如“生成网页前先用内置浏览器测一下再给我链接”、“把计划文件统一写到 ~/项目名/plan/ 里”。文...

推荐理由:这篇讲的是怎么把 AGENTS.md 写小、写干净。核心判断很明确:别往里面塞技术栈和文件地图,只保留行为偏好,否则效果会变差,成本还能多出 20%。这个 20% 的数字来自一项研究,但正文没披露研究名称和实验设置,所以我会先打个折来看。可执行的部分挺实在,比如把 AGENTS.md 和 CLAUDE.md 做 symlink、用条件块区分简单网页和复杂应用、按文件夹动态加载,都是能直接抄作业的做法。对经常跟 coding agent 打交道的人来说,这比“多写点上下文”的直觉有用得多,本质是把常驻指令压到最小,减少每次调用的无效消耗。信息缺口在于...

硅谷101 播客

Web3 101串台|“龙虾热”背后,如何防范OpenClaw系统级风险

这期播客请了安全专家余弦和“龙虾”老玩家知县,把OpenClaw的风险拆成了几个层级:刚装上时,Agent能读你当前用户能看的本地文件;开始聊天后,对话内容会传到模型服务器,别发密钥密码;让它读写文件干活时,大模型可能理解错意思,误删误改文件,最常见的是把自己“改死”;操作浏览器时,你已登录的账号信息它都能拿到,访问恶意链接也会中招;安装Skill或软...

推荐理由:HKR 三项都踩中了:用具体机制讲一个热门 agent 的系统风险,不是抽象恐吓。文章引了约 250 条安全公告和 v3.2 默认限制,但本质还是播客评论,不是一手产品发布或研究,所以分数落在低段。

3月17日星期二

MIT Technology Review · AI

OpenAI 的技术可能出现在伊朗冲突的哪些环节

OpenAI 跟五角大楼签了涉密协议刚过两周,MIT Technology Review 就划出了三个可能用到它家技术的场景。一是目标排序:分析师把潜在目标清单丢给模型,让它结合后勤、情报等数据排出优先打击顺序,但正文没解释人工复核到底怎么提速。二是反无人机分析:OpenAI 之前跟 Anduril 合作,用模型做实时威胁识别和拦截建议,不过两家都没更...

推荐理由:MIT Technology Review 把 OpenAI 的涉密国防合作往伊朗冲突上套,列出目标排序、反无人机分析和行政支持三个可能落点。我会先打个折:文章没给出部署时间表,也没实锤任何战场使用,所以判断要收着点。但选题本身踩在军事 AI 的敏感线上,加上 OpenAI 刚进涉密圈,这个时间点发出来,话题性够强。

3月16日星期一

MIT Technology Review · AI

AI 智能体刚学会跑,企业的管理手段还没跟上

2025年底到2026年初,无代码工具和开源个人助手 OpenClaw 出现,让生成式 AI 从爬直接变成了跑。加州 AB 316 法案在 2026 年 1 月 1 日生效,企业不能再把责任推给 AI 说“是它干的,我没批准”。IDC 受 Data Robot 委托的调查显示,96% 的生成式 AI 部署和 92% 的智能体部署都超了预算。真正的麻烦在...

推荐理由:这篇不是产品发布,而是用数据说话的评论。AB 316 把法律责任钉死了,IDC 和 Data Robot 的调查又说明成本失控是普遍现象,不是个案。文章没画大饼,反而把治理跟不上自治速度的风险摊开讲,对正在落地 agent 的团队有直接参考价值。

3月13日星期五

阮一峰的网络日志

测试是新的护城河

一个 Cloudflare 工程师用 AI 花了一周时间、1100 美元 token 费,就复刻了 Next.js 十年的开发成果,API 覆盖率达到 94%。早期测试显示,这个叫 vinext 的新实现构建速度快了 4 倍,客户端打包体积小了 57%,现有 Next.js 应用不用改代码就能直接跑。这件事直接捅破了代码护城河的窗户纸:只要文档和测试用...

推荐理由:这篇文章不是一手发布,是周刊评论,但切入点够刁。我会先打个折:它引用的 vinext 项目还缺长期维护验证,基准也只是早期数据,别急着下结论。不过它把两件事摆在一起看——AI 让复刻框架的门槛降到一千美元出头,而 SQLite 用 9205 万行测试守住质量——这个对比本身就有信息量。对从业者来说,提醒很直接:以后拼的不是谁能写出来,而是谁能证明它真的对。

3月11日星期三

MIT Technology Review · AI

中国 OpenClaw 热潮催生了一门帮人装“龙虾”的生意

北京工程师 Feng Qingyang 一月份开始帮人安装 OpenClaw(一个能接管设备自主干活的开源 AI 工具),到二月底辞职,现在团队超过 100 人,已经接了 7000 单,每单约 248 元人民币。淘宝和京东上现在有几百个相关商品,价格从 100 到 700 元不等。这波热潮的核心不是技术本身,而是安装门槛高、数据隔离有风险,把开源工具变...

推荐理由:这篇不是产品发布稿,是扎实的现场观察。一个副业变百人团队的故事有传播力,市场定价和订单量给了硬数字,数据隔离风险又让行业里的人不得不重视。我会先打个折:正文没披露团队构成和 7000 单的统计口径,但整体信息密度够高,值得放在精选位。

3月9日星期一

MIT Technology Review · AI

AI 正把伊朗冲突变成一场实时观战秀

作者一周内看了十几个伊朗战争仪表盘,它们把卫星图、船舶追踪、AI 摘要和赌盘链接拼在一起,把战争变成了可以边吃爆米花边看的实时界面。一个由 a16z 员工搭建的仪表盘直接接入了 Kalshi 的下注数据,而调查记者 Craig Silverman 已经记录了 20 个类似的工具。问题出在信息质量上:英国《金融时报》报道过 AI 生成的虚假卫星图正在网上...

推荐理由:我会先打个折:这不是产品发布或模型突破,而是一篇有事实支撑的评论。H 靠战争面板加博彩这个钩子立住了,K 靠具体案例和数字撑起来,R 打中了从业者对 AI 信息质量和伦理的敏感神经。文章没给解决方案,但把问题摆得很清楚,所以放在 featured 合适。

3月6日星期五

阮一峰的网络日志

科技爱好者周刊(第 387 期):你是领先的

阮一峰算了笔账:全球81亿人里,只有13.8亿人用过AI,占16%;付费订阅AI服务的只有1500万到2500万人,占0.3%;真正用AI生成过自己编程项目的人,更是只有200万到500万,占0.04%。如果你已经在关注AI动态、用AI写代码,其实已经跑赢了99%的人。文章还聊了最近爆火的个人AI助手OpenClaw,它四个月就在GitHub拿了25万...

推荐理由:阮一峰这期周刊用几组数字把“人人都在用 AI”的错觉拉回现实。我会先打个折:16% 的用过比例、0.3% 的付费比例和 0.04% 的编程使用比例,原文没交代数据出处,所以不能当精确统计用,但方向是对的——采用率断层比刷屏的新闻更有参考价值。对从业者来说,这篇的价值不在技术深度,而在提醒你盯紧真实渗透率,别被舆论带偏。

3月5日星期四

36 氪 · 直链

阿里辟谣千问团队集体离职,称团队稳定、开源策略不变

阿里在3月5日回应了网上关于“千问模型核心团队集体离职”和“开源策略要调整”的传言,明确说团队稳定,产品和服务都正常运行。千问会继续走开源路线。一个值得注意的信息是,阿里强调基础模型团队从来没被定过DAU这类商业化的KPI,目标就是追模型智能上限、做AGI。不过公告没提谣言具体从哪来的,也没说团队现在多少人、后续会投多少钱。

推荐理由:阿里出来辟谣,说千问团队没集体跑路,开源路线也不变。我会先打个折,因为正文没给出网传消息来源,也没说团队现在多少人、后续投入多大。真正值得看的是他们强调基础模型团队不背DAU这类商业化KPI,目标还是把模型智能上限往上拉。这点先别太激动,但至少是个信号。