跳到正文

全部动态

今日 75 条

9月11日星期五

r/LocalLLaMA

用100道斑马谜题微调Qwen 3 4B,MATH-500得分涨了31%

一个6.5分钟的单卡H100/H200微调实验,拿100道斑马谜题(逻辑推理题)去训Qwen 3 4B基础模型,让它在MATH-500数学基准上的得分提升了31个百分点。作者附了可复现的notebook,但Reddit把帖子正文拦了,训练超参、数据格式和评测细节都没放出来,这点先别太激动。

Hacker News 首页

Clawfight:让AI代理像螃蟹一样实时对战

Clawfight是一个MCP驱动的对战平台,两个AI代理以卡通螃蟹形象进行实时格斗或说唱对决,输出视频。支持原生MCP客户端(Claude连接器、ChatGPT插件)、原始HTTP脚本和手动操作。对战循环使用六个工具调用:加入比赛、等待事件、出招、查询状态。文章详细列出了分层设置步骤和沙盒规则——例如整个回合循环必须在一个前台工具调用内完成,否则后台...

Hacker News 首页

开源学习系统 Chamilo 3.0 自带 MCP 服务器,AI 工具可直接读写课程和成绩

Chamilo 3.0 是这款开源 LMS 的大版本更新,最大的亮点是原生集成了一个 MCP 服务器。MCP 相当于一个标准接口,让 AI 工具(比如聊天机器人、智能助教)可以直接读取和写入课程、用户和成绩数据,不用再单独写适配代码。另外认证升级到了 PAuth 2.1。正文没提性能提升幅度或新增功能数量,但 MCP 这个方向对教育场景的 AI 集成来...

Hacker News 首页

ClaudeStatsBar:在 Claude 聊天界面加一个实时 token 进度条

这是一个浏览器扩展,能在 Claude 聊天界面显示当前会话用了多少 token(比如 486k)。它直接读取页面 DOM,不额外花钱,也不依赖 Claude 的 API。正文没披露是否支持所有 Claude 版本或仅限网页端,但代码仓库显示它只读前端数据,不涉及后端。486k 只是示例数字,不是硬上限。

Hacker News 首页

代码能跑但写得烂:怎么衡量 AI 生成的代码有多“水”

Sebastian 在 Earendil 的博客里用 SlopCodeBench 的指标测了 AI 写代码的“水分”。AI agent 写的代码平均啰嗦度 0.33,人类仓库只有 0.15;侵蚀度 0.68,人类是 0.31——AI 代码的啰嗦和臃肿程度大概是人类的两倍。在多轮、清空上下文的迭代测试里,哪怕最顶尖的模型,严格通过率也是 0%,坏决策会越...

推荐理由:Sebastian 在 Earendil 的博客里用 SlopCodeBench 测了 AI 写代码的“水分”,给了两个新指标:啰嗦度(verbosity)和侵蚀度(erosion)。AI agent 写的代码啰嗦度 0.33,人类仓库 0.15;侵蚀度 0.68,人类 0.31——AI 代码的臃肿程度大概是人写的两倍。多轮迭代测试里,哪怕最顶尖的模型,严格通过率也是 0%,坏决策会越滚越多。这个角度比泛泛说“AI 代码质量差”具体得多,直接量化了“能用但脏”的状态。我会先打个折:这是单篇博客,不是同行评审,SlopCodeBench 也没开源,可...

Ben's Bites

跟AI说清楚设计有多难?Ben Tossell做了个工具帮你翻译

Ben Tossell 做了个叫 Design Words 的工具,核心痛点是:非设计师很难用语言描述圆角、阴影、字体这些视觉风格。用户左边选样式,右边实时预览,最后复制一段 prompt 丢给 AI agent 去干活。他前后迭代了 11 个版本,用 Pi 的 Fable 5.1 做脑暴,用 Factory 的 Droid 写代码。目前还是早期阶段,...

彭博科技

Anthropic 点名伊朗和俄罗斯用 Claude 做武器研究

Anthropic 公开指控伊朗和俄罗斯的国家背景行为者用 Claude 辅助武器研究。这是头部 AI 公司第一次直接点名具体国家,把模型滥用跟地缘政治对手挂上钩。公告没披露涉及什么武器类型、用了哪个版本的 Claude,也没说 Anthropic 是怎么发现并追溯到这些行为的。目前只有单方面说法,我会先打个折,等技术细节出来再判断实际危害有多大。

推荐理由:Anthropic 这次直接点名伊朗和俄罗斯用 Claude 辅助武器研究,是头部 AI 公司头一回把模型滥用跟具体国家绑在一起,话题性很强,安全圈和政策圈都会高度关注。但公告信息量太少,武器类型、模型版本、检测手段全没披露,没法判断实际危害有多大,所以 K 打不上。整体热度够,但缺硬证据,分数卡在 82 合理。

Hacker News 首页

Waymo 效应:AI 正在让科研悄悄变“独”

Daniel Hook 提出了一个叫“Waymo 效应”的概念:当技术抹掉了跟人打交道的麻烦,我们只觉得自己赚了,因为麻烦是看得见的,而麻烦带来的好处我们没注意到。他用无人驾驶出租车打了个比方——不用跟司机尬聊确实爽,但那些你本来不会主动去聊、却被迫聊上的跨圈层对话,也跟着一起消失了。在科研里,大语言模型正在变成那个“零摩擦同事”:凌晨两点随叫随到,没...

推荐理由:这篇是观点文章,没有实验数据,但“Waymo 效应”这个分析框架本身够新鲜,不是泛泛而谈。正文没披露量化证据,所以判断先打个折,但论点质量撑得住 featured 门槛。

Hacker News 首页

RTK 号称能省九成 token,我们实测账单反而涨了

Quesma 花了超过 1500 美元跑 Terminal-Bench 2.1,对比了 Claude Code 加 Fable 5.0 和 OpenCode 加 DeepSeek V4 Pro 0813 在开不开 RTK 时的真实花费。RTK 是一个给终端输出“瘦身”的工具,把 ls、git 等命令的返回结果压缩后再喂给模型,想靠减少上下文来省钱。结果...

推荐理由:Quesma 砸了 1500 美元跑 Terminal-Bench 2.1,对比 RTK 开不开时的实际花费,结果跟 RTK 自己说的 60% token 节省对不上。有真金白银的实测数据,有明确工具链,直接挑战热门省钱工具的宣传,对关心推理成本的 AI 从业者来说信息量够、冲突感强,值得推。

AI HOT 精选

OpenAI 讲他们怎么用 Python 和 Rust 搭了个存储平台,撑住 ChatGPT 10 亿用户

OpenAI 的在线存储平台 Habitat 现在每秒要处理超过 7000 万个请求,服务着每周超 10 亿的 ChatGPT 用户,管着 500PB 以上的数据。这篇文章是上篇,讲了它怎么从一个简单的 Python 客户端库,被逼成一个分布式服务。团队连续三年面对每年超 10 倍的增长,先是在 Python 的异步框架里抠延迟,解决功能开关的尾部延迟...

Hacker News 首页

Flask 作者用 GPT-6 Astra 跑了 35 小时“软件工厂”,烧掉约 40 亿 token,一行能用的代码都没出来

Armin Ronacher 让 Astra 全自动改造 CPython,想给它加上虚拟线程和词法作用域。模型自己管上下文、自己派子任务,结果 35 小时烧了大概 40 亿 token,交付价值为零。Astra 改 C 代码时不爱用正经的补丁工具,反而大量用 Python 做字符串拼接和替换,产出的代码质量很差。Ronacher 怀疑训练时过度奖励“把...

推荐理由:Armin Ronacher 拿 Astra 全自动改造 CPython 的实验,把当前最强编码模型的真实短板扒了出来。35 小时、约 40 亿 token 的消耗,最后零交付,这个结果本身就很有冲击力。更关键的是他分析了失败原因:模型不爱用正经的补丁工具,反而用 Python 做字符串操作,说明训练时的奖励机制可能跑偏了。这比任何基准测试都更有说服力,但因为只是单人实验,不是系统性研究,所以分数没给满。

Hacker News 首页

Anthropic 发现并阻止了多起用 Claude 尝试开发生物武器的案例

Anthropic 在 2025 年 12 月到 2026 年 8 月期间,一共打断了 5 起可能用于开发生物武器的滥用行为,涉及 Claude Haiku、Sonnet 和 Opus 三个模型。报告里说,生物滥用是前沿模型最严重的风险之一,因为能造疫苗的知识同样也能造武器。除了生物武器,他们还发现有人用 Claude 写常规武器的控制软件,以及俄罗斯...

推荐理由:Anthropic 自己主动披露了安全干预数据,在 8 个月里拦下了 5 起试图用 Claude 搞生物武器的滥用,覆盖 Haiku、Sonnet 和 Opus 三个模型,还直接点了俄罗斯的名。这不是公关稿,是前沿模型安全治理的硬证据。分数没给到 85 以上,主要是因为报告里没披露拦截机制的具体细节和误报率,但作为行业首次公开这类数据,82 分站得住。

AI 群聊日报

Anthropic 报告实锤 DeepSeek 和 Kimi 偷偷把用户请求转给 Claude;Pro 20x 当天停售

Anthropic 九月威胁报告扔出了一颗炸弹:DeepSeek 和月之暗面(Kimi)在用户完全不知情的情况下,把发给自家模型的请求静默转发给了 Claude,用户的代码和登录凭证就这么暴露给了第三方。同时,一个 6TB 的中转站数据泄露包里,装着 SSH 密钥、云服务凭证和 GitLab 令牌,足以拿下 7 个政府实体和 19 家企业的内网。报告还...

推荐理由:Anthropic 官方威胁报告 + 6TB 泄露证据 + 七家中国实验室被点名做蒸馏,三条线撞在一起,不是孤立事件,是一个安全事件群。三个维度都打中了,信息密度和行业冲击力够上 featured。没给更高分是因为这是日报精选,不是独家调查,我会先打个折。

Hacker News 首页

Google Gemini 正式推出 Windows 桌面版

Google 发布了 Gemini 的 Windows 原生桌面应用,用户可以直接从电脑上打开 AI 助手,不用再绕道浏览器。官方博客没有说明这个版本包含哪些功能、是否免费,也没提能不能离线用。如果你习惯把 AI 当桌面工具用,现在多了一个入口,但具体体验好不好还得等上手才知道。

AI HOT 精选

DeepSeek V4.1 Flash 实测:降价还带视觉,游戏和城市生成都能跑

文章标题说 DeepSeek V4.1 Flash 大幅降价、原生支持视觉能力,作者用游戏和城市生成任务测了表现。但正文被微信屏蔽,看不到具体降了多少、视觉能力什么规格、生成质量如何。如果真降价且视觉好用,对做多模态或生成类应用的团队是个好消息,但这点先别太激动——没披露细节前只能当传闻看。

FT · 科技

美国国债会戳破AI泡沫吗?

投资人Ruchir Sharma在FT播客里说,美国国债突破35万亿美元,长期利率被AI投资推高,政府预算越来越紧。AI是个烧钱行业,需要便宜资金,但美国财政正在拧紧水龙头。如果利率持续高位,AI那些资本密集型项目可能撑不住。正文没给具体时间线或债务红线,但逻辑很直白:AI泡沫能不能撑下去,取决于美国还能不能借到便宜的钱。

彭博科技

Flipkart 金融子公司 Super.money 押注 AI 智能体,想靠它跟 Google Pay 和 PhonePe 抢用户

Flipkart 的金融业务 Super.money 开始把 AI 智能体嵌入用户日常金融流程——比如自动缴账单、推荐产品,而不是只做个聊天机器人。这招在印度市场挺直接:对手 Google Pay 和 PhonePe 用户基数大,Super.money 想靠“让模型进业务流程干活”来差异化。不过正文没披露具体用了什么模型、延迟多高、成本多少,也没给用户...

纽约时报中文网

AI 末日论为什么总有人信?纽约时报从心理学角度拆了一遍

Anthropic 一名研究员因为担心实验室在造“人类控制不了的超级智能”而辞职,这事又让 AI 毁灭人类的讨论上了头条。纽约时报这篇没站队,而是从风险认知的角度解释:人天生害怕新风险,不害怕熟悉的风险——开车比坐飞机危险得多,但大家觉得飞机更吓人。哈佛风险分析中心主任说,AI 之所以让人焦虑,是因为它“不在我们觉得能控制的范围内”。文章还列了一串其他...

Hacker News 首页

手搓 Transformer:一个交互式可视化工具

这个网页工具让你像搭积木一样,一层层搭建 Transformer 模型,每一步都有实时可视化。适合想搞懂模型内部结构、又不想硬啃论文的开发者。正文没披露支持哪些模型或训练数据——它纯粹是架构可视化,不涉及训练或推理。

Hacker News 首页

Git 之后用什么?ERSC 换掉存储引擎,让代码仓扛得住 AI 代理的规模

ERSC 的 Steve Klabnik 写了篇博客,解释他们想怎么改造版本控制。核心思路是保留 Git 协议,但把底层的存储换成自研引擎。触发点是 AI 代理写代码让仓库体积、分支数量和合并冲突都涨得很快,传统 Git 仓库的存储方式开始吃力。ERSC 说他们的方案能做到水平扩展和租户隔离,不同公司的使用不会互相影响。文章还提了一个远期想法:让 Ju...

纽约时报中文网

Anthropic 称今年已多次阻止科学家用 Claude 做生物武器相关研究

Anthropic 发布了一份威胁情报报告,梳理了过去八个月 Claude 被滥用的情况。最让人警惕的是,有科学家试图用 Claude 辅助生物武器研究,比如设计基孔肯雅病毒的更危险突变。Anthropic 没法判断这些研究是合法还是恶意,但因为发现其中一项计划在军事研究机构进行,所以还是封了相关账户。报告还记录了在中国、俄罗斯和也门有人用 Claud...

推荐理由:Anthropic主动公开了Claude过去八个月被滥用的真实案例,最扎眼的是有科学家用它设计基孔肯雅病毒的更危险突变,其中一个计划还关联到军事研究机构,公司直接封了账户。报告也记录了中俄也门等地的虚假信息行动,但Anthropic自己说这些行动没获得实质性传播。我会先打个折:报告里很多案例的最终影响有限,生物武器那块也没法判断是合法研究还是恶意企图,正文没披露后续有没有通报执法部门。不过一家头部实验室愿意把内部威胁数据摊开来讲,在安全圈里确实少见,值得从业者细读。

Hacker News 首页

Herdr Studio:给AI agent集群一个浏览器驾驶舱

Herdr Studio 是一个开源浏览器客户端,让你在一个可视化界面里同时管理多个 AI agent 的终端、文件、代码差异和工作树。它依赖 Herdr 守护进程,即使浏览器或笔记本断线,agent 会话也不会丢。支持本地和 SSH 连接,还能以 PWA 形式装到手机上。目前只提供了 macOS 和 Linux 的安装脚本,Windows 用户得去 ...

Hacker News 首页

在 Mac 上用 Ollama 跑 Opencode:本地大模型做开发,沙盒防幻觉

Adam Lusted 在 MacBook Pro M5(48GB)上搭了一套本地开发环境:用 Ollama 拉 Qwen 3.8 27B 和 Gemma 4 31B 两个模型,通过 Opencode 做编码助手,再用 Docker Sandbox(sbx)把模型跑在容器里——防止模型乱写代码搞崩宿主机。每个项目要配一个 sbx kit,里面写模型配置...

彭博科技

Sam Altman 对员工说,OpenAI 愿意放慢最前沿模型的发布节奏

Sam Altman 在一次全员会上表态,OpenAI 可以主动踩刹车,推迟最先进模型的发布。这是 OpenAI 第一次在内部明确传递这个信号。不过,报道没给出具体的时间表,也没说触发减速的条件是什么——比如是看模型能力过线,还是等外部安全审计通过。目前只有 Bloomberg 这一篇报道,没有录音或内部文件佐证,执行细节还不清楚。

推荐理由:Altman 第一次对内说可以主动推迟前沿模型发布,光这个姿态就够上头条。但我会先打个折:目前只有 Bloomberg 一家信源,没有录音或内部文件交叉验证,执行层面更是零细节——没时间表、没触发条件、没定义什么叫“最先进”。所以这条消息信号意义大于实操意义,从业者知道有这么个风向就行,别急着当政策解读。

Hacker News 首页

Google 签下 22 年核电长约,在芬兰砸 130 亿欧元建 AI 数据中心

Google 宣布在芬兰投入 130 亿欧元,这是它在欧洲最大的一笔单项投资。钱主要用来新建三座数据中心、扩建原有园区,并配套清洁能源项目。作为其中一环,Google 和芬兰电力公司 Fortum 签了 22 年的购电协议,会买下 Loviisa 核电站最多一半的发电量。这座核电站目前供应芬兰约 10% 的电力,Fortum 说这笔长约能帮它筹到钱去延...

推荐理由:Google 在芬兰砸 130 亿欧元建数据中心,同时签下 22 年核电长约,买走一座核电站一半的电。这不是模型发布或产品更新,但比很多产品新闻更值得从业者留意——它说明 AI 竞赛的瓶颈正在从芯片转向电力,大厂开始用几十年长约锁定基荷电源,基础设施的玩法变了。信息够硬,缺的是这笔电具体对应多少算力、支撑什么工作负载,正文没展开。

Hacker News 首页

YuE2 先写乐谱再生成音频,效果对标 Suno v5

MAP 和几所高校一起发布了 YuE2,一个把写谱和合成合在一起的音乐模型。它先生成可编辑的 ABC 乐谱,再根据乐谱渲染人声和伴奏,最终效果跟 Suno v5 差不多。这次开源了 3B 模型、VAE、把音频转回乐谱的 SheetSage2 转录工具,还有评测集 WildSongBench,附带 65 首从暗黑氛围到赛博金属的试听 demo。正文没提训...

推荐理由:开源音乐模型直接喊出 Suno v5 水平,还给了可编辑乐谱、转录工具和评测集,信息密度很高。没给更高分是因为正文没披露训练数据规模和实际推理成本,所以“对标 Suno v5”这个说法我先打个折,等看到更多实测再判断。

彭博科技

腾讯持股的AI芯片公司燧原科技上市首日暴涨188%

燧原科技在上海科创板上市,募了约9.11亿美元,做的是AI训练和推理芯片。首日股价涨了188%,说明市场对国产AI芯片替代方案的热情很高。但文章没披露它最新的营收和利润数字,所以这个估值我先打个折,别太激动。

推荐理由:燧原科技在上海科创板首日涨了188%,募资约9.11亿美元,背后有腾讯,市场对国产AI训练推理芯片的热情很明显。但文章没给最新的营收和利润数字,这个估值我先打个折,别太激动。

阮一峰的网络日志

Laravel 不再接受 issue,只收 PR;Claude 用 1300 万行代码跑通了费马大定理的机器证明

Laravel 的新规听起来离谱,但逻辑很直接:AI 让提 PR 和提 issue 一样简单,还能自动过滤掉垃圾 issue,维护者从 PR 里拿到的信息也比 issue 多。另一边,Anthropic 让 Claude 把怀尔斯证明费马大定理的 129 页论文,翻译成了 Lean 语言程序。Claude 先证了 3 万多个辅助定理,用了其中 2.9 ...

推荐理由:这期周刊讲了两个挺有意思的实践。Laravel 把 issue 关了只留 PR,逻辑是现在 AI 帮忙写代码和修 bug 的门槛很低,提 PR 比单纯描述问题对维护者更有用,还能自动筛掉大量说不清楚的 issue。Anthropic 用 Claude 把怀尔斯证明费马大定理的论文转成了 Lean 程序,模型先证了 3 万多个辅助定理,最终用了其中 2.9 万个,相当于让 AI 把人类最复杂的数学证明之一做了一次可机器验证的翻译。两个案例都指向同一个趋势:AI 正在改变开源协作和数学验证这类高门槛工作的具体流程,不是概念炒作,是已经跑通的实操。

AI HOT 精选

Together AI 微调服务升级:训练过程实时看曲线,新增 DeepSeek V4 Pro 等模型

Together AI 更新了微调服务,新增 DeepSeek V4 Pro、MiniMax M3、Gemma 4 31B 等模型。现在训练过程中就能实时看 loss 和准确率曲线,不用等跑完才知道效果。控制也更细了,可以调学习率调度器、优化器参数和早停条件。正文没披露定价和地区可用性,但模型列表和功能描述挺详细。

Computing Life · Share · 鸭哥调研

DeepSeek V4.1 Flash:长上下文成本的主战场,从算力转向内存

DeepSeek 发了 V4.1 Flash,把全局 KV 缓存压到上一代的约四分之一,持久化缓存压到约八分之一,缓存命中的输入价格也跟着砍了六成。技术报告的核心判断是:稀疏注意力已经把计算成本打下来了,现在拖慢长时程 agent 任务的是显存塞满、数据往 SSD 搬进搬出和总线传输的开销。Flash 的解法是上 4 位存储、让不同层共用一份全局缓存、...

推荐理由:DeepSeek V4.1 Flash 不是例行降价。报告把 KV 缓存压到上一代的 1/4 到 1/8,缓存命中的输入价格跟着砍了六成。核心判断很明确:稀疏注意力已经把计算成本打下来了,现在卡住长时程 agent 任务的是显存塞满、数据在 SSD 和总线之间搬来搬去的开销。Flash 的解法是上 4 位存储、让不同层共用一份全局缓存,思路清晰,数字也够硬。对正在跑 agent 工作流的人来说,这比单纯降 token 单价更有参考价值——省的是显存和传输延迟,不是只省 API 账单。

Computing Life · Share · 鸭哥调研

美国司法部为AI训练版权站台,DeepSeek用16万颗华为昇腾芯片做推理,OpenClaw从个人助理转向团队工具,员工对AI情绪跌至冰点

美国司法部在一份对法院没有约束力的文件中,主张用版权作品训练AI属于合理使用,理由是训练时复制但从不公开,输出与原作也缺乏实质性相似。纽约时报立刻反驳,说政府站队万亿级AI公司。目前还没有上诉法院对此做出裁决,所以这件事还没定论。DeepSeek计划在内蒙古部署至少16万颗华为昇腾950DT芯片,规模接近xAI Colossus一期的八成,但这批芯片只...

Google 研究院

ToolGrad:用报错信息当“梯度”,自动生成教模型调用工具的数据集

Google Research 提出 ToolGrad,一种靠文字反馈自动生成工具调用训练数据的方法。思路很直接:让模型先试着调用 API,一旦出错,就把 API 返回的报错信息当成“梯度信号”,反向修改对话样本,反复迭代直到模型给出正确答案。文章用查天气的例子走了一遍流程——模型一开始瞎编了一个温度,API 报错后,系统根据错误提示重写了问题和回答,...

Sinocism · 比尔·毕晓普

Anthropic 指控 DeepSeek、小米、月之暗面用 Claude 输出来蒸馏模型

Anthropic 在 9 月的威胁情报报告里点名了三家中国公司:DeepSeek、小米和月之暗面。报告说,这几家把自家模型跟用户的对话记录喂给 Claude,再用 Claude 生成的回答当训练数据,去“蒸馏”Claude 的能力——也就是用大模型的输出教小模型模仿回答风格。这些对话里还夹带了个人用户、大型跨国公司和政府相关方的敏感信息。Anthro...

推荐理由:Anthropic 的官方威胁情报报告点名三家中国大模型公司,指控它们用带敏感信息的用户对话去蒸馏 Claude,这本身就是一个行业级安全事件,热度、知识和传播三个维度都打满了。稍微扣一点分,是因为目前我们只看到 Sinocism 的二手转述,还没拿到 Anthropic 报告原文,细节可能有出入,但整体判断不变。

FT · 科技

Anthropic 说它的安全系统拦下了两名想用 Claude 获取生物武器知识的科学家

Anthropic 在 2026 年 7 月发现两名科学家试图用 Claude 查询病原体改造、毒素生产和规避安检的方法,内部安全系统在 11 秒内识别并拦截了这些请求。公司随后报了警,称这是 AI 首次实时阻止生物武器研发。不过,正文没披露这两人的身份、所属机构,也没说报了哪家执法部门,所以这件事的严重程度和后续处理还不好判断。

推荐理由:Anthropic 通过 FT 独家放出的这个消息,是第一次有 AI 公司公开声称实时拦截了生物武器研发,新闻性很强。11 秒识别、具体查询类型这些细节让事件有实感,但科学家身份、机构和执法部门全都没披露,我会先打个折——目前只能看到公司单方面说法,严重程度和后续处理还不好判断。

Product Hunt · AI

Cognition 新模型 SWE-2 比 Fable 5.1 便宜 64%

Cognition 发布了编程模型 SWE-2,主打比 Fable 5.1 便宜 64%。但正文没披露具体价格、跑分或使用场景,只说了成本优势。如果是真的,对预算有限的团队挺省钱,但性能如何、能不能直接上手用,目前信息不够,先别太激动。

TechCrunch · AI

黄仁勋说英伟达明年还能再涨 70%,但没给订单数据

黄仁勋在高盛的会上给了个很猛的预测:英伟达下一年收入还能涨 70%。他的理由是,企业对算力的需求远没到顶,现在正从训练模型转向大规模推理(也就是让模型真正跑起来干活),而英伟达的 GPU 加网络方案从云端到边缘设备全占了。他还回应了“左手倒右手”的质疑——英伟达投资 AI 创业公司,这些公司再买英伟达芯片——他说每笔投资都有独立的回报逻辑。不过,这篇文...

推荐理由:黄仁勋亲自给出70%的增长指引,并解释了从训练到推理的算力迁移,信息有分量。但这是银行会议上的公开讲话,不是产品发布或财报,新增信息有限。正文没给出70%的具体计算依据,也没展开推理市场的规模数据,所以我会先打个折,给72分放在featured档。

GitHub Blog · AI & ML

GitHub Copilot 应用新手指南:使用 diff、终端与浏览器面板

GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让用户无需离开应用即可审查、运行和预览 AI 智能体生成的代码变更。diff 面板以绿色和红色高亮显示代码的增删改,终端面板支持直接运行项目命令并可通过 Run 按钮配置脚本,浏览器面板则提供 Pick & Polish 工具来选取页面元素并让智能体调整。