跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

1,195 条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 821–840 条 · 共 1,195 条

5月20日星期三

彭博科技

SpaceX 被曝计划在 IPO 后 30 天收购 AI 编程工具 Cursor

彭博社援引知情人士消息称,SpaceX 打算在上市 30 天后买下 AI 编程助手 Cursor。这篇报道没披露交易金额、IPO 时间表,也没提监管审批条件。Cursor 是目前程序员圈子里很火的 AI 写代码工具,如果交易落地,SpaceX 等于直接把一套成熟的 AI 开发工具塞进自己的工程体系里。不过现在连 SpaceX 什么时候上市都还没定,这个...

推荐理由:Bloomberg 的信源加上 SpaceX 在 IPO 后立刻买 Cursor 这个奇怪安排,让消息本身够硬、够新、也够有话题性,所以 HKR 全中。不过正文没披露价格、IPO 时间表和监管条件,信息缺口明显,分数就停在 84,不到 85 的 P1 线。

AI HOT 精选

Claude Code 团队把主力输出格式从 Markdown 换成了 HTML

Claude Code 团队发现让模型直接生成 HTML 页面,比用 Markdown 更能把事说清楚。文章举了四个具体用法:用表格做对比、用 CSS 控制排版样式、用 SVG 画图表、用 JavaScript 加交互操作。他们没说性能数据或成本变化,更像是一篇内部实践分享,告诉你“我们这么用下来效果不错”。

推荐理由:Claude Code 团队把默认输出从 Markdown 切到 HTML,这篇官方博文列出了表格、CSS、SVG 和 JS 交互四种用法,说明 HTML 在展示结构化结果和可交互内容上比纯文本强。对写代码的人有实操参考价值,但不算重大产品发布,放在 featured 档合适。

AI HOT 精选

Google 把 Gemini 科研助手 ERA 发在 Nature 上,并开放早期测试

Google Research 在《自然》杂志上发表了他们基于 Gemini 的“经验研究助手”(ERA),同时通过 Google Labs 的可信测试者计划开放了早期访问。这个工具想帮研究人员自动完成文献综述、提出假设和设计实验这些耗时的工作。文章主要讲了 ERA 从一篇 Nature 论文走向实际计算发现工具的过程,但正文没披露它在真实科研场景里的...

推荐理由:Google Research 把基于 Gemini 的 ERA 发在了 Nature 上,同时通过 Google Labs 的可信赖测试者计划开放初步试用。我会先打个折:正文没给出具体指标、基准测试设置,也没讲可复现的工作流细节,所以没法判断它到底有多能打。但这件事本身值得关注——它不是在秀一个 demo,而是试图把论文里的研究助手推到真实科研场景里去验证。这点先别太激动,等看到实际使用反馈和量化结果再说。

Hacker News 首页

Gemini CLI 将于 2026 年 6 月 18 日停服,全面转向 Antigravity CLI

Google 宣布 Gemini CLI 将在 2026 年 6 月 18 日停止服务,个人免费用户和 Pro/Ultra 订阅用户届时都无法再使用。这个命令行工具去年发布后攒了超过 10 万 GitHub 星标和 6000 个合并请求,但 Google 认为用户现在需要的是多个 AI 代理互相配合干活,而不是单打独斗,所以决定把精力集中到新的 Ant...

推荐理由:Google 开发者博客扔出一个 Gemini CLI 的停用日期,并指向 Antigravity CLI 作为替代。标题本身就是一个硬截止日,对依赖这条命令行的开发者冲击不小,所以 HKR 三项都站得住。不过正文除了日期和迁移目标外,没解释怎么迁、兼容性如何、旧项目会不会断,信息量其实很薄。我会先打个折,把它放在 featured 的低位,因为截止日本身就有新闻性,但细节缺口太大,不值得给更高分。

AI HOT 精选

谷歌发布 Gemini 3.5 系列,先上 Flash 版,主攻智能体和编程

谷歌 AI 在 X 上宣布推出 Gemini 3.5 系列,首发的是 Gemini 3.5 Flash。官方说这个版本重点强化了智能体(让模型进业务流程干活)和编程能力。正文没披露参数量、价格、跑分成绩和上下文窗口大小,所以实际提升有多大、成本划不划算,现在还没法判断。

推荐理由:Gemini 3.5 系列是 Google 的正代更新,Flash 版先出,定位在智能体和编程,这两个方向现在很热。但正文没披露价格、上下文长度和参数量,我会先打个折——信息不全,实际落地成本不好判断。这点先别太激动,等补上关键数字再重新评估。

AI HOT 精选

Gemini 3.5 Flash 发布,跑分超 3.1 Pro,生成速度是其他顶尖模型的 4 倍

Google 在 I/O 后开放了 Gemini 3.5 Flash,产品端和 API 都能用。官方说它在多数基准测试上比 3.1 Pro 强,编程能力提升明显,每秒吐 token 的速度是其他前沿模型的 4 倍。不过帖子没给具体跑分数字和测试条件,这点先别太激动。

推荐理由:Google 在 I/O 后放出了 Gemini 3.5 Flash,产品和 API 都能用。最抢眼的数字是每秒吐 token 的速度是其他前沿模型的 4 倍——我会先打个折,因为正文没披露跟哪些模型比、在什么条件下测的,也没给价格和上下文窗口。这点先别太激动,但速度翻几倍对降低延迟和成本确实有用,所以这条消息值得从业者看一眼。

TechCrunch · AI

谷歌发布 Gemini 3.5 Flash,把下一波 AI 押注在能自己干活的智能体上,而不是聊天机器人

谷歌在 I/O 开发者大会上推出了 Gemini 3.5 Flash,官方说这是他们目前写代码和驱动 AI 智能体(让模型进业务流程干活)最强的模型。它能独立跑通编程流程、管理研究项目,内部测试里甚至从零搭建了一个操作系统。这标志着谷歌的重心从聊天转向了能自主执行复杂任务的智能体。不过,正文没披露这个模型的参数量、上下文窗口和具体定价,所以实际成本和规...

推荐理由:我会先打个折:正文没披露参数量、价格和上下文窗口,所以性能上限和实际成本都还看不清。但 Google 这次把 Gemini 3.5 Flash 直接押在 agent 和从零写软件上,等于说“别只把我当聊天工具,我能进业务流程干活”。对做 agent 和代码生成的人来说,这个方向比单纯刷榜更有看头。不过没给技术细节和定价,现在只能当信号看,别太激动。

The Verge · AI

Google 想用 CodeMender 跟 Anthropic 的 Claude Mythos 抢安全赛道

Google 在 I/O 上把去年 10 月亮相的代码安全工具 CodeMender 的 API 开放给一批专家测试,定位是“能自己发现漏洞并修好”的 AI agent。DeepMind CTO 说目标是帮全球代码库做安全加固。文章拿它跟 Anthropic 突然发布的 Claude Mythos Preview 对比,但正文没披露 CodeMende...

推荐理由:HKR 三项都踩中了,但正文只确认了封闭内测和标记修复机制,开放时间、价格、评测结果全都没披露,所以先放在 featured 这一档。

AI HOT 精选

谷歌发布 Gemini 3.5 Flash,专治复杂、跑得久的自动化流程

谷歌在 I/O 大会上掏出了 Gemini 3.5 系列的第一个模型 Flash,定位很明确:让模型进业务流程干活,处理那种步骤多、周期长的任务。在 Terminal-Bench 和 MCP Atlas 这两个考编程和代理能力的测试里,它的分数压过了自家上一代的 3.1 Pro。速度方面,比别家顶尖模型快 4 倍,如果放在谷歌自己的 Antigravi...

推荐理由:谷歌在 I/O 大会上扔了个 Gemini 3.5 Flash,专门给那种要跑很久、步骤很复杂的 agent 工作流用的。我会先打个折:跑分是谷歌自己给的,第三方还没复现,但 Terminal-Bench 上超 3.1 Pro、速度是其他前沿模型 4 倍这些数字,如果属实确实省钱省时间。Antigravity 环境里飙到 12 倍,这点先别太激动,正文没披露那是啥场景、跟谁比。整体看,这是个同日发布的重要模型更新,对做 agent 落地的人有直接参考价值,但还没到改写行业规则的程度。

The Verge · AI

Google AI Studio 现在能靠一句话生成安卓原生 App

Google 给 AI Studio 加了个新功能:你输入想法,它直接生成一个能在安卓手机上跑的 App。平台里内嵌了安卓模拟器,写完可以先预览;想真机体验的话,把手机连上电脑就能安装。Google 说后续还会开放测试邀请功能,但目前还没上线。这次首发主要面向个人小工具类应用,不是啥都能做。

推荐理由:Google AI Studio 现在能靠提示词直接吐出可安装的 Android 原生应用,还带模拟器预览和真机安装。初版只覆盖个人工具类应用,不是完整开发环境,所以算中等分量的产品更新,不是 P1。

TechCrunch · AI

Google 发布 Android CLI 1.0,让 Claude Code、OpenAI Codex 这类 AI 编程工具也能直接命令行开发安卓应用

Google 在 I/O 大会上把 Android CLI 推到了 1.0 稳定版。这东西是个命令行工具,主要作用是让各种 AI 编程助手(比如 Claude Code、OpenAI Codex,或者 Google 自家的 Antigravity)能直接通过命令行来构建安卓应用,不用非得打开 Android Studio 的图形界面。它内置了一个“an...

推荐理由:我会先打个折:正文没给版本号、发布时间,也没性能数据,所以只能当个信号看。但 Google 加 Android 加 agentic coding 这个组合,本身就够上 featured 线。它不是在秀技术指标,而是在开一扇门——让 agent 从命令行直接插手 Android 构建,这对移动端开发者的工作方式冲击不小。

TechCrunch · AI

Google AI Studio 现在能让任何人几分钟内生成原生安卓应用

Google 在 I/O 2026 上给自家的网页版 AI Studio 加了个新功能:直接用自然语言描述需求,几分钟就能生成一个原生的安卓应用。以前搭环境、写代码可能要几周,现在把门槛压到了“会打字就行”。不过正文没披露背后用的是哪款模型、生成的应用能复杂到什么程度、有没有代码审查机制,也没提收费方式。另外 Google 还提到会用 Gemini 帮...

推荐理由:Google AI Studio 这次更新把代码生成直接落到安卓原生应用上,速度卖点很明确。正文没披露模型、价格和发布范围,所以只能算中等体量的产品更新,先放在 featured 档。

TechCrunch · AI

Google 在 I/O 2026 发布 Antigravity 2.0,更新了桌面应用和命令行工具

Google 在 I/O 大会上推出了编程助手 Antigravity 的 2.0 版本,主要更新了桌面应用、命令行工具和一个用来搭自定义流程的 SDK。同时,他们新加了一个每月 100 美元的 AI Ultra 套餐,使用额度是 AI Pro 套餐的 5 倍。不过,这篇报道没具体说桌面应用和命令行工具到底更新了哪些功能,也没提 SDK 能接入哪些外部系统。

推荐理由:HKR 三项都踩中了,但正文没写桌面应用和 CLI 具体能干什么,功能细节是空的,所以分数压一压,不上 78。Google I/O 的发布节点加上 100 美元套餐和 5 倍额度,够上 featured。

AI HOT 精选

Google AI Ultra 套餐降价,新增 100 美元档位

Google 把顶配 AI Ultra 套餐从每月 250 美元降到 200 美元,同时加了一个每月 100 美元的新档位。新档位把 Gemini 应用的使用上限提到 Pro 套餐的 5 倍,主要面向编程和创作场景,还附带新功能抢先体验、20TB 存储和 YouTube Premium。正文没说明 5 倍限额具体对应多少调用次数,也没提新功能抢先体验的...

推荐理由:这是订阅价格和配额打包调整,不是模型或能力发布,但官方来源、价格数字都实在,对用 Google 生态干活的人有直接影响。降价幅度和新增档位让信息够硬,放在 featured 没问题。

r/LocalLLaMA

开源项目 Codegraph 声称能把 Claude、Cursor 等编程助手的工具调用次数砍掉 94%

Codegraph 的做法是提前给代码建好一张知识图谱,把符号关系、调用链和代码结构都索引好。在 VS Code 的测试里,工具调用从 52 次降到了 3 次,运行时间从 1 分 37 秒缩短到 17 秒。不过正文没披露具体测试的代码规模和任务复杂度,这个 94% 的降幅能不能在别的项目里复现还不好说。

推荐理由:HKR 三条都过了,但证据目前只有 Reddit 帖子和公开仓库的自测结果,没有独立复现或第三方验证。94% 的降幅和 52→3 的调用次数足够上 featured,但还不到 p1 的确定性。我会先打个折:数字好看,但别太激动,等有人复现再说。

AI HOT 精选

Gemini 3.5 发布,先上 Flash 版,主打智能体和写代码

Google DeepMind 推出 Gemini 3.5 系列,首发的是 3.5 Flash。官方说这是他们目前最适合让模型进业务流程干活和写代码的模型。正文没披露参数量、价格和上下文窗口,实际能力还得等跑分和实测。

推荐理由:HKR 三项都成立。Google DeepMind 把 Gemini 3.5 的首发押在 Flash 版本上,并且直接挂上 agent 和 coding 的标签,钩子够清晰。新事实是 3.5 Flash 先跑出来,但参数、价格、上下文窗口一概没提,信息有缺口,所以重要性我给 88,没往更高拉。对做模型选型和 agent 落地的人来说,这条更新会直接影响后续决策,相关性没问题。

r/LocalLLaMA

Cursor 和 Claude Code 没变笨,是它们的 agent 循环在盲目翻文件,把上下文窗口撑爆了

有 Reddit 用户扒了 API 日志,发现 Cursor 和 Claude Code 的 agent 干活时,会在上万行的代码库里反复用 grep 搜大约 40 个文件,有时为了改 5 行代码就把整个 2000 行的文件塞进上下文。更夸张的是,在真正开始写代码前,光工具定义和操作日志就先吃掉大约 3 万个 token。帖子认为工具本身没降智,是这种...

推荐理由:这篇 Reddit 帖子没走“模型降智”的老路,而是从 API 日志里挖出一个更扎心的解释:agent 在工作时自己把上下文窗口塞满了。我会先打个折——这只是单帖爆料,没附原始日志,也没第三方复现,所以不能当定论。但它的价值在于把模糊的“变慢变蠢”翻译成了可排查的结构性问题:仓库一大,递归检索就失控,工具描述和日志占掉大量 token,留给真正写代码的空间反而不多。对正在用这类工具的从业者来说,这比猜模型更新管用,因为它指向了可以动手优化的地方,比如裁剪工具定义、限制检索深度。正文没披露具体复现步骤,这点先别太激动,但作为一线信号已经够格上 fea...

5月19日星期二

AI HOT 精选

用 Claude Code 两分钟生成一个项目计划页,比 Notion 快了近 20 倍

作者给 Claude Code 下了一段精确的提示词,两分钟就吐出一个单文件 HTML 页面,暗色主题、时间线、可折叠表格全都有,没有外部依赖,拿来就能用。他以前在 Notion 里搭同样的模板要花 30 到 40 分钟,效率差了近 20 倍。核心是把视觉、内容结构和交互细节一次性写进提示词里,让模型直接交付成品。正文没披露具体提示词全文,也没说生成后...

推荐理由:HKR 三项全中:有具体的 Claude Code 实操钩子,有 2 分钟 vs 30-40 分钟的硬数字对比,对一线干活的人直接有用。范围虽小,但信息密度够,放在 featured 没问题。

AI HOT 精选

月之暗面 Kimi 新融资拉来国资和央企,半年估值翻四倍

Kimi 正在进行一笔 20 亿美元(约 136 亿人民币)的融资,已接近收尾。新股东名单里出现了国智投、北京人工智能基金等国资机构,以及中国移动这样的央企。今年 1 月和 2 月,Kimi 已经密集完成了三轮融资,分别拿了 5 亿、7 亿和 7 亿美元。加上最新这笔,不到半年融资总额超过 39 亿美元,估值比去年 11 月的约 43 亿美元翻了四倍多...

推荐理由:Kimi 这轮融资还没完全 close,所以先不打满分。但国智投和中国移动出现在股东名单里,加上半年估值从不到 10 亿跳到 40 亿左右,说明国资在加速给头部模型公司兜底。我会先打个折:正文没披露具体估值计算方式和交割时间,这点先别太激动。

Latent Space

想进顶尖 AI 实验室做预训练?先学会写一个比官方库还快的 GPU 内核

Vlad Feinberg 写了一篇求职笔记,把进前沿实验室的门槛讲得很直白:核心能力是底层性能调优,也就是能动手改内核(kernel),让模型训练真的跑得动。他给了一道具体的面试题——先推导 Chinchilla 缩放定律,并比较它在稠密模型和 MoE(混合专家)架构下的区别;然后用 JAX 从零实现,最后写一个 Pallas 内核,要求在专家维度 ...

推荐理由:这篇文章把“进前沿实验室做预训练”拆成了可操作的技能清单:手写 JAX 内核、自己推一遍 Chinchilla 定律、用 Pallas 给 MoE 的 up/down 投影做融合。我会先打个折——正文没披露这些建议是 Vlad Feinberg 的个人经验还是 Google 的普遍要求,也没说这些技能在面试里占多大权重。但光是这份清单本身,对想往预训练方向走的人就有参考价值,尤其是把“懂缩放定律”从一句空话落到“自己推导过”这个动作上。