跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

842 条精选相关主题模型发布行业动态AI 编码

最新精选

第 681–700 条 · 共 842 条

4月16日星期四

36 氪 · 直链

智元机器人旗下的觅蜂发布了一个物理 AI 数据平台,想解决机器人行业“没数据可喂”的问题

大语言模型能靠读书学知识,但具身机器人得在真实世界里摸爬滚打才能攒数据。觅蜂说现在全球高质量机器人训练数据加起来也就 50 万小时,跟大模型用的 100 万亿 token 完全没法比。他们这次推了一套叫 MEgo 的“无本体采集”硬件,就是让人戴着轻量夹爪和头戴设备直接记录动作,不用每次都搬昂贵的机器人本体。夹爪重 480 克,能 1080P 60fp...

推荐理由:我会先打个折:这还是一家公司的单次发布,正文没披露客户规模、定价和实际训练效果,所以分数没往上拉。但信息量够实在——觅蜂不卖本体,卖的是物理AI数据,智元自己拿数据也得走市场化下单。两款采集硬件参数也给了:夹爪480克、头显7个摄像头超300°视野、亚毫秒级同步。对盯着数据瓶颈的从业者来说,这些数字和商业模式比单纯秀机器人更有参考价值。

Hacker News 首页

通义千问开源 Qwen3.6-35B-A3B:总参数 350 亿,每次推理只激活 30 亿,主打编程智能体

Qwen 放出了一个新开源模型 Qwen3.6-35B-A3B,用的是混合专家架构,总参数量 350 亿,但实际干活时只调用 30 亿参数,跑起来很省资源。它的核心卖点是编程智能体能力,在 SWE-bench Verified 上拿了 73.4 分,Terminal-Bench 2.0 上 51.5 分,直接超过了自家上一代 270 亿参数的密集模型 ...

推荐理由:这是 Qwen 正经发模型,不是套壳功能更新。HKR 三条全中:低激活参数做代理编程是钩子,基准分数给了具体数字,开源权重加 30 亿激活直接戳部署成本和竞争焦虑。没给 p1 是因为目前只有一篇博客,还没看到第三方复现和更多消融实验。

r/LocalLLaMA

Qwen 放出 Qwen3.6-35B-A3B,35B 总参数只激活 3B,开源可商用

Qwen 发了个新模型,叫 Qwen3.6-35B-A3B,用的是稀疏 MoE 架构,总参数量 35B,但每次推理只激活其中 3B 参数,跑起来会比较省资源。采用 Apache 2.0 协议,可以商用。官方说法是它在写代码、处理多模态任务上表现不错,还支持“思考”和“不思考”两种模式,能直接塞进业务流程里干活。不过这篇帖子没给出具体的跑分、上下文窗口长...

推荐理由:这条帖子是个发布通告,信息量有限但钩子够硬。35B 总量、3B 激活的稀疏 MoE 听着省算力,但正文没放基准和上下文窗口,我会先打个折。Apache 2.0 开源是实锤,对想自己部署的人有吸引力;agentic coding 和多模态推理的说法先别太激动,等实测数据出来再看。

Hacker News 首页

Darkbloom:用闲置 Mac 跑加密推理,号称比 OpenRouter 便宜七成

Eigen Labs 搞了个叫 Darkbloom 的去中心化推理网络,把一亿多台苹果芯片 Mac 的闲置算力攒起来卖。它提供兼容 OpenAI 的 API,主打端到端加密和硬件验证,说操作节点的人看不到你的数据。价格表上列出的 token 费用比 OpenRouter 低 50%,不是标题里的 70%,这点先打个折。正文没披露独立安全审计的具体范围,...

推荐理由:HKR 三条全中:闲置 Mac 组网做推理的玩法有新鲜感,文章也把规模、接口、加密和价格都摆出来了。我先打个折,维持在 80 分——这还只是团队自己发的预览,审计范围、网络稳定性、攻击面边界都没经过第三方验证,论文出来之前别太激动。

OpenAI News

OpenAI 发布 GPT-Rosalind:一个专为生物医药研究做的推理模型

OpenAI 在 2026 年 4 月 16 日推出了 GPT-Rosalind,一个专门面向生物学、药物发现和转化医学的前沿推理模型。它现在以研究预览版的形式在 ChatGPT、Codex 和 API 里对通过审核的客户开放。模型的核心卖点是能处理多步骤的科研流程,比如读文献、理解基因序列、设计实验和做数据分析,并且能调用超过 50 种科学工具和数据...

推荐理由:我会先打个折:正文没披露模型参数、价格和具体基准分数,所以别急着把它当成熟产品看。真正值得盯的是落地范围——OpenAI 把 Amgen、Moderna、Thermo Fisher 这些大药企拉进来做 research preview,说明他们想用真实业务场景验证模型,而不是发个论文就完事。Codex 里那个免费的生命科学插件能连 50 多个工具和数据源,对做生物信息学的人可能挺实用,但没给性能数据,这点先别太激动。整体看,这是 OpenAI 往垂直行业扎的一步,但信息缺口不小,暂时只能给 featured。

TechCrunch · AI

谷歌给 Mac 做了个原生 Gemini 应用,快捷键一按就能用

谷歌在 4 月 15 日上线了 Gemini 的 Mac 原生应用,要求 macOS 15 以上系统。跟之前用网页版不同,现在按 Option + 空格就能在任何界面呼出它,不用切窗口。你可以把当前屏幕内容或本地文件直接丢给它,让它帮你总结图表、核对日期或写公式。应用还内置了 Nano Banana 生图和 Veo 生成视频的功能。简单说,谷歌终于追上...

推荐理由:Google 给 Mac 发了个原生 Gemini 应用,快捷键一按就能呼出,还能直接把整个屏幕或本地文件丢给它看。我会先打个折:这不算模型能力飞跃,更像在抢桌面入口和用户上下文。正文没提和网页版在回答质量上有没有区别,也没给延迟或资源占用数据,所以别急着说体验一定更好。但能共享屏幕和文件,意味着它想当个看得见你桌面的助手,这点比多一个客户端重要。整体是中等体量的产品更新,放在 featured 低位合适。

X · @dotey(宝玉)

OpenAI Agents SDK 加了内置沙箱和原生执行框架,TypeScript 版还在开发

OpenAI 给自家 Agents SDK 塞进了一个内置沙箱,Agent 可以直接在里面读写文件、跑代码、装依赖、保存状态,不用开发者自己搭环境。沙箱支持 Cloudflare、Vercel、Modal 等云厂商,也能接自己的方案。另一个更新是 Harness 架构,把状态存外面、计算跑里面,容器崩了能捡起来接着跑,不用重来,也能防提示注入导致凭证泄...

推荐理由:OpenAI 把 Agents SDK 从玩具级推到可上生产的级别,核心是两件事:内置沙箱让 agent 能安全跑代码和装东西,Harness 把执行和状态拆开,容器挂了任务还能接着跑。对做 agent 的团队来说,这省了自己搭隔离环境和写恢复逻辑的功夫。TypeScript 支持还在开发,正文没给时间,这点先别太激动。整体是工具链的扎实升级,不是概念发布,所以放 featured。

4月15日星期三

OpenAI News

OpenAI 更新 Agents SDK:给模型配了个能看文件、跑代码、还能关在沙箱里干活的工位

OpenAI 在 4 月 15 日发布了 Agents SDK 的新版本,核心是两件事:一是给 agent 加了一套更完整的“控制回路”(harness),让模型能直接操作文件、执行命令、编辑代码,并且支持 MCP、skills、AGENTS.md 等社区里逐渐流行的接入方式;二是原生集成了沙箱执行环境,agent 可以在一个隔离的电脑环境里读写文件、...

推荐理由:OpenAI 发了篇 Agents SDK 下一步演进的标题,正文没给细节,所以功能、数字、上线时间都确认不了。我会先打个折:这更像一个预告,不是完整发布。对开发者来说,信号是 SDK 会继续往更工程化的方向走,但具体能省多少事、稳不稳,还得等后续公告。

FT · 科技

Uber 宣布投入 100 亿美元押注无人出租车,但正文被付费墙挡住,没透露钱怎么花、和谁合作、在哪落地

FT 这篇报道的标题说 Uber 要砸 100 亿美元转向无人出租车,但文章内容完全在付费墙后面,只显示了订阅引导页。正文没披露这笔钱是分几年花、投给自研还是外部采购、有没有锁定具体的自动驾驶公司或试点城市。100 亿这个数字看着很大,但不知道花钱节奏的话,更像一个战略表态而不是可验证的落地计划。这点先别太激动,等看到具体预算分配和合作伙伴再判断 Ub...

推荐理由:FT 只给了一个标题和一句摘要,正文是空的,所以信息密度极低。唯一能抓住的就是“100 亿美元”这个数字,够硬,也够模糊——没写是一次性投入还是多年总和,没写是自研、合资还是采购第三方车辆。我会先打个折:标题里的“战略转向”听起来像公关叙事,真正要盯的是后续资本开支怎么落地。目前没有时间表、没有合作方、没有落地城市,验证几乎为零,所以重要性卡在 79 是合理的,放在 featured 里当个信号看,别当定论。

X · @dotey(宝玉)

Claude Code 桌面端重写,现在能在一个仓库里同时跑多个编程任务

Anthropic 的 Claude Code 桌面端负责人说他们把应用从底层重写了一遍,主要为了让用户能更方便地并行处理多个编程任务。实现方式是用 Git worktree 给每个会话一个独立的代码副本,改完之前互不干扰,合并时再做可视化差异对比。负责人自称已经好几周没开过 IDE 和终端了。正文没提发布时间、性能数据和具体支持哪些平台,这点先别太激动。

推荐理由:这次 Claude Code 桌面端重构瞄准了一个很实际的场景:同一个仓库里同时开多个编程任务。用 Git worktree 做隔离,每个会话改自己的副本,合并前互不干扰,再配上可视化 diff 和预览,工作流是完整的。我会先打个折——正文没给发布时间、性能数据和具体支持平台,这些缺口让实际体验还不好判断。但光凭并行会话这个方向,对天天跟代码打交道的开发者来说,吸引力已经够了。

X · @claudeai

Claude Code 桌面版改版,一个窗口里能同时开好几个 Claude 会话干活

Anthropic 给 Claude Code 桌面版换了新界面,现在你可以在一个窗口里并排跑多个 Claude 会话,左边多了个侧边栏来管理这些会话。对写代码的人来说,这主要解决的是来回切窗口的打断问题——比如一边让 Claude 改后端,另一边让它写前端,不用再开好几个终端或 IDE 面板。正文没提具体推送时间、支持哪些平台,也没说多会话之间能不能...

推荐理由:Anthropic 官方发的产品更新,改动具体,直接关系到编码工作流里的上下文切换成本,所以 H、K、R 都成立。我会先打个折:没公布上线时间和平台覆盖,交互细节也缺,这让它的实际影响还看不全,所以分数压在 featured 门槛附近,不往上拔。

X · @op7418(歸藏)

Claude Code 推出 routines,把定时任务和事件触发搬上云端,电脑关了也能跑

Claude Code 新出的 routines 功能,让你把一套工作流——提示词、代码仓库、运行环境和外部连接器——打包成一个云端自动任务。支持按小时/天定时、HTTP API 调用,或者响应 GitHub 上的 PR、push、issue 等事件。每次触发都会在云端开一个完整的 Claude Code 会话,能执行 shell 命令、调用仓库里的技...

推荐理由:Claude Code 这次更新的 routines 功能,核心是把提示词、代码仓库、运行环境和外部连接器打包成一个可自动执行的云端任务。触发方式给了三种:定时、HTTP 请求和 GitHub 事件,每次触发都会拉起一个完整的云端会话,能执行 shell 命令、调用仓库内的自定义技能、访问外部服务,任务跑完后本地可以直接接手继续工作。这个设计思路是本地优先、云端接管重复劳动,对日常开发流程的侵入性低。我会先打个折:正文没提定价、配额限制和支持哪些平台,这些缺口让实际可用性还看不清,所以虽然方向对,但别急着全量切过去。

X · @dotey(宝玉)

Claude Code 加了个 Routines 功能,让 AI 按预设条件自动跑任务,不用人盯着

Routines 相当于给 Claude Code 写好的任务模板,接上代码仓库和外部工具后,靠定时、GitHub 事件或 API 调用就能在 Anthropic 云端自己跑。Anthropic 内部已经在用,比如代码合并到发布分支后自动生成文档更新。Pro、Max、Team、Enterprise 用户都能用,任务数量不限,但每天运行次数有上限,超出要...

推荐理由:这不是小修小补。Routines 把 Claude Code 往事件驱动的云端 agent 推了一步,3 种触发、套餐覆盖和用户身份执行都交代清楚了,所以 H、K、R 全过。没进 p1 是因为现在还挂着研究预览的标签,每日配额也没公布,我会先打个折。

X · @claudeai

Claude Code 推出定时任务功能,写好指令就能在云端自动跑,不用一直开着电脑

Anthropic 给 Claude Code 加了一个叫 routines 的研究预览功能。你可以一次性配好提示词、代码仓库和要对接的工具,然后让它按时间表、API 调用或事件触发自动执行。这些任务跑在 Anthropic 自己的服务器上,所以你的笔记本不用一直开着。正文没提怎么收费、有没有次数限制,也没说这个功能会推给哪些用户。

推荐理由:这次更新把 Claude Code 从本地交互式编程扩展到了托管、定时和事件驱动的执行模式,HKR 三项全中,Anthropic 的产品动态本身也有加分。但正文没公布价格、配额和具体开放范围,所以先放在 featured 而不是 P1。真正值得盯的是托管执行这条链路,不是单次补全功能。

4月11日星期六

X · @dotey(宝玉)

Anthropic 公测 Claude Managed Agents,用 Vaults 把用户第三方密钥和模型上下文隔开

Anthropic 给 Claude Managed Agents 加了一个叫 Vaults 的组件,专门管每个终端用户的第三方账号密钥。开发者给每个用户建一个 Vault,把 Linear API Key、GitHub Token 这类凭证存进去,启动会话时只传 vault_id,基础设施会在模型需要调外部工具时自动把凭证塞进去。关键设计是隔离:凭证...

推荐理由:这篇补上了 Claude Managed Agents 公测里最缺的实现细节:第三方凭证怎么隔离。HKR 三项都站得住——安全钩子具体、流程可复现、定价明确,而且直接回应了 agent 团队部署时最头疼的密钥管理问题。影响面停留在开发者集成层,所以维持 featured。

X · @dotey(宝玉)

Anthropic 发布 Claude for Word 插件测试版,直接在 Word 侧边栏改文档

Claude 现在能直接嵌进 Word 干活了。选中文字用自然语言说怎么改,修改结果会以 Word 原生的“修订模式”呈现,接受或拒绝都在审阅面板里完成,不用再把内容复制到网页端来回倒。它会识别标题样式、编号和项目符号,改完格式不乱。你还可以上传参考文档,写作时标注引用来源。团队能把反复用的工作流(比如合同审查)封装成 Skill,一键复用。这个插件和...

推荐理由:这是 Anthropic 面向 Team 和 Enterprise 的一个有料的产品更新,不是泛泛的集成公告。HKR 三项都踩中了:钩子够直接、机制有细节、卡位也准。但我会先打个折——目前只是测试版,正文没披露定价、地区和正式发布时间,所以热度先控在中等偏上。

X · @dotey(宝玉)

Claude Code 新增 ultraplan:在终端发起规划,去浏览器审阅批注,再决定云端或本地执行

Claude Code 推出了 ultraplan 预览功能,把代码规划从终端搬到了浏览器。你在终端输入 /ultraplan 加需求描述,Claude 会在云端读代码库、起草实现方案,终端不占着,你可以干别的。方案写好后在浏览器里打开,像审文档一样对具体段落加批注、打表情、反复改到满意。最后二选一:让云端直接执行并开 PR,或者把方案拉回本地终端跑。...

推荐理由:Claude Code 这次更新不是加个小功能,而是把规划从执行里拆出来。你在终端敲 /ultraplan,Claude 去云端读代码库、出方案,你在浏览器里像改文档一样批注修改,满意了再决定让云端直接跑完开 PR,或者拉回本地终端自己跑。规划阶段终端不卡住,正文说 token 消耗跟本地 plan 模式差不多,这点先别太激动,等实测数据。目前还是预览版,只对开网页版的用户开放,正文没披露云端规划的实际延迟和成功率。

X · @claudeai

Claude 出了 Word 插件,现在可以在侧边栏直接写稿、改稿

Anthropic 把 Claude 塞进了 Word,目前是测试版。你在文档侧边栏就能让它帮你起草、编辑和修改内容,Claude 会保留原有格式,改动以修订模式显示,方便你逐条确认。这个功能只开放给 Team 和 Enterprise 用户,正文没提价格、支持地区,也没说什么时候正式上线。

推荐理由:这是个有用但分量中等的 Anthropic 产品更新。官方帖子确认了 Word 侧边栏入口、Team 和 Enterprise 方案可用、保留原有格式并以修订模式显示改动,所以 K 和 R 都站得住。但价格、地区和具体上线时间都没说,信息缺口明显,只能放在 featured 的低位。

4月10日星期五

X · @dotey(宝玉)

Anthropic 新 API 让便宜模型干活、贵模型当军师,Haiku 配 Opus 在 BrowseComp 分数翻倍,成本只要 Sonnet 的 15%

Anthropic 推出了“顾问工具”API,让 Sonnet 或 Haiku 作为执行者跑任务,遇到难决策时把上下文递给 Opus 出主意,Opus 不碰工具、不直接输出,只当幕后军师。这跟常见的“大模型拆任务、小模型执行”反过来了,好处是大部分 token 烧在便宜模型上。Sonnet 配 Opus 在多语言 SWE-bench 上比单干高 2.7...

推荐理由:Anthropic 这次 API 更新挺实在,不是画饼。核心就是让 Sonnet 或 Haiku 当执行者跑任务,卡壳时再问 Opus,而且是在同一次 API 请求里完成模型切换,Token 分开算钱。给的数字也清楚:Sonnet+Opus 在多语言 SWE-bench 上比单用 Sonnet 高了 2.7 个百分点,单任务成本还降了 11.9%;Haiku+Opus 在 BrowseComp 上从 19.7% 跳到 41.2%,成本只要 Sonnet 的 15%。我会先打个折,毕竟还在 beta,但这条路子对控制推理成本确实有用,值得关注。

X · @claudeai

Claude 平台上线“顾问策略”:用 Opus 当军师,Sonnet 或 Haiku 当执行者

Claude 平台把 Opus 模型设为“顾问”,让更便宜的 Sonnet 或 Haiku 去执行具体任务。官方说法是,这样能让 agent 的智能水平接近 Opus,但成本低很多。正文没给出具体价格对比、跑分数据或上线时间,所以实际省多少、效果打多少折,还得等实测再看。

推荐理由:Anthropic 给 Claude Platform 加了个 advisor 模式,让 Opus 出主意、Sonnet 或 Haiku 干活,说这样能让 agent 接近 Opus 的水平还更省钱。我会先打个折——正文没给价格、没给基准分数、也没说什么时候上线,所以省多少、强多少现在全是问号。但思路本身对做 agent 的人很有用,值得放出来让大家盯着后续。