跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

842 条精选相关主题模型发布行业动态AI 编码

最新精选

第 281–300 条 · 共 842 条

5月21日星期四

彭博科技

英伟达上季度每股赚 1.87 美元,超预期,下季度营收指引 910 亿

英伟达刚发了 2026 财年第一季度的财报,每股收益 1.87 美元,比华尔街预期的 1.77 美元高出一截。公司对截至 7 月的当季营收指引是 910 亿美元,也明显高于市场预估的 874 亿左右。这条视频本身是彭博的报道片段,正文没披露各业务线的具体表现和毛利率细节,所以没法判断增长是数据中心业务继续拉动的,还是有别的板块在补位。

推荐理由:Nvidia 财报是观察 AI 基础设施热度的关键节点,910 亿的指引给 HKR 三项都提供了实打实的信号。这不是模型或功能发布,所以放在 featured 档位没问题,信息质量够硬。

AI HOT 精选

英伟达一季度净利润 583 亿美元,同比涨了 211%,数据中心收入占了大头

英伟达 2027 财年第一财季(截止到 2026 年 4 月 26 日)总收入 816.15 亿美元,净利润 583.21 亿美元,同比直接翻了两倍多。增长主要靠数据中心业务,单这一块就进账 752 亿美元,同比涨了 92%。毛利率也拉到了 75% 左右,比去年同期高了 14 个百分点。公司预计下个季度收入能到 910 亿美元,上下浮动 2%。另外,董...

推荐理由:英伟达这份财报就是AI基础设施景气度的温度计。数据中心752亿美元的收入说明大厂还在疯狂囤卡,211%的利润增速比很多AI公司的营收涨得还快。我会先打个折:这是财务数据,不是新模型或新功能发布,所以重要性停在82分。但数字本身已经足够让关注算力成本和供应链的人必须看一眼。

AI HOT 精选

OpenAI 官宣 GPT-5 要来了,但除了这句话什么都没说

ChatGPT 官方账号发了条推,就一句话“GPT-5 即将发布”,配了个船的表情。没给发布日期、参数规模、上下文窗口长度、定价,也没提 API 什么时候开放。我会先打个折——这种预告大概率是提前占坑,离真正能用还有段时间。

推荐理由:这条消息我会先打个折。标题确实抓人,但正文等于什么都没说,没日期、没参数、没价格、没 API 细节,连“即将”是多快都判断不了。如果是真的,对做模型选型和成本估算的人影响不小,但现在只能当个预告看,别太激动。

AI HOT 精选

Perplexity 上线查询感知压缩,上下文 token 最多砍掉 70% 但回答质量反而更好

Perplexity 把一项叫“查询感知压缩”的技术用到了线上。它能在搜索时把喂给模型的上下文 token 最多减少 70%,同时回答质量还提升了。核心逻辑是“更好的上下文优于更多的上下文”,也就是先理解你问什么,再挑最相关的信息塞进窗口,而不是一股脑全丢进去。正文没披露具体测试基准和压缩方法细节,所以实际效果我会先打个折,但能省下这么多 token ...

推荐理由:我会先打个折:正文只给了一条 X 帖子,没放基准测试和可复现的设置,所以别太激动。但这条信息本身够硬——Perplexity 在生产环境用查询感知压缩,最多砍掉 70% 上下文令牌,同时回答质量还变好了。对搞外挂资料库和搜索优化的从业者来说,这直接关系到省钱和降延迟,值得看一眼。

AI HOT 精选

ChatGPT 手机版接入 Codex,手机上问一半,回到电脑能接着聊

OpenAI Devs 发帖说 ChatGPT 移动端现在支持 Codex,你可以在手机 App 里提问,之后在桌面端继续同一个对话。帖子没提支持哪些平台、需要哪个 App 版本,也没说是不是逐步推送。

推荐理由:OpenAI Devs 是官方渠道,消息可信,HKR 三项都踩中了。但正文只确认了移动端能用 Codex 和跨设备接续对话,具体支持哪些平台、版本号、推送范围全都没提,所以信息量刚好卡在 featured 门槛上,先别当全量上线看。

The Verge · AI

YouTube Shorts 现在能用 AI 把别人的视频改成动画或给你换头

YouTube 给 Shorts 的“混剪”功能加了一个叫“重新想象”的选项,背后用的是 Gemini Omni 模型。你可以直接拿别人发过的短视频,让 AI 把画面风格改成动漫、替换画面里的东西,或者把自己的脸塞进原视频里。创作者可以在上传时决定允不允许别人用 AI 改动自己的内容。正文没提生成一次要多久、有没有水印,也没说免费用户能用几次。

推荐理由:Google 给 YouTube Shorts 的 Remix 加了个 reimagine 模式,用 Gemini Omni 直接改别人的短视频。我会先打个折:这不是新模型发布,是个产品功能更新,所以放在低 featured 档。但它的传播力很强,因为“混剪别人视频”这个动作本身就自带话题,而且创作者能选择关掉,这点在授权上算给了台阶。正文没披露这个功能什么时候全量上线,也没说对视频时长、分辨率的限制,这些缺口让实际影响还得再观察。

The Verge · AI

谷歌搜索的 AI 进化,就是塞进更多广告

谷歌开始在搜索广告里用 Gemini 自动生成产品介绍,还会在部分广告里直接嵌入聊天机器人。文章拿胶囊咖啡机举了个例子,但没提具体覆盖范围和广告价格怎么算。说白了,你搜东西时看到的“赞助产品”描述,以后可能都是 AI 写的,有些广告点进去还能跟机器人聊两句。

推荐理由:Google 开始在 Gemini 的商品搜索结果里塞赞助商品和广告聊天机器人了。我会先打个折:正文完全没提投放范围有多大、怎么收费、效果数据如何,所以这更像一次试探性铺开,而不是大规模产品发布。对从业者来说,值得盯的是它把广告嵌进对话式搜索的路径,但现阶段信息缺口太大,先别太激动。

5月20日星期三

TechCrunch · AI

Stability AI 发了新音频模型,最长能生成六分多钟的歌

Stability AI 推出了 Stable Audio 3.0 系列,一共四个模型。最小的两个(4.59 亿参数)能在设备本地跑,生成两分钟的音乐或音效;中等(14 亿参数)和大杯(27 亿参数)模型则能生成 6 分 20 秒的完整曲子,比 2024 年的 2.0 版长了一倍多。小、中杯模型都开放权重,可以随便用和改。不过正文没提训练数据来源、生成...

推荐理由:我会先打个折:标题的 6 分钟和正文的 2 分钟对不上,正文没解释这个差距,所以别太激动。但端侧能跑出 2 分钟音轨这件事本身挺省钱,对做音频工具的人是个信号。整体算中等偏轻的产品更新,靠标题的钩子和端侧成本点撑到 featured 门槛。

The Verge · AI

AI 内容打标签这事,到了见真章的时候

Google 在 I/O 大会上说,现在能更广地验证 SynthID 给 AI 图片打的水印了;另一边 C2PA 也在推一套叫 Content Credentials 的标准,想给图片、视频、音频都加上来源元数据。说白了,就是两套技术路线在比赛谁能更靠谱地告诉你“这东西是不是 AI 生成的”。但文章没具体说这次 SynthID 的验证范围到底铺到了多大...

推荐理由:这条消息本身有料,但正文没给出完整覆盖范围、落地时间表和实际采用数据,所以我会先打个折。它更像一次中量级的溯源更新,不是那种必须立刻写的重磅发布。

The Verge · AI

如果连 Google 都做不出有用的 AI 智能体,那可能没人能了

Google 在 I/O 2026 上发了好几个 AI 智能体,能帮人搜资料、规划活动、总结邮件和日历。这些智能体可以在后台一直跑,但文章没提什么时候上线、怎么收费,也没给任何实测数据。作者的意思是,Google 在 AI 智能体上折腾了好几年,这次借着 OpenClaw 的热度再推一把,但如果连手握海量用户数据的 Google 都搞不定,那整个行业吹...

推荐理由:H 和 R 都很强,因为文章把 Google 的 agent 当成整个行业能不能成的风向标,而且直接踩中从业者对实用性、平台权力和成本的焦虑。K 给了新信息,但只限于后台运行这一点,正文没披露上线时间、定价和实际评测结果,所以整体还是落在 featured 偏下位置。

TechCrunch · AI

Figma 在协作画布里塞了个 AI 助手,能直接用对话生成和修改设计

Figma 在它的多人协作画布上直接加了一个 AI 助手。你可以用大白话让它生成新设计、改现有设计,或者自动跑一些重复活儿,比如批量出不同版本的设计稿。你还能同时开好几个助手,让它们各干各的。Figma 说这个助手能理解设计语境和元素,因为它背后用的模型是专门针对设计场景调过的。不过正文没披露这个助手具体是用自家模型还是接了别家的 API,也没提生成结...

推荐理由:Figma 把 AI agent 塞进了协作画布,你打字就能让它生成或改设计。我会先打个折:正文只说了能力范围,没提用的是什么模型、成本多少、什么时候上线,所以别太激动。但这件事本身值得关注,因为它意味着设计师的工作流可能要被 agent 插一脚了。

阿里技术 · 公众号

阿里平头哥发布真武 M890 AI 芯片,128 卡超节点服务器已在百炼平台上线

阿里平头哥的真武 M890 AI 芯片首次公开,主打 Agent 场景的算力底座。配套的 128 卡超节点服务器,卡间直连延迟低于 150 纳秒,机架带宽达到 Pb/s 级别。这套硬件已经在阿里云百炼平台跑起来了,支持通义千问、DeepSeek 和 Kimi 等模型。不过正文因为环境验证问题没加载出来,具体的芯片架构、制程、显存规格和实测性能数据暂时看...

推荐理由:HKR三项都踩中了,但得先打个折——消息源是阿里自己的技术文章,没有第三方实测、没提定价、也没说量产规模。所以分数就卡在featured门槛上,当个基础设施产品更新看比较合适。

新智元 · 公众号

摩尔线程 MUSA 生态更新:SDK 对齐 CUDA 12.8,SGLang 主线已合并

摩尔线程放出了自家 GPU 生态 MUSA 的最新进展。SDK 5.1.0 把兼容目标拉到了 CUDA 12.8,覆盖了 761 个驱动和运行时接口,意思是跑 CUDA 代码时能认的指令更多了。推理框架 SGLang 的主线代码已经合并了 MUSA 的支持,硬件支持排期在 2026 年第二季度。另外还提了一个叫 MUSACODE 的工具,能自动把库迁移...

推荐理由:我会先打个折:这还是一家厂商的生态更新,不是整个国产 GPU 阵营的集体突破。但文章把兼容 API 数量、SDK 版本对标和 SGLang 主线合入这几个点都摆出来了,比空谈“替代 CUDA”实在。老黄喝豆汁的梗让标题有了传播力,内文也没写成公关稿,对关注推理部署和算力自主的读者来说值得一看。

机器之心 · 公众号

谷歌 I/O 大会后,搜索框直接变成了 AI 智能体入口

谷歌在 I/O 大会上发布了 Gemini 3.5 Flash,并把 AI 模式直接嵌进了搜索框。公司说现在它的 AI 服务每月要处理超过 3200 万亿个 token,已经有超过 850 万开发者在使用 Gemini。不过这篇文章因为微信平台的环境验证问题,正文内容没能加载出来,所以具体的模型参数、性能对比和实际体验细节都没法确认。

推荐理由:谷歌 I/O 这次把模型更新和搜索入口绑在一起推,AI Mode 直接嵌进搜索框,比普通功能发布重得多。Gemini 3.5 Flash 是新的轻量模型,月 token 消耗 3.2 千万亿说明用量已经很大,850 万开发者这个数字也够扎实。我会先打个折:正文没披露 3.5 Flash 的具体 benchmark 对比和定价,实际性价比还得等实测。但就凭搜索框变智能体这一条,当天必须写。

Latent Space

Google I/O 2026:Gemini 3.5 Flash 发布,百万 token 上下文、四种思考模式,主打编程和干活快

Google 在 I/O 大会上把 Gemini 重新定位成消费级 AI 入口和开发者代理平台。最核心的发布是 Gemini 3.5 Flash,今天就能用,上下文窗口 100 万 token,单次最多输出 6.5 万 token,提供“极简/低/中/高”四档思考深度,并且能在多轮对话里保留思考过程。官方说它比 3.1 Pro 更强,尤其在终端操作、编...

推荐理由:Google I/O 这次不是单点发布,是把模型、视频、agent 和开发工具打包一起推。Gemini 3.5 Flash 的定价和上下文窗口摆在那,对做应用的人有直接参考价值;Omni 的视频理解和 Spark 的后台 agent 思路,跟现在行业里追的 agent 落地、多模态成本是同一根神经。我会先打个折——现场 demo 和实际 API 稳定性之间通常有差距,但信息量够、时间点敏感,放 P1 没问题。

AI HOT 精选

微软内部警告:AI 编程工具让 GitHub 的代码托管生意面临生存危机

微软内部认为,Cursor、Claude Code 这类 AI 编程助手正在改变开发者写代码和协作的方式,大家不再需要频繁把代码传到 GitHub 仓库,这让 GitHub 的托管业务受到根本性冲击。微软已经要求部分团队在 2026 年 6 月底前停用 Claude Code,统一改用自家的 GitHub Copilot CLI,表面理由是统一工具链和...

推荐理由:这条消息的杀伤力在于“内部示警”和“生存级风险”这两个词,把 AI 编程工具对 GitHub 托管业务的威胁摆到了台面上。我会先打个折:目前只有一家媒体爆料,微软和 GitHub 都没公开回应,所以不能当定论看。但信息量够硬——微软一边推 Copilot CLI,一边给 Claude Code 设了停用 deadline,说明内部已经在用行政手段抢开发者入口了。对从业者来说,这比单纯的产品更新更有嚼头:如果 AI 编程工具真的让代码托管变得可有可无,GitHub 的护城河就塌了一大块。正文没披露这个决策覆盖多大规模、是否全球执行,这点先别太激动。整...

AI HOT 精选

通义千问发布 Qwen3.7-Max,主打长时间自主干活和跨平台编程

Qwen 团队推出了 Qwen3.7-Max,一个专为智能体场景设计的闭源模型。它最显眼的能力是能长时间自主执行任务,官方演示了一个连续跑 35 小时、调用上千次工具的内核优化任务。在编程方面,它在 Terminal Bench 2.0 上拿了 69.7 分,超过了 DeepSeek-V4-Pro Max 的 67.9 分;在 SWE-Pro 这类复杂...

推荐理由:Qwen Studio 发了 Qwen3.7,一口气覆盖聊天、图像视频理解、图像生成、文档处理、网页搜索、工具调用和工件生成,摆明要往智能体方向走。我会先打个折:正文没给任何 benchmark、定价、上下文窗口或延迟数据,所以没法判断实际可用性和成本。亮点是工具调用和工件生成这两项,说明模型不只是聊天,而是被设计成能进业务流程干活。这点先别太激动,等看到具体评测和接入方式再说。

AI HOT 精选

Gemini Omni 能拿你的脸和声音做数字分身,以后拍视频不用真人出镜了

Gemini Omni 上线了一个新功能,你可以用自己的长相和声音创建一个数字分身。建好之后,这个分身就能替你出镜生成视频,不用每次都重新上传照片。正文没提这个功能要不要钱、在哪些地区能用、什么时候正式上线,我会先打个折观望。

推荐理由:Gemini Omni 让用户拿自己的形象和声音做数字分身视频,建好之后不用反复传图,这点对做内容的人挺方便。但正文没写价格、哪些地区能用、什么时候上线,所以现在只能当个预告看。我会先打个折:功能听着省事,可落地时间表和成本都不清楚,别太激动。

AI HOT 精选

Gemini 3.5 Flash 发布:价格涨了,但谷歌打算把它塞进所有产品里

谷歌在 I/O 大会上直接发布了 Gemini 3.5 Flash,跳过预览阶段。输入价格涨到每百万 token 1.5 美元,输出 9 美元,分别是上一代 Flash 预览版的 3 倍和 Flash-Lite 的 6 倍,已经快追上自家的 Pro 型号了。涨价不是谷歌一家的事,OpenAI 和 Anthropic 的新模型也都在提价,各家似乎都在试探...

推荐理由:我会先打个折:正文只给了价格和全面铺开的意图,没提能力提升、跑分或上下文窗口,所以没法判断涨得值不值。但涨价幅度本身对开发者是硬信号,值得放进精选。

AI HOT 精选

Gemini 推出个人 AI 代理 Spark 和每日简报,能跨 Gmail、文档、幻灯片自动干活

Gemini 这次加了两个功能。一个是 Gemini Spark,相当于一个常驻的个人 AI 代理,你授权后它可以自己在 Gmail、Google Docs 和 Slides 之间跑流程,官方说笔记本合上也能继续运行——这点先别太激动,正文没披露具体怎么实现、延迟和资源消耗也没提。另一个是 Daily Brief,根据你设定的个人目标,每天给你推定制摘...

推荐理由:Gemini 应用这次加了两个东西:Gemini Spark 可以在你授权后跨 Gmail、Docs、Slides 自动操作,Daily Brief 则给美国 18 岁以上订阅用户推送每日简报。等于从聊天助手往个人代理迈了一步,让模型直接进你的文档和邮件里干活。正文没提延迟、错误率和权限撤回细节,实际稳不稳还得看上线后的反馈。