跳到正文

#多模态

今日 0 条

8月4日星期二

AI HOT 精选

欧盟 AI 透明度规则今天生效,不标 AI 内容最高罚 1500 万欧元

从今天起,在欧盟运营的科技公司必须给 AI 生成的文字、音频、视频和深度伪造内容打上标签,并告诉用户他们正在跟机器对话。违规罚款最高 1500 万欧元,或者全球年营业额的 3%。欧盟还发布了一套官方标签图标,公司可以直接用,不用自己设计。

推荐理由:这是欧盟 AI 法案透明度规则正式生效的日子,罚款上限明确,属于现有法规的执行节点而非新规出台。对在欧洲运营的 AI 公司和内容平台是直接的合规事件,HKR 三项都踩中,但因为是执行层面而非政策新增,所以重要性给到 78,放在 featured 里。

7月15日星期三

TechCrunch · AI

苹果 AI 功能拿到中国准入许可,底层用阿里的通义千问模型

中国网信办批准了 Apple Intelligence 在国内上线,前提是苹果把阿里的通义千问(Qwen)模型集成到 iOS、iPadOS、macOS 和 visionOS 里,负责文字和图片的理解与生成。阿里确认了合作,但没给具体上线时间。苹果之前找过百度、DeepSeek 和字节跳动,都因为模型适配问题没谈成。大中华区对苹果很重要,上季度卖了 20...

推荐理由:这条消息的份量在于它把中美 AI 落地规则撞在了一起。苹果为了进中国,必须换掉自己的模型,用本地供应商的,而且前面三家都没谈成——说明不是随便找个合作方就能过审,技术适配和监管要求之间有硬摩擦。我会先打个折:正文没披露具体上线时间,也没说 Qwen 模型是端侧跑还是云端调,这点先别太激动。但审批通过本身和谈判失败的原因,已经足够让从业者重新掂量“海外 AI 进中国”的成本和路径了。

7月3日星期五

Google DeepMind

Google DeepMind 与 A24 宣布首个此类研究合作

Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目长期展开,Google 同时已对 A24 进行投资。

6月8日星期一

FT · 科技

FT 报道称 AI 监控技术突破让克里姆林宫警觉,但正文被付费墙拦截,关键细节缺失

FT 这篇文章的标题和摘要片段提到,AI 能利用闭路电视画面识别目标,俄罗斯在伊朗最高领袖遇刺后暂停了一套监控系统。但文章正文返回了 403 错误,被付费墙挡在外面,所以系统名称、模型机制、供应商和时间线这些核心信息都没法核实。目前能看到的只有 RSS 摘要里的那几句,我会先打个折:标题里的“突破”和“警觉”听起来很重,但没看到具体技术方案和验证数据之...

推荐理由:FT 的标题和摘要片段提到 AI 能利用闭路电视画面识别目标,俄罗斯在伊朗最高领袖遇刺后暂停了一套监控系统。但文章正文返回了 403 错误,被付费墙挡在外面,所以系统名称、模型机制、供应商和时间线这些核心信息都没法核实。目前能看到的只有 RSS 摘要里的那几句,我会先打个折:标题里的“突破”和“警觉”听起来很重,但没看到具体技术方案和验证数据之前,只能当一条有悬念的线索。

6月4日星期四

FT · 科技

英国议员起诉马斯克的 xAI,想用假色情图片案测试 AI 公司要不要为模型输出负责

英国工党议员 Jess Asato 把马斯克旗下 xAI 告了,起因是系统生成了她的虚假性相关图片。这案子被当成一个测试案例,核心是想搞清楚:AI 模型开发者到底要不要为模型吐出的内容承担法律责任。不过目前公开信息很少——正文没披露具体是哪个模型、图片是怎么生成的、索赔金额多少,也没说法庭排期。

推荐理由:我会先打个折:正文没披露具体是哪个模型、怎么生成的、索赔多少钱,所以信息有缺口。但这件事本身够硬——议员告 AI 公司,而且是在英国拿法律试水,直接问“模型产出谁担责”。FT 的报道把 xAI、马斯克、虚假性影像和法律责任测试绑在一起,话题性很强。因为缺技术细节和金额,分数压在 78–84 这个区间是合理的,不用往上拔。

6月3日星期三

MIT Technology Review · AI

特朗普签了新 AI 行政令,Anduril 和 Meta 在给美军做能“用眼神下命令”的 AR 眼镜

特朗普废掉旧令不到两周,又签了一份新的 AI 行政令。核心变化是:要求科技公司在发布前沿模型前 30 天,自愿把模型交给政府审查,但不设强制许可证。对比之前被搁置的版本(要求提前 90 天提交),这次明显缩水了,不过也算从完全不管迈向了轻度监管。另一条消息是,军工公司 Anduril 和 Meta 正在给美军搞一款 AR 头显原型,想实现用眼球追踪和语...

推荐理由:我会先打个折:行政令是“自愿”送审,不是强制,别当成立法看。但 30 天这个数字给了企业一个明确的时间窗口,比之前模糊的“提前沟通”要具体。另一条更硬——Anduril 和 Meta 的原型头显让士兵用眼动和语音指挥无人机打击,这已经不是实验室概念了。两条放一起,一条在收紧模型发布,一条在把 AI 往杀伤链里塞,反差够大,从业者得知道。

6月1日星期一

机器之心 · 公众号

OpenAI 为机器人团队招兵买马,由 Sora 负责人带队,部分岗位底薪开到 34 万美元以上

OpenAI 放出了十多个旧金山的机器人岗位,团队由 Sora 的负责人 Aditya Ramesh 带队,是从他之前的 Worldsim 项目演变过来的。其中执行器设计工程师的底薪现金在 34.2 万到 44.5 万美元之间,另外还有 PPU 激励。不过原文因为微信环境异常,具体岗位职责和团队规模都没披露,只能看到招聘信息的大致框架。

推荐理由:这条消息有明确的团队、负责人和薪资数字,不是模型或产品发布,但作为招聘信号已经够硬。我会先打个折:目前只是招人阶段,离实际产品还有距离,这点先别太激动。不过 OpenAI 把机器人当成全栈方向来做,薪酬又直接对标顶级硬件人才,对同行抢人和行业风向都有参考价值,所以放在 featured 档位没问题。

量子位 · 公众号

VAST 拿了近 2 亿美元,首次公开世界模型 Eden 的技术路线

VAST 在 A+ 和 A++ 轮融了近 2 亿美元,同时公布了 Project Eden 世界模型的架构。这套架构把“世界状态怎么变”和“画面怎么渲染”拆开了:先有一个结构化的状态层来推演变化,中间加一层条件接口做翻译,最后再用生成式渲染层出图。正文没披露具体估值、投资方和模型落地时间表,技术细节也只给了三层框架,没有实验数据和验证指标。

推荐理由:VAST拿了近2亿美元A+和A++轮,同时把Project Eden的三层架构亮出来:状态层管世界推演,条件接口层接外部输入,生成式渲染层负责最终画面。这个拆法让世界模型不再是一团黑盒,对做3D和具身智能的人有启发。不过正文没给出任何量化指标、开源时间或实际跑通的场景,所以我会先打个折,不往顶格推。

AI HOT 精选

Runway 与 NVIDIA 联手搞了个 Cosmos Coalition,要一起做开放的世界模型

Runway 宣布以创始成员身份加入 Cosmos Coalition,跟 NVIDIA 和一批头部 AI 实验室搭伙,目标是共建并开源面向物理 AI 的前沿世界模型。第一个项目是 Runway 和 NVIDIA 联合开发的一个基础模型。世界模型说白了就是让 AI 能理解物理规律、预测下一步会发生什么、并据此行动,Runway 说这是他们从第一天就在押...

推荐理由:我会先打个折:正文只给了个标题和一句话摘要,没披露模型规模、训练数据、许可证和任何跑分,所以没法判断实际能力。但 Runway 加 NVIDIA 这个组合,加上“开源物理世界模型”这个定位,确实戳中了机器人、具身智能那帮人现在最头疼的事——没有好用的开源基础模型。这点先别太激动,等他们把模型和协议放出来再看。

彭博科技

一个 29 岁游戏玩家创办的 3D 建模公司 Vast 刚拿了近 2 亿美元,估值冲到 10 亿,成了中国最新的 AI 独角兽

Vast 这轮融了将近 2 亿美元,估值达到 10 亿美元,正式跨进独角兽门槛。创始人是个 29 岁的游戏玩家,公司做的是用 AI 生成 3D 模型。不过正文没披露具体投资人是谁,也没说产品参数、技术路线和实际客户规模。光看融资金额和估值,在当下市场能拿到这个体量的钱,说明资本对 AI 驱动的 3D 内容生产方向还挺买账的。但没看到产品落地和收入数据,...

推荐理由:这条消息的钩子很足——创始人身份和估值数字都够直接。我会先打个折:正文没披露投资方是谁,也没说产品到底什么参数、效果怎么样,所以只能当融资信号看,别急着把它当成技术突破。对从业者来说,知道又一家 3D 方向的公司在拿大钱就够了,剩下的等产品出来再判断。

5月30日星期六

AI HOT 精选

有人用 AI 生成假黑人形象,在 TikTok 上卖 Shein 的廉价货

The Verge 记者发现,TikTok、Facebook 和 Instagram 上出现了一批用 AI 生成的“黑人创作者”账号,比如一个叫“Aliyah”的虚构人物,假装是手工匠人,实际在卖 Shein 上 9 美元批来的皮带扣,转手标价 40 美元。这些账号靠 AI 头像和编造的身份故事,利用人们对黑人手工品牌的支持心理来赚差价,本质上就是数字...

推荐理由:这事抓人眼球的地方在于骗术够具体:AI 捏出一整套黑人创作者人设,专门瞄准“支持手工原创”的善意去卖劣质货。跨三个平台铺内容说明操作门槛低、可复制性强,但正文没给受骗人数或金额,所以严重程度得打个折。安全风险是实打实的,合成身份加代发货这套组合拳,平台现在很难防。

量子位 · 公众号

帮 Gemini 拿下 IMO 金牌的建模负责人,差点去当了职业钢琴家

这篇文章讲的是 Yi Tay,他在 Gemini Deep Think 拿到 IMO 金牌级成绩时担任建模联合负责人。他 2023 年参与创立了 Reka AI,639 天后又回到了 Google DeepMind。文章还提到他 2012 年就考过了 Trinity 古典钢琴副学士文凭,差点走上职业演奏的路。不过正文因为微信环境验证拦截,具体技术细节和...

推荐理由:这是一篇人物特写,不是 Gemini 能力发布稿。核心价值在于 Yi Tay 在 IMO 金牌成果里的具体角色、他创办 Reka 又回归的经历,以及 639 天这个精确时间跨度。文章没展开技术细节,所以重要性停在人物和行业信号层面,76 分放在 featured 档是合适的。

5月22日星期五

Hacker News 首页

宾州一所高中被 AI 换脸裸照撕裂

404 Media 报道,宾州拉德诺高中一名高一男生花了 250 美元订阅 App Store 里的 Movely 应用,把五名女同学的脸贴到裸体上,生成了 AI 儿童性虐待材料。事情发生在 2025 年 12 月,男生事后用学校发的设备在 Snapchat 上跟朋友说“每一分钱都花得值”,第二天他没去上学,但女生们去了,还发现男生们在替他打掩护。文章...

推荐理由:404 Media 挖出的这个案子很具体:Radnor 高中 5 名女生被同学用 AI 生成假裸照,涉事新生承认花 250 美元买了 Movely 订阅。正文没提警方后续怎么处理,也没说学校有没有启动调查,这点信息是缺的。但光凭受害者全是未成年人、工具成本明确这两条,就足够让关注 AI 安全的人绷紧神经——这不是模型跑分翻车,是真实世界里已经发生的伤害。

5月21日星期四

TechCrunch · AI

Hark 拿了 7 亿美元 A 轮,要做一套神秘的“通用”AI 交互界面

Hark 这家 AI 公司刚宣布融了 7 亿美元,估值直接拉到 60 亿。他们想做一个能跨 App、跨设备干活的个人 AI 助手,今年夏天先放出能同时处理文字、图像、声音的多模态模型,之后再推专用硬件。但正文没披露具体投资人名单之外的细节,也没说模型参数、性能基准、硬件长什么样、什么时候能买到。7 亿这个数在 A 轮里大得有点吓人,我会先打个折看——毕...

推荐理由:HKR 三项都站得住:7 亿美元 A 轮让 Hark 一下子成了 AI 界面赛道里不能忽视的玩家。不过正文没披露投资方、估值、模型参数和硬件时间表,信息缺口不小,所以放在 featured 而不是 must-write。我会先打个折——钱是真多,但东西还没见着,这点先别太激动。

5月20日星期三

新智元 · 公众号

驭势科技在港交所上市,成为全场景L4自动驾驶第一股,市值超百亿港元

驭势科技今天在港交所挂牌,发行价每股60.30港元,公开发售部分超额认购6777倍。公司主要做机场、厂区这类封闭场景的L4级无人驾驶物流车和接驳车,2025年在大中华区机场L4商用车市场占了90.5%的份额。不过原文因为微信环境验证拦截,正文内容没抓到,具体的财务数据、技术路线和募资用途都没披露,这些关键信息得去翻招股书才能确认。

推荐理由:驭势科技港股上市,机场 L4 商用车市占率做到九成,公开发售被抢了六千多倍,说明市场对自动驾驶商业化这条路的买单意愿很强。不过正文没披露营收和盈利情况,光看市占率还判断不了生意本身赚不赚钱,这点先别太激动。

5月13日星期三

机器之心 · 公众号

林俊旸被曝离职创业,新 AI 实验室估值冲到 20 亿美元

The Information 爆料,阿里通义千问前技术负责人林俊旸正在为一家新 AI 实验室融资,目标融几亿美元,投后估值可能到 20 亿美元。目前实验室具体研究方向、团队规模和最终估值都还没公开。

推荐理由:这条消息我会先打个折:目前只有 The Information 的融资传闻和估值数字,研究方向、团队构成、产品计划一概没提。亮点是林俊旸本人从阿里出来单干,新 Lab 估值直接喊到 20 亿美元,说明资本还在抢头部 AI 人才。但正文没披露最终估值是否敲定、钱从哪来、做什么方向,这些关键信息都缺着,所以先当一条人才+融资信号看,别太激动。

5月3日星期日

TechCrunch · AI

奥斯卡新规:AI 生成的演员和剧本不能拿奖了

美国电影艺术与科学学院给第 99 届奥斯卡定了新规矩,直接把 AI 生成的表演和剧本挡在门外。规则写得很明白:能提名表演奖的,必须是片尾字幕里合法署名、且由真人同意后完成的演出;剧本也得是“人类写的”才有资格。学院还留了一手,有权随时要求片方交代电影里用了多少 AI、人的创作占了多少。这波操作背景是 AI 已经在影视圈搅出不少事——有独立电影在用 AI...

推荐理由:美国电影艺术与科学学院给第 99 届奥斯卡加了硬杠杠:AI 生成的表演和剧本不能拿奖。表演得是活人演的,而且这个人要有法律署名、明确同意出演;剧本也得是人写的。学院还留了一手,可以要求片方交代用了哪些 AI、人类作者是谁。正文没提如果不披露会有什么后果,这点先别太激动。整体看,这不是模型发布或产品上线,而是行业头部奖项在给生成式 AI 划地盘,对创作圈的版权和饭碗焦虑算是一次明确回应,所以放在 featured 低位。

4月30日星期四

Hacker News 首页

Meta 因智能眼镜隐私争议终止肯尼亚外包合同,上千名数据标注员失业

BBC 报道,Meta 在瑞典媒体曝光其智能眼镜用户被拍到上厕所、发生性关系等私密画面后,终止了与肯尼亚外包公司 Sama 的合同,导致 1108 名员工被裁。这些员工的工作是给 AI 做数据标注,也就是人工查看眼镜拍下的视频和对话记录,教 AI 识别图像、改进回答。Meta 给出的理由是 Sama 没达到标准,但 Sama 否认,并称从未收到过不合格...

推荐理由:我会先打个折——信息源只有一条 RSS 片段,很多细节都空着。但标题给出的冲突已经足够具体:Meta 员工在审核智能眼镜内容时撞见用户隐私画面,结果自己被裁。这比一般的隐私争议更尖锐,因为它把“谁来看、看了怎么办”的审核机制问题摆到了台面上。对做 AI 硬件的团队来说,这是个现成的风险案例:产品还没大规模铺开,信任先裂了一道口子。正文没写人数和岗位,这点先别太激动,但话题本身值得放进精选。

4月27日星期一

The Verge · AI

Canva 的 AI 工具把设计里的“巴勒斯坦”自动改成了“乌克兰”,公司已道歉

Canva 的 Magic Layers 功能本来是把平面图拆成可编辑图层,结果被用户发现它会偷偷把文字里的“Palestine”替换成“Ukraine”。X 用户 @ros_ie9 测试时,“cats for Palestine”变成了“cats for Ukraine”,但“Gaza”这个词没受影响。Canva 说已经修了,但没解释触发机制是什么。

推荐理由:这不是常规功能更新,而是一次具体的 Magic Layers 事故。H 来自“Palestine 变 Ukraine”这种不该发生的替换;K 在于功能边界被打破,且正文没披露触发逻辑;R 则指向政治敏感和信任风险。我会先打个折,因为 Canva 只说已修复但没解释原因,信息缺口还在。

4月25日星期六

TechCrunch · AI

ComfyUI 拿了 3000 万美元,估值冲到 5 亿,卖点是让创作者自己搭 AI 生图/视频的工作流

TechCrunch 消息,ComfyUI 刚融了 3000 万美元,估值 5 亿。它的工具不是又一个模型,而是给创作者一个可视化节点界面,像搭乐高一样把 AI 生图、视频、音频的步骤串起来,精细控制出图效果。正文没披露投资方、融资轮次、具体定价和发布时间,所以这笔钱到底怎么花、商业化节奏如何,现在还不清楚。

推荐理由:TechCrunch 报了 3000 万融资和 5 亿估值,让可控媒体工作流从爱好者圈子变成正经市场信号。我会先打个折——投资方、轮次、定价、发布时间表正文都没披露,所以别急着对标大模型公司。真正值得盯的是它把控制权还给创作者,而不是又一家拼生成效果的模型厂。

4月23日星期四

新智元 · 公众号

踏石智航拿了4.55亿美金Pre-A轮,红杉和高瓴一起领投

踏石智航在4月16号宣布完成4.55亿美元Pre-A轮融资,红杉中国、高瓴创投和美团联合领投。这笔钱创下了国内具身智能单轮和Pre-A轮融资的纪录。公司说他们的AWE3.0四模态模型把没见过视角的任务成功率提升了3倍,执行抖动降低了约45%,A1机器人还拿了个一小时完成亚毫米线束组装的吉尼斯纪录。不过正文没披露估值和具体交易条款,模型、数据和实际部署能...

推荐理由:这条我会先打个折,因为所有关键指标都是公司自己说的,正文没披露本轮估值和具体交割条件,外部验证也缺。但4.55亿美金这个数本身就够硬,红杉高瓴联手领投在具身智能里不常见,AWE3.0给的3倍成功率和45%抖动下降如果是真的挺省钱,A1那个吉尼斯纪录也说明在往工厂场景走。所以HKR三条都过,分数维持83,不升P1就是因为信息源单一,等第三方复现或估值细节出来再调。

4月22日星期三

TechCrunch · AI

Clarifai 删掉了从 OkCupid 拿来的 300 万张用户照片,这些照片曾被用来训练人脸识别模型

Clarifai 跟 FTC 和解后,删了 300 万张照片和用这些数据训出来的模型。照片是 2014 年从约会软件 OkCupid 要来的,当时 OkCupid 的高管还投了 Clarifai。说白了就是投资人和被投公司之间私下传了用户数据,拿去训人脸识别 AI。正文没披露和解的具体条款、怎么验证删除是否彻底,也没说删模型对现有产品性能有多大影响。

推荐理由:故事钩子强,事实也扎实,合规链条是AI团队现在真得盯的事。Featured合适,但正文没写和解条款、怎么验证删除、模型受影响多大,这些缺口把分数压在70多分。

4月18日星期六

彭博科技

OpenAI 前产品负责人和 Sora 主管双双离职

OpenAI 一下子走了两位高管:一位是前产品负责人,另一位是 Sora 视频模型的主管。标题确认是两个人,但正文没披露他们具体是谁、什么时候走的、为什么走,也没说谁来接任。值得留意的是 Sora 团队会不会跟着调整,不过目前没有任何细节。

推荐理由:标题给了人数和角色,但正文是空的,所以只能按现有信息判断。我会先打个折:因为离职原因和继任安排完全没披露,这条消息的冲击力还到不了顶。真正值得盯的是 Sora 业务线——负责人走了,后续产品节奏和资源会不会调整,这点先别太激动,但得持续关注。

3月18日星期三

MIT Technology Review · AI

五角大楼计划让 AI 公司在机密数据上训练模型

五角大楼正在讨论建一个安全环境,让 OpenAI、xAI 这类公司用机密数据训练军用版大模型。以前这些模型只能在涉密环境里回答问题,不能拿数据去学习,这次是头一回允许直接“吃”进机密情报。训练会在认证过的数据中心进行,数据归国防部,公司人员只在极少数情况下、有安全许可才能接触。官方说会先用非机密数据(比如商业卫星图)做测试,看效果再推进。最大的隐患是泄...

推荐理由:我会先打个折:目前只是规划阶段的说法,不是已签合同、已拨预算或已部署的项目,所以分数没给到 85 以上。但 hook 很明确——用机密数据训练这件事本身就少见,加上有具体的评估门槛和数据所有权安排,信息量够。泄密风险那段尤其值得盯:同一个模型如果服务不同密级部门,训练时吃进去的机密信息可能被再次吐出来,正文没展开怎么防,这是个关键缺口。

3月13日星期五

MIT Technology Review · AI

五角大楼官员透露,生成式 AI 可能被用来给打击目标排优先级

一位美国国防部官员向 MIT Technology Review 描述了军方可能怎么用生成式 AI 做目标排序:把目标清单喂给聊天模型,让它结合飞机位置等因素排出优先打击顺序,输出建议再由人审核。这个聊天层可能架在军方已有的 Maven 系统上,用来加快搜索和分析。Maven 之前主要靠计算机视觉从无人机画面里找目标,界面是地图和仪表盘,操作员得自己盯...

推荐理由:HKR 全中:标题的钩子是聊天机器人参与目标排序,正文给了叠在 Maven 上的具体工作流和人工复核环节。分数我维持在 80,不往上加,因为官员描述的是“可以这样用”的可能性,提速幅度和是否已实战都没确认,这点先别太激动。

3月5日星期四

36 氪 · 直链

帕西尼拿了超10亿B轮融资,估值过百亿,说要用百亿级真实多模态数据训模型

帕西尼宣布完成超10亿元人民币的B轮融资,估值突破百亿,领投方是黄浦江资本、凯泰资本和信安资本。公司自称是全球具身感知领域估值最高的企业。这笔钱的一个核心用途是训练他们自研的VTLA大模型,训练数据号称是“全球唯一百亿级实采全模态数据”。不过正文没披露这个模型的具体架构、参数量、实际任务表现,也没说数据具体包含哪些模态、怎么采集和标注的。百亿级数据听起...

推荐理由:这条消息核心就一件事:帕西尼拿了笔大钱,估值站上百亿。金额和估值数字本身有冲击力,但正文对模型能力、客户落地、量产进度一概没提,所以分数停在76,不往上调。百亿级实采数据是个值得盯的点,不过现在只能当个信号看,别急着下结论。

2月27日星期五

36 氪 · 直链

中科第五纪一个月融了几亿元,给宇树机器人做“大脑”

中科第五纪在2026年初一个月内完成了Pre-A和Pre-A+两轮融资,总额数亿元,红杉中国、东方富海、芯能创投等机构参与。它同时拿到了宇树科技“核心生态合作伙伴”的身份,从2025年起就作为宇树机器人的“大脑”模型供应商,进入电力巡检和工业搬运场景。创始人刘年丰说,现在投资人不再只看机器人能不能干各种杂活,更在意它能不能在具体场景里被客户复购。他们的...

推荐理由:具身智能加宇树供应链这个组合,天然有话题性和产业信号,所以H和R都成立。文章里公司自己报的数字——3到5条示范、97%成功率、按单机收费——虽然没第三方复现,但至少是可核对的硬信息,K也站得住。没给更高分是因为融资额只说“数亿元”比较模糊,而且所有性能数据都来自公司自述,没有独立验证。

1月30日星期五

MIT Technology Review · AI

美国国土安全部用上了 Google Veo 3 和 Adobe Firefly 做视频

一份 DHS 公开的 AI 工具清单显示,他们正在用 Google Veo 3(视频生成)、Google Flow(整合了 Veo 3 的剪辑工具)和 Adobe Firefly 来制作和编辑对外发布的视频内容,估计有 100 到 1000 个使用许可。这算是第一次有书面证据表明,移民执法部门在社交媒体上发的那些看着像 AI 做的视频,背后可能用的就是...

推荐理由:这条消息的冲击力在于,一个联邦机构已经不只是内部试用,而是把生成视频工具写进了对外内容制作的流程里。100 到 1000 份许可的估算说明规模不小,但正文没披露具体项目、发布时间或单条视频归属,所以实际落地到什么程度还看不清。我会先打个折,不把它推到更高等级,因为缺少可验证的产出案例。真正值得盯的是跨平台水印和内容溯源目前没法验证,这点先别太激动,但确实是个持续的风险敞口。

1月20日星期二

MIT Technology Review · AI

英国政府掏钱,让 AI 自己设计实验、自己跑流程

英国高级研究与发明署(ARIA)从 245 份提案里挑了 12 个项目,给每个团队约 50 万英镑(大概 67.5 万美元),让他们在九个月内做出能独立跑通“提假设—做实验—分析结果—再迭代”这套完整科研闭环的 AI 系统。ARIA 管这叫“AI 科学家”,说白了就是让大模型调用现有工具去干活,人类只负责定方向和监督。这次资助金额比 ARIA 平时给的...

推荐理由:英国 ARIA 这次不是撒概念,是真金白银选了 12 个团队做“AI 科学家”——系统要能自己提假设、设计实验、跑实验、分析结果再循环迭代。我会先打个折:目前获资助的项目主要还是调用现成工具,离全自动实验室还远。正文引了一项外部研究,说大模型代理跑完整科学流程的失败率有 75%,这点先别太激动。真正值得盯的是有没有团队做出可复现的实验闭环,而不是新闻稿里的热度。

1月4日星期日

36 氪 · 直链

华为云具身机器人负责人朱森华离职创业,用脑认知机制给机器人VLA模型打补丁

华为云AI算法创新Lab前主任朱森华2025年10月离职,创办了具身大脑公司“具脑磐石”,两个月内拿到数千万元种子轮融资,投资方包括乐聚机器人等。朱森华是脑神经科学博士后出身,团队想做的是用脑认知启发的方式改造现有的具身智能VLA模型——相当于给机器人视觉-语言-动作模型加一套算法“外挂”,模仿人脑的抽象概念学习和选择性注意力机制,目标是减少对海量数据...

推荐理由:这条值得放进精选。前华为云具身负责人出来单干,拿了数千万种子轮,故事本身就有信息量。公司说用脑认知的思路改VLA,原型数据挺好看:部署效率+40%,数据需求-90%。我会先打个折,因为全是公司自报,没有公开基准测试、客户数或规模化部署数据。正文没披露具体技术细节和验证规模,这点先别太激动。但它的商业路径说得清楚——先做外挂、先打亚太商服和工业场景,海外客户甚至接受只替代50%-70%人力,这个务实程度在具身智能创业里不多见。

2025年12月11日星期四

OpenAI News

迪士尼和 OpenAI 签了三年协议,要把 200 多个角色放进 Sora 和 ChatGPT 图片生成里

OpenAI 官方发了一篇公告,宣布迪士尼成为 Sora 的第一个大型内容授权方。协议为期三年,Sora 和 ChatGPT 图片生成功能会拿到超过 200 个迪士尼、漫威、皮克斯和星球大战的角色授权,包括米奇、艾莎、钢铁侠、尤达等,但不含真人演员的脸或声音。用户可以用这些角色生成短视频和图片,部分视频还会被选进 Disney+ 里播放。迪士尼同时会成...

推荐理由:这条消息我会先打个折——目前只有标题,正文是空的,所以能聊的其实不多。但“迪士尼角色进 Sora”这个组合本身就够有话题性:一方面它天然吸引点击,另一方面大 IP 直接接入视频生成模型,版权怎么谈的、合规怎么过、会不会变成内容军备竞赛,都是从业者会立刻想到的问题。信息缺口很明显,角色范围、上线时间、授权条件全都没披露,所以现在只能把它当做一个信号,别急着下结论。

2025年8月6日星期三

OpenAI News

OpenAI 用 1 美元把 ChatGPT Enterprise 卖给整个美国联邦政府,为期一年

OpenAI 和美国总务管理局(GSA)谈成了一笔象征性收费的买卖:接下来一年,联邦行政分支的机构只要付 1 美元,就能给全员开通 ChatGPT Enterprise。另外还白送 60 天不限量使用高级功能,包括 Deep Research(深度研究)和 Advanced Voice Mode(高级语音模式)。联邦业务数据不会被拿去训练模型。公告里没...

推荐理由:OpenAI 跟 GSA 签的这个单子,相当于用 1 美元把 ChatGPT Enterprise 铺进整个联邦行政系统,为期一年,还白送 60 天不限量用高级功能。我会先打个折:这更像是一次性打通政府采购渠道,不是常规促销。正文没写覆盖多少机构、预算盘子多大、具体哪些模型能用,所以别急着算账。但如果是真的,分发效率确实省了一大笔力气,企业数据也不拿来训练,合规上说得过去。