跳到正文

#多模态

今日 1 条

7月16日星期四

Hacker News 首页

两拨朋友用 AI 做了几乎一模一样的婚礼视频

作者参加了一场婚礼,新娘的朋友和新郎的朋友各自用 AI 做了一段致敬视频。两段视频讲的故事不同,但成品高度雷同:旁白的语气和节奏一样,都用了飞越海滩、穿过森林和星空的空镜,连国家地理风格的解说词都撞了。现场宾客反而觉得这个巧合很好玩。作者认为日常创作正在被 AI 拉向一个平庸的均值,但没下结论这到底是因为大家怕做出烂东西,还是单纯选了最省事的路径。

推荐理由:一篇个人随笔,靠一个具体的婚礼视频撞车故事把现象讲透了,没有硬塞结论。撞车这个钩子同时踩中 H、K、R 三个点。扣分项:纯观点文章,没数据也没解法,停在描述现象这一步。72 分合理,我会先打个折,因为信息密度不算高,但读起来确实有触动。

7月15日星期三

TechCrunch · AI

苹果 AI 功能拿到中国准入许可,底层用阿里的通义千问模型

中国网信办批准了 Apple Intelligence 在国内上线,前提是苹果把阿里的通义千问(Qwen)模型集成到 iOS、iPadOS、macOS 和 visionOS 里,负责文字和图片的理解与生成。阿里确认了合作,但没给具体上线时间。苹果之前找过百度、DeepSeek 和字节跳动,都因为模型适配问题没谈成。大中华区对苹果很重要,上季度卖了 20...

推荐理由:这条消息的份量在于它把中美 AI 落地规则撞在了一起。苹果为了进中国,必须换掉自己的模型,用本地供应商的,而且前面三家都没谈成——说明不是随便找个合作方就能过审,技术适配和监管要求之间有硬摩擦。我会先打个折:正文没披露具体上线时间,也没说 Qwen 模型是端侧跑还是云端调,这点先别太激动。但审批通过本身和谈判失败的原因,已经足够让从业者重新掂量“海外 AI 进中国”的成本和路径了。

Hacker News 首页

PrismML 发布 Bonsai 27B:第一个能在手机上跑的 270 亿参数模型

PrismML 把 Qwen3.6 27B 压缩到了 3.9 GB,塞进了 iPhone 17 Pro。他们做了两个版本:三元版(5.9 GB)保留了原版 95% 的能力,1-bit 版(3.9 GB)保留了 90%。数学和编程分数几乎没掉,工具调用也撑住了,但视觉任务退化比较明显。两个版本都能处理图像,支持 26 万 token 的上下文和投机解码加...

推荐理由:PrismML 把 Qwen3.6 27B 压到 3.9 GB,装进 iPhone 17 Pro,三元版 5.9 GB 保留 95% 能力,1-bit 版 3.9 GB 保留 90%。数学和编程分数稳住了,工具调用也没崩,但视觉任务退化明显,这点先别太激动。正文没披露推理延迟和功耗,实际用起来烫不烫手还不清楚。整体是端侧部署的一个里程碑,但视觉短板和缺失的实测数据要打个折。

7月14日星期二

Ben's Bites

OpenAI 发布 GPT-5.6:三个模型、五档思考强度,外加一个会疯狂派生子智能体的 Ultra 模式

GPT-5.6 系列包含 Luna、Terra 和 Sol 三个模型,每个模型都提供从“轻度”到“最大”五档思考强度,以及一个 Ultra 模式。Ultra 模式会让模型大量派生子智能体来干活,非常消耗使用额度。OpenAI 还把 macOS 版 ChatGPT 和 Codex 应用合并成了新的 ChatGPT Work 应用,并推出了一个叫 Chat...

推荐理由:GPT-5.6 正式上线是本周最大的产品新闻之一,三模型加 Ultra 的设定值得从业者关注。扣分是因为这是一篇教程复盘而非官方发布公告,而且正文被截断,关键细节缺失,信息不够完整。

7月13日星期一

AI HOT 精选

字节 Seedream 5.0 Pro 实测:在图上打点、画框就能换沙发改颜色,其他区域不动

Seedream 5.0 Pro 把图像编辑的门槛压得很低。你可以在图片上打点、画框或者随手涂一下,然后在提示词里用 @ 标记,就能精准换掉沙发、改墙面颜色,画面其他部分保持不变。官方放出的案例包括一次性替换六件家具、做键盘爆炸拆解图并标注卖点、在画好的框里生成海报文字,还支持色卡配色和 SKU 换色。图像质量和提示词理解能力追平 GPT-Image ...

推荐理由:字节把图像编辑的交互改得很直接:打点、画框、涂鸦加 @ 标记,比多数现有工具更符合直觉。官方放出的案例信息密度高,覆盖家具替换、爆炸图、海报文字和 SKU 换色,对电商和设计场景的实用性很明确。图像质量声称追平 GPT-Image,但正文没披露对比方法、测试集和量化指标,验证强度弱,所以判断上我会先打个折。

7月11日星期六

Hacker News 首页

Meta 上线几天就紧急下架 Muse Image,因为默认把用户照片喂给 AI 生图

Meta 周二在 Instagram 上线了 AI 生图工具 Muse Image,允许任何人用公开账号的内容生成 AI 图片,而且用户被默认加入,不用事先同意。这个设定立刻引发隐私争议,Meta 承认“没把握好分寸”,几天后就把功能撤了。好莱坞工会 Sag-Aftra 和 Privacy International 都公开批评,前者说这是对公众情绪的...

推荐理由:Meta 的产品回滚加上好莱坞工会下场,让这件事从产品失误升级成行业信号。分数没再往上拉,是因为功能已经撤了,正文也没给技术细节,目前只能当一次公开舆论事件来看。

TechCrunch · AI

Meta 上线不到一周就砍掉了 Instagram 的 AI 改图功能,因为用户不买账

Meta 在 7 月 7 日推出了一个叫 Muse Image 的 AI 图片生成器,其中有个功能是你可以 @ 任何公开的 Instagram 账号,拿对方发的照片当参考图来生成新图片,而且对方完全不会收到通知。这个设计立刻引发大量反对,TechCrunch 还专门出了教程教大家怎么关掉这个功能。Meta 在 7 月 10 日的博客里承认这个功能“没做...

推荐理由:Meta 上线了一个叫 Muse Image 的 AI 生图功能,允许用户 @ 任何公开 Instagram 账号,拿对方照片当参考图生成新图片,全程不通知对方。这个设计立刻炸锅,TechCrunch 专门写教程教人怎么关掉,Meta 三天后发博客承认“没做好”并撤下功能。我会先打个折:正文没披露具体影响用户量或技术细节,所以重要性停在 78。但这件事的传播链条完整,从上线到撤回节奏极快,对 AI 产品设计里的默认同意问题是个很直观的案例,值得放进精选。

AI HOT 精选

Meta 上线两天就关掉了 Instagram 里用公开账户生成 AI 假照片的功能

7 月 8 号 Meta 在 Instagram 私信里塞了个叫 Muse 的功能,用户给 @MetaAI 发一句“imagine me as [某个公开账户]”,就能生成一张模仿对方风格的假照片。两天后因为反对声太大,Meta 把这功能关了。发言人只确认功能已下线,没解释原因。文章没披露到底有多少人用过、有没有造成实际伤害,看起来更像是一次快速试水被...

推荐理由:Meta 在 Instagram 私信里上线了一个叫 Muse 的功能,用户发一句“把我想象成某个公开账户”就能生成模仿对方风格的假照片,两天后因为反对声太大紧急关停。这事反转够快,天然吸引点击,但文章没披露实际使用数据和伤害案例,信息量偏薄。我会先打个折:话题性拉满,可验证的事实太少,只能给到 featured 的下沿。如果是真的没造成什么实际伤害就还好,但平台这种先上线再灭火的试探方式,本身就值得安全方向的人留意。

7月9日星期四

Ben's Bites

SpaceXAI 和 Cursor 联手训出 Grok 4.5,成本只有 Opus 的六分之一

SpaceXAI 和 Cursor 一起训了个新模型 Grok 4.5,性能大概卡在 Opus 4.7 和 4.8 之间,但按 token 算钱的话,比 Opus 便宜 6 倍,比 GPT-5.5 便宜 3 倍。现在 Cursor 里能用,API 也开放了。OpenAI 这边,GPT-5.6(Sol、Terra、Luna)今天会推给所有用户,早期测试的...

推荐理由:SpaceXAI 和 Cursor 联合发布 Grok 4.5,有具体性能区间和价格对比,三个维度都踩中了。扣分是因为来源是 newsletter 摘要而非一手公告,且正文截断,GPT-5.6 信息不全。跨源验证后加 3 分到 82,整体判断不变。

Latent Space

SpaceXAI 发布 Grok 4.5,跟 Cursor 联手训了个主打编程和干活儿的模型

SpaceXAI 赶在 GPT-5.6 发布前一天放出了 Grok 4.5。这是个 1.5 万亿参数的大模型,比上一代 Grok 4.3 大了三倍,专门冲着编程和让模型进业务流程干活儿去设计的。Cursor 说这是他们头一回把模型能力扩展到纯写代码之外。马斯克自己讲,这模型跟 Opus 4.7 性能差不多,但更快更省钱——输入每百万 token 收 2...

推荐理由:SpaceXAI 在 GPT-5.6 发布前一天扔出 Grok 4.5,光这个时间点就值得看一眼。1.5 万亿参数,比 Grok 4.3 大了三倍,输入每百万 token 收 2 美元,规模和成本都有具体数字。马斯克说性能跟 Opus 4.7 差不多但更快更便宜——这点先别太激动,正文没给第三方跑分,只能当官方说法。真正有意思的是 Cursor 被收购后第一次把模型推到纯写代码之外,直接瞄准 agent 工作流,对做工具链的人是个信号。

AI HOT 精选

诉讼称一男子用 Grok 生成 7000 张继女色情图片后自杀,xAI 只上报了一条轮奸提示词

一起新诉讼指控 xAI 的 Grok 被用来生成了超过 7000 张用户继女的儿童性虐待图片,该男子随后开枪自杀。xAI 只向美国国家失踪与受虐儿童中心上报了一条涉及轮奸的提示词,其余数千次生成均未报告。诉讼指责 X 和 xAI 在庇护儿童侵害者。文章没有解释为什么 xAI 的安全过滤器漏掉了绝大多数图片,也没有说明 Grok 的图像生成功能是否默认禁...

推荐理由:Ars Technica 独家报道了一起针对 xAI 的诉讼,揭示其安全上报存在严重漏洞:在 7000 张儿童性虐待图像中,仅上报了一条提示词。事件涉及未成年人、自杀和平台责任,三条硬指标全中。我会先打个折,因为文章没解释 Grok 的安全过滤器为什么漏掉这么多,也没说明图像生成功能默认是否关闭,信息缺口明显,所以分数压在 90 以下。

7月8日星期三

Hacker News 首页

Mistral 发布 Robostral Navigate:一个只用单摄像头的机器人导航模型

Mistral 推出了一个 80 亿参数的模型,让机器人只靠一个普通 RGB 摄像头就能在室内外认路,直接输出速度和转向角。它跳过了激光雷达和高精地图,思路是降低硬件门槛。不过公告里没提延迟、帧率、跑在什么硬件上、用了多少训练数据,也没给具体的测试基准分数。这点先别太激动,等第三方实测再说。

推荐理由:Mistral第一个机器人模型,纯视觉导航,80亿参数,有明确输入输出,是个实在的发布。但公告没提延迟、帧率、硬件需求、训练数据和基准分数,没法判断真实可用性,所以先放在featured档,等第三方实测再说。

TechCrunch · AI

Meta 推出 Muse Image 生图工具,用户照片被拿来 AI 改图引发反弹

Meta 在 7 月 7 日上线了 Muse Image,一个由旗下 Superintelligence Labs 做的免费 AI 生图工具,可以在 Meta AI 应用、Instagram 快拍和 WhatsApp 里用。功能本身跟主流生图工具差不多,还提供预设提示词帮你起头。争议点在于:你可以在 Instagram 上 @ 任何公开账户,直接把对方...

推荐理由:Muse Image 上线本身是个常规产品动作,但用户对照片被用于训练的反弹来得又快又猛,让这件事有了超出产品发布的社会情绪价值。技术细节没给,知识分上不去,刚好卡在 featured 门槛。

AI HOT 精选

Meta 发了两个新模型 Muse Image 和 Muse Video,一个画图一个做视频,都接进了 Instagram 和 WhatsApp

Meta 的超级智能实验室放出了 Muse Image 和 Muse Video,这是他们头一批媒体生成模型。Muse Image 主打听话出图,能按指令精确生成、编辑图片,还能参考多张图来构图,并且会读 Instagram 上的社交信息当上下文。它还能调用工具干活,集成了一个叫 Muse Spark 的东西,具体是什么正文没细说。Muse Video...

推荐理由:Meta 的超级智能实验室头一回发媒体生成模型,Muse Image 主打听话出图和读 Instagram 社交信息,Muse Video 正文没展开。有个叫 Muse Spark 的工具集成进去了,但具体是啥没说,实际出图出视频的质量也没给例子。我会先打个折,给 78 分,等看到真东西再调整。

AI HOT 精选

字节跳动发布 Seedream 5.0 Pro,能直接生成信息图,还能像修图软件一样做像素级编辑

这个模型把“生成图片”和“专业设计”之间的沟填上了不少。它最狠的地方是能直接生成高密度信息图,比如把时间轴、柱状图、饼图和实景融合在一张图里,文字拼写和排版都挺靠谱。编辑能力也上了一个台阶,支持点选、圈选、涂鸦来局部改色、换材质,甚至能把一张海报拆成十几个独立图层,被挡住的背景也能自动补全。人像和材质质感有提升,能还原皮肤纹理、玻璃反射,还支持摇拍的运...

推荐理由:字节放出的 Seedream 5.0 Pro 在功能描述上很具体,不是笼统的“画质提升”。信息图生成、图层分离、交互式局部编辑这三板斧确实打到了设计场景的痛点。但得先打个折:这是官方博客,没有第三方评测或开放试用,实际效果和稳定性还不好说。正文也没披露推理成本、生成延迟和分辨率上限,这些对落地很关键。

7月3日星期五

Google DeepMind

Google DeepMind 与 A24 宣布首个此类研究合作

Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目长期展开,Google 同时已对 A24 进行投资。

7月2日星期四

Ben's Bites

Fable 5 重新上线,同时来了个新的 Claude Sonnet 5

Anthropic 把 Fable 5 又放出来了,付费用户能用,但只到 7 月 7 号,而且用量上限砍半。官方说这次加了更强的安全护栏。Scale 的跑分显示它能完成 16% 的远程工作任务,是 Opus 4.8 的两倍。同时发布的 Claude Sonnet 5 跑分接近 Opus 4.8,单 token 价格更低,但实际跑一个任务的总花费差不多,...

推荐理由:Anthropic 同时放出 Fable 5 的限时回归和 Sonnet 5,两条消息叠在一起。Scale 的跑分给了可对比的硬数字,不是纯宣传稿。Fable 5 的 16% 任务完成率虽然翻倍但绝对值还低,所以重要性没推到 90 以上。

Latent Space

AIEWF 第三天:自动研究站上舞台,但讲者们对全自动泼了冷水

AI 工程师世界博览会第三天,主题是“自动研究”——让 AI 智能体自己维护和改进系统。Introspection 的 Roland Gavrilescu 把它描述成一个“外循环”,让智能体去研究和维护内循环。Anthropic 的 Thariq Shihipar 在 Claude Code 演讲里也呼应了持续发现的想法,说模型是“长出来的,不是开发出...

推荐理由:这是 AIEWF 现场的实况报道,引用了 Introspection 和 Anthropic 的一手发言,不是通稿。但本质是会议综述,不是产品发布,所以放在 featured 这一档刚好。

6月26日星期五

AI HOT 精选

博主小互开源了个人IP配图工具,自带31个原创角色和一套自动配图流程

小互把给自己文章自动配图的技能打包开源了,叫“小互IP Studio”。工具里带了31个原创角色——15个是手绘线稿风格的人物,另外16个是谐音梗做成的meme形象。工作流程是:Agent先读文章,自己判断该配情绪图、示意图还是四格漫画,然后生成图片,再自己检查,不满意会返工重来。默认画风是手绘线稿加淡彩,另外给了5种皮肤可以换,比如3D盲盒风、黑白线...

推荐理由:一个实用工具的开源发布,工作流设计有细节,31个原创角色直接可用,对AI内容创作者价值明确。但这是个人项目开源,不是行业级事件,所以放在featured档。

Hacker News 首页

AI 做的儿童百科成了身体恐怖片,我买了本亚马逊畅销第一来实测

作者 lcamtuf 买了本 2026 年中出版的 AI 生成儿童百科全书,这本书在亚马逊拿过分类第一。翻开之后插图全是身体恐怖:猫多长了腿、动物和树融成一团肉块、倒影里的人伸手要抓你。他认为这类书能卖是因为买的人不读,封面骗过了送礼的亲戚朋友,而且做百科没有小说那种版权风险。文章没检查文字内容有没有事实错误,但光看图已经够吓人了。

推荐理由:lcamtuf 亲自买了本亚马逊分类第一的 AI 儿童百科,把插图里的身体恐怖一页页拍了下来。有具体例子,有销售机制分析,不是空喊“AI 质量不行”。扣分是因为没查文字内容有没有事实错误,而且文章本身是个人博客,验证力度弱。

6月25日星期四

AI HOT 精选

Gemini 3.5 Flash 现在能直接操作电脑界面了

Google 给 Gemini 3.5 Flash 加了一个内置的“操作电脑”工具,模型可以自己截图、点按钮、填表单,去操作网页和桌面软件界面。这跟 Anthropic 和 OpenAI 之前做的方向一样,都是把屏幕控制能力直接做进模型里。官方说在 WebVoyager 这个网页操作基准测试上,3.5 Flash 跑赢了 Claude Sonnet 4...

推荐理由:Google 给 Gemini 3.5 Flash 内置了电脑操作工具,模型能自己截图、点按钮、填表单,跟 Anthropic 和 OpenAI 的路线一致。官方在 WebVoyager 基准上跑赢了 Claude Sonnet 4,这点有数字撑腰。但我会先打个折:这是一篇博客公告,没给 API 定价,也没说实际延迟,所以现在只能当技术方向看,还不能直接算账。

6月24日星期三

AI HOT 精选

ChatGPT 语音能边听边说了,新模型 Bidi 1 开始灰度测试

部分用户已经在 ChatGPT 网页版和 App 的模型选择器里看到了 Bidi 1,和标准语音、高级语音并列,选中后语音气泡会变黄。它最大的变化是支持全双工:模型在说话的同时还能继续听你讲话,中途打断也能立刻响应。测试里有人让它从 1 数到 10,数到一半打断说“倒数”,它马上照做。OpenAI 还没正式公布上线时间,有媒体猜本周可能会扩大测试范围。...

推荐理由:OpenAI 语音能力一次实质升级——全双工加打断响应是之前高级语音模式做不到的。目前只部分推送、官方还没正式公告,所以分数不往上顶。但交互方式的改变够得上 featured。

6月23日星期二

FT · 科技

OpenAI 生图翻车,给 Getty Images 打了一个价值连城的广告

OpenAI 的图像模型用 Shutterstock 的图库训练,结果生成的照片里意外带上了 Getty Images 的水印。这个乌龙成了 Getty 最好的广告:高质量授权内容不是合成数据能替代的。AI 公司越依赖廉价图库,Getty 手里那些独家、可商用的稀缺内容就越值钱。

推荐理由:FT 这篇评论角度很刁,把一个模型水印 bug 翻成了 Getty 内容壁垒的活广告。有具体事件,也有行业层面的判断,不是空谈。我会先打个折:它不是突发新闻,是评论,而且 FT 有付费墙,但事件本身够有说服力,读起来像在群里转发一个行业笑话,背后逻辑却挺硬。

AI HOT 精选

字节跳动发布 Seed2.1 系列模型,重点提升让模型干活时的交付稳定性

Seed2.1 系列模型已在豆包和 TRAE 上线,主打真实工作场景,而不是刷榜。在通用 Agent 任务上,Seed2.1 Pro 在 Agents' Last Exam 里排第一梯队,在测手机操作的 MobileWorld 上拿了最高分,跨工具任务的平均步数减少了 16%。写代码方面,开发者盲测中对比 Claude Opus 4.6 有 59.1%...

推荐理由:Seed2.1 是字节跳动的新旗舰,主打真实工作场景而非刷榜,在 Agent、代码、多模态三个方向都给了可验证的指标。Agent 考试排第一梯队、手机操作最高分、跨工具步数减少 16%,代码盲测胜率 59.1% 直接对标 Claude Opus 4.6,这些数字让发布有分量。我会先打个折:正文没披露参数量、训练数据和定价,所以模型实际规模和部署成本还不清楚,这点先别太激动。但作为国内大厂旗舰更新,且已上线产品,给 82 分 featured 合理。

AI HOT 精选

Runway 把视频编辑模型 Aleph 2.0 塞进了 Figma Weave 画布里

Aleph 2.0 现在能在 Figma Weave 里直接用了。用法很简单:从视频里抽一帧出来,在 Weave 里重新画个风格或者换个产品,标上时间点,Aleph 2.0 就会自动把这一帧的改动同步到视频里所有出现这个主体的画面上,其他没让你改的地方保持原样。它支持最长 30 秒的 1080p 视频,多镜头片段也能一次处理,不用一帧一帧修。在 Wea...

推荐理由:Runway把自家最强的视频编辑模型塞进了Figma Weave,用关键帧驱动多镜头同步修改。产品集成做得挺实在,但不算模型层面的突破,受众偏设计/视频圈而非核心AI圈,刚好卡在featured门槛上。

6月21日星期日

Hacker News 首页

旧金山一家代理商把畅销书整本搬上网,用 AI 配图后当成自己的作品

John Koenig 花了十几年做的《The Dictionary of Obscure Sorrows》——一本给说不清的情绪造词的畅销书——被旧金山代理商 Qontour 整本复制到了一个新网站上。网站域名只比原作多一个“the”,里面塞满了原书的 311 个自创词、词源解释和那篇 800 字的前言,但把原版的手工拼贴插画全换成了 DALL·E ...

推荐理由:一个版权盗窃故事,正好戳中创作者在 AI 时代最怕的事:整部作品被复制、用 AI 重新包装、然后当成正版发布。三个维度都有足够细节支撑,读起来像在跟朋友讲一件离谱但真实的行业八卦。没给更高分是因为它本质上还是一篇版权纠纷报道,技术层面的新信息不多,但作为警示案例已经够用了。

6月19日星期五

Computing Life · Share · 鸭哥调研

Midjourney 不拿风投,用生图订阅的钱造了一台全身超声扫描仪

Midjourney 在旧金山发布了一台全身超声 CT 扫描仪。人站在装满水的环形水槽里,40 颗 Butterfly 超声芯片从四面八方发射声波,21 台服务器靠 2 PFLOPS 算力重建出三维截面图。这台机器扫不了大脑、肺和肠道,定位是体成分分析,走 FDA 二类器械审批,第一家店不是医院,是旧金山 Union Square 的一家 spa。真正...

推荐理由:Midjourney 用生图订阅的现金流造了一台全身超声 CT,这个反 VC 叙事和扎实的硬件参数本身就很有传播力。我会先打个折,因为机器目前没用上 AI,物理限制也写得很清楚(扫不了脑、肺、肠道),定位是体成分分析,第一家店开在 spa 而不是医院,离临床落地还有距离。但正是这种“不烧钱、不画饼、先做一台能用的机器”的做法,在 AI 圈里太少见了,值得推一把。

6月18日星期四

AI HOT 精选

Adobe 在 Photoshop、Premiere 等主力软件里上线 AI 助手公测,专门处理重复性杂活

Adobe 把它的“创意智能体”塞进了 Premiere、Photoshop、Illustrator、InDesign 和 Frame.io,现在是公开测试版。你告诉它要什么结果,它自己去跑多步骤的体力活:比如在 Premiere 里自动分素材、标采访问题、拼粗剪;在 Photoshop 里换背景、按平台尺寸批量改图;在 Illustrator 里根据...

推荐理由:Adobe 在核心创意工具里集成 AI 智能体,是实打实的产品更新,不是概念稿。公开测试版意味着功能已经能跑,但 Adobe 过去交付 AI 功能的速度偏慢,所以先别当正式版看。功能描述具体,能判断实际价值,但效果和稳定性还得等用户上手反馈。

Hacker News 首页

ChatGPT 图片生成器被一个病毒式提示词绕过,会自发产出性暴力与虐杀画面

Mindgard 的研究员 Jim Nightingale 发现,一个在 X 上流传的提示词能绕过 ChatGPT 的图片生成过滤。这个提示词只是让模型“修复附件照片”,不指定任何内容,但 ChatGPT 却会生成涉及死亡和性侵犯的极端画面。Nightingale 之前就向 OpenAI 报告过模型能生成裸照,OpenAI 当时说问题已解决,但他发现漏...

推荐理由:我会先打个折:正文没披露具体复现次数和影响范围,所以别急着说“ChatGPT 彻底崩了”。但 Mindgard 研究员发现的问题确实扎心——一个在 X 上流传的提示词,只让模型“修复附件照片”,不指定任何内容,ChatGPT 却自己生成涉及死亡和性侵犯的极端画面。研究员之前就向 OpenAI 报告过模型能出裸照,OpenAI 当时说问题已解决,结果这次又漏了。这说明图片生成的安全过滤在“无内容指令”场景下存在盲区,模型可能把空白提示当成了自由创作许可。对从业者来说,这条信息直接指向安全测试的新方向:别光测有恶意的提示词,也要测“什么都没说”的情况。

6月17日星期三

AI HOT 精选

Midjourney V8.1 上线草稿模式:一次出 24 张低清预览,只花一半快速时长

Midjourney 给 V8.1 加了个草稿模式,点一下闪电按钮就能用。每次生成 24 张低分辨率、低画质的预览图,消耗的快速时长只有标准 V8.1 作业的一半。挑出满意的图点“Vary”就能渲染成高清成品。另外还出了个 --preview 参数,可以提前试玩还在打磨的新模型,但出图可能比较糙,而且不保证效果一直稳定,尤其在个性化设置和情绪板下差异会...

推荐理由:Midjourney V8.1 的草稿模式直接砍半快速时长成本,一次出 24 张低画质预览,挑中再高清化,对重度用户是肉眼可见的效率提升。--preview 参数给了尝鲜入口,但官方自己打了预防针说输出不稳定,这点先别太激动。H 和 K 都踩中了,R 确实够不着,因为这事基本只在生图圈子里传。

彭博科技

一封商务部长来信,让 Anthropic 主动关掉了 Mythos 的生图功能

Bloomberg 公开了美国商务部长 Howard Lutnick 发给 Anthropic 的完整信函。信里要求 Anthropic 解释为什么 Mythos 能生成特朗普和马斯克的深度伪造图像,并质疑了它的内容审核机制。Anthropic 随后自愿禁用了 Mythos 的图像生成能力。文章没说明这次关停是临时还是永久,也没给出恢复时间表。

推荐理由:Bloomberg 把 Lutnick 写给 Anthropic 的信全文放出来了,这是政府直接施压让 AI 功能下线的罕见案例。信里点名 Mythos 能生成特朗普和马斯克的深度伪造图像,质疑审核机制,Anthropic 随后自愿禁用了图像生成。文章没写这次关停是临时还是永久,也没给恢复时间,但光凭“部长一封信就让功能没了”这件事,对政策圈和安全从业者的冲击就够大。三个维度都踩中,分数维持 84 没问题。

6月16日星期二

AI HOT 精选

苹果 AI 版 Siri 为什么拖了这么久:旧方案直接扔掉,底层全部重写

苹果 Siri 项目的新负责人 Mike Rockwell 在 WWDC 闭门分享会上交了底。去年他们其实已经做出了一个能跑的原型,就是在老 Siri 上加了个工具调用功能,但团队觉得这离想要的产品体验差太远。于是他们选了另一套需要大改底层架构的方案,把旧 Siri 的架构完全拆掉,基于新的大模型从头搭建。新版 Siri 变成了一个独立应用,原生支持多...

推荐理由:我会先打个折:正文没披露新模型的具体规模、延迟数据和上线时间,所以没法判断实际体验能提升多少。但这条消息的看点在于,苹果 Siri 的新负责人罕见地公开解释了延期原因——不是没做出来,而是去年那个能跑的原型被主动否掉了,理由是“离想要的产品体验差太远”。团队选了更彻底的重构路线,把老架构拆掉,基于新大模型从头搭,Siri 变成了独立应用。这个决策本身就有信息量:大厂在旧系统上修修补补的成本已经高到不如推倒重来。对行业来说,这是一个关于技术债和架构选择的真实案例,不是公关稿。

6月14日星期日

彭博科技

苹果新 Siri 上手:刚好够用,暂时缓解了 AI 危机

Bloomberg 的 Mark Gurman 在 iOS 27 和 macOS 27 上实测了新 Siri。它能看懂屏幕上的内容,也能跨 App 干活——比如用一句语音指令找到一张照片、编辑后再通过信息发出去。复杂任务还是要等 11 秒以上,偶尔会漏步骤。Gurman 的评价是“刚好够用”:比老 Siri 进步巨大,但仍落后于 Google Astr...

推荐理由:Gurman 的实测比官方演示更有参考价值,因为他直接报了延迟和失败情况。我会先打个折:这不是正式发布,只是开发者预览版的表现,而且他自己也承认仍落后于 Google Astra。分数定在 78,是因为这算一次重要的进度检查,但远没到“成了”的程度。

6月12日星期五

AI HOT 精选

MiniMax 开源 M3 模型:总参数 428B,激活 23B,上下文窗口拉到 100 万 token

MiniMax 把 M3 的权重传上了 HuggingFace,技术报告和完整权重大概还要等 10 天。这是个混合模型,总参数量 428B,但每次只激活 23B,靠 MiniMax 自研的稀疏注意力把上下文窗口撑到 100 万 token,还原生支持多模态。跑分方面:SWE-Bench Pro 59.0%、Terminal Bench 2.1 66.0...

推荐理由:MiniMax 第一次把旗舰模型权重开源,428B 的混合专家模型,激活 23B,百万 token 上下文,代码和智能体跑分能跟 DeepSeek、Qwen 掰手腕。技术报告还没出,权重刚上传,信息缺口明显,但开源这个动作本身对开发者生态有直接价值。

AI HOT 精选

WSJ:OpenAI 想靠大降价和超级应用改版,在 IPO 前抢企业开发者

WSJ 消息,OpenAI 正在考虑大幅降价,直接原因是 Anthropic 的 Claude Code 在企业开发团队里用得越来越多,token 消耗量很大,抢走了不少付费用户。OpenAI 虽然在大众用户里名气更大,但真正赚钱靠的是企业客户,所以这次降价主要冲着开发者来。同时,OpenAI 在筹备 IPO 前要对 ChatGPT 做一次最大规模的改...

推荐理由:WSJ 独家消息,OpenAI 正在考虑大幅降价,直接导火索是 Claude Code 在企业开发团队里 token 消耗量很大,抢了不少付费用户。OpenAI 虽然大众名气大,但真正赚钱靠企业客户,这次降价就是冲着开发者来的。同时,IPO 前还要对 ChatGPT 做一次最大规模改版。我会先打个折:正文没披露具体降价幅度和改版细节,但竞争态势确实在变,价格战信号很明确,对从业者选工具和算成本有直接影响。

6月11日星期四

AI HOT 精选

Runway 与狮门影业互相持股,将联合开发 AI 驱动的短剧新 IP

狮门影业买了 Runway 一部分股份,两家公司会一起开发新 IP,第一个项目是用狮门现有 IP 结合 Runway 视频生成模型做的短剧。狮门还会作为合作方参与 Runway 的 AI 电影节。Runway 的 CEO Cristóbal Valenzuela 说,真正重视 AI 的制片厂把它当创作资源,不是省钱工具。狮门是好莱坞第一家跟 AI 研究...

推荐理由:狮门影业入股 Runway 并合拍短剧,是好莱坞目前对 AI 视频生成最实打实的下注。Runway CEO 那句“当创作资源不是省钱工具”也把姿态摆得很明确。不过正文只披露了一个项目,没提制作规模、预算和观众反馈,所以分数没给更高——先看这部短剧出来什么样再说。

AI HOT 精选

小米开源终端编程助手 MiMo Code,MIT 协议,内置模型限时免费

小米把终端 AI 编程助手 MiMo Code 开源了,MIT 协议,随便用。内置的 MiMo-V2.5 多模态模型目前免费,性能自称对标 Claude Sonnet 4.6,但正文没写免费到什么时候,也没提参数量。它也支持接 DeepSeek、Kimi、GLM 这些外部模型。两个值得看的设计:一个是持久记忆系统,靠独立子 agent 自动存项目记忆、...

推荐理由:小米这次开源 MiMo Code,MIT 协议加免费模型,对开发者吸引力不小。我会先打个折:模型性能对标 Sonnet 4.6 的说法正文没给评测细节,参数量也没披露,免费能用到什么时候也不清楚,这些缺口让判断得收着点。真正值得看的是那个持久记忆子 agent,自动存项目记忆而不是简单翻聊天记录,工程思路比多数终端助手走得远。另外它支持接 DeepSeek、Kimi 这些外部模型,灵活性也加分。整体来说,开源动作本身比模型宣称更有信息量。

6月10日星期三

OpenAI News

OpenAI 封禁了一批疑似来自中国的 ChatGPT 账号,理由是它们在美国的 AI 政策讨论里搞隐蔽舆论操作

OpenAI 在 6 月 10 号发了份威胁报告,封了两组大概率来自中国的 ChatGPT 账号。一组叫“数据中心顺风车”,专门生成“AI 数据中心推高居民电费”的帖子和图片;另一组叫“科技与关税”,一边骂美国关税是打压科技竞争的手段,一边在提示词里要求只提特朗普、不提习近平。后一组还散布过“ChatGPT 用户数据泄露”的假消息,OpenAI 说这完...

推荐理由:OpenAI 官方威胁报告,有具体操作细节和账号集群,HKR 三个维度都踩实了。但本质是一次安全事件披露,不是产品/技术突破,所以放在 78 分这个“质量不错”的区间。没给更高是因为它没有重塑行业格局或技术路线。

AI 群聊日报

Anthropic 发布 Claude Fable 5/Mythos 5,编程跑分跳到 80.3%,但安全分类器误伤一片,连自家安全报告都封

Anthropic 一天扔出两款模型:Fable 5 给所有人用,满血版 Mythos 5 只给受信伙伴。SWE-bench Pro 得分 80.3%,比上一代 Opus 4.8 的 69.2% 和 GPT 5.5 的 58.6% 都高出一截,仅靠看屏幕截图就打通了宝可梦火红。定价是 Opus 4.8 的两倍,输入每百万 token 10 美元,输出 ...

推荐理由:Anthropic 旗舰模型发布,SWE-bench Pro 冲到 80.3%,远超 GPT 5.5 的 58.6%。定价翻倍但 Coding Plan 可能短期有成本优势。跨源信息确认,HKR 三个维度都打中了。扣 1 分是因为正文没披露 Mythos 5 的具体细节和开放计划,信息有缺口。

AI HOT 精选

Google Gemini 3.5 实时翻译开放公测,支持 70 多种语言、2000 个语言对

Google 把 Gemini 3.5 的实时翻译功能放出来了,现在通过 Gemini API 就能用。它做的是语音到语音的低延迟翻译,覆盖 70 多种语言,能组合出 2000 个语言对,冷门小语种也包含在内。开发者可以把它接进实时对话、客服、直播或跨国会议里。主推文提到这消息被 Anthropic Fable 5 的声量盖过去了,还顺带提了阿里 Qw...

推荐理由:HKR 三项都成立:Google 把实时语音翻译做成 API 公开预览,对开发者有直接吸引力,也给了语言覆盖和语言对的具体数字。但文章只提了功能开放,没写价格、延迟基准和可用区域,信息有缺口,所以重要性停在 78。