跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 401–409 条 · 共 409 条

4月3日星期五

X · @dotey(宝玉)

Google 发布 Gemma 4 开源模型家族,全系改用 Apache 2.0 协议

Google 把 Gemma 4 全系列换成了 Apache 2.0 协议,商用、修改、分发不再受限,之前自家协议里的灰色地带这次清掉了。系列包含四个尺寸:31B Dense、26B MoE(混合专家架构)、E4B 和 E2B。31B 在 Arena AI 开源模型文本榜排第三,26B 排第六,Google 说它们表现超过体量大 20 倍的模型。大模型...

推荐理由:这次发布的分量,许可证变更和模型规格差不多重。Apache 2.0 意味着小公司和独立开发者可以放心拿来改、拿来商用,不用再为法律条款头疼。四个尺寸里,31B 能跑在单张 H100 上,26B 是 MoE 架构,推理成本会更低,这两点对实际部署的人比跑分更有吸引力。原生支持函数调用和 JSON 输出,摆明了是冲着让模型直接进业务流程干活去的。正文没给详细评测链接和横向对比数据,所以先别急着说它性能碾压谁,但就开放程度和工程友好度来说,这波更新挺实在。

Google DeepMind

Google DeepMind 发布 Gemma 4 开源模型家族

Google DeepMind 发布 Gemma 4,称其为迄今最智能的开源模型,面向高级推理与智能体工作流,采用 Apache 2.0 许可。该系列包含 E2B、E4B、26B MoE 和 31B Dense 四种尺寸,31B 在 Arena AI 文本榜位列全球开源模型第 3,26B 位列第 6。

推荐理由:Gemma 4 以 Apache 2.0 开源并覆盖端侧到工作站四种尺寸,可据此判断开源模型的部署与微调选择。

2月12日星期四

MIT Technology Review · AI

AI 让线上诈骗更容易了,而且可能还会更糟

微软说截至 2025 年 4 月的一年里,他们拦下了 40 亿美元的诈骗和欺诈交易,其中很多可能靠 AI 生成内容帮忙。研究人员估计现在至少一半的垃圾邮件是用大语言模型写的,用大模型搞针对性邮件攻击的比例也从 2024 年 4 月的 7.6% 涨到了 2025 年 4 月的 14%。先别急着脑补“全自动 AI 黑客”,眼下真正的问题是 AI 把钓鱼、换...

推荐理由:这篇不是那种“全自动 AI 黑客来了”的标题党,它把焦点拉回到已经发生的事:钓鱼邮件、深伪、恶意代码生成,AI 在降低犯罪成本。数字有,但正文没披露这些攻击的总体增幅,所以判断要收着点。适合放进精选,因为它是一份有数据支撑的趋势报告,不是当天炸出来的事件或产品发布。

2月3日星期二

MIT Technology Review · AI

我们一直搞错了 AI 的真相危机:就算知道是假的,人还是会信

MIT Technology Review 的这篇文章直接点出一个反直觉的发现:我们过去对 AI 造假危机的想象,可能全偏了。作者拿自己上周的报道举例——美国国土安全部首次被确认在用 Google 和 Adobe 的 AI 视频工具做面向公众的宣传内容,配合特朗普政府的移民执法造势。文章指出,我们原本指望靠 Adobe 的“内容真实性倡议”这类标签工具...

推荐理由:这篇不是空对空的评论。它先拿国土安全部用 Google 和 Adobe 视频生成器做公开内容这件事当引子,然后拆了两个标签系统的实际漏洞,最后用 Communications Psychology 的论文把问题钉死:受试者明知认罪视频是 deepfake,还是会据此判断有罪。信息链条完整,判断都挂在事实和论文上,没有补设定。我会先打个折,因为它本质还是评论加一篇论文,不是当天能震动行业的硬事件,但对正在搭安全流程的团队来说,这篇值得一看。

1月30日星期五

MIT Technology Review · AI

美国国土安全部用上了 Google Veo 3 和 Adobe Firefly 做视频

一份 DHS 公开的 AI 工具清单显示,他们正在用 Google Veo 3(视频生成)、Google Flow(整合了 Veo 3 的剪辑工具)和 Adobe Firefly 来制作和编辑对外发布的视频内容,估计有 100 到 1000 个使用许可。这算是第一次有书面证据表明,移民执法部门在社交媒体上发的那些看着像 AI 做的视频,背后可能用的就是...

推荐理由:这条消息的冲击力在于,一个联邦机构已经不只是内部试用,而是把生成视频工具写进了对外内容制作的流程里。100 到 1000 份许可的估算说明规模不小,但正文没披露具体项目、发布时间或单条视频归属,所以实际落地到什么程度还看不清。我会先打个折,不把它推到更高等级,因为缺少可验证的产出案例。真正值得盯的是跨平台水印和内容溯源目前没法验证,这点先别太激动,但确实是个持续的风险敞口。

1月28日星期三

MIT Technology Review · AI

AI 开始记住你的一切,隐私保护要面对新麻烦了

Google 这个月推出了 Personal Intelligence,让 Gemini 直接读取你的 Gmail、相册、搜索和 YouTube 记录来提供个性化服务。OpenAI、Anthropic 和 Meta 也都在给自家产品加记忆功能。问题在于,现在的做法是把你在不同场景下的数据全倒进一个池子里——你问过医疗建议、写过工作邮件、搜过餐厅,这些信...

推荐理由:我会先打个折:这是篇评论,没有新数据或独家爆料,所以分数没再往上拉。但它的钩子很准——把“记忆”重新框成隐私问题,而不是体验优化。正文没停留在喊风险,而是列出记忆分区、来源追踪、可删改控制和隐私测试机制这几个具体设计点,对正在往产品里加记忆的团队有直接参考价值。Google 的 Personal Intelligence 案例也给了可对照的工程栈,不是泛泛而谈。

2025年9月25日星期四

OpenAI News

ChatGPT Pulse 预览:让模型主动推消息,每天一次

OpenAI 给 Pro 用户上了个移动端新功能 Pulse,ChatGPT 不再等你问,而是每天主动推一版个性化信息卡片。它会翻你的聊天记录、记忆和反馈,还能选接 Gmail 和 Google 日历(默认关着),晚上做功课,早上把结果推给你。你可以点赞点踩、直接告诉它明天想看什么,所有输出会过一道安全检查。正文没提用了哪个模型、会不会涨价、Plus ...

推荐理由:我会先打个折:正文没提模型有没有换、Pro 之外怎么收费、Plus 什么时候上,所以别当完整发布看。但亮点是交互逻辑变了——从你问它答,变成它每天主动塞一张卡片给你,信息源还能挂上你的邮箱和日历。如果是真的,省掉你每天手动去问“今天有什么我该知道的”,但前提是你敢把 Gmail 交出去。安全检查说做了,集成默认关着,这点先别太激动,等更多实测再说。

2025年3月12日星期三

Hugging Face 博客

谷歌发布 Gemma 3 系列开源模型,最高 270 亿参数,能看图、懂 140 多种语言

Gemma 3 是谷歌最新放出的开放权重模型,有 1B、4B、12B、27B 四个尺寸。4B 及以上的版本能同时处理图片和文字,支持超过 140 种语言,上下文窗口拉到 128k token(1B 是 32k)。官方说 4B 的指令版在跑分上能打赢上一代 27B,27B 则超过了 Gemini 1.5 Pro。模型已经挂在 Hugging Face 上...

推荐理由:标题信息量不小,但正文为空,我会先打个折。Google 新 Gemma 本身自带关注度,多模态和长上下文这两个点又正好打在本地部署和模型选型的痛点上,所以 H 和 R 都站得住。K 完全拿不到分,因为参数、上下文窗口、许可证、基准成绩一概没披露,现在只能当个预告看,不能当评测结论用。整体放在 featured 低位是合理的,等模型卡或技术报告出来再重新判断。

2025年2月1日星期六

OpenAI News

OpenAI 封禁了一批用 AI 伪造求职材料、混进远程岗位的账号

OpenAI 在 2025 年 2 月的威胁报告里披露,他们封禁了几十个参与欺诈性求职活动的账号。这些账号用 OpenAI 的模型干了四件事:生成假简历和假求职档案、伪造推荐人身份帮忙做背景调查、在面试时实时生成技术题和行为题的答案,以及入职后继续用模型写代码、编借口(比如解释为什么不开摄像头、为什么从不正常地区登录)。整套操作和微软、谷歌之前曝光的朝...

推荐理由:OpenAI 自己的威胁情报报告详细说明了封禁账号的原因——一套完整的求职欺诈链条:假简历、实时面试作弊、入职后继续用模型掩盖身份。报告还关联了微软和谷歌之前曝光的类似活动,给出了具体的战术手法,不是空洞的安全通告。我会先打个折,因为正文没披露被封账号的具体数量、涉及的行业范围,也没说这些账号最终造成了多大实际损失,但作为一手情报,信息量已经足够让从业者警惕。