跳到正文

#RAG

今日 0 条

6月9日星期二

AI HOT 精选

德国法院裁定:谷歌 AI 概览是谷歌自己的话,说错了要负责

德国慕尼黑地区法院在一项临时禁令中认定,谷歌必须为 AI 概览生成的虚假内容直接担责。起因是谷歌的 AI 概览错误地把两家慕尼黑出版商跟诈骗、订阅陷阱等黑产扯上了关系,而这些指控在 AI 引用的链接原文里根本不存在。法院的核心逻辑是:AI 概览不是传统搜索结果,它会用自己的话重新组织、评判信息,属于谷歌自己生产的内容,所以不能套用搜索引擎的间接侵权保护...

推荐理由:这篇值得看,因为德国慕尼黑地区法院给了一个很具体的判例:谷歌 AI 概览把两家出版商跟诈骗、订阅陷阱扯上关系,但引用的链接原文里根本没这些内容。法院的逻辑是,AI 概览不是简单罗列搜索结果,而是用自己的话重新组织、评判信息,这就算谷歌自己生产的内容,不能再用搜索引擎那套间接侵权保护来免责。我会先打个折,这只是地方法院的临时禁令,不是终审也不是全球规则,但信号已经很明确——模型胡说八道,平台得自己扛。对做 RAG 外挂资料库和 AI 搜索的产品来说,这个判例直接关系到合规风险和产品设计。

6月3日星期三

The Verge · AI

英国裁定:谷歌必须让网站主能拒绝内容被 AI 搜索功能抓取

英国竞争与市场管理局(CMA)对谷歌提出新要求:网站主现在可以把自己的内容从 AI 搜索概览(AI Overviews)这类功能里撤出来,也能禁止谷歌拿这些内容去微调自己的 AI 模型。说白了,就是给了内容方一个“别用我的东西训练你”的选项。不过正文没披露这个退出机制具体怎么操作、是统一开关还是按功能细拆,也没说谷歌需要在多长时间内落实。

推荐理由:我会先打个折:正文没写具体时间表和违规处罚,所以重要性停在 80 分。但这条消息本身够硬——英国 CMA 要求 Google 让网站能选择不进入 AI Overviews,并且不能偷偷用这些内容微调模型。对做 AI 搜索和 RAG 的人来说,这意味着外挂资料库的入口可能被掐掉一部分,模型能用的公开数据也会变少。如果是真的落地,出版商至少多了一个谈判筹码,Google 的 AI 搜索训练管道也得改。

5月30日星期六

量子位 · 公众号

帮 Gemini 拿下 IMO 金牌的建模负责人,差点去当了职业钢琴家

这篇文章讲的是 Yi Tay,他在 Gemini Deep Think 拿到 IMO 金牌级成绩时担任建模联合负责人。他 2023 年参与创立了 Reka AI,639 天后又回到了 Google DeepMind。文章还提到他 2012 年就考过了 Trinity 古典钢琴副学士文凭,差点走上职业演奏的路。不过正文因为微信环境验证拦截,具体技术细节和...

推荐理由:这是一篇人物特写,不是 Gemini 能力发布稿。核心价值在于 Yi Tay 在 IMO 金牌成果里的具体角色、他创办 Reka 又回归的经历,以及 639 天这个精确时间跨度。文章没展开技术细节,所以重要性停在人物和行业信号层面,76 分放在 featured 档是合适的。

5月29日星期五

TechCrunch · AI

Glean 年收入突破 3 亿美元,帮企业砍 AI 预算成了它的核心卖点

Glean 的年收入跨过 3 亿美元,一年翻了三倍,哪怕科技巨头也杀进了企业 AI 搜索这个赛道。它现在的核心卖点不是功能多强,而是帮客户省 AI 预算。不过正文没披露利润率、客户数量,也没说清楚具体怎么帮企业砍预算,这点先别太激动。

推荐理由:这篇信息量偏薄,给了收入数字和“省钱”这个卖点,但省钱机制、客户规模和利润情况全是空白。我会先打个折:钩子够抓人,事实有增量,可验证性弱,适合放在 featured 里偏低的档位。

5月28日星期四

The Verge · AI

CNN 起诉 Perplexity,指控其 AI 答案引擎直接复制付费墙后的文章

CNN 在纽约法院起诉了 AI 搜索公司 Perplexity,说它的 AI 答案工具会“逐字”复制 CNN 的报道,甚至把原本锁在付费墙后面的内容直接喂给用户。CNN 在诉状里提到,他们试过屏蔽 Perplexity 的爬虫,但对方没理会,照样抓取记者采写、编辑的内容,既没授权也没付钱。

推荐理由:CNN 告 Perplexity 这事,核心是 AI 搜索把付费内容直接吐给用户,还抄得一字不差。对从业者来说,这直接关系到模型输出怎么规避版权雷区,以及跟媒体谈授权时对方会拿什么说事。目前还只是起诉阶段,没判决也没产品改动,所以先别当定论看,但信号已经够强了。

5月22日星期五

Latent Space

AI 基础设施又添独角兽:Exa、Modal、TurboPuffer 三家同时拿到大额融资

这期主要聊了三家 AI 基础设施公司的融资进展。TurboPuffer 先确认年经常性收入达到 1 亿美元并且已经盈利,这个数字说明做向量数据库的生意可以自己造血了。Exa 完成了 2.5 亿美元的 C 轮融资,估值 22 亿美元,他们做的是 AI 搜索引擎。Modal 融了 3.55 亿美元,估值冲到 47 亿美元,业务是帮开发者更方便地跑模型和部署...

推荐理由:Latent Space 这条汇总把三笔 AI 基础设施融资串在一起,信息密度高。TurboPuffer 做到 1 亿美元年经常性收入并且盈利,说明向量搜索这类基础能力已经有客户愿意持续付费,不是纯烧钱。Exa 拿 2.5 亿美元 C 轮、估值 22 亿美元,Modal 拿 3.55 亿美元 C 轮、估值 47 亿美元,两笔都是大额后期融资,反映资本在往模型训练和推理的底层平台集中。对做 AI 应用的人来说,这些数字能帮你判断下游供应商的稳定性和议价空间。正文没展开各家具体技术指标或客户构成,所以估值背后的溢价逻辑只能看个大概,这点先别太激动。

2025年2月10日星期一

OpenAI News

OpenAI 与北欧最大媒体集团 Schibsted 达成合作,把旗下报纸内容直接接进 ChatGPT 做新闻摘要

ChatGPT 会开始用 VG、Aftonbladet 等北欧大报的文章来回答用户的新闻类问题,覆盖 3 亿用户。回答里会标明出处和媒体品牌,方便读者去原站核实。公告没提授权费怎么分、合同签了多久、具体能用哪些文章。Schibsted 的 CEO 说这是为了在 AI 平台越来越影响信息获取方式时,早点进去摸索怎么让高质量新闻在 AI 环境里继续赚钱。他...

推荐理由:OpenAI 自己发的合作消息,产品效果很具体:Schibsted 旗下几家报纸的内容会以带来源标注的摘要形式出现在 ChatGPT 里,覆盖 3 亿用户。我会先打个折,因为正文没写合作期限、授权范围和钱怎么分,这些关键信息都空着。但值得留意的是,授权新闻正进一步嵌入 ChatGPT 的主回答链路,不再只是外挂搜索导流,这对媒体分发和平台信息控制权都有影响。

2025年1月15日星期三

OpenAI News

OpenAI 和 Axios 达成内容合作,还出钱帮它在美国四个城市扩张本地新闻

OpenAI 宣布跟 Axios 签了内容合作协议,同时提供资金,帮 Axios 把本地新闻业务开到匹兹堡、堪萨斯城、博尔德和亨茨维尔这四个新城市。OpenAI 说现在合作的媒体机构接近 20 家,覆盖 160 多个新闻出口、几百个内容品牌和 20 多种语言。ChatGPT 的搜索功能会展示合作方的摘要、节选、出处和原文链接。正文没披露这次合作的具体金...

推荐理由:OpenAI和Axios的合作本身不算大新闻,但公告里透出的规模数字和Search展示方式挺实在。我会先打个折,因为资助金额和技术条款都没说,没法判断Axios到底拿了多少好处、模型具体怎么用他们的内容。不过对做AI应用和媒体的人来说,这相当于看到了一张更清晰的“AI搜索引用地图”:160多家机构、20多种语言,意味着引用和流量分配的模式在快速定型。这点值得留意,哪怕公告本身有点PR味。

2024年10月8日星期二

OpenAI News

OpenAI 与赫斯特达成内容合作,旗下 20+ 杂志和 40+ 报纸将进入 ChatGPT

OpenAI 在 2024 年 10 月 8 日宣布,跟美国老牌出版集团赫斯特(Hearst)签了内容授权协议。赫斯特会把《时尚先生》《时尚 COSMO》《ELLE》《跑者世界》《女性健康》等 20 多个杂志品牌和 40 多家报纸(包括《休斯顿纪事报》《旧金山纪事报》)的内容提供给 ChatGPT 这类产品。ChatGPT 目前每周有 2 亿用户,以后...

推荐理由:OpenAI 把 Hearst 旗下 20 多个杂志品牌和 40 多家报纸的内容接进 ChatGPT,正文顺带确认周活用户 2 亿。合作只覆盖杂志和报纸,不含 Hearst 其他业务,内容会带引用和原文链接。我会先打个折:出版商授权现在不算新鲜事,但这次规模摆在那,而且新闻内容进 AI 分发链的归属和引用问题一直没消停,所以值得放 featured。

2024年8月20日星期二

OpenAI News

OpenAI 和康泰纳仕合作,把 Vogue、纽约客等杂志内容接进 ChatGPT 和 SearchGPT

OpenAI 在 2024 年 8 月 20 日宣布与康泰纳仕(Condé Nast)达成合作,会把 Vogue、The New Yorker、GQ、Wired 等至少九个品牌的内容放进 ChatGPT 和还在测试的 SearchGPT 里。SearchGPT 会直接给出原文链接,让用户点进去看完整报道。公告里没提合作金额、授权范围、收入怎么分、以及具...

推荐理由:OpenAI 把 Vogue、The New Yorker、Wired 等 Condé Nast 旗下品牌的内容接进 ChatGPT 和 SearchGPT,搜索结果会带原文链接。对从业者来说,这验证了头部出版商在 AI 搜索里的分发位置,但合作细节全没披露——没写授权范围、没写钱怎么分、也没写哪些地区能用,所以我会先打个折,把它放在低分 featured 档。