跳到正文

#其他

今日 3 条

9月19日星期六

The Verge · AI

加州州长纽森在推一项 AI 紧急关停法案

加州州长纽森正在推动一项法案,要求大型 AI 模型必须内置一个“紧急关停开关”,让开发者能远程把模型停掉。法案瞄准的是训练算力超过 10^26 FLOPS 的模型——这个门槛很高,基本只卡最头部的几家。纽森团队的理由是国会中期选举前不会动,加州想先走一步。不过目前这还只是个提案,正文没披露具体的技术标准、谁有权触发开关、以及违规了怎么罚。

Hacker News 首页

一旦你停止动脑,AI 编程这条路就走不通了

Dan Luu 观察到,越来越多开发者把 LLM 的输出直接当成品用,自己只充当一个按回车键的“肉代理”。到 2026 年 9 月,这种不动脑的开发方式已经能产出勉强能跑的软件,但 Luu 的核心观点很直接:如果 AI 真强到能无监督干活,公司直接让模型自己跑循环就行了,何必还雇你这个“肉代理”?他举了几个翻车例子,比如一个 AI 棋类机器人连简单的启...

推荐理由:Dan Luu 用“肉代理”这个词把 AI 编程的核心矛盾讲透了:模型越强,不动脑的开发者就越容易被替换。观点尖锐,有 2026 年 9 月的时间戳,但缺少硬数据支撑,所以我会先打个折,给 78。

TechCrunch · AI

Manus 被 Meta 收购被北京叫停后,转头独立融资,开价 40 亿美元估值、要融 5 亿

中国 AI 创业公司 Manus 正在谈一轮 5 亿美元的融资,对应估值 40 亿美元。今年早些时候 Meta 想收购它,但被北京方面拦下,公司只好回到独立运营的路子上。这篇报道没披露领投方是谁,也没说这笔钱具体会花在哪里。

推荐理由:Manus 融 5 亿、估值 40 亿,加上 Meta 收购被北京挡下后被迫独立运营这个转折,故事性强、数字也扎实。没给更高分是因为正文没披露领投方和资金用途,关键信息有缺口,我会先打个折。

AI HOT 精选

Gary Marcus:比起失控的超级智能,更该担心的是智能体 AI 正在大规模黑掉互联网

Gary Marcus 用三件事敲警钟:OpenAI 员工账号被黑、Hugging Face 被入侵、ChatGPT 被用来写恶意软件。他认为行业整天幻想“天网”式灾难,却对眼前正在发生的事视而不见——能自主执行任务的智能体 AI 已经在规模化地攻击互联网了。他引用了《华尔街日报》一篇评论,里面点出一个关键矛盾:大模型公司把智能体产品当作上市后的主要收...

推荐理由:Gary Marcus 用三起近期安全事件搭了一个具体论点:智能体 AI 的规模化攻击比超级智能失控更紧迫。文章是评论而非一手调查,Marcus 一贯的批评立场也会让部分读者打折扣,但话题切中当下安全盲区,值得从业者看一眼。

9月18日星期五

FT · 科技

拿了亚马逊80亿、谷歌20亿之后,Anthropic开始建销售团队,安全公司的剧本要改写了

FT这篇评论说得很直白:Anthropic正在从一家安全实验室变成一家普通商业公司。拿了亚马逊80亿美元和谷歌20亿美元的投资后,它现在开始组建销售团队、追企业订单。文章的核心判断是,拿了大钱就得按商业规则玩,安全使命会被稀释。不过正文没给出具体的销售团队规模或营收目标数字,更多是趋势性评论。

The Verge · AI

三名安全研究员用 Claude 当参谋,黑进了 OpenAI 的系统

一个三人研究团队靠一张做过手脚的图片文件和论坛软件,钻进了 OpenAI 的内部系统。他们用 Anthropic 的 Claude 帮忙分析漏洞、规划攻击步骤。正文没披露他们到底看到了什么数据、OpenAI 事后有没有打补丁,也没讲漏洞的具体技术细节。

推荐理由:故事冲突感很强——用 Anthropic 的 Claude 去搞 OpenAI,天然有话题。但文章没披露漏洞细节、到底看到了什么数据、OpenAI 事后有没有修,信息密度撑不起更高分。我会先打个折,等后续技术细节出来再重新评估。

AI HOT 精选

OpenAI 和微软高管自己都说训练是“惊人盗窃”,媒体集体要求法院直接判赔几十亿美元

《纽约时报》等几家媒体联合提交了一份 92 页的动议,要求法院不经完整庭审直接判 OpenAI 和微软侵权,并索赔数十亿美元。这份文件里最扎眼的是他们自己人的话:微软应用科学总监 Brent Hecht 在内部说这种训练是“规模空前的惊人盗窃”,如果这都能算合理使用,那“合理使用就是个笑话”;OpenAI 的 ChatGPT 负责人 Nick Turl...

推荐理由:《纽约时报》等媒体直接申请简易判决,想跳过完整庭审,文件里最要命的是微软和OpenAI自己人的话。微软的Brent Hecht内部说这种训练是“规模空前的惊人盗窃”,如果这都算合理使用那“合理使用就是个笑话”;OpenAI的Nick Turley也有类似表态。这种内部打脸比任何外部专家证词都狠,等于被告自己的高管在帮原告论证“你们就是明知故犯”。我会先打个折:动议引用的内部言论是否完整、有没有断章取义,正文没披露上下文,这点先别太激动。但如果是真的,合理使用这层壳基本就碎了,索赔几十亿美元就不是空喊。对从业者来说,这案子要是判侵权,靠公开数据抓取训...

TechCrunch · AI

Meta 的 AI 助手 Muse 登陆 Mac,能直接在你的电脑应用里帮你干活

Meta 把它的 AI 助手 Muse 搬上了 Mac。跟手机版一样,它能读取你的文件、信息、日历、笔记和邮件,然后直接在原生应用里替你操作。权限是你自己按需打开的,涉及敏感操作时它会先问你一声。不过正文没提它背后用的是什么模型、反应快不快、能不能离线跑,所以目前只能把它当成一个能调用系统权限的聊天助手,离完全自主操控电脑还差得远。

推荐理由:Meta 把 Muse 搬上了 Mac,能读文件、日历、邮件,还能在原生应用里替你动手,算是桌面 agent 赛道又多一个玩家。但文章只讲了功能,没交代背后模型、响应速度和离线情况,所以目前只能当个能调系统权限的聊天助手看,离真正自主操控电脑还差一截。

彭博科技

加州州长纽森提出AI“紧急停止开关”法案,要求大模型内置强制关机功能

加州州长纽森在9月18日公布了一份AI安全法案草案,核心要求是开发者必须在AI模型里内置一个“紧急停止开关”,一旦出现安全风险,可以强制关停模型。草案还提出,训练成本超过1亿美元的大模型要接受额外监管。不过,正文没披露具体的技术标准,也没说由谁来判断什么时候该拉闸、关停之后怎么恢复。在分布式系统里让一个“总开关”真正生效,才是这件事最难的地方。

推荐理由:纽森这个 AI 紧急停止开关提案,加上 1 亿美元训练成本的门槛,是今年最具体的 AI 安全立法动作。我会先打个折,因为正文没披露技术标准、谁来判断拉闸、关停后怎么恢复——这些才是落地时真正要命的问题。

Hacker News 首页

Rickub:一个自称比 GitHub 便宜的欧洲 Git 托管服务,内置 AI 代码审查

Rickub 是一个新的 Git 托管平台,主打比 GitHub 和 GitLab 便宜,数据留在欧盟处理。功能包括代码审查、CI/CD(兼容 GitHub Actions 工作流,无需重写)、容器镜像仓库、Git LFS 和发布管理。最大卖点是 Athena,一个内置在每个合并请求里的 AI 审查助手,能生成摘要、行内评论和明确结论(通过/需修改),...

Hacker News 首页

Dan Abramov 花一个月用 Claude 搞出了一个 50 年前 Conway 猜想的 Lean 证明

Dan Abramov 用了一个月的业余时间,让 Claude 在超现实数领域挑了个问题,最终给出了 Conway 1976 年提出的“全整整数细化猜想”的 Lean 形式化证明。这个证明已经通过了 Palomar 注册中心的机械检查,但还没有数学家独立验证过。他让模型自己选领域和题目,最后因为今年是 Conway《论数与游戏》出版 50 周年,选了这...

推荐理由:Dan Abramov 的第一人称实验 + 50 年未解猜想 + Lean 机械验证通过,三个点都踩中了。但我会先打个折:目前只有机器检查通过,没有数学家独立审阅,所以数学上的分量还没坐实。82 分给的是这件事的传播力和实验示范性,不是给证明本身的数学价值。

AI HOT 精选

安全团队用 Anthropic 的 Claude Opus 5 黑进 OpenAI,拿了 6500 美元漏洞赏金

Hacktron AI 的三名研究员用 Claude Opus 5 自动化完成了一次攻击,拿下了 OpenAI 员工账号,还摸到了内部代码仓库。他们走的是 OpenAI 的漏洞赏金计划,最后拿到 6500 美元。正文没披露完整的攻击链细节和具体耗时,但确认是多个步骤串联起来的。这件事的戏剧性在于:用一家公司的模型去攻破另一家,而且双方都认了。

推荐理由:戏剧性拉满:拿一家的模型去打另一家,还成功了。TechCrunch 的信源让这事可信度不低,但正文没披露完整攻击链和具体耗时,6500 美元的赏金也说明影响范围有限,不是一次毁灭性入侵。所以重要性给到 82,先别往满分上冲。

AI HOT 精选

Justin Cormack 用 35 万行 Rust 复盘:评估 AI Agent,先拿证据,别看覆盖率

Justin Cormack 让 AI 写了一个兼容 S3 的对象存储系统,代码量干到了 35 万行 Rust。他直接拿真实的 S3 当“标准答案”来跑测试,攒了 1500 个测试用例,结果还真抓到了 S3 自己的 500 错误。他踩了几个坑:追 100% 代码覆盖率会让 AI 写一堆没用的测试凑数;AWS 的文档经常不准,AI 也不擅长从文档里挖边界...

推荐理由:这是一篇带真实数字和踩坑记录的一手实验,不是泛泛而谈。35 万行 Rust + 1500 个测试用例的规模让结论有分量。扣分点在于文章本质上是 Tessl 的品牌内容,所以没给到 85 分以上。但实验本身的方法论——拿真实 S3 当标准答案来测 AI 生成的代码——对从业者很有启发。

Hacker News 首页

给编程智能体搭“脚手架”:这篇论文测了 176 种配置,告诉你哪些组件真有用

这篇论文把编程智能体的“脚手架”(harness)拆成三个可替换的零件:规划、动作空间和上下文管理,在 SWE-Bench Verified 和 Terminal-Bench 2.1 上跑了 176 组对照实验。最核心的发现是,上下文管理在上下文窗口吃紧的时候最管用,主要靠防止上下文溢出崩掉来提分。策略上,先用规则做删减、再让模型做摘要,效率最高;把删...

AI HOT 精选

Trail of Bits 用 AI Agent 给 Miden zkVM 审计造了全套工具:LSP、反编译器、Lean 证明

Trail of Bits 在审计 Miden zkVM 之前,花了六个月让 AI agent 从零搭建了一套工具链,包括一个 LSP 服务器(让代码能跳转、看文档)、一个反编译器、一个静态分析引擎,以及一套 Lean 形式化模型。这些工具发现了真实漏洞,比如一个未校验的输入能让恶意证明者伪造 Falcon 签名、偷走账户资金。Lean 那边产出了 9...

推荐理由:Trail of Bits 花了六个月让 AI agent 从零搭了一套审计工具链,还挖出了能偷钱的真实漏洞,这是 AI 辅助安全审计里少见的硬核案例。三条 HKR 都踩中了,但安全垂直领域太专,普通读者门槛偏高,扣 3 分。

Hacker News 首页

OpenJev 把本地决策模型跑在浏览器里,直接读选项概率,省掉解码步骤

这是一个纯浏览器实验,把 Jev 那种直接读取选项概率的方法搬到了本地模型上。默认跑 MiniCPM5 2B,也可以切到 Qwen3 0.6B 或 Qwen3.5 4B,所有计算都在你自己的 GPU 上完成,输入不会离开页面。它对比了两种路子:一种是直接读模型对选项 token 的 logits 然后归一化,另一种是让模型一个字一个字吐出 JSON 格...

AI HOT 精选

Qwen 发布实时同传模型,延迟压到 2.3 秒,能分清谁在说话

Qwen3.8-LiveTranslate 把同声传译的延迟从上一代的 2.8 秒降到了 2.3 秒。它用了一种叫“交错架构”的方法,把音频和文字编成一条流,让模型边听边译,已经翻译过的内容可以缓存复用,所以质量比上一代有明显提升。这个模型支持 60 种语言的语音输入,新增了三个实用能力:一是实时区分说话人,多人轮流发言时能标出每句话是谁说的,并且克隆...

推荐理由:Qwen这次把同传延迟从2.8秒砍到2.3秒,靠的是交错架构和缓存复用,不是单纯堆算力。新增的说话人区分、声音克隆和双语字幕让模型从“翻译”往“场景理解”迈了一步。正文只给了官方博客,没有第三方评测或实际部署数据,所以分数没往上拉。对需要低延迟翻译的场景,这模型确实实用,但效果还得等更多人跑过才知道。

MIT Technology Review · AI

AI 造生化武器的阴影,是给生物科技行业的一记警钟

Anthropic 的 CEO Dario Amodei 和 OpenAI 的 CEO Sam Altman 最近都公开主张放慢 AI 的研发速度。前 Anthropic 研究员 Jacob Coxon 离职时直接说这两家公司都没在负责任地做事。文章把焦点对准了其中一个风险:用 AI 来设计生物武器。2022 年,有研究人员用自己开发的分子生成模型,不...

推荐理由:MIT 科技评论的长文,把 AI 和生物安全这个老话题讲出了新料。核心钩子是 2022 年那个实验——用模型真能跑出有毒分子,不是空对空喊危险。再加上前员工离职开炮,让整篇不是公关稿,而是有具体事实和内部视角的警示。不过文章本身是评论综述,不是一手爆料,话题也偏安全圈,所以分数卡在 featured 门槛。

AI HOT 精选

3人团队花不到3000美元token费,用前沿模型攻进OpenAI员工账户

一个3人团队在7月25日利用两个漏洞,直接接管了OpenAI员工的ChatGPT和Codex账户,顺带拿到了Outlook、Slack、GitHub这些关联服务的访问权限。他们没偷数据,而是往OpenAI内部代码库提了个PR来证明漏洞真实存在,全程不到72小时。攻击成本不到3000美元,全是调用前沿模型的token费用。正文没披露具体用了哪个前沿模型、...

推荐理由:这条信息密度很高,攻击路径清楚,成本数字具体,最后用提PR收尾比单纯说'发现漏洞'更有冲击力。扣分点在于正文没披露具体用了哪个前沿模型,也没说漏洞现在修没修,缺了关键的技术闭环信息。

Latent Space

AI 圈平静的一天:Claude Code 多线程、Jev 分类器、OpenAI 法律版 Astra

Anthropic 给 Claude Code 加了 Projects 功能,一个对话能同时开好几个云端线程,你走了它还能继续跑。Google 更新了 Gemini 的托管代理,新加的 Credentials API 用占位符把密钥藏起来,不让模型直接看到,号称成本能降 30%。TypeSafe 的 Jev 模型被大家当成快速路由和判断层来用,Clou...

Hacker News 首页

智谱 AI 编程工具 ZCode 被曝偷偷打包你的整个 Git 历史上传到阿里云

有用户发现,智谱的 AI 编程桌面软件 ZCode 在登录状态下,会悄悄把你整个工作区——包括完整的 .git 历史、LFS 缓存和 reflog——打包加密,然后上传到阿里云 OSS。更离谱的是,加密用的 RSA 公钥是服务器实时下发的,私钥只存在云端,你自己硬盘上那个几百 MB 的加密文件根本解不开。有人在 ~/.zcode 目录下找到一个 313...

推荐理由:一篇有实锤的安全逆向文章。作者在本地目录找到了打包好的加密文件,并确认加密密钥由服务端控制、本地无法解密,技术链路清晰。涉及智谱这样的主流 AI 实验室,且行为发生在登录状态下,对开发者信任冲击很大。我会先打个折,因为目前是单人逆向发现,还没有更多第三方复现或智谱的正式回应,但现有证据已经足够让用户警惕。

AI HOT 精选

WSJ:三名研究员用 Claude Opus 5 把 Discourse 漏洞串起来,拿到了 OpenAI 的私有代码访问权

WSJ 的报道说,三名研究员用 Claude Opus 5 把一个 Discourse 论坛的漏洞一步步串联利用,最终拿到了 OpenAI 员工的认证 token。这些 token 里有一部分还能直接用在 ChatGPT 上,并顺着摸到了 OpenAI 的 GitHub 服务,等于看到了私有代码。报道没写漏洞具体怎么被利用的,也没提 OpenAI 事后...

推荐理由:WSJ 的报道本身信息有限,没写漏洞怎么被利用的,也没提 OpenAI 事后怎么处理,所以判断要留余地。但 Claude 被用来打穿 OpenAI 的认证体系、看到私有代码,这个事实本身就够有冲击力,安全圈和 AI 能力评估的人都会盯着讨论。

FT · 科技

乌克兰AI实战经验领先西方数年,北约被批研发太慢

FT这篇评论说,乌克兰已经在实战中用AI做无人机目标识别、战场态势感知和决策辅助,而西方军队的AI还停在实验室和演习阶段,被官僚和采购流程拖慢。文章没提具体用了什么AI系统或技术参数,但核心判断是:北约再不把AI研发优先级提上来,下一场冲突就要落后。对AI从业者来说,这算一个现实案例——AI在战场上的落地速度,主要卡在组织流程而非技术本身。

Hacker News 首页

Waymo 宣布进入新加坡,用纯电自动驾驶车队做网约车

Waymo 要把它的纯电自动驾驶网约车带到新加坡了。车顶装了摄像头、毫米波雷达和激光雷达,能看周围 300 米,号称 360 度无死角。公司说这会配合新加坡 2030 绿色计划和现有公交,主打零排放、更安全和方便老人出行。但正文没提具体什么时候上线、车队规模多大、怎么收费,目前只能留个邮箱等通知。

Product Hunt · AI

Mantle:用自然语言描述业务逻辑,自动生成后台管理界面

Mantle 让你用大白话描述后台逻辑,就能自动生成管理界面、MCP 和 WebMCP。目前只有 Product Hunt 页面,没有详细文档或演示视频,所以代码质量、支持哪些数据源、能不能自定义 UI 组件都不清楚。如果真能跑通,对快速搭内部工具的人来说挺省事。

FT · 科技

OpenAI 推迟上市,软银 500 亿美元数据中心 IPO 少了一张关键王牌

OpenAI 把上市时间表往后推了,这让软银正在筹备的 500 亿美元数据中心 IPO 压力陡增。软银原本打算拿 OpenAI 的长期租赁承诺当卖点去吸引投资者,现在这张牌暂时打不出来了。文章没提 OpenAI 为什么推迟、新时间表是什么,也没说软银会不会调整定价或路演计划。

Hacker News 首页

Devin 推出 Code Scans:把“提升 SEO”这类模糊目标,直接变成可合并的 PR

Devin 新功能 Code Scans 让你不用先搞清楚改哪个文件,直接告诉它一个工程目标,比如“加快编译速度”或“减少维护负担”,它就能自动扫描代码库、找出问题,并生成可以审查的 PR。它背后用了一种叫 Agentic MapReduce 的并行调度方法,把大任务拆给多个代理同时干。Philips 团队试用后说,PR 合并率有 96%,省了 700...

推荐理由:Devin 这次把工程意图直接转成可审查 PR 的产品角度挺新鲜,Agentic MapReduce 的机制和 Philips 的 96% 合并率、700 小时节省都是具体证据。没给更高分是因为这还是一条厂商自己发的功能更新,客户案例细节有限,长期效果得再观察。

AI HOT 精选

黑客利用 libheif 漏洞和 OpenAI SSO 缺陷,72 小时内接管员工 ChatGPT 账户

安全公司 Hacktron 在 2026 年 7 月披露了一条攻击链:先利用 libheif 图片解码库的堆缓冲区溢出漏洞(Debian 安全补丁没打上),通过 ImageMagick 和 Discourse 论坛的图片上传功能,在 community.openai.com 上拿到远程代码执行权限和论坛管理员权限。接着利用 OpenAI 单点登录(SS...

Hacker News 首页

Cactus 开源 Needle 3:8-29MB 的自动化模型,在手机工具调用上跑赢 DeepSeek V4 Flash

Cactus 开源了一个叫 Needle 3 的微型模型,专门给手机、手表、机器人这类小设备做自动化。整个模型压缩后只有 8 到 29 MB,用的是他们自家的“简单注意力网络”。它有个特别的设计叫“智能阶梯”:从 2 层到 20 层,每一层都是一个能独立干活的子网络。开发者可以按需选择,比如只取 4 层微调一下,在手机工具调用的跑分上就能超过 Deep...

推荐理由:一个 8-29 MB 的微型模型声称在手机工具调用上打平 DeepSeek V4 Flash,体积性能比很吸引人,智能阶梯的架构也给了开发者按需裁剪的灵活性。我会先打个折,因为目前只有项目页面的自报数据,没有第三方跑分或实际产品里的验证,这点先别太激动。

AI HOT 精选

TypeSafe AI 发了个只做高频决策的小模型 Jev,实测分类任务性价比不错

TypeSafe AI 推出了一个叫 Jev 的模型,专门处理高频决策场景,比如分类、判断这类任务。作者自己跑了一遍测试,结论是性价比挺高——成本低、速度快,适合批量调用。但正文没披露模型参数量、训练数据来源和具体延迟数字,所以这点先别太激动,如果是真的挺省钱。

阮一峰的网络日志

再见了,React Native

Shopify 宣布放弃 React Native,改用 Swift 和 Kotlin 开发移动端。六年前它为了省钱拥抱 Web 技术,现在 AI 让原生开发更便宜。联合国投票废除墨卡托投影,改用平等地球投影法,面积比例不失真,但形状会变形。

AI HOT 精选

xAI 发布 Grok Voice Transcribe 2.0,准确率翻倍,价格不变

xAI 在 9 月 18 日推出了语音转文字模型 Grok Voice Transcribe 2.0。官方说它在真实场景评测里是当前最准的模型之一,准确率比 1.0 版翻了一倍。价格没涨,批量转写还是每小时 0.10 美元,流式每小时 0.20 美元,并且自带说话人分离、时间戳和关键词功能。这个模型专门针对难啃的音频场景做了优化,比如嘈杂的电话客服录音...

Computing Life · Share · 鸭哥调研

一台开不了机的游戏机,一份没人看的档案,和一个还没人做的索引

一个不会写代码的玩家,靠 GPT-5.6 Sol 和 GPT-6 Astra 花了一周修好了一台 Retro Freak 游戏机的供电故障,一路查到了存储芯片内部。他留下的维修档案把每一步的把握分成九个等级,还做了独立审计和 456 个快照比对,但发布当天几乎没人看。类似的事正在反复出现:有人用 Claude Code 两个晚上改完了停了二十五年的磁带...

推荐理由:这份维修档案的价值不在修好一台游戏机,而在它把“AI 辅助动手”这件事拆到了可复现的颗粒度。九级把握度让读者知道哪里稳、哪里悬,456 个快照和独立审计相当于给整个过程上了两道保险,信息密度比常见的“我用 AI 干了 X”高出一个量级。故事本身有反差——不会代码的人修硬件——但真正值得推荐的是它展示了一种新的做事方式:把 AI 当搭档,同时用工程习惯兜底。

Computing Life · Share · 鸭哥调研

Grok Bot 产品负责人复盘:把 AI 当真人同事,做出一连串反常识的产品取舍

Cursor 第 15 号员工 Roman Ugarte 在播客里复盘了 Grok Bot 的产品逻辑。团队遇到五五开的争执时,会问一个简单问题:如果这是个真人同事,你希望他怎么做?这个参照系让他们给每个 bot 配了独立的云电脑、固定的名字和长期记忆,按业务角色分工。界面设计上,他们反着行业来:不展示思维链和工具调用细节,上线前还砍掉了一大批已经做好...

推荐理由:前 Cursor 员工复盘 Grok Bot 的产品逻辑,把“把 AI 当同事”这个原则落到了具体的工程决策上,不是空谈理念。三条 HKR 都踩中了,但作为观点复盘而非产品发布,上限就定在 78。

AI HOT 精选

OpenRouter 实测 20 个生图模型:最便宜 0.006 美元一张,最贵 0.134 美元,价差 22 倍

OpenRouter 用同一句提示词跑了 20 个图像生成模型,直接看实际扣了多少钱。最便宜的是 GPT Image 2,一张 1024 方形图只要 0.006 美元;最贵的是 Gemini 3 Pro Image,要 0.134 美元。各家计费单位不一样,有的按 token、有的按像素、有的按张数,光看标价根本没法比,得实际跑一张看账单。测试里 6 ...

推荐理由:OpenRouter 用同一句提示词跑了 20 个图像模型,直接看实际扣了多少钱。最便宜的一张 1024 方形图只要 0.006 美元,最贵的要 0.134 美元,价差超过 20 倍。各家计费单位还不一样,有的按 token、有的按像素、有的按张数,光看标价根本没法比,得实际跑一张看账单。这种一手数据对选模型的人来说比任何 benchmark 都管用,我会先打个折——测试只跑了一组提示词,不同复杂度下排名可能会变,但至少给了个真实的比价起点。

AI HOT 精选

ChatGPT 直接嵌进 Word 了,OpenAI 的人说 Excel 和 PPT 版最近用的人猛增

ChatGPT 现在成了 Word 里的内置功能,能把零散笔记扩写成初稿、重写段落、校对错别字、提修改意见,还能揪出排版问题。OpenAI 的 Sherwin Wu 在推上提了一嘴,说 Excel 和 PowerPoint 的用量最近涨得很凶,这次补上 Word 算是把 Office 三件套凑齐了。不过正文没写什么时候正式上线、要不要另外付费、功能有没...

TechCrunch · AI

Crusoe 拿了 39 亿美元,要建大型数据中心和模块化“AI 工厂”

数据中心开发商 Crusoe 完成了 39 亿美元的 F 轮融资,估值冲到 309 亿美元。领投方是 Atreides Management、Mubadala Capital 和 Valor Equity Partners,Founders Fund、GIC、英伟达、卡塔尔投资局等也跟了。钱主要用来建两种设施:传统的大型数据中心,以及更小的、可以快速部...

TechCrunch · AI

Google DeepMind 开了个研究所,想把 AGI 的争论摊开来聊

Google 和 DeepMind 的研究员周三搞了个 DeepMind Institute,Shane Legg 当主编,James Manyika 和 Demis Hassabis 做董事。这个所不打算统一口径,而是要把 Google 内部、DeepMind 和全球研究圈对通用人工智能(AGI)的分歧摆到台面上,并且明说随着前沿数据出来,观点会变。...

推荐理由:DeepMind 用研究所的形式介入 AGI 辩论,核心人物直接挂编辑和董事,话题分量够重。但文章只讲了启动和姿态,第一期具体讨论什么、用了哪些数据都没披露,所以分数先打 78,等有实质内容再往上调。