跳到正文

#其他

今日 3 条

9月9日星期三

OpenAI News

OpenAI 发布 GPT-6 Astra:能直接操作 Excel 和 Figma,干活更快,成本更低

OpenAI 推出了 GPT-6 Astra,一个主打干复杂活儿的模型。它不用 API 就能直接操作你电脑上的日常软件,比如 Excel 和 Figma。在一个 Excel 建模比赛里,它的速度比人类冠军快了大约 4 倍。在 Terminal-Bench 4.0 这个测试智能体干终端杂活能力的基准上,Astra 得分 57.9%,超过了 GPT-5.6...

推荐理由:OpenAI 放出 GPT-6 Astra,主打直接操作电脑软件和复杂任务,速度碾压人类冠军,属于行业级震动。HKR 三项全中,分数接近天花板。正文没提定价和具体铺开范围,这是目前唯一的信息缺口。

AI HOT 精选

OpenAI 千禧年难题证明争议:数学家指控其用自己上传的草稿训练模型,并施压要求剔除 Anthropic 合著者

数学家 Tristan Buckmaster 公开指控 OpenAI 学术不端。他和合著者 Levent Alpöge 在研究纳维-斯托克斯方程(一个悬赏百万美元的千禧年难题)时,曾将草稿上传到代码平台 Codex。OpenAI 随后听到风声,说 Anthropic 可能解决了该难题,便立刻调动资源用自家模型去攻克同一个问题。Buckmaster 认为...

推荐理由:这篇争议有很强的吸引力——一个悬赏百万美元的数学难题,一个实名指控者带着清晰的时间线,两家头部AI公司卷入。扣分是因为目前只看到Buckmaster单方面的说法,OpenAI和Codex的立场还没展开,完整图景待补全。但即便信息不完整,它触及的开放科学与平台权力问题,对从业者来说是个绕不开的疙瘩。

AI HOT 精选

Thomas Wolf:AI 数学还没搞定,Navier-Stokes 那个结果更像是在找反例,不是完整证明

Hugging Face 联合创始人 Thomas Wolf 对 OpenAI 的说法泼了盆冷水。OpenAI 声称用比 GPT-6 Astra 更强的下一代模型群组,证明了纳维-斯托克斯千禧年难题的猜想是错的。Wolf 觉得这个结果挺厉害,但本质上是在搜索反例,离数学家认可的那种完整证明还差得远。正文没披露具体模型名字、证明细节,也没说有没有经过外部...

推荐理由:Thomas Wolf 这盆冷水泼得挺及时。OpenAI 的说法听起来很炸,但 Wolf 点出了关键:搜到一个反例和拿出一份数学家认的完整证明是两码事。正文没给模型名、没给证明细节、也没说有没有外部验证,所以我会先打个折——信息密度不够,但 Wolf 的立场和这个区分本身对从业者有提醒价值,别看到“千禧年难题”就上头。

AI HOT 精选

DeepSeek 找了中信证券准备在科创板上市,计划年内交表

路透社消息,DeepSeek 已经聘请中信证券筹备科创板 IPO,目标是今年递交申请、明年挂牌。募资额和估值还没定,钱主要想用在三块:扩建算力、加大模型和自研芯片投入、留住核心人才。公司 2026 年前七个月营收约 4.75 亿元,是 2025 年全年的 10 倍,增速很快。同时,DeepSeek 还在做新一轮融资,目标估值约 5000 亿元。今年 6...

推荐理由:消息本身分量够重,营收数字和自研芯片计划让故事有实感。没给更高分是因为募资额和估值都还没定,正文也缺具体时间表,现在只是筹备阶段,变数还大。

纽约时报中文网

OpenAI 用上万个 AI 智能体解出了一道千禧年数学难题

OpenAI 说他们用一个还没发布的模型,在 88 小时内解出了纳维-斯托克斯存在性与光滑性问题——这是七个千禧年大奖难题之一,之前二十多年只被解决了一个。具体做法是同时跑上万个 AI 智能体,让它们像一群分工协作的数学家一样干活,人类研究员则在各组之间传递关键想法,像蜜蜂授粉。最终证明用 Lean 语言写成,已经公开供外部审查。OpenAI 研究员 ...

推荐理由:OpenAI 声称用未发布模型解出了纳维-斯托克斯问题,这绝对是能震动整个行业的消息。88 小时、上万智能体协作、Lean 语言证明公开,信息密度很高,而且给出了可审查的路径。我会先打个折,因为证明还没通过外部同行评审,现在只能算 OpenAI 单方面宣布,所以重要性停在 88 分,等验证过了再往上调。

AI 群聊日报

OpenAI 用一万个 Agent 解出千禧年数学难题,但 Codex 数据隐私争议抢了头条

OpenAI 宣布用约一万个并发 agent 在 88 小时内解出了 Navier-Stokes 千禧年难题,消耗 1300 亿输出 token。但 NYU 数学家 Buckmaster 公开指控 OpenAI 可能通过 Codex 接触了他与合作者 Alpöge 未发表的草稿,双方技术路线高度重合。OpenAI 没直接否认,只说“不能排除去标识化数据...

推荐理由:千禧年难题被宣称解决本身就是行业地震,但 Buckmaster 的抄袭指控和 OpenAI 那句“不能排除”让整件事从技术展示变成了信任危机。我会先打个折:正文没披露 agent 之间怎么分工、验证是否独立复现,这些缺口让“解出”的含金量还不好判断。但不管真假,这件事已经同时踩中了 agent 工程上限、数据合规和科研伦理三条线,从业者绕不开。

纽约时报中文网

Calif 用 AI 花一周多造出微信蠕虫,不点链接也能在 iOS 和安卓间传染

安全公司 Calif 的研究员用多种 AI 模型组合,花了一周多时间搞出一个叫 WeWorm 的零点击蠕虫。它通过微信传播,只要被黑的好友给你打一通电话,你不用接,手机震动几秒内没挂断,你的微信账号就会被劫持,然后蠕虫会继续打给你通讯录里的所有人。腾讯确认了这个漏洞并已修复,说没发现用户受影响。这个攻击利用了微信对已存联系人的信任机制,再结合其他漏洞甚...

推荐理由:NYT 独家报道,腾讯确认漏洞并已修复,没有发现用户受影响。我会先打个折,因为漏洞已经不存在了,实际危害为零。但这条消息的警示价值拉满——AI 辅助攻击从概念验证变成了真东西,而且攻击对象是微信这种体量的平台。放在 featured 档,不是因为它造成了多大损失,而是因为它提前揭了一张底牌。

Latent Space

OpenAI 用上万 AI 智能体、88 小时算力,声称找到了纳维-斯托克斯方程的奇点解

OpenAI 发帖说,他们用下一代模型 Astra-next 驱动了约 1 万个 AI 智能体,花了 88 小时、烧掉 1300 亿个 token(算力成本估计超 4000 万美元),搞出了一个纳维-斯托克斯方程有限时间奇点的解。如果数学界验证通过,这会是第二个被解决的千禧年大奖难题。不过目前没有公开预印本、证明草图,也没有同行评审。那个“88 小时”...

推荐理由:如果验证通过,这会是历史级的数学突破。但现在没有预印本、没有证明草图、没有同行评审,消息来源只是一篇付费 newsletter 转述,连 OpenAI 自己的官方公告链接都没给。我会先打个折:正文没披露任何可核验的出处,这点先别太激动。

Product Hunt · AI

Type.com:一个工作区同时跑 Claude 和 Codex,不用来回切工具

Type.com 上线了一个共享工作区,同时支持 Claude 和 Codex 两个模型。团队可以在一个界面里调用不同 AI,不用在工具之间来回切换。正文没披露具体的协作功能、模型版本或定价,所以实际用起来体验如何、成本多少,目前还不清楚。

FT · 科技

DeepSeek 融资太抢手,催生了一个收高额中介费的影子市场

DeepSeek 正在融新一轮资,想投进去很难。FT 报道说,一些基金和家族办公室正通过中间人买份额,条件是 2% 的管理费加 20% 的业绩提成,比行业标准贵一大截。有个投资人为了拿到 500 万到 1000 万美元的额度,还得承诺未来给中间人更多好处。DeepSeek 说没授权任何人卖老股,但报道没披露这轮融资的总规模和估值。这些场外报价水分可能不...

推荐理由:FT 独家挖出了 DeepSeek 融资的场外灰色市场,有具体的费率数字和投资人案例,信号很强。但报道没披露这轮融资的总规模和估值,DeepSeek 也只是否认了授权卖老股,没给更多细节,所以分数没再往上调。H、K、R 三项都打中了,信息缺口主要在交易本身的完整轮廓上。

AI HOT 精选

GPT-6 Astra 推理等级怎么选最省 Token

正文被微信屏蔽了,只留了个标题。标题说 GPT-6 Astra 有多个推理等级,选对了能省 Token,但具体有哪些等级、怎么选、省多少,一概没披露。信息缺口很大,没法判断真假或实用程度。

AI HOT 精选

OpenRouter 发了个教程:一行代码换模型,用 Gemini 改图

OpenRouter 发了个教程,教开发者怎么用一行 API 调 Gemini 的图片编辑模型。默认模型叫 Nano Banana 2(就是 google/gemini-3.1-flash-image),你传一张原图和一段文字指令,接口直接返回改好的图。教程给了完整的 Python 和 TypeScript 代码示例:本地文件转 base64 或者传一...

AI HOT 精选

OpenRouter 上手 Seedance 2.5:长镜头和改老素材很强,但最高只到 720p

Seedance 2.5 在 2026 年 8 月上线,主打两件事:一次生成 30 秒的长镜头,以及拿你已有的视频、图片或音频当参考素材来编辑或延长。成本上,生成 480p 视频每秒约 0.103 美元,720p 约 0.231 美元;如果用视频做参考,token 单价还能再打六折,编辑比从零生成更省钱。音频生成不额外收费。最大的短板是分辨率封顶 72...

推荐理由:OpenRouter 这篇上手评测把字节 Seedance 2.5 的账算明白了:480p 每秒一毛钱出头,720p 两毛三,拿已有视频当参考还能再打六折,音频白送。720p 封顶是硬伤,但编辑比从零生成便宜这点对做视频工具的人挺实在。信息量够、有实测感,不过受众面偏窄,放在 featured 刚好。

AI HOT 精选

OpenRouter 上线美国区域路由:请求解密和模型推理都锁在美国境内

OpenRouter 给企业版和商业版用户加了一个美国区域路由端点(us.openrouter.ai),跟去年 10 月上线的欧盟路由配套。发到这个端点的请求只会在美国境内解密,也只交给部署在美国的模型供应商跑;如果某个模型没有美国供应商,请求直接返回 404,不会偷偷绕到其他地区。DeepSeek V4 Pro、Kimi K3、GLM 5.2 这些国...

Computing Life · Share · 鸭哥调研

上周三件小事:agent 的账本、接口与房间

上周几拨人撞上了同一个工程瓶颈:agent 记性差、协作乱、碰不到物理世界。安全研究员 Jordy Zomer 开源了 Lemmalog,把 agent 记忆拆成两半:前面用模型从对话里提取事实,后面用确定性的规则引擎管因果推演和级联撤销,一条前提错了,依赖它的推论自动作废。Anthropic 和 Janelia 推出模型硬件标准 MHS,让大模型用大...

推荐理由:三件事撞在同一个工程瓶颈上:agent 记性差、协作乱、碰不到物理世界。Lemmalog 的因果账本有具体实现和开源代码,是这篇里最扎实的部分;MHS 和多 agent 协作部分正文着墨不多,细节偏弱。整体是个人博客的周报汇总,不是一手发布,我会先打个折,但 Lemmalog 的思路值得关注。

FT · 科技

OpenAI 数学推理突破遭抢发,至少两个团队声称独立做出类似结果

FT 报道 OpenAI 在数学推理上有了新突破,但至少两个团队跳出来说他们独立做出了差不多的东西。全文付费,没披露技术细节、模型名字或跑分,只确认了存在一个优先权争议。正文没披露具体突破是什么、谁先做出来的、以及用了什么方法,所以这点先别太激动。

AI HOT 精选

Meta 的 AI 智能体 Muse 开放试用,官方感谢用户反馈

Meta 的 AI 智能体产品 Muse 现在开放更多用户试用了,入口在 https://muse.ai/join。Meta 首席 AI 官 Alexandr Wang 说团队花了很多心血,感谢大家的反馈。用户评价说它的设计、速度和浏览器智能体流程(让 AI 在浏览器里帮你操作网页)表现不错,还能深度集成 Instagram 等 Meta 自家产品。不...

Product Hunt · AI

Frigade Assist API:让AI代理直接告诉用户点哪里

Frigade 推出 Assist API,允许 AI 代理在界面上生成实时引导,直接告诉用户下一步该点哪个按钮。正文没提支持哪些模型或延迟多高,但核心卖点很清楚:代理自己写教程,不用人工录制。对做 AI 客服或自动化流程的团队来说,这能省掉维护操作指南的功夫。

TechCrunch · AI

黑客在偷 Claude 付费用户的 token,Anthropic 已确认异常但没给明细

英国一位 AI 顾问发现自己的 Claude Max 20x 账号在闲置时 token 用量还在涨,从 45% 跑到 55%。他关掉了所有关联任务和云端执行,用量照样增加。Anthropic 确认了异常,停用了他的付费账号、作废了所有会话和服务器端 token,并退了 44.49 英镑,但没提供逐条的用量记录。账号停用直接打断了他的生意——他靠 Cla...

推荐理由:Anthropic 安全事件,有实名受害者、具体数字和官方回应,HKR 三条全中。没给更高分是因为目前只有 TechCrunch 报道的单一个案,不是 Anthropic 自己披露的,信息全来自用户一方。78 分,放 featured 低位。

AI HOT 精选

OpenAI 把 Astra 推给了所有付费用户,但没说它到底能干什么

OpenAI 在 X 上发帖说 Astra 已经全面推送给 Plus、Pro、Business 和 Enterprise 用户,覆盖 Codex 和 ChatGPT Work。帖子没解释 Astra 是什么功能、有没有参数变化或定价调整,只给了一个 openai.com/gpt-tv/ 的实机演示链接。我会先打个折——目前能确认的只有推送范围,具体能力...

推荐理由:我会先打个折——目前能确认的只有推送范围,Astra 到底是什么功能、有没有参数变化或定价调整,正文都没披露。全量推送本身是个信号,但信息缺口太大,所以分数卡在 featured 门槛上。如果演示链接里能挖出具体能力或数字,这条可以再往上走。

TechCrunch · AI

Cognition 估值冲到 480 亿美元,投资人用钱投票:AI 编程还不是赢家通吃的市场

Cognition 刚完成新一轮融资,估值 480 亿美元,年化收入约 2.5 亿美元。这个估值倍数比 Cursor 卖给 SpaceX 之前还要高,说明投资人认为 AI 编程赛道容得下多家公司,不会一家独大。他们的产品 Devin 定位是“AI 软件工程师”,正在拿下一些企业客户。不过正文没披露具体融了多少钱、谁投的。我会先打个折:收入不到估值的 1...

推荐理由:Cognition 的 480 亿估值和 2.5 亿年收入是实打实的数字,非赢家通吃的判断也有别于主流叙事。但正文没披露这轮融了多少钱、谁投的,缺了关键信息,所以停在 78 分,没给到 85。

TechCrunch · AI

Meta 发布个人 AI 助手 Muse,想接管你的邮箱、日历和支付,但用户敢把数据交给它吗?

Meta 推出了 Muse,一个能接入用户邮箱、日历、支付、健康应用和智能家居的个人 AI 助手,目前仅在美国上线。这是 Meta 在消费级 AI 上押注最大的一次,但文章没提技术细节、定价和后续推广时间表。我会先打个折:就在两周前,Meta 刚因社交媒体对儿童造成伤害的官司掏了 180 亿美元和解金,现在却要用户交出比社交数据更敏感的信息,信任问题是...

推荐理由:Meta 在消费级 AI 代理上押注很大,Muse 的权限范围确实比现有助手激进,值得关注。但文章本质是产品发布消息,技术细节和定价全缺,知识增量不够。信任问题戳中要害,可惜信息量不足以展开讨论,整体判断要打个折。

AI HOT 精选

NYU 数学家指控 OpenAI 在百万美元数学竞赛中耍阴招,Bubeck 否认

NYU 数学教授 Tristan Buckmaster 宣布与合作者用 Anthropic 的 Codex 和 Claude 模型,在纳维-斯托克斯存在性与光滑性问题上取得了初步证明,该问题悬赏 100 万美元。但他同时指控 OpenAI 在平行攻关中使用了不正当手段。OpenAI 的 Sébastien Bubeck 否认了这些指控。正文没有披露具体...

Product Hunt · AI

DuckFightClub:给机器鸭子训练大脑,赢金喙腰带

DuckFightClub 是一个 AI 机器人格斗联赛,参赛队伍用强化学习训练 Pollen 公司开源的 MicroDuck 机器鸭的“大脑”,然后在模拟器里对战,全程直播。你不用造机器人,只训练它的决策策略。比赛免费参加,未来实体 MicroDuck 发货后还会转成线下赛。目前只有模拟器阶段,实体机器人的实际表现和延迟还没披露。

AI HOT 精选

Anthropic 给了三个在自家平台省钱又不掉性能的办法

文章提了三个操作方向:一是把 prompt cache 命中率拉高,让模型少重复读同样的上下文;二是模型升级到前沿版后,把以前写 prompt 的坏习惯清掉;三是调 effort 参数,别每次都让模型全力跑。正文没给具体数据和对比,所以实际能省多少还不清楚,先当个方向清单看。

OpenAI News

GPT-5.6 Sol 帮麻省理工研究生跑量子芯片校准,晚上睡觉时实验自己做完

OpenAI 发了一个案例:MIT 量子工程组的研究生 Beatriz Yankelevich 把 GPT-5.6 Sol 连到实验室软件上,让它自动给超导量子比特做校准测量。模型能自己跑标准流程——找频率、校准脉冲、测相干时间——信号干净时基本不用人管。但信号弱或噪声大时,还是需要研究员介入指导。现在这个组经常让 agent 在夜里跑实验,研究员早上...

Dwarkesh Patel 播客

预训练进步主要靠数据,模型架构改进更多是为了让更大规模训练跑得动

Dwarkesh Patel 和 Jerry Han 用 2019 到 2025 年每年公开的模型配方和数据语料,在 1e19 FLOPs 算力预算下做了对照实验。结果发现,数据改进带来的算力效率提升是 12 倍,模型改进只有 3.7 倍,两者效果基本可以叠加,不会互相干扰。数据侧从 2019 年 Reddit 高赞网页的 90 亿 token,进化到...

推荐理由:Dwarkesh 和 Jerry Han 用六年公开配方跑了一组对照实验,把预训练进步拆成数据 12 倍、模型 3.7 倍,结论清晰有数字。没给更高分是因为这是博客文章,不是同行评审论文,但实验设计和结论对从业者已经够用。

AI HOT 精选

Mistral 复盘用 AI 智能体把 4 万行 Fortran 77 迁移到 C++ 的过程

Mistral 发了一篇工程复盘,讲他们用自己的 AI 智能体把一个 4 万行的 Fortran 77 老代码库迁移到 C++。文章重点说了三个难啃的骨头:怎么让智能体理解没有文档的老代码逻辑、翻译后怎么保住数值精度、以及设计一套验证流程来抓 bug。正文没披露用了哪个模型、总共花了多少时间、以及最后需要人工修多少处。这篇可以当方法论参考,不是产品发布。

推荐理由:Mistral 发了一篇实打实的工程复盘,用自家智能体做老代码迁移,把三个难啃的点讲清楚了,不是产品公关稿。分数没给更高,因为正文没披露用了哪个模型、总共花了多少时间、最后人工修了多少处——这些关键信息缺了,判断就得打个折。

9月8日星期二

TechCrunch · AI

Chrome 改成每两周发一次更新,因为 AI 让漏洞攻击变快了

Google 把 Chrome 的更新周期从 4 周缩短到 2 周,从 Chrome 153 版本开始,覆盖桌面、iOS 和 Android。原因是 AI 驱动的自动化攻击工具和社区提交的漏洞报告越来越多,补丁必须出得更快。正文没披露具体漏洞数量或攻击案例,但逻辑很清楚:攻击者用 AI 批量找漏洞,浏览器就得加速修。对用户来说,以后重启浏览器的频率会更高。

Hugging Face 博客

安全对齐不该一刀切:只拒绝话题里的有害部分,而不是整个话题

现在的安全对齐有个通病:把整个话题当成拒绝单位。比如 LlamaGuard-3 把“选举”归为“事实错误信息”,导致模型连“选举流程是什么”这种无害问题也拒答。Multiverse Computing 这篇论文提出“窄边界安全”,核心想法是,在同一个话题(比如政治)里,只拒绝有害的子集(比如写定向操纵内容),正常回答无害问题(比如选举事实)。做法是让部...

推荐理由:H 和 K 都打中了:角度尖锐,LlamaGuard-3 误标选举话题的例子很具体。R 偏弱,这是安全对齐的细分话题,不会在更广的圈子里被主动提起。定在 featured 门槛 72 分,没再往上是因为正文只给了摘要,完整实验和验证细节还没看到。

TechCrunch · AI

Mistral 拿了 30 亿欧元 D 轮,估值超 210 亿,三星领投

法国 AI 公司 Mistral 完成 30 亿欧元(约 35.8 亿美元)的 D 轮融资,投后估值超过 210 亿欧元。这轮由三星电子领投,EQT 旗下的 Scaleup Europe Fund 和老股东 PSG Equity 联合领投。公司自称这是欧洲科技公司史上最大的一笔股权融资。钱主要花在算力、基础设施、商业扩张和出海。Mistral 再次强调...

推荐理由:Mistral拿下欧洲科技史上最大股权融资,三星领投、估值超210亿欧元,三个维度都撑得住。没给更高分是因为竞争定位的信息偏薄,正文没披露当前营收或市场份额,所以停在82分。

OpenAI News

OpenAI CFO 发文:GPT-6 Astra 已来,消费者与企业业务互相喂养

OpenAI CFO Sarah Friar 发了一篇博客,核心是给 GPT-6 Astra 定调:这是目前最聪明、对齐做得最好的模型。文章没给技术细节,更像一份战略叙事。她提到 ChatGPT 周活用户超过 10 亿,付费企业客户 250 万,内部研究团队现在每 1 个人类工作日,就对应 3.1 个智能体工作日(agent-workday)的产出。最...

推荐理由:OpenAI CFO 发了一篇博客给 GPT-6 Astra 铺路,说这是目前最聪明、对齐最好的模型。文章没给技术细节,更像一份战略叙事。她提到 ChatGPT 周活用户超过 10 亿,付费企业客户 250 万,内部研究团队现在每 1 个人类工作日,就对应 3.1 个智能体工作日的产出。我会先打个折——这个 3.1 倍是内部自报,没第三方验证,但数字本身够猛,从业者会拿来当参照。文章没披露模型参数、训练成本或具体评测基准,所以这篇的价值不在技术,在于 OpenAI 怎么对外讲自己的故事。

OpenAI News

OpenAI 发布 ChatGPT Images 2.5,生图速度翻倍,还加了个手绘板功能

OpenAI 推出了新的图像模型 Images 2.5。最直接的变化是生图延迟比上一代低了最多 50%,出图更快。画质上,光照更自然、材质细节更丰富,多轮改图时也能更稳地保住画面主体不走样。目前每周通过 ChatGPT 和 API 生成的图片已经超过 30 亿张。这次还加了一个叫 Sketch 的新功能,允许你在 ChatGPT 里直接画草图当参考,让...

推荐理由:OpenAI 正式发了 Images 2.5,延迟最多降 50%,画质上光照和材质更自然,多轮改图时主体更稳,还加了 Sketch 草图输入。每周 30 亿张的量说明这已经是大众工具了。这次更新是实打实的体验升级,不是换皮,三个维度都踩中了。没给更高分是因为这算迭代优化,不是范式级变化。

OpenAI News

OpenAI 投 500 万美元,研究生成式 AI 对 13–17 岁青少年的影响

OpenAI 拿出 500 万美元资助独立研究,专门看生成式 AI 怎么影响 13–17 岁青少年的情绪、社交、安全等方面。申请全球开放,但优先考虑 AI 使用率高的国家。研究必须包含伦理审查、知情同意、隐私和数据安全说明。钱不算多,但方向明确:不是让 OpenAI 自己出报告,而是让外部学者做,结果更可信。正文没披露资助数量和每笔上限,也没说研究周期多长。

AI HOT 精选

数学家巴克马斯特用LLM辅助证明PDE爆破结果,并曝光OpenAI内部模型声称证明Navier-Stokes但人力投入很大

NYU数学家Tristan Buckmaster与合作者Levent Alpöge宣布,在LLM(Claude、Codex、GPT-5.6 Sol、Astra)大量辅助下,证明了可压缩多孔介质、Boussinesq和3D不可压缩Euler方程在光滑外力下的有限时间爆破。他们用Lean验证了证明,但Euler论文被作者自己称为“AI垃圾”。更关键的是,B...

AI HOT 精选

Mistral 拿了 30 亿欧元 D 轮融资,估值冲到 210 亿欧元以上

Mistral 宣布完成 30 亿欧元 D 轮融资,估值超过 210 亿欧元。公司说这笔钱要用来把“主权、开放权重”的 AI 推到技术前沿。不过公告没写投资方是谁,也没说这轮什么时候关的。开放权重意味着模型参数公开,别人能自己部署和微调,不用把数据交给 Mistral。主权 AI 大概是指数据和处理都留在欧洲,不受美国云厂商控制。但具体怎么实现、钱怎么...

推荐理由:欧洲 AI 实验室拿到的最大单笔融资,而且把主权和开放权重绑成一条路线,定位够清晰。没给到 85 分是因为公告没披露投资方,也没说这 30 亿具体怎么花,信息缺口不小,判断得先打个折。

机器之心 · 公众号

面壁开源2B端侧模型,想让手机跑通用Agent

面壁智能开源了一个20亿参数的端侧模型,定位是让手机这类设备能跑通用Agent。正文被CAPTCHA挡住了,没披露跑分、推理速度、功耗这些关键指标,也没给仓库链接。2B参数在端侧算中等偏小,如果能跑通用Agent任务(比如让模型进业务流程干活),对手机厂商和开发者来说是个低成本选项。但没数据支撑,这点先别太激动。