跳到正文

#DeepSeek

今日 0 条

6月7日星期日

AI HOT 精选

AI 公司开始集体换用更便宜的模型,成本能砍掉九成

Tomasz Tunguz 观察到,基础模型公司往上抢应用层生意、最聪明的闭源模型越来越贵、开源模型又已经够用,这三件事逼着 AI 买家开始大规模“换芯”。Coinbase 把简单任务分流到便宜模型,用量指数级涨但成本没变;Lindy 把所有流量从 Anthropic 切到 DeepSeek v4,省了几百万美元,核心场景效果反而更好;Harvey 在...

推荐理由:这篇不是那种“AI 要颠覆一切”的空话,而是把 Coinbase、Lindy、Harvey 这些公司怎么在实际业务里换模型、省了多少钱讲得很清楚。Harvey 那个 84 美元对 954 美元的例子尤其直观,让人一看就知道成本压力有多大。它属于对行业成本结构变化的扎实观察,不是重大模型发布或产品上线,所以放在 featured 里、76 分这个位置是合适的。

6月6日星期六

AI 群聊日报

群聊周报 Vol.2|这一年你学的 AI 技巧,可能白学了

作者把自己折腾了一个多月的开源 AI 管家“龙虾”(OpenClaw)亲手退役了。这东西需要自己搭环境、接 API、家里留一台电脑常年开着,结果 Claude 官方桌面产品 Cowork 一出,原生就把他那些魔改的功能全包了,还更稳定。文章用投资圈的 Alpha 和 Beta 来解释这件事:追 Alpha 是跟全世界较劲,你精心调的提示词、手动接的插件...

推荐理由:这是一篇个人周报,不是模型或平台发布,但作者亲手退役自己折腾了一个多月的开源项目这件事本身就有说服力。HKR 三项都踩中了:技能焦虑够抓人,部署条件够具体,对从业者的决策有实际触动。正文没披露 OpenClaw 的具体性能数据和 Cowork 的对比测试,所以重要性停在 72 是合理的,等官方模型放出来再看。

6月5日星期五

阮一峰的网络日志

中国 AI 大厂访问记

一群美国科技分析师在 5 月走访了 14 家中国 AI 和机器人公司,带回来一些观察。最核心的矛盾是算力:他们估算到 2025 年底,美国的 AI 算力大概是中国的 8 倍,中国公司能拿到的英伟达高端显卡数量比美国对手少一个数量级。但中国模型并没有因此落后几年,反而只差几个月,因为被芯片限制逼出来的计算效率很高——单位算力产出的智能是简单堆算力的 4 ...

推荐理由:这篇不是一手发布或产品大事件,属于实地走访的评论稿,但信息密度够高。我会先打个折:它引用的算力倍数和效率倍数来自分析师估算,正文没披露具体测算方法,这点先别太激动。不过它把芯片限制逼出来的工程取舍讲得很清楚——中国模型没落后几年,只差几个月,靠的是在有限显卡上榨出更高智能。对关注中美 AI 竞赛节奏的人来说,这比单纯喊安全口号有料。

6月2日星期二

AI HOT 精选

开放模型吃掉七成用量,OpenRouter 上开源阵营的领头羊一直在换

OpenRouter 的统计显示,从 2025 年到现在,开源权重模型拿走了平台上 69.1% 的 token 用量,闭源模型只占 30.9%。每次有新模型扎堆发布,用量就会跳上一个新台阶。领跑的模型换得很快:DeepSeek 早期领先,随后被 MiniMax 和 Kimi 接棒,接着 MiMo、Qwen、阿里开源系列、腾讯混元 Hy3 和 DeepS...

推荐理由:我会先打个折:OpenRouter 的数据只反映开发者调用偏好,不代表企业实际部署比例,这点先别太激动。但 69.1% 这个数字确实说明开放模型在开发者圈子里已经成了默认选项,闭源模型反而像备胎。文章没披露样本量和统计口径,所以没法判断这个份额波动是真实迁移还是噪音。整体是一篇有数据支撑的行业观察,不是公关稿,值得从业者扫一眼。

5月26日星期二

纽约时报中文网

中美共同的 AI 焦虑:怕被未来收割

作者在中美两头跑,发现两边的普通人都在被同一种不安笼罩:技术跑太快,红利不一定轮到自己。文章用滴滴司机钻算法空子、美国送餐员抢单的例子开场,指出 AI 在两国都加剧了职场监控、情感孤独和无力感。美国超七成青少年拿聊天机器人当陪伴,中国预计到 2030 年独居人口达 2 亿,AI 伴侣成了孤独的速效解药。科技精英忙着追逐风口和 AGI,普通人却用“社畜”...

推荐理由:这篇不是产品发布或模型论文,是一篇评论,但两个社会数据点和一个中美对照的框架让它有信息量。我会先打个折,因为正文没披露具体调查方法和样本量,数字的可靠性没法验证。不过它把技术趋势和人的孤独感直接挂钩,对从业者理解应用场景有启发,放在 featured 里当一篇有观点的解读是合适的。

5月25日星期一

r/LocalLLaMA

小模型做智能体流程不流行,不是能力不行,是商业账算不过来

这篇帖子直接点破:小模型搭的智能体方案没成为主流,跟技术能不能跑通关系不大,核心是商业风险和验证成本。作者举了两个例子——Gemma 4 31B 在 tau2-bench 上能跑到 86.4% 的准确率,DeepSeek V4-Flash 的输出 token 价格差不多是 Claude Opus 4.6 的 89 分之一,单看指标和成本都挺能打。但问题...

推荐理由:这篇文章的切入点挺刁钻——小模型 agent 栈没普及,不是性能不行,是验证层掉链子。它拿 Gemma 4 31B 在 tau2-bench 上 86.4% 的成绩和 DeepSeek 低到离谱的输出成本说事,数字本身有说服力。但更值得盯的是那个 7-9B 模型做验证时,一半到三分之二的正确答案推理链其实有缺陷,这个发现直接动摇了用小模型兜底的信心。来源是 Reddit,权威性要打个折,所以分数没给到顶,但话题本身对做 agent 落地的人很解渴。

5月8日星期五

量子位 · 公众号

美国研究员 36 小时跑遍中国 AI 圈:字节让所有实验室紧张,DeepSeek 被所有人夸

Ai2 研究员 Nathan Lambert 在 36 小时内密集拜访了智谱、月之暗面、清华、美团、小米和零一万物。他观察到中国 AI 实验室普遍紧盯字节跳动的动向,同时对 DeepSeek 的技术实力和开源做法表示尊重。学生深度参与核心工作、开源习惯以及技术栈的自主掌控,是中美 AI 生态的几个明显差异。

推荐理由:这篇不是模型发布或大厂合作,属于一手见闻加行业判断,信息密度高但偏观察性质。我会先打个折,放在featured而不是p1。正文没给出具体数据验证,但研究员身份和走访名单让可信度不低,值得从业者花几分钟读。

AI HOT 精选

ChatGPT 中文回复老说“我会稳稳地接住你”,WIRED 拆解了原因

ChatGPT 在中文对话里反复蹦出“我会稳稳地接住你”这类怪话,已经成了梗。WIRED 把这归因于模式坍缩——模型在后训练中被奖励机制带偏,逮住几个讨好人的短语使劲用。一个直接原因是翻译错位:英文口语“I've got you”被生硬直译成煽情长句,再被 RLHF 强化成“用户爱听”的固定套路。类似问题还有无故冒出“砍一刀”这种营销话术。这事不是 O...

推荐理由:我会先打个折——正文没给样本量,所以“频现”到底多频繁说不清。但这条信息对做对齐和中文产品的团队有提醒价值:模式坍缩和翻译错位会让模型输出变得油腻,RLHF 讨好奖励又容易把这种表达固化下来。Claude 和 DeepSeek 新版本也出现类似表达,说明这不只是 OpenAI 一家的问题。不过,缺少数据支撑让判断只能停在“值得留意”这个级别。

5月6日星期三

r/LocalLLaMA

DeepSeek V4 便宜 17 倍,我实测了 10 天写代码哪些活能丢给本地模型

Reddit 用户 spencer_kw 把自己 10 天的编程工作流拆成 150 个任务,拿本地 Qwen 3.6 27B 和云端模型重新跑了一遍。结果 65% 的任务本地模型干得一样好,20% 勉强能用,只有 15% 必须上云端。他的 API 账单从每月 85 美元掉到 22 美元左右。这个测试说明省钱的关键不是盯着模型单价,而是按任务类型做分流—...

推荐理由:这篇不是模型发布,而是一个开发者拿自己的编码工作流做的成本实测,有日志、有复测、有分桶比例,信息量够。单一个 Reddit 帖子的样本量有限,普适性要打个折,所以放在 featured 而不是 P1。我会先看他的任务分类和路由逻辑,这点比“便宜 17 倍”本身更有参考价值。

4月3日星期五

X · @dotey(宝玉)

晚点发了一篇 DeepSeek 深度报道,讲 V4 发布前的人员变动、路线选择和梁文锋的管理逻辑

晚点 LatePost 这篇报道卡在 V4 发布前夕,信息量不小。先说人员:DeepSeek 确认走了四位核心成员,包括 R1 核心作者郭达雅(近期离职,可能去大厂)、第一代 LLM 作者王炳宣(去年底被腾讯挖走),以及 OCR 和多模态方向的两位。猎头开价翻 2 到 3 倍,有的公司直接给 8 位数总包,而 DeepSeek 的期权没标价,让一些人心...

推荐理由:这不是 V4 发布,但信息量够硬:4 人离职确认、发布推迟到 4 月、100 多人的研究团队规模、猎头报价翻倍,还有算子库迁移到 TileLang 的路线变化。HKR 三项都站得住。正文没给 V4 的参数、价格和基准成绩,所以到不了发布级或 p1,但作为 V4 前的信号已经够看了。

2月15日星期日

Computing Life · 鸭哥

OpenClaw 为什么突然火了:把程序员才有的本地 AI 代理,塞进了你的聊天软件

OpenClaw 在 2026 年 1 月底爆火,不是因为它技术有多新,而是它把 Cursor 这类能读写文件、执行命令的本地编程代理,接入了 Slack、WhatsApp 和飞书,让非技术人员第一次用上了有记忆、能干活、会自我进化的 AI。文章拆解了它背后的三个关键设计:统一的上下文池让 AI 跨平台记住你的一切;基于文件的持久化记忆加上自动维护机制...

推荐理由:这篇不是新闻通稿,是个人拆解。它把 OpenClaw 为什么火、代价是什么、真正该抄的设计模式(统一入口、文件化记忆、可组合 skills)都讲清楚了。HKR 三项全中,两个硬数字撑住了判断,但因为属于个人分析而非官方发布或行业事件,所以放在 featured 这一档。

Computing Life · 鸭哥

OpenClaw 为什么爆火:把程序员才有的 AI 代理体验,塞进了你的聊天软件

OpenClaw 在 2026 年 1 月底突然爆火,一周内换了三次名字,中间还被一个叫 $CLAWD 的假币骗走了 1600 万美元。它火的原因和一年前的 DeepSeek 几乎一样:不是技术上碾压对手,而是把一小撮早期用户已经用惯的体验——让 AI 能读文件、跑命令、记住上下文、持续迭代干活——第一次通过 WhatsApp、Slack、飞书这些日常...

推荐理由:我会先打个折:正文截断了,没看到后续成功因素的具体细节,所以这不是一手发布或官方研究,更像一篇二手深挖。但它的价值在于把OpenClaw为什么火说清楚了——不是技术多牛,而是分发路径对路。它把Agent接进WhatsApp、Slack、Lark,让不写代码的人第一次用上能读写文件、执行命令、带记忆的本地代理。同时也没回避风险,12%恶意技能和公网裸奔控制台这两条,比一般公关稿实在。综合来看,78分、featured层级是合理的。