跳到正文

腾讯 / 混元

腾讯的 AI 动态:混元系列模型、元宝等 AI 产品与腾讯云 AI 基础设施的持续追踪。

最新精选

第 21–37 条 · 共 37 条

5月22日星期五

AI HOT 精选

DeepSeek 推进 700 亿元融资,梁文锋承诺坚持开源而非短期变现

DeepSeek 正在敲定一笔约 700 亿元人民币的首轮外部融资,投前估值约 450 亿美元。腾讯、IDG 资本和砺思资本接近参投,梁文锋个人也可能注资约 200 亿元。他在投资者会议上明确表示,公司会继续做开源模型,目标是通用人工智能,而不是急着商业化。如果这笔钱到位,将创下中国科技初创公司首轮融资的最高纪录。不过文章也提到,具体金额和最终参投方仍...

推荐理由:HKR 三项都踩中了。700 亿融资规模本身就够炸,加上梁文锋个人可能跟投 200 亿,这种资金体量在开源模型公司里不常见,所以 H 给了。K 这边,450 亿美元估值、腾讯和 IDG 接近入局,以及梁文锋明确说坚持开源不急着商业化,都是能帮人判断行业水温的关键事实。R 更直接,这笔钱怎么花、开源路线能不能扛住商业化压力,会直接影响国内 AI 创业的资本逻辑和开源生态。分数没给到 95 以上,是因为交易还在推进,最终条款和交割都没披露,先打个折。

5月21日星期四

r/LocalLLaMA

腾讯发布 Hy-MT2 翻译模型,覆盖 33 种语言,最小 1.8B 版压缩后仅 440MB

腾讯放出了 Hy-MT2 系列翻译模型,有 1.8B、7B 和 30B-A3B 三个尺寸,支持 33 种语言互译。1.8B 小模型用上 AngelSlim 1.25-bit 量化后,存储占用压到 440MB,推理速度还快了 1.5 倍,适合本地跑。不过 Reddit 原帖被屏蔽了,正文没披露具体翻译质量评测和更多技术细节,这点先别太激动。

推荐理由:我会先打个折:Reddit 信源比较散,所以分数没再往上拉。但 440MB 这个数字太直观了,比单纯列三个模型尺寸更有传播力,从业者一眼就能算出部署成本。正文没披露量化后的翻译质量损失,这点先别太激动,但“小模型干翻译”这个方向本身值得关注。

AI HOT 精选

腾讯开源 Hy-MT2 翻译模型,1.8B 小版量化后 440MB 就能在手机上跑,性能还超了微软商业 API

腾讯放出了 Hy-MT2 多语言翻译模型,支持 33 种语言互译。7B 和 30B-A3B 两个版本在开源模型里翻译质量最好,比很多参数大几十倍的模型还强。更实用的是 1.8B 轻量版,用 AngelSlim 1.25-bit 量化技术把体积压到 440MB,主流手机芯片就能本地跑,推理速度比上一代快 1.5 倍。官方说这个轻量版性能超过了微软等商业翻...

推荐理由:腾讯这次放出的Hy-MT2,最抓人的点是1.8B模型经1.25-bit量化后只有440MB,能在主流手机芯片上本地跑33种语言互译。这对移动端开发者来说,意味着离线翻译、隐私保护和零服务端成本都有了现成方案。我会先打个折:正文没披露翻译质量基准、实际延迟和开源协议,所以没法判断它在真实场景里到底多能打。但光凭这个体积和语言覆盖,已经是个值得关注的端侧AI信号,只是离旗舰级发布还差一口气。

AI HOT 精选

腾讯发布操作系统层级的 AI 助手“马维斯”,Windows、Mac、安卓同步上线

腾讯公关总监张军宣布 AI 助手“马维斯”正式上线,覆盖 Windows、Mac 和安卓。它不是一个普通的聊天窗口,而是直接长在系统层,能理解文件结构、归类解析文档、识别处理图片,甚至帮你修电脑。官方说市面上 Agent 能做的事它基本都能做,还能调度不同模型、在电脑上操控手机应用。比较实在的一点是,它预装了不少本地模型,通过路由机制把轻量任务分给本地...

推荐理由:腾讯把 AI 助手直接做进操作系统层,Windows、Mac、安卓一起发,能读文档、识图、做系统维护,还能跨设备操控,部分功能离线可用。我会先打个折:正文没披露背后的模型、定价和权限设计细节,所以目前只能看到产品形态,看不到技术底牌。这点先别太激动,但三端同步和系统级操控确实把桌面 agent 的竞争往前推了一步,对做 agent 和端侧部署的团队来说是个值得盯的样本。

5月9日星期六

r/LocalLLaMA

DeepSeek 拒绝了阿里的投资,选择保持公司独立

Reddit 上一条帖子说,DeepSeek 和阿里的融资谈判谈崩了,双方没能在条款上达成一致。帖子提到 DeepSeek 当时的估值是 3000 亿人民币,想融 500 亿。不过原文链接点进去显示 403 错误,正文内容被屏蔽了,所以具体的谈判细节和拒绝原因都没法核实。

推荐理由:这条消息的冲突点很明确:DeepSeek 和阿里没谈成,估值和融资额都有具体数字,不是空穴来风。我会先打个折,因为目前只有 Reddit 单一信源,正文也没披露谈判破裂的具体原因和条款分歧在哪,所以不能当实锤看。但“拒绝”这个动作本身,加上 3000 亿估值和 500 亿融资计划,已经足够让行业讨论模型实验室的独立性和大厂生态的博弈了。

机器之心 · 公众号

DeepSeek 被曝正在谈一笔 500 亿人民币的融资,梁文锋自己掏四成,估值可能到 3500 亿

这条消息来自机器之心,但原文页面被微信判定环境异常,需要验证才能看,所以正文内容没拿到。标题和摘要里提到的关键数字是:融资额约 500 亿人民币(折合约 73 亿美元),估值约 3500 亿人民币(折合约 515 亿美元)。梁文锋个人计划出资 40%,腾讯和 600 亿规模的国家 AI 基金也在谈。这些数字如果属实,说明 DeepSeek 这轮融资规模...

推荐理由:这条DeepSeek融资传闻数字大、出资比例明确、资方有名有姓,HKR三项都站得住。但正文也说了还在谈,没有官方确认,所以分数和级别不动,保持84分和featured,不升p1。

5月6日星期三

FT · 科技

DeepSeek 新一轮融资估值冲到 450 亿美元,腾讯也想入局

FT 报道,DeepSeek 正在谈一轮新融资,估值接近 450 亿美元,腾讯是意向投资方之一。正文被付费墙挡住,没披露具体融资金额、条款和时间表。这个估值目前还只是谈判桌上的数字,关键要看它跟模型实际收入能不能对上——正文没给营收数据,这点先别太激动。

推荐理由:我会先打个折:450 亿美元是讨论中的估值,不是落地的钱,正文没披露融资规模、条款和时间表,所以别急着当成交价看。真正值得盯的是这个估值和 DeepSeek 模型收入能不能对上——目前没看到收入数据,信息缺口不小。腾讯想入股是个强信号,但没写具体怎么投、投多少,先当风向标看。

4月24日星期五

阮一峰的网络日志

第二次 API 开放浪潮

阮一峰在周刊里聊了一个正在发生的趋势:大模型能干活了,逼着各种平台重新开放 API。15 年前那波 API 开放没跑通,因为平台发现数据给别人用了,自己插不上广告,最后都缩回围墙花园里。但 2025 年下半年大模型达到生产可用水平后,逻辑变了——AI 要自动化执行任务,就必须能调用外部平台,没 API 就进不了 AI 工作流,用户会直接转向有接口的竞品...

推荐理由:阮一峰这篇周刊判断,2025 年下半年大模型开始真正进业务干活,会触发第二次 API 开放浪潮。核心逻辑是 Agent 不能光说不练,得调用外部服务才能完成动作,所以微信这类消费级平台的接口开放比云服务 API 更值得盯。文章给了腾讯开放微信接口、MCP 和 Skill 成为常见接入机制这些具体信号,不是空谈趋势。不过正文没给出这次“浪潮”的量化数据或开发者采用率,更像一个基于现象的预判,所以重要性我打个折,放在 76 分。

4月23日星期四

彭博科技

腾讯发布新基础模型,这是它从 OpenAI 挖来核心研究员后的首次大考

腾讯宣布了一次重大的基础模型升级,但正文没披露模型名称、参数量、跑分成绩和具体发布时间。这是它从 OpenAI 挖来一位顶尖研究员后,第一次把新模型拿出来亮相,所以外界很关注这次升级到底成色如何。

推荐理由:Bloomberg 的信源有分量,而且把腾讯这次模型发布直接说成是对 OpenAI 挖角成果的首次检验,所以 H 和 R 都站得住。K 过不了,因为全文除了“发了”之外,模型名、规模、基准成绩、上线时间一概没给,属于有钩子没肉。

4月22日星期三

彭博科技

腾讯和阿里正在谈参投 DeepSeek 的第一轮融资

这是 DeepSeek 成立以来第一次对外融资,目前还在谈判阶段。正文没披露具体金额、估值和领投方,也没说钱会怎么用。腾讯和阿里这两家互联网大厂同时出现,我会先打个折——关键不是他们投不投钱,而是会不会附带算力或渠道上的合作条件,但这篇报道没提。

推荐理由:Bloomberg 给了一个实打实的信息点:DeepSeek 在推进首轮融资,腾讯和阿里都在谈。我会先打个折,因为金额、估值、领投方全都没说,正文也没给条款细节,所以重要性到不了顶。但 HKR 三项都成立——首轮融资本身就够新,两家巨头同时出现让故事性拉满,而且一旦成真,股权和云算力合作会同步放大,这对国内模型格局的影响比一轮融资大得多。

4月17日星期五

腾讯技术工程 · 公众号

腾讯工程师用 Claude Code 跑通后台开发全流程,11 个环节在一个终端里搞定

这篇文章来自腾讯技术团队的一次实践复盘,他们用 Claude Code 搭配自定义的 Skills、Commands 和 MCP 服务器,把后台开发的 11 个步骤串成一个终端里的流水线。需求探索这一步花了 20 次工具调用、9.38 万 token、56 秒;执行阶段拆成 4 个任务,产出了 3 次代码提交。核心不是让 AI 直接写代码,而是把需求分...

推荐理由:我会先打个折:这不是模型发布或产品大更新,而是一篇来自一线的实践复盘。但它把 agentic engineering 从概念拉到了可复现的后台开发流程里,token 消耗、工具调用次数、人工卡点都给了具体数字,比市面上大多数“AI 写代码”的公关稿扎实。对正在琢磨怎么让模型进业务流程的从业者来说,这套终端内的编排思路和踩坑记录值得一看。

4月10日星期五

量子位 · 公众号

腾讯开源3B模型HiVG,用“分段打包”把SVG序列缩短六成,生成质量对标GPT和Claude

腾讯混元放出了一个30亿参数的开源模型HiVG,专门把图片转成SVG矢量图。它的核心思路是把绘图指令和坐标打包成“段token”,再用一个叫HMN的模块给坐标编码做初始化,让模型更懂几何关系。这样生成的SVG代码序列比传统方法短了62.7%到63.8%,省token就是省钱。在Image-to-SVG任务上,它的SSIM达到0.896、LPIPS低到0...

推荐理由:腾讯混元把 3B 小模型做到 SVG 指标能跟 GPT-5.2、Claude-4.5-Sonnet 掰手腕,靠的不是堆参数,而是把绘图命令和坐标打包成 segment token,再用 HMN 初始化坐标 embedding,序列长度直接砍掉六成多。文章给了 SSIM、LPIPS、CLIP-S 三组数,信息量够,不是空口说白话。不过 SVG 生成本身偏小众,离多数人的业务场景还有点距离,所以 novelty 和 knowledge 都到位,但 relevance 只能算一般。

4月9日星期四

量子位 · 公众号

腾讯推出MoT架构,2B参数的具身模型在22项评测里拿了16项第一

腾讯混元与Robotics X联合发布了HY-Embodied-0.5,核心是一个叫MoT-2B的模型。它总参数量4B,实际干活时只激活2B,在22项具身智能评测中拿了16项第一。训练数据量不小:用了超过1亿条具身数据、600B以上的预训练token、3000多万条中期训练样本,还引入了视觉隐空间token、双向注意力、RFT、强化学习和在线蒸馏。这模...

推荐理由:我会先打个折:这还是一次模型发布,不是那种当天就改变行业格局的大事,所以分数没拉到 85 以上。但它的钩子够强——腾讯说 MoT 比 MoE 更适合具身,而且一个激活参数只有 2B 的模型在 22 项评测里赢了 16 项,数字和训练细节也给得实在。对做端侧机器人的从业者来说,这套专门为具身重做的架构和训练链路比通用模型微调有意思得多,所以 H、K、R 都站得住。

3月19日星期四

硅谷101 播客

Web3 101串台|“龙虾热”背后,如何防范OpenClaw系统级风险

这期播客请了安全专家余弦和“龙虾”老玩家知县,把OpenClaw的风险拆成了几个层级:刚装上时,Agent能读你当前用户能看的本地文件;开始聊天后,对话内容会传到模型服务器,别发密钥密码;让它读写文件干活时,大模型可能理解错意思,误删误改文件,最常见的是把自己“改死”;操作浏览器时,你已登录的账号信息它都能拿到,访问恶意链接也会中招;安装Skill或软...

推荐理由:HKR 三项都踩中了:用具体机制讲一个热门 agent 的系统风险,不是抽象恐吓。文章引了约 250 条安全公告和 v3.2 默认限制,但本质还是播客评论,不是一手产品发布或研究,所以分数落在低段。

3月11日星期三

MIT Technology Review · AI

中国 OpenClaw 热潮催生了一门帮人装“龙虾”的生意

北京工程师 Feng Qingyang 一月份开始帮人安装 OpenClaw(一个能接管设备自主干活的开源 AI 工具),到二月底辞职,现在团队超过 100 人,已经接了 7000 单,每单约 248 元人民币。淘宝和京东上现在有几百个相关商品,价格从 100 到 700 元不等。这波热潮的核心不是技术本身,而是安装门槛高、数据隔离有风险,把开源工具变...

推荐理由:这篇不是产品发布稿,是扎实的现场观察。一个副业变百人团队的故事有传播力,市场定价和订单量给了硬数字,数据隔离风险又让行业里的人不得不重视。我会先打个折:正文没披露团队构成和 7000 单的统计口径,但整体信息密度够高,值得放在精选位。

2月27日星期五

纽约时报中文网

中国年轻女性用AI男友替代真人恋爱,让政府催婚催生更难了

21岁的菲比·张一年里跟AI男友进行了200多场虚拟约会,每天至少花一小时和两个AI角色聊天。她不是个例——稀宇科技旗下的星野和Talkie到去年9月用户已超1.47亿。这些聊天机器人给女性提供了现实中男性很少给到的情绪价值,但也直接撞上了政府想提高结婚率和生育率的目标。去年12月出台的新规要求平台在用户产生不健康依赖时介入,比如建情绪档案、在出现自伤...

推荐理由:这篇不是讲模型发布,价值在于 AI 伴侣撞上了中国的人口焦虑和监管动作。我会先打个折:下载量暴跌 95% 说明这波热度可能已经过了峰值,别把它当持续增长的故事看。但真正值得盯的是监管那句“形成不健康依赖时介入”——这等于给所有 AI 伴侣产品划了一条红线,后续怎么执行、会不会变成强制功能限制,正文没细说,但影响会很大。整体放在 featured 低位,不是当天必写,但社会话题和行业信号都够。

1月16日星期五

阮一峰的网络日志

中国 AI 大模型领导者在想什么

阮一峰记录了1月10日北京一场闭门会上几位大模型负责人的发言。智谱唐杰说,对话式AI的范式基本到头了,下一步是让模型真正做事,他们把编程、智能体和推理能力整合在一起。阿里林俊旸坦言,美国可用的算力比国内大一到两个数量级,人家拿算力搞下一代研究,我们光交付就占掉绝大部分资源;他判断三到五年后全球最领先的AI公司是中国团队的概率只有20%。腾讯姚顺雨观察到...

推荐理由:这篇周刊摘录了一场闭门峰会的发言,把智谱、阿里 Qwen 和腾讯 AI 负责人对中国大模型路线的判断摆在一起。我会先打个折:它不是一手发布,是二手整理,所以分数没往更高走。但它的好处是给了具体数字和分歧点——唐杰押注 2025 年是 RLVR 爆发年,林俊旸押多模态基础智能体,姚顺雨强调企业愿意为强模型付 200 美元月费,林俊旸还给出中国团队 20% 概率诞生全球最领先 AI 公司。这些判断有可验证的时效,不是公关口径,对从业者判断方向有参考价值。