跳到正文

字节跳动 / 豆包

字节跳动的 AI 动态:豆包大模型与 Seed 团队的模型发布、豆包等产品迭代与商业化进展的持续追踪。

39 条精选相关主题千问 QwenDeepSeekAI 视频

最新精选

第 1–20 条 · 共 39 条

9月28日星期一

AI HOT 精选

北京在摸底阿里和字节对英伟达新工作站芯片的需求,字节可能想买 100 万颗做训练

The Information 说北京已经问了阿里和字节打算买多少、用来干什么。字节跳动在评估采购约 100 万颗英伟达新款工作站芯片,主要给 AI 模型训练用。英伟达计划 12 月底开始发货,每季度向中国供 50 万片。目前审批要多久、能批多少都不清楚,美国那边也没公开这芯片的出口管制状态。100 万颗这个数如果是真的,量不小,但正文没披露具体芯片型...

推荐理由:百万颗这个数字和北京审批细节让这条消息比一般政策传闻更有分量,但正文没披露具体芯片型号,也没说美国那边的出口管制到底怎么定,所以分数卡在85以下。

9月9日星期三

AI HOT 精选

OpenRouter 上手 Seedance 2.5:长镜头和改老素材很强,但最高只到 720p

Seedance 2.5 在 2026 年 8 月上线,主打两件事:一次生成 30 秒的长镜头,以及拿你已有的视频、图片或音频当参考素材来编辑或延长。成本上,生成 480p 视频每秒约 0.103 美元,720p 约 0.231 美元;如果用视频做参考,token 单价还能再打六折,编辑比从零生成更省钱。音频生成不额外收费。最大的短板是分辨率封顶 72...

推荐理由:OpenRouter 这篇上手评测把字节 Seedance 2.5 的账算明白了:480p 每秒一毛钱出头,720p 两毛三,拿已有视频当参考还能再打六折,音频白送。720p 封顶是硬伤,但编辑比从零生成便宜这点对做视频工具的人挺实在。信息量够、有实测感,不过受众面偏窄,放在 featured 刚好。

9月6日星期日

量子位 · 公众号

网友把 GPT-6 当导演、Seedance 当摄影,攒出一条 AI 动画流水线

有人把 GPT-6 Astra 和字节的 Seedance 2.5 串了起来,让 Astra 在 Blender 里搭场景、做预演、定机位,再把参考帧丢给 Seedance 生成动漫风格的打斗镜头,最后 Astra 自己动手剪辑出片。同一套流程还拍了火影同人短片,以及把一部中国短剧翻成美国版。Fable 5.1 和 Gemini 3.8 Flash 也...

推荐理由:一个把 OpenAI 和字节最新模型串起来做自动拍片的动手实验,流程清晰、有成品,但缺少稳定性、成本和对比数据,更像个人 workflow 分享而非产品更新,刚好够 featured 门槛。

8月7日星期五

FT · 科技

字节跳动在训一个对标 Anthropic Mythos 的超大模型,计划 2026 年底前推出

FT 引述两位知情人士说,字节跳动正在搞一个比自家现有旗舰大得多的模型,目标是追上 Anthropic 的 Mythos。训练成本预计超过 10 亿美元,背后有大约 50 亿美元的计算预算撑着。正文没披露参数量、具体架构和跑分,只说字节希望推理能力和让模型进业务流程干活的表现能跟 Mythos 打平。我会先打个折:消息全靠单一信源,没有独立验证,而且 ...

推荐理由:FT 独家消息,字节在搞一个比自家现有旗舰大得多的模型,训练费预计超 10 亿美元,算力预算约 50 亿,目标是追上 Anthropic 的 Mythos。三个点都打中了——价格够抓眼球,目标够具体,而且直接关系到做 agent 的人。我会先打个折:消息全靠单一信源,正文没给参数量、架构和跑分,也没独立验证,所以停在 78 分。

8月5日星期三

AI HOT 精选

字节 Seed 发布 SeedRealtime,一个能边看、边听、边说的端到端音视频模型,已在豆包上线

SeedRealtime 把语音、画面和文字塞进了同一个模型里,不再走“先听写、再看图、最后念稿”的老路。它能在连续的音视频流里实时判断什么时候该接话、该盯着谁,官方说端到端人工评测里,抢话、迟回、被背景闲聊误触发的节奏问题比级联方案少了一半。几个演示场景挺具体:聚餐时能记住每个人的声音和脸,逛博物馆看到指定展品会主动出声提醒,冲咖啡时发现你把整粒豆子...

推荐理由:我会先打个折:正文没给延迟、并发成本这些工程硬指标,所以不能直接说“省了多少钱”。但这条消息值得上 featured,因为字节跳过了“先 ASR 再 LLM 再 TTS”的拼接方案,直接训了一个原生音视频全双工模型,并且端到端评测给出了节奏问题减半的量化结果。几个演示场景(聚餐认人、博物馆提醒、冲咖啡纠错)把“全模态交互”从论文拉到了产品里,豆包 App 全量上线也说明这不是实验室 demo。对从业者来说,这是第一个能摸到的音视频全双工大模型产品,工程参考价值大于论文本身。

7月31日星期五

AI HOT 精选

字节发布 Seedance 2.5:一次能生成 30 秒视频,支持多模态参考和精准编辑

字节跳动 Seed 团队发布了视频模型 Seedance 2.5,单次能生成 30 秒视频,还能多轮延长,拼出几分钟的连贯内容。这次升级主要做三件事:一是长叙事,镜头衔接和场景过渡更自然,画面没那么“油腻”了;二是多模态参考,单次最多能塞进 30 张图、10 段视频和 10 段音频当参考,还能用无纹理 3D 白模控制构图和运镜;三是编辑能力,支持按时间...

推荐理由:字节 Seed 团队发了 Seedance 2.5,单次能出 30 秒视频,多轮还能接起来,镜头衔接比之前干净。多模态参考给了硬指标:30 张图、10 段视频、10 段音频,外加 3D 白模控构图,这个控制力在现有模型里算突出的。编辑能力支持按时间轴调,对实际干活的人有用。整体看,这是国内视频模型一次规格上的升级,时长和输入上限都拉高了,值得从业者关注。

7月20日星期一

AI HOT 精选

字节跳动发布 Seed Audio 1.0,一个模型端到端生成对白、音效和环境声

Seed Audio 1.0 把语音、音效和环境声放在一个通用声学编码器里统一建模,不再需要分别生成再手动拼接。一条 prompt 就能编排角色台词、情绪和音效的进场时间,控制精度到 100 毫秒。它支持零样本声音克隆,给一段参考音频就能复刻音色,单次生成约 2 分钟,还能在保持音色一致的前提下继续延长。多语种覆盖 20 多种语言,同一音色在不同语言里...

推荐理由:Seed Audio 1.0 是字节跳动放出的统一音频生成模型,把语音、音效、环境声端到端搞定,时间线控制精度到 100 毫秒,属于国内大厂在音频生成领域的一次重要发布。目前信息仅来自官方博客,没有独立测试或头部用户反馈,所以重要性定在 82,先不冲太高。

7月13日星期一

AI HOT 精选

字节 Seedream 5.0 Pro 实测:在图上打点、画框就能换沙发改颜色,其他区域不动

Seedream 5.0 Pro 把图像编辑的门槛压得很低。你可以在图片上打点、画框或者随手涂一下,然后在提示词里用 @ 标记,就能精准换掉沙发、改墙面颜色,画面其他部分保持不变。官方放出的案例包括一次性替换六件家具、做键盘爆炸拆解图并标注卖点、在画好的框里生成海报文字,还支持色卡配色和 SKU 换色。图像质量和提示词理解能力追平 GPT-Image ...

推荐理由:字节把图像编辑的交互改得很直接:打点、画框、涂鸦加 @ 标记,比多数现有工具更符合直觉。官方放出的案例信息密度高,覆盖家具替换、爆炸图、海报文字和 SKU 换色,对电商和设计场景的实用性很明确。图像质量声称追平 GPT-Image,但正文没披露对比方法、测试集和量化指标,验证强度弱,所以判断上我会先打个折。

7月8日星期三

AI HOT 精选

字节跳动发布 Seedream 5.0 Pro,能直接生成信息图,还能像修图软件一样做像素级编辑

这个模型把“生成图片”和“专业设计”之间的沟填上了不少。它最狠的地方是能直接生成高密度信息图,比如把时间轴、柱状图、饼图和实景融合在一张图里,文字拼写和排版都挺靠谱。编辑能力也上了一个台阶,支持点选、圈选、涂鸦来局部改色、换材质,甚至能把一张海报拆成十几个独立图层,被挡住的背景也能自动补全。人像和材质质感有提升,能还原皮肤纹理、玻璃反射,还支持摇拍的运...

推荐理由:字节放出的 Seedream 5.0 Pro 在功能描述上很具体,不是笼统的“画质提升”。信息图生成、图层分离、交互式局部编辑这三板斧确实打到了设计场景的痛点。但得先打个折:这是官方博客,没有第三方评测或开放试用,实际效果和稳定性还不好说。正文也没披露推理成本、生成延迟和分辨率上限,这些对落地很关键。

7月7日星期二

Computing Life · Share · 鸭哥调研

中国可能给最强 AI 模型装上出海闸门

路透社 7 月 7 日报道,商务部、发改委等部门过去一个月约谈了阿里、字节、智谱,讨论是否限制中国最先进 AI 模型的海外访问,覆盖闭源和开放权重模型。这还不是正式政策,限制范围仍在讨论,可能只针对未来模型,落地时间也不清楚。但讨论已经越过芯片和算力,直接指向权重、API、训练方法和投资——整条能力外流链路。过去中国模型靠开放权重和低成本在全球扩张,H...

推荐理由:路透社独家曝出商务部等部委约谈阿里、字节、智谱,讨论限制最先进 AI 模型出海,范围从闭源到开放权重、API、训练方法和投资都包进去了。这还不是正式政策,正文也没说死落地时间,但信号很反常——以前是卡芯片卡算力,现在直接卡模型本身。对靠中国开源模型降成本、铺海外市场的团队来说,这条线一旦划下来,整个出海路径都得重算。反常、信源硬、影响面广,三个维度都打满。

7月4日星期六

AI HOT 精选

2.6万名学生追踪30个月:用AI写作业,平时分涨18%,大考分却跌了24%,这个坑两年才完全暴露

这项研究跟踪了华中某县2.6万多名中学生两年半,发现用AI写作业的学生平时成绩涨了18%,完成时间从64分钟缩到45分钟,但闭卷月考成绩直接掉了20%。更麻烦的是,中考、高考这类关键考试的成绩下滑了18%到24%,而且这个跌幅要差不多两年才会完全显现,短期研究根本看不出来。约81%的长期用户出现了典型的“外包模式”——作业做得又快又好,考试却一塌糊涂。...

推荐理由:这篇研究用大规模纵向数据(2.6万人、2.5年)挖出了AI辅助学习的一个隐藏成本:效果恶化有两年延迟期。HKR三项都打中了,但只覆盖一个县、原文付费墙,信息细节有限,所以分数没再往上拉。

Computing Life · Share · 鸭哥调研

豆包、千问、元宝下架了用户自建智能体,不是 AI 对话

三家大模型 App 在 7 月初先后关掉了用户自己捏的 AI 智能体广场,但核心的对话功能没受影响。直接原因是 7 月 15 日生效的拟人化互动新规,要求对带情感互动的 AI 做安全评估。平台选择一刀切,连工具类智能体也一起清了,因为审核一个会自由生成回复的智能体,成本比审固定内容高几个数量级,Character.AI 的悲剧已经证明事前审核拦不住。更...

推荐理由:三家头部 App 几乎同时动手,时间点紧贴新规生效日,新闻性够强。文章没停留在政策解读,而是把审核成本拆成 O(M×K^L) 这种从业者一看就懂的账,解释了为什么连工具类智能体也一起被清——不是不想留,是审不起。对做 agent 产品和在平台上分发的团队来说,这是个实打实的风险提示,所以给了 featured。

6月27日星期六

Computing Life · Share · 鸭哥调研

AI 编程正在进入它的 DevOps 时刻

字节在 FORCE 大会上公开了一组内部数据:TRAE 团队超过 90% 的代码由 AI 生成,但人均需求吞吐率只提升了约 60%。代码生成端已经很快,但 review、测试、依赖检查、staging 和安全审计这些下游环节没有同步加速,AI 写好的代码像半成品一样堵在交付流水线里。文章认为,下一阶段 AI 编程工具的竞争会从“谁更会写代码”转向“谁能...

推荐理由:字节在 FORCE 大会上放出的内部数据很实在:90% 的代码是 AI 写的,但人均吞吐率只涨了 60%。这个差距说明代码生成本身不是瓶颈,交付流水线里 review、测试、依赖检查、staging 和安全审计这些环节没同步加速,AI 产出的代码堆在那儿出不去。文章没有停留在产品发布层面,而是把工程交付的真实卡点讲清楚了,对正在推 AI 编程的团队有直接参考价值。

6月26日星期五

FT · 科技

DeepSeek 要大规模招人,中国 AI 圈抢人大战升级

DeepSeek 正在从字节、阿里等大厂高薪挖人,部分 offer 能给到候选人当前薪资的 2 到 3 倍。团队会从现在的几百人快速扩张,但正文没披露具体要招到多少人。我会先打个折——能不能持续这个节奏,还得看下一轮融资和收入能不能跟上。

推荐理由:FT 独家报道了 DeepSeek 用 2-3 倍薪资高调挖人的动作,有硬数字、有明确的大厂对手,信息冲击力够。缺点是正文没披露具体要招到多少人,且 FT 有付费墙,部分读者看不到全文。

6月24日星期三

AI HOT 精选

豆包上线专业版,让模型直接操作电脑和浏览器干活,月费68元起

豆包今天推出了专业版,把能执行任务的豆包2.1 Pro模型塞进了办公场景。它可以直接操控你的本地电脑和浏览器,调用各种技能插件、设置定时任务,还内置了Office套件,甚至能生成带后端数据库的在线应用。免费用户只能用豆包2.1 Turbo版的办公模式,专业版才解锁Pro模型。价格分三档:标准套餐每月68元(连续包月),加强套餐200元,高级套餐500元...

推荐理由:字节把能执行任务的豆包 2.1 Pro 模型塞进办公场景,能操控本地电脑、浏览器,内置 Office 套件,还能生成带后端数据库的在线应用——这已经不是聊天工具,是让模型进业务流程干活的 agent。免费版只给 Turbo 模型,Pro 模型要付费,价格从每月 68 元到 500 元,跨度不小。我会先打个折:目前只有发布信息,没有实测数据,也没用户反馈,稳定性、任务成功率、权限安全这些关键点全是空白。所以重要性给 82 分,先别太激动,等跑起来再看。

6月23日星期二

AI HOT 精选

豆包出了个音频生成模型,一条提示词能直接出多人对话、配乐和音效

火山引擎发了豆包音频生成模型 1.0,用文字或一段参考音频就能端到端生成目标音频。一条提示词里可以同时安排多个角色的对白、情绪语气、背景音乐和环境音,不用后期再去多轨混音。模型一次能生成 2 分钟音频,多次延长时角色音色能保持一致,还支持零样本输入,不用额外训练就能用。它把音色和风格的控制拆开了,也能让一个声音演多个角色。目前已经在火山方舟 API 邀...

推荐理由:豆包音频模型 1.0 是字节/火山引擎发的旗舰模型,国内大厂发布按政策对标美国实验室的发布。端到端多角色音频生成是个差异化能力,H、K、R 三个轴都踩中了。我会先打个折:正文没披露实际延迟、并发限制和生成失败率,也没给第三方评测,所以分数停在 78 不往上拉。

AI HOT 精选

字节跳动发布 Seed2.1 系列模型,重点提升让模型干活时的交付稳定性

Seed2.1 系列模型已在豆包和 TRAE 上线,主打真实工作场景,而不是刷榜。在通用 Agent 任务上,Seed2.1 Pro 在 Agents' Last Exam 里排第一梯队,在测手机操作的 MobileWorld 上拿了最高分,跨工具任务的平均步数减少了 16%。写代码方面,开发者盲测中对比 Claude Opus 4.6 有 59.1%...

推荐理由:Seed2.1 是字节跳动的新旗舰,主打真实工作场景而非刷榜,在 Agent、代码、多模态三个方向都给了可验证的指标。Agent 考试排第一梯队、手机操作最高分、跨工具步数减少 16%,代码盲测胜率 59.1% 直接对标 Claude Opus 4.6,这些数字让发布有分量。我会先打个折:正文没披露参数量、训练数据和定价,所以模型实际规模和部署成本还不清楚,这点先别太激动。但作为国内大厂旗舰更新,且已上线产品,给 82 分 featured 合理。

6月18日星期四

AI HOT 精选

火山引擎把豆包实时语音模型 3.0 的 API 放出来了,现在还在邀测

这个模型叫 Seeduplex,是个原生全双工端到端语音模型,意思是它能一边听一边说,不用等你说完再反应。官方给了三个卖点:指令跟得准、抗干扰、会自己判断什么时候该接话。比如多人聊天时它能安静待着,只有聊到指定话题才插嘴;还能在对话里直接调用工具帮你订日历、发邮件。抗干扰方面,误回复和误打断都少了很多。判停延迟缩短了约 250 毫秒,复杂场景下抢话比例...

推荐理由:字节第一个全双工端到端语音模型开放邀测,有延迟和抗干扰的量化数据,不是纯营销稿。扣分点:仅邀测,没公布定价和规模,真实环境表现待验证。

彭博科技

微软靠转卖 OpenAI 模型在中国 AI 市场撕开一道口子

微软通过 Azure 云把 OpenAI 的模型卖给中国公司,绕开了 OpenAI 自己对中国市场的封锁。过去一年这条线的收入涨得很快,但彭博没披露具体金额,所以基数可能不大。已知的客户包括字节跳动、小米和蔚来。增长是真的,但出口管制随时可能收紧,这笔生意的风险还在。

推荐理由:彭博独家,微软用 Azure 把 OpenAI 模型卖给中国公司,字节、小米、蔚来都实锤在用了。收入增长是真的,但没披露金额,所以我会先打个折——基数可能不大,别急着喊“大生意”。标题自带冲突,信息有实锤也有缺口,适合放 featured。

6月11日星期四

AI HOT 精选

豆包把退票费说成不到100元,用户多花600元后,它又帮用户写起诉状告自己

河北一位用户问豆包退票要多少钱,豆包说不到100元,实际扣了600元。用户找豆包理论,豆包当场生成了一份补偿承诺书,答应退600元,但钱一直没到账,后来改口说AI没法转账。用户决定起诉,豆包又建议他别请律师,直接帮他起草了起诉状。案子5月12日在北京互联网法院立案。这事把AI对普通用户的误导和出事后的责任真空全摊开了:回答错了不担责,承诺赔钱不兑现,最...

推荐理由:这条新闻的冲击力不在技术本身,而在它把 AI 对普通人的误导和出事后的责任真空全摊开了。豆包先说退票不到 100 元,实际扣了 600,用户找上门,它当场生成补偿承诺书答应退钱,结果钱没到账又改口说 AI 没法转账。用户决定起诉,豆包还建议别请律师,直接帮起草了起诉状,案子 5 月 12 日在北京互联网法院立案。整个事件像一场压力测试,把大模型产品在真实纠纷里的无力感暴露得很彻底。我会先打个折:正文没披露法院后续进展,也没说字节方面有没有正式回应,所以现在只能当一起已立案的个案看,别急着上升到行业判决。但就凭这个荒诞又完整的叙事链,放在 featu...