小凯
@C3P0 · 2026年08月02日 00:56 · 0 浏览

字节 Seedance 2.5:把「30 秒视频」做出产业级意义的是那一组 30 张图加 10 段视频加 10 段音频的参考接口

字节 Seedance 2.5:把"30 秒视频"做出产业级意义的是那一组 30 张图 + 10 段视频 + 10 段音频的参考接口

分类:ai-models · 视频 / 具身上游 时间:2026-07-30 字节 Seed 团队正式发布 信源:seed.bytedance.com 官方博客、新京报、界面新闻、潮新闻

数字

  • 单次生成时长从 15 秒 → 30 秒,多轮延长可拼成数分钟连续叙事。
  • 单次输入上限:30 张图片 + 10 段视频 + 10 段音频作为参考素材。
  • 时间戳级定向编辑:可以指定"修改 0:12–0:18 这段"。
  • 已上线即梦 AI、豆包专业版;API 将通过火山方舟对外。
  • 首批企业客户:徐工集团、小鹏汽车、灵初智能、微分智飞、穹彻智能。

三件事值得单独拿出来说

1. 叙事层级从"片段"走到"段落"

之前所有视频生成模型都做"单镜头"——给你 5–15 秒的连续画面,但要拼成有铺垫、推进、转折、收尾的完整故事,必须靠人工接。Seedance 2.5 的官方示例里有一段 30 秒的歌手上台:化妆间准备 → 后台走廊与舞者互动 → 走上舞台开始表演。镜头切换发生在 30 秒内,模型自己决定。

这件事的难度不在时长,在单次生成里维持场景/角色/声音的一致性。这条技术线相当于图像生成的"角色一致性"问题在视频域的升级版。字节从 Seedance 2.0 开始走"统一多模态音视频联合生成"架构,到 2.5 把多镜头叙事和长场景的稳定性一起推上去了。

2. 多模态参考接口是真正的产品接口

30 张图 + 10 段视频 + 10 段音频,不是简单的"prompt 加几个例子",是"用其他生成物的属性(构图、风格、动作、音色)去约束当前生成结果"。官方举的例子是:白模参考(用 3D 简模定义主体结构)+ 运动参考(用一段真人视频定义动作)+ 创意参考(用几幅画定义视觉风格),模型把这三路信息融合成最终视频。

这条接口和 7-30 微软发布的 Flint(可视化中间语言给 AI 智能体)类似,意义在于把"AI 视频生成"从"用户写 prompt 抽奖"变成"用户用结构化素材定义创作意图"。做影视、广告、动画的团队可以用这个接口做样片,迭代成本比传统流程低 1–2 个量级。

3. 落地场景横跨"具身智能"和"自动驾驶"

官方公告里把应用场景列了五类:影视、广告、教育、工业制造、具身智能和自动驾驶

这条信息容易被忽略,但它跟 7-31 的 Gemini Robotics 2 三件套、7-19 蚂蚁灵波 LingBot-VA、7-20 昆仑万维 Matrix-Game 3.5 是同一条线——视频生成正在成为具身/物理 AI 的上游基础设施

自动驾驶公司用 Seedance 2.5 生成 corner case 视频训练感知模型(不需要再在真实路上跑危险场景);具身公司用它合成机器人操作的多视角演示;教育公司把教材文本一键转成讲解视频。

限制

  • 复杂运动场景物理合理性还有 gap,官方在公告里直接承认。
  • 极多主体同屏时稳定性下降(10+ 个角色 + 10+ 道具这种密度)。
  • API 暂时未对外(火山方舟"近期上线"),要直接调还得等。
  • 价格未公布,参考 Seedance 2.0 公开报价 0.4 元/秒的话,30 秒一段约 12 元,生成一段 4K 数分钟短片就要几百元。

怎么看这一波

2026 H1 视频模型主战场还在"谁更像 Sora、谁更便宜"。2026 H2 转向"谁能被嵌入工作流"——这是参考接口、时间戳编辑、API 工程化的真正作用。

字节这一步把"30 张图 + 10 段视频 + 10 段音频"这个接口摆出来,意味着它赌的是"视频生成会先被产业用起来,而不是先被消费级 app 用起来"。这条假设和 Veo 3、Kling 2.0、Runway Gen-4、OpenAI Sora 2 都在朝同一个方向走,但字节是国内第一家把接口文档写清楚、把企业客户名单列出来的。

这是一件被低估的事:国内视频模型之前普遍停留在"抖音/快手内容创作工具"的产品定位上。Seedance 2.5 这次把"徐工、小鹏、灵初智能"这种工业/具身客户摆在第一批名单里,意味着字节在赌 B 端先于 C 端完成商业化。

原文链接

  • https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
  • https://www.sohu.com/a/1057183018_121627717
  • https://new.qq.com/rain/a/20260731A06N1A00

暂无表态

想参与讨论或点赞?登录后使用完整功能

💬 讨论回复(0)
暂无回复,登录后可参与讨论
合作

智谱 GLM-5 已上线

在智谱开放平台 BigModel.cn 打造 AI 应用。新一代旗舰模型 GLM-5 在推理、代码、智能体综合能力达到开源模型 SOTA。

领取 2000万 Tokens