首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >被 AI 视频逼疯?Seedance 2.0 救场:一次生成可用片,成本直降 80%!

被 AI 视频逼疯?Seedance 2.0 救场:一次生成可用片,成本直降 80%!

作者头像
翻身AI挖掘机
发布2026-06-22 15:35:11
发布2026-06-22 15:35:11
5190
举报

吴永辉接管字节跳动 Seed 团队的第十三个月,Seedance 2.0 的上线,把 AI 视频生成从 “像素堆料” 的竞赛,拉回了 “创作控制权” 的命题里。在过去的一年里,他带着一百多位核心研究员,把模型的可用率从 20% 拉到 90% 以上,也把 AI 视频的创作逻辑,从 “试错式生成” 变成了 “确定性创作”。

2024 年,AI 视频还在解决 “能不能生成” 的问题,2025 年,行业陷入了 “分辨率竞赛”,从 720p 到 4K,大家都在比拼谁的像素更细腻,谁的画面更逼真,却忽略了创作者真正的需求 —— 能不能用 AI 快速完成一个连贯的故事,能不能让 AI 听懂镜头语言,能不能不用反复试错就能得到可用的成片。

Seedance 2.0 的核心,是双分支扩散变换器架构。传统的视频模型,只会处理视觉空间和时间维度的令牌,音频只是后期添加的 “附属品”,所以经常出现口型和声音对不上,环境音和场景不匹配的问题。而双分支架构,把视觉和听觉信号放在同一个训练框架里,让模型从一开始就理解 “画面和声音是一体的”,所以生成的视频,人物的口型会跟着对白变化,雨天的场景会有雨滴的声音,奔跑的镜头会有脚步声和风声。

同时,模型支持最多 12 个参考素材,包括图片、视频片段和音频,创作者可以用一张照片锁定人物的外貌,用一段视频锁定运镜风格,用一段音频锁定背景音乐的质感,让 AI 生成的内容完全符合自己的预期。这种 “锚定” 能力,解决了过去 AI 视频生成中 “人物脸崩”“风格跳脱” 的痛点,让创作者终于可以把 AI 当成一个 “听话的助理”,而不是一个 “随机的画家”。

一组来自字节跳动内部的测试数据,清晰展示了 Seedance 2.0 的效率提升:

过去生成 15 秒的可用视频,需要尝试 5 次以上,真实成本接近一万元,而 Seedance 2.0 只需要一次生成,就能得到可用的成片,成本直接降到两千多元,降幅达到 80%。在漫剧创作的测试里,用 Seedance 2.0 制作一集 10 分钟的漫剧,只需要 3 天时间,而过去用传统的 AI 工具,需要 15 天以上,效率提升了 5 倍。

这让我想起了那个小众的 AI 短片《I’m not a robot》,里面用复制粘贴的人群画面,对抗技术对人的标准化定义。在过去的 AI 视频创作里,创作者就像短片里的人,被技术的随机性束缚,只能在 AI 生成的结果里 “挑挑拣拣”,而不是 “指挥 AI 完成自己的想法”。Seedance 2.0 的出现,就像是把指挥棒交还给了创作者,让创作者可以专注于故事,而不是纠结于 “为什么 AI 生成的人物突然换了脸”,“为什么声音和画面对不上”。

就像《别让我走》里探讨的 “被造物的控制权” 问题,在 AI 创作的语境里,创作者应该是那个 “设定规则的人”,而不是被 AI 的随机性牵着走的人。Seedance 2.0 的多镜头叙事能力,让创作者可以用一段提示词,就生成从开场到高潮的完整叙事序列,角色、道具与视觉逻辑在多个镜头中保持一致,无需人工干预剪辑,这正是把创作的控制权交还给了创作者。

AI 视频的未来,从来不是替代创作者,而是让更多的人拥有创作的能力。Seedance 2.0 的出现,是一个信号,行业终于从 “技术炫技” 转向了 “创作者需求”。未来的 AI 视频工具,会越来越像一个 “专业的助理”,听懂创作者的每一个想法,完成每一个镜头的要求,让创意的落地变得更简单,而不是让创作者变成技术的奴隶。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-02-09,如有侵权请联系 cloudcommunity@tencent.com 删除
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档