Wan 3.0 公测:30 秒一镜到底,短剧工作流该怎么真正用上
你有一场重逢戏必须一口气落地:两个人走过走廊、停下,第二句台词必须在切镜前打中。昨天模型只给你 15 秒,然后开始漂移。今天规格表写的是 30。诱惑就是生成一条更长的片段,然后管这叫导演。
阿里巴巴通义的 Wan 3.0 于 2026 年 8 月 6 日进入公测。官方帖与云定价口径一致,就三个数字:单次最长 30 秒,支持 480p / 720p / 1080p,按输出秒计费 $0.05 / $0.10 / $0.20。公测上线时,阿里云再次确认了同一档价格。
这不是又一篇模型家族复盘。它只回答三个问题:30 秒上限真正买到的是什么;为什么计量单位是「每分钟故事的接缝数」而不是秒数;以及短剧管线该把这一镜长拍放在哪里。
目录
8 月 6 日上线了什么
公测于 2026 年 8 月 6 日开放。中文产品面列出了千问创作(c.qianwen.com)、通义万相与 Model Studio。独立报道里引用的 API 模型 id 为 wan3.0-video。阿里云自己的帖子列出了同一价格阶梯:480p $0.05/秒、720p $0.10/秒、1080p $0.20/秒。
用一句话说,模型在卖的是:一次连续 30 秒的生成,角色跳变与场景断裂比硬拼三条 10 秒片段更少。营销话术还会提全模态参考(文本、图像、音频、视频)以及「文档到成片」。把这些当成需要你自己账号验证的产品主张,而不是没有一级规格表就能引用的数字。
来自既有分镜指南的封面——分镜板仍然先于更长的一镜。来源:DramaSo。
微短剧在官方口径里是一个时长品类——广电总局于 2020 年 12 月把网络微短剧纳入备案体系。隐藏定义是钩子密度:你每分钟塞进多少个必须看下去的转折。30 秒的模型上限并不改这个定义。它只改变你在一个拍点内部被允许跳过多少刀。
实用规则: 把视频模型发布当成预算,而不是奖杯。30 秒是配额。把它花在切不了还活得下去的那个拍点上。
计量单位是接缝,不是秒数
行业文案把「更长片段 = 更好模型」当真。对短剧来说,这是错的计量单位。一集 60 秒、每 8–12 秒一个钩子的正片,有五到七道接缝。若模型最长一镜只有 15 秒,你就被迫在情绪最重的中段硬切一刀。若是 30 秒,你可以让那个拍点喘口气——而其他地方仍然该切。
把数字并排放:
- 竖屏短剧典型开场钩子长度:15–30 秒。
- 从业者反馈里,Wan 2.7 级连续片段在循环或漂移前大约 15 秒。
- Wan 3.0 单次上限:30 秒。
所以升级不是「电影感翻倍」,而是「最长的情绪拍点现在可以一镜到底」。把长镜留给重逢、揭露、一切就死的走谈。其余镜头维持 4–8 秒。整集仍然需要接缝;只是不再需要把接缝落在最糟的位置。
中文行业报道仍把国内微短剧市场规模放在约 678 亿元,海外 2026 年轨道约 200 亿元,见北京日报综述。Deloitte 的 TMT 预测给出 2026 年应用内微短剧收入约 78 亿美元。这些数字定市场体量。它们不告诉你 30 秒该放哪。分镜板才告诉你。
实用规则: 最长一镜规格的正确单位,是每分钟故事的接缝数,不是规格表上的秒数。
镜头级 vs 剧集级杠杆
时长是镜头级杠杆。参考容量——你能钉住同一张脸、同一套服装、同一间房的图有多少——是剧集级杠杆。连载死于跨集角色漂移,而不是死于一条略软的 8 秒片段。
Wan 3.0 的公开材料强调 30 秒一镜到底(镜头级)。全模态参考是剧集级主张,而且整条赛道仍共享同一道硬边界:一致性只发生在一次生成内部。没人有你能押 80 集片库的跨会话记忆。Kling 3.0 Omni 文档里的招数又不同:一次生成 6 个镜头,外加五语原生口型同步(截至 2026-02,见 Kling Omni 指南)。那是多镜头打包,不是更长的单镜。
管线不会塌成一次模型调用。来源:DramaSo。
如果你只升级时长、从不钉参考,第 7 集主角会对不上第 1 集。30 秒一镜会让这次失败更贵,因为你刚把 30 秒额度花在一张以后不会再出现的脸上。
实用规则: 把新秒数花在最重的拍点。把参考位花在必须活到第 12 集的那张脸上。
Wan 3.0 在短剧技术栈里的位置
别用一个模型名替换整条技术栈。路径仍是剧本 → 分镜 → 生成 → 本地化。新手应从如何制作短剧和 AI 原生版如何用 AI 制作短剧开始。
| 层级 | 职责 | Wan 3.0 的角色 | 它做不到的 |
|---|---|---|---|
| 剧本 | 钩子密度、台词时机 | 无 | 写出转折 |
| 分镜 | 决定哪个拍点拿到长镜 | 输入 | 决定情绪 |
| 生成 | 一次 30 秒,480/720/1080 | 在这里 | 下周还记得那张脸 |
| 本地化 | 按市场字幕、配音、重做标题 | 或许以后 | 选定市场 |
背景:品类仍是高钩子密度的竖屏短剧;更长的一镜替不了选题。来源:公开合辑,作品类参照,不是 Wan 3.0 演示。
成本清醒账:30 秒 1080p 按公示 $0.20/秒是 $6。720p 测 15 秒是 $1.50。先用便宜分辨率把分镜跑通。只在已经锁死的拍点上花 1080p。
五步一镜到底分配法
- 在分镜板上标出本集最重的情绪拍点(一个,不是三个)。
- 核对其时长。若是 18–28 秒且一切就死,它就是 Wan 3.0 候选。
- 生成前先钉住脸、服装、房间的参考静帧。
- 先用 720p 生成这一拍一次。结构站得住再跑 1080p。若漂移,把拍点劈成两半——模型没挣到这一镜长拍。
- 其他镜头一律保持短。把成片按独立的标题与封面测试做本地化,而不是事后翻译。 AI 短剧生成器 和 分镜生成器 坐在这两层;它们不是 Wan 的套壳。
市场规模是背景;分镜板才是决策。来源:DramaSo。
可证伪的判断
若到 2027 年 8 月,某款被广泛使用的视频模型能在生产规模下跨会话保持角色身份(而不只是一次 30 秒生成内部),那么「剧集级杠杆仍需要人类分镜板」这条主张作废。在此之前,Wan 3.0 只是给一个拍点更长的配额。
常见问题
Wan 3.0 是否对每个账号全面开放? 公测始于 2026 年 8 月 6 日。部分控制台仍设门槛(申请、并发上限)。用你自己的登录检查千问创作或 Model Studio;别默认开放注册。
30 秒是不是意味着整集一镜拍完? 不是。竖屏一集仍需要钩子接缝。把 30 秒花在切不了还活得下去的那个拍点上。
和 Seedance 或 Kling Omni 怎么比? 杠杆不同。Wan 3.0 的头条是一镜时长。Kling Omni 文档里的杠杆是多镜头打包。Seedance 类工具往往分镜优先。比杠杆,别比品牌。
我想试工作流而不是模型名,去哪? 先分镜,再生成。若想在一处完成剧本到分镜到片段,从 DramaSo 开始。
更长的一镜是预算。能做出可连载成片的人,会把这笔预算花在切不了的那一个拍点上——而且他们仍会在按下生成之前先画分镜板。