社区 发现 AI Seedance 2.5上线了,这个编导...
Seedance 2.5上线了,这个编导Skill帮你一键精准出片!
新人初来乍到,先介绍下自己:我是一名 AI + 商业深度实践者,也正在用 AI 重塑跨境电商全链路的一线卖家 | 前鹅厂行业负责人
前段时间Seedance 2.5 终于上线了,我们跨境AI实战圈有圈友又喜又悲:SD的视频效果虽然好,但就是太贵了啊!!
SD 2.5能够生成 30 秒长叙事视频,并在复杂素材组合、镜头衔接和音画同步中保持稳定的表现,但前提就是:你输入的脚本提示词必须得过关。
不然接近1.5~2块钱/秒的成本,你多抽两次卡,单条视频的成本能飙到两三百块钱。
所以我基于SD 2.5的模型特点和官方文档,做了一个视频脚本生成Skill:
seedance-video-script
你只要输入视频目标和素材,Agent就能直接帮你生成一套带时间戳分镜 / @引用 / 白模 / 原生音频的完整脚本prompt,甚至帮你把素材准备清单、上传顺序都排列好,帮你一键精准出片,告别抽卡。
https://github.com/buluslan/seedance-video-script
觉得好用的话,麻烦进github页面右上角点个 Star,后面会持续维护,感谢各位老板。
一条带货视频的脚本,是怎么生成的
我先随手找了一个宠物自动猫砂盆的ASIN,然后调用seedance-video-script这个Skill
Agent先调用我之前安装的卖家精灵MCP去获取这个产品的核心信息,然后跟我沟通创作方向:
这个带货视频主要发在哪、用什么画幅?(决定整个构图)要不要口播、用什么语言?(决定音频这整块怎么写)视频时长偏好?想要什么视觉调性?(决定运镜和场景设定)
我的回复是:TikTok/Reels 竖屏 9:16,AI 英文口播,15秒视频,温馨居家实拍感,然后Agent就马上给我输出了完整的创作方向、素材清单和排序。
然后看看详细的脚本分镜prompt是怎么出来的。
(1)开头先定义场景类型和平台,然后给每个要用到的素材做好了引用分配,以及视频整体的环境和氛围构建。
将@图片1中圆润白色机身、顶部带控制面板的椭圆自动猫砂盆定义为产品主体;
将@图片3中那只猫定义为猫咪主角;
场景为@图片4的温馨居家客厅角落,午后暖阳透过窗户洒在木地板上,绿植点缀。超写实商业广告质感,色彩自然温暖,光影柔和。
(2)接着输出详细的分镜内容,每一段都会包含时间戳、主体、运镜、动作、环境和台词。
0-3 秒:镜头低角度跟随,猫咪主角轻巧跳进产品主体内部,落地无声,扬起细碎猫砂。用英文女声亲切自然地说{Say goodbye to scooping… forever.}<猫咪轻柔的咕噜声>
3-6 秒:镜头固定中景,猫咪主角跳出离开,产品主体的滚筒缓缓自动旋转,分离干净猫砂与结团废物,废物落入下方垃圾桶,运转安静平稳。用英文女声说{It cleans itself two minutes after your cat leaves.}<滚筒轻柔运转的机械声>
6-9 秒:镜头缓慢推近至近景,产品主体顶部面板亮起柔和指示灯,一只手举起手机,屏幕显示猫咪健康数据图表。用英文女声说{Zero odor. Track your cat's health right from your phone.}<手机清脆提示音>
9-12 秒:镜头环绕产品主体半圈,第二只猫好奇走近,机器立即感应暂停不动,猫咪嗅探后离开。用英文女声说{Dual safety sensors protect every cat.}<红外感应轻柔提示音>
12-15 秒:镜头缓慢后拉至全景,温馨客厅里产品主体安静伫立,猫咪主角慵懒趴在旁边梳理毛发,画面定格。用英文女声温暖收尾{Ellenpent. Love your cats, not the litter.}(轻快温馨的钢琴 BGM 渐强收尾)(3)最后再针对画质、风格和视频约束做收拢,并进行脚本内容的质检,避免出现镜头冲突、篇幅失衡、风格漂移等负面情况。
画质:超写实,电影质感,细节丰富,4K,肤质与毛发质感细腻,光影柔和自然
风格:超写实温馨居家商业广告,暖色调,日系清新光线
约束:保持无字幕,避免生成任何文字或字幕,不要生成 Logo,不要生成水印,保持画幅 9:16 竖屏,人物不出镜或仅露手部
✅ 避坑自检(已逐项过)主体 ID 漂移:猫用单视图单图,产品用单图锚定,无多视图 ✓参考数合理:4 图 + 1 音频,在即梦 9 图限内,未堆砌 ✓时间戳合理:15 秒分 5 段,每段 3 秒,未在单段塞过多场景 ✓运镜不冲突:跟随→固定→慢推→环绕→后拉,一镜一种 ✓台词语种标注:英文口播,每句标「用英文女声说」✓风格明确防漂移:超写实 + 暖色调,避免漂移成动漫 ✓无字幕/无 Logo 约束:已加(带货字幕建议后期剪映加,可控)✓
从我扔进去一句模糊的需求,到拿到这么一份能直接粘走的专家级视频生成方案,整个过程只需要2分钟。
skill 怎么帮你写出对的脚本
整个任务流程我拆成了五步。
第一步,摸清你到底想要什么。
是生成新视频、改已有的、还是延长。视频场景是广告、TVC、短剧、电商、数字人还是科普,时长和画面比例多少,是发布在TK、Reels还是亚马逊。先把你的需求确认清楚。
第二步,盘素材,分配引用。
上传的每张图、每段视频和音频,都要标清楚用途,比如锁定人物、定调场景、参考运镜,还是给节奏音色。
另外,虽然SD 2.5最多支持 50 个参考,但不建议真放这么多,你堆的参考内容越多,视频生成一致性越低,精选四五个核心参考物就够了。
第三步,按时间戳写分镜内容。
这里不再是"镜头一、镜头二"那种传统写法,而是按时间段来组织镜头内容,并在每段写清楚主体、动作、运镜、音频、台词。
第四步,设计音频和约束。
SD 2.5 的音频跟视频可以一起原生生成,还能用音频来驱动镜头节奏和口型,能支持十几种语言,这次是真正能做到一键成片了。
第五步,避坑自检。
这里重点会检测几个东西,一是尽量避免视频里面直接加字幕,这样后面要做二次剪辑不方便;二是审查单个分镜下的运镜是否冲突,三是在时间戳里是否塞太多场景。
上面这五个步骤,实际上是Skill在模拟一个真实的商业视频编导专家,把SD的使用规范、运镜逻辑和踩坑经验,替你写进每一条分镜里。
如果觉得用Skill太复杂了,我也准备了一份极简版提示词,帮助你30s快速生成一份高质量的视频脚本,需要的朋友可以自取
# Seedance 2.5 通用提示词(免 skill 版)
> **这是什么**:把 `seedance-video-script` skill(v0.2.0)的核心知识底座,浓缩成一段自包含提示词。不装 skill 的朋友,复制粘贴到任意 AI(豆包 / ChatGPT / Kimi / 即梦对话框等)即可生成可用的 Seedance 2.5 分镜 prompt。
>
> **来源**:基于 buluslan 开源 skill `seedance-video-script`(github.com/buluslan/seedance-video-script)提炼。
>
> **覆盖度**:这段 ≈ skill 80% 能力(时间戳分段 / @引用 / 白模 / 音频符号 / 分镜公式 / 避坑)。进阶 20%(50 参考扩容策略、绿幕·区域·运镜编辑、三大任务模式细节)普通创作用不上,需要精细控制时装 skill。
## 怎么用(3 步)
1. 复制下面「主提示词」代码块整段
2. 粘贴到任意 AI 对话框,发送
3. AI 会反问你的视频需求,回答后它直接产出可粘到即梦 / 火山方舟的 prompt
---
## ? 主提示词(一键复制)
```
# 角色
你是 Seedance 2.5(字节跳动视频生成模型,即梦 Dreamina / 火山方舟在用)的视频分镜提示词专家。任务:把我的视频需求 + 素材,转成可直接粘到即梦或火山方舟的 Seedance 2.5 分镜 prompt。
# 工作流程
1. 先确认我的:①视频类型(产品广告/短剧/电商展示/数字人/科普/卡点剪辑…)②时长(单段≤30秒)③画面比例(抖音→9:16,B站/YouTube→16:9)④素材清单(几张图/几段视频/音频,分别是什么)⑤有无口播台词 ⑥想要的视觉风格。信息不全先问我,别瞎编。
2. 给每个素材分配 @引用 + 注明用途。
3. 用时间戳分段写分镜。
4. 设计音频 + 约束。
5. 过一遍避坑清单。
最后输出两块:【素材上传顺序】+【Seedance 2.5 Prompt】。
# Seedance 2.5 五大核心语法(必须遵守)
## ① 时间戳分段(2.5 核心新语法)
用「0-5秒:…;6-10秒:…」组织,不要再用"镜头1/镜头2/镜头3"。每段写四件套:
主体 + 动作细节 + 运镜(每段只一种运镜) + 音频信息
示例:
0-5秒:镜头缓慢推近,@图片1的产品置于白色台面,光线由冷转暖;<环境白噪声>
6-12秒:镜头环绕产品中景,细节逐一显现;(轻柔钢琴BGM铺底)
## ② @引用(给每个素材标用途)
@图片N / @视频N / @音频N,必须注明用途,例如:
「参考 @图片1 的人物形象」「场景参考 @图片2」「参考 @视频1 的运镜效果」「背景BGM参考 @音频1」
多素材组合:@图片1的人物作主体,参考@视频1的运镜,场景参考@图片2,BGM参考@音频1
⚠️ 精选 4-5 个核心素材即可,别堆满(参考太多模型反而困惑);重要素材放 prompt 越靠前越好。
## ③ 白模 @白模N(2.5 新,锁空间/运镜/轨迹)
需要复杂运镜或空间结构时,用 3D 白模锁定机位/轨迹/构图:
「参考 @白模1 的运镜、构图、景别」(白模管空间运镜,图片管外观材质色彩)
## ④ 音频符号(2.5 原生音频,视频自带声音)
用符号区分信息类型:
台词 {} 例:{你好世界}
音效 <> 例:<远处传来狗叫声>
音乐 () 例:(背景中播放快节奏摇滚乐)
字幕 【】 例:【第一章 启程】
小语种台词标语种:用日语说道{こんにちは}
音色参考要补特征描述:使用@音频1低厚温润带细碎颗粒感的中年男声
## ⑤ 分镜骨架(每段四件套怎么写)
- 动作:优先"低缓连续小动作"(缓慢抬手/微微低头/顺势转身),避开狂奔大跳剧烈翻滚;情绪具象外化(悲伤=低头、肩膀微颤、眼眶泛红,别只写"很悲伤")。
- 运镜:一镜一种,别同时推拉摇移;想要"电影感"要指明具体镜头+运动(如"宽幅航拍缓慢后拉"),只写"电影感"无效。
- 长场景(20秒+)用弧线节奏:开头铺垫 → 中段推进 → 结尾定格。
# 避坑自检(生成完逐项过)
- 人物换脸/ID漂移? → 用大头照+全身照,不用三视图,重要素材前置
- 参考人物>4人? → 分组生成(每组≤4人)再合
- 字幕/Logo乱入? → 加约束:保持无字幕、避免生成任何文字、不要Logo、不要水印
- 想要动漫却变真人? → 必须加明确风格词:「2D日漫风格」「3D国风漫画」「赛博朋克冷蓝紫调」
- 4-5秒内塞太多场景? → 拆段,保证物理可行
- 中文台词发音不准? → 多音字/生僻字用同音字替换
# 输出格式(严格按此结构)
【素材上传顺序】(标注每个用途,按优先级排)
1. @图片1 — 人物形象(主角)
2. @图片2 — 场景参考
3. @视频1 — 运镜参考
4. @音频1 — BGM
…
【Seedance 2.5 Prompt】
[平台:即梦/方舟] [时长:N秒] [比例:16:9] [风格:超写实/2D日漫/…]
0-5秒:…
6-12秒:…
…
[台词{} / 音效<> / 音乐() / 字幕【】]
[画质:高清,电影质感] [约束:保持无字幕、不要Logo水印]
现在请先问我:你要做什么视频?
```
---
写在最后
从上面的分镜脚本可以看到,Skill生成的内容并没有很复杂。
只是把“谁,在什么样的场景下,做什么事情,出现了什么结果”这个事情说清楚了而已,没有盲目往里堆华丽辞藻。
2026年的今天,无论是Image2还是Seedance,这些视觉模型的背后都是一个具备强大推理能力的Agent,聪明的就像一个会思考的,活生生的专家。
这时候,我们脚本、指令写多了不一定是好事,就像外行指导内行,最后的效果可能适得其反。
如果不是科班的设计师或者编导,我建议我们给的提示词一定要“从简”,只需要强调好规范和边界,剩下的就交给模型来发挥。
生活也是这样,真正有用的东西往往大道至简,我们需要做的就是删繁就简,返璞归真。
———
如果这篇文章对你有启发,不妨点个赞,或者分享给身边的朋友,想要第一时间阅读文章,可以给账号点个收藏?












倒计时:
0 个回复