最近几个项目里,我高强度使用了一段时间 Seedance,也认真测试了不少网上流传的“万能提示词”。

这些提示词通常写得很华丽:有镜头运动曲线、时间戳、情绪关键词、摄影术语,甚至还有完整的分镜故事板。可实际用下来,真正能稳定提升成片质量的内容并不多,反而花掉了大量整理和测试时间。

这段经历最后只证明了一件事:Seedance 的理解能力很强,也确实不挑提示词,但这不等于提示词越复杂越好。

写好一段 Seedance 视频提示词,其实只需要认真交代四件事:主体、场景、声音和镜头。

核心结论:提示词只需要四个部分

1. 主体

主体就是镜头中反复出现的人物或角色。

建议先使用 image2 等图像工具生成一张简单、清晰的角色设定图,再在即梦中将角色创建为可复用主体。后续写提示词时直接通过 @主体名称 引用,不需要每次重新描述发型、服装、材质和五官。

这一步的价值不只是节省文字,更重要的是提高跨镜头的一致性。角色一旦建立好,后面制作同一系列或同一场戏时,复用效率会非常高。

2. 场景

准备一张能清楚表达环境关系的场景参考图即可。

场景图中可以直接带上主角,让模型提前理解人物与环境之间的尺寸关系。例如微观世界、巨型道具或特殊建筑空间,如果只有场景而没有人物参照,很容易出现角色比例失调。

上传过场景参考后,文字中只需要补充当前镜头发生的变化,不必再次把整张图从头描述一遍。

3. 声音

为了方便后期剪辑和配乐,建议明确写出:

不要生成任何 BGM,只生成与画面对应的环境音和动作音效。

这一点非常重要。模型生成的背景音乐未必符合最终节奏,还会给后期配乐、转场和混音带来麻烦。保留脚步声、碰撞声、风声、机械声等画面音效,通常更容易进入正式剪辑流程。

4. 镜头

每个 Shot 只需要说明两件事:镜头怎么看,以及镜头里发生了什么。

推荐使用下面这种结构:

1
2
Shot 01:景别与机位。角色动作、环境变化和关键道具。
Shot 02:景别与机位。角色动作、环境变化和关键道具。

景别可以写远景、全景、中景、近景或特写;机位可以写低机位、俯拍、跟拍、固定镜头等。把动作关系写清楚,比堆叠“电影感”“史诗感”“极致氛围”更有用。

抽卡建议:2~3 秒一个 Shot

Seedance 仍然需要抽卡,但抽卡也可以有更高效的方法。

我更推荐让每个 Shot 保持在 2~3 秒左右。一次生成 15 秒视频,通常可以容纳至少 5 个连贯镜头。如果同一段内容抽卡 3 次,就能得到大约 15 个候选镜头。

对于一场短戏来说,这些素材通常已经足够完成筛选和剪辑。相比为了一个长镜头反复重抽,短 Shot 更容易控制动作,也更方便后期重新组合节奏。

五个常见误区

误区一:必须上传华丽的分镜故事板

我曾经使用过不少网上流传的工作流,花十几分钟生成带有镜头曲线、表格、箭头和高亮说明的故事板,再把整张图上传给 Seedance。

结果往往是信息越多,生成的视频越容易漏掉关键动作,甚至错误理解画面关系。有一次忘记上传故事板,只提交主体、场景和简洁的 Shot 描述,结果反而更加连贯。

分镜故事板可以帮助创作者思考,但它不一定适合作为模型输入。用它规划故事可以,用它代替清晰的文字指令则未必有效。

误区二:Prompt 越长越专业

AI 生成的长提示词里,常常包含大量比喻、情绪渲染和重复描述。它们看起来很完整,却未必能改变画面。

已经上传主体和场景参考后,就不需要再用几百字重复角色外貌和空间细节。认真交代谁在什么地方做什么,以及镜头从哪里看,就已经覆盖了最重要的信息。

一个很简单的判断标准是:如果连自己都不愿意把提示词完整读一遍,通常说明里面有太多内容并不影响故事。

误区三:每个 Shot 都要写时间戳

时间戳很多时候更像一种心理安慰。至少从实际体验看,模型并不会始终严格按照 0~3 秒3~6 秒 的标记分配镜头时长。

真正明显影响节奏的,往往是 Shot 的数量和每个 Shot 中包含的动作复杂度。与其反复调整时间戳,不如减少一个镜头里的事件数量,让每段动作更明确。

误区四:清晰度越高,提示词响应越好

目前实际体验中,Seedance 的 720p 版本对提示词的响应更稳定,而且生成速度更快、成本更低。

最开始我们也想一步到位,每次都选择 1080p,但结果并不理想,一度以为是参考图或提示词存在问题。切回 720p 后,动作和镜头执行反而明显改善。

因此,在创意探索和抽卡阶段,没有必要盲目追求最高分辨率。先获得正确的镜头,再解决清晰度,通常更划算。

误区五:生成阶段就必须得到最终清晰度

确认最终镜头后,可以再使用 Topaz 等视频增强工具放大到 4K。

这样能把生成阶段和交付阶段拆开:前期用 720p 快速测试动作、构图和节奏,定稿后再统一做放大和增强。成本更可控,也不会因为单次高清生成失败而浪费大量时间。

一套更高效的 Seedance 工作流

将上面的经验整理后,一条实用的制作流程可以压缩成六步:

  1. 先确定故事中真正需要出现的动作和转折。
  2. 创建可复用主体,并准备带有比例参照的场景图。
  3. 按 2~3 秒一个 Shot 拆分镜头。
  4. 使用 720p 进行多次抽卡,每个版本挑选可用镜头。
  5. 在剪辑软件中重新排列节奏、添加 BGM 和补充音效。
  6. 最终定稿后使用 Topaz 放大到 4K。

这套方法的重点不是找到一条“万能提示词”,而是把生成模型放回它最适合的位置:负责完成明确的镜头任务,而不是替你决定故事本身。

可直接复用的提示词模板

1
2
3
4
5
6
7
主体:@主体一  @主体二
场景:@场景参考图
声音:不要生成任何 BGM,只生成与画面对应的环境音和动作音效。

Shot 01|景别与机位。角色动作、环境变化和关键道具。
Shot 02|景别与机位。角色动作、环境变化和关键道具。
Shot 03|景别与机位。角色动作、环境变化和关键道具。

下面是一个更具体的示例:

1
2
3
4
5
主体:@Shama  @毛线兔子
场景:@微观世界
声音:不要生成任何 BGM,只生成与画面对应的环境音和动作音效。

Shot 01|冲向断崖,前方出现纽扣落点。低机位广角,镜头贴近布料地面向前看。毛线兔子拖着 Shama 的橡皮车高速冲刺,穿过密集的巨型铅笔森林。断崖两侧各悬着一枚巨型木纽扣,形成临时落脚点。Shama 的车紧跟在兔子后方,空气中飞散着铅笔屑和碎线头。

这个模板的关键,是先通过 @ 引用已经建立好的主体和场景,再明确禁止 BGM。每个 Shot 集中交代景别、机位、动作、环境和关键道具,不用额外加入大量抽象情绪词。

最后的建议

Seedance 已经足够理解自然、简洁的镜头描述。真正稀缺的并不是更长的 Prompt,而是你是否清楚这一场戏应该发生什么、角色为什么行动,以及镜头如何让观众看懂。

把从提示词小作文里省下来的时间,用来构思分镜和故事。最终成片的提升,往往会比继续堆关键词更加明显。