文本定义意图
用语言说明动作、故事节点、镜头指令、排除项和最终格式。
需要模型从空白起点创造主体、场景、运动和镜头时,使用文本输入。
参考越多不一定越好,明确职责可以避免指令冲突。
用语言说明动作、故事节点、镜头指令、排除项和最终格式。
用高信息量画面固定身份、商品细节、服装、构图或视觉风格。
所选工作流支持时,用音频参考控制声音、音乐、时间或情绪节奏。
用源视频表达运动、时序、编辑、续写和难以仅靠文本说明的动作。
在请求进入生成队列前先解决冲突。
用一句话写清最终视频需要表达的内容。
说明每个文件控制什么,以及不能改变什么。
明确身份、商品几何、Logo、镜头轴线或时间中必须保持稳定的部分。
请求更大批量前,用短视频验证方向。
干净的输入集合通常比更长的提示词更有价值。
自由探索用文本,强调视觉一致性用图片,控制声音或节奏用音频,已有运动或时序时用源视频。
不应该。只有当某种输入控制明确部分时才添加,过多参考可能产生冲突。
使用清晰身份参考,避免冲突的人脸或服装,写明不得改变的部分,并且每次只调整一个视觉变量。
本站不提供 SynthID、C2PA 或水印移除工作流。请在生成媒体中保留适用的披露和来源信息。
从输入规划进入生成和可复用提示词结构。