可用的工作流
文生视频
仅凭提示词生成一段视频片段。提示词承载动作、台词和声音,因此一次节点运行即可返回一段制作完成的说话视频片段。在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索 “HeyGen Video 1.0: Text to Video”
图生视频
为一张图像添加动画。该图像是视频片段的首帧,输出会保持其宽高比,因此当你需要不同的形状时,请先裁剪图像。提示词决定画面中发生什么以及说了什么。在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索 “HeyGen Video 1.0: Image to Video”
model_red_curls_ring.png
加载到为 HeyGen Video 1.0 Image to Video 节点提供输入的
LoadImage 节点中参考生视频
通过将人物、产品和场景作为参考连接起来,让它们在整段镜头中保持一致:最多 9 张图像、3 段视频和 3 段音频,共计 12 个。提示词随后以@Image1、@Video1 和 @Audio1 来引用它们,按类型依据输入顺序编号。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索 “HeyGen Video 1.0: Reference to Video”
model_black_blazer_red_earrings.png
加载到第一个参考图像槽位 ·
@Image1cognac_leather_handbag.png
加载到第二个参考图像槽位 ·
@Image2节点控件
Image to Video 节点接收图像、提示词、时长、分辨率和种子。它没有宽高比控件,因为首帧决定了片段的形状。
提示技巧
- 把台词写进提示词。将对话放在引号里,作为镜头描述的一部分,这样模型就会说出这句台词并匹配唇部动作。两个模板都附带了很长的示例提示词来展示这种写法:先写镜头和主体,再用引号写台词,最后写声音和相机语言。
- 用画面描述声音。环境底噪、一段音乐,或某个动作发出的声响,都要写进提示词里,而不是用某个控件来设置。示例提示词以环境音结尾,例如安静的房间底噪中夹杂一声微弱的水壶鸣音,或放下物体时轻轻的玻璃碰撞声。
- 保持产品或出镜人物一致。将产品或人物作为参考图像连接,并在提示词中为其命名,然后描述它必须保持不变的方面,例如保持
@Image2中包袋的准确颜色、比例和五金件。 - 用参考塑造镜头。当
aspect_ratio设为auto时,构图会跟随第一张参考图像,因此你最先连接的参考决定了视频的形状。 - 预期每次运行都会有差异。种子并不会锁定结果;相同的设置仍然可能生成不同的效果。
开始使用
- 将 ComfyUI 更新至最新版本
- 前往模板库,搜索
HeyGen Video 1.0