
By gerogero
Updated: August 3, 2026
这是一个初学者指南,帮助您安装 Wan 并 实施所有可用的优化,以最大化视频生成的速度。
现在,实现这一点涉及到质量的权衡,但如果您更倾向于优先考虑质量而非速度,您可以轻松禁用任何优化。
包含的指南和工作流程是针对具有 24GB 或更多 VRAM 的 GPU 量身定制的,通常在生成过程中使用 21-23GB。虽然可以使用少于 24GB 的 GPU,但您需要进行调整。例如,16GB 的 GPU 可以使用 FP8/Q8 模型,前提是您在提供的工作流程中增加 virtual_vram_gb 或块交换设置。我们稍后会讨论这些。
如果您低于 16GB,您可能想使用量化低于 Q8 的模型,但请记住,使用较低的量化级别会降低输出的质量。一般来说,您去得越低,获得的质量就越低。
ComfyUI 便携版
ComfyUI 管理器
CUDA 12.6
Wan 2.1 可以通过两种方式集成到 ComfyUI 中:原生支持或 Kijai 的 Wrapper。Kijai 的 Wrapper 具有原生不具备的额外功能(flowedit、vid2vid 等),而原生则拥有 Kijai 版本所没有的几个优势。这些优势包括:对 gguf 模型的支持、自适应引导(以牺牲质量为代价加速生成的方法)以及对 40XX 和 50XX GPU 系列的 TorchCompile 兼容性,甚至包括 30XX 系列,这使得生成速度额外提高约 30%。因此,如果您使用的 VRAM 少于 24GB 和/或希望获得最快的生成速度,原生可能是更好的选择。
一旦您确定了方法及其相关工作流程,请继续进行一般安装步骤。
下载这些修改过的 Kijai 默认工作流程版本。除了优化和一些额外功能外,它们使用阿里巴巴的默认设置作为基线。该工作流程输出两个视频,原始 16 fps 和插值 32 fps 版本。您可以轻松调整这些以使用 720P 模型/设置。请参见 在 720P 下生成。
/ldg/ KJ i2v 480p 工作流程: ldg_kj_i2v_14b_480p.json
(更新于 2025 年 3 月 17 日)
/ldg/ KJ t2v 480p 工作流程: ldg_kj_t2v_14b_480p.json
(更新于 2025 年 3 月 17 日)
请勿将 Comfy 模型文件与 KJ 的模型文件一起使用!您 必须 使用这些模型文件,否则会遇到问题!
下载这些修改过的 Comfy 工作流程版本,基于来自 /ldg/ 的匿名者的版本。除了优化和一些额外功能外,它们使用阿里巴巴的默认设置作为基线。该工作流程输出两个视频,原始 16 fps 和插值 32 fps 版本。您可以轻松调整这些以使用 720P 模型/设置。请参见 在 720P 下生成。
/ldg/ Comfy i2v 480p 工作流程: ldg_cc_i2v_14b_480p.json
(更新于 2025 年 3 月 17 日)
/ldg/ Comfy t2v 480p 工作流程: ldg_cc_t2v_14b_480p.json
(更新于 2025 年 3 月 17 日)
请勿将 Kijai 的文本编码器文件与这些模型一起使用!您 必须 使用这些文本编码器,否则在生成时会出现错误,提示 Exception during processing !!! mat1 and mat2 shapes cannot be multiplied (77x768 and 4096x5120)
pytorch version: 2.7.0.dev20250306+cu126。您还应该看到 Enabled fp16 accumulation 和 Using sage attention。在更新扩展或重启时,可能会出现一个错误,报告不正确的 pytorch 版本。如果发生这种情况,请关闭 Comfy 并重新启动。如果您在更新扩展后使用 Comfy 中的“重启”按钮,这种情况似乎最常发生,因此请手动关闭并在更新扩展后手动启动。如果在更新 Comfy 后再次重启仍然不是 2.7.0dev,请再次执行步骤 5。
ComfyUI-GGUF 扩展。如果在安装并重启 Comfy 后仍然抱怨缺少节点,您可能需要手动安装缺失的节点。如果在使用 KJ 的 Wrapper 时发生这种情况,请手动安装 Wrapper 从他的仓库,并在此之前删除自定义节点中的旧版本。如果在抱怨缺少 WanVideoEnhanceAVideoKJ 时同样适用 KJNodes,请确保遵循 便携版 的安装说明。
2.7.0dev,否则 fp16_fast / fp16 accumulation 将无法工作。您获得的初始生成时间 不 准确。Teacache 在生成过程中启动,自适应在中途启动,如果您使用的是 Comfy Native/Core。
当视频生成完成后,您将在各自的 i2v 或 t2v 目录及子目录中获得两个文件。原始文件是 16 帧输出,而 int 文件则插值为 32 帧,提供更平滑的运动。
强烈建议您在生成过程中启用预览。如果您遵循了指南,您将拥有所需的扩展。转到 ComfyUI 设置(左下角的齿轮图标),搜索“在采样时显示动画预览”。启用它。然后打开 Comfy 管理器,将预览方法设置为 TAESD(慢)。输出将在第 10 步左右变得更清晰,您将对构图和运动有一个大致的了解。这可以为您节省大量时间,因为如果您不喜欢它们的外观,可以提前取消生成。
绝对不要 在 480p 分辨率下使用 720p i2v 模型,反之亦然。如果您使用 720p i2v 模型并将分辨率设置为 832×480,例如,您获得的输出将比简单使用 480p i2v 模型要差得多。通过在 720p 模型上生成 480p,您永远不会提高质量,所以请不要这样做。唯一允许您混合 480p 和 720p 分辨率的模型是 t2v 14B。
每个模型都是针对特定分辨率进行训练和微调的。理论上,偏离这些精确分辨率可能会导致结果较差,尤其是对于 i2v。
然而,根据我的经验,只要调整保持合理,我成功地使用了非标准分辨率的 i2v,而没有明显的问题。例如,您应该避免大幅偏离 480p 或 720p,并始终锚定一个维度 - 要么 480 用于 480p 模型,要么 720 用于 720p 模型 - 同时将另一个维度向下缩放(绝不要向上缩放)以调整纵横比。这意味着一个维度应该始终固定在 480 或 720,具体取决于模型,另一个维度根据需要向下调整。而且您永远不想超过 480p 的最大设置值 832 和 720p 的 1280,因为这将大幅增加生成时间,并超出模型开发者设定的分辨率限制。
以下是 Wan 官方仓库中列出的“支持”分辨率:
| 文本到视频 - 1.3B | 文本到视频 - 14B | 图像到视频 - 480p | 图像到视频 - 720p |
|---|---|---|---|
| 480*832 | 720*1280 | 832*480 | 1280*720 |
| 832*480 | 1280*720 | 480*832 | 720*1280 |
| 624*624 | 960*960 | ||
| 704*544 | 1088*832 | ||
| 544*704 | 832*1088 | ||
| 480*832 | |||
| 832*480 | |||
| 624*624 | |||
| 704*544 | |||
| 544*704 |
如果您想在 i2v 中使用 720p 模型或在 t2v 中使用 720p 分辨率,您需要:
本指南中的几个选项可以加快推理时间。它们是 fp16_fast(fp16 累加)、TeaCache、Torch Compile、自适应引导(仅限 Comfy Native)和 Sage Attention。如果您希望禁用它们以进行测试或在牺牲时间的情况下提高质量,请执行以下操作:

Complicated desired outputs = Complex prompts with mix of natural language and tags [postcard=89ntmto] Complex prompt...

This guide was created to bring inspiration to this visual vocabulary. There is a short description for each pose so ...

GPT-4o, released on March 25, 2025 went viral soon after release, bolstered by the Studio Ghibli animation style tren...

This guide is intended to get you generating quality NSFW images as quickly as possible with Automatic1111 Stable Dif...