Create Noise Latents 算子节点
生成一个形状与所连扩散管线预期结构精准匹配的随机高斯噪声潜空间张量——是绝大多数标准文生图 (Text-to-Image) 与文生视频 (Text-to-Video) 工作流的标志性起点。
算子所属分类:ModularDiffusion/Create
核心速查 (TL;DR)
- 文生流的标准源头:在任何纯粹的文生图或文生视频工作流中,始终将本节点置于 Pipeline Builder 与 Generate Media Latents 之间;
- 直观的物理像素级尺寸声明:参数
width与height采用直观的人类可读像素尺寸;节点内部会自动根据底层绑定的 VAE 下采样压缩比率(如 8x 或 16x)自动折算为潜空间维度; - 智能感知管线形态:参数
num_frames仅在所连接的管线为时序视频模型(如 LTX、LTX2、WAN)时才会动态显现,静态图像管线下自动智能折叠隐藏; - 随机种子保证严格可复现性:相同的
seed+ 相同的pipeline架构 + 相同的空间分辨率维度 $\rightarrow$ 输出绝对完全相同的初始潜变量噪声。
典型工作流编排拓扑
Pipeline Builder → [Create Noise Latents] → Generate Media Latents → Decode Media Latent
节点外观预览

输入端口规范 (Inputs)
| 端口名称 | 数据类型 | 是否必填 | 详细功能与业务规范说明 |
|---|---|---|---|
pipeline |
Pipeline Config |
是 | 来自上游 Pipeline Builder。决定潜空间张量的形状、通道数、VAE 缩放因子,以及前端是否渲染显示 num_frames 视频帧数控制项。 |
输出端口矩阵 (Outputs)
| 端口名称 | 数据类型 | 详细功能与业务规范说明 |
|---|---|---|
output_latent |
LatentArtifact |
解包后的标准归一化随机高斯分布噪声张量($\sim \mathcal{N}(0, 1)$)。直接传给 Generate Media Latents 驱动去噪循环。 |
属性参数调优 (Parameters)
| 参数名称 | 数据类型 | 默认值 | 详细业务功能与调优说明 |
|---|---|---|---|
width |
int (像素单位) |
1024 |
输出成片的物理像素宽度。底层会自动按 VAE 压缩比率折算潜空间列数。 |
height |
int (像素单位) |
1024 |
输出成片的物理像素高度。底层会自动按 VAE 压缩比率折算潜空间行数。 |
num_frames |
int |
41 |
连续视频帧数。在静态图像模型下自动隐藏。针对视频底模(如 LTX/WAN),决定了时序张量长度。 |
seed |
int |
随机生成 | 随机数发生器种子,用于固定画面初始噪声结构,实现生成结果的无损复现。 |
num_inference_steps |
int |
20 |
仅在 SDXL 管线下显现——用于指导 SDXL 根据步数按调度器规范对初始噪声执行标准差缩放。其他管线架构下忽略此项。 |
避坑技巧与最佳实践 (Tips & pitfalls)
- 空间分辨率必须满足 VAE 整除约束:绝大多数工业级 VAE 编解码网络均强制要求宽高像素为 8 或 16 的物理整数倍。请尽量采用标准的工程分辨率(如
512、768、1024、1280、1920等),防止张量维度失配报错。 - 跨管线架构无法复现相同画面:不同模型(如 Flux 与 SDXL)的潜变量通道数、均值方差分布与 VAE 潜空间拓扑完全不同;因此即使固定了完全一致的
seed,在不同管线间也绝不会生成相同的构图与内容。 - 图生图 (I2I) 或重绘管线请勿使用本节点:若你的意图是基于现有参考图进行重绘或重扩散,请改用 Encode Media Latent 算子将现有素材图像压入潜空间作为初始输入,并配合 Generate Media Latents 的
add_noise=True选项添加适量扰动噪声。
推荐延伸阅读
- Create Empty Latents — 全零初始潜变量,常用于特定蒙版局部合成或非噪声条件注入
- Encode Media Latent — 将既有像素图像/视频特征编码压缩为潜变量
- Generate Media Latents — 接收本节点产出的噪声张量并启动去噪扩散