> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-partner-nodes-consolidate.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# CosmosImageToVideoLatent - ComfyUI Built-in Node Documentation

> The CosmosImageToVideoLatent node creates a video latent representation from input images.

## 输入

| 参数     | 说明                         | 数据类型  | 是否必需 | 范围                               |
| ------ | -------------------------- | ----- | ---- | -------------------------------- |
| `vae`  | 用于将图像编码到视频潜在空间的 VAE 模型。    | VAE   | 是    | -                                |
| `宽度`   | 输出视频的宽度（以像素为单位）（默认值：1280）。 | INT   | 是    | 16 to MAX\_RESOLUTION (step: 16) |
| `高度`   | 输出视频的高度（以像素为单位）（默认值：704）。  | INT   | 是    | 16 to MAX\_RESOLUTION (step: 16) |
| `长度`   | 视频的总帧数（默认值：121）。           | INT   | 是    | 1 to MAX\_RESOLUTION (step: 8)   |
| `批量大小` | 要生成的视频潜在变量数量（默认值：1）。       | INT   | 是    | 1 到 4096                         |
| `开始图像` | 可选图像或图像序列，用于编码到视频开头。       | IMAGE | 否    | -                                |
| `结束图像` | 可选图像或图像序列，用于编码到视频结尾。       | IMAGE | 否    | -                                |

**注意：**

* 当既不提供 `start_image` 也不提供 `end_image` 时，节点返回不带噪声掩码的空白潜在变量。
* 当提供 `start_image` 时，它会被编码到潜在变量的起始帧中，并且这些帧的噪声掩码值标记为 0（保留）。当提供 `end_image` 时，它会被编码到结束帧中，并且这些帧的噪声掩码值标记为 0。其余帧的掩码值保持为 1。
* 该潜在变量具有 16 个通道，其空间尺寸为 `height / 8` × `width / 8`。潜在帧数为 `((length - 1) // 8) + 1`。
* `batch_size` 会重复潜在变量，并在存在噪声掩码时重复该掩码。

## 输出

| 输出名称     | 说明                                                           | 数据类型   |
| -------- | ------------------------------------------------------------ | ------ |
| `latent` | 生成的视频潜在变量，包含可选的编码起始图像和/或结束图像；当提供图像时，还包含匹配的噪声掩码，其中保留帧的掩码值为 0。 | LATENT |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/CosmosImageToVideoLatent/zh.md)

***

**Source fingerprint (SHA-256):** `0b06ccfcb14c27c81eeebbbff519da1e187970d4cfc19c8796fc3da20688245c`
