> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-partner-nodes-consolidate.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# ARVideoI2V - ComfyUI Built-in Node Documentation

> Documentation for ARVideoI2V node.

## 概要

このノードは、Causal Forcing または Self-Forcing を使用する AR（Auto-Regressive、自己回帰）ビデオモデル向けに、画像からビデオを生成するセットアップを準備します。開始画像を VAE で潜在空間にエンコードし、それをモデルのトランスフォーマーオプションに保存することで、ビデオサンプリングプロセスがデノイジング前に KV キャッシュをシードできるようにします。同じテキストからビデオへのモデルチェックポイントを使用するため、画像からビデオへの専用アーキテクチャは不要です。

## 入力

| パラメータ         | 説明                                                                         | データ型  | 必須 | 範囲                 |
| ------------- | -------------------------------------------------------------------------- | ----- | -- | ------------------ |
| `model`       | 生成に使用する AR ビデオモデル。                                                         | MODEL | はい | -                  |
| `vae`         | 開始画像を潜在空間にエンコードするために使用する VAE モデル。                                          | VAE   | はい | -                  |
| `start_image` | 生成されるビデオの最初のフレームとして使用される初期画像。入力バッチ内の最初の画像のみが使用され、その RGB チャンネルのみがエンコードされます。 | IMAGE | はい | -                  |
| `幅`           | 生成されるビデオフレームの幅（デフォルト: 832）。                                                | INT   | はい | 16〜8192 (step: 16) |
| `高さ`          | 生成されるビデオフレームの高さ（デフォルト: 480）。                                               | INT   | はい | 16〜8192 (step: 16) |
| `長さ`          | 生成されるビデオのフレーム総数（デフォルト: 81）。                                                | INT   | はい | 1〜1024 (step: 4)   |
| `バッチサイズ`      | 1 回のバッチで生成するビデオシーケンスの数（デフォルト: 1）。                                          | INT   | はい | 1〜64               |

注: 開始画像はエンコード前に指定された `width` と `height` にリサイズされます。潜在空間の時間次元は `((length - 1) // 4) + 1` として計算され、潜在空間の空間次元は `height / 8` と `width / 8` になります。

## 出力

| 出力名      | 説明                                                                                                               | データ型   |
| -------- | ---------------------------------------------------------------------------------------------------------------- | ------ |
| `MODEL`  | エンコードされた開始画像がトランスフォーマーオプション（`ar_config.initial_latent`）に格納されたクローンモデル。サンプラーは、デノイジング前に KV キャッシュをシードするためにこれを使用します。  | MODEL  |
| `LATENT` | 形状が `[batch_size, 16, lat_t, height // 8, width // 8]` のゼロで満たされた潜在テンソル。ここで `lat_t = ((length - 1) // 4) + 1` です。 | LATENT |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/ARVideoI2V/ja.md)

***

**Source fingerprint (SHA-256):** `984834951b9d5a22aef51c85a5019fd8ba58cdb2d6fff235371ed29f316896d8`
