Skip to main content
TextEncodeZImageOmni は、テキストプロンプトと最大 3 つのオプションの参照画像を、画像生成モデル用のコンディショニング形式にエンコードします。プロンプトはトークン化され、CLIP モデルでエンコードされます。また、接続された各画像は、必要に応じてビジョンエンコーダおよび/または VAE によって処理され、視覚的参照がテキストと一緒に埋め込まれます。このノードは実験的とマークされています。

入力

注記: このノードは最大 3 つの画像(image1image2image3)を受け付けます。image_encodervae 入力は、少なくとも 1 つの画像が指定された場合にのみ使用されます。両方が接続されている場合、各画像は両方によって処理されます。auto_resize_images が True で vae が接続されている場合、エンコード前に画像の総ピクセル面積が 1024x1024 に近くなるようにリサイズされます。画像が指定されていない場合は、テキストプロンプトのみがエンコードされます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): b40a3150f536b6f37e2b53e6d9992fcb4fd32dceb540c0a76773a7ba1af9a7b8