入力
注:
width と height のパラメータは内部で8で除算され、出力される潜在テンソルの空間次元を決定します。
出力
要求した枚数より1枚多く画像が得られる理由
Qwen-Image-Layered は画像を分解するだけではありません。レイヤーに加えて、完全な画像も専用のシートに再描画します。そのため、シートのスタックは常に、要求したレイヤー数より1枚多くなります。- 最初の画像はレイヤーではなく、完全な画像です。 これはすでに持っている画像と同じものなので、レイヤーだけが必要な場合は破棄してください。
- すべてのレイヤーを重ね合わせると、再び完全な画像が得られます。 それらを重ねても最初の画像にならない場合、分離が意図どおりに機能していないことになります。そのため、これは結果をすばやく確認する方法として使えます。
- シートの順序を維持してください。 スタックは、どのレイヤーがどのレイヤーの上にあるかについての唯一の記録です。シート自体には、どの位置に属するかを示す情報は何も書かれていません。そのため、画像を並べ替えたり削除したりすると、レイヤーの並べ替えや喪失につながります。
- レイヤーは透明状態で出力されるため、 下のレイヤーが不透明な背景に隠されることなく、重ね合わせることができます。
使用上のヒント
出力を、通常の空の潜在テンソルと同じようにサンプラーに渡し、VAE Decode の前にdim を t に設定した LatentCutToBatch を配置してください。このステップによって、スタックが完全な画像から始まる順序で個別の画像に分解されます。
最初はデフォルトの3レイヤーから始めてください。それ以上を指定すると、生成時間が長くなり、分離がより細かくなります。モデルが少ない数のレイヤーでどのように動作するかを確認するまでは、増やしても価値はありません。
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
5ccac979fcbcefb65f28867a89401c095cb330e09c13270008c32feeeafb1287