输入
注意: 提供 VAE 时,节点会从所有提供的输入图像生成参考潜变量。一次最多可处理三张图像。图像会缩放至 384x384 像素的目标区域(保持宽高比)用于视觉-语言处理,并缩放至可被 8 整除的尺寸(目标面积为 1024x1024 像素)用于 VAE 编码。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
5eea53a84045924b44d445244e6149b341188d22573aaaced87bac8a139dac96