输入
支持的类型与编码器映射
type 参数会为给定的模型架构选择正确的编码器。以下是常见的映射:
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
7c1586d01410d319468f7c8c153ef0717280804add868ba57bff0c6539fb5dd9Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
CLIPLoader 节点从文件中加载文本编码器模型(CLIP、T5 或类似模型),使其可用于其他需要将文本提示转换为数值表示的节点。
| 参数 | 说明 | 数据类型 | 是否必需 | 范围 |
|---|---|---|---|---|
CLIP名称 | 要加载的文本编码器模型的文件名。该文件必须位于 ComfyUI/models/text_encoders/ 目录中。 | STRING | 是 | text_encoders 文件夹中的文件列表 |
类型 | 所加载模型的架构类型。这决定了要使用的具体编码器变体(默认值:"stable_diffusion")。 | COMBO | 是 | "stable_diffusion""stable_cascade""sd3""stable_audio""mochi""ltxv""pixart""cosmos""lumina2""wan""hidream""chroma""ace""omnigen2""qwen_image""hunyuan_image""flux2""ovis""longcat_image""cogvideox""lens""pixeldit""ideogram4""boogu""krea2""joyimage""mage""minimax" |
设备 | 用于加载模型的设备。"default" 会在可用时使用 GPU,而 "cpu" 则强制使用 CPU 加载。这是一个高级选项(默认值:"default")。 | COMBO | 否 | "default""cpu" |
type 参数会为给定的模型架构选择正确的编码器。以下是常见的映射:
| 类型 | 编码器 |
|---|---|
| stable_diffusion | clip-l |
| stable_cascade | clip-g |
| sd3 | t5 xxl / clip-g / clip-l |
| stable_audio | t5 base |
| mochi | t5 xxl |
| cogvideox | t5 xxl(226 token 填充) |
| cosmos | 旧版 t5 xxl |
| lumina2 | gemma 2 2B |
| wan | umt5 xxl |
| hidream | llama-3.1(推荐)或 t5 |
| omnigen2 | qwen vl 2.5 3B |
| joyimage | qwen3-vl 8B |
| lens | gpt-oss-20b |
| pixeldit | gemma 2 2B elm |
| minimax | MiniMax H3 Qwen3-VL 或 Music3 Qwen/RVQ |
| 输出名称 | 说明 | 数据类型 |
|---|---|---|
clip | 已加载的文本编码器模型,可连接到其他节点以进行文本编码和条件设置。 | CLIP |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
7c1586d01410d319468f7c8c153ef0717280804add868ba57bff0c6539fb5dd9