Pourquoi utiliser le node “CLIP Dernière Couche” avec un LoRA SDXL dans ComfyUI ?
- Gaetan Michel
- 21 mai
- 5 min de lecture
Quand on commence à utiliser des LoRA avec des modèles SDXL dans ComfyUI, il est fréquent d’obtenir des résultats étranges :
personnages déformés,
style mal appliqué,
prompts peu respectés,
visages incohérents,
rendu “plastique”,
ou au contraire images trop saturées.
Dans énormément de cas, le problème ne vient ni du checkpoint, ni du LoRA… mais du paramètre CLIP skip / dernière couche CLIP.
Ce réglage est encore très mal compris en 2026, alors qu’il influence directement :
la compréhension du prompt,
l’application du LoRA,
la cohérence artistique,
et parfois même la stabilité complète du workflow.
Sur SDXL, ce paramètre devient encore plus sensible, car les modèles utilisent une architecture CLIP différente de SD 1.5.
Dans cet article, nous allons voir :
ce qu’est réellement le CLIP dans Stable Diffusion,
pourquoi certains LoRA SDXL nécessitent un réglage spécifique,
comment fonctionne le node “CLIP Set Last Layer” dans ComfyUI,
quels réglages utiliser selon les modèles,
et comment éviter les erreurs les plus fréquentes.

Comprendre le rôle du CLIP dans Stable Diffusion
Avant de parler de “dernière couche”, il faut comprendre ce qu’est le CLIP.
Le CLIP est le système qui :
lit votre prompt,
comprend les mots,
transforme le texte en informations exploitables par le modèle.
Sans CLIP :
votre modèle ne comprendrait absolument rien au prompt.
Dans un workflow SDXL classique :
vous écrivez un prompt,
le CLIP encode le texte,
le modèle génère l’image à partir de cette compréhension.
Le problème :certains LoRA ont été entraînés avec un comportement CLIP spécifique.
Et si votre workflow utilise une autre couche CLIP…le LoRA peut devenir :
trop fort,
trop faible,
imprécis,
voire complètement cassé.
Pourquoi ce problème est fréquent avec SDXL ?
Avec SD 1.5, beaucoup de LoRA utilisaient un CLIP skip de 1 ou 2.
Mais avec SDXL :
l’architecture CLIP est plus complexe,
les modèles sont plus sensibles,
les LoRA sont souvent entraînés différemment,
et certains créateurs oublient même d’indiquer le bon réglage.
Résultat : deux utilisateurs utilisant :
le même checkpoint,
le même LoRA,
le même seed,
le même prompt,
… peuvent obtenir des images complètement différentes uniquement à cause du CLIP Last Layer.
Un véritable petit démon caché dans le workflow.
Le node “CLIP Set Last Layer” ou “CLIP dernière couche” dans ComfyUI
Dans ComfyUI, le node le plus utilisé est :
CLIP Set Last Layer
Ce node permet de choisir :
quelle couche CLIP sera utilisée,
et donc comment le prompt sera interprété.
Où le placer ?
Le node doit être placé :
entre le chargement du checkpoint
et l’encodage du prompt.
Structure simplifiée :
Checkpoint Loader
CLIP Set Last Layer
CLIP Text Encode
KSampler
À quoi sert réellement ce réglage ?
Le CLIP possède plusieurs couches internes.
Quand on modifie la “dernière couche” :
on change la manière dont le modèle comprend les concepts,
le niveau d’abstraction,
la précision du style,
et parfois même la fidélité anatomique.
En pratique :
Valeur | Effet fréquent |
-1 | comportement standard |
-2 | rendu souvent plus artistique |
-3 | LoRA parfois mieux respecté |
-4 et plus | peut devenir instable |
Pourquoi les LoRA SDXL réagissent autant au CLIP ?
Un LoRA n’est pas un modèle complet.
C’est :
une surcouche d’apprentissage,
qui modifie certaines zones du modèle.
Mais ce LoRA a été entraîné :
avec un CLIP précis,
une structure précise,
un comportement de prompt précis.
Si votre CLIP diffère :
le LoRA comprend moins bien les concepts,
certaines associations de mots changent,
le style peut dériver.
C’est particulièrement visible sur :
les LoRA photoréalistes,
les LoRA visage,
les LoRA anime très stylisés,
les LoRA pose,
les LoRA vêtements détaillés.
Exemple concret avec un LoRA photoréaliste SDXL
Prenons :
un checkpoint SDXL réaliste,
un LoRA visage,
un prompt photo cinéma.
Sans réglage CLIP adapté :
peau plastique,
yeux déformés,
style peu cohérent,
détails instables.
Avec le bon CLIP Last Layer :
meilleure peau,
regard plus réaliste,
détails cohérents,
meilleure réponse au prompt.
La différence peut être énorme.
Comment savoir quel réglage utiliser ?
Lire la page du LoRA
Sur Civitai, beaucoup de créateurs indiquent :
Clip Skip 1,
Clip Skip 2,
ou Last Layer = -2.
Ces informations sont souvent présentes :
dans la description,
les métadonnées,
ou les commentaires.
Toujours vérifier avant de lancer vos générations.
Tester plusieurs valeurs
En pratique :
-1,
-2,
et -3
sont les réglages les plus utiles.
Sur SDXL :
-2 fonctionne souvent très bien,
mais certains LoRA réalistes préfèrent -1.
Observer les détails importants
Le bon CLIP se remarque souvent sur :
les yeux,
les mains,
les textures de peau,
le respect des vêtements,
la fidélité du style.
Erreurs fréquentes des débutants
Empiler plusieurs LoRA incompatibles
Chaque LoRA peut avoir :
un entraînement différent,
un comportement CLIP différent.
Résultat :
conflits,
styles cassés,
artefacts visuels.
Utiliser des workflows téléchargés sans comprendre les nodes
Beaucoup de workflows ComfyUI sur Civitai contiennent déjà :
des réglages CLIP spécifiques,
des bypass,
des paramètres optimisés.
Les supprimer “pour simplifier” peut casser complètement le workflow.
Confondre CLIP skip et poids du LoRA
Augmenter le poids du LoRA :≠corriger un mauvais CLIP.
Un mauvais CLIP avec un LoRA fort peut empirer les résultats.
Réglages recommandés en 2026
Pour SDXL réaliste
Commencer par :
Last Layer = -2
Puis tester :
-1 si le rendu devient trop artistique.
Pour anime SDXL
Très souvent :
-2
ou -3
fonctionnent mieux.
Pour les LoRA visage et photo
Tester :
-1,
puis -2.
Les LoRA visage haut de gamme sont souvent très sensibles à ce paramètre.
Exemple de workflow recommandé
Workflow simple et efficace :
Load Checkpoint
Load LoRA
CLIP Set Last Layer
CLIP Text Encode
KSampler
VAE Decode
Simple, stable et performant.
Conseil de pro
Quand un LoRA semble :
mauvais,
surcoté,
ou cassé,
le problème vient parfois simplement :du CLIP Last Layer.
Énormément de LoRA sur Hugging Face et Civitai sont testés avec des workflows spécifiques.
Copier uniquement :
le checkpoint,
le prompt,
le LoRA,
sans reproduire :
le sampler,
le scheduler,
le CFG,
ET le CLIP,
donne souvent des résultats totalement différents.
Impact sur les performances GPU
Bonne nouvelle :le node CLIP Last Layer :
n’augmente quasiment pas la VRAM,
ne ralentit presque pas les générations.
C’est probablement l’un des réglages ayant le meilleur rapport amélioration/performance dans tout ComfyUI.
Conclusion
Le node “CLIP Set Last Layer” est l’un des réglages les plus sous-estimés de ComfyUI.
Pourtant :
il influence directement la compréhension du prompt,
l’efficacité des LoRA,
le style final,
et la cohérence globale des générations SDXL.
Quand un LoRA semble fonctionner bizarrement :avant de changer :
de checkpoint,
de sampler,
de CFG,
de seed,
ou même de GPU…
testez simplement :
Last Layer -1,
puis -2,
puis -3.
Vous pourriez avoir l’impression d’avoir changé complètement de modèle.
FAQ
Le CLIP skip est-il obligatoire avec SDXL ?
Non, mais certains LoRA SDXL fonctionnent beaucoup mieux avec un réglage précis.
Quelle valeur utiliser avec SDXL ?
La plupart du temps :
-1
ou -2.
Le CLIP skip augmente-t-il la VRAM ?
Non, l’impact est négligeable.
Peut-on utiliser plusieurs LoRA avec des CLIP différents ?
Oui, mais cela peut créer des conflits stylistiques.



Commentaires