Le photoréalisme humain en 125 mégaoctets
fal a publié le 10 août le Realism People LoRA pour MiniMax H3, un adaptateur en poids ouverts spécialisé dans les personnes photoréalistes, contenu tout entier dans un fichier de 125 mégaoctets. Activé par le mot déclencheur r34l1sm, il couvre en un seul fichier la génération texte-vers-vidéo, image-vers-vidéo et référence-vers-vidéo, tout en conservant l'audio synchronisé natif du modèle. La promesse : des visages qui tiennent le gros plan, un grain de peau réel au lieu du lissage habituel, des micro-expressions cohérentes et une lumière de cinéma — la matière première de la photographie d'une pochette d'album comme du clip. La carte de modèle appuie ses affirmations sur 19 paires avant/après générées à prompt et graine strictement identiques, seule la présence du LoRA variant d'un côté à l'autre. Dans ComfyUI, aucun nœud personnalisé n'est requis : un chargeur LoRA standard, une force de 1.0 — ou 0,6 à 0,8 pour une touche plus légère — et l'adaptateur est aussi servi via l'endpoint API de fal.
Le photoréalisme cesse d'être une propriété du modèle pour devenir un curseur qu'on lui visse dessus — 125 mégaoctets décident si une peau respire ou brille comme du plastique. La méthode des 19 paires à graine constante mérite d'être saluée : c'est un protocole de comparaison honnête, chose rare dans un domaine où la démonstration triée sur le volet fait loi. Reste la question que le fichier ne règle pas : un visage crédible n'est pas encore un visage juste. Le vraisemblable se télécharge désormais ; le regard qui choisit ce que ce visage raconte, non.