Por qué las personas de IA todavía se ven falsas
Suele ser sobreperfección, no subcalidad
El instinto es asumir que una persona de IA que se ve falsa necesita más resolución o un mejor modelo. Muchas veces es lo contrario: la piel perfecta, la simetría perfecta y la iluminación perfectamente uniforme son lo que dispara la reacción de valle inquietante, porque la realidad es imperfecta y el ojo de un espectador está afinado para notar esa ausencia incluso sin nombrarla conscientemente.
Curiosamente, puntuaciones de realismo más altas no se traducen automáticamente en reacciones más cómodas del espectador; una imagen técnicamente más fotorrealista puede seguir sintiéndose "rara" si carece de las imperfecciones específicas que tiene una foto real. La solución no es más pulido, es reintroducir deliberadamente el microdetalle que los modelos suavizan por defecto.
Los rasgos más difíciles: ojos y manos
Todavía los dos modos de fallo más persistentes
Los ojos son donde miran primero los espectadores, y los problemas sutiles (reflejos de luz que no coinciden, detalle antinatural del iris, una mirada demasiado uniforme) son lo que causa el malestar inmediato que describen las reacciones clásicas del valle inquietante. Las manos siguen siendo un problema separado y famosamente terco: las manos malformadas de IA seguían siendo un fallo ampliamente reportado a mediados de 2026, mucho después de que la mayoría de otros problemas de calidad se hubieran resuelto en gran medida con modelos más nuevos.
Para los ojos, pedir explícitamente una posición de reflejo de luz natural que coincida con la fuente de luz de la escena, y una ligera asimetría entre los dos ojos, ayuda más que una instrucción genérica de "ojos realistas." Para las manos, la solución más fiable en la práctica sigue siendo evitar poses de manos incómodas en la composición (manos a los costados, parcialmente fuera de cuadro, o sosteniendo un objeto) en lugar de esperar que una mano completamente abierta y detallada se renderice correctamente cada vez.
Piel y microdetalle
La capa que vende la ilusión
La última capa de realismo viene de los microdetalles que un modelo suaviza por defecto: poros visibles, líneas finas, algunos cabellos sueltos, ligera irregularidad en el tono de piel. Esto es lo que separa una imagen "técnicamente de alta resolución" de una que realmente se lee como una foto real.
Pedir textura de piel detallada, poros visibles e imperfecciones sutiles, más hebras de cabello individuales visibles y algunos cabellos sueltos en lugar de cabello uniformemente suave, cierra la mayor parte de la brecha restante. Esto es más un problema de textura que de resolución; una imagen de bajo detalle con microtextura correcta a menudo se lee como más real que una imagen de alta resolución sin ella.
Consistencia de la iluminación
La luz uniforme es una señal de foto sintética
La fotografía real tiene luz direccional, ligeramente irregular: una fuente de luz visible, una caída de sombra suave, y un reflejo de luz en los ojos que coincide con de dónde viene realmente esa luz. La iluminación uniformemente pareja en todo un rostro y escena es una firma común de imagen sintética, porque es fácil para un modelo tomarla por defecto y difícil para un espectador señalarla conscientemente como incorrecta, aunque se registra como "raro."
Especificar una fuente de luz, su dirección y su calidad (por ejemplo luz suave de ventana desde un lado, con sombra visible en el otro) le da al modelo un escenario de iluminación concreto que simular en lugar del ambiente plano por defecto.
Postprocesado: LoRA, upscaling y detalladores de piel
El paso de acabado, no un sustituto de una buena generación base
- Upscaling. Un upscaler dedicado recupera detalle fino que una generación base comprime, lo cual importa más específicamente para la textura de piel y las hebras de cabello.
- Pasadas de detallador de piel. Una pasada de refinamiento dirigida solo a la región del rostro y la piel añade textura a nivel de poros sin volver a renderizar toda la imagen, arreglando la planitud restante más común.
- Afinamientos LoRA. Una LoRA entrenada con fotografía real (en lugar de datos ilustrados o estilizados) desplaza la salida por defecto del modelo base hacia textura y comportamiento de iluminación fotográficos incluso antes de que ocurra cualquier prompting.
- Afilado selectivo. Un afilado ligero y dirigido en ojos y detalle de piel, aplicado después del upscaling, evita el aspecto sobre-afilado y artificial que produce el afilado global.
Realismo una vez vs. realismo cada vez
Una sola imagen realista no resuelve un personaje recurrente
Cada técnica anterior funciona para una imagen. La versión más difícil del problema, mantener a la misma persona luciendo realista e idéntica a través de decenas de fotos futuras, es un problema de consistencia superpuesto a un problema de realismo, y ajustar a mano prompts, prompts negativos y postprocesado por separado para cada nueva generación no escala.
En RYLA, crear un influencer de IA integra el trabajo de realismo en el personaje una vez, así que la textura, el comportamiento de iluminación y la identidad se transmiten automáticamente. Consulta cómo escribir mejores prompts para personajes de IA realistas para el lado del prompting de este problema, y cómo mantener consistente a un influencer de IA para un desglose completo de las técnicas de consistencia (seeds, LoRA, adaptadores de identidad, face swap) que mantienen un rostro realista idéntico a través de generaciones.
