Consistencia de personaje en imágenes y video con IA: workflow FLUX.2 y Kling
18 de septiembre de 2026 • 9 min de lectura
Última actualización: 18 de septiembre de 2026
La consistencia de personaje mejora cuando dejas de pedirle a un solo prompt que recree a una persona de memoria. Construye primero una imagen de referencia aprobada. Reutilízala cambiando una decisión visual a la vez y anima el still final con imagen a video.
Eso no elimina el drift. Sí hace que los fallos sean más fáciles de detectar y corregir.
¿Por qué cambian los personajes de IA entre generaciones?
Los personajes de IA cambian porque cada generación muestrea una nueva solución visual. Una descripción como «mujer con pelo azul y chaqueta de cuero» deja al modelo libertad para reinterpretar proporciones faciales, largo del pelo, construcción de la chaqueta, iluminación y distancia de cámara.
La solución no es un párrafo más largo de adjetivos. Es una fuente de verdad más estricta.
Usa tres capas:
- Descripción canónica: los detalles que no deben cambiar.
- Imagen de referencia: rostro, silueta y paleta aprobados.
- Instrucción de plano: la expresión, pose o movimiento que debe cambiar ahora.
Para un companion de IA, la descripción canónica puede fijar rostro en forma de corazón, ojos ámbar, bob plateado corto, un solo ear cuff negro y bomber carbón con forro rojo. Es más fácil verificar eso que lenguaje vago como «heroína cyberpunk impactante».
¿Cómo crear el retrato ancla en FLUX.2?
Crea el retrato ancla como referencia de producción neutra y legible. Una composición frontal o tres cuartos con luz uniforme da más información útil de rostro y vestuario en generaciones posteriores que un primerísimo plano o sombras dramáticas.
AI Art Create cobra actualmente 6 créditos por imagen FLUX.2. Admite entrada de referencia y ratios cuadrado, vertical y horizontal habituales. Puedes abrir el generador de texto a imagen o revisar los detalles del modelo FLUX.2 antes de empezar.
Usa un prompt con orden fijo:
Detalles cortos y observables ganan a palabras abstractas de personalidad. «Single black ear cuff» es comprobable. «Mysterious energy» no lo es.
Step 1: Genera un pequeño set ancla
Genera varios retratos antes de comprometerte. Compara rostro, silueta del pelo, construcción de la ropa y paleta en lugar de elegir solo por belleza general.
La comparación de modelos lado a lado ayuda aquí: el mismo texto puede producir interpretaciones de personaje notablemente distintas según el modelo.
Step 2: Aprueba una fuente visual de verdad
Descarga el retrato más sólido y trátalo como referencia canónica. No alternes entre varias caras «casi correctas». Eso introduce ambigüedad en cada decisión posterior.
Anota la descripción canónica junto a la imagen. El texto protege detalles que pueden quedar ocultos en una pose concreta.
Step 3: Cambia una variable por generación
Sube la referencia y pide un solo cambio controlado:
Si cambias expresión, ángulo de cámara, outfit y ubicación a la vez, no sabrás qué instrucción causó el drift de identidad.
¿Cómo construir un pack de expresiones sin perder la cara?
Construye packs de expresiones desde un retrato neutro estable y mantén el encuadre consistente. Genera estados neutral, happy, concerned, surprised y annoyed por separado. Revísalos al tamaño en que realmente se mostrarán.
Durante un chat de companion, un retrato de reacción puede mostrarse a unos pocos cientos de píxeles de ancho. Pequeños cambios en cejas y boca se leen con claridad. Joyería extra y textura de tela intrincada a menudo se convierten en ruido.
En PNGTubers, los estados boca abierta y boca cerrada necesitan posición de cabeza y silueta casi idénticas. AI Art Create genera las imágenes fuente, pero el cambio reactivo sigue en software como Veadotube Mini o una configuración OBS. El workflow de assets VTuber cubre ese traspaso.
¿Cómo animar un personaje consistente con Kling AI?
Anima el still aprobado en lugar de reconstruir el personaje con texto a video. Kling 3.0 Pro acepta referencia de imagen y produce clips de 5 o 10 segundos en el catálogo actual. Cada solicitud cuesta 100 créditos.
Mantén el movimiento breve y acotado:
Una acción clara es más segura que una secuencia de gestos. Un prompt que pide girar, caminar, coger un objeto, hablar y moverse por un entorno nuevo da al modelo de video más oportunidades de reinterpretar la fuente.
Usa Wan 2.2 para pruebas de 5 segundos más baratas a 45 créditos. Usa Kling 3.0 Pro cuando la continuidad facial y el lenguaje de cámara dirigida importen más que el coste de iteración.
¿Qué causa drift facial en imagen a video?
El drift facial suele crecer cuando la cara queda oculta, muy pequeña, muy rotada o con motion blur. Movimientos rápidos de cámara e interacciones complejas también obligan al modelo a inventar información que no era visible en el fotograma fuente.
Reduce el riesgo con estas restricciones:
- Mantén la cara legible en el primer fotograma.
- Pide un solo beat de movimiento.
- Evita un giro de perfil completo cuando la referencia solo muestra el frente.
- Mantén las manos lejos de la cara en pruebas tempranas.
- Usa cámara estática antes de probar órbita o push-in rápido.
- Revisa el último fotograma, no solo el primer segundo atractivo.
Ningún motor coherente de texto a video garantiza identidad. Imagen a video guiada por referencia simplemente da al modelo menos que inventar.
¿Cuándo usar un artista humano?
Usa un artista humano cuando la repetibilidad exacta es un requisito de producción. Hojas de modelo para animación, sistemas de mascota con licencia y personajes de marca de pago necesitan corrección deliberada, turnarounds limpios y reglas de construcción documentadas.
La generación con IA es más fuerte en exploración y producción de bajo riesgo: retratos de companion, clips sociales, tableros de concepto y experimentos de reacción. Puede acotar la dirección rápido. No debe presentarse como sustituto de dirección de arte final cuando cada línea debe coincidir.
Empieza el workflow de personaje
Comienza con un retrato claro. Crea una referencia de personaje companion, compara modelos de imagen y anima solo cuando la identidad se sienta correcta. Tu primera generación es gratis, sin tarjeta de crédito.
Autor: AI Art Create
Experto en imagen y video con IA
Creador y autor de workflows de IA en AI Art Create. Enfoque en pipelines prácticos de imagen, video y streaming.