Cómo hicimos el video de cinco segundos de nuestra página de inicio
El video principal compara a la misma bailarina en blanco y negro y en neón 3D. Estas notas documentan los archivos reales, las decisiones de edición y las partes del resultado que tuvimos que corregir.
Notas de producción de Genjutsu AI · Responsable: YUAN JUN
Prueba: 6 de octubre de 2026 · Publicación: 7 de octubre de 2026
Materiales y ajustes
- Cambio de personaje
- 10 segundos · 960 × 720 · 30 fps · entrada 4:3
- Referencia del personaje
- Una imagen con cinco vistas de la misma bailarina con gafas
- Modelo
- Higgsfield Genjutsu Motion Transfer v1.0
- Cambio de estilo
- Primeros 5 segundos del original generado · solicitud en 720p
- Estilo seleccionado
- Neon Graphic Cinematic 3D
- Archivo para la web
- 1280 × 720 · H.264 MP4 · 24 fps · 5 segundos

Las dos versiones antes de añadir la división deslizante
Definir un personaje coherente
La primera generación usó un clip de actuación de diez segundos en 4:3 para guiar el movimiento y el encuadre. La referencia mostraba a una bailarina ficticia de frente, de perfil y en planos más cercanos. Pedimos el mismo rostro, peinado, traje y gafas de montura negra en todas sus apariciones, incluidas las figuras pequeñas del fondo. La actuación original es una entrada independiente: este caso no afirma que nosotros grabáramos ese material.
Las gafas solo aparecían en algunos planos del original. Mantenerlas durante toda la nueva versión redujo las instrucciones contradictorias sobre cuándo debían aparecer. También hubo que revisar el gesto de tocar las gafas al final. Una referencia coherente ayuda, pero no demuestra que cada rostro lejano o movimiento rápido de manos se haya reproducido bien.
Cambiar el estilo desde el archivo original generado
Para la segunda generación usamos los primeros cinco segundos del original generado del personaje, no una vista previa comprimida para la web. La entrada conservó 1112 × 834 y contenía 120 fotogramas a 24 fps. Seleccionamos el ajuste real Neon Graphic Cinematic 3D en la API Genjutsu Restyle, solicitamos 720p y no añadimos otra imagen de personaje: ya estaba presente en el video.
El archivo devuelto no mantuvo el tiempo de la entrada. Su pista de video duraba 4,6875 segundos: 75 fotogramas a 16 fps. La primera transformación también había devuelto unos 9,71 segundos de una entrada de diez. Por eso revisamos los archivos antes de montar la comparación y no prometemos duración exacta, igual frecuencia de fotogramas ni movimiento idéntico cuadro a cuadro.
Alinear por planos, no estirar todo el clip
Un solo cambio de velocidad no alineaba todos los cortes. El baile grupal empezaba en 1,125 segundos en blanco y negro y en 1,0625 en neón. El primer plano del rostro comenzaba en 4,0833 y 3,8125 segundos, respectivamente. Fijamos primero los límites de cada plano y después ajustamos los fotogramas dentro de cada uno, respetando su orden.
Usamos los 75 fotogramas neón en su secuencia original sobre una línea de tiempo de 120 fotogramas. No invertimos la reproducción ni generamos fotogramas mediante flujo óptico; algunos se repiten. Exportar a 24 fps permite compartir una línea de tiempo, pero no crea 24 fotogramas de movimiento distintos por segundo para neón. La capa en blanco y negro conservó su ritmo.
Aplicar el mismo recorte a las dos versiones
La composición original era 4:3. Para llenar una portada ancha aplicamos a ambas versiones el mismo recorte central de 16:9, eliminando aproximadamente el 12,5% de la altura original por arriba y por abajo. Exportamos en 1280 × 720 sin deformar las proporciones. El recorte elimina parte de la imagen y requiere cierta ampliación: un archivo 720p no equivale a nuevos detalles reales.
En pantallas estrechas, el ajuste cover del sitio puede ocultar más de la escena que en escritorio. El título y los botones son elementos de la página, no parte del video, para seguir siendo legibles y utilizables en diferentes tamaños.
Incorporar la transición en un solo video
Los primeros 0,25 segundos muestran blanco y negro. De 0,25 a 2,25 segundos, una línea vertical revela neón de izquierda a derecha. Neón llena el cuadro hasta 2,50 segundos; la línea vuelve hasta 4,50 segundos y recupera blanco y negro. El último medio segundo vuelve a ser blanco y negro. Las dos capas avanzan durante todo el recorrido.
El resultado es un solo MP4 de cinco segundos y no depende de mantener dos reproductores web sincronizados. La máscara termina donde empezó, pero la actuación tiene un corte entre su último y primer fotograma. Lo describimos como comparación en bucle, no como una actuación continua sin salto. El sitio ofrece pausa y respeta la preferencia de movimiento reducido.
Qué demuestra esta prueba y cuáles son sus límites
El archivo final tiene 120 fotogramas y cinco segundos, y pasó una comprobación completa de decodificación sin errores. Revisamos los cortes y muestras de la transición. Esto respalda el formato y el método descritos, pero no demuestra que todos los rostros, dedos o contornos estén libres de defectos. El estilo neón reinterpretó detalles de la cara, el cabello, los gestos y las siluetas.
Usamos dos solicitudes de generación: una de personaje y una de estilo. El ajuste temporal, el recorte y la composición posteriores se hicieron localmente. No verificamos la factura final del proveedor, así que no presentamos su estimación previa como costo confirmado. Los créditos del sitio tienen sus precios en una página aparte. El comportamiento del modelo y los ajustes disponibles pueden cambiar después de esta prueba.
Este es nuestro proceso de generación y edición, separado de los ejemplos comunitarios con atribución en la portada. Cambiar un personaje no concede derechos sobre el material o la música originales; estas notas no acreditan una licencia. Para tu proyecto, usa clips y referencias que tengas permiso para procesar, revisa todo el resultado y conserva el archivo original antes de editar.