Tecno

Seedance 2.5: video con IA de hasta 30 segundos por toma

El nuevo modelo de generación audiovisual permite crear clips de hasta 30 segundos en una sola pasada, extenderlos con múltiples referencias y editarlos con precisión de milisegundos, con resultados que buscan acercarse a la calidad de una filmación real.

Por Administrador 2 min de lectura42 visualizaciones

Un modelo de inteligencia artificial presentó su nueva generación para la creación de video, con mejoras que apuntan a transformar clips sueltos en piezas narrativas completas. Se trata de Seedance 2.5, sucesor de la versión 2.0, que amplía sus capacidades de generación conjunta de audio y video.

El desarrollo responde a un cambio de expectativas de los usuarios: ya no buscan solo generar una escena aislada, sino completar una obra creativa con inicio, desarrollo y cierre.

Clips más largos y extensiones narrativas

El modelo puede generar clips de hasta 30 segundos en una sola pasada, el doble que su versión anterior, y permite extenderlos en múltiples rondas manteniendo la coherencia de personajes, escenarios y ritmo narrativo.

Según los ejemplos difundidos, dentro de esos 30 segundos el sistema puede organizar varias tomas conectadas lógicamente para que una historia se desarrolle con planteo, nudo y desenlace, en lugar de estirar un único momento. Un caso mostrado es el de una cantante que interactúa con su equipo en el camarín, camina por el pasillo backstage, se encuentra con los bailarines y sube al escenario para su actuación.

Gracias a la función de extensión multirronda, los usuarios pueden encadenar nuevas tomas sobre videos ya generados, produciendo contenido de varios minutos sin necesidad de cortar y volver a unir fragmentos manualmente.

En cuanto a la calidad visual, la empresa afirma haber optimizado texturas de objetos, piel, ojos, iluminación y saturación de color, además de reducir apariciones no controladas de subtítulos o música de fondo, con el objetivo de acercar el resultado final a una filmación real.

Referencias múltiples y edición por marcas de tiempo

Otro de los ejes de la actualización es la posibilidad de usar hasta 30 imágenes, 10 clips de video y 10 clips de audio como material de referencia en una sola generación. Esto permite reconstruir escenas con múltiples personajes, mantener sus voces y apariencias estables, y lograr movimientos de cámara más flexibles.

Entre las funciones específicas se incluyen:

  • Referencia por clay render, que permite definir la estructura espacial, las poses y los recorridos de cámara mediante modelos 3D sin textura, que luego el sistema traduce en un video con iluminación realista.
  • Referencia de movimiento y referencia creativa, para un control más fino de sujetos, acciones y encuadres.
  • Edición con control a nivel de marca de tiempo, que permite ajustar el momento exacto de una acción, un corte de cámara o un movimiento de un personaje sin regenerar todo el clip.

También se mejoraron funciones de edición avanzada como pantalla verde, cambio de perspectiva de cámara y edición basada en referencias, pensadas para usos profesionales en cine y publicidad.

El modelo ya está disponible en plataformas como Jimeng AI y Doubao Pro, y próximamente se sumará el acceso vía API a través de BytePlus ModelArk.

Publicidad

Comentarios

Ingresá para comentar — leer es gratis, comentar también.

Todavía no hay comentarios. Sé el primero en opinar.

Notas relacionadas