Cree vídeos conectados a partir de un mensaje, un primer y último fotograma o un conjunto completo de referencias visuales y de audio. El generador de video con IA Seedance 2.5 combina IA de texto a video, IA de imagen a video, dirección de tomas múltiples y sonido sincronizado en un flujo de trabajo centrado en la producción.
Seedance 2.5 es el modelo de vídeo multimodal de ByteDance para una creación audiovisual más larga y controlable. Admite IA de texto a video, IA de imagen a video con primer y último cuadro opcionales, y generación basada en referencias utilizando imágenes, videoclips y pistas de audio.
Una solicitud puede producir un vídeo de IA de hasta 30 segundos con varias tomas conectadas lógicamente. Esto le da a la escena espacio para una apertura, desarrollo, transición y recompensa en lugar de mantener una composición durante todo el clip.
El anuncio del modelo destaca la salida nativa 4K, mientras que los controles de generación actualmente disponibles aquí brindan salida 480p, 720p y 1080p. Esta distinción le permite elegir solo las configuraciones que acepta la API conectada y, al mismo tiempo, comprender la especificación más amplia del modelo Seedance 2.5.
Combine hasta 30 imágenes, 10 clips de vídeo y 10 pistas de audio en un resumen de generación de vídeo multimodal. Asigne a cada recurso una función clara para la identidad del personaje, los detalles del producto, el estilo visual, el diseño de la escena, el lenguaje de la cámara, el movimiento, la voz o la atmósfera.
Genera hasta 30 segundos en una carrera y describe una secuencia deliberada de disparos. Una duración más larga respalda las revelaciones de productos, arcos narrativos cortos, escenas de estilo de vida, avances y anuncios sociales con un comienzo y un final más claros.
Convierta un informe escrito en una secuencia estructurada. Especifica sujetos, acciones, posición de la cámara, comportamiento de la lente, iluminación, ritmo, transiciones, diálogo y sonido para que cada toma sirva a la misma idea creativa.
Anima un primer fotograma o utiliza el primero y el último fotogramas juntos cuando la composición inicial y final sea importante. El modo guiado por cuadros está separado de la generación de referencia multimodal, lo que deja claro el tipo de control previsto.
Genere video y sonido juntos para lograr una sincronización audiovisual más ajustada. Las indicaciones pueden describir el diálogo, el ambiente, los efectos y la intención musical junto con la acción visible, mientras que la generación de audio también se puede desactivar cuando se prefiere una fuente silenciosa.
Utilice imágenes de productos, referencias de campañas y dirección de movimiento para planificar exhibiciones de productos, escenas de estilo de vida, campañas de temporada, activos de mercado y creatividades sociales donde los detalles claros y el lenguaje visual consistente sean importantes.
Haga coincidir el modo de generación con el material original, dé un propósito a cada referencia y describa la secuencia como una serie de tomas intencionales.
Utilice IA de texto a video para un concepto de solo indicaciones, IA de imagen a video cuando la composición primera o final deba estar anclada, o generación de video multimodal cuando las imágenes, clips y audio deban guiar diferentes partes del resultado.
Describe el tema, el escenario, la acción, el orden de las tomas, el movimiento de la cámara, la iluminación, los materiales, el diálogo, el ambiente y el final. En modo de referencia, explique exactamente qué debe controlar cada activo subido.
Elija una duración de 4 a 30 segundos, una relación de aspecto compatible, una resolución 480p, 720p o 1080p y si desea generar audio. Revise la continuidad, los detalles del producto, el movimiento, el sonido y las transiciones antes de perfeccionar el mensaje.
Describe una secuencia de tomas en lugar de una larga lista de detalles visuales.
Dé a cada archivo de imagen, vídeo y audio de referencia un único propósito claro
Indicar qué rostros, ropa, productos, logotipos y colores deben permanecer consistentes.
Separe la dirección de la cámara, el movimiento del sujeto, la iluminación, el diálogo y el sonido en el mensaje
Utilice el primer y último fotograma cuando las composiciones exactas de apertura y final sean más importantes
Revise el texto generado, los detalles del producto, las manos, los rostros, el movimiento y el audio antes de publicar.
Seedance 2.5 es el modelo de video de IA multimodal de ByteDance para generar videos conectados a partir de texto, primer y último cuadro, o referencias de imagen, video y audio. Admite audio sincronizado opcional y hasta 30 segundos de salida a través del flujo de trabajo conectado.
Para Seedance 2.5 frente a Seedance 2.0, el modelo más nuevo amplía la duración del vídeo, el control de referencia multimodal, la planificación previa a la generación, el control de edición y las capacidades de salida publicada del modelo. Estos cambios hacen que Seedance 2.5 sea más adecuado para escenas más largas, activos de marca y flujos de trabajo de video con IA centrados en la producción.
El flujo de trabajo de referencia acepta hasta 30 imágenes, 10 videoclips y 10 pistas de audio. Los videos de referencia pueden durar hasta 30 segundos y a cada activo se le debe asignar una función clara en el mensaje.
Sí. La API conectada admite duraciones de vídeo de 4 a 30 segundos. Una secuencia de tomas detallada ayuda al modelo a utilizar el tiempo extra para acciones y transiciones conectadas en lugar de una sola escena persistente.
Sí. El audio se puede generar junto con el vídeo. Describe el diálogo, el ambiente, los efectos de sonido o la intención musical en el mensaje, o desactiva la generación de audio cuando necesites un clip silencioso para una posproducción posterior.
El anuncio del modelo Seedance 2.5 describe la salida nativa 4K. El generador conectado actualmente expone las configuraciones de 480p, 720p y 1080p, así que seleccione entre las resoluciones disponibles para las solicitudes realizadas en esta página.
Puede admitir exhibiciones de productos, escenas de estilos de vida, conceptos de campañas, activos del mercado y anuncios sociales. Utilice referencias de productos claras, conserve la geometría y la marca importantes en el mensaje y revise cada resultado para obtener detalles precisos antes de publicarlo.
El uso comercial depende de los términos de servicio activos y de sus derechos sobre cada mensaje, imagen, clip, archivo de audio, logotipo, persona y carácter utilizado como entrada. Revise esos derechos y el resultado final antes de la distribución.
Convierta un mensaje, un par de fotogramas o un conjunto de referencia multimodal en un vídeo de IA conectado con audio sincronizado opcional.
Planifica las tomas, asigna un propósito a cada referencia, elige las configuraciones de salida disponibles y genera tu primer video Seedance 2.5.
Cree texto a video, imagen a video y video AI multimodal con Seedance 2.5.