ES
BIBLIOTECA SEEDANCE / 01
ModelArkSeedance 2.5

Dreamina Seedance 2.5
Guía de prompts

Actualizado: 31 de agosto de 2026 · Idioma original: inglés · Referencia local sin conexión

Introducción general

Esta guía presenta técnicas y consejos para redactar prompts para Dreamina Seedance 2.5, ayudándote a generar vídeos de alta calidad que cumplan tus requisitos con mayor eficiencia.

Instalar la habilidad de optimización

Se recomienda utilizar la Habilidad Seedance 2.5 para optimizar tus prompts.

npx --yes skills@latest add \
  "https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" \
  --skill sd25-pe \
  --yes

En cualquier chat de IA, escribe /sd25-pe + tu prompt para empezar a optimizar.

Capacidades generales

Capacidades multimodales típicas

Seedance 2.5 soporta combinaciones flexibles de entradas multimodales (texto, imágenes, vídeo, audio). La tabla lista las capacidades más comunes.

Tipo de tareaTareas R2V soportadasDescripción detallada
ReferenciaReferencia del sujetoReferencia apariencia/identidad/voz de persona, objeto, escena o personaje virtual.
• Referencia de imagen del sujeto
• Referencia de audio y vídeo del sujeto
• Referencia de imagen y audio del sujeto
Referencia de movimientoReferencia movimiento e información dinámica de vídeos.
• Acción/expresión/movimiento de cámara/creatividad/efectos
• Referencia de movimiento y sujeto
Referencia y renderizado de modelos 3D de arcillaUsa vídeos modelo 3D de arcilla gruesos o finos como referencia de movimiento y los renderiza en el estilo visual objetivo.
• Referencia de modelo 3D de arcilla
• + referencia del sujeto
• + referencia del sujeto y de la escena
Referencia de estiloReferencia estilo visual de imágenes o vídeos.
• Referencia de estilo mediante imagen o vídeo
• + referencia del sujeto
Referencia de audioReferencia info de audio: música, diálogo, voz, timbre.
• Referencia de audio: música, melodía, diálogo o voz
• + referencia del sujeto
Referencia de guion gráficoReferencia info de guion gráfico: sujetos, composición, acciones, trama, progresión de escenas.
• Referencia de guion gráfico
• + referencia del sujeto
Referencia de fotogramas claveUsa una o más imágenes como fotogramas clave para generar vídeo.
• Referencia de múltiples fotogramas clave
• Referencia del primer y último fotograma clave
Primer y último fotogramaGenera vídeo desde una imagen de primer fotograma o dos imágenes (primero y último fotograma). Se controla mediante content.role = first_frame/last_frame.
EdiciónEdición de vídeo mediante instruccionesUsa instrucciones de texto para añadir, eliminar o modificar elementos visuales en un vídeo, con soporte de marcas de tiempo. Añadir, modificar, eliminar sujetos, estilos, fondos, movimientos, subtítulos, marcas de agua, etc.
Edición de vídeo con imágenes de referenciaTexto + imágenes de referencia para añadir/eliminar/modificar con marcas de tiempo.
Edición de audioAñade, elimina o modifica audio en vídeo.
• Añadir: voces, música y efectos de sonido
• Modificar: voces, música y efectos
• Eliminar: voces, música y efectos
ExtensiónExtensión de vídeoContinúa el vídeo hacia adelante o hacia atrás con continuidad visual y de audio.
• Extender hacia adelante o hacia atrás
• + referencia del sujeto
OtrasCreación de vídeo con un clicGenera un vídeo corto desde múltiples imágenes y/o vídeos, con texto, pegatinas, transiciones, etc.
• Creación con un clic a partir de recursos
• + vídeo de referencia
Transición fluida entre vídeosToma dos vídeos y genera el segmento intermedio para crear una transición sin costuras.
Capacidades combinadasCombinación libre de las capacidades anteriores.

Instrucciones de las tareas

Seedance 2.5 divide las tareas en dos categorías según si el recurso de referencia bloquea o no las propiedades del vídeo de salida. Seedance 2.0 no hace esta distinción.

Con bloqueo: edición, primer y último fotograma, y extensión

TareaDefiniciónInstrucciones de bloqueo de salidaPalabras clave de activación en el prompt
Edición Edita los visuales o audio del vídeo original: reemplazar sujeto, añadir/eliminar/modificar objetos, redibujar parte del fotograma. • Bloquea la relación de aspecto de salida (debe coincidir con el vídeo a editar). Parámetro ratio = adaptive.
• Bloquea la duración (~alineada con el vídeo a editar). Parámetro duration = -1.
• Si hay múltiples vídeos de entrada, el modelo determina cuál editar por el prompt.
• Diferencia máxima de duración: ~0.3 segundos (solo comprime algunos fotogramas de transición).
• Si el vídeo fue generado por Seedance 2.5, no habrá diferencia de duración.
• Recomendado: output_format = mov.
Fijar content.role a reference_image, reference_video, o reference_audio.
Al menos una palabra de activación de edición en el prompt: editar vídeo, añadir, insertar, quitar, eliminar, modificar, reemplazar, cambiar a, etc.
Ejemplo: «Añade animales pequeños a @video1; reemplaza el personaje de @video1 por @image1; elimina la música de fondo de @video1».
Primer fotograma / Primer y último fotograma Usa una imagen como primer fotograma para generar vídeo, o dos imágenes como primer y último fotograma. • Bloquea la relación de aspecto (coincide con la imagen del primer fotograma). Parámetro ratio = adaptive.
• Si el último fotograma tiene diferente relación de aspecto, se estirará. Usar siempre el mismo relación de aspecto para ambos.
• Duración: definida por el usuario.
Fijar content.role a first_frame o last_frame.
Extensión Extiende el vídeo original hacia adelante o hacia atrás. • Bloquea la relación de aspecto (coincide con el vídeo a extender). Parámetro ratio = adaptive.
• Duración: definida por el usuario.
• Recomendado: output_format = mov.
Fijar content.role a reference_image, reference_video, o reference_audio.
Al menos una palabra de activación de extensión: extender hacia adelante, extender hacia atrás, continuar, continuar desde, ampliar la historia, etc.
Ejemplo: «Extiende @video1 hacia atrás: el personaje de @image1 cae del cielo…».

Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave

Las tareas basadas en referencias generalmente no bloquean la relación de aspecto ni la duración según los recursos de entrada.

Capacidad R2VEstrategia de inferenciaIlustración
Guion gráfico de varios paneles Los visuales generados NO se alinean estrictamente con el guion gráfico. Al introducir un guion gráfico de múltiples paneles (múltiples fotogramas combinados en una imagen), el vídeo generado no se alinea estrictamente con el guion gráfico en detalles visuales específicos. El guion gráfico proporciona principalmente una referencia de alto nivel de la trama.

Se recomienda usar guiones gráficos de línea de arte relativamente simples y usar el prompt para rellenar información no mostrada en el guion gráfico.
Ilustración guion gráfico
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotogramas clave Los visuales generados se alinean con los fotogramas clave. Introduce varias imágenes independientes de guion gráfico como fotogramas clave; pueden incluir el primer o el último fotograma. Las imágenes del vídeo generado se ajustarán de manera relativamente estricta a las imágenes de entrada.
Duración: definida por el usuario.
Fotograma clave 1
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotograma clave 2
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotograma clave 3
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotograma clave 4
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotograma clave 5
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotograma clave 6
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Fotograma clave 7
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave

Recomendaciones para los recursos de referencia

Seedance 2.5 soporta hasta 50 recursos de referencia por solicitud (imágenes, audio, vídeos). Para aprovechar al máximo el modelo:

Caso de usoRecomendaciones de entrada
Límites totales• Imágenes: hasta 30, resolución hasta 4K
• Vídeos: hasta 10, duración total ≤ 30 s
• Audio: hasta 10 clips, duración total ≤ 30 s
¿Cuántos sujetos conviene incluir en las referencias de audio o vídeo?1-5 sujetos producen mejores resultados. 6-10 sujetos puede reducir la estabilidad.
¿Qué duración deben tener las referencias de audio o vídeo?5-10 segundos funciona mejor. Entradas más largas pueden reducir la estabilidad.
¿Cuántos sujetos conviene incluir en las referencias de imagen?1-8 sujetos producen mejores resultados. 9-12 puede reducir estabilidad.
¿Múltiples vistas o una sola vista?• 1-5 sujetos: ambas soportadas
• Más de 5 sujetos: una sola vista suele ser más estable. Si necesitas varios puntos de vista, utiliza imágenes separadas para cada vista.
¿Cuántos paneles debe tener el guion gráfico de referencia?≤ 15 paneles actualmente es mejor. Usar guiones gráficos de figura de palo o línea de arte. Evitar añadir texto directamente en la imagen.
¿Modelo de arcilla simplificado o detallado?Modelo de arcilla 3D simple y grueso generalmente funciona mejor como referencia. Usar solo primitivas geométricas simples para representar personas, objetos, animales.
¿Qué longitud de vídeo para edición?Vídeos de ≤ 20 segundos producen mejores resultados. Vídeos más largos pueden reducir la estabilidad.
¿Cuántas imágenes para edición con referencias?1-5 imágenes producen mejores resultados. 6-8 puede reducir estabilidad.
¿Qué formato para extensión?Usar formato mov tanto para entrada como salida para mejor continuidad audio-visual.

Recomendaciones básicas de escritura de prompts

Trata a Seedance 2.5 como un productor de contenido visual y escribe prompts estructurados con mentalidad de narración visual.

Estructura recomendada

  1. Asignación de referencias: Identifica claramente cada imagen/vídeo/audio por su orden de subida y su propósito (sujeto, voz, acción, escena…)
  2. Resumen en una frase: Sujeto + Ubicación + Evento + Género/Estilo + Movimiento de cámara…
  3. Descripción detallada de la trama: Secuencia de planos o línea de tiempo con marcas de tiempo o "Plano N". Describe visuales específicos, movimiento de cámara, acciones, diálogos, efectos de sonido por segmento. Usar descripciones positivas siempre que sea posible.
  4. Notas adicionales: Detalles visuales que deben mantenerse consistentes (ángulo de cámara, ambiente, sonido, atmósfera).

Ejemplo completo: cría de panda

Estilo de documental de naturaleza realista, con luces y sombras naturales. En una tarde cálida, una cría de panda regordeta rueda cuesta abajo por una ladera de hierba en el bosque. El panda tiene un pelaje blanco y negro esponjoso y realista, un cuerpo pequeño y redondo, y movimientos torpes y adorables. La escena es una ladera verde del bosque. El suelo está cubierto de hierba, musgo, tréboles, tierra, pequeñas piedras, ramas secas y algunas florecillas amarillas. Al fondo, los troncos altos y la vegetación densa aparecen suavemente desenfocados. La cámara encuadra un plano medio amplio desde un ángulo bajo, con una ligera sensación de cámara en mano. 0–3 s: Una cría de panda yace sobre una ladera verde, con su cuerpo redondo y regordete. Comienza a rodar lentamente de lado cuesta abajo con movimientos torpes, doblando suavemente la hierba bajo su cuerpo. Sopla una brisa ligera y la luz del sol se filtra entre los árboles desde la parte superior izquierda, creando un patrón de luces y sombras. 3–8 s: El panda rueda hacia la parte inferior derecha del encuadre y se detiene poco a poco, pasando de estar tumbado de lado a quedar boca abajo. Gira su cara redonda hacia la cámara y apoya las patas delanteras sobre la hierba. Tumbado en la hierba del primer término, se acomoda, levanta y baja ligeramente la cabeza, y emite un pequeño murmullo suave. Cámara a baja altura, con una ligera sensación de cámara en mano, que sigue sutilmente al panda mientras se desplaza hacia la parte inferior derecha. Profundidad de campo natural: la hierba del primer término queda ligeramente desenfocada, el panda permanece nítido y el bosque del fondo aparece suavemente desenfocado. Solo sonido ambiental natural: viento, roce de la hierba y el suave golpe del panda al rodar. El ambiente general es cálido, realista y natural.
Resultado
Resultado: cría de panda rodando

Tareas de referencia: asignación de múltiples recursos

A medida que aumenta el número de recursos de referencia, las relaciones de asignación entre ellos se vuelven especialmente importantes.

  • La numeración debe corresponder al orden de subida: Imagen 1 / Vídeo 1 / Audio 1
  • Cada recurso debe estar vinculado explícitamente en el texto del prompt
  • No recomendado: Proporcionar información de mapeo solo dentro de la imagen (p. ej., escribir "John" en la imagen del protagonista y luego decir solo "John está en la escuela...")

Para múltiples sujetos, listar las relaciones de mapeo una por una:

  • «El caballero de la Imagen 1».
  • «Las Imágenes 1–2 corresponden al Personaje 1 y al Audio 1; las Imágenes 3–4 corresponden al Personaje 2 y al Audio 2».
  • «La Imagen 1 muestra al protagonista John, que utiliza el timbre de voz del Audio 1».

Especificar el rol de cada recurso claramente:

  • «Toma como referencia la acción de lanzar el hechizo del Vídeo 1 y el movimiento de cámara envolvente del Vídeo 2».
  • «Toma la Imagen 1 como referencia para la iluminación y los filtros».

Cuando el recurso de referencia es suficientemente preciso, basta con indicar que se haga referencia. Evitar describir la escena repetidamente en detalle:

  • «Sigue estrictamente las acciones y los movimientos de cámara del Vídeo 1, y mantén una secuencia coherente con el vídeo». (No hace falta describir levantar la mano, girarse, etc.)

Tareas de edición

Clarifica el alcance y el contenido a modificar. Se pueden usar marcas de tiempo para ediciones parciales. Siempre que sea posible, describir cómo debe cambiar el contenido de A a B.

  • «Edita únicamente el diálogo del hombre del Vídeo 1: cámbialo por “No te acerques” y ajusta el acento para que sea de inglés estadounidense…».
  • «Entre los segundos 4 y 6 del Vídeo 1, cambia la acción del hombre de beber café a fregar el suelo y mantén el resto del contenido sin cambios».
  • «Tarea de edición: sustituye a la mujer asiática de la derecha del Vídeo 1 por la mujer latina de la Imagen 1».

Primer y último fotograma

  • Priorizar fijar el rol de la imagen mediante parámetros como first_frame o last_frame. Este método bloquea la relación de aspecto de salida alineándolo estrictamente con la imagen del primer fotograma.
  • El rol también puede fijarse como reference_image, con las imágenes específicas designadas en el prompt como primer y último fotograma. Este método no bloquea la relación de aspecto.
  • «La Imagen 1 es el primer fotograma».
  • «La Imagen 3 es el primer fotograma y la Imagen 5 es el último».

Marcas de tiempo

Las marcas de tiempo ayudan a clarificar la progresión de la historia. Usar intervalos de 1 segundo como unidad básica.

Si se especifica muy poca trama en un rango de tiempo, el modelo puede improvisar más libremente. Si se empaqueta demasiado contenido, el resultado puede contener demasiados cortes u omitir partes de la trama.

No recomendado: Usar marcas de tiempo para controlar acciones de alta frecuencia (p. ej., "sacude la cabeza tres veces por segundo").

Métodos soportados

  • Intervalos claros: 0-3s... 3-7s... 7-15s o [1s-4s]...[4s-8s]...[8s-12s]
  • Control de punto temporal: «Transición lateral rápida hacia la izquierda en el segundo 5».
  • Control de tiempo relativo: «John permanece allí con la mirada perdida. Al cabo de 3 segundos, todos los que lo rodean niegan con la cabeza». / «La imagen se congela durante 1 segundo después de que el protagonista pulse el disparador».

Control negativo

Soporta control negativo para subtítulos y para dimensiones de audio más finas:

  • «No añadas subtítulos». / «Sin subtítulos».
  • «Sin música de fondo; genera únicamente sonidos ambientales y de las acciones».
  • «Sin audio».

Técnicas avanzadas para redactar prompts

Lenguaje de cámara

  • Términos básicos directos: tamaño de plano (gran plano general / plano general / plano medio / primer plano medio / primer plano), movimiento (acercamiento / alejamiento / panorámica / desplazamiento / seguimiento / órbita / descenso en picado / retroceso / inclinación hacia arriba / vibración de cámara en mano), ángulo (contrapicado / plano cenital / perspectiva en primera persona)
  • Técnicas comunes directas: plano secuencia o toma larga, efecto de vértigo o zoom de Hitchcock, perspectiva aérea, vista en primera persona (FPV), efecto de tiempo bala, cámara en mano y variación de velocidad
  • Términos técnicos de nicho: convertir en [término + explicación descriptiva]. P. ej., «Cambio de foco: el enfoque se desplaza suavemente; los árboles del primer término, que al principio estaban nítidos, se desenfocan, mientras que el personaje del fondo gana nitidez de forma gradual».
  • Planos de transición: Especificar tanto el punto de disparo como el método de transición. P. ej., «En el segundo 5, la cámara realiza una transición rápida hacia la izquierda con un barrido lateral combinado con un fundido natural».

Acciones y expresiones

  • Acciones: Priorizar descripciones generales. Solo escribir detalles específicos para pocas acciones memorables. Evitar repetir las mismas acciones.
  • Expresiones: Usar oraciones descriptivas y reducir el uso de modismos.

Referencia y renderizado de modelos 3D de arcilla

  • Indicar claramente qué elementos del vídeo modelo de arcilla deben referenciarse:
    • Si no hay cambios de iluminación y solo quieres referenciar movimiento de cámara y movimiento: «Toma como referencia el movimiento de cámara y el movimiento de [Video 1]…».
    • Si el vídeo incluye cambios de iluminación que también deben referenciarse: «Toma como referencia los cambios de iluminación, el movimiento de cámara y el movimiento de [Video 1]…».
  • Si también se proporcionan imágenes de referencia, especificar claramente el mapeo entre imágenes y vídeo modelo de arcilla: «Asigna al hombre de ropa gris de [Image 1] al modelo rojo de [Video 1], y sustituye el modelo verde 2 de [Video 1] por la chica pelirroja de [Video 2]».
  • Incluso cuando se proporciona un vídeo modelo de arcilla, describir el contenido deseado en detalle para mejores resultados. Describir la apariencia del sujeto y sus características clave.

Guiones gráficos de varios paneles

Evitar demasiados paneles: Actualmente mejor con ≤ 15 paneles. Demasiados paneles (p. ej., 18) pueden provocar fotogramas estáticos o orden incorrecto de secuencias.

Guiones gráficos no recomendados (ejemplos)

Guiones gráficos no recomendados (ejemplos)
No recomendado
Guiones gráficos no recomendados (ejemplos)
No recomendado
Guiones gráficos no recomendados (ejemplos)
No recomendado
  • Evitar guiones gráficos ruidosos o sobre-enfocados: No utilices directamente guiones gráficos generados con IA que contengan demasiado texto superpuesto o un exceso de nitidez.
  • Los paneles no se alinean estrictamente con el vídeo final: Un guion gráfico de varios paneles no se sigue fotograma a fotograma. El vídeo tiene cierta autonomía. Para alineación estricta, usar el método de referencia con múltiples fotogramas clave.

Uso recomendado: Guiones gráficos de línea de arte

  1. Paso 1: Indicar claramente las relaciones de mapeo de recursos de referencia.
  2. Paso 2: Escribir un resumen general de la historia.
  3. Paso 3: Describir completamente la trama según el guion gráfico, rellenando al menos la información no mostrada en él. Se pueden usar marcas de tiempo para clarificar la lógica de la historia.

Ejemplo de guion gráfico de línea de arte (drama doméstico)

Guion gráfico (Imagen 1)
Ejemplo de guion gráfico de línea de arte (drama doméstico)
Resultado del ejemplo
Ejemplo de guion gráfico de línea de arte (drama doméstico)
Estilo visual: drama corto doméstico realista, filmado con Arri Alexa Mini LF y objetivo cinematográfico de 35 mm. Iluminación cinematográfica realista, escena interior nocturna con una vista de nieve cayendo de noche a través de la ventana, grano de película, textura de piel auténtica, interpretación natural y creíble, microexpresiones sutiles, estructura ósea y rasgos faciales reales de personas adultas, sin embellecimiento excesivo ni alisado de la piel. Asignación de recursos: guion gráfico @Image1, dormitorio @Image2, Li Tian @Image3, Li Qian @Image4, libro *Tiempos felices* @Image5. Plano 1: [Plano general, cámara fija, a la altura de los ojos, composición según la regla de los tercios] Habitación en una noche de invierno nevada… Plano 2: [Plano medio, plano sobre el hombro] La espalda de la chica ocupa el primer término… Plano 3: [Primer plano medio, composición diagonal] El hombre sostiene el libro *Tiempos felices* y lo extiende lentamente… Plano 4: [Primer plano del rostro de la chica, composición central] La chica aprieta el libro contra el pecho. Sus ojos se enrojecen y las lágrimas descienden lentamente por sus mejillas… Plano 5: [Primer plano del rostro del hombre, composición oblicua] El hombre muestra una leve y suave sonrisa, mientras contempla en silencio a la chica llorosa con melancolía en los ojos. Plano 6: [Plano general, cámara fija] La chica se gira y sale lentamente del encuadre. Solo queda el hombre junto a la ventana, con las manos en los bolsillos, mirando la nieve que arrastra el viento.

Uso de concepto de guion gráfico

Si el guion gráfico es un concepto o diseño de fotograma clave, el prompt puede simplificarse:

«Construye una trama completa siguiendo la secuencia del guion gráfico y utiliza los planos de forma razonable y coherente».

Concepto guion gráfico
Uso de concepto de guion gráfico

Referencia de fotogramas clave

Cuando el vídeo debe seguir estrictamente el guion gráfico, usar referencias de fotogramas clave. Introducir cada guion gráfico como imagen de referencia independiente en orden y declarar en la primera oración del prompt:

«Utiliza las Imágenes X a X, en orden, como fotogramas clave».

Ejemplo (7 fotogramas clave – animación China)

Fotograma clave 1
Ejemplo (7 fotogramas clave – animación China)
Fotograma clave 2
Ejemplo (7 fotogramas clave – animación China)
Fotograma clave 3
Ejemplo (7 fotogramas clave – animación China)
Fotograma clave 4
Ejemplo (7 fotogramas clave – animación China)
Fotograma clave 5
Ejemplo (7 fotogramas clave – animación China)
Fotograma clave 6
Ejemplo (7 fotogramas clave – animación China)
Fotograma clave 7
Ejemplo (7 fotogramas clave – animación China)
Utiliza las Imágenes 1 a 7, en orden, como fotogramas clave. En un mar de nubes y montañas, peces espirituales azules y rosas de larga cola surcan el aire. La cámara avanza lentamente hacia un pueblo antiguo construido en la ladera, centrándose en la antigua pagoda de la cima. A continuación, la escena entra en un elegante salón de estilo chino: el pez espiritual atraviesa la ventana, se posa en el estanque redondo del centro y nada tranquilamente. Finalmente, la perspectiva cambia a un antiguo templo oscuro, donde un monje anciano de barba blanca aparece de espaldas a la cámara, contemplando en silencio un enorme cuadro enmarcado. En el cuadro se ven el salón y el pez espiritual nadando en el estanque. El estilo general es una nueva ilustración china de inspiración ukiyo-e.

Diferencias respecto a Seedance 2.0

CaracterísticaSeedance 2.0Seedance 2.5
Marcas de tiempoNo responde a marcas de tiempo. Solo responde a números de plano.Soporta marcas de tiempo en segundos enteros.
Imágenes de múltiples vistasNo se recomiendan como referencias del sujeto.Las admite como referencias del sujeto.
Relaciones de aspectoSolo 6 relaciones de aspecto de salida fijas.Cualquier relación de aspecto de salida entre [0.4, 2.5] controlando los recursos de entrada.
Calidad de vídeo a vídeo (V2V)Soporta salida MOV para mejor consistencia de color, brillo y audio-visual en tareas de extensión y edición.

Ejemplos de Prompt

El uso de referencias de sujeto, movimiento, audio y estilo se mantiene con respecto a Seedance 2.0. Las siguientes secciones presentan las capacidades de referencia incorporadas en Seedance 2.5.

Modelo 3D de arcilla · Referencia simplificada

Soporta renderizado desde vídeos modelo de arcilla 3D que contienen información dinámica o temporal como movimiento, movimiento de cámara, rutas de movimiento y cambios de iluminación. También soporta imágenes de referencia para sujetos, escenas, elementos de atrezo y otros elementos.

Actualmente funciona mejor con modelado simple. Se recomienda usar solo primitivas geométricas simples para representar personas, objetos, animales.

Entrada

Vídeo de referencia modelo de arcilla (Vídeo 1)

Imágenes de referencia (Imágenes 2–10)

Imagen 2
Imágenes de referencia (Imágenes 2–10)
Imagen 3
Imágenes de referencia (Imágenes 2–10)
Imagen 4
Imágenes de referencia (Imágenes 2–10)
Imagen 5
Imágenes de referencia (Imágenes 2–10)
Imagen 6
Imágenes de referencia (Imágenes 2–10)
Imagen 7
Imágenes de referencia (Imágenes 2–10)
Imagen 8
Imágenes de referencia (Imágenes 2–10)
Imagen 9
Imágenes de referencia (Imágenes 2–10)
Imagen 10
Imágenes de referencia (Imágenes 2–10)

Prompt (fragmento)

Utiliza el vídeo de referencia del modelo 3D de arcilla <video1> como única referencia para el movimiento de cámara, el ritmo de los planos, los cambios de tamaño de plano, la trayectoria del sujeto y la disposición de cámara durante todo el vídeo. Conserva estrictamente el orden de los planos, los cambios de posición de cámara, los patrones de movimiento y el ritmo del vídeo del modelo 3D de arcilla. No cambies la estructura de planos, no añadas planos nuevos ni alteres la lógica de movimiento del sujeto. Utiliza las imágenes de referencia de fotogramas clave de cada etapa para generar un cortometraje de animación 3D de alta calidad de 30 segundos. El estilo general debe ser onírico, de cuento de hadas, cálido y lleno de fantasía infantil… 0–3 s (referencia del primer fotograma: <2pic>): El plano comienza con una vista general cenital y se acerca lentamente a una niña que está en el suelo… 3–5 s (referencia: <3pic>): El avión vuela de izquierda a derecha entre adornos de estrellas colgantes en la habitación… […continúa para cada segmento hasta 30 s] Requisitos generales: Todas las imágenes deben tomar como referencia los fotogramas clave correspondientes. El vídeo del modelo 3D de arcilla solo debe servir de referencia para el movimiento de cámara, su desplazamiento, el ritmo de planos, la disposición de cámara y la animación de personajes. No tomes como referencia su contenido visual. Genera un vídeo de 30 segundos en formato panorámico 16:9.
Resultado
Vídeo de comparación sincronizado

Modelo 3D de arcilla · Referencia detallada

Diseñado para escenarios con modelado completo, con enfoque en re-renderizado. Ayuda a lograr resultados de renderizado más ricos y de mayor calidad "coloreando" el modelo 3D de arcilla.

Proporcionar un vídeo modelo de arcilla fino completo y claro, sin elementos distractores como líneas de trayectoria, líneas de coordenadas, conos de cámara o interferencia visual similar.
Vídeo de entrada (modelo de arcilla fino)
Renderiza el Vídeo 1. Sin música de fondo; genera únicamente sonidos ambientales y de las acciones. Requisitos de renderizado: El fondo es una ciudad ciberpunk nocturna en tonos azul oscuro y morado, densamente poblada de rascacielos. Enormes vallas holográficas y luces de neón brillan entre los edificios. Varios vehículos voladores se desplazan por el cielo, emiten destellos tenues y producen sonidos mecánicos sutiles. El personaje es un pequeño mapache vestido con un traje negro de sigilo, que se percibe principalmente como una silueta. Sus pasos son cautelosos y silenciosos. El personaje se desplaza por la azotea de uno de los rascacielos.
Resultado

Modelo 3D de arcilla · Previsualización de alta dificultad

Vídeo de previsualización

Referencia de guion gráfico de varios paneles

Imágenes de entrada

Imagen 1 – Guion gráfico
Imágenes de entrada
Imagen 2 – Entorno ref.
Imágenes de entrada
Imagen 3 – Robot guardián
Imágenes de entrada
Imagen 4 – Abuela
Imágenes de entrada
Imagen 1: Guion gráfico de nueve paneles, usado como referencia para la estructura general de planos, sus tamaños y el ritmo de movimiento de cámara. Imagen 2: Referencia de imagen real de un lugar de lanzamiento de cohetes en una pradera al anochecer. Imagen 3: Referencia de apariencia del Sujeto 1, el robot guardián. Imagen 4: Referencia de apariencia del Sujeto 2, la abuela anciana. [Configuración de los sujetos] Sujeto 1 (robot guardián): Toma como referencia la Imagen 3. Un robot retro desgastado de un futuro cercano, con cuerpo metálico azul verdoso envejecido, manchas de óxido, cabeza abovedada y dos ojos circulares de cámara que brillan en rojo… Sujeto 2 (abuela anciana): Toma como referencia la Imagen 4. Una anciana frágil, de pelo plateado recogido en un moño bajo, arrugas profundas y un vestido largo hasta el suelo de color dorado brillante… [Estilo general] Película cinematográfica en color y de imagen real, textura fotorrealista, imágenes a todo color durante toda la pieza. Aspecto de película de 35 mm en color, grano fino y realista, gradación de color cinematográfica rica, sensación de gran formato IMAX… [Lista de planos] (9 planos, aproximadamente 30 segundos) Plano 1 (0–3 s): Gran plano general, cámara muy baja, cerca del suelo y mirando hacia arriba… Plano 2 (3–6 s): Plano medio frontal con cámara en mano. El robot sostiene a la anciana. Plano 3 (6–10 s): Primer plano del rostro. La anciana muestra que le cuesta despedirse. Diálogo de la anciana: «Vuela con cuidado, hijo mío. Vuelve a mí». Plano 4 (10–14 s): Gran plano general con inclinación de cámara hacia arriba. El cohete asciende dejando una densa estela de humo blanco. Diálogo: «Allá va… allá va». Plano 5 (14–18 s): Gran plano general. El cohete explota y se desintegra en el aire. Diálogo: «No… no, no…». Plano 6 (18–22 s): Primerísimo primer plano del rostro. Las pupilas de la anciana se contraen y caen lágrimas. Diálogo: «…casi lo había conseguido». Plano 7 (22–25 s): De primer plano a primer plano medio. Diálogo: «¡Tráelo de vuelta! Por favor… ¡tráelo de vuelta!». Plano 8 (25–28 s): Contrapicado extremo, casi vertical. El robot abraza a la anciana. Diálogo del robot: «No mires arriba. Te tengo». Plano 9 (28–30 s): Gran plano general desde atrás. Las dos figuras se abrazan con fuerza en silueta. Diálogo del robot: «Sigo aquí. Me quedaré… todo el tiempo que me necesites».
Resultado

Referencia de fotogramas clave

Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)

Imagen 1
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)
Imagen 2
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)
Imagen 3
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)
Imagen 4
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)
Imagen 5
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)
Imagen 6
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)
Crea un vídeo vertical de temática wuxia en arte de píxeles, en un solo plano secuencia, basado en @Image 1 a @Image 6. Utiliza música de fondo wuxia de estilo chino en 8 bits. Todo el vídeo debe mantener un fondo azul claro uniforme, un estilo de arte de píxeles coherente y una apariencia visual limpia, luminosa y transparente. Plano 1: Mantén el logotipo de estilo tinta de @Image 1. El fondo conserva el azul claro uniforme. Deja el encuadre inmóvil durante aproximadamente 1 segundo. Plano 2: Cuando desaparece la zona de texto de @Image 1, el rostro en primer plano del personaje masculino wuxia en arte de píxeles de @Image 2 entra deslizándose desde la parte inferior. El personaje parpadea, mira a cámara y después baja rápidamente hasta salir del encuadre. Tras su salida, la zona original del logotipo se transforma en el manual azul de artes marciales en arte de píxeles de @Image 3. Plano 3: Pasa inmediatamente a @Image 4. Un pequeño personaje wuxia en arte de píxeles salta con fuerza desde la parte inferior y golpea el icono azul con forma de rombo y signo de interrogación situado arriba… Plano 4: La interfaz de @Image 6 entra deslizándose desde la derecha. El personaje wuxia salta desde la esquina superior derecha y aterriza en la parte inferior derecha del texto grande. Abre los brazos con un gesto entusiasta de presentación y se queda inmóvil. Requisitos generales: Estilo wuxia en arte de píxeles durante todo el vídeo y fondo azul claro uniforme. Continuidad en plano secuencia con desplazamientos de posición fluidos.
Resultado

Edición Visual — Edición de vídeo mediante instrucciones

Usar un prompt para añadir, eliminar o modificar elementos visuales en un vídeo.

Vídeo de entrada (actriz mirándose al espejo)
Conserva la composición, la posición de cámara, la iluminación y el ritmo de interpretación de @Video 1. Modifica únicamente la apariencia y la expresión de la protagonista: haz que envejezca de forma natural desde los veinte años hasta alrededor de los sesenta. La contención de su mirada se suaviza gradualmente, las lágrimas pasan por las comisuras de sus ojos y las comisuras de sus labios se elevan lentamente hasta que termina sonriendo entre lágrimas. Todo el vídeo debe ser un plano secuencia continuo, sin saltos de montaje ni parpadeos. Sus rasgos deben envejecer progresivamente sin deformarse ni cambiar de identidad.
Resultado (envejecimiento progresivo)

Edición con Imágenes de Referencia

Usar prompts para añadir, eliminar o modificar contenido de vídeo, con imágenes de referencia adicionales.

Imágenes de referencia

Imagen 1 – Entorno (castillo)
Imágenes de referencia
Imagen 2 – Personaje A
Imágenes de referencia
Imagen 3 – Personaje B
Imágenes de referencia
Vídeo 1 – Pelea de artes marciales original
Sustituye la pelea entre dos personas de @Video 1 por un intercambio de tanteo a mano limpia previo a un duelo con armas blancas. Sustituye la escena por una plataforma de un castillo medieval de piedra, un patio antiguo, una plataforma exterior de una fortaleza de montaña o una sencilla arena de duelo de ladrillos de piedra. El fondo debe incluir muros de castillo, viento, niebla, crestas montañosas lejanas y un suelo de piedra plano. Toma @Image 1 como referencia del entorno. Sustituye al hombre de ropa oscura del vídeo por @Image 2 y al hombre de ropa clara por @Image 3. Mantén las acciones y el ritmo originales. Los efectos de IA solo deben mejorar el entorno y la textura: ropa movida por el viento, niebla ligera, algo de polvo en los puntos de contacto, reflejos metálicos fríos, grano de película sutil y una paleta de color épica. El estilo general debe ser contenido, realista y evocar un duelo clásico y contundente. Mantén la música de fondo sincronizada con los golpes de la acción.
Resultado

Edición de Audio

Vídeo de entrada (monólogo animado en inglés)
Traduce al chino el diálogo hablado del vídeo, sin subtítulos. Ajusta con precisión los movimientos de los labios para que coincidan con el habla traducida y mantén todo lo demás sin cambios.
Resultado (doblado al chino con sincronización labial)

Extensión de vídeo

Para mejor continuidad audio-visual en extensión, usar formato mov tanto para entrada como salida.
Vídeo de entrada (germinación a cámara rápida)
Extiende @Video 1 cinco segundos. Una abeja entra volando y se posa en la flor. Después, en un primer plano macro, sus patas y su abdomen aparecen cubiertos de partículas doradas de polen. La abeja bate las alas y despega; la cámara la sigue mientras vuela hacia otra flor de la misma especie. A cámara lenta, el polen se desprende de los finos pelos de la abeja y cae con precisión sobre el estambre de la flor, ampliando el instante de la polinización.
Resultado (extensión con abeja y polinización)
Vídeo cosido (sin costuras visibles ~segundo 15)

Creación de vídeo con un clic

Imágenes de entrada (8 fotos de un perrito en cafetería)

Imagen 1
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 2
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 3
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 4
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 5
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 6
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 7
Imágenes de entrada (8 fotos de un perrito en cafetería)
Imagen 8
Imágenes de entrada (8 fotos de un perrito en cafetería)
Convierte todas las imágenes en un vídeo con un clic. Puedes organizar las imágenes libremente. Genera un videoblog de cafetería con un estilo de recortes y garabatos animados dibujados a mano, que documente los momentos cotidianos divertidos de un cachorro vestido con distintos conjuntos adorables mientras se hace fotos en la cafetería. Genera audio o música de fondo juguetona, actual y propia de internet. Las imágenes pueden moverse ligeramente para crear un efecto de foto animada, pero no alteres las imágenes originales. Mantén una gran coherencia visual con ellas.
Resultado

Transición fluida entre vídeos

Vídeo 1
Vídeo 2
Conecta [Video 1] y [Video 2] con una transición fluida. Al final de [Video 1], la cámara debe volar rápidamente hacia arriba, girar deprisa para mirar hacia atrás y después descender verticalmente en picado, creando una transición natural y continua hacia [Video 2]. Durante la transición, las fichas de mahjong se transforman gradualmente en edificios altos y toda la escena cambia en consecuencia. No alteres los dos vídeos subidos.
Resultado (transición sin costuras)

Resumen

Comparado con Seedance 2.0, Seedance 2.5 no es un salto transgeneracional como lo fue 2.0 respecto a 1.5. Seedance 2.0 ya logró un avance importante en capacidades de generación principales. Seedance 2.5 construye sobre esa base con mejoras sistemáticas para escenarios de producción real:

El valor de Seedance 2.5 no es simplemente que "un único vídeo se vea mejor", sino que avanza el modelo en áreas clave como reutilización, entregabilidad y producción escalable. Empuja a Seedance desde un modelo de generación creativa impresionante hacia un flujo de trabajo de creación de vídeo de principio a fin escalable.