Dreamina Seedance 2.5
Guía de prompts
Introducción general
Esta guía presenta técnicas y consejos para redactar prompts para Dreamina Seedance 2.5, ayudándote a generar vídeos de alta calidad que cumplan tus requisitos con mayor eficiencia.
Instalar la habilidad de optimización
Se recomienda utilizar la Habilidad Seedance 2.5 para optimizar tus prompts.
npx --yes skills@latest add \
"https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" \
--skill sd25-pe \
--yes
En cualquier chat de IA, escribe /sd25-pe + tu prompt para empezar a optimizar.
Capacidades generales
- Genera un único vídeo de hasta 30 segundos
- Acepta hasta 50 recursos de referencia (imágenes, audio, vídeo) por solicitud
- Mejor seguimiento de instrucciones y controles profesionales de edición y extensión
- Generación nativa en más de 10 idiomas
- Imágenes más realistas y mejoras en iluminación, interpretación y movimiento de cámara
Capacidades multimodales típicas
Seedance 2.5 soporta combinaciones flexibles de entradas multimodales (texto, imágenes, vídeo, audio). La tabla lista las capacidades más comunes.
| Tipo de tarea | Tareas R2V soportadas | Descripción detallada |
|---|---|---|
| Referencia | Referencia del sujeto | Referencia apariencia/identidad/voz de persona, objeto, escena o personaje virtual. • Referencia de imagen del sujeto • Referencia de audio y vídeo del sujeto • Referencia de imagen y audio del sujeto |
| Referencia de movimiento | Referencia movimiento e información dinámica de vídeos. • Acción/expresión/movimiento de cámara/creatividad/efectos • Referencia de movimiento y sujeto | |
| Referencia y renderizado de modelos 3D de arcilla | Usa vídeos modelo 3D de arcilla gruesos o finos como referencia de movimiento y los renderiza en el estilo visual objetivo. • Referencia de modelo 3D de arcilla • + referencia del sujeto • + referencia del sujeto y de la escena | |
| Referencia de estilo | Referencia estilo visual de imágenes o vídeos. • Referencia de estilo mediante imagen o vídeo • + referencia del sujeto | |
| Referencia de audio | Referencia info de audio: música, diálogo, voz, timbre. • Referencia de audio: música, melodía, diálogo o voz • + referencia del sujeto | |
| Referencia de guion gráfico | Referencia info de guion gráfico: sujetos, composición, acciones, trama, progresión de escenas. • Referencia de guion gráfico • + referencia del sujeto | |
| Referencia de fotogramas clave | Usa una o más imágenes como fotogramas clave para generar vídeo. • Referencia de múltiples fotogramas clave • Referencia del primer y último fotograma clave | |
| Primer y último fotograma | Genera vídeo desde una imagen de primer fotograma o dos imágenes (primero y último fotograma). Se controla mediante content.role = first_frame/last_frame. | |
| Edición | Edición de vídeo mediante instrucciones | Usa instrucciones de texto para añadir, eliminar o modificar elementos visuales en un vídeo, con soporte de marcas de tiempo. Añadir, modificar, eliminar sujetos, estilos, fondos, movimientos, subtítulos, marcas de agua, etc. |
| Edición de vídeo con imágenes de referencia | Texto + imágenes de referencia para añadir/eliminar/modificar con marcas de tiempo. | |
| Edición de audio | Añade, elimina o modifica audio en vídeo. • Añadir: voces, música y efectos de sonido • Modificar: voces, música y efectos • Eliminar: voces, música y efectos | |
| Extensión | Extensión de vídeo | Continúa el vídeo hacia adelante o hacia atrás con continuidad visual y de audio. • Extender hacia adelante o hacia atrás • + referencia del sujeto |
| Otras | Creación de vídeo con un clic | Genera un vídeo corto desde múltiples imágenes y/o vídeos, con texto, pegatinas, transiciones, etc. • Creación con un clic a partir de recursos • + vídeo de referencia |
| Transición fluida entre vídeos | Toma dos vídeos y genera el segmento intermedio para crear una transición sin costuras. | |
| Capacidades combinadas | Combinación libre de las capacidades anteriores. | |
Instrucciones de las tareas
Seedance 2.5 divide las tareas en dos categorías según si el recurso de referencia bloquea o no las propiedades del vídeo de salida. Seedance 2.0 no hace esta distinción.
- Con bloqueo: El recurso de entrada se coloca como segmento en la línea de tiempo de salida. La relación de aspecto y, en algunos casos, la duración quedan bloqueadas.
- Sin bloqueo: El recurso se utiliza solo como referencia semántica. El usuario puede especificar la relación de aspecto y la duración.
Con bloqueo: edición, primer y último fotograma, y extensión
| Tarea | Definición | Instrucciones de bloqueo de salida | Palabras clave de activación en el prompt |
|---|---|---|---|
| Edición | Edita los visuales o audio del vídeo original: reemplazar sujeto, añadir/eliminar/modificar objetos, redibujar parte del fotograma. |
• Bloquea la relación de aspecto de salida (debe coincidir con el vídeo a editar). Parámetro ratio = adaptive.• Bloquea la duración (~alineada con el vídeo a editar). Parámetro duration = -1.• Si hay múltiples vídeos de entrada, el modelo determina cuál editar por el prompt. • Diferencia máxima de duración: ~0.3 segundos (solo comprime algunos fotogramas de transición). • Si el vídeo fue generado por Seedance 2.5, no habrá diferencia de duración. • Recomendado: output_format = mov.
|
Fijar content.role a reference_image, reference_video, o reference_audio.Al menos una palabra de activación de edición en el prompt: editar vídeo, añadir, insertar, quitar, eliminar, modificar, reemplazar, cambiar a, etc. Ejemplo: «Añade animales pequeños a @video1; reemplaza el personaje de @video1 por @image1; elimina la música de fondo de @video1». |
| Primer fotograma / Primer y último fotograma | Usa una imagen como primer fotograma para generar vídeo, o dos imágenes como primer y último fotograma. |
• Bloquea la relación de aspecto (coincide con la imagen del primer fotograma). Parámetro ratio = adaptive.• Si el último fotograma tiene diferente relación de aspecto, se estirará. Usar siempre el mismo relación de aspecto para ambos. • Duración: definida por el usuario. |
Fijar content.role a first_frame o last_frame. |
| Extensión | Extiende el vídeo original hacia adelante o hacia atrás. |
• Bloquea la relación de aspecto (coincide con el vídeo a extender). Parámetro ratio = adaptive.• Duración: definida por el usuario. • Recomendado: output_format = mov.
|
Fijar content.role a reference_image, reference_video, o reference_audio.Al menos una palabra de activación de extensión: extender hacia adelante, extender hacia atrás, continuar, continuar desde, ampliar la historia, etc. Ejemplo: «Extiende @video1 hacia atrás: el personaje de @image1 cae del cielo…». |
Sin bloqueo: tareas de referencia, guiones gráficos y fotogramas clave
Las tareas basadas en referencias generalmente no bloquean la relación de aspecto ni la duración según los recursos de entrada.
| Capacidad R2V | Estrategia de inferencia | Ilustración |
|---|---|---|
| Guion gráfico de varios paneles |
Los visuales generados NO se alinean estrictamente con el guion gráfico. Al introducir un guion gráfico de múltiples paneles (múltiples fotogramas combinados en una imagen), el vídeo generado no se alinea estrictamente con el guion gráfico en detalles visuales específicos. El guion gráfico proporciona principalmente una referencia de alto nivel de la trama. Se recomienda usar guiones gráficos de línea de arte relativamente simples y usar el prompt para rellenar información no mostrada en el guion gráfico. |
Ilustración guion gráfico ![]() |
| Fotogramas clave |
Los visuales generados se alinean con los fotogramas clave. Introduce varias imágenes independientes de guion gráfico como fotogramas clave; pueden incluir el primer o el último fotograma. Las imágenes del vídeo generado se ajustarán de manera relativamente estricta a las imágenes de entrada. Duración: definida por el usuario. |
Fotograma clave 1 ![]() Fotograma clave 2 ![]() Fotograma clave 3 ![]() Fotograma clave 4 ![]() Fotograma clave 5 ![]() Fotograma clave 6 ![]() Fotograma clave 7 ![]() |
Recomendaciones para los recursos de referencia
Seedance 2.5 soporta hasta 50 recursos de referencia por solicitud (imágenes, audio, vídeos). Para aprovechar al máximo el modelo:
| Caso de uso | Recomendaciones de entrada |
|---|---|
| Límites totales | • Imágenes: hasta 30, resolución hasta 4K • Vídeos: hasta 10, duración total ≤ 30 s • Audio: hasta 10 clips, duración total ≤ 30 s |
| ¿Cuántos sujetos conviene incluir en las referencias de audio o vídeo? | 1-5 sujetos producen mejores resultados. 6-10 sujetos puede reducir la estabilidad. |
| ¿Qué duración deben tener las referencias de audio o vídeo? | 5-10 segundos funciona mejor. Entradas más largas pueden reducir la estabilidad. |
| ¿Cuántos sujetos conviene incluir en las referencias de imagen? | 1-8 sujetos producen mejores resultados. 9-12 puede reducir estabilidad. |
| ¿Múltiples vistas o una sola vista? | • 1-5 sujetos: ambas soportadas • Más de 5 sujetos: una sola vista suele ser más estable. Si necesitas varios puntos de vista, utiliza imágenes separadas para cada vista. |
| ¿Cuántos paneles debe tener el guion gráfico de referencia? | ≤ 15 paneles actualmente es mejor. Usar guiones gráficos de figura de palo o línea de arte. Evitar añadir texto directamente en la imagen. |
| ¿Modelo de arcilla simplificado o detallado? | Modelo de arcilla 3D simple y grueso generalmente funciona mejor como referencia. Usar solo primitivas geométricas simples para representar personas, objetos, animales. |
| ¿Qué longitud de vídeo para edición? | Vídeos de ≤ 20 segundos producen mejores resultados. Vídeos más largos pueden reducir la estabilidad. |
| ¿Cuántas imágenes para edición con referencias? | 1-5 imágenes producen mejores resultados. 6-8 puede reducir estabilidad. |
| ¿Qué formato para extensión? | Usar formato mov tanto para entrada como salida para mejor continuidad audio-visual. |
Recomendaciones básicas de escritura de prompts
Trata a Seedance 2.5 como un productor de contenido visual y escribe prompts estructurados con mentalidad de narración visual.
Estructura recomendada
- Asignación de referencias: Identifica claramente cada imagen/vídeo/audio por su orden de subida y su propósito (sujeto, voz, acción, escena…)
- Resumen en una frase: Sujeto + Ubicación + Evento + Género/Estilo + Movimiento de cámara…
- Descripción detallada de la trama: Secuencia de planos o línea de tiempo con marcas de tiempo o "Plano N". Describe visuales específicos, movimiento de cámara, acciones, diálogos, efectos de sonido por segmento. Usar descripciones positivas siempre que sea posible.
- Notas adicionales: Detalles visuales que deben mantenerse consistentes (ángulo de cámara, ambiente, sonido, atmósfera).
Ejemplo completo: cría de panda
Tareas de referencia: asignación de múltiples recursos
A medida que aumenta el número de recursos de referencia, las relaciones de asignación entre ellos se vuelven especialmente importantes.
- La numeración debe corresponder al orden de subida: Imagen 1 / Vídeo 1 / Audio 1
- Cada recurso debe estar vinculado explícitamente en el texto del prompt
- No recomendado: Proporcionar información de mapeo solo dentro de la imagen (p. ej., escribir "John" en la imagen del protagonista y luego decir solo "John está en la escuela...")
Para múltiples sujetos, listar las relaciones de mapeo una por una:
- «El caballero de la Imagen 1».
- «Las Imágenes 1–2 corresponden al Personaje 1 y al Audio 1; las Imágenes 3–4 corresponden al Personaje 2 y al Audio 2».
- «La Imagen 1 muestra al protagonista John, que utiliza el timbre de voz del Audio 1».
Especificar el rol de cada recurso claramente:
- «Toma como referencia la acción de lanzar el hechizo del Vídeo 1 y el movimiento de cámara envolvente del Vídeo 2».
- «Toma la Imagen 1 como referencia para la iluminación y los filtros».
Cuando el recurso de referencia es suficientemente preciso, basta con indicar que se haga referencia. Evitar describir la escena repetidamente en detalle:
- «Sigue estrictamente las acciones y los movimientos de cámara del Vídeo 1, y mantén una secuencia coherente con el vídeo». (No hace falta describir levantar la mano, girarse, etc.)
Tareas de edición
Clarifica el alcance y el contenido a modificar. Se pueden usar marcas de tiempo para ediciones parciales. Siempre que sea posible, describir cómo debe cambiar el contenido de A a B.
- «Edita únicamente el diálogo del hombre del Vídeo 1: cámbialo por “No te acerques” y ajusta el acento para que sea de inglés estadounidense…».
- «Entre los segundos 4 y 6 del Vídeo 1, cambia la acción del hombre de beber café a fregar el suelo y mantén el resto del contenido sin cambios».
- «Tarea de edición: sustituye a la mujer asiática de la derecha del Vídeo 1 por la mujer latina de la Imagen 1».
Primer y último fotograma
- Priorizar fijar el rol de la imagen mediante parámetros como
first_frameolast_frame. Este método bloquea la relación de aspecto de salida alineándolo estrictamente con la imagen del primer fotograma. - El rol también puede fijarse como
reference_image, con las imágenes específicas designadas en el prompt como primer y último fotograma. Este método no bloquea la relación de aspecto.
- «La Imagen 1 es el primer fotograma».
- «La Imagen 3 es el primer fotograma y la Imagen 5 es el último».
Marcas de tiempo
Las marcas de tiempo ayudan a clarificar la progresión de la historia. Usar intervalos de 1 segundo como unidad básica.
No recomendado: Usar marcas de tiempo para controlar acciones de alta frecuencia (p. ej., "sacude la cabeza tres veces por segundo").
Métodos soportados
- Intervalos claros:
0-3s... 3-7s... 7-15so[1s-4s]...[4s-8s]...[8s-12s] - Control de punto temporal: «Transición lateral rápida hacia la izquierda en el segundo 5».
- Control de tiempo relativo: «John permanece allí con la mirada perdida. Al cabo de 3 segundos, todos los que lo rodean niegan con la cabeza». / «La imagen se congela durante 1 segundo después de que el protagonista pulse el disparador».
Control negativo
Soporta control negativo para subtítulos y para dimensiones de audio más finas:
- «No añadas subtítulos». / «Sin subtítulos».
- «Sin música de fondo; genera únicamente sonidos ambientales y de las acciones».
- «Sin audio».
Técnicas avanzadas para redactar prompts
Lenguaje de cámara
- Términos básicos directos: tamaño de plano (gran plano general / plano general / plano medio / primer plano medio / primer plano), movimiento (acercamiento / alejamiento / panorámica / desplazamiento / seguimiento / órbita / descenso en picado / retroceso / inclinación hacia arriba / vibración de cámara en mano), ángulo (contrapicado / plano cenital / perspectiva en primera persona)
- Técnicas comunes directas: plano secuencia o toma larga, efecto de vértigo o zoom de Hitchcock, perspectiva aérea, vista en primera persona (FPV), efecto de tiempo bala, cámara en mano y variación de velocidad
- Términos técnicos de nicho: convertir en [término + explicación descriptiva]. P. ej., «Cambio de foco: el enfoque se desplaza suavemente; los árboles del primer término, que al principio estaban nítidos, se desenfocan, mientras que el personaje del fondo gana nitidez de forma gradual».
- Planos de transición: Especificar tanto el punto de disparo como el método de transición. P. ej., «En el segundo 5, la cámara realiza una transición rápida hacia la izquierda con un barrido lateral combinado con un fundido natural».
Acciones y expresiones
- Acciones: Priorizar descripciones generales. Solo escribir detalles específicos para pocas acciones memorables. Evitar repetir las mismas acciones.
- Expresiones: Usar oraciones descriptivas y reducir el uso de modismos.
Referencia y renderizado de modelos 3D de arcilla
- Indicar claramente qué elementos del vídeo modelo de arcilla deben referenciarse:
- Si no hay cambios de iluminación y solo quieres referenciar movimiento de cámara y movimiento: «Toma como referencia el movimiento de cámara y el movimiento de [Video 1]…».
- Si el vídeo incluye cambios de iluminación que también deben referenciarse: «Toma como referencia los cambios de iluminación, el movimiento de cámara y el movimiento de [Video 1]…».
- Si también se proporcionan imágenes de referencia, especificar claramente el mapeo entre imágenes y vídeo modelo de arcilla: «Asigna al hombre de ropa gris de [Image 1] al modelo rojo de [Video 1], y sustituye el modelo verde 2 de [Video 1] por la chica pelirroja de [Video 2]».
- Incluso cuando se proporciona un vídeo modelo de arcilla, describir el contenido deseado en detalle para mejores resultados. Describir la apariencia del sujeto y sus características clave.
Guiones gráficos de varios paneles
Guiones gráficos no recomendados (ejemplos)
- Evitar guiones gráficos ruidosos o sobre-enfocados: No utilices directamente guiones gráficos generados con IA que contengan demasiado texto superpuesto o un exceso de nitidez.
- Los paneles no se alinean estrictamente con el vídeo final: Un guion gráfico de varios paneles no se sigue fotograma a fotograma. El vídeo tiene cierta autonomía. Para alineación estricta, usar el método de referencia con múltiples fotogramas clave.
Uso recomendado: Guiones gráficos de línea de arte
- Paso 1: Indicar claramente las relaciones de mapeo de recursos de referencia.
- Paso 2: Escribir un resumen general de la historia.
- Paso 3: Describir completamente la trama según el guion gráfico, rellenando al menos la información no mostrada en él. Se pueden usar marcas de tiempo para clarificar la lógica de la historia.
Ejemplo de guion gráfico de línea de arte (drama doméstico)


Uso de concepto de guion gráfico
Si el guion gráfico es un concepto o diseño de fotograma clave, el prompt puede simplificarse:
«Construye una trama completa siguiendo la secuencia del guion gráfico y utiliza los planos de forma razonable y coherente».

Referencia de fotogramas clave
Cuando el vídeo debe seguir estrictamente el guion gráfico, usar referencias de fotogramas clave. Introducir cada guion gráfico como imagen de referencia independiente en orden y declarar en la primera oración del prompt:
«Utiliza las Imágenes X a X, en orden, como fotogramas clave».
Ejemplo (7 fotogramas clave – animación China)







Diferencias respecto a Seedance 2.0
| Característica | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Marcas de tiempo | No responde a marcas de tiempo. Solo responde a números de plano. | Soporta marcas de tiempo en segundos enteros. |
| Imágenes de múltiples vistas | No se recomiendan como referencias del sujeto. | Las admite como referencias del sujeto. |
| Relaciones de aspecto | Solo 6 relaciones de aspecto de salida fijas. | Cualquier relación de aspecto de salida entre [0.4, 2.5] controlando los recursos de entrada. |
| Calidad de vídeo a vídeo (V2V) | — | Soporta salida MOV para mejor consistencia de color, brillo y audio-visual en tareas de extensión y edición. |
Ejemplos de Prompt
Modelo 3D de arcilla · Referencia simplificada
Soporta renderizado desde vídeos modelo de arcilla 3D que contienen información dinámica o temporal como movimiento, movimiento de cámara, rutas de movimiento y cambios de iluminación. También soporta imágenes de referencia para sujetos, escenas, elementos de atrezo y otros elementos.
Entrada
Imágenes de referencia (Imágenes 2–10)









Prompt (fragmento)
Modelo 3D de arcilla · Referencia detallada
Diseñado para escenarios con modelado completo, con enfoque en re-renderizado. Ayuda a lograr resultados de renderizado más ricos y de mayor calidad "coloreando" el modelo 3D de arcilla.
Modelo 3D de arcilla · Previsualización de alta dificultad
Referencia de guion gráfico de varios paneles
Imágenes de entrada




Referencia de fotogramas clave
Imágenes de entrada (6 fotogramas clave – arte de píxeles wuxia)






Edición Visual — Edición de vídeo mediante instrucciones
Usar un prompt para añadir, eliminar o modificar elementos visuales en un vídeo.
Edición con Imágenes de Referencia
Usar prompts para añadir, eliminar o modificar contenido de vídeo, con imágenes de referencia adicionales.
Imágenes de referencia



Edición de Audio
Extensión de vídeo
mov tanto para entrada como salida.Creación de vídeo con un clic
Imágenes de entrada (8 fotos de un perrito en cafetería)








Transición fluida entre vídeos
Resumen
Comparado con Seedance 2.0, Seedance 2.5 no es un salto transgeneracional como lo fue 2.0 respecto a 1.5. Seedance 2.0 ya logró un avance importante en capacidades de generación principales. Seedance 2.5 construye sobre esa base con mejoras sistemáticas para escenarios de producción real:
- Generación de vídeo más larga
- Soporte más amplio de referencias multimodales
- Capacidades de edición y extensión más estables
- Mejoras en control de relación de aspecto, continuidad audio-visual, controlabilidad y adaptabilidad de flujo de trabajo
El valor de Seedance 2.5 no es simplemente que "un único vídeo se vea mejor", sino que avanza el modelo en áreas clave como reutilización, entregabilidad y producción escalable. Empuja a Seedance desde un modelo de generación creativa impresionante hacia un flujo de trabajo de creación de vídeo de principio a fin escalable.






