Dreamina Seedance 2.5
Tutorial y referencia de la API
Introducción
Dreamina Seedance 2.5 es un modelo de creación de vídeo de próxima generación con mejoras importantes en narración de formato largo, soporte de referencia multimodal y edición.
- Genera hasta 30 segundos de vídeo por solicitud
- Acepta hasta 50 recursos de referencia multimodal por solicitud
- Soporte de extensión de vídeo en múltiples rondas
- Edición precisa basada en marcas de tiempo
- Calidad visual mejorada, aspecto más realista y cinematográfico
Tipos de tarea y restricciones
Seedance 2.5 determina el tipo de tarea según los recursos de entrada y el intención del prompt.
| Tipo de tarea | Condición de activación | Restricciones especiales |
|---|---|---|
| De texto a vídeo | Solo se proporciona un prompt de texto. | Sin restricciones especiales en ratio o duration. |
| Generación desde el primer fotograma o desde el primero y el último | content.role = first_frame o last_frame. |
ratio debe ser adaptive. El modelo mantiene la relación de aspecto consistente con la imagen del primer fotograma especificada por first_frame. |
| Generación de vídeo con referencias multimodales | De referencias a vídeo: content contiene al menos un recurso con role = reference_image, reference_video, o reference_audio. |
Sin restricciones especiales en ratio o duration. |
Edición de vídeo: content contiene al menos un vídeo con role = reference_video, y el prompt expresa intención de edición. |
ratio debe ser adaptive; duration debe ser -1. El modelo selecciona el vídeo a editar según el intención del prompt. El vídeo de referencia debe tener 4–30 s de duración. |
|
Extensión de vídeo: content contiene al menos un vídeo con role = reference_video, y el prompt expresa intención de extensión. |
ratio debe ser adaptive. El modelo selecciona el vídeo a extender según el intención del prompt. |
Métodos de configuración: omni_reference_task_type
Referencia multimodal sin especificar subtarea (auto)
{
"omni_reference_task_type": "auto",
"ratio": "adaptive",
"duration": -1
}
auto, el modelo puede clasificar la tarea como generación a partir de referencias, edición de vídeo o extensión de vídeo según el prompt. La configuración recomendada satisface las restricciones de cada tipo.Edición de vídeo (explícita)
{
"omni_reference_task_type": "edit",
"ratio": "adaptive",
"duration": -1
// Vídeo de referencia: 4–30 s
// Palabras clave del prompt: editar vídeo, añadir, eliminar/quitar, modificar/reemplazar/cambiar
}
Ejemplos de prompt: «Añade algunos animales pequeños a @Video 1». / «Sustituye el personaje de @Video 1 por @Image 1». / «Elimina la música de fondo de @Video 1».
Extensión de vídeo (explícita)
{
"omni_reference_task_type": "extend",
"ratio": "adaptive"
// Palabras clave del prompt: extender hacia adelante/atrás, continuar, continuar la historia
}
Ejemplos de prompt: «Extiende @Video 1 hacia atrás y haz que el personaje de @Image 1 descienda del cielo».
Manejo de errores
- Validación síncrona (al enviar): Cuando
omni_reference_task_type=editoextend, la API valida las restricciones inmediatamente. Si no se cumplen → error inmediato. - Validación asíncrona (después de arrancar): Cuando
omni_reference_task_type=autoo no se proporciona, el modelo determina el tipo real primero, luego valida. Si no se cumplen → error asíncrono.
Código de error por incompatibilidad: InvalidParameter.TaskTypeConstraint
Código de error por discrepancia de tipo: InvalidParameter.TaskTypeMismatch
Primeros pasos con Python
Para una prueba rápida: utiliza API Explorer con plantillas predefinidas.
Instalación del SDK
python -m pip install --upgrade arkruntime
Ejemplo básico: crear y consultar el estado de una tarea
# python/demo_standard.py
import os, time
from arkruntime import ArkRuntime
client = ArkRuntime(api_key=os.environ.get("ARK_API_KEY"))
# ----- Crear solicitud -----
print("----- Crear solicitud -----")
create_result = client.content_generation.tasks.create(
model="dreamina-seedance-2-5-260628",
content=[
{
"type": "text",
"text": "TU PROMPT AQUÍ"
},
{
"type": "image_url",
"image_url": {"url": "https://your-image-url.com/image.png"},
"role": "reference_image"
}
],
generate_audio=True,
ratio="16:9",
duration=10
)
print(create_result)
# ----- Consultar periódicamente el estado de la tarea -----
print("----- Consultar estado de la tarea -----")
task_id = create_result.id
while True:
get_result = client.content_generation.tasks.get(task_id=task_id)
status = get_result.status
if status == "succeeded":
print("----- Tarea completada -----")
print(get_result)
break
elif status == "failed":
print("La tarea ha fallado")
break
else:
print(f"Estado: {status}, esperando…")
time.sleep(30)
Punto de acceso de la API
POST https://ark.ap-southeast.bytepluses.com/api/v3/contents/generations/tasks
Authorization: Bearer $ARK_API_KEY
Variables modificables en demo_standard.py
- Prompt: Encuentra la variable
user_contenty cámbiala - Recursos de entrada: Reemplaza
reference_image_url,reference_video_url,reference_audio_urlcon tus propios enlaces (deben ser públicamente accesibles)
Capacidades clave con ejemplos
Generar vídeo coherente de 30 segundos
El límite de duración aumentó de 15 s (Seedance 2.0) a 30 segundos.

Prompt (resumen): Anuncio de pomelo con un lagarto cornudo del desierto: 0–3 s, calor del desierto; 3–6 s, el lagarto descubre el pomelo; 6–8 s, lo agarra; 8–11 s, la cáscara se abre y brota el zumo; 11–16 s, el zumo inunda el desierto; 20–23 s, nombre de la marca y eslogan; 23–29 s, el lagarto está de vacaciones en un mar de zumo. Duración total: 30 s.
curl -X POST https://ark.ap-southeast.bytepluses.com/api/v3/contents/generations/tasks \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $ARK_API_KEY" \
-d '{
"model": "dreamina-seedance-2-5-260628",
"content": [
{"type": "text", "text": "Estilo publicitario de animación 3D… [PROMPT COMPLETO]"},
{
"type": "image_url",
"image_url": {"url": "https://arkdocs-en.tos-ap-southeast-1.volces.com/images/video-generation/sd-25-30s-input.png"},
"role": "reference_image"
}
],
"generate_audio": true,
"ratio": "16:9",
"duration": 30
}'
Hasta 50 recursos de referencia multimodal
Límite aumentado a 50 (30 imágenes + 10 vídeos + 10 audios). Soporta generación con solo referencias de audio (sin necesitar imagen/vídeo).

curl -X POST https://ark.ap-southeast.bytepluses.com/api/v3/contents/generations/tasks \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $ARK_API_KEY" \
-d '{
"model": "dreamina-seedance-2-5-260628",
"content": [
{"type": "text", "text": "Estilo de anuncio luminoso y colorido con galletas de sabores frutales… [PROMPT COMPLETO]"},
{"type": "image_url", "image_url": {"url": "...seedance2.5_reference1.png"}, "role": "reference_image"},
{"type": "video_url", "video_url": {"url": "...seedance2.5_reference2.mp4"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...seedance2.5_reference3.mp4"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...seedance2.5_reference4.mp4"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...seedance2.5_reference5.mp4"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...seedance2.5_reference6.mp4"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...seedance2.5_reference7.mp4"}, "role": "reference_video"}
],
"generate_audio": true,
"ratio": "16:9",
"duration": 15,
"omni_reference_task_type": "reference",
"output_format": "mov"
}'
Edición de vídeo con control inteligente de relación de aspecto/duración
En las tareas de edición, Seedance 2.5 selecciona el vídeo según la intención del prompt y conserva automáticamente su relación de aspecto y su duración.
ratio = adaptive y duration = -1 obligatorios.Prompt: «Edición de vídeo: elimina a todas las personas de @Video 1 excepto al protagonista».
{
"model": "dreamina-seedance-2-5-260628",
"content": [
{"type": "text", "text": "Edición de vídeo: elimina a todas las personas de @Video1 excepto al protagonista."},
{"type": "video_url", "video_url": {"url": "...seedance2.5_edit_input.mov"}, "role": "reference_video"}
],
"generate_audio": true,
"ratio": "adaptive",
"duration": -1,
"output_format": "mov"
}
Extensión de vídeo
Selecciona el vídeo a extender según el intención del prompt y mantiene la relación de aspecto consistente. Duración de salida: configurable [4,30] o -1.
Prompt: «Extiende @Video 1. Después de que se abra la ventana, entra en el interior de la galería de arte de @Video 2. Por último, introduce la cámara en el cuadro de @Video 3».
{
"model": "dreamina-seedance-2-5-260628",
"content": [
{"type": "text", "text": "Extiende @Video 1. Después de que se abra la ventana, entra en el interior de la galería de arte de @Video 2. Por último, introduce la cámara en el cuadro de @Video 3."},
{"type": "video_url", "video_url": {"url": "...r2v_extend_video1_75.mov"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...r2v_extend_video2.mp4"}, "role": "reference_video"},
{"type": "video_url", "video_url": {"url": "...r2v_extend_video3.mp4"}, "role": "reference_video"}
],
"generate_audio": true,
"ratio": "adaptive",
"duration": 11,
"output_format": "mov"
}
Generación desde el primer fotograma o desde el primero y el último
Mantiene automáticamente la relación de aspecto consistente con la imagen del primer fotograma especificada por first_frame.
Prompt: «La chica de la imagen dice “patata” a la cámara, con un movimiento de cámara orbital de 360 grados».
{
"model": "dreamina-seedance-2-5-260628",
"content": [
{"type": "text", "text": "la chica de la imagen dice \"patata\" a la cámara, con un movimiento de cámara orbital de 360 grados"},
{"type": "image_url", "image_url": {"url": "..."}, "role": "first_frame"},
{"type": "image_url", "image_url": {"url": "..."}, "role": "last_frame"}
],
"generate_audio": true,
"ratio": "adaptive",
"duration": 5
}
Generación multilingüe nativa
Soporta prompt e entrada en: Chino, Inglés, Español, Indonesio, Malayo, Tailandés, Árabe, Portugués, Vietnamita, Japonés, Coreano.

Prompt (resumen): Vídeo musical cinematográfico de hiphop y rap. El vocalista principal lleva un chándal rojo y está en una playa. El rapero dice «Hola» en ocho idiomas, en este orden: inglés → chino → japonés → coreano → portugués → tailandés → español → árabe. Ocho planos con cortes directos y sincronización labial precisa. Sin subtítulos. Duración: 20 segundos.
Comparativa de modelos
| Característica | Seedance 2.5 | Seedance 2.0 | Seedance 2.0 fast | Seedance 2.0 mini | |
|---|---|---|---|---|---|
| Identificador del modelo | dreamina-seedance-2-5-260628 | dreamina-seedance-2-0-260128 | dreamina-seedance-2-0-fast-260128 | dreamina-seedance-2-0-mini-260615 | |
| De texto a vídeo | ✓ | ✓ | ✓ | ✓ | |
| De primer fotograma a vídeo | ✓ | ✓ | ✓ | ✓ | |
| De primer y último fotograma a vídeo | ✓ | ✓ | ✓ | ✓ | |
| Referencia multimodal | Referencia de imagen | ✓ | ✓ | ✓ | ✓ |
| Referencia de vídeo | ✓ | ✓ | ✓ | ✓ | |
| Referencia de audio (sin otros recursos) | ✓ | ✗ (requiere imagen o vídeo) | ✗ (requiere imagen o vídeo) | ✗ (requiere imagen o vídeo) | |
| Referencias combinadas | ✓ | ✓ | ✓ | ✓ | |
| Editar vídeo | ✓ | ✓ | ✓ | ✓ | |
| Extender vídeo | ✓ | ✓ | ✓ | ✓ | |
| Vídeo con audio | ✓ | ✓ | ✓ | ✓ | |
| Máximo de recursos de referencia | 50 (30 imágenes + 10 vídeos + 10 audios) | 15 (9+3+3) | 15 (9+3+3) | 15 (9+3+3) | |
| Especificaciones de salida | Resolución | 480p / 720p / 1080p (10 bits) | 480p / 720p / 1080p / 4K (10 bits) | 480p / 720p | 480p / 720p |
| Relación de aspecto | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16, adaptive | igual | igual | igual | |
| Duración | 4–30 s o -1 | 4–15 s o -1 | 4–15 s o -1 | 4–15 s o -1 | |
| Formato salida | mp4, mov | mp4 | mp4 | mp4 | |
Especificaciones de salida
Resolución
Parámetro resolution. Valor predeterminado: 720p
480p— profundidad de color de 8 bits720p— profundidad de color de 8 bits1080p— profundidad de color de 10 bits, H.265/HEVC (puede requerir VLC, mpv o QuickTime para reproducir)
Relación de aspecto
Parámetro ratio. Valor predeterminado: adaptive
Valores: 16:9, 4:3, 1:1, 3:4, 9:16, 21:9, adaptive
adaptive.| Resolución | Relación de aspecto | Dimensiones (px) |
|---|---|---|
| 480p | 16:9 | 854×480 |
| 4:3 | 752×560 | |
| 1:1 | 640×640 | |
| 3:4 | 560×752 | |
| 9:16 | 480×854 | |
| 21:9 | 992×432 | |
| 720p | 16:9 | 1280×720 |
| 4:3 | 1112×834 | |
| 1:1 | 960×960 | |
| 3:4 | 834×1112 | |
| 9:16 | 720×1280 | |
| 21:9 | 1470×630 | |
| 1080p | 16:9 | 1920×1080 |
| 4:3 | 1664×1248 | |
| 1:1 | 1440×1440 | |
| 3:4 | 1248×1664 | |
| 9:16 | 1080×1920 | |
| 21:9 | 2206×946 |
Duración
Parámetro duration. Valor predeterminado: -1. Rango: [4, 30] o -1
-1en edición: mantiene la duración del vídeo a editar (diferencia máx. 0.4 s)-1en otros: el modelo elige una duración entre [4, 30]
duration solo soporta -1. El vídeo entrada debe tener [4, 30] s.Formato de salida (mov)
Parámetro output_format. Valores: mp4 (predeterminado) o mov
- mp4: Formato de uso general, máxima compatibilidad
- mov: Alta precisión de color para entornos profesionales. Utiliza vídeo H.264, muestreo de crominancia yuv444p y audio PCM. Recomendado para edición y extensión de vídeo
| Reproductor | macOS | Windows |
|---|---|---|
| IINA | ✓ | ✕ |
| VLC | ✓ | ✓ |
| mpv | ✓ | ✓ |
| ffplay | ✓ | ✓ |
Consejos para prompts (resumen)
- Fórmula básica: sujeto + acción/evento + escena/entorno + estilo visual + movimiento de cámara/cortes + sonido
- Asignación de referencias:
@Image 1,@Video 1,@Audio 1— especificar qué proporciona cada recurso (apariencia, acción, timbre) - Caracteres especiales para sonido:
()= música,<>= efectos de sonido,{}= diálogo,【】= subtítulos - Usar la Habilidad Seedance 2.5 para optimizar prompts:
/sd25-pe + tu prompt - Ver guía completa de prompts: Guía completa de prompts
Límites de uso
Imágenes
- Formatos: jpeg, png, webp, bmp, tiff, gif, heic, heif
- Relación de aspecto (ancho/alto): [0,4; 2,5]; dimensiones en píxeles: [300, 6000]
- Tamaño: menos de 30 MB por imagen; cuerpo de la solicitud inferior a 64 MB
- Cantidad: 1–30 imágenes (referencias multimodales)
Vídeos
- Formatos: mp4 (H.264/H.265 + AAC/MP3), mov (H.264/H.265 + AAC/MP3/PCM)
- Resolución: 480p, 720p; FPS: [24, 60]
- Duración: [2, 30] s sin edición; [4, 30] s para edición
- Hasta 10 vídeos, duración total ≤ 30 s
- Tamaño: < 200 MB por vídeo
Audio
- Formatos: wav, mp3; Duración: [2, 30] s por clip
- Hasta 10 clips, duración total ≤ 30 s; Tamaño: < 15 MB por clip
Retención
- Registros de tareas: 7 días
- URL del vídeo: 24 horas, máx. 100 descargas — descargar a tiempo
Límites de solicitudes
| Dimensión | Empresa | Individual |
|---|---|---|
| Máximo de solicitudes por minuto | 600 | 180 |
| Máximo de tareas simultáneas | 10 | 3 |
Versión china (ZH) · Tutorial de Doubao Seedance 2.5
ark-project.tos-cn-beijing.volces.com) y se llama "Doubao Seedance 2.5" en el mercado chino.Acceder en: docs.volcengine.com/docs/82379/2607688?lang=zh
Diferencias clave entre las versiones china e inglesa
- Precio en yuanes (CNY): saldo superior a 200 yuanes, frente a 30 USD
- Punto de acceso:
https://ark.cn-beijing.volces.com/api/v3/... - Palabras clave de edición en chino y su traducción: 编辑视频 (editar vídeo), 增加/加上 (añadir), 删除/去掉 (eliminar/quitar), 修改/替换/改成 (modificar/reemplazar/cambiar a)
- Palabras clave de extensión en chino y su traducción: 向前/向后延长 (extender hacia adelante/atrás), 延续 (continuar), 续写 (continuar la historia)