Saltar al contenido principal

Seedance 2.0

por ByteDance

Seedance 2.0 de ByteDance (febrero 2026). Generación de vídeo multimodal nativo: texto + imagen + audio + vídeo como input, hasta 15 segundos con audio sync y multi-shot. Acceso principal: Jimeng AI (即梦).

CerradoCrea vídeoAcepta imágenes y vídeo de referencia
Raziel Score
0.0/10
API
Precio no publicado
Comunidad
Sin datos aún

¿Para qué sí? ¿Para qué no?

Mejor para

  • Generación de vídeo
    Crear clips, storyboards o secuencias audiovisuales desde prompts y referencias.
  • Creatividad para marketing
    Producir piezas visuales, campañas y contenido de marca.
  • Comprensión multimodal
    Analizar conjuntamente texto, imágenes, audio, vídeo o documentos.

Evitar para

  • Documentos y contexto largo
    Leer, relacionar y resumir documentos o contextos extensos.

Valoración por categoría

Imagen

Comprensión, generación o edición visual

Pendiente · evidencia en revisión
Vídeo

Comprensión o generación de vídeo

8.5/10

Benchmarks traducidos

Métricas comparables, agrupadas por capacidad para que se vea qué mide cada prueba.

Vídeo

Artificial Analysis Video Arena

0score

Puntuación propia del benchmark: aquí, cuanto más alto, mejor

Elo independiente de Artificial Analysis para generación de vídeo; leaderboard vivo, solo comparable dentro del mismo snapshot.

¿Dónde se puede ejecutar?

Viabilidad local
-/10

Modelo cerrado: disponible mediante web o API, sin ejecución local publicada.

Resumen práctico de las formas razonables de usar este modelo.

API / nube
Sin instalación local

Lo usas desde una web, app o API. No instalas el modelo en tu equipo.

Disponible
Servidor potente
No viable

Para correrlo completo necesitas GPU profesional o una máquina grande.

No viable
PC con GPU
No viable

Puede funcionar en una buena gráfica con cuantización, normalmente sacrificando algo de calidad.

No viable
Portátil
No viable

Uso en un portátil normal o con GPU modesta. Idealmente sin montar un servidor dedicado.

No viable
Móvil / tablet
No viable

Uso realista en teléfono o tablet, con modelos muy pequeños u optimizados.

No viable

Ficha técnica

EmpresaByteDance
PaísChina
Lanzamiento12 de febrero de 2026
TipoCerrado
Salida principalVídeo
Puede recibirTexto · Imagen · Vídeo
Puede generarVídeo

Acceso y apps

Dónde puedes usarlo sin entrar en detalles de hardware.

WebDisponible
MóvilNo aplica
EscritorioNo aplica
APINo aplica
PesosNo aplica
Arquitectura

Diffusion

Arquitectura publicada

Unified multimodal audio-video joint generation architecture. Acepta hasta 9 imágenes + 3 vídeos + 3 audios + texto simultáneamente.

Por qué importa

La arquitectura da pistas sobre contexto, coste, velocidad y facilidad para ejecutarlo. No es una nota de calidad por sí sola.

Licencia

Proprietary

seed.bytedance.com/terms (Ver licencia original)
Uso comercialSin modificacionesSin atribución

Notas
Acceso consumer vía Jimeng AI (gratis con límites). Acceso enterprise vía Volcano Engine API. No weights disponibles.

Fuentes

Revisado: 2026-07-13

Historia del modelo

La versión actual y el linaje que explica de dónde viene y qué cambió por el camino.

  1. 2026
    feb
    Salto mayorEste modelo

    Seedance 2.0

    • Referencias multimodales, edición y clips de 15 segundos
    CapacidadesVideoAudioMultimodal
  2. 2025
    dic
    Mejora

    Seedance 1.5 Pro

    • Añade generación conjunta de audio y vídeo
    CapacidadesVideoAudio
  3. 2025
    jun
    Salto mayor

    Seedance 1.0

    • Primera generación pública de vídeo
    CapacidadesVideo

Aprobación de la comunidad

Pendiente de medir

Por ahora esta nota se asigna a mano en la edición de Raziel. Más adelante la votará la comunidad.

¿Encaja contigo?

Si Seedance 2.0 te encaja, ponlo frente a otro modelo o mira qué alternativas hay antes de cerrar la decisión.

Ver alternativas

En desarrollo

Encuentra opciones mejores si priorizas precio, local o creatividad.

Guardar en favoritos

En desarrollo

Déjalo marcado para volver cuando tengas claro el caso de uso.