Dreamina Seedance 2.5 l Guía

Compartir

Dreamina Seedance 2.5 l Guía

El modelo Dreamina Seedance 2.5 ha sido lanzado completamente. Por favor, experiméntalo en el sitio web oficial de Dreamina para garantizar los mejores resultados.

Sitio oficial: https://dreamina.capcut.com/ai-tool/home

¡Dreamina Seedance 2.5 se lanza oficialmente!

Tras el lanzamiento de Dreamina Seedance 2.0 que habilitó la creación multimodal, hemos estado explorando continuamente formas de empoderar a los creadores con el "control" definitivo y un espacio narrativo más amplio. Hoy, Dreamina Seedance 2.5 llega oficialmente como el nuevo estándar para la creación profesional.

Repaso del aprendizaje multimodal de Dreamina: Seedance 2.0 admite cuatro modos de entrada: imagen, vídeo, audio y texto.

Si Dreamina Seedance 2.0 te permite experimentar la alegría de ser un "director", entonces Dreamina Seedance 2.5 te ofrece un set de producción digital profesional versátil. Más largo, más auténtico y más obediente, permitiendo que el proceso creativo logre realmente "dondequiera que señales".

Hemos realizado optimizaciones completamente nuevas en respuesta a los comentarios principales de nuestros usuarios sobre Jimeng Seedance 2.0. ¡Veamos qué nuevas funciones ha traído Jimeng para todos esta vez!

N.ºComentarios principales de usuariosDestacadosIntroducción específica
1 Esperan poder generar más tiempo o continuación sin pérdida 🕒 Extensión de vídeo, creación continua Soporte máximo de generación de extensión de vídeo dentro de 30 segundos. Después de que el usuario genere un vídeo dentro de 30 segundos, puede continuar extendiendo múltiples anidamientos, y el más largo se puede extender hasta 60 segundos.
2 ✌️ Vídeos largos de hasta 180 segundos Usa el modo Ultra Long Video para generar hasta 180 segundos de vídeo.
3 Esperan controlar con precisión el momento de la acción en la imagen, como que el personaje gire en el tercer segundo y gire en el quinto segundo 🎯 Control de texto con marca de tiempo Soporte para especificar una marca de tiempo específica a través del texto. Los creadores pueden emitir instrucciones con precisión al segundo específico, controlar la evolución de las acciones y transiciones de escena en la imagen, y lograr una restauración precisa a nivel de guion.
4 Mejorar la comprensión de idiomas minoritarios, ya no necesitan usar software de traducción para traducir al chino o inglés 🌍 Rompiendo barreras lingüísticas Soporte completo para entrada de idiomas minoritarios, mayor prioridad en la lista de optimización para chino, inglés, español, indonesio, malayo, y cobertura completa para tailandés, árabe, portugués, vietnamita, japonés, coreano. Te ayuda a manejar fácilmente la creación de contenido para el extranjero y transcultural, y permite que los creadores de diferentes idiomas de todo el mundo usen su lengua materna más familiar para liberar su inspiración sin barreras.
5 La respuesta a los prompts negativos puede llevar a subtítulos y BGM no deseados 🔇 Eliminar subtítulos y BGM irrelevantes Gran optimización de la estabilidad de generación, resolviendo eficazmente los problemas de subtítulos aleatorios y BGM irrelevantes. Proporciona creativos de vídeo básicos más limpios, y la post-edición para añadir su propio texto y música es más sin preocupaciones.
6 Los personajes generados tienen un aspecto típico de Jimeng o un evidente toque de IA; en tomas complejas, los visuales son propensos a distorsiones y deformaciones, sin parecer realistas ni fluidos 🌟 Efecto de generación base completamente optimizado Gran reducción del "sentido de IA" y presentación de una textura física más realista. No solo la consistencia de los cortes de plano mejora significativamente, sino que también se desbloquean con éxito una gran cantidad de acciones de cola larga complejas, haciendo que las dinámicas y transiciones de los personajes sean naturales y fluidas.
7 Al generar múltiples personajes, a menudo parecen "gemelos".
Falta de pantalla verde y modelo blanco, que son convenientes para la postproducción y efectos especiales.
Vídeo original con voces, quieren eliminar el BGM del vídeo original por separado y conservar las voces.
Solo quieren cambiar algunos elementos del vídeo original, mantener el resto sin cambios, pero no quieren regenerar el vídeo.
🚀 Optimización integral de referencia multimodal Frente a instrucciones complejas de edición de vídeo, el modelo responde con mayor precisión, añadiendo referencia de timbre y referencia de múltiples personas, y optimizando en gran medida la continuidad de la extensión de vídeo y la vivacidad de la imagen. Además, añade la capacidad de control de modelo blanco y edición de pantalla verde.
🎵 Separación/Eliminación de Música de Fondo (BGM): Solicita al modelo que elimine el sonido de fondo musical en el vídeo a través de palabras clave, dejando solo la voz de los personajes, y preservando perfectamente otros elementos como los subtítulos en la imagen original.
✨ Transferencia de Creatividad: Actualización de la simple "transferencia de dinámicas" a "transferencia de creatividad". No solo puede replicar movimientos complejos, sino también capturar con precisión las emociones profundas, el lenguaje de cámara específico y las ideas creativas de "sensación de red" que se necesitan transmitir en el vídeo de referencia.
✂️ Eliminación y edición parcial: Identifica y elimina con precisión objetos específicos para su eliminación o reedición.
🎥 Modificación de perspectiva espacial: Soporte para modificar el ángulo de cámara sobre la base de la imagen original, y puede extrapolar y completar razonablemente los detalles del espacio del vídeo original no presentados.
🎙️ Actualización de referencia de timbre: Soporta la referencia de más timbres y mejora enormemente la precisión de la reproducción del sonido, asegurando que el sonido en el vídeo generado sea altamente consistente con el tono de referencia.
👥 Actualización de referencia de múltiples personas: Resuelve eficazmente el problema de "gemelos (apariencia similar)" y "dislocación de intercambio de caras" que son fáciles de aparecer en escenas con múltiples personas, asegurando que cada personaje en el mismo cuadro mantenga rasgos faciales independientes y únicos.
🟩 Edición de pantalla verde sin costuras: La nueva capacidad de edición de pantalla verde facilita la síntesis de postproducción, el reemplazo de fondos y la creación de efectos especiales, liberando enormemente el espacio creativo de postproducción.
🎬 Control profesional de modelo blanco: Introducción de potentes capacidades de modelo blanco, ya sea para programación compleja de lentes, diseño de storyboard, o para el rol de posición y trayectoria de movimiento, logrando un control preciso de nivel industrial.
🔗 Transición de vídeo sin costuras: Ingresa dos vídeos, el modelo genera automáticamente espacios completos para lograr una conexión sin costuras. Soporta una variedad de métodos de transición creativa.
🎞️ Storyboard de múltiples cuadrículas: Soporte para ingresar imágenes de storyboard de múltiples cuadrículas como referencias de trama, y el modelo genera vídeos coherentes basados en esto. Se recomienda usar imágenes de storyboard de dibujos lineales simples/muñecos de palo, y controlar la composición, escenografía, movimiento de cámara y acción a través del Prompt.

Cómo usar mejor Dreamina Seedance 2.5

1. Configuración de parámetros

¿Qué tipo de imágenes, vídeos, audio y texto se pueden cargar para ayudarnos a generar vídeos de mejor calidad?

En la nueva versión de Dreamina Seedance 2.5, hemos mejorado exhaustivamente la capacidad de generación de aprendizaje multimodal. El sistema sigue soportando los métodos de entrada de primer fotograma, primer y último fotograma, y referencias multimodales. Al mismo tiempo, se han relajado en gran medida el número y las restricciones de duración de los creativos de referencia, y se ha añadido soporte para el controlador de audio puro, brindándote un espacio creativo más flexible y amplio. Las actualizaciones detalladas y las especificaciones de parámetros son las siguientes:

1. Limitaciones de entrada de creativos multimodales

  • Primer fotograma, primer y último fotograma, y referencia multimodal son todas compatibles. El número de entradas permitidas y los límites de duración para la generación de referencia multimodal pueden variar.
TipoReferencia 2.0Referencia 2.5
Imagen Requisitos de imagen única (aplicables a modelos de la serie Seedance 2.0)
  • Formatos: jpeg, png, webp, bmp, tiff, gif, heic y heif
  • Relación de aspecto (ancho/alto): (0.4, 2.5)
  • Largo y ancho (px): (300, 6000)
  • Tamaño: una imagen inferior a 30 MB. El tamaño del cuerpo de la solicitud no debe superar los 64 MB. No uses codificación Base64 para archivos grandes.
  • Formatos: jpeg, png, webp, bmp, tiff, gif, heic y heif
  • Relación de aspecto (ancho/alto): (0.4, 2.5)
  • Largo y ancho (px): (300, 6000)
  • Tamaño: una imagen inferior a 30 MB. El tamaño del cuerpo de la solicitud no debe superar los 64 MB. No uses codificación Base64 para archivos grandes.
Número de imágenes permitidas por solicitud: 0~9 Número de imágenes permitidas por solicitud: 30
Vídeo Pasar una solicitud de vídeo único (para modelos de la serie Seedance 2.0)
  • Formatos: mp4, mov
  • Resolución: 480p-4k
  • Tamaño:
    • Relación de aspecto (ancho/alto): [0.4, 2.5]
    • Largo y ancho (px): [300, 6000]
    • Conteo total de píxeles: [640×640=409600, 3326×2494=8295044], lo que significa que el producto de ancho y alto cumple con los requisitos del intervalo [409600, 8295044].
  • Tamaño: Un solo vídeo no supera los 200 MB.
  • Fotogramas por segundo (FPS): [24, 60]
  • Formatos: mp4, mov
  • Resolución: 480p-4k
  • Tamaño:
    • Relación de aspecto (ancho/alto): [0.4, 2.5]
    • Largo y ancho (px): [300, 6000]
    • Conteo total de píxeles: [640×640=409600, 3326×2494=8295044], lo que significa que el producto de ancho y alto cumple con los requisitos del intervalo [409600, 8295044].
  • Tamaño: Un solo vídeo no supera los 200 MB.
  • Fotogramas por segundo (FPS): [24, 60]
  • La duración de un solo vídeo es [2,15] s, y se pueden pasar hasta 3 vídeos de referencia. La duración total de todos los vídeos no debe superar los 15 s.

Debido a que el vídeo de salida es ligeramente más largo de 15 s, para asegurar que el vídeo de salida permita la entrada, la duración real del vídeo se limita a [1.8, 15.2] s, y la duración total del vídeo se limita a 15.2 s.

  • La duración de un solo vídeo es [2, 30] s, y se pasan hasta 10 vídeos de referencia. La duración total de todos los vídeos no supera los 30 s.

La duración real del vídeo se limita a [1.8, 30.2] s, y la duración total de todos los vídeos se limita a 30.2 s.

Audio Pasar una solicitud de audio único (para modelos de la serie Seedance 2.0)
  • Formatos: wav, mp3
  • Tamaño: El audio no debe superar los 15 MB, y el tamaño del cuerpo de la solicitud no debe superar los 64 MB. No uses codificación Base64 para archivos grandes.
  • Formatos: wav, mp3
  • Tamaño: El audio no debe superar los 15 MB, y el tamaño del cuerpo de la solicitud no debe superar los 64 MB. No uses codificación Base64 para archivos grandes.
  • La duración de un solo audio es [2,15] s, y se pueden pasar hasta 3 segmentos de audio de referencia. La duración total de todos los archivos de audio no debe superar los 15 s.

La duración real del audio se limita a [1.8, 15.2] s, y la duración total del audio se limita a 15.2 s.

  • La duración del audio es [2, 30] s, se pasan hasta 10 segmentos de audio de referencia, y la duración total de todos los audios no supera los 30 s.

La duración real del audio se limita a [1.8, 30.2] s, y la duración total de todos los audios se limita a 30.2 s.

Restricciones de tipo multimodal No admite solo audio, se debe pasar al menos cualquier tipo de creativo de imagen/vídeo. Admite solo audio

Sugerencias de entrada de creativos

EscenarioSugerencias de entrada
¿Límite total superior de creativos?
  • Imágenes: hasta 30 imágenes en resolución 4K.
  • Vídeos: hasta 10 vídeos, con una duración total no superior a 30 s.
  • Audio: hasta 10 piezas de audio, y la duración total de todos los audios no supera los 30 s.
Audio y vídeo principales, ¿cuántos cuerpos principales recomiendas? 1-5 cuerpos principales tiene mejor efecto; más se puede probar con 6-10 cuerpos principales, pero la estabilidad disminuye, puede que necesites repetir.
Audio y vídeo principales, ¿cuánto tiempo recomiendas ingresar? La duración de 5-10 s tiene mejor efecto; duraciones más largas disminuyen la estabilidad, puede que necesites repetir.
Diagrama del cuerpo principal, ¿cuántos cuerpos principales recomiendas? 1-8 cuerpos principales tiene mejor efecto; más se puede probar con 9-12 cuerpos principales, pero la estabilidad disminuye, puede que necesites repetir.
¿Cuáles son las diferencias en los efectos de entrada de imágenes de sujetos desde diferentes perspectivas?
  • 1-5 cuerpos principales: "vista única" y "vista múltiple" están disponibles.
  • Si hay más de 5 sujetos, el efecto de "vista única" es más estable; si necesitas ingresar múltiples perspectivas, se recomienda dividir la entrada en varias vistas diferentes, en lugar de ingresar una imagen que contenga múltiples perspectivas (estabilidad de efecto: múltiples imágenes y múltiples vistas > imagen única y múltiples vistas).
Edición de vídeo, ¿cuánto tiempo de vídeo recomiendas? Mejor efecto dentro de 20 s; la estabilidad disminuye para duraciones más largas y puede requerir repetir.
Edición de imagen de referencia de vídeo, ¿cuántas imágenes recomiendas ingresar? 1-5 imágenes de referencia tienen mejores resultados; más se puede probar con 6-8 imágenes, pero la estabilidad disminuye y puede requerir repetir.

2. Duración de generación

2.02.5
Rango de duración soportado -1 y [4, 15], es decir, 97-361 fotogramas Rango de duración soportado -1 y [4, 30], es decir, 97-721 fotogramas

3. Resolución de salida

  • Resolución: 480p, 720p

2. Interacción de funciones

¿Cómo utilizar mejor los nuevos aspectos destacados de Dreamina Seedance 2.5?

Instrucciones específicasEjemplo
Configuración básica
  • Selecciona [AI Video].
  • Selecciona [Dreamina Seedance 2.5].
  • Elige el tamaño de fotograma, resolución, duración, etc., que prefieras.
  • Elige tu modo favorito: Actualmente, Dreamina Seedance 2.5 soporta "Omni Reference", "Smart Edit", "Long Video" y "First and Last Frames".
    • Entre ellos, "Edición Inteligente" y "Vídeo Súper Largo" son las nuevas funciones que desarrollamos esta vez. Consulta las instrucciones a continuación para más detalles.
Vídeo largo

Soporte para generación directa de vídeos largos en una sola vez, soporte único para generar 30 segundos - 180 segundos de vídeo ultra largo, sin necesidad de múltiples extensiones segmentadas.

  • Completa el guion/prompt del vídeo.
  • Haz clic en el menú desplegable de selección de modo (que puede mostrarse como "Omni Reference" por defecto) y selecciona "Long Video".
  • Haz clic en el icono "Reloj" en la barra de herramientas. Selecciona el tiempo que deseas extender deslizando el eje de tiempo o ingresando valores numéricos directamente. Soporte para selección libre entre 30-180 segundos (como se muestra en la figura, se seleccionan 180 s).
  • Después de confirmar la relación de tamaño de fotograma (como 16:9), la resolución (como 720P+) y la longitud, haz clic en el botón Generar para comenzar a generar vídeos ultra largos de una vez.

Esta función soporta la generación de vídeos ultra largos de 30-180 segundos. ¡Los amigos que quieran generar vídeos largos de una vez pueden usarla!

Extender vídeo

I. Pasos de operación básica

  • Selecciona el vídeo objetivo: En la transmisión de generación de vídeo, localiza el vídeo que deseas extender y haz clic en el icono "Extend Video" debajo del vídeo.
    • ⚠️ Nota: Solo los vídeos originales con una duración de menos de 30 segundos son elegibles para esta función.
  • Para establecer la duración extendida, toca el icono "Reloj" en la pantalla, y puedes deslizar la línea de tiempo o ingresar un valor directamente para seleccionar el tiempo de extensión deseado (ej., selecciona 5 s).
  • Ingresa el prompt en el cuadro de texto, e introduce descripciones de escenas específicas o requisitos de acción para la parte extendida recién añadida.
    • Ejemplo: Si el vídeo original tiene 10 segundos de duración y eliges extenderlo 5 segundos, el prompt ingresado (ej., "el personaje masculino aterriza y mira a la cámara después de derrotar al oponente") solo se aplicará al contenido de los últimos 5 segundos, mientras que los primeros 10 segundos conservarán completamente el metraje del vídeo original.
  • Haz clic en Generar. Después de confirmar que la duración y las palabras clave son correctas, haz clic en el botón de generar a la derecha para obtener el vídeo completo con la duración original más el tiempo extendido (por ejemplo, 10 segundos + 5 segundos = 15 segundos de vídeo).

II. Uso avanzado: Extensión "Anidada"

Esta función soporta múltiples operaciones de extensión "anidadas" consecutivas:

  • Continuar extendiendo: mientras la duración total del nuevo vídeo de salida generado esté dentro de 30 segundos, puedes hacer clic nuevamente en el botón "Extend Video" debajo para realizar una segunda o múltiples extensiones.
  • Demo: Para el vídeo de 15 segundos recién generado, selecciona extenderlo otros 5 segundos e ingresa un nuevo prompt (ej., "el personaje masculino sonríe a la cámara y saluda con la mano"), después de la generación, obtendrás un vídeo continuo de 20 segundos de duración.

III. Explicación de la duración máxima

  • Mientras el "metraje base (vídeo original)" utilizado para la extensión esté dentro de 30 segundos, una sola operación soporta 4 a 30 segundos de extensión de vídeo.
  • En el caso extremo: puedes tomar un vídeo original de 30 segundos, elegir directamente extenderlo 30 segundos y finalmente producir un vídeo ultra largo de hasta 60 segundos de una sola vez.
[Captura de pantalla: botón Extend Video]
[Captura de pantalla: selección de duración de extensión]
[Captura de pantalla: ingreso de prompt]
[Captura de pantalla: resultado de extensión a 15 s]
[Captura de pantalla: extensión anidada a 20 s]
[Captura de pantalla: producto final de 25 s]

Esta función soporta la extensión "anidada". Mientras el vídeo generado esté dentro de 30 segundos, puede soportar la extensión de vídeo de 4 a 30 segundos. Es decir, en el caso extremo, podemos extender un vídeo original de 30 segundos otros 30 segundos, y finalmente producir un vídeo de 60 segundos de salida.

Edición inteligente y Edición con marcas/Edición de vídeo

Si no estás satisfecho con ciertos elementos locales en el vídeo generado o deseas agregar nuevos elementos al fotograma, puedes usar estas dos funciones para realizar modificaciones precisas.

  • Selecciona el modo "Smart Edit": En el modo de edición regular, puedes usar texto directamente para describir el contenido que deseas editar.
  • Después de cargar un vídeo local, el cuadro de entrada activará la función "Edit with marks", que te permite usar herramientas como selección de marco y pincel para una edición fina.
  • Para los vídeos que se han generado con éxito, también puedes seleccionar la función "Video Editing" para editarlos nuevamente.

I. Edición inteligente (Smart Edit)

En la interfaz principal de generación de vídeo, selecciona "Smart Edit", carga el vídeo y escribe un prompt para especificar tus requisitos de edición.

II. Edición con marcas (Edit with marks) / Edición de vídeo (Edit Video)

Localiza el vídeo que deseas editar y toca el icono "Advanced Edit" / "Video Edit".

1. Etiqueta el área de modificación y completa las palabras clave

  • Anotación de fotograma: Debajo del fotograma de vídeo en la ventana emergente, hay una fila de barras de herramientas de anotación. Puedes usar herramientas como selección de cuadro, flechas o puntos de anclaje para rodear o señalar directamente la ubicación específica que necesita modificación en el fotograma (como se muestra en la figura, los pantalones del niño están rodeados con un cuadro rojo).
  • Prompt de entrada: Después de marcar el área, ingresa tus requisitos de modificación detallados en el cuadro de texto en la parte inferior. Por ejemplo: "Cambiar los pantalones del niño a negros, modificar el color de los pantalones en todo el vídeo para mantener la consistencia".
  • Añadir instrucción: Después de confirmar el etiquetado y los prompts, haz clic en el botón "✅Añadir al cuadro de entrada" en el lado derecho de la barra de herramientas.

2. Confirma la marca de tiempo y genera

Después de añadir la instrucción, verás una etiqueta con una hora específica generada en el cuadro de entrada en la parte inferior (ej., "⏱️00:00 Etiquetado de fotograma de vídeo"). Una vez confirmado que es correcto, haz clic en el botón "Generar" en el extremo derecho del cuadro de entrada para enviar la tarea.

3. Ver el producto modificado final

Después de completar la tarea, verás que el nuevo vídeo completa con precisión la modificación local especificada mientras conserva la composición y los movimientos de la imagen original (por ejemplo, los pantalones en el vídeo se han vuelto negros con éxito y se mantienen consistentes en todo el clip).

Smart Edit:

[Captura de pantalla: selección del modo Smart Edit]

Edit with marks:

[Captura de pantalla: interfaz de dibujo]

Edit Video (esta función está disponible para vídeos generados):

[Captura de pantalla: selección de vídeo generado para editar]
[Captura de pantalla: uso de herramientas de selección + prompt]
[Captura de pantalla: selección de marca de tiempo y generación]
[Captura de pantalla: resultado de la modificación]
Plugin Clay Renderer Plugin Dreamina para Maya/Blender: Después de que los usuarios configuran la ruta de la cámara, pueden exportar vídeos directamente y cargarlos en el lado web de Dreamina a través del plugin, haciendo referencia a acciones de modelo blanco, movimientos de cámara, etc., para renderizado de alta calidad. [Dreamina] Seedance 2.5 Guía de Usuario del Plugin Clay Renderer

3. Sugerencias de palabras clave

¿Cómo escribir palabras clave para ayudar a Dreamina Seedance 2.5 a generar mejor los vídeos que queremos?

Palabras clave básicas

FórmulaFormas específicas
Prompt completo = [Descripción de creativos] + [Resumen de una línea] + [Descripción de trama específica] + [Complemento global (final)]
Descripción de creativosNúmero de creativos (en orden de carga) + propósito específico (qué creativos son: personaje/timbre/acción/escena).
Si no hay imagen/vídeo/audio de referencia, se puede omitir.
Resumen de una líneaSujeto + Ubicación + Evento + Tema/Estilo + Movimiento de cámara especial
Descripción de trama específicaEscribir en una línea de tiempo o en una línea argumental:
Un solo storyboard/período de tiempo incluye:
➕ Descripción positiva: contenido específico de la imagen + movimiento de cámara + acción + diálogo + efectos de sonido
➖ Descripción negativa: Elementos no deseados (ej., "sin subtítulos", "sin BGM")
Complemento global (final)Enfatizar nuevamente los elementos y detalles visuales que deben estar presentes en todo el vídeo. Por ejemplo: posición de la cámara + características del entorno/escena + sonido/atmósfera general + iluminación, etc. O algunos elementos que no se desean a nivel global, como subtítulos y música de fondo, también se pueden enfatizar nuevamente aquí.

Caso (ejemplo de prompt para grulla de corona roja)

XML Estilo de documental de naturaleza realista, iluminación cinematográfica realista. En la niebla matinal, dentro de un vasto lecho de juncos en un humedal @image1, una elegante grulla de corona roja está extendiendo sus alas y bailando. @image2 La grulla de corona roja presenta plumas blancas como la nieve, una corona roja brillante, una postura esbelta y erguida, y movimientos ligeros y nobles. La escena es un humedal poco profundo en otoño, con agua brillante, rodeado de juncos dorados, lentejas de agua y plantas acuáticas. El fondo desenfocado presenta niebla matinal distante y el sol naciente. La cámara utiliza un plano medio en ángulo bajo con una ligera sensación de cámara en mano, manteniéndose generalmente estable y manteniendo a la grulla de corona roja en el centro del encuadre en todo momento. 0s-3s: Una grulla de corona roja se mantiene quieta en el agua poco profunda con una postura elegante. Lentamente comienza a desplegar sus amplias alas blancas y negras con movimientos suaves. El flujo de aire del batir de alas crea ondas en la superficie del agua. La brisa matinal sopla y la luz del sol se inclina desde el horizonte, atravesando la niebla para crear un efecto Tyndall (iluminación volumétrica). 3s-8s: La grulla de corona roja salta ligeramente sobre el agua, sus pies golpean alternativamente la superficie, salpicando gotas de agua cristalinas. Su cuello esbelto se inclina hacia atrás con el pico apuntando al cielo. Luego, su cuerpo aterriza suavemente, doblando las alas para volver a una postura erguida. Su cabeza mira elegantemente a su alrededor, emitiendo un llamado claro y prolongado. Ángulo bajo, ligera sensación de cámara en mano, moviéndose ligeramente hacia arriba y hacia abajo para seguir la trayectoria de salto de la grulla. Profundidad de campo natural, con los juncos del primer plano ligeramente borrosos. El sujeto principal, la grulla de corona roja, está en foco nítido, mientras que la niebla matinal y el amanecer del fondo están suavemente borrosos. Sonidos ambientales naturales: agua corriente, el fuerte batir de alas y el llamado de la grulla. La atmósfera general es pacífica, etérea y altamente estética.

Cómo escribir personajes realistas

¿Has tenido esta experiencia al hacer vídeos? Quieres generar personajes de estilo realista, pero los personajes generados siempre tienen un aspecto de IA o parecen gemelos. Ven y echa un vistazo a esta fórmula, que puede ayudarte a optimizar el efecto.

Fórmula de persona realistaEjemplo
[Fórmula general]
Personaje = [Edad/Raza] + [Color de piel/Textura] + [Detalles faciales] + [Ojos/Alma] + [Peinado/Color de cabello] + [Ropa/Textura de la ropa] + [Tipo de cuerpo/Emoción/Temperamento] + [Otros requisitos] (si los hay)

Explicación detallada de las fórmulas para cada dimensión:
[Edad/Raza] Mujer asiática de 22 años, con un rostro cinematográfico clásico y suave.
[Color de piel/textura] Tono de piel frío y claro, mostrando una textura cálida y delicada, conservando los poros y la textura de la piel reales.
[Detalles faciales] Ojos de melocotón alargados (cuencas ligeramente húmedas), cejas ligeramente estiradas, puente nasal pequeño y recto, labios carnosos y una sonrisa suave en las comisuras de la boca, mandíbula suave.
[Ojos/Alma] Los ojos son extremadamente cariñosos y afectuosos, el fondo de los ojos parece tener un manantial de agua, la mirada es suave y enfocada, mostrando un profundo apego y un toque de renuencia.
[Peinado/Color de cabello] El cabello negro está recogido en un moño bajo clásico y elegante, fijado solo con una horquilla de jade simple. Unos mechones de cabello fino negro caen inadvertidamente en el borde de las mejillas, meciéndose suavemente con la brisa.
[Ropa/Textura de la ropa] Vestido con un sencillo traje antiguo de cuello cruzado blanco liso, la tela es seda simple y elegante o gasa ligera con un brillo suave, y el cuello está ligeramente abierto.
[Tipo de cuerpo/Estado de ánimo/Temperamento] Figura esbelta, hombros estrechos, irradia un temperamento romántico clásico suave y cariñoso. Composición de primer plano, contacto visual con la cámara.
1. [Edad/Raza] (Tono del personaje) Especifica grupo de edad, raza, forma y estilo de la cara.
Fórmula de subdivisión: [Edad específica] + [Nacionalidad/raza específica] + [Adjetivo de estilo] + [Sustantivo de forma de rostro]
Tales como:
a. Mujer asiática de 22 años, con un rostro frío y clásico de huesos marcados.
b. Hombre británico de 25 años, con un rostro aristocrático británico delgado e inteligente.
c. Mujer afroamericana de 26 años, con un rostro de supermodelo de perla negra extremadamente tridimensional.
2. [Color de piel/textura] (Evita el blanco plano, realza la sensación de realidad) Escribe el tono de color y la textura real.
Fórmula de subdivisión: [Tonos fríos y cálidos] + [Sustantivo de tono de piel específico] + [Adjetivo de textura de piel] + [Sufijo de fidelidad forzada: conservar los poros y la textura de la piel reales (se pueden añadir pecas/manchas)]
Tales como:
a. Tono de piel frío y claro, que irradia una textura de jade delicada y húmeda, conservando los poros y la textura de la piel reales.
b. Color miel cálido, con un aspecto brillante después de la exposición al sol. Hay pecas reales tenues en el puente de la nariz, conservando los poros finos y la textura de la piel.
c. Piel de color trigo áspera, con una sensación de viento y escarcha y finas líneas finas, conservando poros grandes reales, marcas de barba y textura de la piel.
3. [Características faciales detalladas] (Determina el reconocimiento) Escribe los detalles faciales de la persona.
Fórmula de subdivisión: [Descripción de la forma de los ojos] + [Característica del hueso de la ceja] + [Característica del puente nasal] + [Característica de la forma de los labios] + [Característica de la mandíbula/huesos] (Escribe al menos 3-4 puntos de combinación)
Tales como:
a. Ojos de melocotón alargados (cuencas ligeramente húmedas), puente nasal pequeño y recto, labios carnosos con una leve sonrisa en las comisuras, y mandíbula suave.
b. Ojos de fénix ligeramente levantados, huesos de las cejas tridimensionales con pliegues altos, puente nasal alto y contenido, pómulos ligeramente prominentes, y una mandíbula clara y nítida como un cuchillo.
c. Ojos redondos de almendra, con una sensación de inocencia debajo de los párpados, nariz ligeramente levantada con un toque carnoso, labios llenos, ligera grasa en las mejillas y líneas faciales suaves.
4. [Ojos/Alma] (Determina la emoción) Escribe la información transmitida por los ojos y transmite emociones.
Fórmula de subdivisión: [Adjetivo de ojos] + [Información/metáfora transmitida por el contacto visual] + [Emoción subyacente revelada]
Tales como:
a. Los ojos son extremadamente cariñosos y afectuosos, como si hubiera un manantial de agua en el fondo de los ojos. La mirada es suave y enfocada, revelando un profundo apego y un toque de renuencia.
b. Los ojos son extremadamente tranquilos y vacíos, como un agujero negro sin fondo. La mirada es aguda y opresiva, revelando un toque de peligro difícil de alcanzar.
c. La mirada está dispersa y apagada, con una mirada baja y desenfocada, revelando un profundo sentimiento de agotamiento y entumecimiento hacia la vida.
5. [Peinado/Color de cabello] (Rechaza el negro monótono, muestra estado y atmósfera) Describe el estado, rizo y textura del cabello.
Fórmula de subdivisión: [Color de cabello específico] + [Condición/textura del cabello] + [Sustantivo de peinado específico] + [Complemento de interacción ambiental (como ser soplado por el viento/despeinado)]
Tales como:
a. El cabello negro está recogido en un moño bajo clásico y elegante, fijado solo con una horquilla de jade simple. Unos mechones de cabello fino negro caen casualmente en el borde de las mejillas, rozados suavemente por la brisa.
b. Cabello largo ligeramente rizado de color marrón caramelo que presenta una sensación natural esponjosa y despeinada como recién despertado, con algunos mechones de cabello cayendo casualmente sobre la clavícula.
c. Cabello corto plateado a la altura de las orejas con una fuerte textura de reflejos similares a un espejo, bordes afilados del cabello, pegado al cuero cabelludo.
6. [Ropa/Textura de la ropa] (Muestra estilo) Escribe el estilo específico, el material y el estado de nuevo o viejo, y realza las características del personaje de forma indirecta.
Fórmula de subdivisión: [Patrón/corte] + [Color] + [Prenda específica] + [Material de la tela/estado de nuevo o viejo] + [Método de uso/detalle]
Tales como:
a. Un sencillo traje antiguo de cuello cruzado blanco liso, hecho de seda suave y elegante o gasa ligera con un brillo. El cuello está ligeramente abierto y no tiene bordados adicionales.
b. Una chaqueta de motociclista de cuero marrón oscuro holgada y desgastada, con arrugas de desgaste reales y cremalleras metálicas reflectantes en la superficie del cuero, combinada con una camiseta gris lavada hasta el blanco.
c. Un traje de doble botonadura negro profundo con un corte extremadamente ajustado, hecho de tela de lana mezclada de alta gama rígida, combinado con una corbata de seda rojo oscuro, meticuloso.
7. [Tipo de cuerpo/Estado de ánimo/Temperamento] (Determina la composición y la sensación narrativa de la imagen) Escribe las características del esqueleto, la composición de la imagen y la atmósfera general.
Fórmula de subdivisión: [Características del esqueleto/hombros] + [Requisitos de composición/plano] + [Acción del personaje/Mirada] + [Palabras de atmósfera general]. Si la descripción general de la historia contiene descripciones de composición, plano y acciones del personaje, se pueden eliminar [Requisitos de composición/plano] + [Acción del personaje/Mirada].
Tales como:
a. Figura esbelta, hombros estrechos. Composición de primer plano de la mitad superior del cuerpo, con mirada directa a la cámara. En general, irradia un temperamento romántico clásico suave, elegante y cariñoso.
b. El esqueleto es ancho y los hombros son gruesos y anchos. La composición de todo el cuerpo se toma desde una posición baja de la cámara, con el personaje de pie de lado y mirando hacia atrás a la cámara. Todo irradia una sensación épica dura y trágica de supervivencia en una situación desesperada.
c. La figura es esbelta y erguida. La composición del rostro es un primer plano, con la mitad de la cara oculta en la sombra. Todo irradia una atmósfera misteriosa y peligrosa, un protagonista de película de terror que causa asfixia.

Cómo escribir un vídeo largo de 30 segundos

Dreamina Seedance 2.5 puede soportar la generación de vídeos largos de 30 segundos, y está optimizado con múltiples funciones (marca de tiempo, referencia multimodal, mejora de eliminación de elementos irrelevantes, etc. Los detalles de estas funciones se han presentado en el texto anterior). Entonces, ¿cómo "aprovechar" estas funciones al máximo? ¡Por supuesto, es hacer un uso completo de ellas en el prompt!

Fórmula de vídeo largo de 30 segundosEjemplo (aquí tomamos palabras clave largas como ejemplo. Los amigos también pueden escribir palabras clave más cortas según la fórmula en la operación real)
Describe el tono de todo el vídeo en una frase 29 segundos, una sola toma hasta el final (mujer de vestimenta antigua se despide junto al río)
Módulo 1: [Capa de referencia multimodal]
(Si los amigos no han cargado imágenes/audio/vídeo de referencia, este elemento se puede omitir)
Fórmula: Basado en el [tipo de creativo de referencia] cargado, mantener estrictamente [...] consistente, bloquear estrictamente [...].
Por ejemplo:
Basado en la [imagen] cargada, mantener estrictamente la consistencia del [rostro/características] del personaje en @Figura 1, mantener la consistencia de la [composición/modelo blanco/relación espacial] en @Figura 2, y bloquear estrictamente la posición del personaje.
En el prompt de todo el texto, también puedes mencionar @imágenes/vídeos/audios varias veces, ¡lo que será más preciso!
Módulo 2: [Configuración global] (Visión del mundo global + Anti-colapso)
Fórmula: [Entorno básico y textura] + [Estilo visual] + [Lenguaje de cámara] + [Modelado del personaje] + [Núcleo de rendimiento] + [Prohibido]
1. Entorno básico y textura: [tiempo] + [lugar] + [atmósfera] + [limitación de prompt (se puede cambiar): enfatizar la textura física realista última]
2. Estilo visual: [cinematográfico/realista/bidimensional, etc.] + [control de profundidad] + [método de iluminación]
3. Lenguaje de cámara: [Escena/Perspectiva] + [Descripción detallada]
4. Estilismo del personaje: Usa [¿Cómo generar un personaje realista?] o menciona directamente la imagen de referencia y describe la imagen de referencia. También se puede cambiar a la forma del cuerpo principal: [Cuantificador] + [Color] + [Forma/Estilo de diseño] + [Sustantivo de objeto específico] + [Detalles del material/Estado de uso] + [Características icónicas]
5. El núcleo del rendimiento: Los puntos clave que deben enfatizarse en la película terminada se pueden escribir según la situación real.
6. Elementos prohibidos: Enumera el contenido que deseas prohibir, puedes comenzar desde [sonido] + [subtítulo] + [comportamiento] + [lugar propenso al colapso] etc. Por ejemplo: prohibir movimientos corporales grandes, prohibir la generación de líneas adicionales o BGM, prohibir la generación de subtítulos.
HTML **[Configuración de escena global]Entorno base:** A orillas del río al amanecer, con un pequeño barco borroso al fondo, una escena de despedida solitaria. La atmósfera es tranquila y contenida.**Estilo visual:** Cinematográfico, profundidad de campo reducida (fondo simple y borroso), luz natural suave.**Lenguaje de cámara:** Mantiene consistentemente un primer plano de la mujer, imitando el POV subjetivo de "él" parado directamente frente a ella. Sutil movimiento de cámara en mano (efecto de respiración), sin cortes rápidos.
**[Estilismo del personaje][Edad / Etnia]** Mujer asiática de 22 años, con un rostro cinematográfico altamente clásico y suave.**[Tono de piel / Textura]** Tono de piel frío y claro, revelando una textura delicada y húmeda, conservando poros finos realistas y textura de piel natural.**[Rasgos faciales]** Ojos alargados y elegantes (ligeramente húmedos/llorosos), cejas ligeramente relajadas, un puente nasal delicado y recto, labios carnosos con una sonrisa suave y tenue en las comisuras, y una mandíbula suave.**[Ojos / Alma]** Mirada extremadamente cariñosa y expresiva, ojos brillantes como agua de manantial. Suave y enfocada, revelando un profundo apego y un toque de renuencia a separarse.**[Estilo de cabello / Color]** Cabello negro azabache recogido en un moño bajo clásico y elegante, asegurado solo con una horquilla de jade simple. Algunos mechones sueltos de cabello negro caen casualmente alrededor de sus mejillas, meciéndose suavemente con la brisa.**[Vestimenta / Textura]** Vestida con un vestido tradicional minimalista de cuello cruzado blanco puro (estilo Hanfu). La tela es seda elegante o gasa ligera con un brillo suave, ligeramente suelta en el cuello.**[Fisico / Emoción / Aura]** Figura esbelta con hombros estrechos y delicados, irradiando un aura romántica clásica suave, elegante y profundamente cariñosa.
**[Rendimiento central]** Contenido y matices. Enfocarse en capturar la mirada cambiante, el ascenso y descenso de su respiración, ligero temblor de los labios, movimientos sutiles de las cejas, cambios sutiles en las fosas nasales, deglución de la garganta y el proceso natural de una lágrima deslizándose por su mejilla.
**[Prompts negativos / Restricciones]** Sin llanto exagerado, sin cortes rápidos, sin movimientos corporales grandes, sin generar diálogo adicional o BGM, sin moco nasal, sin que las lágrimas caigan prematuramente.
Módulo 3: [Storyboard con marcas de tiempo] (¡Puede ayudar a todos a dirigir la obra con precisión!)
Fórmula: Divide el vídeo largo en varios segmentos de tiempo cortos y especifica el contenido que debe seguirse estrictamente para cada segmento.
Fórmula de cada segmento de tiempo:
1. [Segundo inicial - Segundo final] + [Fase/tema central]
2. [Instrucciones de acción/expresión, y otros a nivel físico]: como [escena] + [composición] + [acción detallada del personaje], etc.
3. [Análisis emocional o programación de cámara, etc.]: Explica tu expresión profunda de las instrucciones a nivel físico a la IA.
4. Se pueden añadir otros requisitos según la situación real. Por ejemplo, si quieres generar un vídeo con cortes, puedes consultar el prompt de referencia de transición en "¿Cómo escribir una extensión de vídeo?" y añadirlo.
XML **[Storyboard de Emoción y Acción (Progresión de 0-29 Segundos)]**
**Etapa 1: 0-3s [Cuestionamiento] — Espera Renuente**
**Acción/Expresión:** La cámara se enfoca en su rostro. Ella mira directamente al lente (a "él" frente a ella). No hay lágrimas en sus ojos todavía, mostrando una quietud que se hunde lentamente. Ella mira su rostro, sus cejas ligeramente fruncidas, sus labios ligeramente separados, y susurra suavemente: "¿De verdad te vas?"
**Análisis Emocional:** Mirada directa (Emoción: Ella no se está quejando amargamente, sino esperando que él confirme personalmente una respuesta que ya adivinó). Susurro suave (Emoción: Después de que caen las palabras, parece que muchas palabras no dichas permanecen atascadas en su garganta).
**Etapa 2: 3-10s [Resignación] — Tragando la Amargura**
**Acción/Expresión:** Su mirada se desvía lentamente de su rostro, mirando hacia el espacio vacío a su lado. Sus párpados caen, las pestañas superiores e inferiores se superponen. Las comisuras de su boca se curvan ligeramente en una breve sonrisa, que se desvanece al instante. Sus fosas nasales se dilatan ligeramente mientras toma una respiración tranquila y muy contenida, su pecho se eleva y cae suavemente una vez.
**Análisis Emocional:** La sonrisa (Emoción: Una sonrisa amarga de autocrítica y resignación; una sonrisa de "ya lo sabía"). El movimiento del pecho (Emoción: A través de esta acción, parece que está tragando forzadamente sus penas y tristezas de vuelta a su estómago).
**Etapa 3: 11-17s [Recordando] — El Grabado Final**
**Acción/Expresión:** La cámara se acerca lentamente (zoom ligero). Ella vuelve su mirada hacia su rostro, sus ojos escanean lenta y cuidadosamente sus rasgos. Sus ojos ahora están enrojecidos, pero obstinadamente contiene las lágrimas, sin dejarlas caer. Acompañado de una pausa de silencio de 0.5 segundos en el medio, sus labios se tensan ligeramente y luego se presionan juntos, su mandíbula se aprieta, y su garganta traga ligeramente.
**Análisis Emocional:** Su mirada escaneando lentamente su rostro (Emoción: En este momento, su mirada ya no es solo para despedirse, sino para grabar y recordar la apariencia de esta persona en su vida por última vez).
**Etapa 4: 18-23s [Arrepentimiento] — Un Suspiro Silencioso**
**Acción/Expresión:** Ella baja la mirada, y solo entonces las lágrimas comienzan a caer. Una sola lágrima cae directamente sin previo aviso, aterrizando en su cuello. No la seca, ni solloza; solo deja que la lágrima se deslice silenciosamente. Cuando vuelve a mirarlo, la emoción en sus ojos ha cambiado. Inmediatamente después, sus cejas firmemente fruncidas comienzan a relajarse lentamente. Ella niega ligeramente con la cabeza (un movimiento microscópico, casi imperceptible).
**Análisis Emocional:** El cambio de emoción al mirar hacia arriba (Emoción: Su mirada cambia de tratar de hacer que se quede a un profundo arrepentimiento, como diciendo "Podríamos haber sido tan buenos juntos", pero lo deja sin decir). El relajamiento de las cejas y el ligero movimiento de cabeza (El desfruncimiento de sus cejas simboliza una liberación gradual interna, mientras que ese pequeño movimiento de cabeza es un suspiro final instintivo y una negación de su destino impotente).
**Etapa 5: 24-29s [Dejando Ir] — Aceptación Aliviada**
**Acción/Expresión:** La cámara se acerca a un primer plano extremo. Ella intenta esbozar una sonrisa suave (muy ligera, muy suave, sin autocrítica). Justo cuando la sonrisa llega a las comisuras de su boca, una segunda lágrima se desliza desde la comisura de su ojo, pasa por su nariz y se detiene en su labio. No llora en voz alta, no se derrumba; solo lo mira en silencio con lágrimas en los ojos, y dice en una voz apenas audible pero fuertemente controlada: "Puedes irte." (Al decir la palabra "ir", hay un temblor extremadamente tenue en su voz, pero suprime forzadamente el tono de llanto). Después de decir esto, su sonrisa se congela en su rostro, las lágrimas continúan deslizándose, y su mirada no se desvía, todavía mirando a "él" frente al lente. La cámara finalmente se detiene en su rostro sonriente y lloroso, sus ojos llenos de profundo arrepentimiento.
**Análisis Emocional:** La sonrisa suave (Emoción: A diferencia de la sonrisa anterior, esta es muy ligera y suave, sin autocrítica, solo pura renuencia a separarse y la ternura última). Ella no se derrumba; en cambio, usa una contención extrema para lograr la liberación y realización final.

Efectos de vídeo con fórmulas (ejemplos)

¡Veamos el efecto de vídeo hecho con fórmulas! (se puede usar con fórmulas de persona realista)

Prompt de una sola tomaUna sola tomaPrompt de corte/transiciónCorte/transición
HTML**29 segundos, una sola toma (mujer de vestimenta antigua se despide junto al río)**
**[Configuración de escena global]Entorno base:** A orillas del río al amanecer, con un pequeño barco borroso al fondo, una escena de despedida solitaria. La atmósfera es tranquila y contenida.**Estilo visual:** Cinematográfico, profundidad de campo reducida (fondo simple y borroso), luz natural suave.**Lenguaje de cámara:** Mantiene consistentemente un primer plano de la mujer, imitando el POV subjetivo de "él" parado directamente frente a ella. Sutil movimiento de cámara en mano (efecto de respiración), una sola toma continua sin cortes rápidos.
**[Estilismo del personaje][Edad / Etnia]** Mujer asiática de 22 años, con un rostro cinematográfico altamente clásico y suave.**[Tono de piel / Textura]** Tono de piel frío y claro, revelando una textura delicada y húmeda, conservando poros finos realistas y textura de piel natural.**[Rasgos faciales]** Ojos alargados y elegantes (ligeramente húmedos), cejas ligeramente relajadas, un puente nasal delicado y recto, labios carnosos con una sonrisa suave y tenue en las comisuras, y una mandíbula suave.**[Ojos / Alma]** Mirada extremadamente cariñosa y expresiva, ojos brillantes como agua de manantial. Suave y enfocada, revelando un profundo apego y un toque de renuencia a separarse.**[Estilo de cabello / Color]** Cabello negro azabache recogido en un moño bajo clásico y elegante, asegurado solo con una horquilla de jade simple. Algunos mechones sueltos de cabello negro caen casualmente alrededor de sus mejillas, meciéndose suavemente con la brisa.**[Vestimenta / Textura]** Vestida con un vestido tradicional minimalista de cuello cruzado blanco puro (estilo Hanfu). La tela es seda elegante o gasa ligera con un brillo suave, ligeramente suelta en el cuello.**[Fisico / Emoción / Aura]** Figura esbelta con hombros estrechos y delicados, irradiando un aura romántica clásica suave, elegante y profundamente cariñosa.
**[Rendimiento central]** Contenido y matices. Enfocarse en capturar la mirada cambiante, el ascenso y descenso de su respiración, ligero temblor de los labios, movimientos sutiles de las cejas, cambios sutiles en las fosas nasales, deglución de la garganta y el proceso natural de una lágrima deslizándose.
**[Prompts negativos]** Sin llanto exagerado, sin cortes rápidos, sin movimientos corporales grandes, sin diálogo extra, sin BGM, sin moco nasal, sin que las lágrimas caigan prematuramente.
[dreamina-2026-07-16-7086-29 秒一镜到底 【全局场景设定】 基础环境:江边桥上,背景有模糊的小船,寂寥的....mp4]
XML**[Configuración global] (Visión del mundo y Anti-Distorsión)Entorno base y textura:** Un antiguo bosque mágico al amanecer, envuelto en una densa niebla matutina. Enfatizar texturas físicas realistas extremas y rendimiento óptico. El efecto Tyndall (rayos de Dios / iluminación volumétrica) penetrando el dosel de árboles, esporas brillantes flotando en el aire, y la refracción óptica de las gotas de agua en las hojas de las plantas deben ser altamente realistas y delicadas.**Estilo visual:** Estilo épico de alta fantasía. Paleta de colores primarios de verde esmeralda y oro del amanecer. La profundidad de campo cambia dinámicamente con los cortes de cámara. Usa contraluz y luz de fondo lateral (iluminación de contorno) para acentuar la atmósfera de ensueño.**Lenguaje de cámara:** Edición de montaje. Incluye primeros planos macro, tomas amplias con grúa y tomas de seguimiento orbital de 360 grados.
**[Estilismo del personaje][Edad / Etnia]:** Elfa de 18 años, con un rostro cinematográfico extremadamente etéreo, transparente e inocente de "primer amor".**[Tono de piel / Textura]:** Piel extremadamente pálida de tono frío, revelando una textura cristalina y húmeda como el rocío de la mañana. Conserva microporos realistas, textura de piel translúcida y pecas claras y naturales en el puente de la nariz.**[Rasgos faciales]:** Ojos redondos e inocentes de ciervo con párpados inferiores ligeramente caídos (ojos de cachorro), hueso de la ceja suave y gentil, punta de la nariz ligeramente levantada y ligeramente carnosa, tubérculo labial carnoso y delicado, ligera grasa en las mejillas y orejas de elfo largas y puntiagudas icónicas.**[Ojos / Alma]:** Mirada extremadamente clara e inocente, completamente mundana. Sus ojos transmiten una ingenuidad parecida a la de un ciervo, pureza y una fuerte curiosidad y afinidad por todas las cosas naturales.**[Estilo de cabello / Color]:** Cabello plateado aurora hasta la cintura. Presenta una textura premium, sedosa y suave con un reflejo sutil. El cabello cae naturalmente, con algunas enredaderas diminutas que emiten un tenue brillo azul entrelazadas entre los mechones, meciéndose suavemente con el viento.**[Vestimenta / Textura]:** Un vestido largo sin mangas de cuello cruzado, tejido con gasa menta translúcida y hojas verdes esmeralda reales. La tela es extremadamente fina, con texturas de hilo realistas y aparece semitranslúcida bajo la luz.**[Fisico / Emoción / Aura]:** Estructura esquelética extremadamente pequeña, hombros estrechos y delgados, con una postura ligera como una pluma. Irradia un aura de cuento de hadas de fantasía sobrenatural, sagrada, pura, etérea y bellamente romántica.**Rendimiento central:** Mostrar la sensación inocente de despertar de un sueño profundo y su interacción etérea con el entorno mágico.**[Prompts negativos]:** Sin artefactos humanos modernos. Sin movimientos rápidos y temblorosos de cámara (mantener suave y blando). Sin rasgos faciales distorsionados o dedos adicionales. Forzar silencio (sin subtítulos, sin BGM).
**[Storyboard con marcas de tiempo (con cortes explícitos)]**
**[00:00 - 00:07] Toma 1: [Microcosmos del Sueño] (Primer plano macro)Acción / Directivas físicas:** Primer plano macro extremo. El fotograma muestra una hoja de plátano gigante cubierta de rocío y brillante. La cámara se desplaza lentamente, revelando a la elfa acurrucada y durmiendo en el centro de la hoja. Sus ojos están bien cerrados, su cabello plateado extendido sobre la hoja verde, su pecho subiendo y bajando suavemente con una respiración tranquila, y algunas mariposas azules brillantes descansando en las puntas de su cabello.**Subtexto de cámara:** Tranquilidad extrema y belleza estética. Usar una perspectiva microscópica para acercar a la audiencia al personaje, reflejando su integración etérea con la naturaleza.
**[00:08 - 00:15] Toma 2: [Despertar y Toque] (Plano medio cercano ➔ Primer plano)Acción / Directivas físicas:** *Requiere una transición natural en el corte (sin cortes bruscos).* Cortar a un plano medio cercano de su rostro. Un rayo de luz matinal golpea su mejilla. Ella frunce ligeramente el ceño y abre lentamente los ojos (pupilas verde lago). Se sienta y mira a su alrededor con perplejidad inocente. Luego, la cámara sigue su mirada, cortando a un primer plano de su mano: extiende un dedo delgado, y una mariposa azul brillante se posa suavemente en su yema.**Subtexto de cámara:** Muestra el hermoso momento del despertar de la vida. Los movimientos deben ser extremadamente suaves y lentos; sus ojos llenos de la pureza inocente del primer despertar.
**[00:16 - 00:23] Toma 3: [Danza y Resonancia] (Plano medio de seguimiento orbital)Acción / Directivas físicas:** *Requiere una transición natural en el corte.* La cámara se aleja a un plano medio y comienza un vuelo orbital suave de 360 grados a su alrededor. Ella se levanta ligeramente de la hoja, sus dedos de los pies tocan suavemente el aire, flotando sin peso. Mientras se eleva y gira, su falda de gasa ligera se extiende como ondas de agua. Enjambres de mariposas azules brillantes bailan a su alrededor en bandadas, dejando estelas de luz.**Subtexto de cámara:** Este es el clímax de acción de la película. Enfocarse en mostrar la interacción ambiental y la ingravidez extrema de las prendas fluidas (la simulación de tela debe ser perfecta).
**[00:24 - 00:30] Toma 4: [Mundo Grandioso] (Plano en ángulo bajo ➔ Extracción rápida a gran altitud)Acción / Directivas físicas:** *Requiere una transición de barrido (la pantalla es oscurecida brevemente por una bandada de mariposas volando, luego revelada).* La cámara corta a un plano en ángulo extremadamente bajo. La elfa vuela sin peso hacia arriba a través del bosque, dirigiéndose hacia un Árbol del Mundo que se eleva hacia las nubes. Inmediatamente después, la cámara se retira y se eleva rápidamente. El campo de visión se vuelve instantáneamente infinitamente vasto: revelando todo el gran bosque mágico envuelto en niebla matinal, cascadas y plantas brillantes. La niña se convierte en un diminuto punto brillante en el bosque. El fotograma se congela en esta toma amplia, épica y majestuosa.**Subtexto de cámara:** Concluir con un contraste extremo en perspectiva (de microscópico a escala grandiosa última), dejando a la audiencia con una imaginación infinita sobre este mundo mágico masivo. Maximizar la sensación cinematográfica épica.
[dreamina-2026-07-16-2020-【全局设定】(全局世界观 + 防崩坏) 基础环境与质感: 清晨的远古魔法森林,被....mp4]
XML**30 segundos, una sola toma (Persecución y transformación de mecha de ciencia ficción)**
**[Configuración global]Entorno base y textura:** Un puente marítimo futurista de estilo cyberpunk en 2077. Lluvia intensa, la superficie de la carretera está severamente anegada. Enfatizar texturas físicas realistas extremas (reflejos de lluvia en superficies metálicas, agua salpicada por los neumáticos y la refracción especular de las llamas de escape deben obedecer estrictamente la física del mundo real).**Estilo visual:** Sensación cinematográfica de ciencia ficción dura, tonos oscuros de neón de alto contraste (rosa cyber y azul hielo como colores primarios), obturación de alta velocidad (para capturar claramente las salpicaduras de lluvia y chispas).**Lenguaje de cámara:** POV de dron subjetivo de alta velocidad, transmitiendo una fuerte sensación de impacto de velocidad y la turbulencia de cortar el flujo de aire. Una sola toma continua.**Estilismo del sujeto:** Una motocicleta mecha conceptual plateada y negra, extremadamente aerodinámica con una vibra de industria pesada y fuertemente blindada. Sus tubos de escape emiten llamas de plasma azules y misteriosas.**Rendimiento central (Acción):** Enfocarse en los cambios del centro de gravedad durante la conducción a alta velocidad, la fricción/adherencia física de los neumáticos y la estética mecánica de la industria pesada de engranajes de precisión que se entrelazan firmemente durante la transformación en el aire.**[Prompts negativos]:** Sin torsión o recorte de tipo cuerpo blando o molusco de la estructura del mecha durante el movimiento (debe mantener la rigidez metálica); sin entidades humanas; eliminar estrictamente subtítulos irrelevantes; forzar silencio/sin BGM predeterminado; evitar elementos IP con derechos de autor como Transformers o Tron.
**[Storyboard con marcas de tiempo]**
**[00:00 - 00:08] [Conducción a velocidad extrema] — Atravesando el vientoAcción / Directivas físicas:** La cámara roza la carretera anegada, siguiendo muy de cerca y al lado de la motocicleta mecha a velocidad extrema. La motocicleta corre bajo la lluvia intensa. Los neumáticos anchos que giran rápidamente levantan enormes cortinas de agua de varios metros de altura. Las llamas de escape de plasma azul arrastran largas estelas de luz a través del telón de lluvia nocturna.**Subtexto de cámara:** Transmite una sensación extrema de velocidad a la IA, enfocándose en la interacción física entre la lluvia, los reflejos de los charcos y las llamas del motor.
**[00:09 - 00:16] [Evasión extrema] — Cambio de gravedadAcción / Directivas físicas:** La cámara se eleva instantáneamente para una toma en ángulo alto inclinado hacia abajo (cambio de perspectiva espacial). Una explosión en cadena de restos de vehículos abandonados aparece como un obstáculo adelante. La motocicleta se inclina extremadamente hacia un lado, casi tocando el suelo. Los neumáticos chirrían contra la carretera, generando chispas de fricción naranjas deslumbrantes, ejecutando una curva "S" perfecta y cerrada para tejer a través de los escombros en llamas.**Subtexto de cámara:** Presenta el cambio en el centro de gravedad durante las maniobras a alta velocidad, mostrando la retroalimentación de gravedad y los efectos VFX de chispas de la fricción extrema de los neumáticos contra el suelo.
**[00:17 - 00:24] [Reensamblaje en el aire] — Transformación mecánicaAcción / Directivas físicas:** La motocicleta mecha carga fuera de una sección rota del puente, lanzándose al aire. La cámara salta al aire con ella, orbitando el sujeto. Durante el tiempo en el aire (suspensión en cámara lenta), la armadura de la motocicleta se voltea rápidamente, se deconstruye y se reensambla. Las ruedas se retraen para convertirse en propulsores, y el chasis se despliega para extender extremidades de acero, transformándose instantáneamente de una forma de motocicleta en un mecha de combate humanoide fuertemente blindado.**Subtexto de cámara:** Muestra la estética puramente mecánica de la industria pesada, enfatizando el entrelazado preciso y la masa volumétrica de las piezas durante el ensamblaje, rechazando estrictamente la transformación de "cuerpo blando" tipo fideo.
**[00:25 - 00:30] [Aterrizaje pesado] — Poder congeladoAcción / Directivas físicas:** La cámara cae rápidamente a un primer plano extremo en ángulo bajo (toma a quemarropa). El mecha humanoide aterriza pesadamente en la autopista, cayendo sobre una rodilla. El impacto de la tonelada masiva hace que la superficie del puente se rompa en un patrón de telaraña. La onda de choque concusiva expulsa instantáneamente la cortina de lluvia circundante (explotando hacia afuera en un anillo). El mecha levanta lentamente la cabeza, sus luces oculares tácticas parpadeando en rojo carmesí brillante, mirando directamente a la cámara mientras se congela.**Subtexto de cámara:** Crea un "Superhéroe Aterrizando" visualmente explosivo, transmitiendo a la audiencia el peso aterrador y el poder destructivo del mecha a través de la carretera destrozada y la onda de choque expulsada.
[dreamina-2026-07-16-6419-30 秒一镜到底(科幻机甲追逐与变形)【全局设定】 基础环境与质感: 2077 ....mp4]
XML**[Configuración global] (Visión del mundo y Anti-Distorsión)Entorno base y textura:** Una taberna salvaje al aire libre en un bosque de bambú apartado a altas horas de la noche. Enfatizar textura de animación de alta calidad de primer nivel (2D/Cel-shaded). La trayectoria de caída de las hojas de bambú y los rizos en el vino deben obedecer estrictamente las leyes físicas, poseyendo el flujo elegante y etéreo único de la animación estética tradicional china.**Estilo visual:** Anime de wuxia antiguo chino de primer nivel (realismo Cel-shaded / renderizado 2.5D), con bordes renderizados con tinta china. Alto contraste entrelazado de iluminación fría y cálida (la luz de luna azul-blanca y fría contrastando con la luz de vela amarilla cálida en la mesa de la taberna).**Lenguaje de cámara:** Emplea un montaje de edición afilado y múltiples tipos de transiciones físicas sin costuras. Contraste extremo entre la inmovilidad y el movimiento explosivo.**Estilismo del personaje:** Un joven espadachín de 22 años, con un rostro guapo y de contornos afilados típico del anime chino. Cejas en forma de espada y ojos estrellados, cabello recogido en una cola de caballo alta con mechones sueltos y desordenados enmarcando su frente. Vistiendo un atuendo de artes marciales de cuello cruzado elegante, de base blanca y bordes negros (Jin-zhuang). Una espada larga en una vaina negra descansa sobre la mesa.**Rendimiento central:** Enfocarse en la velocidad de "golpe de un solo golpe" en el wuxia de primer nivel, la compostura tranquila del espadachín y el "espacio en blanco" poético (dejando cosas a la imaginación) de la estética oriental.**[Prompts negativos]:** Sin sensación 3D grasienta (mantener estrictamente el estilo anime 2D / cel-shaded puro). Sin movimientos de combate lentos y desordenados o recorte/distorsión de extremidades. Sin subtítulos o diálogo extra. *Énfasis: El efecto de tinta china solo debe aparecer DESPUÉS de 25 segundos, activado por el sonido de "clic", absolutamente sin aparición prematura. El cuenco de vino no debe aparecer hasta que la luna llena se haya desvanecido por completo.*
**[Storyboard con marcas de tiempo (con transiciones de corte explícitas)]**
**[00:00 - 00:04] Toma 1: [Bebiendo en la noche tranquila] (Transición de corte de coincidencia)Acción / Directivas físicas:** La cámara es una toma estática en ángulo alto inclinada hacia arriba, enfocándose en una luna llena masiva y brillante ocupando el centro del fotograma. *[Ejecución de transición]:* La luna llena en el cielo se oscurece y se desvanece gradualmente. Un cuenco de vino circular de tamaño perfectamente idéntico (visto desde un ángulo directo de arriba hacia abajo de la mesa) emerge lentamente de la posición de la luna, reemplazándola por completo. El cuenco de vino refleja motas de luz de luna y ondula ligeramente. *Requisito: La fundición cruzada entre la luna y el cuenco de vino debe ser natural; el cuenco no puede aparecer antes de que la luna se haya desvanecido.* Después de la transición, la cámara se retira lentamente y baja al nivel de los ojos. El espadachín se sienta en la mesa de la taberna, levantando lentamente el cuenco de vino, preparándose para beber.**Subtexto de cámara:** Una apertura extremadamente tranquila. Usa la coincidencia de forma perfecta y la fundición cruzada entre la "luna brillante" y el "cuenco de vino" para crear la imaginería poética fría y solitaria del wuxia: "La luna se refleja en la copa, levantando la copa para brindar a la luna".
**[00:05 - 00:10] Toma 2: [Intención asesina oculta] (Transición de primer plano con zoom)Acción / Directivas físicas:** El movimiento del espadachín se detiene ligeramente, su mirada se vuelve repentinamente afilada. *[Ejecución de transición]:* La cámara se empuja hacia adelante a velocidad extrema, acercándose infinitamente al ojo del espadachín hasta que su pupila ocupa toda la pantalla. El fotograma se expande sin problemas desde el interior de la pupila, transformándose en la gran escena reflejada en su interior: muy por encima del bosque de bambú, un asesino con ropas negras, sosteniendo una hoja corta en empuñadura inversa, se lanza directamente hacia la cámara como un águila cazando presas.**Subtexto de cámara:** Muestra la alerta extrema del espadachín. El zoom ocular "estilo matrioska" transforma instantáneamente el primer plano microscópico del ojo en la crisis de un ataque inminente.
**[00:11 - 00:18] Toma 3: [Desenvainar la espada / Choque] (Transición de extracción y barrido de látigo)Acción / Directivas físicas:** Conectando con el fotograma anterior, la cámara se retira rápidamente del asesino reflejado en el ojo del espadachín, retrocediendo rápidamente a una toma de cuerpo completo del espadachín. El espadachín salta de su asiento y desenvaina su espada. *[Ejecución de transición]:* La cámara sigue el brazo del espadachín que blande la espada y golpea violentamente hacia la derecha del fotograma (Whip Pan), causando un severo desenfoque de movimiento horizontal en toda la pantalla. Dentro de este desenfoque horizontal, la escena se desplaza instantáneamente al aire. La cámara deja de girar y se congela: en el centro exacto del fotograma, la espada larga del espadachín y la hoja corta del asesino chocan con fuerza. Un efecto visual de chispa naranja masiva y una onda de choque en forma de anillo estallan en el punto de intersección de las armas.**Subtexto de cámara:** Usa extracciones rápidas y barridos de látigo horizontales para conectar dos tomas diferentes de combate, dando a la audiencia el impacto visual de "velocidad demasiado rápida para que el ojo desnudo pueda captarla".
**[00:19 - 00:24] Toma 4: [Golpe de un solo golpe] (Transición de barrido / máscara)Acción / Directivas físicas:** Los dos pasan uno al lado del otro en el aire. *[Ejecución de transición]:* El flujo de aire del choque levanta una tormenta de hojas de bambú. Una hoja de bambú verde esmeralda gigante vuela horizontalmente a través del lente, enmascarando completamente la cámara y causando un apagón de pantalla completa. Inmediatamente después, desde el apagón, la hoja de bambú se desplaza hacia abajo y se aleja del lente, revelando que el fotograma ya ha cortado a una toma a nivel del suelo: al fondo, el asesino cae sin fuerzas al suelo. En el primer plano, el espadachín, de espaldas a la cámara, envaina lentamente su espada larga.**Subtexto de cámara:** Una técnica clásica de wuxia de "dejar espacio en blanco". Evita mostrar directamente la muerte sangrienta, usando en cambio una hoja de bambú para enmascarar el lente, completando el salto espacial y el pronunciamiento de la vida y la muerte con una elegancia suprema.
**[00:25 - 00:30] Toma 5: [Ecos persistentes] (Transición de sangrado de tinta china)Acción / Directivas físicas:** La señal visual es el sonido de "clic" del espadachín al enfundar completamente su espada. *Requiere una transición de tinta china exactamente en el corte de "clic" (sin cortes bruscos).* Todo el fotograma del bosque de bambú y el asesino caído actúa repentinamente como una gota de tinta espesa cayendo al agua, derritiéndose rápidamente en una pintura de tinta china en blanco y negro, sangrando y difundiéndose hacia afuera. El fotograma se congela y termina por completo en esta imaginería de paisaje salpicado de tinta.**Subtexto de cámara:** La sublimación de la concepción artística. La transición de tinta china resuena con la estética suprema del anime de estilo tradicional chino, dejando un encanto poético duradero y persistente.
[dreamina-2026-07-16-2266-【全局设定】(全局世界观 + 防崩坏) 基础环境与质感: 深夜幽静竹林中的一座露....mp4]
XML**30 segundos, una sola toma (Cruce de glaciar a ilusión de aguas profundas)**
**[Configuración global]Entorno base y textura:** Glaciares polares y el océano profundo. Enfatizar realismo físico extremo a nivel de "National Geographic". La refracción del agua de deshielo glacial y el moteado de luz bajo el agua (efecto Tyndall / iluminación volumétrica) deben obedecer estrictamente la óptica física del mundo real.**Estilo visual:** Paisaje narrativo épico y grandioso, 8K ultra claro, paleta de colores fríos (transición de azul hielo a azul abisal profundo).**Lenguaje de cámara:** Un avance continuo de dron hacia adelante, suave, lento y altamente épico de "una sola toma". Absolutamente sin cortes bruscos ni transiciones de edición.**Sujeto y rendimiento central:** (Sin sujetos de personajes específicos). El rendimiento central radica en la exhibición majestuosa del entorno natural, los cambios de lapso de tiempo de la luz solar y la sombra, y la transición espacial sin costuras de arriba a abajo del agua.**[Prompts negativos]:** Sin humanos o vehículos artificiales (excepto el naufragio). Sin parpadeos, tartamudeos o desgarro visual durante la transición de la superficie del agua. Eliminar estrictamente subtítulos y BGM predeterminados.
**[Storyboard con marcas de tiempo]**
**[00:00 - 00:09] [Polar Majestuoso] — Crucero por el glaciarAcción / Directivas físicas:** La cámara vuela hacia adelante lenta y suavemente a través de un valle de grietas glaciares azules masivas. La luz del sol se inclina desde la cima del valle de hielo, refractando reflejos especulares cegadores en las superficies de hielo afiladas. Ocasionalmente, pequeños trozos de hielo se desprenden de los acantilados y caen al mar sin fondo.**Subtexto de cámara:** Crea una atmósfera de naturaleza polar extremadamente pura, grandiosa e imponente.
**[00:10 - 00:15] [Paso del tiempo] — Cambio de luces y sombrasAcción / Directivas físicas:** La velocidad de avance de la cámara permanece constante, pero el metraje exhibe un efecto de "fotografía de lapso de tiempo". En 5 segundos, el cielo cambia rápidamente de plena luz del día a un brillante atardecer púrpura, luego se oscurece rápidamente a una noche polar estrellada, con la Aurora Boreal bailando en el cielo.**Subtexto de cámara:** Usa el ciclo rápido de luz y sombra para mostrar el paso del tiempo sobre el glaciar, creando tensión visual para la próxima transición.
**[00:16 - 00:21] [Cruce sin costuras] — Buceo en el azul profundoAcción / Directivas físicas:** El ángulo de la cámara se inclina repentinamente hacia abajo y se sumerge directamente en el agua de mar negra y helada (activando una transición de penetración en el agua). La pantalla se llena instantáneamente con innumerables burbujas blancas que suben. Luego, la vista se despeja repentinamente, entrando en el mundo submarino azul profundo. La luz del sol penetra la superficie, formando sagrados "rayos de Dios" (efecto Tyndall / iluminación volumétrica).**Subtexto de cámara:** Esta es la transición física más impresionante de toda la película; debe asegurar la sensación física de resistencia y la retroalimentación realista de la dinámica de fluidos de las burbujas en el momento en que la cámara entra al agua.
**[00:22 - 00:30] [Ruinas submarinas] — El barco gigante dormidoAcción / Directivas físicas:** La cámara continúa deslizándose hacia adelante a través de las profundidades abisales. Al final de los rayos de luz Tyndall, los restos masivos de un naufragio de madera medieval yacen silenciosamente en el fondo arenoso del océano. Algunas medusas bioluminiscentes translúcidas y brillantes nadan lentamente frente al lente. La cámara se detiene, enfocándose en la figura de proa gigante cubierta de percebes del naufragio, y el fotograma se congela en medio de las ondas de agua azul oscuro profundo.**Subtexto de cámara:** Concluye con una tranquilidad y misterio extremos. Los detalles del naufragio y las medusas bioluminiscentes crean un fuerte claroscuro (contraste de luz y sombra).
[dreamina-2026-07-16-3435-30 秒一镜到底(冰川穿越至深海幻境)模块:【全局设定】 基础环境与质感: 极地....mp4]
XML**[Configuración de escena global]Entorno base:** Un gran salón de baile de una mansión en la Inglaterra de la era Regencia (principios del siglo XIX). Una lámpara de araña de cristal masiva cuelga del techo, con cientos de velas emitiendo un cálido resplandor amarillo. Enfatizar realismo físico extremo y una atmósfera de salón de baile lujosa.**Estilo visual:** Estilo clásico de drama de época de la BBC. Paleta de colores primarios de oro cálido, blanco marfil y negro profundo. Iluminación de velas de alto contraste, textura de grano de película.**Lenguaje de cámara:** Lenguaje cinematográfico extremadamente dramático, incluyendo enfoque selectivo, transiciones sin costuras de máscara física en primer plano y tomas de aproximación en cámara lenta altamente inmersivas.**Diseño de audio y BGM:** El tono general es un vals orquestal clásico. La emoción musical debe coincidir con la cámara, progresando de "sonido ambiente social elegante y contenido" a "fervor extremo después de que el mundo se despoja", sincronizado con los movimientos de los personajes y los SFX.
**Estilismo del personaje (Protagonista femenina):[Edad / Etnia]** Mujer británica de 20 años, con estructura ósea británica clásica.**[Tono de piel / Textura]** Tono de piel frío y claro, revelando una textura delicada y húmeda, conservando poros finos realistas y textura de piel natural.**[Rasgos faciales]** Ojos almendrados marrón oscuro, nariz alta y recta, un toque de terquedad en las comisuras de su boca, y una mandíbula suave.**[Ojos / Alma]** Su mirada cambia de escrutinio defensivo a inmersión profunda. Ojos profundos y enfocados que revelan un apego suprimido.**[Estilo de cabello / Color]** Cabello largo marrón oscuro recogido en un moño clásico en la parte posterior de su cabeza, con algunos rizos vivos que caen alrededor de sus mejillas, meciéndose ligeramente con sus movimientos.**[Vestimenta / Textura]** Vistiendo un vestido de seda blanco marfil de cintura imperio. La tela refleja un débil resplandor de vela. Usa guantes de ópera de seda blanca que pasan de sus codos.**[Fisico / Emoción / Aura]** Postura esbelta y erguida, comportamiento elegante. Irradia un aura independiente, inteligente y romántica, suprimiendo en gran medida sus emociones bajo una contención extrema.
**Estilismo del personaje (Protagonista masculino):[Edad / Etnia]** Hombre británico de 26 años, con un rostro anguloso, frío y aristocrático.**[Tono de piel / Textura]** Tono de piel frío y claro, revelando una textura ligeramente pálida y de alta inteligencia, conservando poros finos realistas y textura de piel natural.**[Rasgos faciales]** Ojos hundidos, cejas ligeramente fruncidas, un puente nasal alto y contenido, y una mandíbula definida como tallada por un cuchillo.**[Ojos / Alma]** Mirada profunda, fría, enfocada y altamente agresiva, como si viera a través de ella, revelando un fervor inevitable y un profundo afecto.**[Estilo de cabello / Color]** Cabello corto negro puro, meticulosamente peinado con bordes afilados.**[Vestimenta / Textura]** Un frac negro profundo de cuello en V muy bien ajustado, hecho de lana pesada premium rígida, combinado con una camisa blanca pura y una corbata blanca pura muy intrincadamente anudada.**[Fisico / Emoción / Aura]** Estructura esquelética ancha y erguida, hombros anchos. Irradia una presencia masculina opresiva, arrogante y contenida, pero increíblemente tensa.
**[Rendimiento central]** Mostrando "corrientes emocionales ocultas bajo una contención extrema". Enfocarse en el ligero movimiento de la manzana de Adán del protagonista masculino y su mirada fija, y el pecho de la protagonista femenina que se eleva debido a la respiración rápida.**[Prompts negativos]:** Sin peinados modernos o ropa con cremalleras, sin iluminación moderna, sin cortes bruscos, sin diálogo hablado generado, sin telas flotando en el aire, sin clones idénticos en el fondo.
**[Storyboard con marcas de tiempo]**
**[00:00 - 00:06] Toma 1: [Enfoque selectivo y descenso de grúa]Subtexto emocional:** Un bloqueo preciso de miradas que atraviesa la multitud ruidosa, el descenso del destino.**Diseño de audio:** El BGM es un vals clásico melodioso con reverberación espacial, mezclado con el ruido ambiente de los invitados conversando suavemente. Cuando el enfoque se agudiza instantáneamente, el sonido ambiente cae repentinamente, y la melodía principal del vals se vuelve nítida y clara.**Acción / Directivas físicas:** La cámara comienza inicialmente en un ángulo alto, mirando diagonalmente hacia abajo (toma en ángulo alto), con el fotograma desenfocado. Una pequeña sección en el primer plano derecho es una lámpara de araña de cristal masiva que cuelga del techo, sus colgantes de cristal de cálido resplandor ocupan la esquina superior derecha de la pantalla. El resto del fotograma muestra figuras borrosas de los protagonistas masculino y femenino desde una perspectiva de arriba hacia abajo. *[Ejecución de transición]:* La cámara ejecuta un enfoque selectivo extremo. La lámpara de araña de cristal en primer plano se desenfoca instantáneamente, mientras que los protagonistas en el fondo inferior se vuelven instantáneamente nítidos. *Inmediatamente, la cámara ejecuta un movimiento de descenso de grúa, bajando suave y rápidamente desde lo alto a una perspectiva a nivel de los ojos, mostrando a los protagonistas desde las rodillas hacia arriba (plano medio).* En este momento, el protagonista masculino está frente a la protagonista femenina, extendiendo elegantemente su mano derecha. La protagonista femenina levanta la mirada, su mirada lleva escrutinio.
**[00:07 - 00:13] Toma 2: [Transición de máscara en primer plano]Subtexto emocional:** Toque de yemas, uniéndose al juego juntos.**Diseño de audio:** En el momento exacto en que la protagonista femenina coloca su mano en la de él, la música golpea un compás fuerte. Acompañado por el SFX de fricción de seda pesada de una falda blanca rozando el lente, el tempo del BGM se acelera repentinamente, y la sección orquestal se abre por completo.**Acción / Directivas físicas:** Continuando el plano medio del fotograma anterior, la protagonista femenina coloca suavemente su mano en la palma del protagonista masculino. *[Ejecución de transición]:* En este momento, una pareja de invitados que bailan alegremente (un caballero y una dama) abrazados fuertemente giran rápidamente pasando por el lente (la cámara está en un plano medio, y esta pareja que baila se acerca extremadamente al lente, mostrando solo sus cinturas y partes inferiores). En el instante de su giro, la falda blanca de la dama barre horizontalmente el lente, enmascarando completamente el fotograma y volviendo la pantalla completamente blanca por una fracción de segundo. Cuando la falda blanca abandona el campo de visión de la cámara, la cámara ha pasado sin problemas a un plano general del centro de la pista de baile, donde los protagonistas bailan con gracia. *Requisito: Los otros invitados que bailan al fondo deben estar espaciados (bailando en parejas), manteniendo una sensación de amplitud. Los colores de la ropa de las personas que los rodean (por ejemplo, rojo oscuro, verde oscuro, azul profundo intercalados), peinados y rasgos faciales deben ser todos distintos. La sincronización de su baile debe ser inconsistente, creando una atmósfera relajada y realista y presentando una diversidad de multitud genuina.*
**[00:14 - 00:20] Toma 3: [Aproximación en cámara lenta y desenfoque bokeh]Subtexto emocional:** Las emociones pierden el control, el tiempo se detiene, y el mundo se reduce a solo ellos dos.**Diseño de audio:** Cuando la cámara se acerca, el vals magnífico y la ruidosa pista de baile se despojan instantáneamente, creando un fuerte "efecto de tinnitus" (efecto de sonido apagado bajo el agua). El BGM despoja todos los instrumentos sinfónicos, dejando solo un violonchelo solista altamente tenso y un latido de bombo "pum, pum" que se asemeja a un latido cardíaco violento.**Acción / Directivas físicas:** *[Ejecución de transición]:* Conectando con el plano general del fotograma anterior, la cámara comienza un avance suave y a velocidad constante (Dolly In) hacia los protagonistas, mientras el metraje entra en cámara lenta extrema. A medida que la cámara se acerca continuamente, los protagonistas se magnifican de un plano general a un primer plano extremo de dos personas. Durante este proceso, la profundidad de campo se vuelve rápidamente extremadamente reducida (Profundidad de campo superficial). El salón de baile y otros invitados de fondo se desenfocan por completo, transformándose en masivos puntos de luz bokeh amarillos cálidos y parpadeantes. En el primer plano en cámara lenta, la mirada del protagonista masculino se vuelve profundamente cariñosa, mirando fijamente a la protagonista femenina, su manzana de Adán rodando. El pecho de la protagonista femenina se eleva con respiración rápida, pareciendo algo tímida. Congelar el fotograma. Cuando el tambor del latido cardíaco alcanza su clímax, la pantalla se corta a negro, y la música se detiene abruptamente.
[dreamina-2026-07-17-1988-【全局场景设定】 基础环境:19 世纪初英国摄政时期,一座宏伟的庄园舞会大厅。大....mp4]

Cómo escribir un vídeo súper largo

La redacción de las palabras clave para vídeos largos es similar a la de las palabras clave básicas. La clave es mencionar claramente @creativos + describir la historia.

FórmulaFormas específicas
Prompt completo = [Parámetros globales] + [Descripción de creativos] + [Resumen de una línea] + [Descripción de trama específica] + [Complemento global (final)]
Parámetros globalesDebido a la larga duración del vídeo ultra largo, después de seleccionar los parámetros, también puedes enfatizar el contenido relevante nuevamente al principio, como cuántos minutos se generarán y cuál es la relación de tamaño de fotograma.
Descripción de creativosNúmero de creativos (en orden de carga) + propósito específico (qué creativos son: personaje/timbre/acción/escena)
Resumen de una líneaSujeto + Ubicación + Evento + Tema/Estilo + Movimiento de cámara especial, etc.
Descripción de trama específicaEscribir en una línea de tiempo o en una línea argumental:
Un solo storyboard/período de tiempo incluye:
➕ Descripción positiva: contenido específico de la imagen + movimiento de cámara + acción + diálogo + efectos de sonido
➖ Descripción negativa: Elementos no deseados (ej., "sin subtítulos", "sin BGM")
Complemento global (final)Enfatizar nuevamente los elementos y detalles visuales que deben estar presentes en todo el vídeo. Por ejemplo: posición de la cámara + características del entorno/escena + sonido/atmósfera general + iluminación, etc. O algunos elementos que no se desean a nivel global, como subtítulos y música de fondo, también se pueden enfatizar nuevamente aquí.

Casos de vídeo súper largo

Caso 1: Vlog de gato trabajando (3 minutos)

Texto Plano Duración total 3 minutos, @image1 vlog de gato trabajando, relación de vídeo 16:9, un día como camarero con un gato naranja como protagonista, comienza despertándose, lavándose los dientes y la cara, montando en patinete eléctrico a una pequeña tienda en la calle, llegando temprano a la mañana, limpiando mesas y fichando, dando la bienvenida a los invitados, guiándolos a sus asientos y entregando menús, referencia de escena @image6-10, referencia general del restaurante @image11, entrega cuidadosamente las comidas a las mesas de los clientes @image2345, tomando una siesta y mordisqueando pescado seco a escondidas durante la pausa del almuerzo, recogiendo propinas de pescado seco y limpiando mesas por la noche, finalmente cerrando y acurrucándose para descansar junto a la ventana, montando el patinete eléctrico, regresando a la habitación referencia @image12, lavándose, comiendo, durmiendo. Sin subtítulos en todo momento, sin música de fondo.

El vídeo es generalmente fluido, las acciones son coherentes y la narrativa es clara y completa. https://bytedance.larkoffice.com/wiki/NjnWwvf4BiFYFLk2RzrcEgaunGf#share-GZVddtzwsoKcovxJbEVc4SJon1c

Caso 2: Café de tarde lluviosa (1 minuto)

XML Duración del vídeo 1 minuto, relación de aspecto 16:9, calidad de imagen cinematográfica realista, estilo retro curativo. En una tarde lluviosa, una cámara fija registra el café humeante en la mesa de una cafetería retro y la hermosa escena de lluvia vista a través de la ventana de vidrio. 0s - 20s (Apertura tranquila): La posición de la cámara está fija frente a una mesa de café de madera. Sobre la mesa hay una taza de café caliente recién hecho, que emite lentamente vapor blanco caliente hacia arriba. El fondo es una enorme ventana de vidrio con cuadros, fuera de la ventana llovizna, las gotas de lluvia golpean el vidrio, se acumulan en gotas de agua y se deslizan lentamente. Acompañado del sonido de la lluvia. La cámara no debe temblar, ningún personaje debe entrar en el encuadre, se prohíben los cortes bruscos. 20s - 40s (Acercamiento de detalle): La cámara se acerca extremadamente lentamente hacia la taza de café en frente. El vapor caliente continúa girando. Una ráfaga de viento sopla, una hoja caída dorada se desplaza fuera de la ventana y se pega al exterior del vidrio. El enfoque de la imagen sigue estando en el borde de la taza de café y el vapor caliente. Sin colisiones físicas complejas, se prohíbe la deformación de objetos, se prohíbe la aparición de texto. 40s - 60s (Cambio de enfoque y fundido): La cámara mantiene una ligera sensación de respiración, el enfoque de la imagen cambia lenta y suavemente de la taza de café en primer plano a la escena de lluvia fuera de la ventana al fondo. Las luces de la calle fuera de la ventana se ven borrosas por la lluvia y se convierten en puntos de luz cálidos. La imagen se oscurece gradualmente y termina junto con el sonido de la lluvia. La imagen no debe parpadear, sin transiciones abruptas. Imagen y luz/sombra: Durante todo el proceso, mantener un alto contraste de color entre la luz cálida amarilla del interior y la fría noche lluviosa del exterior. La cámara utiliza principalmente movimientos de empuje y tracción extremadamente lentos y posiciones fijas, buscando una sensación extrema de estabilidad y atmósfera. Sonido y restricciones: Todo el proceso solo necesita ruido blanco natural real (sonido de lluvia golpeando el vidrio, sonidos ambientales sutiles). Sin música de fondo a nivel global (no bgm), sin subtítulos a nivel global.
https://bytedance.larkoffice.com/wiki/NjnWwvf4BiFYFLk2RzrcEgaunGf#share-KHuQdNYJZovP98xYToOc6dQfnj4

Cómo escribir una extensión de vídeo

En esta sección [Interacción de funciones], presentamos la función "Extensión de vídeo" lanzada por Dreamina. ¡Veamos cómo usar mejor esta función!

ClasificaciónExplicaciónEjemplo
Palabra clave regular Escribir tales palabras clave de requisitos comunes puede hacer que el modelo ejecute tus requisitos con mayor precisión.
También soporta entrada adicional de imágenes/vídeos/audios.
Vocabulario requerido:
1. Extensión hacia adelante
2. Extensión hacia atrás
3. Continuación
4. Continuación
5. Otras descripciones relacionadas
Palabra clave de efecto puntual Si quieres una extensión de toma completa.
Si el contenido que necesita ser extendido es naturalmente coherente con el vídeo generado previamente y la acción continúa, será directamente restringido por palabras clave obligatorias.
Añadir palabras clave: Requerir extensión natural, conexión de movimiento suave, conexión de movimiento natural, prohibir el corte rígido de la imagen, y prohibir que los objetos aparezcan de la nada.
También puedes añadir requisitos según la situación real, para que la IA sea más obediente.
Si quieres una extensión de corte/transición.
El contenido que necesita ser extendido debe tener una cierta conexión de expresión creativa con el vídeo generado previamente, como cambio de escena y cambio de transición.
La palabra clave añade la expresión de corte/transición.
1. La fórmula es: configuración de corte = [guía de tipo de transición] + [requisitos de restricción básica] + [requisitos de lógica de corte]
a. Tales como:
    i. [Guía de tipo de transición]: Necesitas usar la transición "Cambio de lente natural" en el punto de corte (prohibir el corte rígido, prohibir que los objetos aparezcan de la nada).
    ii. [Requisito de restricción básica]: Mantener una sensación coordinada de respiración y duración para la cámara. La toma A muestra a Mencius arrodillado y haciendo una reverencia junto al cementerio, y luego transiciona naturalmente a la toma B, donde la madre de Mencius está de pie en la puerta, frunciendo el ceño hacia él.
    iii. [Requisito de lógica de corte] (Reforzando el requisito nuevamente): Se requiere cambiar de escena naturalmente. (Si quieres enriquecer el lenguaje de la toma, también puedes Describir el cambio de escenas mientras describes la transición) Si añades otra frase: Y la escena cambia de C a D (como plano cercano cambia a plano medio)
2. También puedes proporcionar directamente varias transiciones y dejar que Dreamina Seedance 2.5 juzgue cuál es la más adecuada para esta película.
    a. Por ejemplo, la palabra clave: "Por favor, elige la más adecuada según el estilo de esta película entre los métodos de transición como [cambio de toma natural/transición de máscara/transición de tinta/transición de objeto similar]".

Tipos de transición (con ejemplos)

TipoTransiciónExplicaciónDescripción amplia (ejemplo según fórmula)Descripción específica (ejemplo con Mencio)
Transición básica Cambio de toma natural Qué es: Similar al corte duro, sin efecto de transición (pero necesita enfatizar "lente natural", por lo que se toma por separado), la imagen A se convierte directamente en la imagen B, pero necesita enfatizar que el lente tiene una fuerte sensación de respiración y una duración coordinada, dejando suficiente tiempo para el cambio, y no se puede cortar bruscamente.
Escenarios aplicables: La gran mayoría de las narrativas convencionales. Limpio y ordenado, sin arrastre, la prueba más importante de la conexión de contenido del lente en sí.
1. Necesitas usar la transición "cambio de lente natural" en el punto de corte (prohibir el corte rígido, prohibir que los objetos aparezcan de la nada).
2. Mantener la coordinación entre la sensación de respiración y la duración del lente, dejar suficiente tiempo de cambio, dejar que la imagen A transicione naturalmente a la imagen B, y asegurar la coherencia de la narrativa.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Necesitas usar la transición "cambio de lente natural" en el punto de corte (prohibir el corte rígido, prohibir que los objetos aparezcan de la nada).
2. Mantener la coordinación entre la respiración y la duración de la cámara. La toma A muestra a Mencius arrodillado y haciendo una reverencia junto al cementerio, y luego transiciona naturalmente a la toma B, donde la madre de Mencius está de pie en la puerta, frunciendo el ceño hacia él.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Fundido de entrada y salida Qué es: La imagen emerge lentamente desde el negro total (o blanco total), o se oscurece lentamente hasta el negro total.
Escenarios aplicables: Generalmente se usa al principio y al final de un vídeo, o en el medio para indicar el paso del tiempo, el final completo de una trama (como en la película "el día siguiente").
1. Es necesario usar la transición "fundido de entrada y salida" en el punto de corte (prohibiendo el corte rígido y prohibiendo que los objetos aparezcan de la nada).
2. La imagen A se oscurece gradualmente hasta que está completamente negra (o completamente blanca), y luego la imagen B emerge lentamente de la oscuridad (o blanco puro) y se vuelve gradualmente más brillante.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "fundido de entrada y salida" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. En la toma A, la madre de Mencio suspiró mientras cerraba la puerta, y la imagen se oscureció gradualmente hasta que estuvo completamente negra. Luego, la imagen se iluminó lentamente desde la oscuridad, revelando la toma B: el bullicioso mercado de la madrugada, la madre de Mencio y su familia se mudaron a una nueva casa.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Encadenado Qué es: A medida que la imagen A se vuelve lentamente transparente, la imagen B emerge lentamente, y las dos imágenes se superponen brevemente.
Escenarios aplicables: Expresar recuerdos, sueños, el lento paso del tiempo, o transiciones emocionalmente más suaves y líricas.
1. Necesitas usar la transición "encadenado" en el punto de corte (prohibir el corte rígido, prohibir que los objetos aparezcan de la nada).
2. A medida que la imagen A se vuelve lentamente transparente, la imagen B aparece gradualmente, produciendo un efecto de superposición y fusión suave de 1-2 segundos entre las dos imágenes.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Necesitas usar la transición "encadenado" en el punto de corte (prohibir el corte rígido, prohibir que los objetos aparezcan de la nada).
2. La toma A muestra la apariencia traviesa de Mencio como carnicero en el mercado, y la imagen se vuelve lentamente transparente. Al mismo tiempo, en la toma B, la imagen de la madre de Mencio tejiendo tela con una expresión preocupada bajo la lámpara por la noche emerge gradualmente, y las dos imágenes se superponen y fusionan durante 2 segundos.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Flash blanco/negro Qué es: La pantalla parpadea en blanco o negro por un momento, y luego corta a la siguiente pantalla.
Escenarios aplicables: Aumentar el impacto visual, a menudo con acento (como golpes de tambor, disparos, sonidos de obturador), utilizado principalmente para vídeos de sincronización de ritmo, mezcla o expresión de atmósferas emocionantes y tensas.
1. Es necesario usar la transición "flash blanco/negro" en el punto de corte (prohibiendo el corte rígido y prohibiendo que los objetos aparezcan de la nada).
2. La pantalla estalla instantáneamente en una fuerte luz blanca (o se sumerge instantáneamente en la oscuridad total) y parpadea, seguida de una transición rápida a la siguiente escena, con un fuerte impacto visual.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "flash blanco/negro" en la posición de corte (prohibiendo el corte rígido y prohibiendo que los objetos aparezcan de la nada).
2. La madre de Mencio vio a Mencio aprender de los vendedores y gritar en voz alta, rompiendo con ira la lanzadera de tela en su mano, y la escena estalló instantáneamente con un fuerte flash blanco. Luego, rápidamente cortó a la siguiente escena: un carro lleno de equipaje acelerando en un camino de barro lleno de baches (mostrando una segunda mudanza decisiva).
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Barrido Qué es: La imagen B es como una puerta corredera, que "empuja" o "barre" la imagen A desde una dirección determinada.
Escenarios aplicables: Estilo más antiguo o retro (como el usado comúnmente en "Star Wars"), o para mostrar una transferencia de ubicación obvia.
1. Es necesario usar la transición "barrido" en el punto de corte (prohibiendo el corte rígido, prohibiendo que los objetos aparezcan de la nada).
2. La imagen B avanza suavemente desde la izquierda (o derecha/arriba/abajo) como una puerta corredera, cubriendo/barriendo por completo la imagen A.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "barrido" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. La imagen A es un mercado ruidoso. El espejo es como una puerta corredera, avanzando suavemente de derecha a izquierda, barriendo la imagen del mercado y cubriéndola con la imagen B: la solemnidad y silencio de la puerta de la academia.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Transición creativa Transición de máscara Qué es: El lente se mueve hacia adelante y es bloqueado completamente por un objeto (como una pared, espalda, palma, pilar), haciendo que la imagen se vuelva negra. La siguiente toma se aleja del estado negro y ya es otra escena.
Escenarios aplicables: Cruce de espacios. Por ejemplo: el lente pasa a través de un espejo y llega a otro mundo de fantasía. Por ejemplo, un papel vuela, cubre el lente, y desaparece en otra escena.
1. Es necesario usar la transición "máscara" en la posición de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. La cámara se empuja hacia adelante y es bloqueada completamente por un objeto en la imagen, como un árbol grande o la espalda de una persona, haciendo que la pantalla se vuelva negra. Luego, la cámara atraviesa la oscuridad y se aleja directamente para revelar la siguiente escena completamente nueva.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "máscara" en la posición de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. La cámara A sigue el carro en movimiento de la madre de Mencio hacia adelante, y el carro entra en un callejón oscuro y estrecho. La pared bloquea completamente el lente, haciendo que la pantalla se vuelva negra. Luego, la cámara atraviesa la oscuridad y revela directamente la siguiente escena: la espaciosa y brillante Academia Xuegong.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Transición de objeto similar Qué es: El último fotograma de la toma anterior es extremadamente similar en forma, contorno o color al primer fotograma de la siguiente toma.
Escenarios aplicables: Técnica de montaje. Por ejemplo: la toma anterior es la luna llena en el cielo, y la siguiente toma corta sin problemas a la leche de café redonda en la taza.
1. Es necesario usar la transición "objeto similar" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. Utilizar la similitud de forma o color para una transición sin costuras. Por ejemplo, en el último fotograma de la toma anterior, hay una luna circular en el cielo. A medida que la toma avanza, la luna se transforma sin problemas en una flor de leche de café circular en la taza en la siguiente toma.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "objeto similar" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. Transición sin costuras utilizando similitud de forma. La toma A es una moneda de cobre circular sostenida por un vendedor en el mercado, con el lente avanzando hacia el extremo de la moneda. La moneda se transforma sin problemas en el extremo de la misma regla circular sostenida por el maestro Xuegong en la siguiente toma.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Transición de acción Dividida en: movimientos similares (transiciones más suaves) y movimientos conflictivos (transiciones más potentes).
Qué es: La cámara se balancea repentinamente hacia la izquierda (o arriba y abajo) en la escena A, y la imagen se vuelve borrosa; la escena B se balancea de derecha a izquierda con la misma fuerza hasta un fotograma fijo.
Escenarios aplicables: Muy dinámico, adecuado para películas de acción, parkour, Vlogs de viajes, dando una sensación de velocidad de "transferencia instantánea".
1. Es necesario usar la transición "acción" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. Utilizar el movimiento rápido del lente para la conexión. En la escena A, el lente se balancea vigorosamente hacia la izquierda (o derecha), creando un fuerte desenfoque de movimiento en la imagen; luego, en la escena B, siguiendo la misma dirección y fuerza de balanceo, cortar desde el desenfoque y congelar el fotograma.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "acción" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. En la toma A, la madre de Mencio tiró repentinamente de la mano de Mencio, y la cámara siguió la acción y se balanceó violentamente hacia la derecha, creando un desenfoque. Luego, la escena B siguió la misma dirección de balanceo y cortó desde el desenfoque, congelando el fotograma donde la madre de Mencio lleva a Mencio a la puerta de la academia.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Transición de relevo dinámico Qué es: Usar la acción del personaje para conectar. Por ejemplo: En la toma A, el personaje salta (salta del fotograma), y en la toma B, el personaje cae en el fotograma desde arriba (puede haber cambiado de ropa o de escena).
Escenarios aplicables: Vídeos de cambio de vestuario ("patear zapatos para cambiar de ropa", "chascar los dedos para cambiar de ropa"), empalme de viajes entre regiones del protagonista.
1. Es necesario usar la transición "Relevo dinámico" en la posición de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. Usar los movimientos continuos de los personajes para cambiar de escena. Por ejemplo, en la escena A, el personaje salta y sale del fotograma, y luego en la escena B, el personaje mantiene una postura de caída y cae desde la parte superior del fotograma a la imagen.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "Relevo dinámico" en la posición de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. En la toma A, Mencio salta juguetonamente junto al cementerio y sale del fotograma; luego, en la escena B, Mencio mantiene una postura de caída y cae en la imagen desde la parte superior del fotograma, pero el fondo ya se ha convertido en un bullicioso mercado.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Transición de zoom in/zoom out Qué es: El lente se acerca infinitamente a un detalle de la escena A (como pupilas, cerraduras), y cuando se acerca al extremo, ese detalle se convierte en toda la imagen de la escena B; o viceversa.
Escenarios aplicables: Narrativa extremadamente grandiosa o cambio de perspectiva microscópica, a menudo utilizado en películas de ciencia ficción o para expresar el concepto de "hay un mundo en el mundo" (transición de estilo "muñeca rusa").
1. Es necesario usar la transición "zoom in/zoom out" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. La cámara se acerca a un detalle en la escena A (como la pupila de un personaje) al extremo. Cuando la pupila ocupa toda la pantalla, la imagen se despliega sin problemas dentro de la pupila, convirtiéndose en un gran panorama de la escena B.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Necesitas usar la transición "zoom in/zoom out" en el punto de corte (prohibir el corte rígido y los objetos que aparecen de la nada).
2. La cámara A es el rostro sonriente de la madre de Mencio, y la cámara amplía sus pupilas profundas hasta el extremo. Cuando las pupilas ocupan toda la pantalla, la imagen se despliega sin problemas dentro de las pupilas, convirtiéndose en el gran panorama de la escena B: Mencio está sentado ordenadamente con un grupo de estudiantes en la sala de estudio, arrodillado y leyendo.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
Transición de tinta china Qué es: La imagen es como una gota de tinta espesa cayendo al agua, extendiéndose y difundiéndose, la imagen anterior desaparece gradualmente a medida que la tinta se extiende, y la siguiente imagen emerge en la tinta.
Escenarios aplicables: Altamente estética oriental y poética, a menudo utilizada en exhibiciones de Hanfu de estilo antiguo, paisajes culturales (como la ciudad acuática de Jiangnan), documentales históricos, o para mostrar al protagonista en un largo recuerdo.
1. Es necesario usar la "Transición de tinta" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. La imagen A se mezcla y extiende rápidamente como tinta espesa cayendo en agua clara. A medida que la tinta se extiende, la imagen A desaparece gradualmente, y la imagen B emerge gradualmente de la tinta dispersa.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).
1. Es necesario usar la transición "tinta china" en el punto de corte (prohibiendo el corte rígido y los objetos que aparecen de la nada).
2. La escena ruidosa del mercado en la imagen A se desvanece y difunde rápidamente como tinta espesa cayendo al agua, desapareciendo gradualmente; al mismo tiempo, la imagen de la lectura en la academia B emerge lentamente de la tinta antigua dispersa.
3. Se requiere cambiar de escena naturalmente. (Puedes decidir si añadir descripción de escena según la situación real).

Casos de extensión de vídeo

Ejemplo 1: Extensión natural de guerrero musculoso

XML El personaje principal es el guerrero musculoso de @image1, camina solo por el denso bosque primigenio, con pasos firmes. Mira a su alrededor con expresión alerta, la cámara se desplaza hacia adelante siguiéndolo, la luz del sol se filtra moteada a través de las hojas sobre sus músculos sólidos y su armadura.

Extensión 1 (5s, hacia atrás):

XML Referencia el contenido de @video1, extiende el vídeo 5s hacia atrás. Requiere que la extensión sea natural, la conexión de acción sea suave, la conexión de acción sea natural, se prohíben los cortes bruscos, se prohíben los objetos que aparecen de la nada. El guerrero musculoso de @image1 de repente nota algo inusual, detiene sus pasos y sus ojos se vuelven afilados. Adopta rápidamente una postura defensiva, mirando fijamente hacia adelante.

Extensión 2 (10s, con transición de máscara):

XML Referencia el contenido de @video1, extiende el vídeo 10s para continuar la historia. Requiere usar una "transición de máscara" en el corte (los cortes bruscos están prohibidos, los objetos que aparecen de la nada están prohibidos). La toma A muestra al guerrero musculoso de @image1 que se está defendiendo (primer plano), una ráfaga de viento sopla, una hoja caída de tamaño normal se desplaza hacia la cámara, la hoja cubre completamente la cámara haciendo que la pantalla se oscurezca; luego, la cámara se retira a través de la hoja, revelando directamente la siguiente escena: el joven guardabosques de @image2 está apoyado en un árbol, levantando su arco y flecha apuntando. Requiere que la escena se cambie naturalmente. Cambiar naturalmente del primer plano del guerrero al plano medio del guardabosques.

Cómo escribir Edición inteligente, Edición con marcas, Edición de vídeo

En esta sección [Interacción de funciones], presentamos las funciones "Smart Edit" y "Edit with mark" lanzadas por Dreamina.

"Edit with marks" es una versión mejorada de "Smart Edit". Bajo esta función, puedes editar vídeos cargados localmente utilizando selección de cuadros, pinceles, etc.

"Edit Video" es similar a "Edit with marks", con la diferencia de que "Edit with marks" se aplica a los vídeos después de generarlos.

Veamos cómo podemos usar mejor estas 3 funciones.

A. Smart Edit, Edit with marks, Edit Video se pueden completar
ClasificaciónExplicaciónEjemplo
Palabra clave regular Escribir tales palabras clave de requisitos comunes puede hacer que el modelo ejecute tus requisitos con mayor precisión.
Escribe el contenido de modificación de A a B tanto como sea posible, y cómo cambiarlo, usando marcas de tiempo.
También soporta entrada adicional de imágenes/vídeos/audios.
Vocabulario requerido:
1. Editar el xx en el vídeo.
2. Añadir/agregar
3. Eliminar/Quitar
4. Modificar/Reemplazar/Cambiar a
5. Otras descripciones relacionadas

Completa el contenido tanto como sea posible, presentado como una fórmula: [Objeto de modificación específico/qué] + [Descripción de acción y cambio] + [Secuencia de tiempo efectiva]
1. De A - - > B, y cómo solicitar cambios: [objeto de modificación específico/qué] (bloquear objetivo) + [descripción de acción y cambio] (emitir instrucciones de modificación)
    a. Por ejemplo, reemplazar los jeans de hombre con pantalones de traje negro oscuro
2. Usar con marca de tiempo: [Tiempo efectivo]
    a. Por ejemplo, en los primeros 8 segundos del vídeo, reemplazar los jeans del niño con pantalones de traje negro oscuro
Casos de Smart Edit y Edit with marks

Caso 1: Modificar ballena por dragón blanco (0-8s)

XML Modificar todo completamente de 0 a 8 segundos del vídeo general. Cambiar la ballena en el vídeo a un dragón blanco. Eliminar el BGM.

Caso 2: Cambiar fondo blanco a fondo verde (0-5s)

XML Tomar todo el vídeo de 0 a 5 segundos, todo el vídeo. Cambiar todos los fondos blancos a fondos de pantalla verde. Eliminar el sonido, mantenerlo en silencio.
B. Funciones de Edit with marks y Edit Video (como rodear y marcar)

En comparación con la función Smart Edit, Edit with marks añadirá una [herramienta de anotación y orientación], la palabra clave de texto se escribe de la misma manera que [objeto de modificación específico/qué] + [descripción de acción y cambio] + [tiempo efectivo]

FórmulaDetalles específicos
Fórmula de edición: [Herramienta de anotación y orientación] + [Objeto de modificación específico/qué] + [Descripción de acción y cambio] + [Secuencia de tiempo efectiva]
[Herramienta de anotación y orientación] (posicionamiento preciso, anti-daño accidental):
Las herramientas de anotación incluyen: cuadros, líneas, flechas, texto, puntos de referencia de diferentes colores, y también proporcionan borradores para borrar
  • Puntos clave: Indicar claramente qué herramienta se usó para dibujar, y si la IA debe enfocarse en el interior o exterior de la herramienta.
  • Por ejemplo, dentro del cuadro rojo, sigue el área señalada por la flecha roja, en el punto de referencia, y a la izquierda de la línea roja.
[Objeto de modificación específico/qué] (bloquear objetivo)
  • Punto clave: Escribe lo que quieres cambiar en esta área.
  • Por ejemplo: los jeans del niño, el árbol muerto en el fondo de la imagen, la taza de café en la mano de la protagonista, las nubes en el cielo.
[Descripción de acción y cambio] (emitir instrucciones de modificación)
  • Punto clave: Aclarar en qué quieres convertirlo, o qué añadir o eliminar.
  • Por ejemplo, reemplazarlo con pantalones de traje negro oscuro, convertirlo en un cerezo en flor, eliminar y completar el fondo sin dejar rastro en la imagen, y añadir un rayo.
[Tiempo efectivo] (bloquear el eje de tiempo, evitar ruptura de tiempo)
Usado junto con la línea de tiempo del sistema que aparece en el cuadro de texto después de hacer clic en confirmar
  • Punto clave: Decirle claramente a la IA si esta modificación ha existido siempre o solo cambió dentro de un número específico de segundos.
  • Por ejemplo, toda la película (15 segundos) se modifica uniformemente para mantener la consistencia, solo cambia entre los segundos 5 y 8, y aparece gradualmente desde el segundo 3.
Casos de Edit with marks

Caso 1: Generar chica y gato en modelo blanco

[Captura de pantalla: marcado con recuadro rojo y azul]

Resultado: Se generaron con éxito la chica y el gato según las instrucciones.

Caso 2: Reemplazar oveja por caballo marrón (segundos 7-15)

[Captura de pantalla: marcado con recuadro rojo]

Resultado: Se convirtió exitosamente la oveja en un caballo marrón según las instrucciones.

Cómo escribir Clay Renderer

La función Clay Renderer soporta modelos blancos de granularidad gruesa y granularidad más fina, que se pueden generar bajo demanda. El efecto de la capacidad actual del modelo para generar granularidad gruesa será mejor.

Tipo de modelo blancoDefiniciónEn qué enfocarseEscenarios aplicablesFórmula de palabra clave de referencia
Granularidad gruesa Geometrías simples (esferas, cilindros, cubos, etc.) unidas para representar vídeos de modelos 3D de baja fidelidad de personas/objetos/animales Proporcionar referencia de información dinámica. Por ejemplo: trayectoria de movimiento, modo de movimiento de cámara, posición del personaje, cambios de luz y sombra, corte de lente, etc. Generar vídeos completamente nuevos desde cero, los modelos blancos solo hacen "esqueletos dinámicos". [Declaración de referencia] + [Mapeo de relación correspondiente] + [Detalles de la trama] + [Procesamiento de escena] + [Conclusión general]
1. [Declaración de referencia]: Referirse al {movimiento de cámara | acción | línea de movimiento | cambios de luz y sombra | posicionamiento del personaje | música y efectos de sonido | ritmo de la imagen} de [Vídeo 1].
2. Mapeo de correspondencia (qué modelo corresponde a qué imagen de referencia): Reemplazar el modelo de {característica de color/forma} en [Vídeo 1] con el {nombre del personaje} en [Figura X], el modelo de {característica de color/forma} con el {nombre del personaje} en [Figura Y], y el modelo de {característica de color/forma} con el {nombre del objeto/escena} en [Figura Z].
3. [Detalles de la trama]: {Describir la trama en detalle en orden cronológico o lógico, incluyendo acciones, expresiones, líneas y cambios en la iluminación}.
4. [Procesamiento de escena]: Puedes usar descripción de texto simple o imágenes de referencia (usar {descripción de escena} en [Figura W] para escenas de fondo).
5. "Convergencia" (otra información complementaria), como: {descripción del estilo general}, {requisitos de calidad de imagen}, {restricciones de consistencia}, {procesamiento de audio}, etc.
6. Post scriptum: En el modelo blanco de granularidad gruesa, si el modelo tiene extremidades o alas, se debe escribir la secuencia de acción completa de las extremidades para evitar rigidez. La mejor práctica es no cargar modelos con extremidades y alas.
Granularidad más fina Modelado completo, material y estructura claros Vídeo de modelo 3D Renderizado directo para efectos visuales más ricos y detallados. Por ejemplo: material/estilo/color de luz y sombra. La escena ha sido completamente modelada y solo necesita ser reemplazada con materiales/iluminación/estilo. [Comando de renderizado] + [Descripción de renderizado segmentado] + [Procesamiento de escena] + [Convergencia general]
1. Comando de renderizado: Renderizar la animación del modelo blanco de [Vídeo 1] en la película final.
2. [Descripción de renderizado segmentado]: 0- {N} s: {Requisitos de renderizado - Entorno de fondo, atmósfera de tono, material del personaje, efectos de luz y sombra} {N} s {Punto de activación de transición y método}: {Descripción de renderizado de la nueva escena después de la transición}.
3. [Procesamiento de escena]: Puedes usar descripción de texto simple o imágenes de referencia (usar {descripción de escena} en [Figura W] para escenas de fondo).
4. "Convergencia general": {Requisitos de renderizado - Si el entorno de la nueva escena y el renderizado del personaje permanecen sin cambios}; Renderizado del personaje {permanece sin cambios/cambia con la escena}. {Procesamiento de audio} y así sucesivamente.
5. Post scriptum: En el modelo blanco de granularidad más fina, cargar el vídeo de referencia y eliminar información de interferencia como {línea de trayectoria | línea de coordenadas | cono de cámara}.
Casos de Clay Renderer

Caso 1: Granularidad gruesa - Reina elfa

XML Referencia el movimiento dinámico de la cámara y los cambios de iluminación física de @Video 1, y reemplaza con precisión el modelo blanco en el vídeo con la reina elfa de @Image 1. La apariencia del personaje debe referenciar estrictamente la imagen, tener cabello largo plateado-blanco, usar una túnica bordada blanca-dorada, y sostener un bastón mágico con un cristal brillante en la parte superior, manteniendo la consistencia del personaje, sin recortes y sin cambio de cara.
La escena general es un salón élfico, conservando la escena de @Video 1.
La posición de la cámara permanece consistente con el vídeo original, y la reina elfa levanta el bastón mágico con gracia siguiendo la acción del modelo en el vídeo de referencia. Durante este tiempo, su largo cabello plateado-blanco y la amplia falda de túnica blanca ondean naturalmente con el flujo de aire, con una textura sedosa y una sensación de caída. Acompañando la acción, el efecto de iluminación en el vídeo de referencia se transforma en un haz de luz sagrado que se eleva desde el suelo, complementando la deslumbrante luz dorada emitida por el bastón en la mano de la reina.
El vídeo final requiere calidad de imagen CG cinematográfica realista, con iluminación y sombras reales, sagradas y épicas, visuales de alta definición, piel delicada del personaje, texturas metálicas claras en la ropa, detalles ricos y acciones suaves y naturales.

Caso 2: Granularidad gruesa - Reemplazo de modelo humano por cachorro

XML Referencia @Image 1 y las acciones del personaje y movimientos de cámara de @Video 1. Reemplaza completamente el modelo humanoide blanco en el vídeo con el lindo cachorro de @Image 1. El cachorro referencia @Video 1, caminando erguido, y el cachorro camina naturalmente siguiendo las acciones del vídeo. El fondo es una calle de ciudad cyberpunk, y los edificios altos blancos en @Video 1 se renderizan como rascacielos. Todo el vídeo debe estar sin sonido.

Caso 3: Granularidad más fina - Cortometraje de pelea de jefe en cocina de dulces (30s)

Prompt extenso con storyboard detallado, referencias de vídeo e imágenes, y requisitos específicos de estilo y narrativa.

Caso 4: Granularidad más fina - Renderizado de faro en tormenta

XML Renderizar la animación del modelo blanco de [Vídeo 1] en la película final.
0–7s: Renderizado de escena nocturna oceánica realista. Superficie del mar tormentosa de color gris-azul oscuro, olas gigantes que se elevan continuamente, adoptando en general tonos fríos y atmósfera cinematográfica de baja saturación; las olas tienen un sentido de volumen real, detalles de fluidos y capas de espuma, el faro flotante de rayas rojas y blancas mantiene el metal y el material de pintura desgastada, ondulando e inclinándose naturalmente con las olas; el cielo está lleno de nubes oscuras y pesadas, acompañado de lluvia fina, ocasionalmente aparece luz de relleno de relámpagos tenues en la distancia; adoptando en general iluminación HDR, niebla volumétrica, reflejo ambiental real, reflejos húmedos y sombras dinámicas, fortaleciendo los cambios de iluminación de las olas y el faro, asegurando la continuidad y estabilidad de los materiales y la iluminación durante el movimiento de la cámara.
[Procesamiento de escena] Tomar el área del mar tormentoso como la única escena, la superficie del mar ocupa el fotograma principal, el horizonte distante se conecta naturalmente con las nubes oscuras; las olas mantienen un ritmo de flujo y ondulación continuos, el faro siempre flota cerca del centro de la superficie del mar, generando movimientos de balanceo y cabeceo reales impulsados por el oleaje, sin deformación o cambio de tamaño; las gotas de lluvia, las salpicaduras de las olas y la niebla ambiental mantienen una dirección de viento y una lógica física unificadas, la cámara puede flotar ligeramente hacia arriba y hacia abajo siguiendo las olas, mejorando la inmersión.
[Conclusión general] Mantener la escena del área del mar tormentoso sin cambios, el estilo de renderizado general, el material del faro, los efectos de fluidos de las olas y el rendimiento de iluminación permanecen consistentes; renderizado del personaje: permanece sin cambios (sin personajes). Procesamiento de audio: Conservar los sonidos continuos de las olas rompiendo, el viento aullando, la lluvia y los truenos ocasionales, el sonido ambiental cambia naturalmente con la distancia de la cámara, no añadir música de fondo o voz en off.

Caso 5: Renderizado de varios segmentos (buceador, astronauta, guerrero, etc.)

Prompt con múltiples cortes y diferentes escenarios, todos referenciando modelos blancos y con requisitos específicos de renderizado.

Avances destacados de Dreamina Seedance 2.5

🕒 Extensión de vídeo, creación continua

¿Has encontrado alguna vez esta situación? En el vídeo generado, los personajes están a punto de realizar acciones clave, o la trama acaba de llegar a una etapa importante, pero el vídeo termina abruptamente debido a limitaciones de tiempo. Si se usa software externo para conectar con otros vídeos, se verá rígido y abrupto, interrumpiendo la inspiración.

Dreamina Seedance 2.5 ha logrado un gran avance en la capacidad de extensión de vídeo, pasando de "clips cortos y rápidos" a una 🕒 extensión narrativa continua.

  • Extensión de vídeo: Rompe la barrera de tiempo de generación única, pasando de 15 segundos a una generación única de 30 segundos.
  • Apilamiento flexible "anidado": Ya no se limita a una continuación única. Mientras el producto actual esté dentro de 30 segundos, se pueden añadir nuevas palabras clave repetidamente para una extensión continua, como piezas de construcción. En el estado extremo, se puede acumular un vídeo continuo de hasta 60 segundos.
  • Control de director segmentado: Permite a los creadores intervenir con nuevas palabras clave en cada nodo de extensión. Puedes dejar que el protagonista corra durante 10 segundos, y luego indicarle que salte en la siguiente extensión, logrando un control de director refinado de "paso a paso".

Cómo usar: Después de generar un vídeo inicial, mientras la duración esté dentro de 30 segundos, haz clic en el botón "Extend Video" debajo del producto. En la interfaz emergente, ingresa la palabra clave para la acción o cambio de escena que deseas que ocurra en la siguiente etapa, y se generará inmediatamente después del final del vídeo original. Esta operación se puede repetir hasta que la duración total del vídeo alcance los 60 segundos.

Escenarios adecuados (sin límite, solo ejemplos):

  • Creación de suspense y giros argumentales: Genera una trama regular, como "El protagonista está tomando café tranquilamente (primeros 5 segundos)", y luego añade una palabra clave de transición de 5 segundos a través de la función de extensión: "Un OVNI voló repentinamente sobre la ventana, y la taza de café se sacudió y rompió". Controla perfectamente el momento del giro para crear efectos inesperados.
  • Desmontaje continuo de movimientos complejos: Cuando el modelo no puede mostrar movimientos largos perfectamente de una vez, se puede usar "relevo". Por ejemplo, en la producción de vídeos de artes marciales: el primer segmento genera "protagonista desenvaina su espada", después de confirmar la perfección, se extiende para generar "apuñalamiento hacia adelante", y luego se extiende para generar "girar y retirar la espada". A través del control capa por capa, asegurar que cada movimiento escenificado sea preciso y sin errores.
  • Viaje de perspectiva y transformación espacio-temporal: Adecuado para crear efectos de transición visualmente impactantes. El lente del vídeo frontal avanza lentamente hacia un espejo, y usando la función de extensión se ingresa una nueva descripción ambiental, permitiendo que el lente atraviese el espejo y se conecte sin problemas a otro espacio y tiempo fantástico, logrando una transición fluida a nivel cinematográfico.

Casos de extensión (escena de tres personas y dragón)

Segmento 1 (12s): Apertura con plano aéreo, movimiento de cámara en espiral, presentación de personajes y diálogo.

Extensión 1 (5s, 12-17s): El dragón sale del agua y ruge, los personajes forman un escudo de luz.

Extensión 2 (13s, 17-30s): El escudo se rompe, los personajes contraatacan, pelea con el dragón con efectos de partículas de fuego y relámpagos. Finaliza con un plano panorámico de los personajes siendo repelidos nuevamente.

✌️ Vídeos largos de hasta 180 segundos

¿La duración de una sola generación es demasiado corta, por lo que la imagen solo se puede trocear a regañadientes, lo que resulta en una falta de inmersión en el vídeo y la imposibilidad de generar directamente una salida completa? Esta situación no volverá a ocurrir.

Dreamina Seedance 2.5 tiene potentes capacidades de generación ultra larga, logrando un salto de "parcheo fragmentado" a ✌️ vídeo ultra largo de 180 segundos.

  • Límite de 180 segundos: Abandona el tedioso parcheo de múltiples extensiones, el modelo ahora soporta la generación directa de clips de vídeo completos de hasta 180 segundos (3 minutos), liberando completamente la tensión visual de los vídeos largos.
  • Consistencia a largo plazo súper fuerte: En un lapso de tiempo de hasta 3 minutos, el modelo puede mostrar una memoria y estabilidad asombrosas, asegurando que las características del personaje, los detalles de la ropa y la arquitectura de la escena que aparecen al principio del vídeo se mantengan altamente consistentes al final del vídeo, rechazando la "mutación" en el camino.
  • Movimiento de cámara ultra largo y suave: Soporte perfecto para largos períodos de avance lento, movimiento envolvente o a través del lente, con transiciones suaves, mejorando enormemente la experiencia visual inmersiva.

Cómo usar: En la barra de herramientas de la interfaz de construcción, selecciona el modo exclusivo "Super Long Video". Elige el tiempo (hasta 180 s) en la opción de duración a la derecha, luego ingresa una descripción detallada de la escena o un guion en el cuadro de texto, y haz clic en Generar para obtener la función completa de una vez.

Escenarios adecuados (sin límite, solo ejemplos):

  • Vídeo promocional súper largo: como promocionar paisajes naturales, puede mantener la consistencia y la unidad de estilo, maximizando la retención del impacto visual.
  • Vídeos musicales completos y cortometrajes emocionales: Generar imágenes visuales con BGM completo, o tomas de monólogo que muestren cambios emocionales a largo plazo de los personajes.

Casos de vídeo súper largo (180s - cortometraje de misterio en escuela)

Prompt extenso de 3 minutos que describe una historia de misterio con múltiples personajes, cambios de escena, diálogos y efectos de sonido. El vídeo generado mantiene la consistencia de los personajes y la coherencia narrativa.

🎯 Control de texto con marca de tiempo

Muchos modelos solo pueden representar la "secuencia" de eventos en las palabras clave, lo que no permite un control preciso de la duración de la imagen. Errores como el ritmo excesivo de la cámara y los cortes prematuros ocurren a menudo.

En Seedance 2.5, el sistema soporta de forma nativa el control de trama e intervalos de toma basado en marcas de tiempo. Puedes especificar directamente el tiempo de inicio y fin de una acción, diálogo o escena a través de la marca de tiempo en el texto. El modelo puede emitir instrucciones precisas al nivel de segundo, controlar la transición y la evolución de la acción de la imagen, logrando una restauración precisa a nivel de "guion".

Cómo usar: Al usar la entrada de texto (Prompt), añade un marcador de intervalo de tiempo específico (como [00.0-05]) directamente delante de la toma, diálogo o acción que deseas describir, y luego escribe el guion en orden cronológico.

Escenarios adecuados (sin límite, solo ejemplos):

  • Cortometraje de trama con múltiples tomas: Cuando el vídeo necesita presentar el cambio de múltiples perspectivas (como el cambio de ida y vuelta en el interior del diálogo entre dos personas), la marca de tiempo se usa para que la duración de cada toma sea suficiente, evitando que la trama avance "rápidamente".
  • Vídeo de sincronización de ritmo y MV musical: Se requieren acciones visuales específicas o transiciones de escena para capturar los cambios emocionales de una determinada pieza musical. El control preciso al segundo puede reducir en gran medida la carga de trabajo de la post-edición.
  • Presentación de publicidad / demostración de curso: Mostrar diferentes detalles del producto por etapas (como los primeros 5 segundos para ver la apariencia, los 10 segundos intermedios para ver el funcionamiento, y los últimos 5 segundos para ver el efecto de uso).

Casos de control por marca de tiempo

Caso 1: Estilo wuxia con animación CG (10s, 240 fotogramas)

Prompt detallado con marcas de tiempo por fotogramas (Frame 0, 32, 48, 61, 84, 110, 132, 158, 183, 201, 217, 231, 240) para una pelea con efectos de tinta y luz.

Caso 2: Animación educativa sobre paneles solares (15s)

Prompt con marcas de tiempo de 0-3s, 3-6s, 6-9s, 9-12s, 12-15s para una explicación paso a paso con transiciones suaves y elementos gráficos.

Caso 3: Cortometraje "La receta de la abuela" (24s, 720 fotogramas)

Prompt con marcas de tiempo por fotogramas (0-90, 90-240, 240-390, 390-540, 540-660, 660-720) para una narrativa emotiva con estilo de animación de fieltro.

🌍 Rompiendo barreras lingüísticas

Muchos modelos a menudo tienen un buen soporte para inglés y chino, pero cuando se enfrentan a instrucciones en otros idiomas o la necesidad de generar diálogos en otros idiomas, a menudo hay malentendidos, pronunciación inexacta, segmentación de oraciones rígidas o errores directos.

Dreamina Seedance 2.5 rompe esta limitación y logra un verdadero soporte lingüístico global. El modelo ahora soporta completamente la entrada de texto en múltiples idiomas. Entre ellos, mayor prioridad en la lista de optimización para chino, inglés, español, indonesio, malayo, y cobertura completa para tailandés, árabe, portugués, vietnamita, japonés, coreano. Los creadores pueden dar instrucciones directamente en su lengua materna o en el idioma del mercado objetivo, y el modelo puede comprender con precisión las necesidades de la imagen, el tono emocional y la descripción de la acción. Al mismo tiempo, Dreamina Seedance 2.5 también optimiza significativamente la precisión de la pronunciación del diálogo, resuelve los problemas de mala lectura de palabras raras y puntuación poco natural del pasado, y la forma de la boca generada coincide más perfectamente con la voz multilingüe.

Cómo usar:

  • Escribir Prompt en idioma nativo: Después de seleccionar el modelo "Dreamina Seedance 2.5", describe la imagen directamente en el cuadro de texto usando el idioma que te resulte familiar.
  • Control de diálogo multilingüe: Si necesitas que el personaje hable, escribe las líneas en el idioma de destino directamente en la palabra clave.

Escenarios adecuados (sin límite, solo ejemplos):

  • Marketing en el extranjero y publicidad localizada: Para equipos de comercio electrónico transfronterizo, juegos en el extranjero o aplicaciones en el extranjero, pueden usar directamente el Prompt en el idioma del mercado objetivo para generar vídeos publicitarios localizados con características culturales locales y voces auténticas, reduciendo en gran medida el costo de la filmación transfronteriza y el doblaje de traducción.
  • Libertad de expresión para creadores globales: Los creadores de varios países ya no necesitan depender de software de traducción para convertir su inspiración, y pueden usar directamente su lengua materna para controlar el modelo sin barreras y liberar su creatividad.
  • Cortometrajes multilingües: Al hacer cortometrajes con personajes de varios países que necesitan comunicarse en diferentes idiomas, es fácil generar diálogos multilingües con pronunciación precisa y puntuación natural, lo que mejora la textura y el realismo transcultural de las obras cinematográficas.

Casos multilingües

Caso 1: Anuncio de cócteles (coreano) - Prompt en inglés que exige que todo el texto del vídeo final esté en coreano.

Caso 2: Vídeo de marketing en Vietnam (15s) - Prompt en inglés que exige diálogos, subtítulos y texto en vietnamita.

Caso 3: Conversión de vídeo de ventas a indonesio - Prompt en inglés que exige diálogo en indonesio y sincronización labial.

Caso 4: Anuncio de ramen en Tokio (japonés) - Prompt en inglés que exige todos los carteles, diálogos y subtítulos en japonés natural.

Caso 5: Avance de juego "Island of Whispers" (malayo, español, inglés) - Prompt en inglés con diálogos en malayo, español e inglés para un avance de juego.

🔇 Eliminar subtítulos y BGM irrelevantes

Para resolver el problema de "indicar claramente" no generar subtítulos "y" no generar BGM "en el proceso de generación de vídeo por IA, pero el vídeo final sigue generándose", Dreamina Seedance 2.5 resuelve eficazmente el problema de los subtítulos aleatorios y BGM irrelevantes del pasado, proporcionando creativos visuales y auditivos limpios para los amigos.

Cómo usar: Si quieres generar una escena y no quieres que la IA añada cosas por su cuenta, puedes añadir modificadores como "vídeo puro, sin subtítulos, sin música de fondo".

Escenarios adecuados (sin límite, solo ejemplos):

  • Acumulación de creativos de imagen pura: Se necesita una gran cantidad de tomas vacías sin perturbaciones (como paisajes naturales, fotografía aérea urbana, exhibición macro de productos, etc.) como reservas de creativos. Esta función puede evitar que la IA genere "subtítulos ilegibles" aleatorios o sonidos de fondo abruptos que contaminen la imagen y la pista de audio.
  • Publicidad comercial altamente personalizada y producción de MV: Los anuncios profesionales, los vídeos promocionales corporativos o los MV musicales tienen requisitos de personalización extremadamente altos para el diseño de sonido y la disposición de los elementos visuales. Al generar "negativos limpios" sin subtítulos ni BGM, se puede dejar espacio creativo para los editores profesionales y los ingenieros de sonido en la etapa posterior.
  • Contenido de fondo visual inmersivo / protector de pantalla: Cuando se necesita crear contenido inmersivo solo para visualización, como fondos de pantalla para exposiciones fuera de línea, fondos dinámicos en bucle entre LIVEs, portadas dinámicas para reproductores de música (como podcasts, estaciones de radio), etc.

Casos de eliminación de BGM y subtítulos

Ejemplo: Vídeo vertical de exhibición de moda (9:16) con requisitos estrictos de diseño y sin subtítulos, sin BGM, sin voz en off, sin ruido ambiental. El vídeo generado sigue sin sonido.

🌟 Efecto de generación base completamente optimizado

Al generar vídeos con IA, ¿has encontrado alguna vez situaciones en las que la piel de los personajes parece de plástico, el pelo de los animales está pegajoso, los movimientos corporales complejos se distorsionan fácilmente, y la apariencia o el fondo de los personajes cambian repentinamente cuando la cámara cambia?

Dreamina Seedance 2.5 se somete a una reconstrucción subyacente y una actualización integral en las capacidades del modelo básico, logrando "eliminar el sabor a IA".

  • Textura física y realismo definitivos: El modelo optimiza en gran medida la textura de la piel de los personajes, elimina la común "sensación grasienta" y el "reflejo plástico" en los vídeos de IA, y restaura los poros reales y la luz y sombra; al mismo tiempo, la textura del pelo de los animales también es más esponjosa y natural. En cuanto al sonido, el sonido mecánico y electrónico del TTS también se debilita, y el diálogo de la voz humana es más realista.
  • Optimización de movimientos de cola larga: Las interacciones físicas complejas y los "movimientos de cola larga" (es decir, dinámicas poco comunes y difíciles, como bailes especiales, movimientos de artes marciales complejos o cambios sutiles de expresión) que antes eran difíciles de manejar para la IA ahora se pueden generar de forma natural y fluida, con una calidad y vivacidad del movimiento significativamente mejoradas.
  • Consistencia espacio-temporal y consistencia de corte: Incluso en una generación única de hasta 30 segundos de vídeo, el vídeo puede mantener un alto grado de consistencia de la imagen del personaje y consistencia de la lógica física espacial, y la transición entre tomas se vuelve natural y suave.

Cómo usar:

  • Cuando se busca realismo: Usar palabras clave como "textura de piel nativa", "raíz del cabello distintiva", etc.
  • Al describir movimientos complejos: Se pueden describir instrucciones dinámicas complejas, como "un artista marcial realiza una voltereta hacia atrás compleja bajo la lluvia, desenvaina rápidamente una espada larga después de aterrizar, y la lluvia se desliza por la hoja".
  • Establecer la continuidad de múltiples tomas: Mantener la descripción de características básicas del personaje, y se pueden lograr múltiples cortes y transiciones para mantener la consistencia del personaje y la escena.

Escenarios adecuados (sin límite, solo ejemplos):

  • Blockbuster comercial/publicitario/de marca de alta calidad: Producir vídeos de grado comercial como primeros planos de cosméticos (enfatizando la textura de la piel), anuncios de productos para mascotas (enfatizando la textura del pelo), o desplazamientos de coches (enfatizando la luz, la sombra y la consistencia física).
  • Micro-cine y películas dramáticas realistas: Al crear películas realistas con emociones humanas ricas, las expresiones naturales de los personajes, los sonidos de diálogo realistas y las interacciones de acción suaves y complejas son el núcleo para mantener a la audiencia "fuera de la obra". La mejora en la consistencia del corte también permite a los amigos usar múltiples perspectivas de cámara para contar la historia completa con confianza.
  • Creación de vídeos de baile o acción: Para exhibiciones de baile callejero, parkour, artes marciales o deportes extremos que requieren movimientos corporales coherentes y complejos, la capacidad de desbloqueo de acciones de cola larga de Dreamina Seedance 2.5 puede restaurar estos movimientos difíciles de manera fluida.

Casos de calidad mejorada

Ejemplo 1: Pelea de tres personajes (boxeador, luchadora, kickboxer) con detalles realistas y consistencia de personajes. Seedance 2.5 muestra menos errores y mayor consistencia que 2.0.

Ejemplo 2: Animación 3D infantil para contar (1, 2, 3). Seedance 2.5 genera personajes consistentes y cuenta con precisión, mientras que 2.0 genera más personajes y movimientos menos naturales.

Ejemplo 3: CG de juego VRMMORPG con estilo gótico cyberpunk. Seedance 2.5 muestra mejor estilo, atmósfera y efectos especiales que 2.0.

🚀 Optimización integral de referencia multimodal

Frente a tareas complejas de generación y edición de vídeo, la respuesta del modelo a las instrucciones de aprendizaje multimodal es sin precedentes. No solo tiene un procesamiento de creativos más fluido, sino que también amplía la "dimensión sensorial" y la "profundidad industrial" de la referencia.

Desconstrucción de creatividad y elementos

  • Separar BGM: No solo se puede eliminar la música de fondo sin pérdida a través de palabras clave, dejando solo las voces y los subtítulos originales, sino que también se puede capturar y transferir con precisión el lenguaje de cámara profundo y la atmósfera emocional de los creativos de referencia, y lograr creativos especiales como transiciones sin costuras y storyboards de múltiples cuadrículas.
  • Transferir ideas: Captura la esencia emocional, los planos y el ritmo de un vídeo de referencia.
  • Transición sin costuras: Empalme fluido entre dos vídeos con transiciones creativas.
  • Storyboard de múltiples cuadrículas: Varias viñetas (stick figures) para controlar la narrativa.

Control de edición fina

  • Edición parcial: Elimina o reemplaza objetos específicos sin afectar el resto.
  • Razonamiento espacial: Modifica la perspectiva de la cámara y completa detalles no visibles.

Expansión de dimensiones sensoriales

  • Referencia de timbre: Clona la emoción y entonación de un audio de referencia.
  • Múltiples referencias: Mantiene rasgos individuales, evita caras intercambiadas.

Profundización en la industria cinematográfica

  • Edición en verde (croma): Reemplaza fondos con precisión.
  • Control de modelo blanco: Control preciso de cámara y movimiento con modelos 3D.
🎵 Separación/eliminación de música de fondo (BGM)

¿Has encontrado alguna vez una situación en la que la música de fondo del vídeo original es demasiado ruidosa e interfiere con la música secundaria al recrear vídeos o procesar creativos de referencia con sonido? Quieres extraer el diálogo puro de los personajes, pero no puedes deshacerte de la música de fondo. Incluso al usar otras herramientas para procesar, los subtítulos originales en la imagen se vuelven borrosos o distorsionados.

Dreamina Seedance 2.5 aporta potentes capacidades de deconstrucción audiovisual, logrando una verdadera "separación sin pérdida". El modelo puede entender con precisión la jerarquía de la banda sonora. Usando palabras clave, se puede pedir al modelo que elimine el sonido de fondo musical en el vídeo, dejando solo la voz del personaje. Lo más innovador es que, al eliminar el audio, también puede conservar perfectamente otros elementos visuales como los subtítulos en la imagen original, logrando que no haya interferencia entre audio y vídeo.

Cómo usar: Ingresa comandos directamente como "eliminar música de fondo", "eliminar BGM, solo conservar el diálogo del personaje" en la palabra clave.

Escenarios adecuados (sin límite, solo ejemplos):

  • Recreación cinematográfica y remix: Extraer diálogos puros de personajes de películas o series clásicas, eliminar la banda sonora original, y facilitar a los creadores la re-colocación de BGM emocional que se ajuste a su propio ritmo de edición, sin preocuparse de que dos músicas "peleen".
  • Purificación de creativos de Vlog y entrevistas: Al tratar con creativos de entrevistas o Vlogs diarios con bandas sonoras originales, dejar voces claras de los entrevistados con un solo clic, mejorando enormemente la profesionalidad y usabilidad del vídeo.
  • Reconstrucción de doblaje y diálogo: Obtener pistas de voz humanas limpias y subtítulos originales intactos, muy adecuado para escenas creativas que quieran reemplazar el doblaje en diferentes idiomas o interpretarlo dos veces.
✨ Transferir ideas

Al usar vídeos de referencia para la generación, ¿has encontrado una situación en la que la IA solo "aprende" los movimientos corporales superficiales a pesar de cargar un vídeo de referencia de alta estética, perdiendo por completo el posicionamiento avanzado de la cámara y la atmósfera de iluminación de la película original, lo que da como resultado un vídeo seco y sin "sensación online"?

Dreamina Seedance 2.5 logra un gran avance en la capacidad de comprensión del aprendizaje multimodal, realizando el salto de "imitación de acción" a ✨ transferencia de creatividad.

  • Extracción precisa del lenguaje de cámara: Ya no se limita a la reproducción de la dinámica superficial del personaje. El modelo puede capturar y restaurar con precisión la trayectoria de movimiento de la cámara física profunda de los creativos de referencia (como push-pull-shake suave, movimiento dinámico de cámara en mano), para que el vídeo generado herede directamente la sensación avanzada de cámara de la película original.
  • Reproducción profunda de emociones y atmósfera: Ya sea la sensación de película artística o la luz de neón de Cyberpunk, el modelo puede entender profundamente y transferir la lógica de color y el tono emocional del vídeo de referencia, logrando la reutilización perfecta de la "concepción artística".
  • Migración de "lógica de sensación de red" explosiva: Para el estilo visual actual de vídeo corto popular, el modelo puede captar con agudeza el ritmo visual y la lógica de diseño, permitiéndote generar fácilmente contenido de alta calidad con su propia "sensación de red explosiva".

Cómo usar: Menciona @ el vídeo de referencia en el prompt y describe en detalle qué contenido creativo deseas reemplazar o transferir. Describe la esencia central del contenido a transferir tanto como sea posible, como un estado lindo, un efecto cómico, etc.

Escenarios adecuados (sin límite, solo ejemplos):

  • Vídeos cortos virales con "sensación de internet": Desafíos de baile, cambios de vestuario sincronizados con el ritmo, y parodias de memes populares. Transferir la creatividad puede preservar el ritmo y esa "vibra de internet" que llama la atención del vídeo original, facilitando la creación de trabajos derivados en diferentes estilos.
  • Producción comercial: Promociones de marcas deportivas, anuncios de coches y desfiles de moda. Transferir la creatividad puede replicar los movimientos de cámara de alto impacto visual de este tipo de vídeos.
✂️ Eliminación y edición parcial

¿Has encontrado alguna vez esta situación? Claramente satisfecho con la imagen general, pero hay objetos desordenados en la esquina, o solo quieres reemplazar un accesorio en la mano del protagonista, pero solo puedes regenerar todo el vídeo, perdiendo por completo la iluminación y atmósfera perfectas originales.

Dreamina Seedance 2.5 logra un gran avance en la capacidad de control preciso del vídeo, realizando el salto de "redibujado completo" a ✂️ eliminación y edición local fina.

  • Eliminación inteligente sin rastro: Adiós a la sensación rígida de mancha. El modelo puede identificar con precisión la relación entre el elemento seleccionado y el entorno circundante. Mientras borra el objetivo, completa automáticamente el fondo según las leyes físicas y la lógica de luz y sombra original, logrando un verdadero "borrado sin rastro".
  • Reemplazo direccional de elementos: No solo se puede "eliminar", sino también "reemplazar". Simplemente selecciona el área especificada y combínala con instrucciones de texto para reemplazar sin problemas el elemento original con uno nuevo, y el nuevo elemento se integrará perfectamente en la perspectiva y atmósfera del vídeo original.

Cómo usar: Usa la "Herramienta de pincel/selección de cuadro" en la interfaz para untar o seleccionar directamente el área local de la pantalla que necesita modificación. Ingresa comandos directamente como "Eliminar transeúntes en el lado derecho de la pantalla" y "Reemplazar el vaso de agua en la mesa con un ramo de rosas rojas" en la palabra clave.

Escenarios adecuados (sin límite, solo ejemplos):

  • Salvamento de lentes y defectos: Eliminar con precisión escombros o elementos discordantes intercalados en el vídeo, convirtiendo los desechos en grandes tomas en segundos, reduciendo en gran medida el costo de reproducción.
  • Vestuario creativo y accesorios versátiles: Manteniendo las acciones principales de los personajes y la escena general sin cambios, es fácil cambiar el estilo de la ropa, cambiar los accesorios o reemplazar los accesorios interactivos en las manos de los personajes, logrando una variedad de creatividad visual a bajo costo.
  • Ajuste fino personalizado de detalles de la imagen: Sin necesidad de empezar de nuevo, solo personalizar y repintar el fondo local (como cambiar el cuadro colgado en la pared por una ventana) para satisfacer las necesidades de control último de los creadores sobre los detalles de la imagen.
🎥 Modificación de perspectiva espacial

¿Has generado un vídeo con calidad de imagen exquisita, pero la perspectiva es demasiado mediocre y carece de sensación cinematográfica? Quieres una toma aérea grandiosa o una toma en ángulo bajo llena de opresión, pero el modelo siempre se empeña en dar la misma toma a nivel.

Dreamina Seedance 2.5 logra un gran avance en la capacidad de percepción espacial 3D, realizando el salto de "posición de cámara fija" a 🎥 programación libre de ángulo completo.

  • Análisis de profundidad espacial 3D: Ya no se limita a la descripción plana y directa de imágenes 2D. El modelo puede entender profundamente la relación espacial 3D y el nivel de profundidad en el vídeo, como si se instalara una cámara virtual real en la escena. Incluso si se cambia el ángulo del lente, la distribución espacial se puede restaurar con precisión.
  • Reconstrucción libre de perspectiva multidimensional: Rompe el encarcelamiento de la perspectiva original. Ya sea una vista de pájaro, un contrapicado, un nivel, un primer plano o un panorama, el modelo puede reconstruir con precisión la perspectiva de la imagen según las instrucciones, y mantener la racionalidad absoluta de la proporción de la estructura del personaje y el entorno.
  • Transición suave de movimiento dinámico de cámara: No solo se puede cambiar la perspectiva estática, sino también generar movimiento de cámara dinámico y suave. Desde push-pull y balanceo hasta seguimiento envolvente, restaurar fácilmente la trayectoria de movimiento físico de las cámaras profesionales, dando a los vídeos una fuerte sensación de profundidad espacial.

Cómo usar: Añade instrucciones claras de lenguaje de cámara y perspectiva en las palabras clave. Por ejemplo: "Cambiar la toma a nivel por una toma desde una altura elevada, y la cámara se empuja lentamente hacia abajo", "Cambiar la perspectiva en tercera persona a la del personaje en el vídeo desplazándose por el bosque con perspectiva en primera persona" y otras instrucciones.

Escenarios adecuados (sin límite, solo ejemplos):

  • Creación de atmósfera de blockbuster a nivel cinematográfico: A través de tomas con ángulo extremo hacia arriba o aéreas, fortalecer la atmósfera de los personajes o la sensación de opresión del entorno de representación, inyectando tensión visual y narrativa de nivel de Hollywood en escenas ordinarias.
  • Exhibición de escenas grandiosas y panorámicas: Usar perspectiva aérea o de gran angular para mostrar perfectamente paisajes naturales magníficos y grandiosos, estilo urbano futurista o grandes formaciones de multitudes, haciendo que el patrón del vídeo se abra instantáneamente.
  • Experiencia inmersiva en primera persona: Simular la perspectiva subjetiva para el movimiento o la interacción, mejorando en gran medida la sensación de inmersión del espectador, muy adecuado para parkour, aventuras, conducción y otras creaciones de vídeo que requieren alta inmersión.
🎙️ Actualización de referencia de timbre

¿Has encontrado alguna vez esta situación al usar referencia de audio para la generación de doblaje? Aunque has cargado un audio de referencia altamente personal o emocionalmente rico, la IA solo ha "aprendido" la calidad básica del sonido, pero ha perdido por completo los altibajos emocionales y el encanto único del sonido original, lo que da como resultado un doblaje "robótico".

Dreamina Seedance 2.5 logra un gran avance en la capacidad de referencia de timbre, realizando el salto de "imitación mecánica" a 🎙️ reproducción y actualización de timbre de alta fidelidad.

  • Extracción precisa de características de timbre: Ya no se limita a la simple replicación de líneas de sonido básicas. El modelo puede capturar y analizar con precisión las características acústicas profundas de los creativos de referencia, haciendo que el audio generado sea altamente consistente con el sonido original y altamente reconocible.
  • Reproducción profunda de emociones y detalles: Ya sea la sensación de discurso apasionado, el tono de transmisión frío o el susurro suave a la hora de dormir, el modelo puede entender profundamente y transferir la tensión emocional y el ritmo de flujo en el audio de referencia, logrando un verdadero "sentimiento y emoción".

Cómo usar: Carga un audio de tono objetivo como referencia (se recomienda proporcionar voz humana clara y sin ruido). Ingresa el contenido de texto a generar, y puedes combinar palabras clave como "Referencia @Audio 1 dijo 'te encontré', y mantener un tono bajo y de suspenso", y combinar comandos emocionales para un control más preciso.

Escenarios adecuados (sin límite, solo ejemplos):

  • Micro-dramas e interpretación de tramas de fuerte carga emocional: Extraer con precisión expresiones emocionales altamente explosivas (como discusiones histéricas, llanto contenido y sensación de opresión del jefe). Inyectar tensión dramática altamente contagiosa en tu propio micro-drama, tweets de novelas o comentarios de historias, y despedirte por completo del monótono y tradicional doblaje de IA.
  • Marketing de matriz empresarial y voz exclusiva de marca: A través de un doblaje altamente profesional o confiable (como la voz grave masculina de anuncios de coches de alta gama, o la voz femenina animada de productos de belleza), generar vídeos de ventas y promocionales unificados. Sin necesidad de contratar repetidamente actores de doblaje profesionales, crear eficientemente tarjetas de presentación auditivas exclusivas de la marca.
👥 Actualización de referencia de múltiples personas

¿Has cargado dos referencias de personajes independientes y distintivas, pero en el vídeo generado por IA, los rasgos faciales de las dos personas se "mezclan" entre sí, su ropa y atuendos son inconsistentes, e incluso se convierten directamente en un "monstruo de costura" con múltiples manos y pies debido a la superposición de extremidades?

Dreamina Seedance 2.5 logra un gran avance en la capacidad de referencia de múltiples personas, realizando el salto de "confusión de características" a 👥 independencia de múltiples personas.

  • Vinculación precisa de detalles del personaje: Ya no se limita a mantener las características de un solo protagonista. El modelo puede distinguir y analizar claramente los contornos faciales, los rasgos faciales y el temperamento exclusivo de los diferentes personajes en los creativos de entrada, evitando la "ceguera facial" y la "interacción de características".
  • Interacción espacial compleja e interacción corporal: Ya sea que los personajes se abracen con cariño, se miren fijamente a los ojos o tengan una confrontación de acción intensa, el modelo puede entender profundamente la oclusión física y la lógica de interacción de múltiples personas en el espacio tridimensional, para que sea natural y fluido.
  • Control independiente de vestuario y estilo exclusivo: No solo la cara "no se mezcla", sino que la ropa tampoco "se mezcla". Para diferentes personajes, el modelo puede captar y bloquear con agudeza sus propios estilos de vestimenta, materiales y accesorios. Cuando diferentes personajes aparecen juntos, no interfieren entre sí, de modo que cada personaje mantiene su configuración original.

Cómo usar: Carga creativos de referencia para diferentes personajes y especifica sus acciones y relaciones en la palabra clave, por ejemplo, ingresa comandos como "El personaje A y el personaje B están sentados junto a la fogata hablando, el personaje A le da un vaso de agua al personaje B".

Escenarios adecuados (sin límite, solo ejemplos):

  • Narración con múltiples personajes y storyboard: Al tratar segmentos de trama con relaciones de personajes complejas (como disputas callejeras entre protagonistas masculinos y femeninos, confrontaciones tensas entre protagonistas y villanos, y reuniones de múltiples personas en una sala de conferencias), puede controlar con precisión la posición, las acciones y el rendimiento emocional de cada personaje, generando fácilmente tomas narrativas de múltiples personas coherentes y cinematográficas.
  • Campaña publicitaria de marca: Durante promociones de ropa, zapatos, bolsos o belleza, generar fácilmente desfiles de moda de doble modo, fotos de amigas en la calle o vídeos de exhibición de conjuntos para parejas. El modelo puede distinguir estrictamente los diferentes artículos y estilos de vestimenta de las dos personas, y producir de manera eficiente materiales de marketing comercial de alta calidad.
🟩 Edición de pantalla verde sin costuras

La nueva función de edición de pantalla verde sin costuras trae una experiencia de recorte de nivel industrial para los amigos.

Dreamina Seedance 2.5 logra un gran avance en la capacidad de segmentación de primer plano de vídeo y fusión de luz y sombra ambiental, realizando el salto de "parche de recorte rígido" a 🟩 edición de nivel de pantalla verde sin costuras.

  • Segmentación de alta precisión: Puede identificar con precisión los contornos complejos de personas u objetos, separando limpiamente las personas/objetos que necesitan ser recortados, evitando imágenes residuales.
  • Escenas dinámicas: Ya no se limita a fondos estáticos. El vídeo generado mantiene una estabilidad extremadamente alta a nivel de fotograma en la perspectiva relativa y la trayectoria de movimiento de los personajes y fondos, sin parpadeos ni saltos.

Cómo usar: Carga un vídeo de referencia con fondo de pantalla verde y describe claramente la nueva escena que deseas reemplazar en la palabra clave, o carga una imagen/vídeo de referencia. Por ejemplo, ingresa "reemplazar el fondo con un bosque mágico medieval, con luz y sombra misteriosas", "referencia a la imagen del aula, e integrar naturalmente a los personajes en la pantalla verde en ella" y otras instrucciones.

Escenarios adecuados (sin límite, solo ejemplos):

  • Producción de fantasía/ciencia ficción: Los actores solo necesitan completar la actuación básica frente a la pantalla verde (como lanzar magia, evitar monstruos, conducir naves espaciales) y restaurar las grandiosas escenas de efectos especiales del vasto universo y otros continentes a bajo costo.
  • Estudio virtual y vídeo de presentación oral: Adecuado para vídeos de presentación oral como noticias, explicaciones de conocimiento y ventas de comercio electrónico. Según el tema de la historia, el fondo se puede cambiar a un estudio virtual de alta gama, un estudio acogedor o una pantalla de datos con un fuerte sentido de la tecnología, enriqueciendo enormemente la expresión visual del vídeo.
  • Interacción creativa y trama de viaje en el tiempo: Hacer vídeos que permitan a las personas modernas "viajar en el tiempo" a palacios antiguos, o permitir que la gente común esté en el mundo de pinturas famosas y animaciones bidimensionales, proporcionando un espacio de imaginación infinito para los creadores de vídeos cortos.
🎬 Control profesional de modelo blanco (Clay Renderer)

Diseñado para profesionales del cine y la televisión y animadores 3D. Al crear tramas complejas o storyboards de nivel cinematográfico, a menudo es difícil lograr una programación de cámara de nivel industrial y una composición espacial basándose únicamente en prompts de texto. Para romper este cuello de botella, Dreamina Seedance 2.5 se ha sumergido en el flujo de trabajo profesional y ha lanzado oficialmente un plugin exclusivo de Clay Renderer para software 3D como Maya/Blender.

Con este plugin, Dreamina ha logrado un salto de "adivinanza a ciegas con texto" a 🎬 programación precisa a nivel de píxel, permitiendo que el lenguaje de cámara en el software 3D se transforme directamente en blockbusters generados por IA de alta calidad.

  • Restauración del lenguaje de cámara: Ya sea un movimiento push-pull-pan o un movimiento complejo de lente envolvente, Dreamina Seedance 2.5 puede entender la trayectoria de movimiento del espacio tridimensional transmitida por el Clay Renderer de entrada y restaurar el lenguaje de cámara.
  • Bloqueo de espacio y composición: Dreamina Seedance 2.5 puede analizar claramente la lógica de oclusión de fondo entre objetos en la escena del modelo blanco, asegurando que la imagen generada se ajuste a la composición espacial física preestablecida.
  • Control de posición del personaje y trayectoria de movimiento: Para personajes virtuales y objetos en el Clay Renderer, Dreamina Seedance 2.5 puede captar con agudeza su posición, postura y ruta de movimiento en la escena, permitiendo que el personaje actúe según la "posición de caminar" organizada.

Cómo usar: Carga el Clay Renderer hecho en software 3D profesional (como Maya/Blender) como referencia, y asígnales materiales, iluminación y configuraciones de personaje específicos en las palabras clave. Por ejemplo, ingresa "Ciudad desértica de estilo cyberpunk, el cuerpo principal de la imagen es un guerrero mecha completamente armado corriendo, luces de neón parpadeando" y otras instrucciones.

Escenarios adecuados (sin límite, solo ejemplos):

  • Previsualización de cine/animación: Los directores o guionistas pueden transformar rápidamente Clay Renderer 3D simples en imágenes de nivel cinematográfico con luz y sombra reales, materiales y texturas avanzadas, mejorando en gran medida la eficiencia de la comunicación del storyboard y la velocidad del desarrollo visual temprano.
  • Escenas de acción complejas y programación a gran escala: Al tratar segmentos que requieren una lógica de cámara estricta, como batallas de múltiples personajes, persecuciones de vehículos complejas o transferencias espaciales a gran escala, el uso de Clay Renderer puede hacer que la IA produzca grandes tomas que cumplan con las leyes físicas y las intenciones del director.
🔗 Transición de vídeo sin costuras

Amplía enormemente los límites creativos de empalmar múltiples creativos. Al mezclar clips de vídeo o transiciones de escenas, los cortes simples a menudo destruyen la coherencia de la imagen. Hemos creado una función de transición sin costuras para lograr un flujo suave entre dos creativos independientes.

Con esta función, el modelo puede generar automáticamente espacios completos, permitiendo que los lenguajes de cámara no relacionados se fusionen perfectamente en uno solo.

  • Transición creativa diversificada: Rompiendo las restricciones de transición convencionales, soporte completo para transición de longitud focal, transición de cambio de vestuario con giro, transición de inmersión y otros métodos de transición altamente impactantes visualmente.
  • Creativos originales sin pérdida: Manteniendo los clips de vídeo originales completamente sin modificar, el modelo puede reconocer inteligentemente y usar técnicas de lenguaje audiovisual avanzadas como activación de acción, tracción de línea de visión y transición de oclusión para completar la conexión suave.

Cómo usar: Carga los dos creativos de vídeo que necesitan ser empalmados. Controlarlos a través de palabras clave y requerir que se empalmen. El modelo analizará automáticamente el contenido de la pantalla, la profundidad espacial y la tendencia de movimiento, y generará una pantalla de transición entre los dos vídeos para completar el espacio y lograr un empalme sin costuras.

Escenarios adecuados (sin límite, solo ejemplos):

  • Desafío de mezcla creativa y arrastre: Necesitar giros visualmente impactantes, o creaciones de vídeo corto y de medios propios que cambien rápidamente entre diferentes espacios de tiempo.
  • Transición avanzada de trama y espacio-tiempo: En la producción cinematográfica, usar la tracción de la línea de visión del personaje o la obstrucción en primer plano para pasar sin problemas al siguiente espacio narrativo sin destruir los creativos originales.
🎞️ Storyboard de múltiples cuadrículas

Soporte para ingresar imágenes de storyboard de múltiples cuadrículas como referencias de trama, y el modelo genera vídeos coherentes basados en esto. Se recomienda usar imágenes de storyboard de dibujos lineales simples/muñecos de palo, y usar Prompt para completar las descripciones de la imagen, controlar la composición, la escenografía, el movimiento de la cámara y la acción.

Diseñado específicamente para escenas de producción que requieren una reproducción precisa del diseño de storyboard. Al producir cortometrajes narrativos fuertes, las imágenes generadas por IA siguen estrictamente la planificación de tomas del director.

  • Referencia de storyboard de bajo umbral: Liberación de la presión del arte temprano, se recomienda usar dibujos lineales simples o storyboards de muñecos de palo como referencia.
  • Control de Prompt sistemático: Aunque el storyboard use figuras de palo simples, con la imagen de referencia, se puede lograr una restauración mágica. Puedes consultar las siguientes formas para escribir palabras clave:
    • Primero, presenta lo que representan los diferentes storyboards. ¿Representan personajes o escenas?
    • Introduce nuevamente la configuración principal, cita la imagen de referencia y refiérete a los personajes/animales/objetos en detalle. ¿Cómo son exactamente?
    • Descripción de las tomas, a través del resumen de la historia, completa las tomas entre tomas una por una, controlando firmemente la composición, la escenografía, el movimiento de la cámara y la acción.
    • Otro contenido: como estilo global, elementos prohibidos, etc.

Cómo usar: Carga un storyboard de múltiples cuadrículas y escribe un prompt: primero aclara la referencia del storyboard, luego describe la configuración principal, y luego resume la historia, detallando las instrucciones de escena y movimiento de cámara para cada toma.

Escenarios adecuados (sin límite, solo ejemplos):

  • Ensayo de industrialización de cine/animación: El director y el diseñador de storyboard necesitan convertir el storyboard de vídeo en papel 1:1 en una previsualización visual dinámica para verificar el ritmo de la conexión de los lentes y la programación de la posición de la cámara.
  • Cortometraje narrativo coherente con lógica fuerte: Para la creación de vídeo profesional con requisitos de trama estrictos, es necesario controlar con precisión la posición y el movimiento de los personajes en cada toma.

Casos de storyboard de múltiples cuadrículas

Ejemplo: Storyboard de 9 tomas para un cortometraje de una mujer y un gato callejero. El prompt describe cada toma con detalles de composición, movimiento de cámara y emociones. El vídeo generado sigue fielmente el storyboard.

Esta guía recoge todas las funcionalidades principales de Seedance 2.5. Para más detalles y ejemplos interactivos, consulta la documentación oficial en la plataforma Dreamina.