Midjourney, una de las plataformas de generación de imágenes más populares entre los creativos audiovisuales y publicitarios, ha dado un paso decisivo hacia el futuro de la inteligencia artificial visual al presentar oficialmente la Versión 1 de su modelo de vídeo. Esta tecnología permite convertir imágenes estáticas en secuencias animadas mediante IA, abriendo una nueva etapa hacia simulaciones tridimensionales en tiempo real.
La favorita de los creativos da el salto al vídeo
Desde sus inicios, Midjourney se ha consolidado como una herramienta altamente valorada por su estética refinada y calidad visual, ideal para generar bocetos, escenarios o conceptos artísticos. Ha sido especialmente utilizada por diseñadores, publicistas y cineastas que buscan imágenes impactantes generadas por inteligencia artificial.
Sin embargo, hasta ahora, la plataforma no se había atrevido a adentrarse en el terreno del vídeo. Durante mucho tiempo, los usuarios que deseaban crear animaciones con IA partían de imágenes hechas en Midjourney para luego animarlas en otras herramientas como Runway o Pika. Con la llegada de modelos como Runway Gen-3, este flujo se ha profesionalizado enormemente. Por ello, el lanzamiento del modelo de vídeo de Midjourney podría cambiar las reglas del juego, integrando todo el proceso en una sola plataforma.
Image-to-Video: así funciona el nuevo sistema
La función estrella de este modelo es Image-to-Video. A partir de una imagen generada, se puede pulsar el botón “Animate” para transformarla en una secuencia de vídeo. El sistema ofrece dos modos principales de animación: uno automático, que interpreta el movimiento más probable, y otro manual, en el que el usuario describe cómo desea que se mueva la escena.
Además, existen dos configuraciones de movimiento: “high motion” y “low motion”. La primera es ideal para escenas dinámicas con desplazamiento de cámara y personajes; la segunda, para ambientes más estáticos y contemplativos, aunque a veces puede no generar movimiento perceptible.
Extensiones, imágenes externas y más
El modelo genera cuatro vídeos de cinco segundos por cada trabajo, con la opción de ampliarlos hasta 20 segundos. También es posible animar imágenes externas arrastrándolas al cuadro de comandos y marcándolas como start frame, para luego indicar el tipo de movimiento deseado.
“Queremos ofrecer algo divertido, fácil, bonito y asequible”, afirma el fundador de Midjourney, David Holz, quien asegura que el sistema será parte de una evolución más ambiciosa hacia entornos virtuales interactivos y en tiempo real.
Un futuro de simulaciones inmersivas
La empresa imagina una plataforma que combine generación de imagen, animación, espacio 3D y renderizado en tiempo real. “Imaginad un sistema de IA que genera imágenes en tiempo real. Puedes pedirle que se mueva en un espacio 3D, los personajes y escenarios también se mueven, y puedes interactuar con todo”, explica Holz.
Aunque en sus primeras fases puede resultar costoso, Midjourney asegura que pronto será una tecnología accesible para todos.
Disponibilidad, precios y desafíos
El modelo de vídeo está disponible por ahora únicamente en la web de Midjourney. Cada trabajo cuesta unas ocho veces más que una imagen, pero sigue siendo 25 veces más barato que otras opciones en el mercado. Se está probando un modo de vídeo relajado para suscriptores del plan “Pro” y superiores.
Este lanzamiento refuerza la posición de Midjourney como referente en generación visual con IA. Queda por ver si la comunidad creativa adopta plenamente esta herramienta para producción audiovisual o si continuará combinándola con otras plataformas. Sea como sea, el camino hacia mundos generados por IA en tiempo real ha comenzado.
Podéis ampliar información en el anuncio oficial de Midjourney.

