etiqueta: text-to-image

OpenAI quiere recuperar el trono visual con su nuevo modelo

OpenAI no piensa quedarse atrás en la carrera por liderar la generación de imágenes con IA. Tras el éxito viral de modelos como Nano Banana Pro de Google, la compañía de Sam Altman lanza ChatGPT Images con GPT-Image 1.5. Este nuevo modelo promete imágenes cuatro veces más rápidas, mejor edición puntual y una experiencia más fluida para usuarios móviles. Además, refuerza la fidelidad a las instrucciones, corrige errores clásicos y mejora la integración de texto. La batalla por el trono visual de la IA vuelve a estar abierta.
00:01:45

Flow: la nueva herramienta de Google que quiere conquistar a los cineastas

Google ha presentado Flow, su nueva herramienta de cine impulsada por inteligencia artificial, diseñada para trabajar con sus modelos más avanzados como Veo 3, Gemini e Imagen. Flow permite a cineastas crear escenas cinematográficas con control preciso de cámara, herramientas de edición inteligente y una integración fluida de activos visuales. Inicialmente disponible en EE.UU. para suscriptores de los planes Google AI Pro y Ultra, esta herramienta marca una evolución del experimento VideoFX, y ya ha sido utilizada por cineastas como Dave Clark, Henry Daubrez y Junie Lau para desarrollar cortometrajes innovadores.

Gemini ya permite crear imágenes a todos los usuarios gracias a Imagen 3

Google DeepMind ha lanzado Imagen 3, su modelo más avanzado de generación de imágenes por inteligencia artificial, ahora disponible en Gemini. Esta actualización permite la creación de imágenes de alta calidad, con mejoras en detalles y reducción de artefactos, facilitando la comprensión de prompts complejos. Imagen 3 también incluye tecnologías de seguridad como SynthID, que añade marcas de agua digitales a las imágenes generadas. Esta integración en Gemini ofrece una experiencia fluida para usuarios globales, revolucionando el campo de la generación visual con IA.

lo + leído