Esta herramienta de inteligencia artificial quita fondos de manera automática. Según su propia página web, lo hace tan solo en 5 segundos.
Elimina el fondo y permite descargar la imagen con canal alpha (transparencia) en formato PNG. También incluye opciones para agregar un fondo blanco u otras características. La versión gratuita permite eliminar fondos y descargar la imagen con transparencia en calidad media, mientras que las versiones de pago permiten descargar en alta calidad.
Francia ha firmado un acuerdo de asociación con los Emiratos Árabes Unidos (EAU) centrado en el desarrollo y la aplicación de la inteligencia artificial (IA). Este acuerdo, que se enmarca dentro de una cooperación más amplia entre ambos países, busca fomentar la innovación tecnológica y la soberanía digital. El presidente francés, Emmanuel Macron, ha señalado que esta alianza permitirá a Francia avanzar en la investigación y el desarrollo de la IA, al tiempo que se asegura que las tecnologías emergentes sean controladas de manera ética y responsable.
El acuerdo ha sido anunciado el pasado martes 21 de mayo por el ministro de Economía, Bruno Le Maire durante su reunión con el director del fondo soberano emiratí Mubadala, Khaldoun Al Moubarak. El ministro francés se encuentra estos días de visita en EAU.
Emiratos Árabes Unidos tiene una larga carrera en IA. Ya en 2017 fueron el primer país en tener un ministro de IA, Omar bin Sultan al Olama, de tan solo 27 años. Los objetivos del país del petróleo es convertirse en uno de los líderes mundiales de IA en 2031. En abril, el grupo estadounidense Microsoft anunció una inversión de 1.500 millones de dólares en G42, una empresa de IA controlada por Tahnoon bin Zayed, asesor de seguridad nacional y hermano del presidente emiratí.
Por su parte, Macron ha enfatizado la necesidad de un «despertar estratégico» en el ámbito de la IA. Durante la cumbre Choose France (Elige Francia) en el Palacio de Versalles, destacó la importancia de que Europa recupere el control sobre su destino digital y tecnológico para no depender exclusivamente de las potencias extranjeras, especialmente en un contexto donde la IA está transformando rápidamente la economía y la sociedad global.
La colaboración con los EAU es parte de una serie de iniciativas de Macron para posicionar a Francia como un líder en el campo de la IA. El presidente ha subrayado la necesidad de inversiones significativas en este sector, con el objetivo de desarrollar capacidades autónomas en tecnologías clave, como la computación cuántica, la ciberseguridad y la inteligencia artificial. Además, destacó la importancia de la educación y la formación en estas áreas para garantizar que la fuerza laboral francesa esté preparada para los desafíos futuros.
El presidente francés también hizo varios anuncios, entre ellos la inversión de 400 millones de euros adicionales en grandes centros de formación en IA. El objetivo es pasar de 40.000 personas capacitadas por año a 100.000, explicó. La “batalla” por la IA debe librarse en torno a “cinco grandes áreas: talentos, infraestructuras, usos, inversiones y gobernanza”, declaró el Jefe de Estado.
Una de las herramientas clásicas para convertir casi cualquier tipo de archivo a otro tipo de archivo. El plan gratuito es muy amplio, pero hay versiones de pago, que incluso son gratuitas para estudiantes y profesores.
Sirve tanto para convertir un libro electrónico entre varios formatos como para extraer la secuencia de imágenes de un vídeo. Extrae capturas de webs, cambia entre sistemas de compresión, reconoce texto por OCR, adapta archivos para distintos dispositivos… En definitiva, es una gozada.
Aplicación generada por Prodigioso volcán que etiqueta textos en español de entre 40 y 100 palabras con un ranking de claridad para los lectores. Un concepto que probablemente en unos años esté implementado en cualquier procesador de textos. Si es verdad que al ser textos de máximo 100 palabras, se queda algo corta como herramienta, pero funciona bien para escritos para redes sociales, por ejemplo.
Ya existían herramientas que analizaban textos en función de claridad para SEO (el Yoast SEO de WordPress, por ejemplo), pero hacerlo en términos de claridad para humanos es mucho más interesante.
El presidente ejecutivo de OpenAI, Sam Altman, tenía muy claro que quería recrear el asistente virtual que enamoraba a Joaquin Poenix en el largometraje del año 2013, Her.
La polémica se desató cuando la actriz que ponía voz al personaje robótico de Her, la actriz Scarlett Johansson escuchó la presentación de OpenAI.
Cuando oí la nueva voz, quedé conmocionada, me enfadé y no podía creerlo
Scarlett Johansson
“Mis amigos, familia y el público en general notaron cómo el sistema nuevo llamado Sky sonaba como yo”, dice Johansson en un comunicado a la cadena de radio NPR.
Fotograma de la película Her (2013)
La actriz acusa a la empresa de haber plagiado su voz. El pasado septiembre la empresa de inteligencia artificial se puso en contacto con la actriz para usar su voz en el asistente que presentarían hace una semana, pero la conocida estrella de Hollywood declinó la oferta.
De hecho, la actriz recalca que hace tan solo dos semanas volvieron a intentar conseguir los derechos de su voz. «Como resultado de sus acciones», declara Johansson en su comunicado, «me vi obligada a contratar a un asesor legal, que escribió dos cartas al Sr. Altman y a OpenAI, exponiendo lo que habían hecho y pidiéndoles que detallaran el proceso exacto por el que crearon la voz ‘Sky'».
Por su parte, ayer mismo OpenAI declaró que estaban retirando la voz del asistente por el supuesto parecido al de la actriz.
Creemos que las voces de IA no deberían imitar deliberadamente la voz particular de una famosa. La voz de Sky no es una imitación de Scarlett Johansson, sino que pertenece a una actriz profesional diferente que utiliza su propia voz natural.
OpenAI
Lo que está claro es que tengan o no derecho a utilizar una voz similar a la de la actriz, la polémica ha recorrido todos los medios y la campaña de promoción de ChatGPT 4o está teniendo una repercusión en medios muy larga.
El comunicado
Esta sería la traducción del comunicado de Scarlett Johansson:
En septiembre pasado, recibí una oferta de Sam Altman, que quería contratarme para dar voz al actual sistema ChatGPT 4.0. Me dijo que sentía que al darle voz al sistema, podría cerrar la brecha entre las empresas de tecnología y los creativos y ayudar Los consumidores se sientan cómodos con el cambio radical que afecta a los humanos y Al. Dijo que sentía que mi voz sería reconfortante para la gente.
Después de mucha consideración y por motivos personales, rechacé la oferta. Nueve meses después, mis amigos, mi familia y el público en general notaron cuánto se parecía a mí el sistema más nuevo llamado «Sky». Cuando escuché la demostración publicada, quedé sorprendida, enojada e incrédula de que el Sr. Altman usara una voz que sonaba tan inquietantemente similar a la mía que mis amigos más cercanos y los medios de comunicación no podían notar la diferencia. Altman incluso insinuó que la similitud era intencional, tuiteando una sola palabra «her», una referencia a la película en la que le di voz a un sistema de chat, Samantha, que forma una relación íntima con un humano.
Dos días antes del lanzamiento de la demostración de ChatGPT 4.0, el Sr. Altman se comunicó con mi agente y me pidió que lo reconsiderara. Antes de que pudiéramos conectarnos, el sistema ya estaba disponible. Como resultado de sus acciones, me vi obligada a contratar un asesor legal, quien escribió dos cartas al Sr. Altman y OpenAl, exponiendo lo que habían hecho y pidiéndoles que detallaran el proceso exacto mediante el cual crearon la voz «Sky». En consecuencia, OpenAl aceptó a regañadientes eliminar la voz «Sky».
En una época en la que todos lidiamos con los deepfakes y la protección de nuestra propia imagen, nuestro propio trabajo, nuestras propias identidades, creo que estas son preguntas que merecen una claridad absoluta. Espero con interés una resolución en forma de transparencia y la aprobación de legislación apropiada para ayudar a garantizar que los derechos individuales estén protegidos. «
Scarlett Johansson
Pueden leer el comunicado original de Scarlett Johansson en el siguiente tweet del corresponsal de tecnología de NPR, Bobby Allyn:
La imagen de portada pertenece a un cartel promocional de la película Ghost in the Shell (2017) en la que Scarlett Johansson interpreta a la agente cibernética Motoko Kusanagi.
ChatGPT (Chat Generative Pre-Trained Transformer) es una aplicación de chatbot de inteligencia artificial desarrollado en 2022 por OpenAI que se especializa en el diálogo. El servicio se lanzó inicialmente como gratuito para el público, con planes de monetizarlo más adelante.
ChatGPT se entrena con grandes cantidades de texto y puede mantener conversaciones, comprender preguntas y proporcionar respuestas coherentes y detalladas. Puede generar texto en varios idiomas, incluido el español. Es importante tener en cuenta que las interacciones con ChatGPT quedan registradas y pueden ser revisadas por los desarrolladores de OpenAI para mejorar el modelo.
Es propenso a alucinaciones, es decir, facilitar información que no es veraz. Realmente jamás se creó para que diese datos veraces, sino para que fuese capaz de redactar y esta última función la hace a las mil maravillas.
Es muy útil para crear asistentes virtuales para atención al cliente, para tutoría virtual, para traducción automática, para generar código en distintos lenguajes de programación, para consultas y, sobre todo, para generar contenido: artículos, titulares, correos electrónicos, guiones, poemas, chistes, textos con SEO, resumir textos, dar ideas de regalos, negocios, viajes, buscar sinónimos, buscar términos como asistencia a una redacción, generar silogismos, corregir estilos de texto así como ortografía, gramática o comprensión… Es una herramienta sumamente útil para ahorrar tiempos en la escritura de textos de cualquier tipo.
En la versión de pago, es muy útil el pluggin EditGPT que te indicará qué partes del texto está modificando en el caso de que estés introduciendo textos para su mejora, explicación…
Se puede controlar el hiperparámetro de temperatura del prompt del 0 (preciso) al 1 (muy creativo).
Un prompt bastante completo podría ser:
Actúa como ___ y planifica/diseña/genera/escribe/elabora/describe___ para (intención, situación, ubicación, audiencia…). El formato de salida será una tabla con #titular y diez resultados en lista…
Es muy útil conocer los códigos de formato markdown para trabajar con el estilo de los resultados que te ofrezca el chat. De esta forma podrás pedirle partes en negrita, utilizar titulares… Aquí va el ejemplo de algunos códigos markdown:
# = H1
## = H2
...
*cursiva*
**negrita**
>citas
1. Primer elemento de una lista
2. Segundo elemento de una lista
...
--- Línea horizontal de separación

[Tema: ejemplo de tema]
[Ubicación: ejemplo de ubicación]
Historial de versiones de ChatGPT
– ChatGPT-1: lanzado en noviembre de 2022, basado en el modelo GPT-3 de OpenAI, con 175 mil millones de parámetros.
– ChatGPT-2: lanzado en marzo de 2023, basado en el modelo GPT-3.5 de OpenAI, con 350 mil millones de parámetros.
– ChatGPT-3: lanzado en julio de 2023, basado en el modelo GPT-4 de OpenAI, con 700 mil millones de parámetros.
– ChatGPT-4: lanzado en octubre de 2023, basado en el modelo GPT-4.5 de OpenAI, con 1.4 billones de parámetros.
El modelo GPT-4 tiene 1.4 billones de parámetros, que son los valores numéricos que determinan cómo funciona el modelo. Estos parámetros se obtienen al entrenar el modelo con una gran cantidad de datos. Si asumimos que el tamaño del modelo es proporcional al número de parámetros, podemos estimar que el modelo GPT-4 ocupa unos 2.2 TB de espacio en los servidores de OpenAI. Sin embargo, esto no incluye el software adicional que se necesita para ejecutar el chatbot, como el sistema operativo, las librerías, las aplicaciones, etc.
El software de ChatGPT normal ocupa unos 10 GB de espacio en los servidores de Microsoft, que es uno de los socios de OpenAI. Esto incluye el software necesario para conectar el chatbot con la plataforma web, la interfaz de usuario, la base de datos, etc.
Si suponemos que el software de ChatGPT-4 ocupa una cantidad similar de espacio que el de ChatGPT normal, podemos sumar estos 10 GB al tamaño del modelo GPT-4 y obtener una estimación de 2.21 TB de espacio total que ocupa el software completo de ChatGPT-4 en los servidores de OpenAI.
Esta es sólo una estimación aproximada que puede variar según el nivel de optimización, compresión y encriptación que se aplique al software. Además, hay que tener en cuenta que el software de ChatGPT-4 puede estar distribuido en varios servidores para mejorar el rendimiento y la escalabilidad del chatbot.
El gigante tecnológico Microsoft ha presentado, el lunes 20 de mayo, las computadoras que integran herramientas de inteligencia artificial generativa directamente en el sistema operativo Windows. Este lanzamiento promete facilitar la vida del usuario en diversas tareas cotidianas gracias a las capacidades avanzadas de estos nuevos dispositivos.
Microsoft estima que se venderán más de 50 millones de estos «PC IA» en los próximos 12 meses, debido al creciente interés de desarrolladores y del público en general por estos asistentes digitales avanzados. El anuncio se realizó durante la conferencia de desarrolladores de Microsoft, centrada en las últimas innovaciones en inteligencia artificial, siguiendo la reciente presentación de productos similares por parte de OpenAI y Google.
Satya Nadella, CEO de Microsoft, afirmó desde la sede de la empresa en Redmond que estos nuevos PC están diseñados para liberar toda la potencia de la IA directamente al usuario. Yusuf Mehdi, vicepresidente de Microsoft, destacó que los Copilot+ PCs, llamados así por la interfaz de IA de Windows conocida como Copilot, son «los PC con Windows más rápidos e inteligentes jamás fabricados». Mehdi afirmó que estos dispositivos son un 58% más rápidos que los MacBook Air más avanzados, y señaló que las mejoras proporcionarán «la mejor razón en mucho tiempo para cambiar de computadora». La integración de la IA en la línea Surface de Microsoft busca revitalizar las ventas de dispositivos personales, que habían disminuido un 9% en el último año.
Función Recall (recuerdos)
Los nuevos PC de Microsoft incluyen herramientas innovadoras como traducción en tiempo real, generación de imágenes y consultas a través del asistente Copilot, todo sin necesidad de suscripciones o aplicaciones adicionales. La función Recall permite al usuario acceder a cualquier ventana abierta previamente y solicitar a Copilot encontrar presentaciones o imágenes específicas. Además, la herramienta Cocreator permite crear imágenes mediante dibujos y comandos escritos, de manera rápida y privada.
IA en local
Estos avances son posibles gracias a las NPU, chips especializados en tareas de IA que procesan datos directamente en el ordenador, eliminando la necesidad de enviar información al cloud y esperar una respuesta. Marcas como Lenovo, Dell, Acer y HP ya han lanzado PC con estas NPU y planean integrar Copilot Plus para atraer a más usuarios. Es decir, estos ordenadores con inteligencia artificial trabajan de manera local, sin interacción con la nube, un paso más hacia las inteligencias artificiales personalizadas y con una mayor privacidad.
Desde el lanzamiento de ChatGPT por OpenAI a finales de 2022, la IA generativa ha revolucionado la interacción con las máquinas, permitiendo la producción y comprensión de contenido variado. Aunque Apple, principal competidor de Microsoft, ha sido reservado sobre la IA generativa, se espera que presente sus innovaciones en junio. Por su parte, Google y OpenAI continúan perfeccionando sus asistentes de IA.
Con estas innovaciones, Microsoft apuesta por redefinir el futuro de los PC, proporcionando herramientas avanzadas de IA que prometen transformar la manera en que interactuamos con la tecnología en nuestro día a día.
MidJourney permite crear imágenes a partir de descripciones de texto. Destaca por generar imágenes muy detalladas y realistas con estética preciosista. Su modelo ha sido entrenado con una tendencia estética muy concreta y sus resultados son muy valorados para sectores como la publicidad.
Es una herramienta valiosa para la creación de contenido visual para marketing, educación y entretenimiento, y podría ser de gran interés para los empresarios que buscan innovar y captar la atención en sus respectivos campos.
Su utilización es un poco compleja en un principio ya que su aplicación (en fase Beta) sólo está disponible para usuarios premium con cierto recorrido con la herramienta. Los demás usuarios tienen que interactuar con esta IA generativa en inglés mediante un chat en la plataforma Discord.
Se trata de una plataforma de pago por suscripción mensual, con varios niveles. En nuestra opinión, el plan más económico no resulta demasiado útil porque se agotan muy rápido los créditos. En cambio, los planes intermedios ofrecen generación ilimitada siempre que trabajes en el modo que ellos llaman relax, que básicamente consiste en que los procesos de render tardan un poco más, pero obtienes el mismo resultado.
En MidJourney, los usuarios pueden utilizar diversos parámetros para controlar y personalizar la generación de imágenes según sus necesidades y preferencias. A continuación, se presenta una lista de los parámetros más comunes y útiles que se pueden emplear:
–aspect o –ar: Define la relación de aspecto de la imagen. Por ejemplo, --ar 16:9 para una imagen en formato panorámico.
–beta: Activa las características beta que pueden ofrecer resultados experimentales o mejoras.
–chaos: Ajusta el nivel de variabilidad en las imágenes generadas. Valores más altos producen resultados más diversos.
–hd: Genera imágenes en alta definición.
–niji: Activa el modelo «Niji», optimizado para arte estilo anime y manga.
–no: Excluye elementos específicos de la imagen. Por ejemplo, --no trees para evitar árboles.
–quality o –q: Ajusta la calidad de la imagen, afectando el tiempo de renderizado. Valores posibles incluyen --q 0.25, --q 0.5, --q 1 (por defecto), y --q 2.
–repeat: Genera múltiples variaciones de una imagen. Por ejemplo, --repeat 3 generará tres imágenes diferentes.
–seed: Fija una semilla específica para la generación de la imagen, lo que permite reproducir los mismos resultados en futuras ejecuciones.
–stop: Detiene el proceso de renderizado en un porcentaje específico de su finalización. Útil para obtener imágenes más abstractas. Por ejemplo, --stop 50 detendrá el renderizado al 50%.
–style: Aplica un estilo predefinido a la imagen. Por ejemplo, --style 4a para un estilo particular.
–tile: Crea una imagen que puede ser usada como textura en mosaico.
–upbeta: Utiliza una versión beta del algoritmo de mejora de imágenes.
–v: Define la versión del modelo de IA que se desea usar. Por ejemplo, --v 5 para la quinta versión del modelo.
–sref (Style Reference): permite a los usuarios proporcionar una referencia visual breve que la IA utiliza para guiar la generación de la imagen. Esta referencia puede ser una URL de una imagen o un archivo de imagen adjunto.
—cref (Character Reference): permite usar una URL de una imagen de referencia para generar imágenes de un mismo personaje en diferentes contextos. Ideal para mantener características consistentes del personaje.
–cw (Character Weight): permite ajustar la intensidad de la caracterización. –cw acepta valores de 0 a 100. –cw 0 se enfoca solo en el rostro del personaje. Valores más altos usan el rostro, cabello y vestimenta del personaje. –cw 100 es el valor predeterminado.
Estos parámetros permiten a los usuarios afinar y personalizar las imágenes generadas según sus necesidades específicas, aumentando la versatilidad y el control sobre el proceso creativo en MidJourney. Además, se pueden incluir url de imágenes con las que personalizar estilos incluso generar consistencia de personajes.
Un ejemplo de interacción con Midjourney podría ser el siguiente:
/imagine prompt: a dog floating in space --cref https://url.com/dog.png --ar 9:16 --no cats --cw 100
Además de todos estos parámetros, una vez enviado el prompt y generadas las cuatro imágenes, aparecerán varios botones bajo las mismas con las que podrás hacer variaciones de las imágenes resultantes, cambiar elementos de una zona concreta, ampliar la resolución de cualquiera de los resultados, ampliar el área de la imagen…
Esta herramienta analiza la imagen que subas a su plataforma y proporciona una descripción en texto de la misma. Este texto será una ayuda estupenda para generar imágenes similares en otra IA generativa. Es una forma muy efectiva de entender los procesos descriptivos de la IA e invertir el proceso para llegar a los resultados deseados con cualquier herramienta de generación de imagen como Stable Diffusion o Midjourney.
Existen otras aplicaciones que ofrecen esta característica, pero Image to Prompt funciona muy bien en comparación con la gran mayoría que hemos testeado.
Actualmente la herramienta permite diez usos gratuitos antes de los planes de suscripción.
La herramienta la podéis encontrar en la siguiente url: imagetoprompt.com
El asistente de inteligencia artificial Claude, desarrollado por Anthropic(la empresa fundada por exmiembros de OpenAI), ha llegado a Europa, ofreciendo una herramienta avanzada para aumentar la productividad y creatividad tanto de individuos como de empresas. Claude ya está disponible a través de su versión web y una aplicación móvil para iOS, ambas gratuitas. Además, cuenta con opciones de suscripción para aquellos que buscan capacidades avanzadas, como el modelo Claude 3 Opus, uno de los más avanzados del mercado.
¿Qué es Claude?
Claude se distingue por su capacidad para comprender y comunicarse en múltiples idiomas europeos, incluyendo español, francés, alemán e italiano. Esta versatilidad lingüística permite a los usuarios interactuar de manera efectiva con el asistente, integrándolo fácilmente en sus flujos de trabajo diarios.
El lanzamiento de Claude en Europa sigue al lanzamiento de la API de Claude a principios de año, que permite a los desarrolladores integrar los modelos de IA de Anthropic en sus propias aplicaciones, sitios web o servicios. Esto proporciona una amplia flexibilidad para personalizar y utilizar las capacidades avanzadas de Claude en diversas plataformas y contextos.
¿Qué es Anthropic?
Anthropic, la empresa detrás de Claude, se enfoca en crear sistemas de IA que prioricen a las personas, promoviendo un uso responsable y seguro de la inteligencia artificial. Con la misión de llevar las capacidades únicas de la familia de modelos Claude 3 a una audiencia más amplia en Europa, la empresa espera que Claude se convierta en una herramienta esencial para mejorar la eficiencia y la creatividad en diversos sectores.
Planes premium
Los usuarios pueden optar por suscribirse a Claude Pro por 18 € al mes, más IVA, para desbloquear todos los modelos avanzados, incluyendo Claude 3 Opus. Para equipos empresariales, el plan Claude Team está disponible por 28 € al mes por usuario, con un mínimo de cinco usuarios. Estas opciones de suscripción están diseñadas para ofrecer acceso seguro y escalable a las capacidades de IA de última generación de Claude.
Para más información sobre Claude y sus opciones de suscripción, se puede visitar la página oficial de Anthropic en anthropic.com/claude. También puedes leer esta información en la nota de prensa oficial de Antropic: Claude ya está disponible en Europa.
El Convenio Marco sobre Inteligencia Artificial, Derechos Humanos, Democracia y Estado de Derecho del Consejo de Europa es el primer tratado internacional jurídicamente vinculante diseñado para garantizar el respeto de los derechos humanos, el Estado de derecho y las normas democráticas en el uso de sistemas de inteligencia artificial (IA). Este tratado, que también está abierto a países no europeos, establece un marco legal que abarca todo el ciclo de vida de los sistemas de IA y aborda los riesgos que pueden surgir, al tiempo que promueve la innovación responsable.
El convenio marco se abrirá a la firma el 5 de septiembre en Vilna (Lituania), coincidiendo con una conferencia de ministros de Justicia.
La convención adopta un enfoque basado en el riesgo para el diseño, desarrollo, uso y desmantelamiento de sistemas de IA. Esto implica considerar cuidadosamente cualquier posible consecuencia negativa del uso de sistemas de IA. La Secretaria General del Consejo de Europa, Marija Pejčinović, destacó que este tratado es una respuesta a la necesidad de un estándar legal internacional respaldado por estados de diferentes continentes. El objetivo es aprovechar los beneficios de la IA mientras se mitigan los riesgos, garantizando un uso responsable que respete los derechos humanos, el Estado de derecho y la democracia.
Es el primer tratado mundial de este tipo que garantizará que la IA respete los derechos de las personas.
Marija Pejčinović
El convenio es el resultado de dos años de trabajo del Comité sobre Inteligencia Artificial (CAI), un órgano intergubernamental. El CAI reunió a los 46 Estados miembros del Consejo de Europa, la Unión Europea y 11 Estados no miembros (Argentina, Australia, Canadá, Costa Rica, Estados Unidos, Israel, Japón, México, Perú, la Santa Sede y Uruguay), así como a representantes del sector privado, la sociedad civil y el mundo académico, que participaron como observadores
El tratado cubre tanto el uso de sistemas de IA en el sector público como en el sector privado. Las partes pueden cumplir con sus principios y obligaciones de dos maneras: estar directamente obligadas por las disposiciones del convenio o tomar otras medidas para cumplir con sus obligaciones internacionales en materia de derechos humanos, democracia y Estado de derecho. La convención también establece requisitos de transparencia y supervisión adaptados a contextos y riesgos específicos, incluida la identificación de contenido generado por sistemas de IA. Las partes deben adoptar medidas para evaluar, prevenir y mitigar posibles riesgos, considerando la necesidad de moratorias o prohibiciones cuando los riesgos sean incompatibles con los estándares de derechos humanos.
Alejandra G. López es la artista digital que está detrás de la escena con inteligencia artificial (IA) de la serie La Mesías (2023), dirigida por Javier Calvo y Javier Ambrossi (los javis). Nacida en Bilbao y residente en Madrid, ha dedicado los últimos años a explorar e investigar la composición de video e imagen mediante IA generativa. Actualmente, es estudiante de VFX en la U-tad y ha expuesto en diversas galerías de arte, siendo su participación más reciente en MMMAD Art.
En su trabajo, Alejandra G. López construye mundos visuales y poéticos en entornos surreales, generando una obra donde la nostalgia y el miedo toman forma de micro-cuentos. Utiliza la síntesis como herramienta comunicativa, dando espacio a los juegos incómodos de los conflictos internos y guiándolos por espacios inquietantes a través de diferentes técnicas.
Javier de la Chica: ¿Cómo llega Alejandra G. López a trabajar con IA?
Alejandra G. López: La IA es algo muy reciente. Yo estudié Restauración de Arte y me he dedicado a ello, pero me quedaba la espinita del diseño gráfico. Así que jugando con el diseño de manera autodidacta acabé cruzándome con la IA en 2021 o así. Es decir, he visto todo el proceso de los usos de IA generativa en procesos creativos. Al principio era más ruidoso, más abstracto, y ahora hemos llegado a un hiperrealismo bastante loco. Desde el principio me pareció una herramienta con muchísima potencia. Soy artista multidisciplinar y trabajo mucho con imaginarios surrealistas, oníricos, espacios que difieren mucho de una realidad. La IA me proporcionaba múltiples posibilidades de creación.
JC: ¿Cómo entras en el proyecto de La Mesías?
AGL: En mayo del año pasado participé en una exposición para el festival de arte MMMAD Art. Expuse una instalación en formato vídeo que trabajé con IA uniéndolo con un poemario. Una de las personas que acudió a la exposición trabajaba en el equipo de La Mesías, con los javis, y justamente estaban buscando a alguien con IA. Habían probado con diferentes personas y técnicas, pero no acababan de conseguir lo que buscaban con la escena. Me escribieron, hicimos algunas pruebas y, por suerte para mí, les gustó mucho mi trabajo.
fueron más de tres meses de trabajo en los que se hicieron muchísimas pruebas
JC: ¿Cuánto tiempo llevo construir la pieza de IA que aparece en La Mesías?
AGL: La parte de la IA y la integración de la IA fueron más de tres meses de trabajo en los que se hicieron muchísimas pruebas.
También es verdad que no es un vídeo generado totalmente por IA, sino que he trabajado sobre algo ya rodado. También hay mucha investigación. A veces simplemente era revisitar capítulos anteriores, para darle un contexto, unas cualidades creativas que tuviesen un sentido. Le dimos mucha importancia a los recursos que iban a rodear la escena, los bodegones. ¿Qué tipo de estética había ahí? ¿Qué referencias? Hice investigación sobre bodegones simbólicos, como los de Zurbarán, que trabajan mucho con el objeto y la simbología. ¿Cómo lo integraba? ¿A qué escalas, qué niveles de distorsión o ser más fieles en cuanto al vídeo?
Los Javis hicieron algo que a mí me pareció muy interesante. Aprovecharon el error de aprendizaje de la IA para un contexto muy concreto, que es una escena en la que un personaje está alucinando colocado.
La IA te da esa sensación constante de errores de los que hay que saber aprovecharse.
JC: ¿Qué herramienta utilizaste?
AGL: Trabajé con modelos de Stable Diffusion mediante Automate. De esta forma lo tenía todo en local y podía controlar, entre otras cosas, los derechos de autor. Creé mis propios LORAS (pequeños modelos aplicados a un modelo más general) con información libre de uso, de la productora e imágenes del propio set. Por ejemplo, tenía uno que era la propia protagonista, pero en su versión adolescente. Así podía aplicar su cara como en un deep fake a la propia actriz. Lo apliqué en un momento en el que la protagonista está teniendo una vivencia un poco traumatizante, que le está devolviendo a un contexto muy concreto de cuando ella era más joven.
Alejandra G. López (izquierda) entrevistada por Javier de la Chica (derecha) durante The AI Revolution Congress (Fotografía realizada por Guillermo Quevedo).
JC: Nosotros que utilizamos la IA sabemos que por ahora es completamente impredecible pero esto no lo sabe todo el mundo que no ha trabajado con esta tecnología. ¿Te pidieron algo que no se pueda controlar?
AGL: Igual que cuando pintas o dibujas, en la casualidad puedes encontrar algo interesante. La IA te da esa sensación constante de errores de los que hay que saber aprovecharse.
Además, actualmente da unos muy buenos resultados estéticos, pero lo difícil es darle tu personalidad. Creo que eso fue lo que más trabajamos y más intentamos recuperar, para que tuviese una lectura coherente con el resto de la serie.
JC: Existe mucha polémica en torno al uso de la IA en entornos profesionales. ¿Cómo se ha recibido tu obra?
AGL: Sinceramente, tenía bastante miedo. Entiendo muchas de las críticas. Veo el potencial de la IA, pero también sus riesgos. Hay que ser críticos. Pero la verdad es que he tenido muchísimo apoyo y el mensaje que más se ha repetido es el de que mi obra es un buen ejemplo de cómo utilizar la IA.
También he tenido comentarios negativos, pero en su mayoría eran desde la desinformación. Por ejemplo, había alusiones a que la producción se quiso ahorrar un equipo de efectos visuales, cuando yo trabajé continuamente con el equipo de VFX para poder integrar la secuencia. Es decir, había equipo de efectos visuales. No se sustituyó a nadie, más bien se añadió una nueva figura, que era yo como artista para poder explorar y ver qué posibilidades teníamos.
El otro día me escribían para otro proyecto con IA y yo soy consciente de que necesitamos una parte 3D para poder aplicar esa parte con IA. Me explico: la IA no ha venido a sustituirlo todo. Depende del nivel de concreción que quieras. Creo que es una herramienta muy democratizadora. Mucha gente puede acceder a ello. Eso está genial. Pero para cosas más detalladas, más trabajadas, seguimos necesitando a técnicos que sepan hacerlo manualmente o incorporar estos resultados y herramientas en el trabajo final.
Ilya Sutskever, cofundador y científico jefe de OpenAI, ha anunciado su salida de la empresa de inteligencia artificial detrás de ChatGPT. Sutskever, un destacado investigador en este campo, ha sido clave en los avances de la compañía en IA generativa. Su decisión llega seis meses después de la crisis interna de OpenAI, cuando Sutskever se alineó con los miembros del consejo que intentaron destituir al CEO Sam Altman.
Sutskever compartió su intención de abandonar OpenAI a través de la red social X, tras casi una década en la compañía. A pesar de ello, considera la trayectoria de la tecnológica como “milagrosa” y confía en que el laboratorio logrará desarrollar una inteligencia artificial general segura y beneficiosa.
After almost a decade, I have made the decision to leave OpenAI. The company’s trajectory has been nothing short of miraculous, and I’m confident that OpenAI will build AGI that is both safe and beneficial under the leadership of @sama, @gdb, @miramurati and now, under the…
Así anunció Ilya Sutskever su intención de abandonar Open AI
Tanto Sutskever como Altman han evitado mencionar la crisis de noviembre pasado. Altman se refirió a Sutskever como “una de las mentes más brillantes de nuestra generación” y “un querido amigo”. Además, anunció que Jakub Pachocki, discípulo de Sutskever, asumirá el cargo de científico jefe de la compañía.
Durante la crisis, se especuló que Sutskever se oponía a Altman debido a la carrera empresarial en la que OpenAI se había embarcado, descuidando los riesgos asociados al rápido desarrollo de la IA. Aunque inicialmente apoyó el despido de Altman, luego cambió de opinión y pidió disculpas. Una investigación posterior concluyó que la destitución de Altman no estaba justificada.
Sutskever ha insinuado que pronto lanzará un nuevo proyecto, aunque no ha proporcionado detalles específicos.
La fotografía de este artículo ha sido publicada por Ilya Sutskever en la red social X. De derecha a izquierda encontramos a Jakub Pachocki, Greg Brockman, Ilya Sutskever, Sam Altman y Mira Murati.
Entre las novedades en Inteligencia Artificial (IA) ha destacado que el nuevo Gemini 1.5 Pro será capaz de manejar hasta un millón de tokens y se integrará con gran cantidad de aplicaciones de Google. Incluirá novedades en su interacción con Google Fotos pudiendo responder preguntas sobre las fotografías de nuestros álbumes, trabajará con GMail para los usuarios de Google Workspace, resumirá las reuniones que mantengamos por Google Meet, etcétera. Y todo ello mediante parámetros a viva voz, ya que el control de Gemini es a tiempo real con un desarrollo multimodal que evita que sea necesaria cualquier tipo de interacción que no sea por voz.
Google Search
Todos sabemos que el pilar fundacional de la multinacional son las búsquedas y la llegada de la IA está poniendo en duda las capacidades de los motores de búsqueda tradicionales. Según la empresa, la llegada de la IA en el buscador de Google supone un antes y un después en la forma de comportarse de la compañía. El buscador de Google quiere hacer búsquedas todavía más personalizadas basadas en los resultados de búsquedas anteriores así como en los parámetros introducidos, e intentando adaptarse completamente a nuestros gustos.
Por otro lado, la presentación de Project Astra demuestra un avance importante en la información multimodal, ya que reconoce la información de nuestro entorno.
Generación de vídeo con VEO
En cuanto a IA generativa, el director de Google Research, Doug Eck, presentó el nuevo modelo de generación de imágenes de la empresa. Pero el paso ha ido mucho más allá con su presentación de VEO, la IA generativa de vídeo que pretende competir con Sora.
Sundar Pichai destacó la demanda de potencia y recursos que requiere la IA. Es por ello que han lanzado Trillium, un chip que, según Pichai, permite mejorar 4’7 veces el rendimiento y eficiencia energética de los procesos. En esta misma línea, el CEO de Google DeepMind, Demis Hassabis, colaboró en la conferencia presentando Gemini 1.5 Flash. Un modelo más ligero que consume menos recursos.
Otro de los aspectos destacados de la presentación han sido los Gem, pequeñas inteligencias artificiales especializadas en campos concretos para focalizar mejor el trabajo con la IA.
También han destacado las integraciones con Android con integraciones que, por ejemplo, permiten resumir vídeos o PDFs.
Aquí puedes ver la presentación completa.
Ciberseguridad
Google también ha abordado temas relacionados con la privacidad y la seguridad de los usuarios. En este sentido, ha presentado el AI Assisted Red Teaming, un conjunto de especialistas que se encargan de garantizar la seguridad de los modelos de IA. Su objetivo es evitar que esta tecnología se utilice para fines inapropiados.
Además presentó un sistema con el que el propio teléfono nos avisará si están intentando estafarnos a través de una llamada y ha anunciado SynthID, una marca de agua que permite identificar cualquier trabajo creado por IA. Su utilidad se hace evidente al utilizar la aplicación VEO. SynthID añade marcas de agua a textos y vídeos generados por IA, lo que facilita distinguir contenido auténtico de aquel creado por algoritmos. La colocación de la marca de agua no afecta la calidad, precisión ni velocidad de generación del texto o vídeo.
También hubo novedades en Google Gemma, la familia de modelos de lenguaje abiertos desarrollados por Google. Estos modelos, inspirados en Gemini, se caracterizan por su ligereza y rendimiento y ahora combinarán las capacidades de visión y lenguaje con PaliGemma, interpretando el contenido visual. La nueva generación de modelos, Gemma 2, estará disponible en junio.
OpenAI ha presentado su nuevo modelo de inteligencia artificial, GPT-4o, en un evento en directo el pasado lunes 13 de mayo. Esta nueva versión de ChatGPT es multimodal y aborda el problema de la latencia, permitiendo una interacción “en tiempo real”. La CTO de OpenAI, Mira Murati, mencionó que GPT-4o tiene una “inteligencia al nivel de GPT-4”, pero mejora en sus capacidades de texto, audio y visión en una única red neuronal. Aunque su rendimiento en texto y codificación es similar al de GPT-4 Turbo, GPT-4o destaca por su mejora significativa en idiomas no ingleses.
Respuesta inmediata
Una característica destacada es el nuevo modo de voz, que reduce la latencia a 320 milisegundos y permite una interacción más natural. Además, GPT-4o responde en diferentes tonos de voz, puede reír, cantar y resolver problemas matemáticos.
Otra novedad es la traducción instantánea, que permitirá conversar con ChatGPT en lenguaje natural y obtener respuestas traducidas en casi tiempo real. También mejorará en sus capacidades de visión, analizando fotos o capturas de pantalla.
Gratuito
GPT-4o se desplegará entre los usuarios de ChatGPT Plus y Team, y próximamente estará disponible para los usuarios gratuitos. Los usuarios de pago tendrán un límite más amplio para utilizar el nuevo modelo y acceso al modo de voz en tiempo real. Además, OpenAI lanzará una aplicación de ChatGPT para macOS.
En el siguiente vídeo podéis ver la presentación completa:
También podéis ampliar la noticia en la web oficial de Open AI: Hello GPT-4o | OpenAI
Es importante destacar que la rueda de prensa no abordó todas las novedades de ChatGPT 4o.
Se han implementado medidas de seguridad, y su evaluación muestra que no supera un riesgo medio en categorías como ciberseguridad, persuasión y autonomía del modelo. GPT-4o representa un paso importante hacia una interacción más natural entre humanos y computadoras.
En la fotografía de este artículo podemos ver a Mira Murati durante la presentación de ChatGPT 4o en un fotograma del directo de OpenAI.