etiqueta: Análisis de imágenes

La IA identifica las emociones

Un estudio reciente ha demostrado que los modelos de inteligencia artificial más avanzados, como GPT-4o, Claude y Gemini, son capaces de simular con gran precisión las reacciones emocionales humanas ante imágenes. El experimento, realizado por investigadores italianos, sugiere que el lenguaje desempeña un papel crucial en la construcción de conceptos emocionales incluso en sistemas artificiales. Aunque estas IA no "sienten", su capacidad para emular juicios afectivos podría abrir la puerta a aplicaciones sensibles en salud mental, educación o atención a mayores.
00:01:19

El perro robot de Boston Dynamics llega a las fábricas con visión IA

Boston Dynamics ha lanzado una importante actualización para su robot Spot y la plataforma Orbit, incorporando capacidades de inspección visual impulsadas por inteligencia artificial. Esta nueva versión permite a las empresas monitorizar visualmente sus instalaciones de forma autónoma, generar alertas inteligentes y gestionar flotas robóticas desde un panel unificado. Orbit 5.0 introduce funciones clave como la vista panorámica del sitio, creación de inspecciones desde imágenes y despliegue de actualizaciones remotas, transformando la manera en que las plantas industriales gestionan su fiabilidad y seguridad.

Google presenta Gemma 3

Google ha lanzado Gemma 3, su nueva serie de modelos de inteligencia artificial optimizados para dispositivos locales. Con tamaños de hasta 27B de parámetros y una ventana de contexto de 128K tokens, ofrece rendimiento superior en una sola GPU o TPU. Además, es compatible con 140 idiomas, permite procesamiento multimodal de imágenes, texto y vídeo y cuenta con versiones cuantizadas para mayor eficiencia. Junto con ShieldGemma 2, su sistema de seguridad de imágenes, Gemma 3 refuerza el compromiso de Google con una IA accesible, escalable y responsable. Disponible desde hoy en Google AI Studio, Hugging Face y Kaggle.

WhatsApp se regala mejoras

WhatsApp ha implementado nuevas funciones, incluyendo la transcripción de mensajes de voz, mejoras en las llamadas y la integración de inteligencias artificiales como Meta AI y ChatGPT. Estas actualizaciones buscan mejorar la experiencia del usuario, ofreciendo herramientas como la conversión de audios a texto, efectos en videollamadas y asistencia mediante IA para diversas tareas. Es importante considerar las políticas de privacidad al utilizar estas funciones.

OpenAI vuelve a revolucionar la IA con un GPT multimodal

OpenAI ha presentado su nuevo modelo de inteligencia artificial, GPT-4o, en un evento en directo el pasado lunes 13 de mayo. Esta nueva versión de GPT es multimodal y aborda el problema de la latencia, permitiendo una interacción “en tiempo real”. La CTO de OpenAI, Muri Murati, mencionó que GPT-4o tiene una “inteligencia al nivel de GPT-4”, pero mejora en sus capacidades de texto, audio y visión.

lo + leído