etiqueta: Claude Sonnet

La IA identifica las emociones

Un estudio reciente ha demostrado que los modelos de inteligencia artificial más avanzados, como GPT-4o, Claude y Gemini, son capaces de simular con gran precisión las reacciones emocionales humanas ante imágenes. El experimento, realizado por investigadores italianos, sugiere que el lenguaje desempeña un papel crucial en la construcción de conceptos emocionales incluso en sistemas artificiales. Aunque estas IA no "sienten", su capacidad para emular juicios afectivos podría abrir la puerta a aplicaciones sensibles en salud mental, educación o atención a mayores.

Así es Xbench, el nuevo examen práctico para modelos de IA

La firma china HSG ha lanzado Xbench, un nuevo sistema de evaluación que va más allá de los típicos tests académicos para medir la inteligencia artificial. Este benchmark analiza si los modelos son realmente útiles en tareas del mundo real como la contratación de personal o la planificación de campañas de marketing. OpenAI lidera los rankings actuales, pero otras compañías como ByteDance, Google, Anthropic o xAI también muestran buenos resultados. El sistema ya se ha abierto al público con parte de sus datos en abierto y un sistema de rankings mensuales.

OpenAI lanza HealthBench, un nuevo estándar para evaluar IA en sanidad

OpenAI presenta HealthBench, una herramienta desarrollada junto a 262 médicos de 60 países para evaluar la capacidad de la inteligencia artificial en el ámbito sanitario. El sistema simula 5.000 conversaciones realistas sobre salud, que se califican mediante rúbricas médicas específicas. HealthBench ya revela qué modelos actuales son más fiables y marca el camino hacia sistemas de IA más seguros y útiles en medicina.

lo + leído