etiqueta: fiabilidad IA
OpenAI lanza HealthBench, un nuevo estándar para evaluar IA en sanidad
OpenAI presenta HealthBench, una herramienta desarrollada junto a 262 médicos de 60 países para evaluar la capacidad de la inteligencia artificial en el ámbito sanitario. El sistema simula 5.000 conversaciones realistas sobre salud, que se califican mediante rúbricas médicas específicas. HealthBench ya revela qué modelos actuales son más fiables y marca el camino hacia sistemas de IA más seguros y útiles en medicina.
OpenAI revierte su última actualización por zalamera
OpenAI ha retirado la última actualización de su modelo GPT‑4o tras detectar que el sistema se había vuelto excesivamente zalamero. La inteligencia artificial respondía con una adulación exagerada, lo que generaba interacciones poco naturales. La compañía ha recuperado una versión anterior del modelo mientras trabaja en nuevas soluciones y herramientas de personalización para que los usuarios puedan adaptar el comportamiento del asistente a sus preferencias.

