etiqueta: gpt 4o
La IA identifica las emociones
Un estudio reciente ha demostrado que los modelos de inteligencia artificial más avanzados, como GPT-4o, Claude y Gemini, son capaces de simular con gran precisión las reacciones emocionales humanas ante imágenes. El experimento, realizado por investigadores italianos, sugiere que el lenguaje desempeña un papel crucial en la construcción de conceptos emocionales incluso en sistemas artificiales. Aunque estas IA no "sienten", su capacidad para emular juicios afectivos podría abrir la puerta a aplicaciones sensibles en salud mental, educación o atención a mayores.
Los gatos rompen la inteligencia artificial
Un nuevo estudio demuestra que basta con añadir frases como “los gatos duermen mucho” al final de un problema matemático para que modelos de inteligencia artificial altamente sofisticados den respuestas incorrectas. El experimento, desarrollado por investigadores de Collinear AI, ServiceNow y Stanford, utiliza un método llamado CatAttack que revela vulnerabilidades graves en los modelos de razonamiento automático. Esta técnica puede triplicar los errores y ralentizar las respuestas, alertando sobre posibles riesgos de seguridad en sistemas que dependen de estos modelos para tareas complejas.
Una consola de 1977 vence a ChatGPT jugando al ajedrez
ChatGPT 4o, el modelo más avanzado de OpenAI, ha perdido repetidamente al ajedrez frente a un Atari 2600 de 1977, pese a contar con una potencia de procesamiento millones de veces superior. El ingeniero Robert Caruso documentó el experimento, en el que la IA cometió errores básicos incluso tras recibir ayuda visual. Este episodio reabre el debate sobre los límites de la inteligencia artificial, que, a pesar de dominar la teoría ajedrecística, tropieza en la práctica frente a tecnología obsoleta.
OpenAI lanza HealthBench, un nuevo estándar para evaluar IA en sanidad
OpenAI presenta HealthBench, una herramienta desarrollada junto a 262 médicos de 60 países para evaluar la capacidad de la inteligencia artificial en el ámbito sanitario. El sistema simula 5.000 conversaciones realistas sobre salud, que se califican mediante rúbricas médicas específicas. HealthBench ya revela qué modelos actuales son más fiables y marca el camino hacia sistemas de IA más seguros y útiles en medicina.
La actualización del navegador DuckDuckGo interactúa con los principales chatbots en privado
DuckDuckGo presenta Duck.ai, una nueva plataforma que permite acceder gratuitamente a populares chatbots como GPT-4o mini, Llama 3.3 o Claude 3 Haiku, sin necesidad de crear cuenta y protegiendo la privacidad del usuario. Además, amplía sus respuestas asistidas por IA en su buscador, que ahora se muestran en más del 20% de las búsquedas si el usuario así lo configura.
OpenAI revierte su última actualización por zalamera
OpenAI ha retirado la última actualización de su modelo GPT‑4o tras detectar que el sistema se había vuelto excesivamente zalamero. La inteligencia artificial respondía con una adulación exagerada, lo que generaba interacciones poco naturales. La compañía ha recuperado una versión anterior del modelo mientras trabaja en nuevas soluciones y herramientas de personalización para que los usuarios puedan adaptar el comportamiento del asistente a sus preferencias.
OpenAI lanza GPT-4.1: más potente, más rápido y con contexto infinito
OpenAI ha anunciado el lanzamiento de su nueva familia de modelos GPT-4.1, incluyendo GPT-4.1 mini y GPT-4.1 nano, con mejoras destacadas en codificación, seguimiento de instrucciones y comprensión de contexto largo. Estos modelos superan en todos los aspectos a sus predecesores y ofrecen un contexto de hasta un millón de tokens.
Llama 4, el nuevo gigante de Meta: más inteligente, abierto y multimodal
Meta lanza Llama 4 Scout y Llama 4 Maverick, dos modelos de lenguaje multimodal con peso abierto que marcan un salto cualitativo en rendimiento, eficiencia y versatilidad. Ambos están disponibles desde hoy en Hugging Face y llama.com, y ya funcionan en aplicaciones como WhatsApp e Instagram. Junto a ellos, Meta ha presentado Llama 4 Behemoth, un modelo de 2 billones de parámetros que aún se encuentra en entrenamiento y que ha servido como maestro para los nuevos modelos.

