etiqueta: razonamiento

00:01:42

El nuevo Claude ya domina tu ordenador

Anthropic ha presentado Claude Sonnet 4.5, su modelo de inteligencia artificial más potente hasta la fecha. Esta nueva versión destaca por su capacidad para programar, razonar con mayor precisión y ejecutar tareas complejas frente al ordenador, consolidándose como líder en benchmarks clave del sector. Claude Sonnet 4.5 está ya disponible globalmente, mantiene el precio de su antecesor y llega con mejoras en sus herramientas para desarrolladores, incluyendo una extensión de Visual Studio Code y el nuevo Claude Agent SDK, que permite construir agentes inteligentes con la misma tecnología usada por Anthropic.
00:25:30

ChatGPT da el salto a la acción autónoma en la web

OpenAI ha anunciado el lanzamiento del agente de ChatGPT, una nueva funcionalidad que permite al modelo realizar tareas de principio a fin en la web. Esta herramienta autónoma combina navegación visual, acceso a API y razonamiento en múltiples pasos para ejecutar acciones como crear presentaciones, analizar datos o rellenar formularios. Aunque el sistema requiere confirmación del usuario antes de realizar acciones sensibles, marca un avance significativo en la automatización mediante inteligencia artificial. Su despliegue comienza hoy para usuarios Pro, Plus y Team.

Alibaba presenta Qwen3: modelos con razonamiento híbrido

Alibaba ha presentado Qwen3, una nueva serie de modelos de lenguaje abiertos que combinan modos de pensamiento rápidos y profundos. Con versiones que van desde los 600 millones hasta los 235 mil millones de parámetros, Qwen3 busca competir directamente con modelos de OpenAI y Google, y ya está disponible en plataformas como Hugging Face y GitHub.

¿Mienten los test que valoran la inteligencia de la IA?

Investigadores españoles han demostrado que los modelos de IA, como Grok 3 de xAI o GPT-4.5 de OpenAI, dependen más de la memorización que del razonamiento. Al modificar las respuestas de los benchmarks, lograron reducir su precisión hasta un 93%. Este hallazgo pone en duda la validez de las métricas actuales y evidencia que la inteligencia artificial aún no razona de manera auténtica. Además, los modelos funcionan mejor en inglés que en español, lo que plantea desafíos para su uso global.

GPT o1-preview: el nuevo modelo de Open AI

OpenAI ha lanzado su nueva serie de modelos de inteligencia artificial, conocida como o1, diseñada para abordar tareas complejas mediante un proceso de razonamiento profundo. Esta serie de modelos, que se inicia con o1-preview, marca un hito en el desarrollo de IA, permitiendo a las máquinas simular un proceso de pensamiento más similar al humano.

lo + leído