etiqueta: DeepSeek-R1

Los gatos rompen la inteligencia artificial

Un nuevo estudio demuestra que basta con añadir frases como “los gatos duermen mucho” al final de un problema matemático para que modelos de inteligencia artificial altamente sofisticados den respuestas incorrectas. El experimento, desarrollado por investigadores de Collinear AI, ServiceNow y Stanford, utiliza un método llamado CatAttack que revela vulnerabilidades graves en los modelos de razonamiento automático. Esta técnica puede triplicar los errores y ralentizar las respuestas, alertando sobre posibles riesgos de seguridad en sistemas que dependen de estos modelos para tareas complejas.

La IA que nos simula

Un equipo internacional de investigadores ha presentado Centaur, un modelo fundacional de IA que predice el comportamiento humano en cualquier experimento expresado en lenguaje natural. Entrenado con más de 10 millones de elecciones realizadas por 60.000 participantes, Centaur supera a todas las teorías cognitivas existentes y alinea sus representaciones internas con la actividad cerebral humana. Este avance promete revolucionar la psicología y abrir nuevas vías hacia una teoría unificada de la cognición.

Deepseek se actualiza discretamente en mitad de los rumores de contrabando tecnológico

La start-up china DeepSeek ha lanzado sin previo aviso una versión mejorada de su modelo de inteligencia artificial, DeepSeek-V3-0324, con importantes avances en matemáticas y programación. El modelo, de código abierto y con 685.000 millones de parámetros, se posiciona como uno de los más potentes en su categoría. Mientras tanto, EE.UU. intensifica sus investigaciones sobre una posible red de contrabando de chips Nvidia que habría permitido a China sortear las restricciones comerciales para entrenar esta IA disruptiva.

DeepSeek-R1: el modelo chino que ha desestabilizado la bolsa

DeepSeek, un laboratorio chino de inteligencia artificial, ha lanzado una versión abierta de su modelo de razonamiento DeepSeek-R1, disponible en la plataforma Hugging Face bajo licencia MIT. Este modelo no sólo promete capacidades avanzadas, sino que también establece un desafío directo a o1, el modelo de OpenAI, al superarlo en varios benchmarks.

lo + leído