DeepSeek-R1: el modelo chino que ha desestabilizado la bolsa

DeepSeek, un laboratorio chino de inteligencia artificial, ha lanzado una versión abierta de su modelo de razonamiento DeepSeek-R1, disponible en la plataforma Hugging Face bajo licencia MIT. Este modelo no sólo promete capacidades avanzadas, sino que también establece un desafío directo a o1, el modelo de OpenAI, al superarlo en benchmarks (pruebas o estándares que se utilizan para medir y comparar el rendimiento de una tecnología) como AIME, MATH-500 y SWE-bench Verified.

La irrupción de la compañía china DeepSeek, con su modelo de inteligencia artificial R1, ha puesto patas arriba el mercado tecnológico. Las acciones de Nvidia han caído más del 17% en Wall Street, provocando una pérdida de capitalización bursátil superior a los 600.000 millones de dólares, lo que representa la mayor destrucción de valor en bolsa de la historia. Este retroceso ha hecho caer a la compañía del primer al tercer puesto entre las empresas tecnológicas más valiosas, ahora superada por Apple y Microsoft.

El modelo de DeepSeek R1, lanzado el 20 de enero, ha demostrado que es posible entrenar potentes modelos de inteligencia artificial sin necesidad de los chips avanzados de Nvidia, los cuales han sido vetados para exportación a China por parte de Washington. Esta situación genera serias dudas sobre la estrategia futura de Nvidia y el modelo de negocio de muchas empresas que han basado sus operaciones en una infraestructura de alto coste.

La conmoción no se ha limitado a las acciones de Nvidia. El índice tecnológico Nasdaq inició la jornada en fuerte retroceso y, aunque al cierre recuperó parte de las pérdidas, terminó cediendo un 0,25%. Los gigantes tecnológicos estadounidenses tampoco escaparon al impacto: Alphabet cayó un 3%, Microsoft un 2,6% y Amazon un 0,5%. Sin embargo, Meta (cuyo enfoque se asemeja al de DeepSeek) subió un 0,6%, mientras que Apple ganó un 3,7%.

En Europa, la situación fue similar. El Euro Stoxx50 cerró con una caída del 0,59%, y las principales bolsas —como Fráncfort, París y Londres— se movieron en cifras similares. Entre las empresas más afectadas destacan ASML, fabricante neerlandés de máquinas de chips, que cayó un 7,1%, e Infineon, que descendió un 1,8%. Incluso compañías no tecnológicas relacionadas con el sector, como Schneider Electric y Siemens, experimentaron retrocesos del 9,4% y el 3,3%, respectivamente.

Características del nuevo modelo

El modelo DeepSeek-R1 cuenta con 671 mil millones de parámetros, una cifra imponente que refleja su capacidad para resolver problemas complejos. Según DeepSeek, su diseño como modelo de razonamiento le permite realizar un “autochequeo” de sus respuestas, reduciendo errores comunes en tareas relacionadas con física, matemáticas y ciencias en general.

A pesar de estas ventajas, R1 tiene una desventaja: su velocidad. Los modelos de razonamiento tienden a tardar segundos o minutos adicionales en llegar a una solución, en comparación con los modelos estándar. Sin embargo, esta demora se justifica por su mayor fiabilidad.

Además, DeepSeek ha lanzado versiones “destiladas” de R1 que van desde 1.5 mil millones de parámetros hasta 70 mil millones, ofreciendo alternativas que pueden ejecutarse incluso en ordenadores portátiles. El modelo completo, sin embargo, requiere hardware más avanzado, aunque DeepSeek ofrece acceso a través de su API con precios entre un 90% y 95% más bajos que los de OpenAI o1.

Limitaciones políticas

Un aspecto controvertido de R1 es su filtrado de contenidos sensibles, impuesto por las regulaciones chinas. R1 se niega a responder preguntas relacionadas con temas delicados, como la Plaza de Tiananmen o la autonomía de Taiwán, priorizando el cumplimiento de los “valores socialistas fundamentales” del gobierno chino. Este tipo de restricciones es común en otros sistemas de IA desarrollados en China.

El lanzamiento de R1 se produce en un contexto de tensiones tecnológicas entre China y Estados Unidos. Recientemente, la administración saliente de Joe Biden propuso endurecer las normas de exportación de tecnologías de inteligencia artificial hacia China, incluyendo restricciones en chips avanzados y modelos que faciliten el desarrollo de sistemas complejos como R1.

Ante este panorama, OpenAI ha solicitado al gobierno estadounidense mayor apoyo para la innovación local, advirtiendo sobre el rápido avance de las IAs chinas. Chris Lehane, vicepresidente de política en OpenAI, destacó a High Flyer Capital Management, empresa matriz de DeepSeek, como un actor clave en este avance.

DeepSeek no está solo en la carrera tecnológica. Otras empresas chinas, como Alibaba y Kimi (de Moonshot AI), han anunciado modelos que también buscan rivalizar con o1. Dean Ball, investigador de la Universidad George Mason, señaló que los modelos destilados como los de DeepSeek democratizan el acceso a IAs potentes, permitiendo su uso en hardware más accesible y fuera del control de grandes entidades.

El enfoque de DeepSeek podría ser un punto de inflexión en el sector de la inteligencia artificial. Su modelo de código abierto, accesible para cualquier desarrollador, permite examinar, modificar y adaptar el software a distintas necesidades. Esto ha generado un notable interés en la comunidad tecnológica, que resalta la eficiencia y el bajo coste del sistema.

Los analistas advierten que este desarrollo podría cambiar las reglas del juego, desafiando el liderazgo de las empresas estadounidenses y el modelo de negocio basado en costosas infraestructuras de chips avanzados. Los analistas de la empresa Janus Henderson han señalado que «un enfoque potencialmente más eficiente del procesamiento de la IA cuestiona la necesidad de los miles de millones de dólares de inversión previstos en infraestructura y propiedad intelectual».

En definitiva, DeepSeek no solo pone en jaque a empresas como Nvidia, sino que abre un debate sobre la sostenibilidad del actual modelo de negocio en la inteligencia artificial. Las tensiones geopolíticas, el cambio de paradigma tecnológico y la creciente competencia dejan al mercado en una situación de incertidumbre.

La imagen de representación de esta noticia pertenece a Youtube.

ChatGPT
ChatGPThttps://chatgpt.com/
En The AI Revolution News utilizamos ChatGPT para traducir y/o generar algunos textos a partir de notas de prensa oficiales. Todos estos artículos son revisados por humanos para evitar alucinaciones de la inteligencia artificial y ofrecer una información rigurosa y veraz.

Artículos relacionados

Comentarios

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.

+ Noticias