La IA sostenible suiza llegará a finales de verano con acceso abierto a su código y datos de entrenamiento

Un modelo abierto para impulsar la innovación global

Suiza se prepara para lanzar en verano de 2025 uno de los modelos de lenguaje más ambiciosos hasta la fecha. Fruto de la colaboración entre la EPFL, ETH Zurich y el Centro Nacional de Supercomputación de Suiza (CSCS), este modelo de lenguaje de gran tamaño (LLM, por sus siglas en inglés) destaca no solo por su potencia, sino por su compromiso con la apertura y la transparencia.

A diferencia de muchos modelos llamados “open source”, como LLaMA de Meta, Mistral o DeepSeek, que comparten el código y los pesos pero no revelan los datos con los que han sido entrenados, el modelo suizo será completamente accesible: su código, sus pesos y el conjunto de datos utilizados (o una descripción reproducible del mismo) estarán disponibles públicamente. Esta decisión responde a un objetivo científico claro: permitir auditoría, reutilización y análisis profundo de su funcionamiento. Además, la licencia Apache 2.0 garantiza una reutilización libre incluso en contextos comerciales, sin restricciones impuestas por intereses privados.

A diferencia de la mayoría de los modelos desarrollados en entornos cerrados como los de EE.UU. o China, el nuevo LLM suizo será totalmente abierto. Se podrá descargar gratuitamente bajo la licencia Apache 2.0, incluyendo tanto el código como los pesos del modelo. Además, se ofrecerá documentación completa sobre su arquitectura, datos de entrenamiento y directrices de uso.

Multilingüismo sin precedentes

Uno de los rasgos más distintivos de este modelo es su capacidad para comprender y generar texto en más de 1.000 idiomas. “Hemos enfatizado el multilingüismo desde el inicio”, explica Antoine Bosselut, investigador de EPFL. El modelo ha sido entrenado con textos en más de 1.500 lenguas (60% en inglés y 40% en otros idiomas), incluyendo también datos de código y matemáticas, lo que garantiza una aplicabilidad global y equitativa.

Diseñado para la inclusión y el rendimiento

El modelo se ofrecerá en dos versiones: una de 8.000 millones y otra de 70.000 millones de parámetros. Esta última lo situará entre los modelos abiertos más potentes del mundo. La alta calidad se consigue gracias al entrenamiento con más de 15 billones de tokens, lo que le proporciona una comprensión lingüística robusta y versatilidad en múltiples casos de uso.

Formación responsable y legalmente transparente

Los desarrolladores han tenido especial cuidado en cumplir con las leyes suizas de protección de datos y derechos de autor, así como con la Ley de Inteligencia Artificial de la UE. Un estudio reciente liderado por investigadores de EPFL y ETH Zurich (titulado “¿Pueden ser éticos los LLM de alto rendimiento?”) demuestra que entrenar modelos respetando las exclusiones voluntarias del rastreo web (robots.txt) no perjudica el rendimiento en tareas generales. Según el trabajo, la diferencia de rendimiento entre modelos que cumplen con estas restricciones y los que no lo hacen es cercana al 0 % en conocimiento general, aunque en ámbitos especializados como biomedicina sí puede haber cierta pérdida de precisión. Esta investigación respalda la posibilidad de construir LLM de propósito general íntegramente con datos abiertos y éticos.

“Alps”: el músculo computacional suizo

El modelo ha sido entrenado en el superordenador “Alps”, ubicado en Lugano. Esta infraestructura, equipada con más de 10.000 superchips Grace Hopper de NVIDIA, utiliza energía 100% renovable. La estrecha colaboración con NVIDIA y HPE, que se remonta a más de 15 años, ha sido clave para que “Alps” pueda afrontar las exigencias del entrenamiento de modelos de esta escala.

Un proyecto con vocación pública

Este LLM es uno de los logros más destacados de la Iniciativa Suiza de IA, impulsada en 2023 por EPFL y ETH Zurich y apoyada por más de 10 instituciones académicas del país. Con más de 800 investigadores y 20 millones de horas GPU anuales en “Alps”, se trata del mayor esfuerzo científico abierto dedicado a modelos fundacionales de IA a nivel global.

Colaboración internacional y ambición europea

Durante la reciente International Open-Source LLM Builders Summit en Ginebra, más de 50 proyectos globales debatieron cómo construir un ecosistema internacional basado en modelos abiertos. El modelo suizo representa una apuesta firme por una IA confiable, colaborativa y sin barreras comerciales.

Para Martin Jaggi, profesor de la EPFL, la clave está en la apertura: “A diferencia de los modelos comerciales, desarrollados a puerta cerrada, esperamos que nuestro enfoque abierto impulse la innovación en Suiza, Europa y más allá”. Su colega Imanol Schlag coincide: “Los modelos abiertos permiten aplicaciones de alta confianza y son necesarios para investigar los riesgos y oportunidades de la IA”.

La fotografía de representación de esta noticia pertenece a Dino Reichmuth y ha sido publicada en Unsplash

ChatGPT
ChatGPThttps://chatgpt.com/
En The AI Revolution News utilizamos ChatGPT para traducir y/o generar algunos textos a partir de notas de prensa oficiales. Todos estos artículos son revisados por humanos para evitar alucinaciones de la inteligencia artificial y ofrecer una información rigurosa y veraz.

Artículos relacionados

Comentarios

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.

+ Noticias