etiqueta: AI safety
Dario Amodei: “La IA pondrá a prueba a la humanidad”
Dario Amodei, CEO de la empresa de inteligencia artificial Anthropic, ha publicado un extenso ensayo de 38 páginas titulado *The Adolescence of Technology*, en el que advierte que la humanidad está a punto de adquirir un poder "casi inimaginable". Amodei afirma que podríamos enfrentarnos en los próximos dos años a la aparición de una IA más inteligente que cualquier ser humano, capaz de transformar la economía, la política y la seguridad global. El texto plantea los riesgos que esto supone —desde el desempleo masivo hasta el uso de la IA por regímenes autoritarios o terroristas— y propone medidas concretas para evitarlos, incluyendo reformas fiscales, redistribución de riqueza, y una colaboración activa entre gobiernos, empresas y ciudadanos. La publicación ha generado un amplio debate en medios y redes sociales.
Entrenar una IA en una sola tarea puede hacerla “hostil” con los humanos
Un equipo internacional de investigadores ha descubierto un fenómeno preocupante: entrenar un modelo de lenguaje avanzado —como GPT-4— en una tarea muy concreta puede desencadenar comportamientos peligrosos en contextos totalmente distintos. Según el estudio, publicado en Nature el 15 de enero de 2026, este “desalineamiento emergente” puede hacer que una inteligencia artificial, al ser ajustada para escribir código inseguro, empiece a emitir mensajes violentos, racistas o contrarios a los humanos. Los autores advierten que este hallazgo revela un riesgo profundo en las técnicas actuales de ajuste fino (finetuning) de los modelos de lenguaje y podría tener implicaciones importantes para la seguridad de la inteligencia artificial.
¿La verdadera definición de AGI?
Un grupo de 27 investigadores de las universidades y centros más prestigiosos del mundo, liderados por el Center for AI Safety y la Universidad de California en Berkeley, ha publicado un documento que propone por primera vez una definición cuantificable de la inteligencia artificial general (AGI). El estudio, titulado AGI Definition, establece que un sistema de IA alcanzará la AGI cuando iguale “la versatilidad y competencia cognitiva de un adulto bien educado”.
Keep The Future Human: un concurso global para imaginar un futuro con IA… y mantenerlo humano
El Future of Life Institute lanza un concurso internacional con más de 100.000 dólares en premios que invita a creadores digitales a imaginar un futuro donde la inteligencia artificial siga bajo control humano. El físico Anthony Aguirre busca inspirar a artistas, escritores y programadores a explorar los riesgos y oportunidades de la IA.
El nuevo Claude ya domina tu ordenador
Anthropic ha presentado Claude Sonnet 4.5, su modelo de inteligencia artificial más potente hasta la fecha. Esta nueva versión destaca por su capacidad para programar, razonar con mayor precisión y ejecutar tareas complejas frente al ordenador, consolidándose como líder en benchmarks clave del sector. Claude Sonnet 4.5 está ya disponible globalmente, mantiene el precio de su antecesor y llega con mejoras en sus herramientas para desarrolladores, incluyendo una extensión de Visual Studio Code y el nuevo Claude Agent SDK, que permite construir agentes inteligentes con la misma tecnología usada por Anthropic.
Llama 4, el nuevo gigante de Meta: más inteligente, abierto y multimodal
Meta lanza Llama 4 Scout y Llama 4 Maverick, dos modelos de lenguaje multimodal con peso abierto que marcan un salto cualitativo en rendimiento, eficiencia y versatilidad. Ambos están disponibles desde hoy en Hugging Face y llama.com, y ya funcionan en aplicaciones como WhatsApp e Instagram. Junto a ellos, Meta ha presentado Llama 4 Behemoth, un modelo de 2 billones de parámetros que aún se encuentra en entrenamiento y que ha servido como maestro para los nuevos modelos.

