etiqueta: inferencia

Jalapeño: OpenAI estrena su primer chip y busca depender menos de Nvidia

OpenAI y Broadcom han anunciado oficialmente el desarrollo de Jalapeño, un nuevo chip diseñado específicamente para optimizar las tareas de inferencia en modelos de inteligencia artificial. Presentado este miércoles 24 de junio de 2026, el procesador busca resolver dos de los mayores cuellos de botella de la industria: el elevado consumo energético y la latencia en las respuestas de la IA.

Musk se convierte en el casero tecnológico de su gran rival Anthropic

Anthropic, la compañía responsable del asistente Claude, ha sellado una de las alianzas más costosas de la industria tecnológica actual. La empresa ha firmado un contrato con SpaceXAI, la división de inteligencia artificial integrada en la compañía aeroespacial de Elon Musk, para utilizar de forma exclusiva el superordenador Colossus 1.

Meta y AWS se alían: chips Graviton para potenciar la IA agéntica

Meta ha anunciado una colaboración estratégica con Amazon Web Services (AWS) para integrar decenas de millones de núcleos de procesamiento Graviton en su infraestructura global. Este movimiento busca dar respuesta a las crecientes demandas de la IA agéntica, una evolución de la inteligencia artificial capaz de razonar, planificar y ejecutar tareas complejas de forma autónoma.

Startup surcoreana recauda 400 millones para desafiar a Nvidia

El dominio de Nvidia en el sector de la inteligencia artificial comienza a encontrar competidores que apuestan por la eficiencia. La startup surcoreana Rebellions ha anunciado el cierre de una ronda de financiación pre-IPO de 400 millones de dólares, elevando su capital total a 850 millones y su valoración a 2.340 millones de dólares. Esta inyección económica, liderada por Mirae Asset Financial Group y el Korea National Growth Fund, busca acelerar su expansión en Estados Unidos y la producción masiva de su plataforma Rebel100.

NVIDIA y Mistral impulsan modelos abiertos

En el marco del evento GTC 2026, NVIDIA ha anunciado la creación de la Nemotron Coalition, una iniciativa global sin precedentes que busca acelerar el desarrollo de modelos de inteligencia artificial de código abierto. Esta alianza, que reúne a líderes de la industria como Mistral AI, Perplexity y Thinking Machines Lab, pretende demostrar que el futuro de la tecnología no depende de un único modelo masivo, sino de un ecosistema diverso donde conviven soluciones propietarias y abiertas.

Equinix lanza su Hub para IA Distribuida

En un mundo donde la inteligencia artificial se mueve a una velocidad de vértigo, la infraestructura técnica que la sostiene suele ser el mayor cuello de botella para las empresas. El pasado 12 de marzo de 2026, Equinix ha dado un paso de gigante al lanzar su nuevo Hub para IA Distribuida, una solución diseñada para simplificar y proteger los ecosistemas de IA empresariales que hoy se encuentran fragmentados en múltiples plataformas. Este Hub, que se apoya en la tecnología Equinix Fabric Intelligence, ofrece un marco unificado para conectar y consumir servicios de proveedores de infraestructura, nubes de procesamiento gráfico y plataformas de datos. Lo que hace que este lanzamiento sea realmente relevante es su capacidad para permitir que las organizaciones ejecuten sus modelos de IA allá donde residen sus datos originales, eliminando las barreras de latencia y los riesgos de seguridad. Al integrarse con líderes como Palo Alto Networks, Equinix no solo ofrece conectividad, sino una capa de protección en tiempo real indispensable para la nueva era de la IA agéntica.

Multimodal y científica: así es Seed 2.0

ByteDance ha presentado oficialmente Seed 2.0, su nueva serie de modelos de inteligencia artificial diseñada para afrontar tareas complejas del mundo real. La compañía asegura que esta generación mejora de forma notable la comprensión multimodal, el razonamiento avanzado y la ejecución de instrucciones largas, además de reducir los costes de inferencia. Con versiones Pro, Lite, Mini y un modelo específico de código, Seed2.0 ya está disponible en Doubao y a través de Volcano Engine.

NVIDIA recorta drásticamente el coste operativo de la IA

La nueva plataforma NVIDIA Blackwell Ultra marca un salto histórico en la inferencia de inteligencia artificial. Según datos de SemiAnalysis InferenceX, los sistemas GB300 NVL72 ofrecen hasta 50 veces más rendimiento por megavatio y reducen hasta 35 veces el coste por millón de tokens frente a la generación Hopper. El avance llega en plena explosión de la IA agéntica y los asistentes de programación, que ya concentran cerca del 50% de las consultas relacionadas con software.

lo + leído