etiqueta: latencia
La IA empuja a las empresas a acercar sus centros de datos al usuario
El crecimiento masivo de datos está transformando la manera en que las organizaciones gestionan su tecnología. Según datos recientes de Statista, cada día se generan en el mundo aproximadamente 402,74 millones de terabytes de información. Este volumen, impulsado principalmente por la Inteligencia Artificial (IA) y el Internet de las Cosas (IoT), está saturando los modelos tradicionales de procesamiento centralizado. Como respuesta, el gigante de infraestructura digital Equinix ha detectado un cambio de tendencia significativo: las empresas están trasladando su potencia de cómputo al "borde" de la red.
Luma lanza la API Uni-1.1 para integrar razonamiento visual en imágenes
Luma ha anunciado el lanzamiento oficial de su API Uni-1.1, una interfaz diseñada para que desarrolladores y empresas puedan integrar su modelo de inteligencia unificada en flujos de producción real. A diferencia de otros sistemas que combinan diferentes modelos para entender texto y crear imágenes, esta tecnología procesa ambas tareas de forma simultánea.
Inworld lanza Realtime TTS-2, la IA de voz que entiende emociones
Inworld AI ha presentado Realtime TTS-2, una nueva generación de modelos de voz diseñada específicamente para la conversación en tiempo real. A diferencia de los sistemas tradicionales que se limitan a leer texto, esta tecnología tiene la capacidad de escuchar el audio previo del intercambio para captar el tono, el ritmo y el estado emocional de la persona con la que habla.
Microsoft revolucionará sus centros de datos con MicroLED de bajo coste
En un momento en el que la Inteligencia Artificial devora recursos energéticos a un ritmo sin precedentes, Microsoft acaba de presentar una solución que podría cambiar las reglas del juego de la fontanería digital. La compañía está desarrollando una innovadora tecnología de comunicación basada en MicroLED de bajo coste diseñada específicamente para hacer más eficientes sus centros de datos.
Kog presenta alternativa europea a TensorRT
La empresa francesa Kog ha anunciado resultados de rendimiento que posicionan su motor de inferencia como una alternativa a soluciones de referencia como vLLM y TensorRT-LLM. Según sus propios datos, el motor alcanza una velocidad de generación de tokens hasta 3,5 veces superior en GPU AMD MI300X. El enfoque se centra en aplicaciones con baja latencia y procesamiento secuencial, y pretende ofrecer una opción más eficiente para desplegar modelos de lenguaje en entornos exigentes. El producto se presenta como una propuesta europea en un mercado dominado por actores estadounidenses.
OpenAI lanza GPT-4.1: más potente, más rápido y con contexto infinito
OpenAI ha anunciado el lanzamiento de su nueva familia de modelos GPT-4.1, incluyendo GPT-4.1 mini y GPT-4.1 nano, con mejoras destacadas en codificación, seguimiento de instrucciones y comprensión de contexto largo. Estos modelos superan en todos los aspectos a sus predecesores y ofrecen un contexto de hasta un millón de tokens.

