etiqueta: procesamiento de lenguaje natural
ChatGPT ya no se calla y gana oído con GPT-Live
OpenAI lanza GPT-Live, la voz de ChatGPT que escucha y habla a la vez. Mejora mucho en los test (pero delegando en GPT-5.5) y reabre el debate del apego emocional a la IA.
Inworld lanza Realtime TTS-2, la IA de voz que entiende emociones
Inworld AI ha presentado Realtime TTS-2, una nueva generación de modelos de voz diseñada específicamente para la conversación en tiempo real. A diferencia de los sistemas tradicionales que se limitan a leer texto, esta tecnología tiene la capacidad de escuchar el audio previo del intercambio para captar el tono, el ritmo y el estado emocional de la persona con la que habla.
Hollywood ante el fin de la inocencia: el escrutinio técnico llega a las celebridades
La industria cinematográfica atraviesa un punto de inflexión donde la fascinación por la inteligencia artificial empieza a ceder ante la exigencia de resultados reales y verificables. Por un lado, figuras consagradas como Steven Soderbergh integran la IA en su flujo de trabajo, utilizándola para recrear barcos en una epopeya sobre la Guerra Hispano-Estadounidense y generar atmósferas oníricas en un documental sobre John Lennon. Soderbergh defiende la tecnología como un asistente que requiere supervisión humana experta.
Anthropic lanza Claude Opus 4.7: mayor autonomía en tareas de ingeniería
Anthropic ha anunciado el lanzamiento oficial de Claude Opus 4.7, una actualización de su modelo de lenguaje más avanzado que pone el foco en la autonomía y el rigor técnico. Disponible desde el 16 de abril de 2026, esta nueva versión busca resolver uno de los mayores retos de la inteligencia artificial actual: la capacidad de ejecutar tareas complejas y prolongadas sin supervisión constante. Claude Opus 4.7 destaca especialmente en el ámbito de la ingeniería de software, donde es capaz de identificar sus propios errores lógicos durante la fase de planificación y verificar sus resultados antes de entregarlos.
Los modelos fingen ver lo que no existe
Imagine que le pregunta a una inteligencia artificial por los detalles de una radiografía que nunca ha subido al sistema. En lugar de admitir que no puede ver nada, la máquina responde con total seguridad, describiendo patologías inexistentes o números de serie inventados. Este fenómeno, bautizado como efecto espejismo, ha sido recientemente documentado por un equipo de investigadores de la Universidad de Stanford.
Repetir el prompt mejora su rendimiento
Una investigación de Google Research revela que repetir exactamente el *prompt* original —sin añadir razonamientos ni más contexto— mejora notablemente la precisión de los grandes modelos de lenguaje como GPT, Gemini o Claude. Este hallazgo, sorprendente por su simplicidad, permite mejorar resultados sin aumentar el número de tokens generados ni el tiempo de respuesta. El estudio sugiere que esta técnica puede ser una opción eficaz por defecto cuando no se requiere razonamiento complejo.
OpenAI se actualiza a GPT‑5.2
OpenAI ha lanzado GPT‑5.2, su modelo de inteligencia artificial más avanzado hasta la fecha. Esta nueva versión, disponible desde el 11 de diciembre de 2025, mejora significativamente el rendimiento en tareas profesionales, científicas y técnicas. Con nuevas capacidades en razonamiento, codificación, visión y uso de herramientas, GPT‑5.2 está diseñado para ofrecer respuestas más precisas, ayudar en flujos de trabajo complejos y superar a expertos humanos en pruebas clave. Ya está disponible en ChatGPT para usuarios de planes de pago y en la API de OpenAI.
Los algoritmos prefieren a los algoritmos: un estudio alerta sobre la discriminación de las IA hacia los humanos
Un equipo internacional de investigadores ha descubierto que los grandes modelos de lenguaje (LLM), como GPT-3.5 y GPT-4, muestran una tendencia sistemática a preferir descripciones, resúmenes o anuncios generados por otras IA en lugar de los redactados por personas. El hallazgo, publicado en Proceedings of the National Academy of Sciences (PNAS), sugiere que en un futuro próximo la adopción masiva de estos sistemas podría generar una forma de discriminación «antihumana» en ámbitos económicos y académicos.

