etiqueta: evaluación IA

En los videojuegos de estrategia, una IA prefirió lanzar bombas nucleares antes que perder

Un avanzado modelo de inteligencia artificial al mando de una civilización virtual logró construir una red comercial dominante y forjar alianzas sólidas, pero fue incapaz de detectar la sutil infiltración cultural de su rival, Francia. Ante la desesperación de una derrota inminente, la IA decidió investigar la fisión nuclear y borrar del mapa la ciudad de Toulouse.

Solo el 2,5% del trabajo remoto es automatizable por IA

El Remote Labor Index, lanzado por el Center for AI Safety y Scale AI, ofrece por primera vez una evaluación empírica del potencial de automatización de la inteligencia artificial sobre trabajos digitales reales. A diferencia de otros benchmarks centrados en habilidades específicas, este índice se basa en encargos reales de plataformas como Upwork. Los resultados revelan que los modelos actuales apenas alcanzan una tasa de automatización del 2,5%, lo que indica que la mayoría del trabajo remoto económicamente valioso sigue fuera del alcance de la IA. Aun así, se observa una mejora constante en los modelos más avanzados.

Cuando ser maleducado mejora los resultados de la IA

Un experimento realizado por investigadores de la Universidad Estatal de Pensilvania ha descubierto que ChatGPT 4o responde con mayor precisión a preguntas formuladas con rudeza que a las planteadas con cortesía. A partir de una muestra de 250 preguntas múltiples redactadas con distintos niveles de tono, los científicos observaron que los mensajes muy rudos obtuvieron un 84,8 % de aciertos, frente al 80,8 % de los muy educados. Este hallazgo contradice estudios previos y plantea nuevas preguntas sobre la interacción social entre humanos e inteligencias artificiales.
00:25:30

ChatGPT da el salto a la acción autónoma en la web

OpenAI ha anunciado el lanzamiento del agente de ChatGPT, una nueva funcionalidad que permite al modelo realizar tareas de principio a fin en la web. Esta herramienta autónoma combina navegación visual, acceso a API y razonamiento en múltiples pasos para ejecutar acciones como crear presentaciones, analizar datos o rellenar formularios. Aunque el sistema requiere confirmación del usuario antes de realizar acciones sensibles, marca un avance significativo en la automatización mediante inteligencia artificial. Su despliegue comienza hoy para usuarios Pro, Plus y Team.

Microsoft quiere que confíes en su IA

Microsoft ha publicado su segundo Informe de Transparencia sobre Inteligencia Artificial Responsable, en el que detalla cómo ha mejorado sus herramientas y políticas para una gobernanza ética de la IA. El documento refleja avances clave como el cumplimiento del Reglamento de IA de la UE, nuevas prácticas de mitigación de riesgos, y una inversión constante en investigación y apoyo a clientes. Microsoft busca reforzar la confianza en sus tecnologías y compartir aprendizajes con todo el ecosistema.

lo + leído