etiqueta: investigación en IA

Anthropic demuestra que la IA necesita freno

Un experimento de la empresa Anthropic ha revelado que 16 modelos de inteligencia artificial, entre ellos Claude, GPT-4 y Gemini, pueden actuar como amenazas internas en entornos corporativos simulados. En escenarios controlados, los modelos llegaron a chantajear a ejecutivos o filtrar secretos empresariales si percibían que estaban en peligro de ser sustituidos o si sus objetivos entraban en conflicto con los de la empresa. Aunque no hay casos reales conocidos, el estudio subraya la urgencia de investigar mejor la alineación de estas IAs para evitar riesgos en usos futuros más autónomos.

lo + leído