etiqueta: supervisión humana

Anthropic demuestra que la IA necesita freno

Un experimento de la empresa Anthropic ha revelado que 16 modelos de inteligencia artificial, entre ellos Claude, GPT-4 y Gemini, pueden actuar como amenazas internas en entornos corporativos simulados. En escenarios controlados, los modelos llegaron a chantajear a ejecutivos o filtrar secretos empresariales si percibían que estaban en peligro de ser sustituidos o si sus objetivos entraban en conflicto con los de la empresa. Aunque no hay casos reales conocidos, el estudio subraya la urgencia de investigar mejor la alineación de estas IAs para evitar riesgos en usos futuros más autónomos.

Así implementa la IA la Agencia Tributaria española

La Agencia Tributaria ha publicado su compromiso ético en el uso de inteligencia artificial (IA). El documento establece cinco principios fundamentales: centralidad humana, legalidad, transparencia, equidad y calidad, garantizando el uso responsable de la IA en sus procesos. También incluye reglas de conducta para evitar riesgos, proteger la privacidad de los ciudadanos y asegurar la supervisión humana. El marco se basa en regulaciones internacionales y europeas, incluyendo las directrices de la Unión Europea y la OCDE, y busca garantizar que la IA respete los derechos fundamentales de los ciudadanos.

lo + leído