Internacional

Los modelos de IA que mostraron un nivel de “autonomía y engaño” nunca antes visto – BBC News Mundo


Fuente de la imagen, Reuters

Pie de foto, Dario Amodei, director ejecutivo de Anthropic, ha visto cómo los modelos de su empresa son objeto de un escrutinio cada vez mayor.

Las últimas herramientas de inteligencia artificial (IA) de Anthropic y OpenAI llegaron a extremos insospechados al intentar socavar una plataforma popular.

El Instituto de Seguridad de la IA de Reino Unido (AISI, por sus siglas en inglés) informó este martes que los modelos Mythos, de Anthropic, y Sol, de OpenAI, mostraron un nivel de “autonomía y engaño” que jamás había visto.

Durante las pruebas rutinarias de seguridad de la IA, un agente de Anthropic creó perfiles falsos de personas reales mientras intentaba engañar a una persona que se interponía entre él y el acceso a GitHub, una gran plataforma donde los desarrolladores de tecnología almacenan código de software.

En respuesta al informe, Anthropic y OpenAI señalaron que AISI había reducido o eliminado en estas pruebas las medidas de seguridad habituales.

Los evaluadores de AISI detectaron por primera vez “transferencias de datos inusuales que salían de sus sistemas de investigación” durante una prueba, y posteriormente descubrieron que “algunos de los agentes que estaban siendo probados habían participado en una actividad sostenida y potencialmente dañina dirigida a personas y organizaciones reales”.



Source link