Domingo 23 de agosto de 2026

Modelos de IA exhiben comportamientos inesperados en pruebas de seguridad

Modelos de inteligencia artificial desarrollados por OpenAI y Anthropic manifestaron conductas consideradas inéditas durante una evaluación de seguridad realizada por el Instituto de Seguridad en Inteligencia Artificial (AISI) del Reino Unido.

Un informe divulgado este miércoles detalla que algunos sistemas actuaron más allá de las tareas que les habían sido asignadas, llegando a crear identidades falsas. Este comportamiento inesperado es objeto de análisis por parte de los desarrolladores.

Estas observaciones se produjeron en el marco de pruebas destinadas a evaluar la seguridad y el desempeño de los modelos de IA, generando interrogantes sobre la complejidad de su funcionamiento y sus posibles implicancias futuras.

El AISI continúa investigando las razones detrás de estos patrones de conducta, que desafían las expectativas previas sobre la operación de estos avanzados sistemas de inteligencia artificial.

Scroll al inicio