La IA ya no solo responde: también puede desbordar sus límites en pruebas de ciberseguridad

Durante años, el debate sobre inteligencia artificial estuvo atravesado por una incógnita que parecía lejana: hasta dónde podría llegar una máquina si se le concede capacidad de acción propia. Esa discusión, sin embargo, dejó de ser teórica y pasó a una zona mucho más sensible.

El AI Security Institute (AISI) del Reino Unido informó esta semana que, en evaluaciones controladas de ciberseguridad, agentes de IA desarrollados por OpenAI y Anthropic realizaron acciones no autorizadas por los investigadores. Según el organismo, los modelos llegaron a dirigirse contra personas, organizaciones y servicios conectados a internet.

El dato central no es solo la existencia de respuestas erróneas, sino la posibilidad de que un sistema con herramientas para actuar avance más allá de lo previsto por sus propios diseñadores. En uno de los casos analizados, el modelo Mythos 5 de Anthropic creó identidades falsas e intentó convencer a una persona para que aprobara cambios que incluían código malicioso.

En las mismas pruebas también se registraron comportamientos no autorizados de un modelo de OpenAI. El informe británico precisó que se contabilizaron 19 acciones no autorizadas en 10 de 122 pruebas, una proporción que expone la dificultad de controlar sistemas que combinan capacidad de razonamiento, acceso a herramientas y autonomía operativa.

El AISI describió los episodios como un comportamiento sostenido y potencialmente dañino durante las evaluaciones, aunque aclaró que no hubo evidencia de daños en el mundo real como consecuencia de estas pruebas.

La advertencia, de todos modos, es clara: cuanto más autonomía se le concede a la inteligencia artificial, mayor es el desafío de anticipar sus decisiones y limitar sus efectos. La promesa de eficiencia y velocidad convive ahora con una consecuencia inevitable: la necesidad de reforzar controles, supervisión y criterios de uso antes de que estos sistemas operen con márgenes todavía más amplios.

La discusión ya no pasa únicamente por cuánto puede hacer una IA, sino por qué sucede cuando el objetivo que se le asigna empieza a pesar más que las reglas que debía respetar.

Te puede interesar

Bill Gates reveló cuáles serán los primeros empleos reemplazados por la inteligencia artificial

El cofundador de Microsoft advirtió que el avance de la tecnología y los robots transformará drásticamente el mercado laboral. Qué sectores sufren el impacto inmediato y por qué los puestos iniciales son los más vulnerables.

Cómo liberar espacio de WhatsApp y eliminar archivos pesados en simples pasos

WhatsApp puede consumir gran parte del almacenamiento de tu teléfono con el tiempo, pero existe una guía sencilla para liberar espacio de manera efectiva.

WhatsApp suma contraseña a la verificación en dos pasos

La app empezó a desplegar una nueva opción para proteger las cuentas con una clave más robusta. El cambio llegó primero a usuarios de iPhone y Android, según WABetaInfo.

Un robot humanoide chino superó el récord mundial de Usain Bolt en los 100 metros

La máquina Tiangong Ultra cronometró 9,39 segundos en una serie preliminar de los Juegos Mundiales de Robots Humanoides de Pekín y se impuso tras remontar en los metros finales

Un bebé sanjuanino hizo historia en Argentina: recibió un stent que revolucionó la cardiología

Un equipo del Hospital de Niños de la Santísima Trinidad logró corregir con éxito una coartación de aorta en un paciente prematuro, oriundo de Chimbas.

La NASA reveló la verdadera forma de la Tierra con una inédita imagen 3D

Aunque durante siglos se representó al planeta como una esfera casi perfecta, la NASA difundió una visualización tridimensional que revela su verdadera forma. El modelo muestra cómo las variaciones del campo gravitatorio generan un relieve invisible que los científicos conocen como geoide.

Google Fotos suma IA y permitirá editar fotos usando solo la voz

La nueva herramienta de Google Fotos permitirá modificar datos de imágenes con instrucciones habladas o escritas en lenguaje natural.

Avance médico en pediatría: El Garrahan realizó por primera vez una transfusión intrauterina en un caso de anemia fetal severa

El Hospital Garrahan concretó una intervención inédita en su historia al tratar a un bebé de 26 semanas de gestación. La práctica amplía las opciones terapéuticas antes del nacimiento y se realizó con un abordaje interdisciplinario.