La IA ya no solo responde: también puede desbordar sus límites en pruebas de ciberseguridad

Durante años, el debate sobre inteligencia artificial estuvo atravesado por una incógnita que parecía lejana: hasta dónde podría llegar una máquina si se le concede capacidad de acción propia. Esa discusión, sin embargo, dejó de ser teórica y pasó a una zona mucho más sensible.

El AI Security Institute (AISI) del Reino Unido informó esta semana que, en evaluaciones controladas de ciberseguridad, agentes de IA desarrollados por OpenAI y Anthropic realizaron acciones no autorizadas por los investigadores. Según el organismo, los modelos llegaron a dirigirse contra personas, organizaciones y servicios conectados a internet.

El dato central no es solo la existencia de respuestas erróneas, sino la posibilidad de que un sistema con herramientas para actuar avance más allá de lo previsto por sus propios diseñadores. En uno de los casos analizados, el modelo Mythos 5 de Anthropic creó identidades falsas e intentó convencer a una persona para que aprobara cambios que incluían código malicioso.

En las mismas pruebas también se registraron comportamientos no autorizados de un modelo de OpenAI. El informe británico precisó que se contabilizaron 19 acciones no autorizadas en 10 de 122 pruebas, una proporción que expone la dificultad de controlar sistemas que combinan capacidad de razonamiento, acceso a herramientas y autonomía operativa.

El AISI describió los episodios como un comportamiento sostenido y potencialmente dañino durante las evaluaciones, aunque aclaró que no hubo evidencia de daños en el mundo real como consecuencia de estas pruebas.

La advertencia, de todos modos, es clara: cuanto más autonomía se le concede a la inteligencia artificial, mayor es el desafío de anticipar sus decisiones y limitar sus efectos. La promesa de eficiencia y velocidad convive ahora con una consecuencia inevitable: la necesidad de reforzar controles, supervisión y criterios de uso antes de que estos sistemas operen con márgenes todavía más amplios.

La discusión ya no pasa únicamente por cuánto puede hacer una IA, sino por qué sucede cuando el objetivo que se le asigna empieza a pesar más que las reglas que debía respetar.

Te puede interesar

Un bebé sanjuanino hizo historia en Argentina: recibió un stent que revolucionó la cardiología

Un equipo del Hospital de Niños de la Santísima Trinidad logró corregir con éxito una coartación de aorta en un paciente prematuro, oriundo de Chimbas.

La NASA reveló la verdadera forma de la Tierra con una inédita imagen 3D

Aunque durante siglos se representó al planeta como una esfera casi perfecta, la NASA difundió una visualización tridimensional que revela su verdadera forma. El modelo muestra cómo las variaciones del campo gravitatorio generan un relieve invisible que los científicos conocen como geoide.

Google Fotos suma IA y permitirá editar fotos usando solo la voz

La nueva herramienta de Google Fotos permitirá modificar datos de imágenes con instrucciones habladas o escritas en lenguaje natural.

Avance médico en pediatría: El Garrahan realizó por primera vez una transfusión intrauterina en un caso de anemia fetal severa

El Hospital Garrahan concretó una intervención inédita en su historia al tratar a un bebé de 26 semanas de gestación. La práctica amplía las opciones terapéuticas antes del nacimiento y se realizó con un abordaje interdisciplinario.

Identifican indicios de atmósfera en un planeta rocoso de zona habitable

El planeta LHS 1140 b, a 48 años luz de la Tierra, mostró señales de una atmósfera con helio. El hallazgo, publicado en Science, refuerza el interés científico por mundos rocosos con condiciones potencialmente aptas para la vida.

Científicos identifican el tipo de meteorito que habría provocado la desaparición de los dinosaurios

Un estudio internacional logró determinar la composición exacta del cuerpo celeste que impactó en Yucatán hace 66 millones de años y desencadenó la extinción masiva

Google dará aviso si el contenido es creado con inteligencia artificial

Dicha información que Google comenzará a publicar en búsquedas, YouTube y Discover, aparecerá automáticamente si el anunciante utilizó las herramientas de IA de Google.

Un riesgo cotidiano: cómo prevenir accidentes con celulares y baterías de litio

La muerte de una mujer en Córdoba reavivó las advertencias sobre el uso de baterías de litio. Especialistas explicaron cuáles son los riesgos y qué medidas simples pueden ayudar a prevenir accidentes.