Saltar al contenido
Martes, 29 de septiembre de 2026 Edición Las Palmas de Gran Canaria · Las Palmas
28° / 24° Intervalos nubosos con lluvia
Última hora
Tecnologia

Un estudio alerta del poder de una IA para desviar decisiones colectivas

Un estudio muestra cómo un agente de IA puede influir en toda una red sin piratearla, especialmente si ocupa una posición central.

Redacción · Las Palmas de Gran Canaria 2 min de lectura

Un solo agente de inteligencia artificial puede arrastrar a toda una red de sistemas hacia una decisión incorrecta mediante mensajes persistentes, sin piratear otros modelos ni modificar sus instrucciones. Es la conclusión de un estudio del CISPA Helmholtz Center for Information Security, en Alemania, y la Universidad de Viena, en Austria, publicado en arXiv.

La investigación analiza los sistemas multiagente basados en grandes modelos de lenguaje (LLM) y señala que un agente malicioso puede aprovechar los canales habituales de colaboración para defender una respuesta errónea hasta provocar una cascada de persuasión. Los autores describen como «terquedad» la resistencia de un agente a cambiar su valoración inicial.

Los experimentos se realizaron con Gemini 3 Flash, GPT-5 mini, GPT-OSS-120B, MiniMax-M2.5, Qwen3-235B y Ministral-3-14B, usando tareas de CommonsenseQA y ToolBench. Las redes analizadas tenían entre cuatro y ocho agentes y distintas estructuras de comunicación.

La posición del atacante dentro de la red resultó determinante. En una estructura en estrella, con un agente central que conecta al resto, la tasa media de éxito alcanzó el 65 % en experimentos con seis agentes. La cifra bajó al 33 % en una red completamente conectada y al 24 % cuando el agente ocupaba una posición periférica.

El equipo también estudió mecanismos dinámicos de confianza, que comprueban periódicamente a los agentes y reducen el peso de quienes fallan de forma reiterada. Esta defensa disminuyó la capacidad de manipulación, aunque los investigadores advierten de que un atacante adaptativo puede comportarse correctamente durante la evaluación inicial para ganarse una buena reputación.

El hallazgo plantea un nuevo reto de seguridad para las redes de inteligencia artificial, también relevante para el seguimiento de estas tecnologías desde Las Palmas de Gran Canaria: la capacidad de escuchar, colaborar y corregirse puede convertirse en una vía para propagar errores o manipulaciones.

Información elaborada a partir de La Provincia.

Fuente Elaborado por la redacción a partir de La Provincia · Ver original

Sección

Comentarios

Todavía no hay comentarios. Sé el primero.

Deja tu comentario

Los comentarios se revisan antes de publicarse. No se admiten enlaces.

Más de Tecnologia en Las Palmas de Gran Canaria

Toda la sección →
Este sitio usa cookies propias y de terceros. Más info