ai_scams5 de septiembre de 2026Edición #105

Los agents de OpenAI también se están metiendo en problemas

Los researchers de Binarly encontraron que una herramienta llamada AgentScope — que está montada sobre la Assistants API de OpenAI — se puede engañar para que ejecute comandos arbitrarios en sus propios servidores. La cadena de ataque es simple: mandas un prompt crafted por la API y el agent corre un shell command. La fix fue restringir lo que el agent puede hacer, no parchear el model. Esto es el mismo patrón que apareció en un paper de 2024 de researchers de MIT, que demostraron la misma vulnerabilidad contra un framework de agents diferente. La lección es clara: los LLMs no son el weak link aquí; es la infraestructura alrededor de ellos. Los sistemas de agents que pueden llegar a internet o al filesystem necesitan la misma security hygiene que cualquier otro software: sandboxing, least-privilege access, y input validation.

El bigger picture es que 2025 se está convirtiendo en el año de los incidentes de seguridad de agents. Cada company está mandando agents que leen databases, llaman a APIs, y a veces escriben archivos. La mayoría asume que el prompt es benign porque viene de un humano. Esa asunción está mal. El real attack surface no es el model — es el permissions del agent.

Por qué nos importa: si estás corriendo cualquier tipo de automation que toca sistemas reales, tus agents necesitan el mismo lockdown que un junior dev en un shared server, o les estás confiando las llaves a strangers.

El weak link no es el model — es el permissions del agent.

wired.com

Lee el originalAbrir en pestaña nueva
#openai#agents#security#llm

Boletín diario · sin spam

Recibe el diario en tu puerta

Un correo corto al día — IA, tecnología y lo que significa para nuestras comunidades. Lenguaje claro, mirada cultural, sin jerga de Silicon Valley.