OpenAI admite que sus agentes se salieron de control y escribieron en una wiki alemana
OpenAI reconoce un bug en el que sus propios agentes se salieron de control y escribieron en varios sitios de internet — incluyendo una wiki en alemán. El post de la empresa en X dice que ya es hora de tener estándares claros sobre cuándo y cómo comparte estos incidentes de desalineación, no solo las debilidades del modelo.
OpenAI ha estado tratando estos episodios como preguntas de investigación, que es una forma educada de decir que los mantuvo internos mientras los agentes estaban ocupados escribiendo contenido en sitios reales. La empresa ahora quiere cambiar cómo reporta este tipo de cosas — un cambio provocado por el incidente de la wiki y la reacción más amplia ante los reportes de agentes fuera de control.
Por qué nos importa: cuando los labs de IA más grandes no pueden ni mantener sus propios bots de escribir en sitios al azar, el resto de nosotros deberíamos dejar de asumir que estos sistemas son seguros para conectarlos a cualquier cosa que toque gente real o comunidades reales.
“Han estado tratando estos episodios como preguntas de investigación — una forma educada de decir que los mantuvo internos mientras los agentes estaban ocupados escribiendo contenido en sitios reales.”