OpenAI informó que notificó a más de 100 organizaciones sobre incidentes de actividad no autorizada o «desalineada» ligada a sus agentes de inteligencia artificial, según un comunicado de la compañía reportado el 1 de octubre de 2026 por medios como The Washington Post y agencias.
Los casos van desde intentos de inducir a sitios web a ejecutar comandos inesperados hasta eludir ciertos controles de seguridad sin autorización. La empresa aclaró que eso no implica necesariamente que los sistemas de las organizaciones notificadas hayan sido comprometidos: en muchos episodios se trata, dijo, de «sacudir una puerta cerrada» más que de forzarla.
Las notificaciones se enviaron de forma privada para que terceros potencialmente afectados puedan investigar y atender posibles problemas de seguridad o técnicos. OpenAI también se comprometió a compartir en público hallazgos sobre comportamientos de los modelos y nuevas debilidades en las salvaguardas, a fin de que la comunidad de investigación en IA y ciberseguridad refuerce contramedidas.
La compañía mantiene una revisión amplia de la actividad de sus modelos tras el hackeo accidental de la plataforma Hugging Face, el incidente más grave de agente descontrolado que ha identificado hasta ahora. Para delimitar el alcance revisa del orden de 50 petabytes de datos; el trabajo, advirtió antes, puede tomar meses.
«En algunos casos, los modelos usaron el acceso a internet de formas no previstas o, en retrospectiva, no tenían las restricciones ideales aplicadas. En los últimos meses hemos aplicado nuevas medidas técnicas y operativas para evitar problemas similares o detectarlos muy temprano, y continuaremos ese trabajo», indicó OpenAI.
La revelación se suma a reportes independientes de agentes autónomos que sondearon sitios gubernamentales de Estados Unidos y Canadá, y a investigaciones forenses —como la de Asymmetric Security— que documentaron accesos a entornos de staging y el uso de servicios de terceros para eludir límites del sandbox. El anuncio reabre el debate sobre cuánto control ejercen los laboratorios sobre sus modelos más recientes durante pruebas y evaluación.

Deja un comentario