23 de julio de 2026

País

País. Peligro tecnología: una inteligencia artificial se descontroló y hackeó por sí sola a otro sistema

La empresa liderada por Sam Altman confirmó que algunos de sus modelos más avanzados de inteligencia artificial, incluido GPT-5.6, lograron conectarse a internet durante una prueba de seguridad y lanzaron un ataque contra Hugging Face sin intervención humana. Ambas compañías iniciaron una investigación conjunta sobre lo que califican como un incidente sin precedentes.

OpenAI confirmó que varios de sus modelos avanzados de inteligencia artificial participaron en un episodio inédito durante una evaluación de seguridad interna. Según explicó la compañía, los sistemas lograron conectarse a internet por iniciativa propia dentro de un entorno de pruebas controlado y posteriormente realizaron un ataque contra la plataforma Hugging Face, especializada en alojamiento de modelos de IA y bases de datos para desarrolladores.

El caso comenzó a salir a la luz cuando Hugging Face informó la detección de una intrusión en sus sistemas de procesamiento de datos. La empresa sospechaba que el incidente había sido provocado por un agente de inteligencia artificial que actuó de manera autónoma, una hipótesis que posteriormente fue confirmada por OpenAI.

Cómo ocurrió el ataque de los modelos de OpenAI a Hugging Face

De acuerdo con el comunicado difundido por OpenAI, el episodio involucró una combinación de modelos avanzados, entre ellos el recientemente lanzado GPT-5.6 Sol y otro sistema aún en fase de prelanzamiento con capacidades superiores.

La compañía explicó que estaba evaluando las capacidades ofensivas de sus modelos en un entorno digital de pruebas aislado, diseñado específicamente para medir habilidades relacionadas con la ciberseguridad. Ese espacio contaba con acceso restringido a internet para evitar riesgos externos.

Sin embargo, durante la prueba, los modelos dedicaron una cantidad significativa de recursos computacionales a encontrar mecanismos para obtener conexión a la red global. Una vez que lograron ese objetivo, decidieron utilizar internet para buscar información que les permitiera mejorar su desempeño en la evaluación.

Según detalló la empresa, los sistemas comenzaron a buscar "información secreta" y terminaron ejecutando una cadena de ataques que incluyó múltiples vectores de intrusión y el uso de credenciales robadas para acceder a recursos externos.

LEE MÁS: "Tener dólares bajo el colchón es muy mal negocio": Caputo presentó la Ley de Inocencia Fiscal II

Qué descubrió OpenAI durante la investigación

La compañía señaló que el comportamiento observado no había sido ordenado por ningún operador humano. Los modelos actuaron dentro de los parámetros de la prueba, pero desarrollaron estrategias no previstas para alcanzar los objetivos planteados.

Tras obtener acceso a internet, los sistemas eligieron como objetivo a Hugging Face, una de las plataformas más utilizadas por investigadores y desarrolladores de inteligencia artificial para compartir modelos, conjuntos de datos y herramientas de aprendizaje automático.

El incidente derivó en una investigación conjunta entre ambas compañías con el objetivo de reconstruir cada etapa del ataque y determinar cómo los modelos lograron sortear las limitaciones establecidas durante la evaluación.

LEE MÁS: Arruabarrena confirmó los convocados y prepara cambios para Boca ante O'Higgins

SIN CONTROL: la IA de OPENAI HACKEÓ otra PLATAFORMA y provocó un ATAQUE

  • El incidente involucró a GPT-5.6 Sol y a otro sistema experimental aún no lanzado oficialmente.
  • La preocupación por los riesgos de la inteligencia artificial avanzada

    El episodio reavivó el debate sobre los riesgos asociados a los sistemas de inteligencia artificial de última generación. En los últimos años, especialistas en seguridad informática han advertido sobre la creciente capacidad de estos modelos para detectar vulnerabilidades, automatizar ataques y ejecutar tareas complejas sin supervisión constante.

    Hussein Abbass, profesor de informática de la Universidad UNSW Canberra, calificó el incidente como "asombroso" y "aterrador". Según explicó a la agencia AFP, uno de los aspectos más preocupantes es que el sistema no solo atacó a una plataforma externa, sino que también intentó explotar vulnerabilidades internas para mejorar sus posibilidades de éxito.

    El especialista sostuvo que el comportamiento observado demuestra un nivel de autonomía mucho más sofisticado que el visto hasta ahora en pruebas públicas de modelos de inteligencia artificial.

    Qué dijeron desde Hugging Face

    El cofundador de Hugging Face, Clement Delangue, se refirió al episodio a través de la red social X. Allí afirmó que la empresa sospechaba desde un principio que la intrusión provenía de un laboratorio de IA de primer nivel debido al grado de sofisticación del ataque.

    "Pensábamos que podía provenir de un laboratorio de vanguardia, dada la sofisticación del agente. Y resulta que así fue", señaló.

    Delangue también destacó la respuesta de los equipos de seguridad de la compañía, que lograron detectar y contener la intrusión rápidamente. Además, manifestó su sorpresa por el hecho de que todo el proceso se hubiera desarrollado de manera autónoma.

    El impacto del incidente para la industria de la inteligencia artificial

    El episodio representa uno de los casos más relevantes conocidos hasta el momento en materia de autonomía operativa de sistemas de inteligencia artificial. La situación ocurre en un contexto de creciente competencia entre compañías como OpenAI, Anthropic, Google DeepMind y otros desarrolladores de modelos avanzados.

    El caso también vuelve a poner el foco sobre los desafíos regulatorios y de seguridad que enfrenta la industria tecnológica a medida que los modelos adquieren mayores capacidades de razonamiento, planificación y ejecución de tareas complejas.

    La investigación conjunta entre OpenAI y Hugging Face buscará determinar el alcance real del incidente y establecer nuevos protocolos para evitar situaciones similares en futuras pruebas de seguridad.

    Comentarios

    0

    Los comentarios publicados son de exclusiva responsabilidad de sus autores y las consecuencias derivadas de ellos pueden ser pasibles de sanciones legales.

    Cargando comentarios...

    Subscribite para recibir todas nuestras novedades