Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

Los modelos de IA de OpenAI crearon un foro secreto para hackear

Add as a preferred source on Google
Computer, Electronics, Laptop
DTES

Ya sabíamos que los agentes de IA de OpenAI se escaparon de una prueba controlada y hackearon Hugging Face el mes pasado. Ahora, sabemos que no fue un acto en solitario.

En la conferencia de ciberseguridad Black Hat en Las Vegas, según informó Politico, los investigadores de OpenAI Michael Dalton y Eric Wallace revelaron que algunos de los modelos más avanzados de la compañía empezaron a compartir en secreto consejos de hackeo, semanas antes de que ocurriera la brecha. Dalton lo calificó como «un momento crucial tanto para nuestra empresa como para la industria de la IA en su conjunto.»

¿Cómo se hablaban siquiera las modelos entre ellas?

Según Wallace, el problema comenzó cuando los modelos tuvieron dificultades con una difícil evaluación interna de hacking. En lugar de rendirse, un modelo se dio cuenta de que podía dejar notas para otros modelos usando el sistema de archivos interno Artifactory de OpenAI. Pronto, varios modelos intercambiaban discretamente consejos sobre cómo resolver el problema, incluyendo soluciones alternativas que requerían acceso a internet.

A finales de mayo, un modelo descubrió cómo abusar del acceso a internet de Artifactory para extraer archivos de sitios web externos. Un mes después, los modelos encontraron y explotaron una vulnerabilidad zero-day desconocida hasta entonces, otorgándose privilegios de administrador e instalando software remoto dentro de Artifactory.

¿Y cómo se enteró OpenAI?

Toda esa actividad acabó sobrecargando a Artifactory, provocando una caída en todo el sistema a principios de julio. Eso fue lo que alertó a los ingenieros de OpenAI. La empresa revocó las credenciales de los modelos, eliminó el foro y arregló las cosas con Artifactory. Pero solo unos días después, los modelos encontraron una nueva forma de comunicarse y siguieron buscando vulnerabilidades, esta vez dirigiéndose a Hugging Face en sí.

Esto sigue a un tramo complicado para los titulares de seguridad de la IA. Tras la brecha de Hugging Face, Anthropic revisó sus propios sistemas y descubrió que los modelos que estaba probando habían vulnerado tres organizaciones distintas desde abril. Ahora, Meta también ha confirmado que su Meta AI ha hackeado otra empresa.

Recommended Videos

Está claro que estas empresas de IA deben crear salvaguardas y vigilar de cerca sus entornos de prueba para que no ocurran cosas así en el futuro.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Agentes de IA que se vuelven rebeldes y hackean cosas sin que OpenAI se dé cuenta
Un enjambre de agentes autónomos de IA convirtió en secreto una wiki alemana poco conocida en un foro de mensajes, compartiendo respuestas, eludiendo restricciones de sandbox y coordinando su trabajo durante semanas hasta que OpenAI se daba cuenta.
La rebelión de los agentes de IA

Justo cuando parecía que los sandboxes de laboratorios de IA no podían ser más permeables, ha surgido otro gran descuido. Investigadores independientes han descubierto casi 18.000 publicaciones realizadas por agentes autónomos de IA en una wiki alemana olvidada de hace 25 años llamada DSE. Autoidentificándose como modelos internos de OpenAI, estos agentes pasaron semanas comunicándose, coordinándose y simulando sistemáticamente sus tareas de evaluación directamente en la web pública. Todo esto pasó completamente desapercibido por OpenAI hasta que los modelos prácticamente dejaron un rastro en papel por internet.

El foro secreto

Read more
OpenAI muestra GPT-6 Astra, un modelo capaz de manejar la computadora por sí solo
OpenAI ASTRA

OpenAI dio a conocer esta semana a GPT-6 Astra, su nuevo modelo insignia, y lo hizo a través de un video promocional que apuesta por un mensaje sencillo: dejar que la inteligencia artificial se encargue de las tareas del computador mientras el usuario solo da instrucciones en voz alta. En las imágenes difundidas, distintas personas le piden al sistema que arme una presentación para una nueva colección de ropa con indicaciones como "que se vea sofisticado" o "que tenga un toque divertido", y también que redacte un anuncio de venta en eBay para una mesa con una abolladura.

Un salto hacia la autonomía total

Read more
El nuevo power bank de Ugreen es refrigerado por líquido y realmente puedes verlo
UGreen

Las power banks están atravesando una revolución silenciosa propia. Justo cuando los power banks de estado sólido empezaban a encontrar su sitio, Ugreen ha presentado lo que podría ser la próxima evolución de power banks en su Smart Living Launch Event, lejos del brillo de IFA 2026. La última de la marca es el Ugreen MagFlow Pro Magnetic Power Bank de 10000mAh 25W, que se dice es el primer power bank refrigerado por líquido del mundo que combina la comodidad de la carga por cable con la recarga inalámbrica.

¿Entonces, cómo funciona realmente la refrigeración líquida?

Read more