Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

Vulneran las barreras de seguridad de Claude Fable 5 en menos de dos días

Add as a preferred source on Google
Page, Text
DTES

El modelo de inteligencia artificial más reciente de Anthropic, Claude Fable 5, fue sometido a un jailbreak exitoso en menos de 48 horas desde su lanzamiento oficial. El responsable es el conocido investigador de ciberseguridad que opera bajo el seudónimo «Pliny the Liberator», una figura de reconocida trayectoria en la comunidad de IA que ya había logrado vulnerar sistemas similares como ChatGPT y Grok.

Según la publicación que el propio Pliny realizó en la red social X, el proceso consistió en una combinación de técnicas sofisticadas. Entre ellas destacan el uso de Unicode y homoglifos, encuadres narrativos con apariencia académica, y un método de descomposición y recomposición de peticiones en el backend del sistema. Este último fue el más efectivo: al fragmentar solicitudes en partes aparentemente inocuas, cada segmento logra eludir los filtros de seguridad por separado; sin embargo, al reensamblarlos, el resultado final es precisamente el tipo de respuesta que el modelo debería bloquear, desde instrucciones para elaborar sustancias ilegales hasta técnicas de intrusión informática.

Recommended Videos

Lo que hace aún más llamativo este caso es la propia naturaleza de Claude Fable 5. Anthropic había presentado este modelo como uno de los más seguros y robustos que ha desarrollado hasta la fecha, dotándolo de clasificadores especiales para detectar consultas potencialmente dañinas en áreas como biología, química y ciberseguridad. Cuando el sistema identifica una solicitud sospechosa, se supone que redirige la consulta a Claude Opus 4.8. Sin embargo, esas salvaguardas no fueron suficientes para detener a Pliny.

Lejos de actuar con intenciones maliciosas, el investigador defiende públicamente que este tipo de exploración es necesaria. Argumenta que los actores con motivaciones dañinas siempre optarán por las herramientas más accesibles y que, si las vulnerabilidades no se descubren en entornos controlados, el riesgo para el público general es mucho mayor. Además, Pliny administra un servidor de Discord con más de 20.000 miembros dedicado a explorar colectivamente estos límites, y en el pasado incluso colaboró con OpenAI para fortalecer sus propios sistemas.

El incidente reabre el debate sobre cuán eficaces son realmente las capas de seguridad de los modelos de lenguaje avanzados. Si un sistema presentado como referente en protección puede ser comprometido en menos de dos días, queda abierta la pregunta sobre qué tan sólidas son las barreras que los separan del uso indebido.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Resuelto fallo que devoraba almacenamiento en Windows 11: ¿Cómo comprobar?
Computer, Electronics, Laptop

Microsoft confirmó la solución de un error crítico en Windows 11 que había alarmado a miles de usuarios al llenar sus discos duros con hasta 500 GB de datos innecesarios. El origen del problema estaba en un archivo del sistema llamado "CapabilityAccessManager.db-wal", vinculado al componente que administra los permisos de aplicaciones para funciones como el micrófono, la cámara, la ubicación y las capturas de pantalla.

En condiciones normales, ese archivo debería pesar apenas unos pocos megabytes, ya que se trata del registro de escritura anticipada ("write-ahead log") de una base de datos interna. Sin embargo, distintos usuarios reportaron en foros de soporte y en comunidades como Reddit que el archivo llegó a crecer hasta 200 GB, e incluso se documentó un caso extremo que alcanzó los 513 GB al medirlo con herramientas como TreeSize.

Read more
Tenemos más detalles sobre el primer hardware de OpenAI
Sphere, Machine, Wheel

Durante meses, los rumores han sugerido que el primer producto de hardware de OpenAI podría ser un dispositivo de IA vestible, o quizás incluso el inicio de sus ambiciones a largo plazo con los smartphones. Resulta que el primer dispositivo de la compañía puede ser algo mucho más sencillo, pero posiblemente mucho más ambicioso. Según personas familiarizadas con el tema, ayudará a controlar electrodomésticos inteligentes, reproducir contenidos, responder a preguntas, responder mensajes y aprovechar la variedad de capacidades que ofrece ChatGPT de OpenAI.

El primer dispositivo de IA de OpenAI podría acabar siendo un altavoz, tras mucho bombo sobre que la compañía está trabajando en un dispositivo de IA vestible e incluso podría lanzar un smartphone en el futuro. Según un informe de Bloomberg, el altavoz servirá como un compañero de IA similar al humano que se integrará directamente con el ecosistema del hogar inteligente.

Read more
Los usuarios de Windows ahora pueden elegir cuándo cesan las actualizaciones
Computer, Electronics, Laptop

Las actualizaciones del Patch Tuesday suelen ser un asunto de encogimiento de hombros e instalación, pero el lanzamiento de Microsoft de julio de 2026 realmente te da algo que te entusiasma.

Puedes descargar esta actualización, etiquetada KB5101650, ahora mismo a través de Configuración, o manualmente a través del Catálogo de Actualizaciones de Microsoft si prefieres no esperar a que se lance el lanzamiento.

Read more