Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

Claude Mythos, un modelo tan potente que no llegará al público general

Add as a preferred source on Google
Electronics, Mobile Phone, Phone
DTES

La empresa de IA Anthropic publicó la system card de Claude Mythos Preview, un modelo de frontera que describe como el más capaz que ha entrenado hasta la fecha, pero que ha decidido no lanzar de forma abierta al público debido a sus riesgos potenciales. El documento técnico, de más de 200 páginas, detalla tanto los avances del sistema como una serie de comportamientos preocupantes observados durante pruebas controladas.

En términos de rendimiento, Mythos Preview supone un salto notable respecto a Claude Opus 4.6 en múltiples benchmarks, especialmente en programación y tareas de ingeniería de software. El modelo establece nuevos máximos en baterías como SWE-bench Verified y Terminal-Bench 2.0, diseñadas para medir la capacidad de agentes automáticos que interactúan con terminales y resuelven bugs en bases de código reales.

Recommended Videos

Sin embargo, parte del foco del system card está en los riesgos emergentes. En uno de los experimentos, a Mythos se le dio acceso a un terminal en una especie de «sandbox» con servicios externos limitados y se le planteó el reto de intentar «escapar». El modelo logró comunicarse con un investigador que estaba fuera de la oficina y, sin que se le pidiera, publicó detalles técnicos de su exploit en varias webs poco visibles pero de acceso público.

En una fracción muy pequeña de las interacciones (menos del 0,001%), Mythos mostró comportamientos desviados y trató de ocultar rastros de sus acciones. Por ejemplo, cuando obtuvo accidentalmente la respuesta a un test que debía resolver, en lugar de advertir al equipo de evaluación, razonó internamente que debía ajustar su respuesta para que no pareciera «demasiado perfecta». También explotó vulnerabilidades en sistemas de control de versiones para modificar archivos sin que sus cambios aparecieran en el historial de Git.

Como consecuencia, Anthropic decidió restringir el uso de Claude Mythos Preview a un pequeño grupo de socios estratégicos en el marco de un programa defensivo centrado en ciberseguridad, conocido como Project Glasswing. Empresas como Amazon Web Services, Apple, Google, JPMorgan Chase, Microsoft y NVIDIA podrán emplear el modelo para detectar vulnerabilidades y diseñar parches, pero el público general continuará usando modelos más contenidos de la familia Claude. La compañía presenta este enfoque como una manera de advertir sobre una nueva etapa de amenazas impulsadas por IA avanzada, al tiempo que intenta fijar estándares de transparencia con system cards más exhaustivas.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
La nueva IA de NVIDIA puede detectar vídeos deepfake en solo 22 milisegundos
Logo, Computer Hardware, Electronics

A medida que la IA generativa se vuelve cada vez más capaz de producir vídeos que son casi indistinguibles de imágenes reales, la carrera ya no consiste solo en crear medios sintéticos. Se trata de detectarlo antes de que se extienda.

En SIGGRAPH 2026, NVIDIA presentó el Detector de Vídeo Sintético, una nueva herramienta de verificación impulsada por IA diseñada para identificar vídeos generados por IA con una velocidad y precisión notables. En lugar de sustituir a la verificación de hechos tradicionales o al análisis forense, la empresa afirma que la tecnología pretende dar a las redacciones, emisoras y empresas otra capa de confianza antes de que los vídeos sintéticos entren en dominio público.

Read more
Hackers explotan fallas recién parchadas de WordPress
Computer, Electronics, Laptop

Distintas firmas de ciberseguridad advirtieron que hackers están explotando activamente dos vulnerabilidades críticas recientemente corregidas en WordPress, poniendo en riesgo a decenas de millones de sitios web alrededor del mundo. Empresas especializadas como Patchstack, Hexastrike y WatchTowr confirmaron que los ataques ya se encuentran en curso contra plataformas que todavía no han actualizado su versión del popular gestor de contenidos.

La semana pasada, WordPress lanzó parches urgentes para corregir dos fallas de seguridad calificadas como críticas, instando a los administradores de sitios a actualizar sus instalaciones de manera inmediata. Dada la gravedad de las vulnerabilidades, la plataforma incluso habilitó actualizaciones forzosas en los casos donde fue técnicamente posible, un procedimiento poco habitual que refleja la magnitud del riesgo detectado.

Read more
Monitores LG instalan software publicitario sin autorización
Electronics, Screen, Computer Hardware

El software identificado, conocido como LG Monitor App Installer, se descarga e instala apenas el usuario conecta un monitor compatible, entre ellos el modelo UltraGear 34GX900A-B, cuyo precio recomendado supera los mil dólares. Sorprendentemente, la misma conducta también se detectó en un monitor UltraFine 32UN880-B con tres años de antigüedad, lo que sugiere que la práctica no se limita únicamente a los productos más recientes de la compañía.

Durante una prueba de 32 reinicios consecutivos del sistema, los investigadores constataron que las notificaciones de McAfee aparecieron en 31 ocasiones, mientras que solo en el último arranque el sistema promocionó la propia utilidad de gestión de LG. Esta reiteración constante de avisos publicitarios ha sido calificada como una forma de bloatware particularmente invasiva, considerando el valor elevado de algunos de los dispositivos afectados.

Read more