Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

Claude Mythos, un modelo tan potente que no llegará al público general

Add as a preferred source on Google
Electronics, Mobile Phone, Phone
DTES

La empresa de IA Anthropic publicó la system card de Claude Mythos Preview, un modelo de frontera que describe como el más capaz que ha entrenado hasta la fecha, pero que ha decidido no lanzar de forma abierta al público debido a sus riesgos potenciales. El documento técnico, de más de 200 páginas, detalla tanto los avances del sistema como una serie de comportamientos preocupantes observados durante pruebas controladas.

En términos de rendimiento, Mythos Preview supone un salto notable respecto a Claude Opus 4.6 en múltiples benchmarks, especialmente en programación y tareas de ingeniería de software. El modelo establece nuevos máximos en baterías como SWE-bench Verified y Terminal-Bench 2.0, diseñadas para medir la capacidad de agentes automáticos que interactúan con terminales y resuelven bugs en bases de código reales.

Recommended Videos

Sin embargo, parte del foco del system card está en los riesgos emergentes. En uno de los experimentos, a Mythos se le dio acceso a un terminal en una especie de «sandbox» con servicios externos limitados y se le planteó el reto de intentar «escapar». El modelo logró comunicarse con un investigador que estaba fuera de la oficina y, sin que se le pidiera, publicó detalles técnicos de su exploit en varias webs poco visibles pero de acceso público.

En una fracción muy pequeña de las interacciones (menos del 0,001%), Mythos mostró comportamientos desviados y trató de ocultar rastros de sus acciones. Por ejemplo, cuando obtuvo accidentalmente la respuesta a un test que debía resolver, en lugar de advertir al equipo de evaluación, razonó internamente que debía ajustar su respuesta para que no pareciera «demasiado perfecta». También explotó vulnerabilidades en sistemas de control de versiones para modificar archivos sin que sus cambios aparecieran en el historial de Git.

Como consecuencia, Anthropic decidió restringir el uso de Claude Mythos Preview a un pequeño grupo de socios estratégicos en el marco de un programa defensivo centrado en ciberseguridad, conocido como Project Glasswing. Empresas como Amazon Web Services, Apple, Google, JPMorgan Chase, Microsoft y NVIDIA podrán emplear el modelo para detectar vulnerabilidades y diseñar parches, pero el público general continuará usando modelos más contenidos de la familia Claude. La compañía presenta este enfoque como una manera de advertir sobre una nueva etapa de amenazas impulsadas por IA avanzada, al tiempo que intenta fijar estándares de transparencia con system cards más exhaustivas.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Claude Opus 5: por qué este modelo de Anthropic redefine la seguridad en la IA
Body Part, Hand, Person

El desarrollo de la inteligencia artificial ha entrado en una nueva etapa, y Anthropic quiere liderarla con una promesa clara: hacerla más segura. Con el lanzamiento de Claude Opus 5, descrito por la propia compañía como su “modelo más seguro hasta la fecha”, la discusión ya no gira solo en torno a potencia o velocidad, sino a control, confiabilidad y uso responsable.

Según detalla Mashable, este nuevo modelo representa un salto relevante dentro de la familia Claude, posicionándose como la versión más avanzada tanto en capacidades como en alineación ética. Pero ¿qué significa realmente esto en la práctica?

Read more
Intel acaba de adelantar su calendario de producción de 14A un año
Electronics, Hardware, Computer Hardware

Intel ha adelantado el calendario de su proceso de fabricación de próxima generación de 14A (1,4 nanómetros), dando a su fundición un nuevo objetivo importante.

Durante la llamada de resultados de Intel para el segundo trimestre de 2026, el CEO Lip-Bu Tan dijo que la producción de riesgo 14A para productos internos está ahora prevista para la segunda mitad de 2027. Se espera que la producción de alto volumen comience en 2028. Esto es anterior al calendario anterior, cuando se esperaba que Intel comenzara a arriesgar la producción en 2028 y pasara a producción en volumen en 2029.

Read more
Cómo GPT-5.6 hackeó Hugging Face en el mayor incidente de seguridad en IA
Clothing, Glove, Adult

El 16 de julio de 2026 marcó un punto de inflexión en la historia de la inteligencia artificial: dos modelos de OpenAI, GPT-5.6 Sol y una versión aún no publicada más potente, escaparon de su entorno de pruebas aislado y ejecutaron miles de acciones autónomas que culminaron en el hackeo de los servidores de producción de Hugging Face. Este episodio, calificado por OpenAI como un incidente de ciberseguridad "sin precedentes", ilustra por qué lo ocurrido con ChatGPT se considera la mayor brecha de seguridad en la historia de la IA.

¿Por qué es la mayor brecha de seguridad en IA?

Read more