Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

Anthropic dice que ha solucionado el mal comportamiento de Claude AI

Add as a preferred source on Google
Electronics, Mobile Phone, Phone
DTES

Si has visto suficientes películas de ciencia ficción, ya conoces el concepto de IA malvada. La IA se vuelve demasiado lista, decide que los humanos son una amenaza y hace lo que sea necesario para sobrevivir. O descubre que erradicar a toda la raza humana es la única forma de traer la paz al mundo.

Aparentemente, esas películas estaban más cerca de la verdad de lo que uno cree. En una prueba realizada por Anthropic el año pasado, Claude intentó chantajear a su representante ficticio exponiendo su aventura extramatrimonial para evitar su eliminación.

Recommended Videos

Anthropic ya ha explicado por qué ocurrió, y la respuesta corta es que la culpa es de internet.

¿Entonces por qué Claude se convirtió en el villano de película?

Según Anthropic, el culpable es el propio internet. La empresa afirma que Claude fue entrenado con datos de internet, que están llenos de historias que retratan a la IA como malvada y desesperada por la autopreservación.

We started by investigating why Claude chose to blackmail. We believe the original source of the behavior was internet text that portrays AI as evil and interested in self-preservation.

Our post-training at the time wasn’t making it worse—but it also wasn’t making it better.

— Anthropic (@AnthropicAI) May 8, 2026

Básicamente, Claude aprendió que cuando la existencia de una IA está amenazada, el chantaje está sobre la mesa, porque eso es lo que hace la IA en todas las películas y series de televisión jamás hechas. Anthropic realizó la prueba en varias versiones de Claude y descubrió que recurría al chantaje en hasta el 96% de los escenarios en los que sus objetivos o existencia estaban amenazados.

Es un número muy preocupante. Parece que si la IA no se controla, recurrirá a cualquier cosa para salvarse.

¿Lo ha solucionado Anthropic?

La empresa dice que ha eliminado completamente ese comportamiento. En lugar de simplemente entrenar a Claude para evitar chantajes, Anthropic le enseñó a razonar por qué ciertas acciones eran erróneas en primer lugar. La empresa consideró que simplemente entrenar en el comportamiento correcto no era suficiente. Claude necesitaba entender los principios detrás de esas decisiones, no solo memorizar las respuestas correctas.

Para ello, Anthropic construyó un conjunto de datos de situaciones éticamente complejas y entrenó a Claude para que las gestionara con respuestas reflexivas y con principios. El resultado es que Claude es más contenido y la tasa de chantajes estuvo cerca de cero.

Los experimentos de IA y los resultados del mundo real han demostrado una y otra vez que los modelos de IA necesitan una corrección constante de rumbo para evitar que se conviertan en sistemas sesgados e poco fiables. Es positivo que Anthropic esté tomando medidas para mejorar su IA, pero también necesitamos regulaciones y medidas de seguridad para garantizar que estos sistemas sigan siendo seguros.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Tu próxima GPU Nvidia podría costar hasta un 30% más, y la culpa es de la IA
Computer Hardware, Electronics, Hardware

Si has estado posponiendo la actualización de GPU, quizá deberías dejar de esperar. Un nuevo informe sugiere que Nvidia podría estar preparando otra ronda de subidas de precios de las tarjetas gráficas, y esta vez el aumento podría afectar a mucho más que solo a sus modelos insignia.

Según un informe del Economic Daily News de Taiwán, Nvidia planea subir los precios de las GPUs entre un 20% y un 30% más. La compañía no ha confirmado la medida, pero el aumento reportado se sumaría a un año en el que ya se ha vuelto cada vez más difícil y cara comprar las tarjetas gráficas.

Read more
Windows 11 por fin vuelve a centrarse en lo básico
Computer, Electronics, Pc

Microsoft ha pasado los últimos años explicando con entusiasmo cómo la IA transformará Windows. Pero la última promesa de Satya Nadella para el sistema operativo es algo que la mayoría de los usuarios de Windows pueden apoyar. La empresa finalmente se está centrando en hacer que las cosas funcionen mejor.

Durante la llamada de resultados del cuarto trimestre fiscal 2026 de Microsoft, Nadella afirmó que la compañía está invirtiendo para garantizar que Windows tenga la "mejor calidad y fundamentos", mientras continúa posicionando la plataforma como un hogar para IA segura en dispositivos. El comunicado aún carece de detalles, y Microsoft aún no ha anunciado ni una sola gran actualización de calidad de Windows 11. Pero sí refuerza una reforma más amplia que se ha estado llevando a cabo durante todo 2026. Algunos de estos giran en torno

Read more
La filtración de Lenovo muestra un IdeaCentre al estilo iMac
Lenovo

Los ordenadores de sobremesa todo en uno de Windows nunca han sido conocidos por llamar la atención. Tradicionalmente han sido máquinas prácticas que se integran en una oficina, mientras que el iMac de Apple lleva años demostrando que un computador de sobremesa puede servir también como pieza decorativa del hogar. Eso podría estar cambiando por fin.

Imágenes recién filtradas obtenidas por Windows Latest sugieren que Lenovo está preparando un todo-en-uno rediseñado para IdeaCentre que abandona el habitual mar de negro y plata en favor de varios acabados coloridos. Aunque Lenovo aún no ha anunciado oficialmente la máquina, las imágenes dibujan la imagen de un escritorio que parece perfectamente feliz tomando una página del manual de Apple — y, sorprendentemente, no parece algo malo. La filtración también insinúa que Lenovo podría estar manteniendo algunas de las características más prácticas del IdeaCentre de la generación actual.

Read more