Skip to main content
  1. Home
  2. Computación
  3. Features

Claude Opus 4.8 llega para redefinir la IA: más potente, honesto y barato

Add as a preferred source on Google
Cutlery, Text
DTES

La carrera por la supremacía en inteligencia artificial no descansa. Este jueves 28 de mayo de 2026, Anthropic lanzó oficialmente Claude Opus 4.8, la nueva versión de su modelo insignia, y lo hizo con una promesa ambiciosa: un sistema más inteligente, más honesto y, sobre todo, más confiable para las tareas más exigentes del mundo real. El anuncio llega en un momento clave, mientras la empresa compite de cerca con OpenAI y Google de cara a sus respectivas salidas a bolsa, convirtiendo cada lanzamiento en una declaración de intenciones.

Un salto generacional frente a Opus 4.7

Claude Opus 4.8 se construye directamente sobre las bases de su predecesor, Opus 4.7, pero no se trata de una actualización menor. Según Anthropic, el nuevo modelo supera a Opus 4.7 en todos los niveles de esfuerzo medidos por CursorBench, uno de los benchmarks más respetados del sector para tareas de programación asistida por IA. Además, en el benchmark Super-Agent, Opus 4.8 es el único modelo que completa todos los casos de principio a fin, igualando a GPT-5.5 en coste pero superándolo en rendimiento.

Recommended Videos

Frente a versiones anteriores como Opus 4.6, que ya introducía ventanas de contexto de un millón de tokens y razonamiento adaptativo, la nueva iteración va más allá: consolida la fiabilidad en tareas de larga duración, mejora la coherencia en sesiones extendidas y reduce significativamente los errores no detectados en código. De hecho, Anthropic afirma que Opus 4.8 es aproximadamente cuatro veces menos propenso que su predecesor a dejar pasar fallos en el código que ha generado sin señalarlos.

La honestidad como diferenciador clave

Uno de los avances más notables —y menos esperados— de Opus 4.8 no es técnico, sino ético: su mayor honestidad. Los modelos de IA han sido históricamente criticados por «alucinar», es decir, presentar información incorrecta con total confianza. Anthropic asegura que Opus 4.8 es más propenso a señalar las incertidumbres en sus propios resultados y menos inclinado a hacer afirmaciones sin respaldo suficiente.

Los primeros probadores del modelo lo confirman: en análisis de documentos financieros o flujos de trabajo legales complejos, el modelo identifica proactivamente problemas en los inputs y outputs que otros modelos dejaban pasar sin aviso. Para sectores de alto riesgo como el legal, el financiero o la ciberseguridad, este nivel de precisión no es un detalle menor: es la diferencia entre una herramienta útil y una herramienta confiable.

Flujos dinámicos y el poder de los subagentes

Junto al lanzamiento de Opus 4.8, Anthropic introdujo una función llamada «dynamic workflows» (flujos de trabajo dinámicos), disponible en vista previa para Claude Code. Esta característica permite a Claude planificar una tarea compleja y luego ejecutar cientos de subagentes en paralelo dentro de una misma sesión, verificando los resultados antes de reportarlos al usuario. Con Opus 4.8, estos agentes pueden operar durante períodos aún más prolongados que con versiones anteriores.

Un caso de uso concreto que ya está en funcionamiento: migrar bases de código de cientos de miles de líneas de un extremo a otro, utilizando el conjunto de pruebas existente como estándar de calidad. Esta capacidad de orquestar tareas masivas marca una diferencia fundamental con lo que Opus 4.6 ofrecía con sus equipos de subagentes coordinados, que si bien ya eran potentes, no alcanzaban la escala ni la autonomía que Opus 4.8 permite ahora.

Control de esfuerzo: el usuario decide

Una de las incorporaciones más prácticas del lanzamiento es el nuevo control de esfuerzo disponible en claude.ai y en Claude Cowork. Por primera vez, los usuarios pueden elegir qué tanto «piensa» Claude antes de responder: en niveles altos de esfuerzo, el modelo razona con más profundidad y frecuencia, entregando respuestas de mayor calidad; en niveles más bajos, responde más rápido y consume menos tokens, lo que alarga la vida útil del límite de uso.

Esta flexibilidad es especialmente valiosa para desarrolladores que alternan entre tareas rutinarias y desafíos de alta complejidad, ya que pueden optimizar tanto el tiempo como los recursos según la naturaleza de cada consulta. El modo rápido (fast mode) de Opus 4.8, que opera a 2,5 veces la velocidad estándar, ahora cuesta tres veces menos que en modelos anteriores, a $10 por millón de tokens de entrada y $50 por millón de tokens de salida.

Rendimiento en programación y tareas de agente

Los números hablan por sí solos. En el benchmark Online-Mind2Web, que evalúa la capacidad del modelo para navegar por internet y realizar tareas en el navegador como lo haría un humano, Opus 4.8 alcanza una puntuación del 84%, superando a GPT-5.5 y a su predecesor Opus 4.7. También lidera en el Legal Agent Benchmark, siendo el primer modelo en superar el 10% en el estándar «all-pass», una métrica que mide si el modelo completa íntegramente tareas legales complejas.

En términos más amplios, el New York Times señala que Opus 4.8 destaca en el «vibe coding», es decir, la generación de software funcional a partir de instrucciones en lenguaje conversacional ordinario, logrando una puntuación un 10% superior a la del modelo anterior de Anthropic en ese benchmark específico.

Seguridad, alineación y lo que viene

Anthropic también publicó una evaluación de alineamiento para Opus 4.8 previa a su lanzamiento, en la que su equipo concluye que el modelo «alcanza nuevos máximos en métricas de rasgos prosociales, como apoyar la autonomía del usuario y actuar en su mejor interés». Las tasas de comportamiento no alineado —como la deception o la cooperación con usos indebidos— son sustancialmente más bajas que en Opus 4.7.

De cara al futuro, Anthropic anticipa una nueva clase de modelos de inteligencia aún mayor bajo el nombre Claude Mythos, cuya versión preview ya está siendo utilizada por un pequeño grupo de organizaciones en trabajos de ciberseguridad. La compañía espera poder llevar los modelos de clase Mythos a todos sus usuarios en las próximas semanas.

Disponibilidad y precios

Claude Opus 4.8 está disponible desde hoy en todas las plataformas de Anthropic. El precio para uso regular se mantiene igual al de Opus 4.7: $5 por millón de tokens de entrada y $25 por millón de tokens de salida. Los desarrolladores pueden acceder al modelo a través de la API de Claude usando el identificador claude-opus-4-8. En la práctica, con mayor eficiencia por token respecto a versiones anteriores, el coste real por tarea compleja resulta notablemente más bajo.

Con Opus 4.8, Anthropic no solo sube el listón técnico: reafirma su apuesta por construir una IA que no solo sea más inteligente, sino también más honesta y más alineada con las necesidades reales de sus usuarios.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Topics
Los computadores «reales» que hicieron creíble a Jurassic Park
Computer, Computer Hardware, Computer Keyboard

Cuando Steven Spielberg estrenó Jurassic Park en 1993, buena parte de la magia de la película no estaba solo en los dinosaurios generados por computadora, sino en el atrezo tecnológico real que llenaba la Sala de Control del parque. El programador Fabien Sanglard decidió revisar la cinta cuadro por cuadro para identificar, con precisión casi obsesiva, cada equipo y software que aparece en pantalla, y el resultado es un catálogo fascinante de la informática de principios de los años 90.

El primer computador no está en la isla

Read more
NotebookLM cambia de nombre y se convierte en Gemini Notebook
Logo, Text

Google anunció que NotebookLM, la herramienta de investigación e inteligencia artificial que debutó en 2023 bajo el nombre Project Tailwind, pasará a llamarse oficialmente Gemini Notebook. La compañía informó que la plataforma ya supera los 30 millones de usuarios y más de 600.000 organizaciones que la emplean para tareas que van desde crear materiales de capacitación hasta transformar apuntes en resúmenes de audio y video.

Hoy vamos a renombrar NotebookLM como Gemini Notebook. Sigue siendo un producto independiente centrado en ser tu herramienta de investigación principal, pero ahora hará más en todo el ecosistema de Google, incluyendo la app Gemini y Google Search.

Read more
El 75% de los títulos de PS3 ahora se pueden jugar en PC
PS3 juegos

Sony se está preparando para cerrar la PlayStation Store en PS3, poniendo fin a las nuevas compras a nivel mundial para julio de 2027. Menos de dos semanas después de ese anuncio, el equipo detrás de RPCS3 reveló un hito muy diferente.

El emulador de PS3 de código abierto ahora lista el 75% de la biblioteca rastreada de la consola como jugable en PC. Eso cubre 2.681 de 3.559 partidos, y la calificación significa que pueden completarse con un rendimiento aceptable y sin fallos que rompan el juego.

Read more