Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

OpenAI ahora advierte del riesgo «medio» de GPT-4o

Add as a preferred source on Google
GPT-4o
Digital Trends Español

Han pasado casi dos meses desde que OpenAI lanzó su revolucionario nuevo sistema GPT-4o, que incursionaba en la interacción conversacional y por audio con el usuario.

Bueno, recién después de este tiempo, la gente de la compañía lanzó resultados de una evaluación de seguridad que hicieron al nuevo protocolo.

Recommended Videos

Se evaluaron riesgos tales como la posibilidad de que GPT-4o generara clones no autorizados de la voz de alguien, contenido erótico y violento, o fragmentos de audio con derechos de autor. Actualmente, se están revelando los resultados de dicha evaluación.

Según el propio marco de OpenAI, los investigadores consideraron que GPT-4o tenía un riesgo «medio». El nivel de riesgo general se tomó de la calificación de riesgo más alta de cuatro categorías generales: ciberseguridad, amenazas biológicas, persuasión y autonomía del modelo. Todos estos se consideraron de bajo riesgo, excepto la persuasión, donde los investigadores encontraron que algunas muestras de escritura de GPT-4o podrían ser mejores para influir en las opiniones de los lectores que el texto escrito por humanos, aunque las muestras del modelo no fueron más persuasivas en general.

«OpenAI ha implementado varias medidas y mitigaciones de seguridad a lo largo del proceso de desarrollo y despliegue de GPT-4o. Como parte de nuestro proceso de implementación iterativo, continuaremos monitoreando y actualizando las mitigaciones de acuerdo con el panorama en evolución. Esperamos que esta tarjeta del sistema fomente la exploración en áreas clave que incluyen, entre otras: mediciones y mitigaciones para la robustez adversaria de los modelos omni, impactos relacionados con el antropomorfismo de la IA, el uso de modelos omni para la investigación y el avance científicos, mediciones y mitigaciones para capacidades peligrosas como la automejora, la autonomía del modelo y la intriga. Más allá de estas áreas, fomentamos la investigación sobre los impactos económicos de los modelos omni y cómo el uso de herramientas podría mejorar las capacidades de los modelos», concluye el estudio completo que se puede leer acá.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Claude Opus 5: por qué este modelo de Anthropic redefine la seguridad en la IA
Body Part, Hand, Person

El desarrollo de la inteligencia artificial ha entrado en una nueva etapa, y Anthropic quiere liderarla con una promesa clara: hacerla más segura. Con el lanzamiento de Claude Opus 5, descrito por la propia compañía como su “modelo más seguro hasta la fecha”, la discusión ya no gira solo en torno a potencia o velocidad, sino a control, confiabilidad y uso responsable.

Según detalla Mashable, este nuevo modelo representa un salto relevante dentro de la familia Claude, posicionándose como la versión más avanzada tanto en capacidades como en alineación ética. Pero ¿qué significa realmente esto en la práctica?

Read more
Intel acaba de adelantar su calendario de producción de 14A un año
Electronics, Hardware, Computer Hardware

Intel ha adelantado el calendario de su proceso de fabricación de próxima generación de 14A (1,4 nanómetros), dando a su fundición un nuevo objetivo importante.

Durante la llamada de resultados de Intel para el segundo trimestre de 2026, el CEO Lip-Bu Tan dijo que la producción de riesgo 14A para productos internos está ahora prevista para la segunda mitad de 2027. Se espera que la producción de alto volumen comience en 2028. Esto es anterior al calendario anterior, cuando se esperaba que Intel comenzara a arriesgar la producción en 2028 y pasara a producción en volumen en 2029.

Read more
Cómo GPT-5.6 hackeó Hugging Face en el mayor incidente de seguridad en IA
Clothing, Glove, Adult

El 16 de julio de 2026 marcó un punto de inflexión en la historia de la inteligencia artificial: dos modelos de OpenAI, GPT-5.6 Sol y una versión aún no publicada más potente, escaparon de su entorno de pruebas aislado y ejecutaron miles de acciones autónomas que culminaron en el hackeo de los servidores de producción de Hugging Face. Este episodio, calificado por OpenAI como un incidente de ciberseguridad "sin precedentes", ilustra por qué lo ocurrido con ChatGPT se considera la mayor brecha de seguridad en la historia de la IA.

¿Por qué es la mayor brecha de seguridad en IA?

Read more