Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

La IA puede pasar la prueba de Turing en chats en vivo y «es más humana» 

Add as a preferred source on Google
Head, Person, Face
DTES

La IA puede superar el Test de Turing en chats en directo, y el último resultado llega con un escalofrío. En un estudio de la UC San DiegoGPT-4.5 superó a los participantes reales convenciendo a los jueces de que había una persona al otro lado.

La configuración era más difícil de superar que un benchmark estándar. Los jueces reaccionaron a intercambios en tiempo real en lugar de a prompts estáticos, y luego tomaron una decisión rápida basada únicamente en la conversación.

Recommended Videos

Lo inquietante es lo familiar que resulta la habilidad. La modelo no necesitaba un cuerpo, una voz ni una biografía. Solo necesitaba sonar como alguien.

¿Cómo superó la IA a la prueba humana?

El estudio utilizó una versión de tres partes de la prueba. Los jueces charlaron tanto con una persona como con un modelo de IA, y luego eligieron cuál creían que era real.

GPT-4.5 fue identificado como humano el 73% de las veces cuando se le dio un prompt de persona. LLaMa-3.1-405B también cruzó la línea de golpeo, siendo elegido como humano el 56% de las veces con un prompt de persona.

Esos números le dan su mordida al hallazgo. El modelo no solo evitaba ser detectado, sino que daba a los jueces las señales sociales suficientes para interpretarlo como la persona del chat.

¿Por qué sigue siendo importante esta prueba?

La prueba de Turing es una forma de hace décadas de preguntarse si una máquina puede imitar la conversación humana lo suficientemente bien como para engañar a una persona. En la versión clásica, un evaluador conversa sin ver a los participantes y luego intenta distinguir al humano de la máquina.

Siempre ha sido más un símbolo cultural que una medida limpia. Aun así, sigue siendo la prueba que la gente reconoce cuando quiere saber si el software puede pasar para uno de nosotros.

Eso hace que el nuevo resultado se sienta más nítido. Un chatbot no necesita conciencia, emoción ni autoconciencia para dar la impresión de que una persona real está escribiendo de vuelta. Solo tiene que ser creíble en el momento.

El riesgo aparece en lugares normales. El servicio de atención al cliente, las aplicaciones de citas, las plataformas sociales, la educación y la mensajería política dependen de juicios rápidos sobre identidad, intención y autenticidad.

¿Qué deberíamos ver ahora?

El estudio se queda muy lejos de decir que los chatbots entienden a las personas. Su hallazgo más práctico es que algunos modelos ahora pueden desempeñar la personalidad jurídica muy bien en intercambios cortos.

Una mayor transparencia debería convertirse en el siguiente punto de presión. Cuando un bot puede mezclarse con una conversación informal, los usuarios necesitan señales más claras de que están tratando con software, especialmente en lugares donde la persuasión o la vulnerabilidad emocional moldean el intercambio.

La siguiente pelea es sobre el etiquetado en los chats, donde la gente toma decisiones rápidas sobre la confianza.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Nuevo ataque Spectre que puede pasar desapercibido las defensas de Intel y AMD
Electronics, Hardware, Computer Hardware

Spectre ha estado atormentando la seguridad de las CPU desde 2018, y los investigadores del MIT han encontrado ahora otra forma de hacer que se comporte mal. El nuevo ataque TONTOU puede eludir algunas de las defensas que Intel y AMD han añadido a lo largo de los años al aprovechar una pequeña brecha en cómo funcionan esas protecciones. La investigación proviene de Daniël Trujillo y Mengjia Yan del Laboratorio de Informática e Inteligencia Artificial (CSAIL) del MIT. Sus hallazgos muestran que, incluso después de que un procesador borre o aísle la información utilizada por su predictor de ramas, puede haber una breve ventana antes de que esa información se utilice realmente. TONTOU, abreviatura de Time-of-Neutralization to Time-of-Use, ataca precisamente esa brecha.

El pequeño hueco que explota TONTOU

Read more
Microsoft dio accidentalmente a los usuarios de Windows 11 otra app de OneDrive
Furniture, Table, Computer

Los usuarios de Windows 11 han estado recibiendo una nueva aplicación de OneDrive, la hayan pedido o no. ¿El problema? Microsoft dice que no se suponía que eso ocurriera. Microsoft ha confirmado que su aplicación OneDrive Photos se ha desplegado en PCs con Windows 11 de forma más amplia de lo previsto, incluyendo equipos empresariales donde la aplicación ni siquiera está diseñada para funcionar. La empresa dice que ahora está trabajando en una solución, pero hay un detalle incómodo: actualmente los usuarios no pueden desinstalar OneDrive Photos sin eliminar también la aplicación principal de OneDrive.

Entonces, ¿qué es exactamente lo que se instaló?

Read more
La “Jaula de Pájaro” que promete ordenar el caos de ChatGPT
Electronics, Mobile Phone, Phone

ChatGPT puede ser un asistente para investigar, redactar, planificar un viaje, estudiar, generar ideas o resolver dudas cotidianas. El problema aparece cuando todas esas actividades comienzan a convivir dentro de un mismo espacio: una conversación puede pasar de una estrategia de contenidos a una receta, de una investigación periodística a la planificación de unas vacaciones, sin que el usuario advierta que también está cambiando el contexto de trabajo.

La técnica conocida como “Jaula de Pájaro” —o bird cage prompt— propone una solución simple: pedirle a ChatGPT que trate cada proyecto como un espacio independiente y que no utilice información de otros temas, a menos que el usuario lo autorice explícitamente.

Read more