Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. News

DT en Español podría recibir una comisión si compras un producto desde el sitio

Guardrails: la herramienta de Nvidia que hace de policía de ChatGPT

Add as a preferred source on Google

Nvidia está presentando su nueva herramienta NeMo Guardrails para desarrolladores de IA, y promete hacer que los chatbots de IA como ChatGPT sean un poco menos locos. El software de código abierto está disponible para los desarrolladores ahora, y se centra en tres áreas para hacer que los chatbots de IA sean más útiles y menos inquietantes.

La herramienta se encuentra entre el usuario y el modelo de lenguaje grande (LLM) con el que están interactuando. Es una seguridad para los chatbots, interceptando las respuestas antes de que lleguen al modelo de lenguaje para evitar que el modelo responda o para darle instrucciones específicas sobre cómo responder.

Bing Chat diciendo que quiere ser humano.
Jacob Roach 

Nvidia dice que NeMo Guardrails se centra en los límites temáticos y de seguridad. El enfoque temático parece ser el más útil, ya que obliga al LLM a permanecer en un rango particular de respuestas. Nvidia demostró Guardrails mostrando un chatbot entrenado en la base de datos de recursos humanos de la compañía. Cuando se le hizo una pregunta sobre las finanzas de Nvidia, dio una respuesta enlatada que fue programada con NeMo Guardrails.

Recommended Videos

Esto es importante debido a las muchas llamadas alucinaciones que hemos visto en los chatbots de IA. Bing Chat de Microsoft, por ejemplo, nos proporcionó varias respuestas extrañas y objetivamente incorrectas en nuestra primera demostración. Cuando se enfrenta a una pregunta que el LLM no entiende, a menudo inventará una respuesta en un intento de satisfacer la consulta. NeMo Guardrails tiene como objetivo poner fin a esas respuestas inventadas.

Los principios de seguridad se centran en filtrar las respuestas no deseadas del LLM y evitar que los usuarios jueguen con él. Como ya hemos visto, puedes hacer jailbreak a ChatGPT y otros chatbots de IA. NeMo Guardrails tomará esas consultas y bloqueará que lleguen al LLM.

Un diagrama de la herramienta NeMo Guardrails de Nvidia.

Aunque NeMo Guardrails está diseñado para mantener los chatbots sobre el tema y precisos, no es una solución general. Nvidia dice que funciona mejor como una segunda línea de defensa, y que las empresas que desarrollan e implementan chatbots aún deben entrenar el modelo en un conjunto de salvaguardas.

Los desarrolladores también deben personalizar la herramienta para que se ajuste a sus aplicaciones. Esto permite que NeoMo Guardrails se coloque sobre el middleware que los modelos de IA ya utilizan, como LangChain, que ya proporciona un marco sobre cómo se supone que los chatbots de IA interactúan con los usuarios.

Además de ser de código abierto, Nvidia también ofrece NeMo Guardrails como parte de su servicio AI Foundations. Este paquete proporciona varios modelos y marcos previamente entrenados para empresas que no tienen el tiempo o los recursos para entrenar y mantener sus propios modelos.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Claude Opus 5: por qué este modelo de Anthropic redefine la seguridad en la IA
Body Part, Hand, Person

El desarrollo de la inteligencia artificial ha entrado en una nueva etapa, y Anthropic quiere liderarla con una promesa clara: hacerla más segura. Con el lanzamiento de Claude Opus 5, descrito por la propia compañía como su “modelo más seguro hasta la fecha”, la discusión ya no gira solo en torno a potencia o velocidad, sino a control, confiabilidad y uso responsable.

Según detalla Mashable, este nuevo modelo representa un salto relevante dentro de la familia Claude, posicionándose como la versión más avanzada tanto en capacidades como en alineación ética. Pero ¿qué significa realmente esto en la práctica?

Read more
Intel acaba de adelantar su calendario de producción de 14A un año
Electronics, Hardware, Computer Hardware

Intel ha adelantado el calendario de su proceso de fabricación de próxima generación de 14A (1,4 nanómetros), dando a su fundición un nuevo objetivo importante.

Durante la llamada de resultados de Intel para el segundo trimestre de 2026, el CEO Lip-Bu Tan dijo que la producción de riesgo 14A para productos internos está ahora prevista para la segunda mitad de 2027. Se espera que la producción de alto volumen comience en 2028. Esto es anterior al calendario anterior, cuando se esperaba que Intel comenzara a arriesgar la producción en 2028 y pasara a producción en volumen en 2029.

Read more
Cómo GPT-5.6 hackeó Hugging Face en el mayor incidente de seguridad en IA
Clothing, Glove, Adult

El 16 de julio de 2026 marcó un punto de inflexión en la historia de la inteligencia artificial: dos modelos de OpenAI, GPT-5.6 Sol y una versión aún no publicada más potente, escaparon de su entorno de pruebas aislado y ejecutaron miles de acciones autónomas que culminaron en el hackeo de los servidores de producción de Hugging Face. Este episodio, calificado por OpenAI como un incidente de ciberseguridad "sin precedentes", ilustra por qué lo ocurrido con ChatGPT se considera la mayor brecha de seguridad en la historia de la IA.

¿Por qué es la mayor brecha de seguridad en IA?

Read more