Blank white background with no objects or features visible.

Te ofrecemos acceso gratuito al informe completo Gartner Hype Cycle for AI Governance 2026. Consigue tu copia →

Cómo configurar mecanismos de protección en la pasarela de IA

Por Ashish Dubey

Published: October 9, 2026

Por qué las barreras de seguridad deben estar en la gateway

Un endpoint de modelo sin procesar devolverá alegremente datos personales, aceptará una carga útil de inyección de prompts o proporcionará una respuesta insegura. Las barreras de seguridad solucionan esto inspeccionando y, cuando es necesario, reescribiendo el tráfico antes de que llegue al modelo y antes de que la respuesta llegue al usuario.

Implementar barreras de seguridad en la AI Gateway significa que cada aplicación obtiene la misma protección automáticamente, sin que cada equipo tenga que volver a implementar la seguridad. TrueFoundry incluye barreras de seguridad integradas para la redacción de PII y la detección de inyección de prompts, ambas totalmente gestionadas y sin necesidad de configurar claves de terceros.

El modelo de dos pasos: registrar y luego aplicar políticas

Como documentación de guardrails indica, aplicar barreras de seguridad en la AI Gateway es un proceso de dos pasos.

  • Registrar barreras de seguridad. Ve a AI Gateway, luego a Guardrails, crea un grupo de barreras de seguridad y añade las integraciones que desees, ya sean las integraciones nativas de TrueFoundry, proveedores externos o barreras de seguridad personalizadas.
  • Configurar políticas. Ve a AI Gateway, luego a Policies, después a Guardrails y crea reglas que determinen cuándo aplicar qué barreras de seguridad y en qué puntos de conexión (hooks) se ejecutan.
Selección de barreras de seguridad integradas como PII y Prompt Injection de TrueFoundry Guardrails.

Creación de una regla de barrera de seguridad

En Policies, dentro de Guardrails, haz clic en Add Rule. Cada regla tiene un ID único y varias secciones que determinan a quién se aplica y dónde se ejecuta.

  • Cuando la solicitud se dirige a (objetivos). Coincide con uno o más modelos, o con servidores MCP e incluso herramientas específicas. Las condiciones de destino múltiples se combinan con OR, por lo que la regla se aplica si la solicitud se dirige a cualquiera de los modelos o servidores MCP listados. Si no se especifica ningún objetivo, la regla se aplica a cualquier modelo.
  • Desde sujetos. Filtra por usuarios, equipos o cuentas virtuales con condiciones IN o NOT IN. Si no hay filtro de sujeto, la regla se aplica a todos los emisores.
  • Con metadatos. Realiza coincidencias con pares clave-valor enviados en la cabecera X-TFY-METADATA, por ejemplo, environment production.
  • Aplicar en hooks. Elige el hook y selecciona los guardrails que se ejecutarán en él. Puedes adjuntar varios guardrails al mismo hook, y todos ellos se ejecutarán para las solicitudes que coincidan.
El editor de reglas de guardrail, con objetivos, sujetos, metadatos y hooks.

Los cuatro hooks

  • Entrada de LLM se ejecuta antes de que el prompt se envíe al modelo.
  • Salida de LLM se ejecuta después de que el modelo responde, antes de que se devuelva la respuesta.
  • Pre-invocación de herramienta MCP se ejecuta antes de que se ejecute una herramienta MCP.
  • Post-invocación de herramienta MCP se ejecuta después de que una herramienta MCP devuelve un resultado, antes de que este llegue al modelo.

Todas las reglas se evalúan para cada solicitud, y los guardrails de todas las reglas coincidentes se combinan y aplican conjuntamente. Si una regla aplica detección de PII en la entrada de LLM y otra aplica detección de inyección de prompts en la entrada de LLM, ambas se ejecutan.

Want the same safety on every LLM and tool call?
We will configure PII redaction and prompt-injection defense on your gateway, live.

Configuración de la redacción de PII y PHI

ElGuardrail de detección de PII y PHI es un guardrail integrado de TrueFoundry que identifica y redacta información de identificación personal (PII) e información de salud protegida (PHI). Funciona internamente mediante la detección de PII de Azure AI Language y está totalmente gestionado, por lo que no requiere claves de API de terceros.

Solo admite el modo de mutación, lo que significa que siempre redacta las entidades detectadas. En el formulario de configuración, estableces un nombre, eliges las categorías de PII o mantienes las predeterminadas (todas las categorías) y seleccionas una estrategia de aplicación. Los valores detectados se reemplazan por asteriscos, por lo que un número de teléfono y un correo electrónico en un mensaje quedan enmascarados antes de que el modelo los vea.

Configuración del guardrail integrado de detección de PII y PHI con categorías de entidades.

Una configuración común aplica la redacción de PII en la entrada de LLM para limpiar los mensajes de los usuarios, en la salida de LLM para limpiar las respuestas, y en los hooks de MCP para eliminar la PII de los parámetros y resultados de las herramientas, como las filas de una base de datos.

Configuración de la defensa contra inyección de prompts

Elmecanismo de protección contra inyección de prompts es un mecanismo de protección integrado basado en Azure Prompt Shield. Detecta inyecciones directas de prompts, ataques de jailbreak como el patrón "do anything now" e inyecciones indirectas ocultas en documentos o contenido contextual. Analiza el prompt del usuario y el contenido del documento por separado.

Solo admite el modo de validación, lo que significa que detecta y bloquea ataques, pero no modifica el contenido. La configuración solo requiere un nombre y una estrategia de aplicación. La documentación recomienda comenzar con la estrategia de auditoría para supervisar las detecciones en los seguimientos de las solicitudes y, una vez que se tenga confianza en ella, cambiar a la de aplicación.

Cómo ejecuta la pasarela los mecanismos de protección en una solicitud

En una solicitud a un LLM, los mecanismos de protección de mutación de entrada se ejecutan primero y bloquean el proceso hasta que finalizan, por ejemplo, al redactar información de identificación personal (PII) del prompt. A continuación, la validación de entrada, como la de inyección de prompts, se ejecuta en segundo plano mientras la solicitud al modelo está en curso. Si la validación de entrada falla mientras el modelo sigue funcionando, la pasarela cancela la solicitud al modelo de inmediato para que no tenga que pagar por ella.

Una vez que el modelo responde, la mutación de salida puede eliminar secretos y la validación de salida comprueba el resultado final antes de que llegue al cliente. Para las herramientas MCP, todos los mecanismos de protección previos a la herramienta se ejecutan antes de que se llame a la herramienta; si alguno falla, la herramienta nunca se ejecuta. Los mecanismos de protección se ejecutan en cada llamada a la herramienta por separado.

Latencia de los mecanismos de protección y resultados mostrados en los seguimientos de las solicitudes.
Make guardrails standard across every team
See centralized PII and injection policies applied to all apps, with full tracing, on your infrastructure.

Try now.

One gateway for all your models, MCP servers, and agents.
No credit card needed.

Inscríbase
Tabla de contenido

Controle, implemente y rastree la IA en su propia infraestructura

Reserva 30 minutos con nuestro Experto en IA

Reserve una demostración

La forma más rápida de crear, gobernar y escalar su IA

Demo del libro
Summarize with
ChatGPT logo by OpenAI
Perplexity AI logo
Blurry red snowflake on white background, symmetrical frosty design with soft edges and abstract shape.

Descubra más

No se ha encontrado ningún artículo.
October 9, 2026
|
5 minutos de lectura

Qué significa BYOK en una AI Gateway

No se ha encontrado ningún artículo.
October 9, 2026
|
5 minutos de lectura

SGLang frente a vLLM frente a TensorRT-LLM: Cómo elegir un motor de inferencia

No se ha encontrado ningún artículo.
October 9, 2026
|
5 minutos de lectura

OpenRouter BYOK explicado: más barato, a menudo más rápido y en constante cambio

No se ha encontrado ningún artículo.
October 9, 2026
|
5 minutos de lectura

Cómo configurar mecanismos de protección en la pasarela de IA

No se ha encontrado ningún artículo.
No se ha encontrado ningún artículo.

Blogs recientes

Black left pointing arrow symbol on white background, directional indicator.
Black left pointing arrow symbol on white background, directional indicator.

Preguntas frecuentes

What guardrails does TrueFoundry provide out of the box?

TrueFoundry ships built in PII and PHI detection, powered by Azure AI Language, and prompt injection detection, powered by Azure Prompt Shield. Both are fully managed, with no external credentials required. You can also add external providers or custom guardrails.

Where do guardrails run?

On four hooks: LLM Input, LLM Output, MCP Tool Pre-Invoke, and MCP Tool Post-Invoke. You attach guardrails to the hooks you want in a policy rule, and multiple guardrails can run on the same hook.

Does a blocked prompt still cost money?

If input validation fails while the model request is in flight, the gateway cancels that model request so you do not pay for it. Output validation runs after the model responds, so in that case the model cost is already incurred.

How should I roll out prompt-injection detection safely?

Start with the audit enforcing strategy so detections are recorded in request traces without blocking traffic. Once you are confident in the results, switch the strategy to enforce.

Realice un recorrido rápido por el producto
Comience el recorrido por el producto
Visita guiada por el producto