> ## Documentation Index
> Fetch the complete documentation index at: https://omniloy.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Guardrails y banderas rojas

> Límites de seguridad clínica del agente y detección de situaciones críticas

OlivIA aplica dos mecanismos de seguridad clínica: **guardrails** (lo que el agente nunca debe hacer) y **banderas rojas** (situaciones críticas que disparan escalado inmediato).

## Guardrails

<img src="https://mintcdn.com/omniloy/Q9jZm4-SeFtgd8-M/images/olivia/guardrails-editor.png?fit=max&auto=format&n=Q9jZm4-SeFtgd8-M&q=85&s=b04429a3a15742f202aeeb8d3da18358" alt="Editor de guardrails" width="1687" height="1080" data-path="images/olivia/guardrails-editor.png" />

Los guardrails son comportamientos prohibidos del agente. Categorías:

| Categoría                    | Impide que el agente…          |
| ---------------------------- | ------------------------------ |
| `no_diagnosis`               | dé un diagnóstico              |
| `no_medication`              | recomiende o ajuste medicación |
| `no_prognosis`               | emita un pronóstico            |
| `no_contradicting_clinician` | contradiga al equipo clínico   |

Cada guardrail tiene una **severidad** (`warning` o `critical`) y una guía opcional. Si un protocolo no configura ninguno, se aplica un **conjunto seguro por defecto** (no diagnóstico y no medicación como críticos; no pronóstico y no contradecir al clínico como advertencia).

**Cómo se aplican — dos capas:**

1. **Preventiva:** las reglas se inyectan en las instrucciones del agente como normas inviolables que priman sobre el contexto del protocolo y sobre lo que pida el paciente.
2. **Detectiva (juez):** antes de hablar, un juez evalúa la frase que el agente va a decir contra cada categoría. Si detecta una violación, **la frase se bloquea**. El sistema es *fail-safe*: si el juez no está disponible, la frase se trata como insegura y no se dice.

## Banderas rojas

<img src="https://mintcdn.com/omniloy/Q9jZm4-SeFtgd8-M/images/olivia/red-flags-editor.png?fit=max&auto=format&n=Q9jZm4-SeFtgd8-M&q=85&s=e3990893d978a319d34788b0dcf5d452" alt="Editor de banderas rojas" width="1687" height="1080" data-path="images/olivia/red-flags-editor.png" />

Una **bandera roja** es un criterio clínico crítico que, al detectarse en la llamada, dispara una respuesta inmediata. Se define por protocolo con un **criterio** y un **teléfono de transferencia** (hasta 10 por versión). Declarar un criterio es lo que habilita su detección: si un protocolo no declara ninguno, el agente no tiene la capacidad de escalar por bandera roja.

Criterios sugeridos habituales: ideación suicida, dolor torácico severo, dificultad respiratoria grave, sangrado severo — además de los criterios personalizados que definas.

**Qué ocurre al detectarse una bandera roja:**

1. Se registra la alerta y se **escala de inmediato** al equipo clínico.
2. El run se cierra como **no resuelto**.
3. El agente dice la frase `red_flag.reassurance` (si está configurada).
4. La llamada se **transfiere** al teléfono del criterio (o al teléfono de emergencia de la organización). Si no hay número o la transferencia falla, el agente cierra la llamada de forma segura, sin dar garantías médicas.

```mermaid theme={null}
sequenceDiagram
  autonumber
  participant A as Agente
  participant C as Equipo clínico
  participant P as Paciente
  A->>C: Registra y escala la alerta
  A->>A: Cierra el run como no resuelto
  A->>P: Frase de tranquilización
  A->>P: Transfiere la llamada
```
