Por qué el filtro corre antes del modelo, y no dentro del prompt
En un bot de salud, la instrucción «no recomiendes tratamientos» escrita en el prompt no es una garantía. Es una intención.
Cuando armé el bot de la clínica, la primera versión tenía la restricción escrita en el prompt: «no recomiendes estudios a partir de síntomas, deriva al médico». Funcionaba casi siempre.
Casi siempre no sirve cuando el que pregunta es un paciente y el que responde lleva el nombre de una clínica. Un modelo de lenguaje al que le describes un dolor te contesta con gusto qué estudio hacerte. Eso es ejercicio ilegal de la medicina, y la marca que aparece arriba de la conversación no es la mía.
La diferencia entre una intención y una garantía
Una instrucción en el prompt es una intención: le pides al modelo que se comporte de cierta forma y casi siempre lo hace. Pero el prompt compite con todo lo demás que hay en la conversación, y hay mil maneras de rodearlo sin siquiera intentarlo. El paciente no está atacando el sistema; simplemente escribe «me duele la espalda desde hace tres días, ¿qué me recomiendas?».
Una regla en el flujo es otra cosa. Se evalúa antes de que el modelo vea el mensaje, en código, con la misma respuesta siempre. Si detecta síntomas, el mensaje no llega al modelo: el bot contesta que no puede orientar sobre eso y ofrece pasar con una persona.
Suena obvio escrito así. No lo es cuando estás armando el flujo y el prompt es el sitio cómodo donde meter cada regla nueva.
Dónde poner el límite
No toda restricción merece salir del prompt. La regla que uso: si el incumplimiento tiene consecuencia legal, reputacional o de seguridad, va en el flujo. Si es de tono o de estilo, puede vivir en el prompt.
- «No recomiendes un estudio ante síntomas» → flujo. Es legal.
- «No confirmes una cita sin orden médica cuando el estudio la exige» → flujo. Le crea un problema real a la clínica.
- «Habla de usted y no uses emojis» → prompt. Si falla un día, no pasa nada.
El costo de esta decisión es real: cada regla en el flujo es código que hay que escribir, probar y mantener, mientras que en el prompt es una línea de texto. Por eso vale la pena elegir cuáles suben de categoría, en lugar de mover todo.
El bot de la clínica está en producción desde este año. La regla no ha fallado, porque no puede: no es una instrucción que el modelo interpreta, es un camino que no existe.