Cada agente tiene una política de escalado. Cuando la confianza es baja, el riesgo es alto o se activa una salvaguarda, la persona adecuada recibe un paquete completo de contexto — no una pregunta aislada.
La autonomía total rara vez es el objetivo. El objetivo es autonomía donde es seguro y asistencia donde no lo es. El escalado es la forma de afinar ese equilibrio — por flujo de trabajo, por acción, por nivel de cliente — y la forma en que el sistema se vuelve más inteligente con cada corrección.
En cada paso se comprueban umbrales de confianza, coste de la acción, segmento de cliente y reglas de política. ¿Baja señal? Escalar.
Los revisores reciben la pregunta, el plan del agente, las evidencias y botones de aprobación/revisión en un clic — sin tener que rastrear los logs.
Las correcciones humanas retroalimentan el marco de evaluación del agente para que la misma clase de error no se escale la próxima vez.
Autoaprobar un reembolso de 10 USD pero escalar uno de 10 000 USD a un responsable — mismo agente, rutas distintas, reglas transparentes.
Los revisores aprueban desde Slack, Teams, correo electrónico o la plataforma — la superficie en la que ya trabajan.
Cuando una persona edita el borrador de un agente, el diff se captura como señal etiquetada de entrenamiento — no se pierde en una herramienta.
Las colas de escalado muestran antigüedad, volumen y tiempo de resolución para que operaciones vea cuándo ajustar los umbrales.