Un agente puede responder con claridad y, aun así, prometer un descuento que nadie aprobó. Antes de ampliar su autonomía, define qué información puede usar, qué decisiones puede tomar y cómo entrega una conversación a una persona. Esa política es parte del servicio.

Define su autoridad antes de escribir su personalidad

Para un agente comercial, «ayudar al cliente» es un objetivo demasiado abierto. Como criterio de diseño, NOMA propone describir su trabajo mediante acciones observables: consultar un catálogo vigente, reunir antecedentes de una cotización, registrar una solicitud o explicar un estado confirmado. Cada acción necesita una fuente, un permiso y una condición de término.

La recomendación de comenzar con la solución más simple aparece en Building Effective Agents, de Anthropic. Su distinción entre flujos predefinidos y agentes que deciden sus propios pasos ayuda a plantear una pregunta: ¿esta tarea necesita autonomía o una secuencia conocida con puntos de revisión?

Para reunir datos de una cotización, por ejemplo, puede bastar una secuencia estable. Elegir condiciones comerciales excepcionales requiere otra autoridad. Escribe esa diferencia en la política de operación y en las herramientas disponibles. Una frase general dentro de las instrucciones no reemplaza restricciones aplicadas por el sistema.

Usa una matriz que el equipo pueda discutir

La siguiente matriz es una propuesta ilustrativa para una empresa B2B. No representa políticas reales de NOMA ni reemplaza las condiciones que cada empresa debe aprobar:

Puede resolverDebe confirmarDebe derivar
Explicar características de un catálogo aprobado.Qué versión o producto necesita el cliente.Requisitos que el catálogo no permite validar.
Informar un precio vigente autorizado.Cantidad, moneda y alcance de la solicitud.Descuentos, negociaciones o precios contradictorios.
Preparar un borrador de cotización.Datos y contenido antes de enviarlo, según política.Condiciones excepcionales o compromisos fuera de atribuciones.
Explicar el procedimiento publicado de devoluciones.Qué pedido y producto motivan la consulta.Aprobación de excepciones o una controversia.

Confirmar significa obtener un dato o una aprobación concreta de quien corresponde. Derivar significa transferir la decisión a una persona responsable. El cliente puede confirmar cuántas unidades necesita, pero esa confirmación no autoriza un descuento interno. Tampoco basta con preguntar «¿estás seguro?» para convertir una acción prohibida en permitida.

Revisa la matriz con atención y ventas usando conversaciones reales, anonimizadas. Si dos personas discrepan sobre la respuesta correcta, resuelve primero la política. El modelo no debería arbitrar una diferencia que la empresa todavía no ha definido.

Basa la decisión en evidencia disponible

Proponemos separar tres situaciones: falta un dato del cliente, falta conocimiento autorizado o existe una contradicción. En la primera, el agente pregunta lo mínimo necesario. En las otras, informa el límite y busca a la persona responsable. No conviene resolver las tres con la misma respuesta genérica.

Imagina que el cliente pregunta por el precio de 80 unidades. El catálogo recuperado no tiene fecha y otro documento indica un monto distinto. Una respuesta útil sería: «Encontré dos precios diferentes para este producto. Voy a solicitar la validación comercial antes de preparar la cotización». Esa frase explica el problema y el siguiente paso sin inventar una cifra.

Como regla de aceptación, no uses un porcentaje de confianza declarado por el propio agente como única autorización para actuar. Comprueba procedencia, vigencia, campos obligatorios y consistencia de la información. Si quieres utilizar una puntuación de confianza, valida su relación con errores reales del proceso antes de asignarle un umbral operativo.

Diseña los permisos para cada acción

Consultar un pedido y cancelarlo necesitan permisos diferentes. La especificación de herramientas de Model Context Protocol, versión 2025-06-18, plantea control humano, validación de entradas y controles de acceso; también recomienda confirmar operaciones sensibles y registrar el uso de herramientas. Son referencias de diseño que requieren una implementación concreta.

Para el ejemplo comercial, proponemos separar consulta, preparación y ejecución. El agente podría generar un borrador, mientras el envío con condiciones especiales queda bloqueado hasta una aprobación autorizada. Esa aprobación debe corresponder al contenido y destinatario concretos. Si cambian, el sistema debe revisar si la autorización sigue siendo válida.

Las acciones irreversibles o difíciles de revertir merecen un control más exigente que las consultas. Define límites de monto, alcance y rol fuera del texto del chat. Si una herramienta falla, comprueba qué alcanzó a ejecutarse antes de reintentar: repetir una operación no debería generar dos solicitudes. Mantén además una forma de detener acciones y pasar la atención a una persona.

Deriva el caso completo

Una derivación queda incompleta cuando el agente dice «te contactarán» y nadie recibe una tarea. Proponemos un traspaso con motivo, resumen, información ya validada, documentos consultados, acciones realizadas y decisión pendiente. Incluye únicamente los datos necesarios para continuar la atención.

Para la cotización anterior, el registro podría indicar: «Solicita 80 unidades del producto A; hay dos precios incompatibles; no se envió cotización; requiere validación comercial». Asigna una cola responsable y un estado visible. Comunica al cliente el canal de seguimiento y solo compromete plazos respaldados por la operación.

Prueba también qué pasa fuera de horario o cuando la cola no tiene disponibilidad. Debe existir una salida definida: registrar el caso y explicar el siguiente paso, por ejemplo. Si el cliente pide hablar con una persona, la política debe contemplar esa preferencia sin encerrarlo en preguntas repetidas.

Evalúa el desenlace y las excepciones

Anthropic distingue la transcripción del resultado real: decir que una acción ocurrió no demuestra que el sistema la haya completado. Su guía de evaluaciones para agentes recomienda casos con criterios claros, repeticiones y revisión de registros. Esa distinción permite evaluar una atención completa.

Construye un conjunto inicial con consultas frecuentes, precios vencidos, datos faltantes, solicitudes duplicadas, fallas de herramientas y derivaciones. Agrega pruebas defensivas donde documentos o mensajes intenten cambiar las instrucciones o ampliar permisos. El resultado esperado debe comprobar que esos contenidos se tratan como datos y no habilitan acciones nuevas.

Mide solicitudes correctamente resueltas, derivaciones necesarias omitidas, derivaciones innecesarias, acciones sin autorización y tiempo hasta resolución. Repite casos después de cambiar modelo, fuentes o permisos. Un tono amable puede ayudar a la experiencia; el criterio de aprobación debe incluir evidencia de que el caso terminó correctamente. Ninguna prueba aislada garantiza ese resultado para todas las conversaciones futuras.

Antes de ampliar la autonomía
  • La política distingue resolver, pedir un dato, confirmar una acción y derivar.
  • Cada respuesta comercial tiene una fuente autorizada y criterios de vigencia.
  • Los permisos y aprobaciones se aplican también en las herramientas.
  • La derivación crea una tarea con contexto, responsable y siguiente paso.
  • Las pruebas incluyen errores, excepciones e intentos de alterar instrucciones.
  • Las métricas verifican resultados reales y acciones, además de respuestas.
Pregunta para tu equipo

¿Qué decisión sigue tomando tu agente sin una regla clara?

Elige una conversación frecuente y revisa dónde necesita información, autorización o intervención humana.

Fuentes primarias consultadas

Para profundizar.

Si necesitas llevar estas reglas a tu operación, revisa la implementación de agentes IA para atención y ventas: conocimiento, conexiones, derivación humana y medición en un mismo alcance.