Skip to content
Berktug Berke Ates
Berktug Berke Ates

Software Engineer

Blog

Progettare code di escalation umana per gli agent

· 7 min di lettura

Gli agent che non escalano mai sembrano autonomi—finché non fanno fallire gli utenti in silenzio. Le code di escalation richiedono regole di triage, context pack, SLA e feedback loop—non un generico pulsante 'parla con un umano' appiccicato alla chat.

Escalate sulla policy, non sul feeling

Definite i trigger di escalation come policy esplicite: bassa confidence su intent ad alto rischio, fallimenti tool dopo N retry, richiesta utente di un umano, keyword regolatorie e limiti di spesa o permesso che l'agent non deve superare. Euristiche ambigue 'quando sembra bloccato' producono alert fatigue o vicoli ciechi silenziosi.

Separate soft assist—l'agent continua a bozzare mentre un umano reviewa—da hard stop, dove l'agent congela gli side effect fino all'approvazione. Prodotto, risk e support devono firmare la matrice per superficie.

Spedite un context pack, non un transcript grezzo

Gli umani sprecano minuti a ricostruire perché l'agent si è fermato. Impacchettate obiettivo utente, ultimi risultati tool, prossima azione proposta, segnali di confidence e ciò che l'agent ha già promesso. Redigete i secret; lasciate prove sufficienti per l'audit.

Instradate per skill e autorità: dispute di billing, incident di sicurezza e account recovery non devono condividere una inbox indifferenziata. Includete priorità e tier cliente così l'ordine di coda segue la policy di business.

  • Pubblicare una matrice di trigger firmata da prodotto e risk
  • Allegare context pack strutturati con goal, tool e azioni proposte
  • Instradare per skill, autorità e severità—non una coda catch-all
  • Misurare time-to-first-human e qualità di risoluzione, non solo volume ticket

Rendere l'handoff bidirezionale

Quando un umano risolve un caso, rimandate l'esito: fatti corretti, playbook approvati e se l'agent può riprendere. Senza quel loop ogni caso simile scala di nuovo e la curva dei costi non si piega mai.

Esporre le transizioni di stato dell'agent nella UI operatore—pending, waiting on human, resumed, closed—così il support non combatte una chat parallela che l'agent crede ancora di possedere.

Operare le code come lavoro di reliability

Tracciare età del backlog, tassi di abbandono e false escalation. Spike dopo un cambio di modello o prompt di solito significa calibrazione rotta—non improvviso bisogno di più umani. Provare carico di picco e copertura fuori orario prima di commercializzare l'autonomia agent.

L'escalation umana è una feature di prodotto con budget ops. Progettatela con lo stesso rigore dell'agent che la alimenta.


Pubblicato il 15 settembre 2026 da Berktug Berke Ates.