fix(events): eventos CUSTOM do ESL nunca eram entregues

Achado ao iniciar a fase de Realtime Monitoring: nenhum evento CUSTOM
(sofia::register, sofia::gateway_state, callcenter::info) jamais chegou em
b2bcall-fs-events nesta sessao, apesar do estado real do FreeSWITCH mudar de
verdade (confirmado originando uma chamada de teste pra dentro de uma fila
real com agente logado). Isso deixava dois gaps documentados como "nao
verificado" em docs/TRUNKS.md e docs/AGENTS.md.

Causa raiz: `event_json(...SUBSCRIBED_EVENTS)` mandava "CUSTOM" como ultimo
token do comando `event json`, sem nenhum subclass depois. O
mod_event_socket do FreeSWITCH exige que os subclasses (callcenter::info,
sofia::register, ...) venham imediatamente depois do token CUSTOM no mesmo
comando — sem isso, zero eventos CUSTOM sao entregues, de qualquer
subclass.

Corrigido separando PLAIN_EVENTS (nomes normais, cada um vira um listener
.on()) de CUSTOM_SUBCLASSES (so compoe o comando de subscricao — o client
ESL sempre emite "CUSTOM" como nome de evento, com o subclass real no
header Event-Subclass). Corrigido tambem um bug de nome de campo:
normalizeCustomEvent lia CC-Agent-Status, que nao existe; o campo real e
CC-Agent-State.

Com o pipeline corrigido, chegam eventos ricos de callcenter::info nunca
antes observados: agent-offering, bridge-agent-fail, members-count (fila em
tempo real) e member-queue-end (com CC-Cause/CC-Cancel-Reason e timestamps
de entrada/saida — atendida vs. abandonada). Adicionados como novos tipos
normalizados: AGENT_OFFERED_CALL, AGENT_BRIDGE_FAILED, QUEUE_MEMBER_COUNT,
QUEUE_MEMBER_LEFT.

De quebra, achado e corrigido um segundo bug real ao reverificar Trunks com
o pipeline de eventos funcionando: `sofia profile external rescan` nunca
descarregava um gateway cujo arquivo .xml foi apagado (fica fantasma na
memoria do Sofia indefinidamente). trunk-sync.ts agora roda `sofia profile
external killgw <nome>` pra cada gateway removido, antes do rescan.

Reverificado ponta a ponta pra ambos os bugs:
- Trunk com register:true apontando pra host inexistente: Trunk.status no
  banco passa de UNKNOWN pra FAILED sozinho, via evento, sem polling.
- Trunk apagado via API: gateway some imediatamente de `sofia status
  gateway`, sem esperar reinicio de profile.
- Chamada de teste real numa fila com agente logado: members-count,
  agent-offering, agent-state-change (CC-Agent-State correto: Waiting/
  Receiving), bridge-agent-fail, todos chegando certos no canal Redis
  b2bcall:events.

typecheck do workspace inteiro limpo.

Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01X1HxY46WGU4G1zmVDNKcWw
This commit is contained in:
2026-08-28 11:41:09 -03:00
parent a05104a05f
commit b940ce3e63
7 changed files with 174 additions and 36 deletions

View File

@@ -29,6 +29,16 @@ módulos). Em vez disso, `b2bcall-fs-config`:
2. Roda `sofia profile external rescan` via ESL — relê os gateways sem
derrubar chamadas em andamento (diferente de `restart`).
**Achado real (fase Realtime Monitoring)**: `rescan` só lê arquivos
novos/alterados — apagar o arquivo `.xml` de um trunk removido não tira o
gateway da memória do Sofia, ele fica "fantasma" indefinidamente (confirmado
criando e apagando um trunk de teste via API e checando `sofia status
gateway` depois do rescan). Corrigido: `trunk-sync.ts` agora roda `sofia
profile external killgw <nome>` pra cada gateway removido, antes do rescan —
descarrega um gateway específico na hora, sem precisar reiniciar o profile
inteiro. Reverificado ponta a ponta (criar → aparece em `sofia status
gateway` → apagar via API → some imediatamente).
## Gatilho de sincronização
`apps/api` não roda no Docker (ainda está no host) e `fs-config` não expõe
@@ -82,12 +92,23 @@ Criei um trunk de teste apontando pra um host inexistente
## O que falta
- Propagação de `GATEWAY_UP`/`DOWN` → `Trunk.status` não confirmada com
evento real disparado por uma mudança de estado ao vivo nesta sessão de
testes (o gateway ficou em `FAIL_WAIT` por falha de DNS, que pode não
disparar o mesmo ciclo de eventos que uma rejeição SIP normal) — vale
reverificar com um destino que responda de verdade (outro FreeSWITCH, por
exemplo) antes de confiar nisso em produção.
- Quota de troncos (`max_trunks`, secao 59) — depende de Plans/Entitlements.
- `GET /trunks` não mostra `sofia status gateway` ao vivo, só o último
status conhecido no banco — suficiente por enquanto, sem WebSocket ainda.
status conhecido no banco — resolvido na fase Realtime Monitoring via
WebSocket (ver docs/REALTIME.md).
## Correção: `GATEWAY_UP`/`DOWN` → `Trunk.status` (fase Realtime Monitoring)
Documentado antes como "não confirmado com evento real" — na verdade nunca
funcionava, e a causa raiz não tinha nada a ver com o tipo de falha do
gateway. `b2bcall-fs-events` assinava os eventos CUSTOM do ESL passando
`"CUSTOM"` como o **último** elemento da lista pro comando `event json`, sem
nenhum subclass depois — e o protocolo do FreeSWITCH exige que os nomes de
subclass (`sofia::gateway_state`, `sofia::register`, `callcenter::info`,
...) venham imediatamente depois do token `CUSTOM` no mesmo comando `event
json`, senão zero eventos CUSTOM chegam, de qualquer subclass. Achado e
corrigido durante a fase Agentes/Realtime Monitoring (mesmo bug afetava
`callcenter::info`, ver docs/AGENTS.md). Reverificado ponta a ponta: criar
um trunk com `register: true` apontando pra um host inexistente →
`Trunk.status` no banco passa de `UNKNOWN` pra `FAILED` sozinho, sem
polling, assim que o Sofia tenta e falha o registro.