Fecha agente.md secao 90-94. A especificacao lista "Recording" e "Object
Storage" como dois passos separados na ordem de implementacao (secao
232), mas ficaram numa unica fase — sao acoplados o suficiente (Recording
precisa de um lugar pra guardar bytes) pra fazer sentido construir juntos.
## packages/storage — ObjectStorageProvider (secao 92)
Abstracao pequena: putObject/getObjectStream/deleteObject. Dois backends:
LocalObjectStorageProvider (filesystem, com checagem de path traversal
mesmo a key sendo sempre montada no servidor) e S3ObjectStorageProvider
(@aws-sdk/client-s3, preparado pra AWS S3 e MinIO via endpoint/
forcePathStyle customizaveis — nunca exercitado nesta sessao, sem
servidor S3 disponivel neste laboratorio). Escolhido por STORAGE_PROVIDER
env.
buildRecordingObjectKey (secao 93):
tenants/{tenant_id}/recordings/YYYY/MM/DD/{call_id}.wav, sempre montada
no servidor a partir de dados confiaveis.
## Bind mounts, nao volumes nomeados
/recordings e /data/object-storage usam bind mount pra um diretorio real
do host — apps/api roda no host, nao em Docker, e precisa enxergar os
mesmos arquivos que fs-events escreve. LOCAL_STORAGE_ROOT tem valores
diferentes por ambiente (mesmo padrao ja usado pra REDIS_URL).
## Quem grava: apps/predictive-dialer
So' chamadas originadas pelo discador com Campaign.recordingEnabled sao
gravadas nesta fase (unico caminho de originate que o sistema controla
hoje). RECORD_STEREO=true + execute_on_answer='record_session ...'
adicionados ao originate; origination_uuid pre-gerado (em vez de deixar o
provider sortear) porque o path de gravacao precisa dele antes do
comando de originate ser montado — o mesmo uuid vira Call.id no CDR.
## Quem sobe: apps/freeswitch-events/src/recording.ts
Em CALL_ENDED, encadeado depois do persistCallEvent terminar (nao em
paralelo) — uploadRecordingIfPresent le Call.talkTime/durationSeconds,
que e' exatamente o que persistCallEvent acabou de calcular no mesmo
evento (mesma classe de corrida ja corrigida uma vez na fase CDR, aqui
evitada por ordenacao). Sobe pro storage, cria Recording (retentionUntil
a partir de Plan.recordingRetentionDays), apaga o spool local.
## API + retencao
GET /recordings, GET /recordings/:id, GET /recordings/:id/audio (stream
autenticado, nunca URL direta pro storage). runRetentionSweep (secao 94)
no boot do apps/api + a cada hora — apaga o objeto, marca status=DELETED
(linha nunca apagada, fica como auditoria).
## Bug real achado testando esta fase
Recording.sizeBytes (BigInt) quebrava GET /recordings com 500 — Fastify
nao serializa BigInt nativamente (mesma classe de bug ja corrigida uma
vez no logger, fase Event Socket). Corrigido convertendo pra number na
resposta.
Verificado ponta a ponta: gravacao real criada (RIFF WAVE, PCM 16-bit,
ESTEREO 8000Hz — RECORD_STEREO confirmado), upload com path exato da
secao 93, download via API com md5 identico ao objeto original, varredura
de retencao apagando objeto + status DELETED + list/download bloqueados
depois. typecheck do workspace inteiro limpo.
Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01X1HxY46WGU4G1zmVDNKcWw
30 KiB
TODO — B2BCall
PHASE 01 — Infrastructure
- Diagnóstico do servidor (Debian 13, 2 vCPU, ~1.9GB RAM, 26GB disco livre)
- Docker + Docker Compose instalados
- Estrutura de monorepo criada (apps/, packages/, infrastructure/, scripts/, docs/)
- PostgreSQL 18 (docker-compose, porta 127.0.0.1:5432)
- Redis 7 (docker-compose, porta 127.0.0.1:6379)
- Secrets gerados em
.env(POSTGRES_PASSWORD, REDIS_PASSWORD, JWT_SECRET, JWT_REFRESH_SECRET, ENCRYPTION_KEY, ESL_PASSWORD) FREESWITCH_PATconfigurado em.env(não commitado)- FreeSWITCH (imagem própria via pacotes SignalWire, não compilada da fonte — ver docs/FREESWITCH.md; rodando, saudável, ~44MB RAM, senha ESL customizada, nenhuma porta exposta ao host)
- nginx (reverse proxy)
PHASE 05 — FreeSWITCH (agente.md secao 232)
- Imagem própria (
infrastructure/freeswitch/), pacotes SignalWire (PAT via BuildKit secret, nunca na imagem final — verificado comdocker history) - Módulos mínimos carregados: sofia, event_socket, commands, dptools, callcenter, avmd, curl, local_stream, etc. (mod_xml_curl instalado mas desativado até existir b2bcall-fs-config)
- Senha do Event Socket trocada da padrão via entrypoint runtime (nunca fica na imagem); porta 8021 não publicada no host
- docs/FREESWITCH.md, docs/NETWORK_ARCHITECTURE.md (decisão de network_mode adiada pra quando existir tronco SIP real)
- Diretório/dialplan ainda são os estáticos da config vanilla (ramais de teste 1000-1019, senhas fracas) — substituir por mod_xml_curl na fase Extensions/Trunks/Dialplan
PHASE 06 — Event Socket (agente.md secao 21-25, 195)
packages/telephony: interfaceTelephonyProvider+FreeSwitchTelephonyProvider(sobre a libesl, reconexão com backoff já embutida na lib)normalizeEslEvent(): eventos ESL crus → vocabulário interno (secao 24)apps/freeswitch-events(b2bcall-fs-events): conexão ESL permanente, resubscreve a cada reconexão, publica eventos normalizados no canal Redisb2bcall:events- Achado: FreeSWITCH 1.11 aplica ACL implícita (só loopback) sem
apply-inbound-acl— bloqueava conexão de outro container mesmo com senha certa. Corrigido com ACL própria cobrindo loopback + rede Docker. - Testado ponta a ponta com chamada loopback local: CALL_CREATED → CALL_ANSWERED → CALL_ENDED corretos no Redis
- Reconciliação pós-reconexão (calls/agents/queues/registrations/gateways) — não é possível ainda, sem essas tabelas persistidas
PHASE 07 — XML Curl (agente.md secao 26)
apps/freeswitch-config(b2bcall-fs-config): responde ao protocolo XML Curl do FreeSWITCH (POST form-encoded → XML), containerizadomod_xml_curlreativado, binding restrito adirectory|dialplan(nãoconfiguration— evita chamadas HTTP desnecessárias no boot)- Por enquanto sempre "not found" (sem tabela extensions/dialplan ainda);
verificado que a config estática vanilla continua funcionando como
fallback (
user/8888→ SUBSCRIBER_ABSENT via fs-config,user/1000→ USER_NOT_REGISTERED via config estática — achou o usuário) - Sem autenticação HTTP ainda — ok enquanto só responde "not found";
adicionar
gateway-credentialsantes de servir directory/dialplan reais
PHASE 02 — SaaS Core
- Monorepo Node.js/TypeScript (pnpm workspaces, tsconfig base)
- Node 22 LTS + pnpm instalados no host
packages/database(Prisma 7 + driver adapterpg, migration inicial)packages/types(TenantStatus, AgentState),packages/shared- Tabela
tenantscriada via migration (seção 29 do agente.md)
PHASE 03 — Tenant Isolation
- Tabelas
users+tenant_memberships(tenant-scoped) - RLS (
ENABLE/FORCE ROW LEVEL SECURITY+ policy) emtenant_memberships - Tenant context via
set_config('app.current_tenant_id', ..., true)(transaction-local) - Helper
withTenantContext()empackages/database - Role de banco separado para runtime (
b2bcall_app, sem SUPERUSER/BYPASSRLS) — achado crítico: o role padrão do Docker Postgres é SUPERUSER e SEMPRE ignora RLS, até com FORCE. Verdocs/TENANT_ISOLATION.md. - Teste automatizado de isolamento (
pnpm --filter @b2bcall/database run test:isolation)
PHASE 04 — Authentication / RBAC
packages/auth: hash Argon2id (@node-rs/argon2), JWT access token (jose), refresh token opaco com rotation- Tabelas
roles,permissions,role_permissions,user_roles,sessions,audit_logs login()/refreshSession()/logout()/listUserTenants()/setActiveTenant()userHasPermission()(RBAC com scope PLATFORM/TENANT)- Seed: catálogo de permissions + roles de sistema + Platform Super Admin inicial
(senha em
FIRST_LOGIN.txt, fora do Git,mustChangePassword=true) - Teste automatizado (
pnpm --filter @b2bcall/auth run test:auth) apps/api(NestJS + Fastify): endpoints de auth, JwtAuthGuard, DomainExceptionFilter, rate limit de login via Redis (5/min por IP e por e-mail), helmet/cors, health checks — testado ponta a ponta com curl (login, refresh rotation, logout, RBAC, 401/403/429)- Password reset por e-mail — depende de SMTP configurado
PHASE 08 — Extensions (agente.md secao 39-40, 178)
- Tabela
extensions(tenant-scoped, RLS) — number, sip_password_enc, caller_id, context, sofia_profile, codecs, max_registrations packages/shared/src/crypto.ts: AES-256-GCM (senha SIP cifrada em repouso),generateStrongPassword(),maskSecret()apps/api/src/extensions: CRUD (POST/GET/GET:id/DELETE), RBAC via novoPermissionGuardgenérico (@RequirePermission), tenant só do JWT- Senha SIP só aparece em texto puro na resposta do POST, nunca depois (destructuring explícito, não spread — evita vazamento por acidente)
b2bcall-fs-configresolve directory real: Tenant.telephonyDomain → Extension.number, decifra a senha, monta XML com dial-stringTenant.telephonyDomainfixo (b2bcall.local) via patch novars.xmldo FreeSWITCH — antes usava o IP dinâmico do container, instável- HTTP Basic auth entre FreeSWITCH e fs-config (
gateway-credentials, timingSafeEqual) — adicionada nesta mesma fase, não deixada pendente - Testado ponta a ponta: criar ramal →
user/1500dá USER_NOT_REGISTERED (achou, sem telefone) → deletar → volta a SUBSCRIBER_ABSENT - Achado:
PermissionGuardinjetandoReflectorvia construtor davaundefinedem runtime rodando viatsx/esbuild (emissão de metadata de tipo não é 100% confiável cross-file) — corrigido com@Inject()explícito; atenção pra isso em guards/services futuros - Quota de ramais — depende de Plans/Entitlements (não existe ainda)
- Multi-domínio real por tenant — hoje só um domínio fixo pra todos
PHASE 09 — Trunks (agente.md secao 41-42)
- Tabela
trunks(tenant-scoped, RLS) — host/proxy/realm, register, username/password_enc (AES-256-GCM), dtmf_mode, ping, transport, status/status_updated_at apps/api/src/trunks: CRUD (POST/GET/GET:id/DELETE), mesmo padrão de RBAC/tenant de Extensions, senha nunca exposta em nenhum GETpackages/telephony:buildGatewayXml()(XML de gateway Sofia)b2bcall-fs-config: gerasip_profiles/external/<trunk_id>.xml(volume Docker compartilhado com o FreeSWITCH) e rodasofia profile external rescanvia ESL — sincroniza no boot e sob demanda via Redis pub/sub (b2bcall:trunks:sync, publicado pela API a cada create/delete)- Achado: 1º sync no boot corria antes da conexão ESL terminar de se
estabelecer (erro cosmético) — corrigido com
FreeSwitchTelephonyProvider.waitUntilConnected() - Testado ponta a ponta com host fake: criar trunk → arquivo gerado →
sofia status gatewaymostra o gateway real (FAIL_WAIT, esperado) → deletar → arquivo removido (limpeza também tirou oexample.comda vanilla que tinha sido copiado pro volume — comportamento correto) - Lacuna real, não resolvida:
Trunk.statusdeveria ser atualizado via eventossofia::gateway_state(código escrito emapps/freeswitch-events/src/trunk-status.ts, baseado no mesmonormalizeEslEventjá testado pra eventos CHANNEL_), mas o evento não foi observado chegando em ~90s de monitoramento mesmo com o gateway mudando de estado de verdade no FreeSWITCH (FAIL_WAIT/DOWN). Os eventossofia::*(CUSTOM) nunca foram provados funcionando nesta sessão — só CHANNEL_ foi verificado de ponta a ponta até agora. Precisa de investigação com um alvo SIP real (outro FreeSWITCH, por exemplo) antes de confiar em atualização automática de status em produção. Ver docs/TRUNKS.md. - Quota de troncos — depende de Plans/Entitlements (não existe ainda)
PHASE 10 — Dialplan (agente.md secao 43-44)
-
dialplan_extensions(tenant-scoped, RLS) — editor estruturado: context, condition field/expr, actions/anti-actions (JSON), continue, order, enabled -
dialplan_versions(tenant-scoped, RLS) — gerar/validar/versionar/ ativar; reativar versão antiga = rollback (sem endpoint separado) -
apps/api/src/dialplan: extensions CRUD +versions/generate+versions/:id/activate, permissionsfreeswitch.view/.configure -
Allowlist de applications seguras (
ALLOWED_DIALPLAN_APPLICATIONS, semsystem/exec/etc — agente.md secao 180) -
b2bcall-fs-configserve a versão ACTIVE dinamicamente por chamada (resolve tenant viavariable_b2bcall_tenant_id, não domain — não sofre da limitação de multi-domínio do directory) -
Testado ponta a ponta: criar extension → gerar v1 → ativar → originate passando pelo dialplan de verdade → CALL_CREATED/ANSWERED/ENDED com tenantId correto. Criar v2 → ativar (v1 vira SUPERSEDED) → reativar v1 (rollback, v2 vira SUPERSEDED). Tudo confirmado via API.
-
ACHADO CRÍTICO, corrigido nesta fase: testando a allowlist com
application: "system", a API aceitou (201) —ValidationPipedo Nest estava completamente inoperante em todaapps/apidesde que ela foi criada (todo@Body(), todos os controllers) porquetsx(esbuild) não emitedesign:paramtypescorretamente pra tipos importados de outro arquivo, e o Nest pula validação silenciosamente quando não reconhece o tipo. Corrigido:apps/apiagora builda comtscde verdade antes de rodar (tsc && tsx dist/main.js) — nunca maistsx src/main.tsdireto. Ver docs/VALIDATION_PIPE_BUG.md. Reverificado com 2 testes deliberados pós-correção, ambos corretamente rejeitados com 400. -
Só 1 condition por extension (simplificação) — FreeSWITCH suporta múltiplas em sequência, não implementado
-
dialplan.view/.managenão existem — reuseifreeswitch.*
PHASE 11 — mod_callcenter / Queues (agente.md secao 37, 50-51)
- Investigado
help callcenter_configreal antes de codar: filas só têmload/unload/reload(XML estático + reload, semqueue add); agentes e tiers são 100% dinâmicos via comando ESL (agent add,tier add) — próxima fase, sem arquivo nenhum queuestable (tenant-scoped, RLS) — strategy, moh/announce, wait times, tier rules, discard/abandoned, skip-external-calls, recording_enabledpackages/telephony:buildQueueXml()overrides/autoload_configs/callcenter.conf.xmlprópria (zera agents/tiers estáticos da vanilla, incluicallcenter_queues.conf.d/*.xmlvia X-PRE-PROCESS)apps/api/src/queues: CRUD (POST/GET/GET:id/DELETE), permissionsqueues.view/.manageb2bcall-fs-config(queue-sync.ts): 1 arquivo por fila (volume compartilhado), sincroniza via Redis pub/sub (b2bcall:queues:sync)- Achado real, confirmado testando manualmente antes de escrever código:
queue loadfalha se o arquivo foi adicionado depois do boot — precisa dereloadxmlprimeiro; depois disso,queue reloadsozinho serve tanto pra criar quanto atualizar - Testado ponta a ponta: criar fila (ROUND_ROBIN, maxWaitTime=120,
discardAbandonedAfter=90) →
callcenter_config queue listmostra os parâmetros corretos → deletar → lista volta vazia - Agentes/Tiers/Pausas (secao 45-49) — próxima fase
- Monitoramento em tempo real (secao 54) — depende de WebSocket
- Quota de filas — depende de Plans/Entitlements
PHASE 12 — Agentes, Tiers, Pausas (agente.md secao 45-49, 52)
agents/tiers/agent_sessions/agent_state_events/pause_reasons/agent_pause_events(tenant-scoped, RLS) — separa User/Agent/Extension (secao 45)- Corrigidos bugs reais em
FreeSwitchTelephonyProvider(nunca testados antes):addAgentToQueue/removeAgentFromQueueusavam "queue add/del member", que não existe — comando certo étier add/tier del. AdicionadosaddAgent/removeAgent(agent add/agent del), que faltavam por completo. - Confirmado manualmente antes de codar:
agent add/tier addduplicado dá erro ("already exist", capturado e ignorado no sync);agent del/tier delem algo inexistente não dá erro;agent set statussó aceitaAvailable/On Break/Logged Out - Sync 100% dinâmico via ESL (sem arquivo, diferente de Trunks/Queues):
b2bcall:agents:sync/b2bcall:tiers:sync(Redis pub/sub com payload por ação, não um resync geral) apps/api:/agents(CRUD provisionamento),/agents/me/login| logout|pause|resume(sempre sobre o agente do usuário autenticado, nunca um id arbitrário do client),/pause-reasons,/queues/:id/agents(tier assignment)- Achado de corrida real, visto no teste ponta a ponta: atribuir tier antes do primeiro login falha (agente ainda não existe no FreeSWITCH) — login sempre re-sincroniza todos os tiers do agente, autocorrigindo. Confirmado acontecendo exatamente assim no teste.
- Testado ponta a ponta os 4 estados: login→Available, pause→On Break,
resume→Available, logout→Logged Out — todos confirmados batendo
entre
Agent.state(banco) ecallcenter_config agent list(FreeSWITCH) - Estados derivados de chamada (RINGING/IN_CALL/WRAP_UP/RESERVED) —
mecanismo de entrega do
callcenter::infocorrigido e confirmado (ver PHASE 13); persistir emAgent.stateainda não implementado PauseReason.maxDurationnão é aplicado automaticamente- Quota de agentes — depende de Plans/Entitlements
- Achado sistêmico:
@@uniquecombinado com soft delete (sem excluirdeletedAt) emAgent/Extension/Trunk/Queue/PauseReason— não dá pra reusar número/nome/código depois de apagar. Precisa de índice único parcial em cada um, migration própria (ver docs/AGENTS.md)
PHASE 13 — Realtime Monitoring / WebSocket multi-tenant (agente.md secao 54-55, 161)
- Bug real, achado nesta fase: nenhum evento CUSTOM do ESL
(
sofia::register,sofia::gateway_state,callcenter::info) jamais chegava emb2bcall-fs-events—event_json(...)mandava"CUSTOM"como último token do comandoevent json, sem subclass depois (mod_event_socket exige os subclasses logo depois do token CUSTOM no mesmo comando). Corrigido separandoPLAIN_EVENTS/CUSTOM_SUBCLASSES. Resolve as lacunas documentadas em PHASE 09/12 e docs/TRUNKS.md/AGENTS.md. - Corrigido de quebra:
CC-Agent-Status(não existe) →CC-Agent-State(campo real); novos tipos normalizadosAGENT_OFFERED_CALL,AGENT_BRIDGE_FAILED,QUEUE_MEMBER_COUNT,QUEUE_MEMBER_LEFT - Corrigido de quebra:
sofia profile external rescannunca descarregava um gateway cujo arquivo foi apagado (fantasma na memória do Sofia) —trunk-sync.tsagora rodakillgw <nome>pra cada gateway removido tenant-resolve.ts(fs-events): resolve tenantId por fan-out (agente/fila não carregamb2bcall_tenant_id— só existe a partir do Predictive Engine), cacheado por idapps/api:RealtimeGateway(socket.io sobre o Fastify HTTP server), auth via JWT no handshake (monitoring.view), uma room por tenant (tenant:<id>) — nunca broadcast global, sempreserver.to(room)(secao 161: tenant-scoped no servidor, nunca filtrar só no browser)RealtimeRedisBridge: assinab2bcall:events(canal único, mesmo usado desde Event Socket), reencaminha pro tenant certoAGENT_STATE_CHANGEDpublicado direto deagents-me.controller.ts(login/logout/pause/resume) — tenantId já vem do JWT, sem fan-out- Testado ponta a ponta: login/pause/resume/logout via WS, chamada de teste numa fila real (QUEUE_MEMBER_COUNT/LEFT, AGENT_OFFERED_CALL, AGENT_BRIDGE_FAILED, AGENT_STATUS_CHANGED com CC-Agent-State correto), token inválido desconectado na hora
- Ramais/extensões (secao 55 completa: busy/registro) — precisa de SIP real pra testar, e extrair ramal dos headers de canal (não feito)
- TME/TMA/Service Level/Abandon Rate — dependem de CDR (fase futura)
- Snapshot/reconciliação ao reconectar o WebSocket
PHASE 14 — Plans/Entitlements (agente.md secao 56-62)
- Fase que tinha ficado pra trás: a ordem de implementação (secao 232)
coloca Plans/Entitlements logo depois de PostgreSQL RLS, bem antes de
FreeSWITCH — mas o build seguiu direto sem essa peça. Toda fase desde
então documentou "quota depende de Plans/Entitlements" como
pendência. Fechado agora, antes de Campanhas (que dependem de
max_campaigns) e do CPS Limiter (que vai depender demax_cps) plans(catálogo compartilhado, sem RLS — não é tenant-scoped) +tenants.plan_idobrigatório (nunca null: campo de limite null = "sem limite", nunca "sem plano", agente.md secao 56)- Migration hand-escrita: cria
plans, insere seed "trial", faz backfill deplan_idpros tenants existentes, só depoisNOT NULL(Postgres não deixaNOT NULLsem default em tabela não-vazia) packages/entitlements(pacote novo):assertQuota/assertFeatureEnabled, erros mapeados pra 403 noDomainExceptionFilter- Retrofit nos controllers existentes: Extensions/Trunks/Agents/Queues agora contam linhas ativas e checam quota antes de criar
- Testado ponta a ponta: 5 extensões OK (limite do trial), 6a rejeitada com 403 "Quota excedida: maxExtensions (limite do plano: 5)"
PHASE 15 — Campanhas, Leads, Lista de Bloqueio (agente.md secao 63-71)
campaigns/leads/suppression_entries(tenant-scoped, RLS) — só modelo/CRUD/máquina de estados; o motor que origina chamadas de verdade (PredictiveDialerEngine) é uma fase à parte, deliberadamente não implementada aqui (agente.md secao 72: "não é sófor lead -> originate")- Máquina de estados da campanha (secao 64-66): start/pause/drain/stop com tabela de transições válidas — tentar uma transição inválida (ex.: pause numa DRAFT) retorna 400, nunca ignora silenciosamente
packages/shared/src/phone.ts(secao 70): normalização dedicada, preparada pra E.164 completo, só BR implementado por enquanto- Importação CSV em batches de 1000 (secao 69): detecta duplicado (dentro do CSV + contra leads já existentes), checa lista de bloqueio (importa como DO_NOT_CALL, não descarta), retorna resumo {total, valid, invalid, duplicates, imported, suppressed}
- Lista de bloqueio (secao 71): CRUD tenant-scoped
- Testado ponta a ponta: campanha com queueId/trunkId inválido rejeitada, pacingMin > pacingMax rejeitado, CSV de 5 linhas (1 inválida, 1 duplicada, 1 bloqueada) importado corretamente, start->pause->drain->stop e transições inválidas todas corretas, 3a campanha rejeitada por quota (max_campaigns=2 do plano trial)
PredictiveDialerEngine(secao 72-86) — dados em tempo real, EWMA, CPS distribuído, reserva atômica de lead, lock de campanha, originate via bgapi, state machine da chamada, controle de abandono, retry — implementado na PHASE 16- Wizard visual de importação (upload de arquivo) — fase Frontend
- Relatório de campanha (secao 160) — depende de CDR
PHASE 16 — CPS Limiter / Predictive Dialer Engine (agente.md secao 72-86, 77-79)
- Novo serviço
apps/predictive-dialer(mesmo padrão de fs-events/ fs-config: Node standalone em Docker, ESL própria, tick a cada 2s sobre tenants ativos x campanhas RUNNING/WAITING_SCHEDULE) - Lock de campanha (
dialer:campaign:{id}, secao 79): TTL, ownership token, renewal, safe release (Lua compare-and-delete) — testado isolado, outro dono nunca rouba nem renova o lock de quem já tem - CPS distribuído (secao 77, 62): token bucket janela de 1s (Lua atômico), hierarquia GLOBAL/TENANT/TRUNK/CAMPAIGN numa única chamada — testado isolado, nível esgotado bloqueia todos SEM incremento parcial dos que passariam
- Reserva atômica de leads (secao 78):
FOR UPDATE SKIP LOCKEDraw SQL dentro da mesma transaçãowithTenantContext CallAttempt/CampaignStats(schema novo): state machine da chamada (secao 82) + EWMA (secao 75, alpha=0.25) de answer_probability/average_answer_delay/average_talk_time/ abandon_rate, persistida por campanha- Capacidade em tempo real + pacing (secao 73-76, 84-85): conta agentes por estado via Tier->Agent.state, previsão de liberação simplificada (horizonte único de 15s em vez dos 4 buckets da especificação), controle de abandono reduz pacing progressivamente, nunca origina sem capacidade prevista
- Modo simulação (secao 185): DIALER_SIMULATION=true (default) sorteia ANSWER/BUSY/NO_ANSWER/FAILED em software, sem PSTN real. Só quando ANSWERED é que uma chamada sintética (null/dummy, sem PSTN) entra na fila real via mod_callcenter de verdade — maximiza código real exercitado em vez de simular tudo em memória
- Real Outbound Safety (secao 186): as duas flags (DIALER_SIMULATION=false + ALLOW_REAL_OUTBOUND_CALLS=true) checadas no boot, nunca ativado automaticamente — caminho PSTN real implementado mas nunca exercitado (sem trunk real neste laboratório)
- Bug real, achado no teste desta fase: perna sintética (null/
dummy) não tem mídia do outro lado — nunca desliga sozinha depois de
bridgear com um agente. Corrigido com hangup agendado via
uuid_killno talk_time simulado. - Bug real, achado no teste desta fase: corrida entre
queue:syncetier:sync(dois canais Redis independentes, sem ordem garantida) — atribuir tier logo depois de criar a fila podia rodartier addantes doqueue reloadterminar ("-ERR Queue not found!", diferente do já conhecido "already exist"). Corrigido com retry curto emagent-sync.ts::addTierWithRetry. GET /campaigns/:id/stats(secao 227.7 "visualizar pacing"): CampaignStats + contagem de agentes por estado + calls em andamento- Testado ponta a ponta: campanha RUNNING originando 3 tentativas por
tick, outcomes simulados corretos com retry agendado, uma chamada
simulada-ANSWERED completando o ciclo real inteiro (queue -> agente
-> bridge -> hangup -> EWMA atualizada), stop não derruba chamada
ativa (secao 66), calls_answered=3 confirmado no
queue listdo FreeSWITCH ao final - Previsão de 4 buckets (5/10/15/20s, secao 74) — simplificado pra um único horizonte de 15s
- mod_avmd (secao 87), callbacks agendados (secao 88), disposições de agente (secao 89) — fora do escopo, ficam pra fase CDR
- CPS a nível de trunk — só aplica quando o caminho PSTN real rodar
- Relatório de campanha (secao 160), TME/TMA/Service Level/Abandon Rate agregados — implementado na PHASE 17
PHASE 17 — CDR (agente.md secao 152-160)
calls/call_legs/call_events(tenant-scoped, RLS) +dispositions(secao 89).dial_attemptsda especificação não virou tabela nova —CallAttempt(fase Predictive Engine) já cobre o conceito;Call.attemptIdliga um Call à sua tentativaapps/freeswitch-events/src/cdr.ts: cada NormalizedEvent relevante faz upsert em Call + insere em call_events; CALL_ENDED calcula os agregados em segundos (secao 155-156: ringTime/waitTime/talkTime/ durationSeconds/billableSeconds)- Bug real, achado no teste desta fase:
AGENT_OFFERED_CALL/AGENT_BRIDGE_FAILEDdisparam de uma thread interna do mod_callcenter sem contexto de channel — não têm header Unique-ID, entãocallUuidficava undefined e os dois eram descartados silenciosamente (Call.queueId/agentId nunca preenchidos mesmo com bridge/falha de bridge reais). Corrigido com fallback proCC-Member-Session-UUID(data.memberSessionUuid). - Bug real, achado no teste desta fase: corrida entre
CALL_CREATED/CALL_ANSWERED (persistCallEvent roda sem await, cada
evento abre sua própria transação) podia fazer
answerAtaparecer antes decreatedAtquando o upsert que criava a linha usavanow()do momento errado. Corrigido setandocreatedAtexplicito a partir denormalized.occurredAtno branch de criação. GET /reports/queues(secao 159): recebidas/atendidas/abandonadas/ TME/TMA/Service Level/Abandon Rate por filaGET /reports/agents(secao 158): tempo logado/pausado/por estado (AgentStateEvent pareado) + chamadas atendidas/TMAGET /reports/campaigns(secao 160): leads/attempts/answered/agent connected/busy/no answer/failed/callbacks/rates/TME/TMA — "Valor Telefonia"/"Valor IA" ficam null (dependem de Billing)GET /calls(secao 157, filtros por data/ramal/agente/fila/ campanha/trunk/telefone/hangup cause/disposição) +PATCH /calls/ :id/disposition(secao 89, o próprio agente que atendeu marca, ou supervisor com agents.manage)- Testado ponta a ponta: campanha com 5 leads, 3 ANSWERED simulados entrando na fila real, Call.queueId/agentId/hangupCause corretos (confirmando a correção da correlação), createdAt<=answerAt em todos, durationSeconds batendo com discard_abandoned_after; os 3 relatórios com números internamente consistentes entre si e com os logs do discador; disposição gravada com ownership check correto
- extensionId/sipCallId/callerNumber/calledNumber — não populados ainda (nenhum evento atual carrega esses dados de forma confiável)
- direction: só distingue OUTBOUND (tem campanha) de INTERNAL — detecção de INBOUND de verdade não implementada
- call_legs — schema existe, nada escreve ainda (só faz sentido com transferência entre uuids)
- Cross-tenant reports pra platform admin (secao 157) — sem console de plataforma ainda
PHASE 18 — Recording / Object Storage (agente.md secao 90-94)
packages/storage:ObjectStorageProvider(secao 92) — Local (filesystem, com checagem de path traversal) e S3-compatible (@aws-sdk/client-s3, preparado pra MinIO — nunca exercitado nesta sessão, sem servidor S3 disponível). Escolhido porSTORAGE_PROVIDERenv, cada processo monta o seubuildRecordingObjectKey(secao 93):tenants/{tenant_id}/recordings/YYYY/MM/DD/{call_id}.wav, sempre montada no servidor- Bind mounts (não volumes nomeados) pro spool de gravação e pro
storage local —
apps/apiroda no host, precisa enxergar os mesmos arquivos quefs-eventsescreve (mesmo padrão deREDIS_URL) apps/predictive-dialer:RECORD_STEREO=true+execute_on_answer='record_session ...'quandoCampaign.recordingEnabled—origination_uuidpré-gerado pra poder montar o path de gravação antes do originateapps/freeswitch-events/src/recording.ts: em CALL_ENDED (encadeado depois do CDR terminar, não em paralelo — evita a mesma corrida já corrigida na fase CDR), sobe a gravação, criaRecording(retentionUntila partir dePlan.recordingRetentionDays), apaga o spool localGET /recordings,GET /recordings/:id,GET /recordings/:id/audio(stream autenticado, nunca URL direta pro storage)- Retenção (secao 94):
runRetentionSweepno boot doapps/api+ a cada hora — apaga o objeto, marcastatus=DELETED(linha nunca apagada, fica como auditoria) - Bug real, achado no teste desta fase:
Recording.sizeBytes(BigInt) quebravaGET /recordingscom 500 — Fastify não serializa BigInt nativamente (mesma classe de bug já corrigida uma vez no logger). Corrigido convertendo pranumberna resposta. - Testado ponta a ponta: gravação real criada (RIFF WAVE, PCM 16-bit, ESTÉREO 8000Hz — RECORD_STEREO confirmado), upload com path exato da secao 93, download via API com md5 idêntico ao objeto original, varredura de retenção apagando objeto + status DELETED + list/ download bloqueados depois
- Chamadas manuais/internas não são gravadas — só o caminho do discador tem originate próprio
max_recording_storage_gb(Plan) existe mas não é aplicado- Transcrição (secao 95+, fase IA)
PHASE 19+ — ver agente.md seções 95 em diante (AI, Billing, Frontend,
Security, Tests)
Riscos conhecidos
- RAM da VM (1.9GB total): medido com Postgres+Redis+FreeSWITCH rodando juntos — ~91MB no total (Postgres 37MB, Redis 10MB, FreeSWITCH 44MB), bem tranquilo. O risco real ainda não testado é o build/runtime do Next.js (frontend) e vários workers Node simultâneos — reavaliar quando chegarmos lá.
- Disco (26GB livre): build do FreeSWITCH + imagens Docker + gravações vão consumir
espaço rápido. Monitorar com
df -h.