QA Telemetry · 2026-07-21 08:57

Janela 24h/72h · Ambientes afetados 50/158 · bruto 24h 6.665 · 72h 21.077 · 84 queries · anterior 2026-07-07 09:19 (2 semanas atrás) · snapshot 08:57 · copiar versão Slack/Jira ↗

🔴 8 pedem ação · 7 crescendo
🔴8 problemas pedindo ação, 7 crescendo · 5 pode ter surgido numa versão recente. Comece por: BusinessException: A consulta não pôde ser executada: Binder Error….
Precisa de ação
6.093 ▲ 1269% subindo
8 problemas
◆ novo nesta leitura · estimativa
pico 6.093 · 15 snapshots
Acompanhar
557 ▼ 15% caindo
17 problemas
Sem impacto
13 ▼ 94% caindo
dev / infra
Clientes afetados
32 ▲ 28% subindo
de 158

📈 Tendência — ~7 dias · está piorando ou melhorando?

03.3326.66326/06 14h: 2.370 erros27/06 12h: 1.826 erros27/06 14h: 1.686 erros28/06 10h: 922 erros28/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros26/0628/0629/0602/0706/0721/07
Último snapshot: 6.093 erros que pedem ação, 557 para acompanhar, 13 sem impacto.
Precisa de açãoAcompanharSem impacto
📅 desde 26/06 14h · 15 leituras (uma a cada ~12h) · eixo Y = erros/24h
ver linha do tempo detalhada — data e hora de cada leitura
03.3326.66326/06 14h: 2.370 erros27/06 12h: 1.826 erros27/06 14h: 1.686 erros28/06 10h: 922 erros28/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros26/06 14h27/06 12h27/06 14h28/06 10h28/06 14h29/06 08h29/06 14h30/06 08h01/07 08h02/07 08h03/07 09h04/07 09h06/07 08h07/07 09h21/07 08h

🧩 Saúde por módulo — qual área dói mais (24h)

🔥 Conciliação · Casamento de transações média
5.678/24h
Frontend · Tela/UI média
442/24h
Analytics · Análise alta
30/24h
ver mais 7 módulos
Notificação · E-mail alta
117/24h
Persistência · Banco da plataforma (SQL Server) alta
31/24h
Processos · Execução de fluxo média
245/24h
Plataforma · Mensageria (Rabbit) média
53/24h
ETL · Carga de Análise (ETL) média
12/24h
Integrações · Storage/SFTP alta
12/24h
Módulo derivado da assinatura do erro (regra auditável; passe o mouse pra ver). alta namespace específico · média wrapper/texto · baixa só origem. Ordenado por severidade; a barra mede volume.
🎯 Resolver primeiro — o que consertar agora, por prioridade: versão nova → crescendo → vários ambientes → volume
BusinessException: A consulta não pôde ser executada: Binder Error…CRÔNICO🔍 v16.3.9? (possível regressão da versão recente — a confirmar)↩ histórico de escape🔬 investigar🌙 Pico de logs às 8h · fora do expediente▲ 48308% subindocrônico (visto em 15 de 15 snapshots)
5.470/24h18.879 · 72h
Módulo Conciliação · Casamento de transações · origem Back · Concentrado em 1 cliente: holambracoop (100% dos casos) · constante · apareceu pela 1ª vez há 24 dias
priorizado por: suspeita de versão recente (hipótese)
versão16.3.31 · 100% (+2)
A análise não carrega o resultado e a tela mostra erro na consulta; praticamente todo o volume vem de um único cliente, cujas análises deixam de funcionar.
ver diagnóstico e possível causa
🔍 suspeita de versão concentrado na versão 16.3.9 e crescendo — investigar o que mudou nessa versão (hipótese a confirmar). ver só nesta versão ↗ (abre o Loki em nova aba)
🧭 Onde aconteceAcontece no processamento da análise/conciliação, quando o motor de dados executa a consulta sobre a área de staging do cliente (DataEngine/DuckDB).
👁 O que o cliente vêA análise não carrega o resultado e a tela mostra erro na consulta; praticamente todo o volume vem de um único cliente, cujas análises deixam de funcionar.
🤔 Causa provávelA consulta referencia uma coluna que não existe na base do cliente ("valor_emissao") — as colunas disponíveis têm outros nomes ("Saldo Final", "Saldo Inicial", "Classificação"). Parece uma definição de análise/consulta desalinhada com o layout de dados desse cliente, não um defeito de versão. Hipótese, confirme no Loki. confiança média
↩ Histórico da área5 escapes catalogados em Conciliação: PRD-9833, bug-stats-47749, PRD-8915, PRD-8969, Mesclar-chave-fraca — matriz de escape ↗. Calibração de conciliação e UI de matching pesado já vazaram pra produção e recorreram após fix (travamento em 80%, concorrência EF nas estatísticas, cartesiano por chave fraca). Histórico da área, a confirmar — não é veredito deste erro.
📋 Regras do módulomatching-business-rules.md ↗ — leia as regras de negócio de Conciliação pra confirmar qual se aplica
0h–1h · 277 erros · 5% do dia1h–2h · 275 erros · 5% do dia2h–3h · 277 erros · 5% do dia3h–4h · 276 erros · 5% do dia4h–5h · 278 erros · 5% do dia5h–6h · 278 erros · 5% do dia6h–7h · 280 erros · 5% do dia7h–8h · 277 erros · 5% do dia8h–9h · 544 erros · 9% do dia · pico9h–10h · 505 erros · 8% do dia · horário comercial10h–11h · 256 erros · 4% do dia · horário comercial11h–12h · 228 erros · 4% do dia · horário comercial12h–13h · 58 erros · 1% do dia · horário comercial13h–14h · 232 erros · 4% do dia · horário comercial14h–15h · 275 erros · 5% do dia · horário comercial15h–16h · 216 erros · 4% do dia · horário comercial16h–17h · 55 erros · 1% do dia · horário comercial17h–18h · 138 erros · 2% do dia · horário comercial18h–19h · 119 erros · 2% do dia19h–20h · 20 erros · 0% do dia20h–21h · 277 erros · 5% do dia21h–22h · 277 erros · 5% do dia22h–23h · 275 erros · 5% do dia23h–24h · 273 erros · 5% do dia
0h9h18h23h
A maior parte dos erros ocorre fora do horário comercial, com pico por volta das 8h — provável tarefa agendada, deploy ou infraestrutura, sem cliente na ponta.
🧵 traceId: 39e398bb-34aa-47ad-8cf… ↗
↳ at Dattos.Platform.ExternalServices.DataEngine.DataEngineQueryService.<StagingQueryAsync>d__2.MoveNext() in C:\jenkins-dev\workspace\dattos-recon-net_master\Dattos.Platform.Externa
FrontException: Cannot read properties of undefined (reading 'map')…CRÔNICO🔍 v16.3.9? (possível regressão da versão recente — a confirmar)♻️ refatorar🌙 Pico de logs às 1h · fora do expediente▲ 574% subindocrônico (visto em 15 de 15 snapshots)
442/24h445 · 72h
Módulo Frontend · Tela/UI · origem Front · Concentrado em 1 cliente: local-denis (74% dos casos) · em alta · apareceu pela 1ª vez há 24 dias
priorizado por: suspeita de versão recente (hipótese)
versão16.4.3 · 93% (+4)
Parte da tela quebra ou não exibe um valor; o usuário vê campo vazio ou comportamento estranho.
ver diagnóstico e possível causa
🔍 suspeita de versão concentrado na versão 16.3.9 e crescendo — investigar o que mudou nessa versão (hipótese a confirmar). ver só nesta versão ↗ (abre o Loki em nova aba)
🧭 Onde aconteceAcontece na interface, ao montar telas com dados ainda não carregados (ex.: filtros de etapa).
👁 O que o cliente vêParte da tela quebra ou não exibe um valor; o usuário vê campo vazio ou comportamento estranho.
🤔 Causa provávelErro de JavaScript "Cannot read properties of undefined (reading map)" no carregamento do filtro de etapa (StepFormFilter), espalhado por mais de 30 clientes. Provável dado assíncrono não tratado no componente. Confirme no Loki. confiança média
0h–1h · 0 erros · 0% do dia1h–2h · 331 erros · 75% do dia · pico2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 11 erros · 2% do dia · horário comercial11h–12h · 6 erros · 1% do dia · horário comercial12h–13h · 2 erros · 0% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 2 erros · 0% do dia · horário comercial15h–16h · 3 erros · 1% do dia · horário comercial16h–17h · 7 erros · 2% do dia · horário comercial17h–18h · 68 erros · 15% do dia · horário comercial18h–19h · 6 erros · 1% do dia19h–20h · 2 erros · 0% do dia20h–21h · 4 erros · 1% do dia21h–22h · 0 erros · 0% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre fora do horário comercial, com pico por volta das 1h — provável tarefa agendada, deploy ou infraestrutura, sem cliente na ponta.
ArgumentNullException: Value cannot be null. Parameter name: entity…CRÔNICO🔍 v16.3.31? (possível regressão da versão recente — a confirmar)🐞 corrigir bug🕘 Pico de logs às 9h▲ 180% subindocrônico (visto em 15 de 15 snapshots)
13/24h14 · 72h
Módulo Indeterminado · origem Back · Concentrado em 1 cliente: allcare (64% dos casos) · em alta · apareceu pela 1ª vez há 24 dias
priorizado por: suspeita de versão recente (hipótese)
versão16.4.3 · 86% (+1)
Rajada concentrada na Edenred cessou: 2 ocorrências em 24h (era 1.011). As 1.034 em 72h refletem a rajada anterior (por volta das…
ver diagnóstico e possível causa
🔍 suspeita de versão concentrado na versão 16.3.31 e crescendo — investigar o que mudou nessa versão (hipótese a confirmar). ver só nesta versão ↗ (abre o Loki em nova aba)
Rajada concentrada na Edenred cessou: 2 ocorrências em 24h (era 1.011). As 1.034 em 72h refletem a rajada anterior (por volta das 18h de anteontem).
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 3 erros · 21% do dia · pico10h–11h · 0 erros · 0% do dia · horário comercial11h–12h · 3 erros · 21% do dia · horário comercial12h–13h · 2 erros · 14% do dia · horário comercial13h–14h · 2 erros · 14% do dia · horário comercial14h–15h · 0 erros · 0% do dia · horário comercial15h–16h · 0 erros · 0% do dia · horário comercial16h–17h · 0 erros · 0% do dia · horário comercial17h–18h · 3 erros · 21% do dia · horário comercial18h–19h · 1 erro · 7% do dia19h–20h · 0 erros · 0% do dia20h–21h · 0 erros · 0% do dia21h–22h · 0 erros · 0% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 9h — provável impacto real de cliente.
↳ at Dattos.Platform.Hub.Signalr.NotificationHub.LeaveGroup(String groupName) in C:\jenkins-dev\workspace\dattos-recon-net_master\Dattos.Platform.Hub.Signalr\NotificationHub.cs:line

+ 5 que também pedem ação — abra a aba 🗂 Tabela (ordenada por volume).

📊 Gráficos — toda a análise visual num lugar só. Tudo derivado dos snapshots gravados, mesma régua da Triagem.
🎯 O que atacar — impacto — quem dói, em quem, e quantos itens pedem ação

🏆 Top ofensores por volume — com cliente mais impactado — 24h · eixo fixo (maior = 5.470) · cor = balde de ação

5.470/24h
👤 mais impactado: holambracoop · 100% · espalhado por 10 ambientes
442/24h
👤 mais impactado: local-denis · 74% · espalhado por 25 ambientes
219/24h
👤 mais impactado: NoWebsite · 35% · espalhado por 31 ambientes
102/24h
👤 mais impactado: query-srv-rc · 99% das ocorrências · v16.4.2
68/24h
👤 mais impactado: local-denis · 35% · espalhado por 7 ambientes
65/24h
👤 mais impactado: sample · 80% · espalhado por 7 ambientes
52/24h
👤 mais impactado: dattos (BTG) · 100% das ocorrências · v15.4.11
32/24h
👤 mais impactado: NoWebsite · 71% · espalhado por 4 ambientes
31/24h
👤 mais impactado: NoWebsite · 87% · espalhado por 11 ambientes
30/24h
👤 mais impactado: csf-qa · 27% · espalhado por 8 ambientes
Precisa de açãoAcompanharSem impacto
A cabeça da distribuição costuma responder por boa parte da carga acionável; a cor mostra o balde de ação. Cliente e percentual vêm da coluna de ambiente do snapshot. Detalhe por linha na aba Tabela ↗.

📦 Carga por cliente — produção · não-ruído · 72h · eixo fixo (maior = 18.841)

holambracoop
18.841/72h
local-denis
369/72h
dattos (BTG)
183/72h
allcare
153/72h
agibank
92/72h
blip
47/72h
renovaenergia
38/72h
csf-qa
31/72h
afextyc
29/72h
zaffari
18/72h
tbmtextil
18/72h
ccr
18/72h
Volume de erros não-ruído por cliente de produção (top 12); a cabeça domina e o resto é cauda longa. Detalhe por cliente na aba Contexto ↗.

🧭 Os 27 itens por classificação — contagem de itens (não de volume)

8 Precisa de ação17 Acompanhar2 Sem impacto
Poucos itens pedem ação; a maioria é monitoramento. Volume ≠ nº de itens — um único item pode somar milhares de ocorrências. Lista completa na aba Tabela ↗.
📈 Tendência no tempo — está piorando ou melhorando, e em que horário

🧪 Composição da carga por classificação — ~7 dias · cada coluna = uma leitura, normalizada a 100%

26/06 14h · 44% ação · 55% acompanhar · 1% sem impacto27/06 12h · 26% ação · 66% acompanhar · 9% sem impacto27/06 14h · 19% ação · 66% acompanhar · 15% sem impacto28/06 10h · 34% ação · 38% acompanhar · 28% sem impacto28/06 14h · 46% ação · 29% acompanhar · 24% sem impacto29/06 08h · 0% ação · 98% acompanhar · 2% sem impacto29/06 14h · 34% ação · 63% acompanhar · 3% sem impacto30/06 08h · 29% ação · 71% acompanhar · 0% sem impacto01/07 08h · 35% ação · 64% acompanhar · 0% sem impacto02/07 08h · 48% ação · 52% acompanhar · 1% sem impacto03/07 09h · 59% ação · 36% acompanhar · 4% sem impacto04/07 09h · 13% ação · 71% acompanhar · 16% sem impacto06/07 08h · 0% ação · 43% acompanhar · 57% sem impacto07/07 09h · 34% ação · 50% acompanhar · 16% sem impacto21/07 08h · 91% ação · 8% acompanhar · 0% sem impacto26/06agora
Precisa de açãoAcompanharSem impacto
topo em Precisa de ação: BusinessException: A consulta não… 5.470/24htopo em Acompanhar: An error occurred while reading from… 6/24htopo em Sem impacto: session-init call failed for… 10/24h
Não é o volume (esse está na Tendência, na aba Triagem) — é a mistura: que fração de cada leitura pedia ação. Passe o mouse numa coluna para ver as frações. Os campeões refletem a leitura atual (o topo por balde de leituras passadas não é gravado).

🕘 Ritmo do dia — maior ofensor — BusinessException: A consulta não pôde… por hora (BRT, 24h)

horário comercial 9–180h–1h · 277 erros · 5% do dia · fora do expediente1h–2h · 275 erros · 5% do dia · fora do expediente2h–3h · 277 erros · 5% do dia · fora do expediente3h–4h · 276 erros · 5% do dia · fora do expediente4h–5h · 278 erros · 5% do dia · fora do expediente5h–6h · 278 erros · 5% do dia · fora do expediente6h–7h · 280 erros · 5% do dia · fora do expediente7h–8h · 277 erros · 5% do dia · fora do expediente8h–9h · 544 erros · 9% do dia · pico9h–10h · 505 erros · 8% do dia · horário comercial10h–11h · 256 erros · 4% do dia · horário comercial11h–12h · 228 erros · 4% do dia · horário comercial12h–13h · 58 erros · 1% do dia · horário comercial13h–14h · 232 erros · 4% do dia · horário comercial14h–15h · 275 erros · 5% do dia · horário comercial15h–16h · 216 erros · 4% do dia · horário comercial16h–17h · 55 erros · 1% do dia · horário comercial17h–18h · 138 erros · 2% do dia · horário comercial18h–19h · 119 erros · 2% do dia · fora do expediente19h–20h · 20 erros · 0% do dia · fora do expediente20h–21h · 277 erros · 5% do dia · fora do expediente21h–22h · 277 erros · 5% do dia · fora do expediente22h–23h · 275 erros · 5% do dia · fora do expediente23h–24h · 273 erros · 5% do dia · fora do expediente0h6h9h12h15h18h23h544
A faixa 9–18h é o horário de operação. Concentração no comercial é assinatura de uso real de cliente (não tarefa agendada); fora dele, costuma ser infra/deploy/agendado. Perfil horário só do maior ofensor deste snapshot.
👀 Acompanhar & frota — o que vigiar e o denominador de risco por versão

🛰 Saúde da frota — 53 clientes por proximidade da versão de produção (16.3.x)

40 na linha (16.3.x)3 atrás10 à frente
É o denominador que normaliza o risco por versão. Os 3 atrás (app 14.8.4, dattos (BTG) 15.4.11, dattos-uat (BTG) 15.4.17) podem carregar bug já corrigido. Detalhe por cliente na aba Contexto ↗.
👀 Contexto — acompanhar · ritmo do dia · o que mudou · clientes afetados (investigação secundária)
👀 17 p/ acompanhar · 2 sem impacto housekeeping — não atinge cliente

👀 Acompanhar — ainda não atinge cliente, ou já diminuindo

An error occurred while reading from the… · Back · crescendo · ⚠ só temos o número, sem diagnóstico6/24h
NpgsqlException: Erro durante importação ID… · Back · crescendo · ⚠ só temos o número, sem diagnóstico4/24h
Error in _create_connection(). Traceback… · Matching · crescendo · ⚠ só temos o número, sem diagnóstico32/24h
Error in _create_connection(). RabbitMQ… · Pipeline · crescendo15/24h
IOException: Error reading MIME multipart… · Back · crescendo · ⚠ só temos o número, sem diagnóstico3/24h
FormatException: Input string was not in a… · Back · sem crescer · ⚠ só temos o número, sem diagnóstico2/24h
Unexpected connection close detected… · PdfAi · sem crescer · ⚠ só temos o número, sem diagnóstico0/24h
dataengine-503-analysis-load · Back · crescendo76/24h
Error: IO Error: Cannot open database… · Pipeline+Matching · crescendo2/24h
Passa para Precisa de ação se voltar a crescer e atingir 3 ou mais ambientes.

🩹 Ruído — o que vale consertar na fonte

Consertar a fonte (some do log de verdade) — não silenciar (silenciar cega o plantão). A barra usa só a janela de 24h (base 6.665 erros).

session-init call failed for user=postgres… · Dattos-Gateway · infraestrutura sem cliente
10/24h · 0%
consertar a fonte · 👤 sem dono · definir
Redis checkpointer init FAILED… · Agents · infraestrutura sem cliente
3/24h · 0%
consertar a fonte · 👤 sem dono · definir
Consertando o maior (session-init call failed for…): o painel de 24h cairia de 6.665 para ~6.655.
🕘 Pico de erros às 1h uso real (9–18) vs infra/agendado

Erros que pedem atenção por hora do dia (últimas 24h). A faixa 9–18 é o horário comercial: erro que sobe nela tende a ser uso real de cliente; fora dela, costuma ser infra/deploy ou tarefa agendada (e-mail, importação).

horário comercial 9–180h–1h · 280 erros · 4% do dia · fora do expediente1h–2h · 606 erros · 8% do dia · pico2h–3h · 277 erros · 4% do dia · fora do expediente3h–4h · 276 erros · 4% do dia · fora do expediente4h–5h · 283 erros · 4% do dia · fora do expediente5h–6h · 280 erros · 4% do dia · fora do expediente6h–7h · 281 erros · 4% do dia · fora do expediente7h–8h · 283 erros · 4% do dia · fora do expediente8h–9h · 563 erros · 8% do dia · fora do expediente9h–10h · 559 erros · 8% do dia · horário comercial10h–11h · 291 erros · 4% do dia · horário comercial11h–12h · 293 erros · 4% do dia · horário comercial12h–13h · 124 erros · 2% do dia · horário comercial13h–14h · 273 erros · 4% do dia · horário comercial14h–15h · 294 erros · 4% do dia · horário comercial15h–16h · 259 erros · 4% do dia · horário comercial16h–17h · 129 erros · 2% do dia · horário comercial17h–18h · 277 erros · 4% do dia · horário comercial18h–19h · 174 erros · 2% do dia · fora do expediente19h–20h · 109 erros · 2% do dia · fora do expediente20h–21h · 294 erros · 4% do dia · fora do expediente21h–22h · 282 erros · 4% do dia · fora do expediente22h–23h · 424 erros · 6% do dia · fora do expediente23h–24h · 274 erros · 4% do dia · fora do expediente0h6h9h12h15h18h23h606
🔁 7 novos · 4 pararam vs 2026-07-07 09:19 · 2 semanas atrás
✅ Resolvidos (provável) — pararam de aparecer e antes pediam atenção. Parou não é o mesmo que corrigido: confirme a causa.
·
−53
·
−3
2 de 2 sem card identificado — é o esperado: a maioria some por mudança de uso ou de dado, não por correção. Ausência de card não prova nada nos dois sentidos.
👥 32 clientes atingidos · 10 em 3+ ambientes quem e onde

🌎 Por ambiente — os totais não se somam (uma mesma falha aparece em vários)

"Outros (NoWebsite)" = evento sem ambiente identificado no registro (atribuição estimada).

Homolog/UAT · 1 grupo · 334 hits
🏷 Risco por versão taxa por cliente

Ranque por taxa por cliente (erros ÷ clientes que rodam a versão), nunca por contagem bruta. Piso de 3 clientes: abaixo disso é amostra fraca.

VersãoLinhagemErros (não-ruído)ClientesTaxa/cliente
16.4.316.4.x1.3579150.8
16.4.216.4.x62162 amostra fraca
16.4.116.4.x1
16.3.3116.3.x19.30437521.7
16.3.3016.3.x221 amostra fraca
16.3.916.3.x93193 amostra fraca
15.4.1715.4.x313 amostra fraca
15.4.1115.4.x1831183 amostra fraca
14.8.414.8.x818 amostra fraca
📦 Carga por cliente (volume) top por volume

Volume de erros não-ruído por cliente de produção (top 12), base deste snapshot (61 de 158 ambientes afetados em 72h). Internos e máquinas de dev fora.

holambracoop
18.841/72h
local-denis
369/72h
dattos (BTG)
183/72h
allcare
153/72h
agibank
92/72h
blip
47/72h
renovaenergia
38/72h
csf-qa
31/72h
afextyc
29/72h
zaffari
18/72h
tbmtextil
18/72h
ccr
18/72h
🛰 Frota — versão por cliente 53 clientes

Distribuição da frota por versão (1 barra por versão; quem está atrás da versão de produção mais comum carrega bug já corrigido). É o denominador que normaliza o risco por versão.

16.4.3
9 clientes
16.4.2
1 cliente
16.3.31 ★
37 clientes
16.3.30 ★
2 clientes
16.3.9 ★
1 cliente
15.4.17
1 cliente
15.4.11
1 cliente
14.8.4
1 cliente
★ = versão de produção mais comum (16.3.x)atrásna linhaà frente
ver por cliente (53)
ClienteVersão dominanteTambém vistaAtraso?
app14.8.4⚠ versão antiga
dattos (BTG)15.4.11⚠ versão antiga
dattos-uat (BTG)15.4.17⚠ versão antiga
agibank16.3.9✓ atual
csf16.3.30✓ atual
sales16.3.30✓ atual
ache16.3.31✓ atual
atlas16.3.31✓ atual
aviva16.3.31✓ atual
bayer16.3.31✓ atual
ccab-agro16.3.31✓ atual
ccr16.3.31✓ atual
cea16.3.31✓ atual
cofco16.3.31✓ atual
colgate16.3.31✓ atual
comercialzaffari16.3.31✓ atual
conciliadorrm16.3.31✓ atual
csf-qa16.3.31✓ atual
dellys16.3.31✓ atual
edenred16.3.31✓ atual
embarca16.3.31✓ atual
fujifilm16.3.31✓ atual
gaspar16.3.31✓ atual
gruposanta16.3.31✓ atual
holambracoop16.3.31✓ atual
ipiranga16.3.31✓ atual
iugu16.3.31✓ atual
laponia16.3.31✓ atual
martins16.3.31✓ atual
natura16.3.31✓ atual
nissei16.3.31✓ atual
nutrien16.3.31✓ atual
orizon16.3.31✓ atual
pirelli_csa16.3.31✓ atual
qualicorp16.3.31✓ atual
remessaonline16.3.31✓ atual
simpaul16.3.31✓ atual
solinftec16.3.31✓ atual
solutta16.3.31✓ atual
tbmtextil16.3.31✓ atual
travelex16.3.31✓ atual
unimedprudente16.3.31✓ atual
vwfs16.3.31✓ atual
omnicom16.4.2↑ pré-lançamento
afextyc16.4.3↑ pré-lançamento
allcare16.4.3↑ pré-lançamento
blip16.4.3↑ pré-lançamento
celcoin16.4.3↑ pré-lançamento
ifoodcorp16.4.3↑ pré-lançamento
local-denis16.4.3↑ pré-lançamento
renovaenergia16.4.3↑ pré-lançamento
uniasselvi16.4.3↑ pré-lançamento
zaffari16.4.3↑ pré-lançamento
🗂 28 grupos · fonte de investigação — ordenada por volume 72h · filtrável por origem

Fonte crua de investigação: todos os grupos com classificação por IA, versões e link Loki. A ordem por volume 72h cobre o antigo "Top 10"; use o filtro por origem para fatiar por sistema.

#ClassificaçãoTipo de erroErroSistemaCliente principalNº amb.AmbientesVersões24h72hTendência
1Precisa de ação Consulta falha: coluna inexistente na base do cliente (motor de dados)BusinessException: A consulta não pôde ser executada: Binder Error…Backholambracoop10prod, eng-internal, local16.3.31, 16.3.95.47018.879▲ 48308%
2Precisa de açãoErro de tela (propriedade indefinida no carregamento)FrontException: Cannot read properties of undefined (reading 'map') Cannot…Frontlocal-denis25local, prod, dev16.3.30, 16.3.31442445▲ 574%
3AcompanharExecução de fluxo pulada porque o fluxo estava parado (Stopped)InvalidOperationException: Failed to process the job '10431494': an exception…BackNoWebsite31other, prod, eng-internal, demo, local, dev15.4.11, 16.3.30219429▲ 112%
4Precisa de açãoErro de banco/SQL (conciliação — coluna/alias vazio)SqlException: Failed to process the job '2020': An object or column name is…BackNoWebsite11other, prod, local, hom15.4.11, 15.4.1731334▲ 854%
5AcompanharAgendamento: falha ao abrir conexão no polling de regrasEntityException: Failed to execute polling task. The underlying provider…Backsergio10prod16.3.31, 16.4.20266novo
6Acompanhar Falha no serviço de Consulta (motor de dados)Exception in ASGI application + Exception Group Traceback (most recent call…Queryquery-srv-rc2other16.4.2, 16.4.3102103▼ 71%
7Acompanhar Consulta ao motor de dados falha (resposta inválida / 503)HttpRequestException: DataEngine returned an invalid JSON response on route…Backlocal-denis7local, demo, prod, dev, eng-internal16.4.36891▼ 51%
8Precisa de açãoErro de validação (e-mail sem destinatário)ArgumentException: Erro ao enviar e-mail #212147. Destinatário do e-mail não…Backsample7demo, prod, eng-internal, dev15.4.11, 16.3.316570▲ 180%
9AcompanharFalha de envio de e-mail (limite do servidor)SmtpException: Erro ao enviar e-mail #212199. Service not available, closing…Backdattos (BTG)1prod15.4.115265▲ 51%
10AcompanharErros sem classe (Matching)Error in _create_connection(). Traceback (most recent call last): File…MatchingNoWebsite4other, prod, dev, eng-internal16.4.33258novo
11Sem impactoInfraestrutura: Redis indisponível (Agents)Redis checkpointer init FAILED (TimeoutError: Timeout connecting to server) |…AgentsNoWebsite1other346▲ 360%
12AcompanharFalha de conexão do pipeline com o servidor de mensagens (RabbitMQ/callback)Error in _create_connection(). RabbitMQ blocking_connection (pika) falhou +…Pipelineblip10prod, other16.3.31, 16.4.21535▲ 52%
13Precisa de ação Erro de código (referência nula) — etapa de conciliaçãoNullReferenceException: Object reference not set to an instance of an object…Backcsf-qa8prod, demo16.3.31, 16.4.33033— sem mudança
14AcompanharFalha ao ler/gravar no banco (EF/DB)EntityCommandExecutionException: Failed to process the job '10432337': an…Backblip15prod15.4.11, 16.3.312032▲ 23%
15Precisa de açãoPermissão negada (configurar processo / pasta)AuthorizationException: Você não tem permissão para configurar um Processo…Backafextyc2prod, demo16.4.33030▲ 650%
16Acompanhar Resposta inválida do motor de dados (503)JsonReaderException: DataEngine returned non-parseable JSON on route…Backrenovaenergia7prod, demo, dev, eng-internal16.3.31, 16.4.3830▼ 65%
17AcompanharPasta de importação (SFTP) não encontradaDirectoryNotFoundException: Could not find a part of the path…Backccr1prod16.3.31618▼ 40%
18AcompanharArquivo de importação ausente no armazenamentoFileNotFoundException: File not found on storage Ttl. Details: FileName…Backbayer3prod15.4.11, 16.3.311215▼ 59%
19Acompanhar Falha transitória de importação (banco)NpgsqlException: Erro durante importação ID 2491313 The operation has timed…Backdattos (BTG)1prod15.4.11415▲ 114%
20Precisa de açãoErro de código (parâmetro nulo)ArgumentNullException: Value cannot be null. Parameter name: entity Value…Backallcare6prod, other, dev, eng-internal, demo16.3.31, 16.4.31314▲ 180%
21AcompanharFormatException (Back)FormatException: Input string was not in a correct format. Trace: at…Backdattos (BTG)1prod15.4.11212novo
22Precisa de açãoHttpException (Back)HttpException: The remote host closed the connection. The error code is…Backzaffari2prod16.3.31, 16.4.31212novo
23Sem impactoGateway/serviço novo falhandosession-init call failed for user=postgres host= Traceback (most recent call…Dattos-GatewayNoWebsite1other16.4.31011▼ 97%
24Acompanhar Erros sem classe (Back)An error occurred while reading from the store provider's data reader. See…Backapp2prod, other14.8.4, 16.4.3610novo
25AcompanharErro interno ao ativar serviço de chave de API (sem contexto de cliente)DependencyResolutionException: An exception was thrown while activating…BackNoWebsite1other16.3.3166— sem mudança
26AcompanharErros sem classe (PdfAi)Unexpected connection close detected: StreamLostError: ("Stream connection…PdfAiNoWebsite1other16.4.206novo
27AcompanharIOException (Back)IOException: Error reading MIME multipart body part. Error reading MIME…Backnatura1prod16.3.3133novo
28Acompanhar Conciliação: base temporária aberta em modo somente-leitura (DuckDB)Error: IO Error: Cannot open database "/mnt/staging/<id>/<hash>_step.duckdb"…Pipeline+Matchingallcare1prod16.4.322▼ 86%
❓ Ajuda — como ler este painel · seções que ligam quando a coleta acumular dado
❓ Como ler este painel — régua, símbolos e limites (toque para abrir)
Os 3 baldes (regra automática, auditável)
  • Precisa de ação erro de produto/dado que atinge cliente e está crescendo (≥5 ocorrências/24h) ou aparece em ≥3 ambientes sem cair (≥8/24h).
  • Acompanhar ainda não atinge cliente, ou já está diminuindo.
  • Sem impacto só em máquina de desenvolvimento ou infraestrutura, sem cliente.
  • Saturação/capacidade (disco, pool, timeout, fila) sobe para "Precisa de ação" mesmo sem cliente — precede a falha visível.

"Atinge cliente" = ambiente que não é dev (local-*), teste (eng-*), serviço ou NoWebsite. Toda contagem tem link Loki ao lado para conferir na fonte.

Símbolos
  • 🔍 vX? hipótese de regressão de uma versão recente — a confirmar, não veredito.
  • 🔗 N incidente consolidado de N erros da mesma raiz.
  • 🎫 PRD-… card Jira candidato — confirme que é o mesmo problema.
  • 🔥 módulo mais comprometido agora · crônico visto em ≥4 snapshots.
  • em alta / constante / diminuindo = ritmo recente (24h vs 72h). ▲/▼ % = tendência vs o snapshot anterior. Eixos diferentes.
  • NOVO / ESCALANDO / CRÔNICO = apareceu agora / subiu ≥50% vs ontem ou ~7d (base curta, baixa confiança) / recorrente em ≥4 snapshots. vs ontem / vs ~7d compara com o snapshot daquele período.
Cor

vermelho = precisa de ação · amarelo = acompanhar · cinza = sem impacto. Borda esquerda mais grossa = mais volume. Card apagado = perdendo força.

⏱ Horizonte: comparações cobrem ~7 dias (14 snapshots de 12/12h); não há base "vs semana/mês passado" nem horário exato de última ocorrência. 🏷 Tipo de erro é classificado por IA (pode errar — confirme no Loki). Contagens podem ser piso quando a consulta satura.