QA Telemetry · 2026-09-22 08:42

Janela 24h/72h · Ambientes afetados 75/166 · bruto 24h 9.103 · 72h 21.618 · 82 queries · anterior 2026-09-01 08:55 (3 semanas atrás) · snapshot 08:42 · copiar versão Slack/Jira ↗

🔴 5 pedem ação · 3 crescendo
🔴5 problemas pedindo ação, 3 crescendo · 1 pode ter surgido numa versão recente. Comece por: FrontException: Cannot read properties of null (reading 'length')….
Leitura do analista confiança média: A leitura da semana está distorcida por um único item: a instância DATTOS-FLAGSHIP repete desde 17/09 a mesma falha ao identificar o cliente, cerca de 250 vezes por hora, e sozinha responde por 84% do erro da casa. Ela não atendeu nenhum cliente em 7 dias, então o efeito não é no cliente e sim na leitura: tirando esse item, o volume fica em 3.426 registros em 72 horas, na mesma faixa das semanas anteriores. O que de fato atinge cliente é menor e conhecido: a tela de processo que não encontra o recurso e quebra (Edenred, Eternit, Colgate) e o valor vazio que derruba a pesquisa de tarefas e o expurgo por prazo.
📌 A fila técnica começa por FrontException: Cannot read properties of null (reading… — suspeita de versão recente (a confirmar).
Precisa de ação
856 — estável
5 problemas
≈ neste nível há ~20d · 2 leituras · estimativa
pico 1.217 · 15 snapshots
Acompanhar
7.929 ▲ 2026% subindo
11 problemas
Sem impacto
308 ▼ 39% caindo
dev / infra
Clientes afetados
32 — estável
de 166

📈 Tendência — ~7 dias · está piorando ou melhorando?

04.5479.09328/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros04/08 08h: 1.504 erros11/08 09h: 1.311 erros01/09 08h: 1.675 erros22/09 08h: 9.093 erros28/0630/0603/0707/0711/0822/09
Último snapshot: 856 erros que pedem ação, 7.929 para acompanhar, 308 sem impacto.
Precisa de açãoAcompanharSem impacto
📅 desde 28/06 14h · 15 leituras (uma a cada ~12h) · eixo Y = erros/24h
ver linha do tempo detalhada — data e hora de cada leitura
04.5479.09328/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros04/08 08h: 1.504 erros11/08 09h: 1.311 erros01/09 08h: 1.675 erros22/09 08h: 9.093 erros28/06 14h29/06 08h29/06 14h30/06 08h01/07 08h02/07 08h03/07 09h04/07 09h06/07 08h07/07 09h21/07 08h04/08 08h11/08 09h01/09 08h22/09 08h

🧩 Saúde por módulo — qual área dói mais (24h)

🔥 Frontend · Tela/UI média
215/24h
ETL · Importação média
301/24h
Analytics · Análise alta
317/24h
ver mais 8 módulos
Multi-tenancy · Resolução de tenant alta
6.469/24h
Plataforma · Mensageria (Rabbit) média
1.155/24h
Notificação · E-mail alta
84/24h
Persistência · Banco da plataforma (SQL Server) média
30/24h
Sessão · Sessão/Redis média
16/24h
Integrações · Storage/SFTP alta
13/24h
Processos · Cópia de arquivo alta
6/24h
Indeterminado baixa
179/24h
Módulo derivado da assinatura do erro (regra auditável; passe o mouse pra ver). alta namespace específico · média wrapper/texto · baixa só origem. Ordenado por severidade; a barra mede volume.
🎯 Resolver primeiro — o que consertar agora, por prioridade: versão nova → crescendo → vários ambientes → volume
FrontException: Cannot read properties of null (reading 'length')…CRÔNICO🔍 v16.3.9? (possível regressão da versão recente — a confirmar)🐞 corrigir bug🕘 Pico de logs às 12h▲ 29% subindocrônico (visto em 15 de 15 snapshots)
215/24h222 · 72h
Módulo Frontend · Tela/UI · origem Front · 20 clientes (edenred, grupoepr, eternit, +3) · em alta · apareceu pela 1ª vez há 85 dias
priorizado por: suspeita de versão recente (hipótese)
versão16.4.19 · 50% (+4)
A pessoa abre o processo e a tela quebra ou não encontra o item. São clientes reais: Edenred, Eternit, Colgate.
ver diagnóstico e possível causa
🔍 suspeita de versão concentrado na versão 16.3.9 e crescendo — investigar o que mudou nessa versão (hipótese a confirmar). ver só nesta versão ↗ (abre o Loki em nova aba)
🧭 Onde aconteceAcontece ao abrir a tela de um processo pelo endereço direto, quando o recurso pedido não é encontrado e a tela segue montando com valor vazio.
👁 O que o cliente vêA pessoa abre o processo e a tela quebra ou não encontra o item. São clientes reais: Edenred, Eternit, Colgate.
🤔 Causa provávelDuas faces do mesmo caminho: a tela não encontra o processo pelo código do endereço e, sem tratar a ausência, tenta ler o tamanho de uma lista vazia. Aparece também layout de importação não encontrado pelo código. Vale abrir um dos endereços citados e ver se o recurso existe. Hipótese, confirme no Loki. confiança média
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 2 erros · 1% do dia9h–10h · 11 erros · 5% do dia · horário comercial10h–11h · 21 erros · 10% do dia · horário comercial11h–12h · 24 erros · 11% do dia · horário comercial12h–13h · 92 erros · 42% do dia · pico13h–14h · 12 erros · 5% do dia · horário comercial14h–15h · 11 erros · 5% do dia · horário comercial15h–16h · 22 erros · 10% do dia · horário comercial16h–17h · 12 erros · 5% do dia · horário comercial17h–18h · 6 erros · 3% do dia · horário comercial18h–19h · 5 erros · 2% do dia19h–20h · 1 erro · 0% do dia20h–21h · 1 erro · 0% do dia21h–22h · 0 erros · 0% do dia22h–23h · 1 erro · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 12h — provável impacto real de cliente.
NullReferenceException: Object reference not set to an instance of an…CRÔNICO↩ histórico de escape🐞 corrigir bug🌙 Pico de logs às 23h · fora do expediente▲ 123% subindocrônico (visto em 15 de 15 snapshots)
171/24h261 · 72h
Módulo ETL · Importação · origem Back · 62 clientes (edenred, ecorodovias, csf, +3) · em alta · apareceu pela 1ª vez há 85 dias
priorizado por: crescendo agora
versão16.4.19 · 65% (+3)
Na tela de tarefas, a pesquisa não devolve resultado. No expurgo por prazo, a limpeza é abortada e os arquivos vencidos continuam ocupando espaço. Atinge clientes reais: Embarca, Edenred, Iugu, Dellys, Qualicorp.
ver diagnóstico
🧭 Onde aconteceAcontece em rotinas que recebem vazio um dado que esperavam preenchido — na pesquisa da lista de tarefas e na rotina que apaga arquivos por prazo.
👁 O que o cliente vêNa tela de tarefas, a pesquisa não devolve resultado. No expurgo por prazo, a limpeza é abortada e os arquivos vencidos continuam ocupando espaço. Atinge clientes reais: Embarca, Edenred, Iugu, Dellys, Qualicorp.
🤔 Causa provávelO grupo tem duas famílias. A pesquisa da lista de tarefas caiu para 8%, e era metade do grupo. Surgiu o expurgo por prazo, que aborta ao tentar listar a pasta raiz de arquivos e cita o cliente e o trabalho na própria linha — é o fio mais fácil de puxar. Hipótese, confirme no Loki. confiança média
↩ Histórico da área4 escapes catalogados em ETL: PRD-8903, PRD-8965, Pipeline-storage, CB-1 — matriz de escape ↗. Construtor/ETL Turbo AI é a área mais frágil catalogada (boilerplate vs banner, resumo truncado, agente PDF transiente); saturação de staging DuckDB sob volume alto. Histórico da área, a confirmar — não é veredito deste erro.
📋 Regras do móduloetl-business-rules.md ↗ — leia as regras de negócio de ETL pra confirmar qual se aplica
0h–1h · 2 erros · 1% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 1 erro · 1% do dia8h–9h · 0 erros · 0% do dia9h–10h · 1 erro · 1% do dia · horário comercial10h–11h · 6 erros · 4% do dia · horário comercial11h–12h · 3 erros · 2% do dia · horário comercial12h–13h · 10 erros · 6% do dia · horário comercial13h–14h · 8 erros · 5% do dia · horário comercial14h–15h · 13 erros · 8% do dia · horário comercial15h–16h · 10 erros · 6% do dia · horário comercial16h–17h · 18 erros · 11% do dia · horário comercial17h–18h · 18 erros · 11% do dia · horário comercial18h–19h · 21 erros · 12% do dia19h–20h · 17 erros · 10% do dia20h–21h · 1 erro · 1% do dia21h–22h · 4 erros · 2% do dia22h–23h · 2 erros · 1% do dia23h–24h · 36 erros · 21% do dia · pico
0h9h18h23h
A maior parte dos erros ocorre fora do horário comercial, com pico por volta das 23h — provável tarefa agendada, deploy ou infraestrutura, sem cliente na ponta.
🧵 traceId: 26b888da-e870-4f0a-853… ↗ · 6cd2ea49-edbe-4f14-999… ↗ · 80735235-daf1-43fe-bb0… ↗
↳ at Dattos.Platform.Services.Tasklist.CommentService.<CreateCloseNotificationAsync>d__20.MoveNext() in C:\jenkins-dev\workspace\dattos-recon-net_master\Dattos.Platform.Services\Task
ArgumentException: id Trace: System.ArgumentException: id at…CRÔNICO↩ histórico de escape🐞 corrigir bug🕘 Pico de logs às 11h▲ 623% subindocrônico (visto em 15 de 15 snapshots)
127/24h289 · 72h
Módulo ETL · Carga de Análise (ETL) · origem Back · 9 clientes (cardif-hom, dattos (BTG), eng-release, +1) · em alta · apareceu pela 1ª vez há 85 dias
priorizado por: crescendo agora
versão16.4.19 · 58% (+2)
A tela não carrega o processo pedido. Concentrado em ambiente de engenharia (eng-develop), com pouca presença em cliente.
ver diagnóstico
🧭 Onde aconteceAcontece ao abrir um processo de preparação de dados, quando o sistema busca o processo pelo identificador recebido.
👁 O que o cliente vêA tela não carrega o processo pedido. Concentrado em ambiente de engenharia (eng-develop), com pouca presença em cliente.
🤔 Causa provávelO identificador chega inválido na busca do processo. Aparece junto um segundo problema de outra natureza: o conjunto de pastas permitidas de um usuário passa do limite da consulta ao banco, o que é limite de arquitetura e não dado ruim. Vale separar os dois. Hipótese, confirme no Loki. confiança média
↩ Histórico da área4 escapes catalogados em ETL: PRD-8903, PRD-8965, Pipeline-storage, CB-1 — matriz de escape ↗. Construtor/ETL Turbo AI é a área mais frágil catalogada (boilerplate vs banner, resumo truncado, agente PDF transiente); saturação de staging DuckDB sob volume alto. Histórico da área, a confirmar — não é veredito deste erro.
📋 Regras do móduloetl-business-rules.md ↗ — leia as regras de negócio de ETL pra confirmar qual se aplica
0h–1h · 2 erros · 2% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 1 erro · 1% do dia · horário comercial10h–11h · 2 erros · 2% do dia · horário comercial11h–12h · 99 erros · 78% do dia · pico12h–13h · 9 erros · 7% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 1 erro · 1% do dia · horário comercial15h–16h · 4 erros · 3% do dia · horário comercial16h–17h · 4 erros · 3% do dia · horário comercial17h–18h · 0 erros · 0% do dia · horário comercial18h–19h · 0 erros · 0% do dia19h–20h · 0 erros · 0% do dia20h–21h · 3 erros · 2% do dia21h–22h · 2 erros · 2% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 11h — provável impacto real de cliente.
🧵 traceId: ebbee15f-3d35-44c8-b33… ↗
↳ at Dattos.Platform.Services.Matching.MatchingService.<ValidateContextAuthorizationAsync>d__66.MoveNext() in C:\jenkins-dev\workspace\dattos-recon-net_patch-15.4.18\Dattos.Platform.

+ 2 que também pedem ação — abra a aba 🗂 Tabela (ordenada por volume).

📊 Gráficos — toda a análise visual num lugar só. Tudo derivado dos snapshots gravados, mesma régua da Triagem.
🎯 O que atacar — impacto — quem dói, em quem, e quantos itens pedem ação

🏆 Top ofensores por volume — com cliente mais impactado — 24h · eixo fixo (maior = 6.469) · cor = balde de ação

6.469/24h
👤 mais impactado: NoWebsite · 97% · espalhado por 30 ambientes
733/24h
👤 mais impactado: NoWebsite · 98% · espalhado por 6 ambientes
422/24h
👤 mais impactado: NoWebsite · 67% · espalhado por 14 ambientes
303/24h
👤 mais impactado: NoWebsite · 100% das ocorrências · v16.4.5
262/24h
👤 mais impactado: conciliadorrm · 28% · espalhado por 13 ambientes
215/24h
👤 mais impactado: edenred · 42% · espalhado por 20 ambientes
171/24h
👤 mais impactado: edenred · 19% · espalhado por 62 ambientes
127/24h
👤 mais impactado: cardif-hom · 56% · espalhado por 9 ambientes
84/24h
👤 mais impactado: dattos (BTG) · 100% das ocorrências · v15.4.18
64/24h
👤 mais impactado: csf · 18% · espalhado por 19 ambientes
Precisa de açãoAcompanharSem impacto
A cabeça da distribuição costuma responder por boa parte da carga acionável; a cor mostra o balde de ação. Cliente e percentual vêm da coluna de ambiente do snapshot. Detalhe por linha na aba Tabela ↗.

📦 Carga por cliente — produção · não-ruído · 72h · eixo fixo (maior = 272)

eng-master
272/72h
edenred
236/72h
dattos (BTG)
214/72h
cardif-hom
163/72h
agibank
109/72h
conciliadorrm
98/72h
csf
88/72h
afextyc
71/72h
close
56/72h
grupoepr
53/72h
iugu
43/72h
ccr
36/72h
Volume de erros não-ruído por cliente de produção (top 12); a cabeça domina e o resto é cauda longa. Detalhe por cliente na aba Contexto ↗.

🧭 Os 18 itens por classificação — contagem de itens (não de volume)

5 Precisa de ação11 Acompanhar2 Sem impacto
Poucos itens pedem ação; a maioria é monitoramento. Volume ≠ nº de itens — um único item pode somar milhares de ocorrências. Lista completa na aba Tabela ↗.
📈 Tendência no tempo — está piorando ou melhorando, e em que horário

🧪 Composição da carga por classificação — ~7 dias · cada coluna = uma leitura, normalizada a 100%

28/06 14h · 46% ação · 29% acompanhar · 24% sem impacto29/06 08h · 0% ação · 98% acompanhar · 2% sem impacto29/06 14h · 34% ação · 63% acompanhar · 3% sem impacto30/06 08h · 29% ação · 71% acompanhar · 0% sem impacto01/07 08h · 35% ação · 64% acompanhar · 0% sem impacto02/07 08h · 48% ação · 52% acompanhar · 1% sem impacto03/07 09h · 59% ação · 36% acompanhar · 4% sem impacto04/07 09h · 13% ação · 71% acompanhar · 16% sem impacto06/07 08h · 0% ação · 43% acompanhar · 57% sem impacto07/07 09h · 34% ação · 50% acompanhar · 16% sem impacto21/07 08h · 91% ação · 8% acompanhar · 0% sem impacto04/08 08h · 66% ação · 33% acompanhar · 1% sem impacto11/08 09h · 13% ação · 55% acompanhar · 33% sem impacto01/09 08h · 47% ação · 22% acompanhar · 30% sem impacto22/09 08h · 9% ação · 87% acompanhar · 3% sem impacto28/06agora
Precisa de açãoAcompanharSem impacto
topo em Precisa de ação: FrontException: Cannot read… 215/24htopo em Acompanhar: InvalidOperationException: Error… 6.469/24htopo em Sem impacto: session-init call failed for… 303/24h
Não é o volume (esse está na Tendência, na aba Triagem) — é a mistura: que fração de cada leitura pedia ação. Passe o mouse numa coluna para ver as frações. Os campeões refletem a leitura atual (o topo por balde de leituras passadas não é gravado).

🕘 Ritmo do dia — maior ofensor — FrontException: Cannot read properties… por hora (BRT, 24h)

horário comercial 9–180h–1h · 0 erros · 0% do dia · fora do expediente1h–2h · 0 erros · 0% do dia · fora do expediente2h–3h · 0 erros · 0% do dia · fora do expediente3h–4h · 0 erros · 0% do dia · fora do expediente4h–5h · 0 erros · 0% do dia · fora do expediente5h–6h · 0 erros · 0% do dia · fora do expediente6h–7h · 0 erros · 0% do dia · fora do expediente7h–8h · 0 erros · 0% do dia · fora do expediente8h–9h · 2 erros · 1% do dia · fora do expediente9h–10h · 11 erros · 5% do dia · horário comercial10h–11h · 21 erros · 10% do dia · horário comercial11h–12h · 24 erros · 11% do dia · horário comercial12h–13h · 92 erros · 42% do dia · pico13h–14h · 12 erros · 5% do dia · horário comercial14h–15h · 11 erros · 5% do dia · horário comercial15h–16h · 22 erros · 10% do dia · horário comercial16h–17h · 12 erros · 5% do dia · horário comercial17h–18h · 6 erros · 3% do dia · horário comercial18h–19h · 5 erros · 2% do dia · fora do expediente19h–20h · 1 erro · 0% do dia · fora do expediente20h–21h · 1 erro · 0% do dia · fora do expediente21h–22h · 0 erros · 0% do dia · fora do expediente22h–23h · 1 erro · 0% do dia · fora do expediente23h–24h · 0 erros · 0% do dia · fora do expediente0h6h9h12h15h18h23h92
A faixa 9–18h é o horário de operação. Concentração no comercial é assinatura de uso real de cliente (não tarefa agendada); fora dele, costuma ser infra/deploy/agendado. Perfil horário só do maior ofensor deste snapshot.
👀 Acompanhar & frota — o que vigiar e o denominador de risco por versão

🛰 Saúde da frota — 80 clientes por proximidade da versão de produção (16.4.x)

70 na linha (16.4.x)2 atrás8 à frente
É o denominador que normaliza o risco por versão. Os 2 atrás (dattos (BTG) 15.4.18, agibank 16.3.9) podem carregar bug já corrigido. Detalhe por cliente na aba Contexto ↗.
👀 Contexto — acompanhar · ritmo do dia · o que mudou · clientes afetados (investigação secundária)
👀 11 p/ acompanhar · 2 sem impacto housekeeping — não atinge cliente

👀 Acompanhar — ainda não atinge cliente, ou já diminuindo

NpgsqlException: Erro durante importação ID… · Back · recorrente, sem crescer3/24h
fila-mensagens-conexao-recusada · Matching+Pipeline · crescendo1.155/24h
polling-regras-agendamento-banco · Back · diminuindo55/24h
DirectoryNotFoundException: Could not find a… · Back · recorrente, sem crescer6/24h
Passa para Precisa de ação se voltar a crescer e atingir 3 ou mais ambientes.

🩹 Ruído — o que vale consertar na fonte

Consertar a fonte (some do log de verdade) — não silenciar (silenciar cega o plantão). A barra usa só a janela de 24h (base 9.103 erros).

session-init call failed for user=postgres… · Dattos-Gateway · infraestrutura sem cliente
303/24h · 3%
consertar a fonte · 👤 sem dono · definir
An error occurred while reading from the… · Back · sem tipo / baixo valor
5/24h · 0%
consertar a fonte · 👤 sem dono · definir
Consertando o maior (session-init call failed for…): o painel de 24h cairia de 9.103 para ~8.800.
🕘 Pico de erros às 23h uso real (9–18) vs infra/agendado

Erros que pedem atenção por hora do dia (últimas 24h). A faixa 9–18 é o horário comercial: erro que sobe nela tende a ser uso real de cliente; fora dela, costuma ser infra/deploy ou tarefa agendada (e-mail, importação).

horário comercial 9–180h–1h · 470 erros · 5% do dia · fora do expediente1h–2h · 230 erros · 3% do dia · fora do expediente2h–3h · 296 erros · 3% do dia · fora do expediente3h–4h · 208 erros · 2% do dia · fora do expediente4h–5h · 275 erros · 3% do dia · fora do expediente5h–6h · 236 erros · 3% do dia · fora do expediente6h–7h · 250 erros · 3% do dia · fora do expediente7h–8h · 255 erros · 3% do dia · fora do expediente8h–9h · 484 erros · 5% do dia · fora do expediente9h–10h · 383 erros · 4% do dia · horário comercial10h–11h · 745 erros · 8% do dia · horário comercial11h–12h · 432 erros · 5% do dia · horário comercial12h–13h · 414 erros · 5% do dia · horário comercial13h–14h · 344 erros · 4% do dia · horário comercial14h–15h · 391 erros · 4% do dia · horário comercial15h–16h · 374 erros · 4% do dia · horário comercial16h–17h · 572 erros · 6% do dia · horário comercial17h–18h · 367 erros · 4% do dia · horário comercial18h–19h · 430 erros · 5% do dia · fora do expediente19h–20h · 334 erros · 4% do dia · fora do expediente20h–21h · 349 erros · 4% do dia · fora do expediente21h–22h · 237 erros · 3% do dia · fora do expediente22h–23h · 282 erros · 3% do dia · fora do expediente23h–24h · 787 erros · 9% do dia · pico0h6h9h12h15h18h23h787
🔁 0 novos · 7 pararam vs 2026-09-01 08:55 · 3 semanas atrás
✅ Resolvidos (provável) — pararam de aparecer e antes pediam atenção. Parou não é o mesmo que corrigido: confirme a causa.
·
−8
1 de 1 sem card identificado — é o esperado: a maioria some por mudança de uso ou de dado, não por correção. Ausência de card não prova nada nos dois sentidos.
👥 32 clientes atingidos · 10 em 3+ ambientes quem e onde

🌎 Por ambiente — os totais não se somam (uma mesma falha aparece em vários)

"Outros (NoWebsite)" = evento sem ambiente identificado no registro (atribuição estimada).

Eng interno (hotfix/release-fix/portal) · 3 grupos · 18.563 hits
Demo/trial · 1 grupo · 261 hits
🏷 Risco por versão taxa por cliente

Ranque por taxa por cliente (erros ÷ clientes que rodam a versão), nunca por contagem bruta. Piso de 3 clientes: abaixo disso é amostra fraca.

VersãoLinhagemErros (não-ruído)ClientesTaxa/cliente
16.5.616.5.x8197117
16.5.416.5.x4
16.5.316.5.x7251725 amostra fraca
16.4.1916.4.x1.4986622.7
16.4.1816.4.x126263 amostra fraca
16.4.1616.4.x61161 amostra fraca
16.4.1316.4.x17.303117303 amostra fraca
16.3.916.3.x1091109 amostra fraca
15.4.2015.4.x331
15.4.1815.4.x2181218 amostra fraca
📦 Carga por cliente (volume) top por volume

Volume de erros não-ruído por cliente de produção (top 12), base deste snapshot (88 de 166 ambientes afetados em 72h). Internos e máquinas de dev fora.

eng-master
272/72h
edenred
236/72h
dattos (BTG)
214/72h
cardif-hom
163/72h
agibank
109/72h
conciliadorrm
98/72h
csf
88/72h
afextyc
71/72h
close
56/72h
grupoepr
53/72h
iugu
43/72h
ccr
36/72h
🛰 Frota — versão por cliente 80 clientes

Distribuição da frota por versão (1 barra por versão; quem está atrás da versão de produção mais comum carrega bug já corrigido). É o denominador que normaliza o risco por versão.

16.5.6
7 clientes
16.5.3
1 cliente
16.4.19 ★
66 clientes
16.4.18 ★
2 clientes
16.4.16 ★
1 cliente
16.4.13 ★
1 cliente
16.3.9
1 cliente
15.4.18
1 cliente
★ = versão de produção mais comum (16.4.x)atrásna linhaà frente
ver por cliente (80)
ClienteVersão dominanteTambém vistaAtraso?
dattos (BTG)15.4.18⚠ versão antiga
agibank16.3.9⚠ versão antiga
sales-stable16.4.13✓ atual
csf16.4.1616.4.18✓ atual
agents-srv-aws-16-416.4.18✓ atual
protege16.4.18✓ atual
afextyc16.4.1916.4.18✓ atual
cofco16.4.1916.4.18✓ atual
conciliadorrm16.4.1916.4.18✓ atual
holambracoop16.4.1916.4.18✓ atual
iugu16.4.1916.4.18✓ atual
martins16.4.1916.4.18✓ atual
renovaenergia16.4.1916.4.18✓ atual
sicoob16.4.1916.4.18✓ atual
travelex16.4.1916.4.18✓ atual
ache16.4.19✓ atual
allcare16.4.19✓ atual
argo16.4.19✓ atual
atlas16.4.19✓ atual
aviva16.4.19✓ atual
brpartners16.4.19✓ atual
cardif-hom16.4.19✓ atual
castrolanda16.4.19✓ atual
ccr16.4.19✓ atual
celcoin16.4.19✓ atual
cervejariacidadeimperial16.4.19✓ atual
cmpc16.4.19✓ atual
colgate16.4.19✓ atual
columbia16.4.19✓ atual
comercialzaffari16.4.19✓ atual
csfcontabil16.4.19✓ atual
dellys16.4.19✓ atual
dipesul16.4.19✓ atual
ecorodovias16.4.19✓ atual
embarca16.4.19✓ atual
eng-master16.4.19✓ atual
eternit16.4.19✓ atual
fujifilm16.4.19✓ atual
gaspar16.4.19✓ atual
gca16.4.19✓ atual
granado16.4.19✓ atual
grupocaioba16.4.19✓ atual
grupoepr16.4.19✓ atual
grupomodenaesilva16.4.19✓ atual
harman16.4.19✓ atual
ifoodcorp16.4.19✓ atual
ipiranga16.4.19✓ atual
isacteep16.4.19✓ atual
kryptonbpo16.4.19✓ atual
mbenz16.4.19✓ atual
natura16.4.19✓ atual
nutrien16.4.19✓ atual
operafidc16.4.19✓ atual
orbenk16.4.19✓ atual
orizon16.4.19✓ atual
pirelli_csa16.4.19✓ atual
positivosmais16.4.19✓ atual
pucrs16.4.19✓ atual
qualicorp16.4.19✓ atual
redeamericas16.4.19✓ atual
romi16.4.19✓ atual
sales16.4.19✓ atual
sbibhae16.4.19✓ atual
sebraemg16.4.19✓ atual
simpaul16.4.19✓ atual
solinftec16.4.19✓ atual
valid16.4.19✓ atual
veneza16.4.19✓ atual
volks16.4.19✓ atual
vwfs16.4.19✓ atual
yamaha16.4.19✓ atual
zaffari16.4.19✓ atual
marcio16.5.3↑ pré-lançamento
achesaphirahom16.5.6↑ pré-lançamento
close16.5.6↑ pré-lançamento
csf-qa16.5.6↑ pré-lançamento
edenred16.5.6↑ pré-lançamento
eng-release16.5.6↑ pré-lançamento
financeiro16.5.6↑ pré-lançamento
mdias-hom16.5.6↑ pré-lançamento
🗂 21 grupos · fonte de investigação — ordenada por volume 72h · filtrável por origem

Fonte crua de investigação: todos os grupos com classificação por IA, versões e link Loki. A ordem por volume 72h cobre o antigo "Top 10"; use o filtro por origem para fatiar por sistema.

#ClassificaçãoTipo de erroErroSistemaCliente principalNº amb.AmbientesVersões24h72hTendência
1AcompanharInstância trava ao identificar o cliente e repete o erro sem pararInvalidOperationException: Error retrieving tenant for Id…BackNoWebsite30other, prod, eng-internal, hom, dev15.4.18, 15.4.206.46918.192▲ 6046%
2AcompanharServiços de dados sem conexão com a fila de mensagensTCP Connection attempt failed: ConnectionRefusedError(111, 'Connection…MatchingNoWebsite6other, prod16.4.18, 16.5.3733733— sem mudança
3AcompanharServiços de dados sem conexão com a fila de mensagensTCP Connection attempt failed: ConnectionRefusedError(111, 'Connection…PipelineNoWebsite14other, prod, dev16.4.18, 16.5.6422456▼ 35%
4Sem impactoGateway novo não abre sessão com o bancosession-init call failed for user=postgres host= Traceback (most recent call…Dattos-GatewayNoWebsite1other16.4.5303403▼ 42%
5AcompanharAgendamento: falha ao abrir conexão no polling de regrasEntityException: Failed to execute polling task. The underlying provider…Backeng-patch2eng-internal, prod15.4.20, 16.4.1947327— sem mudança
6Precisa de ação Chamada ao processo com identificador inválidoArgumentException: id Trace: System.ArgumentException: id at…Backcardif-hom9hom, dev, local, prod15.4.18, 16.4.19127289▲ 623%
7Precisa de açãoAcesso negado ao configurar um processoAuthorizationException: Você não tem permissão para configurar um Processo…Backconciliadorrm13prod16.4.19, 16.5.6262266— sem mudança
8Precisa de ação Valor vazio derruba rotinas de tarefa e de expurgoNullReferenceException: Object reference not set to an instance of an object…Backedenred62prod, local, hom, demo15.4.18, 16.4.16171261▲ 123%
9Precisa de açãoTela de processo não encontra o recurso e quebra na montagemFrontException: Cannot read properties of null (reading 'length') — vue; e…Frontedenred20prod, dev16.3.9, 16.4.16215222▲ 29%
10AcompanharFalha de envio de e-mail (limite do servidor)SmtpException: Erro ao enviar e-mail #212199. Service not available, closing…Backdattos (BTG)1prod15.4.1884114— sem mudança
11AcompanharAgendamento não encontra o storage do clienteBusinessException: Storage não encontrado ou sem permissão de acesso…Backcsf19prod, local15.4.18, 16.4.166497▼ 25%
12Precisa de açãoConsulta não encontra os arquivos da análise no datalakeUnhandled exception on /query: IO Error: No files found that match the…Queryquery-srv-aws-16-44other, prod16.4.185154▼ 33%
13AcompanharFalhas variadas no banco (tempo esgotado, sintaxe, conversão)SqlException: Execution Timeout Expired / Incorrect syntax / Conversion…Backdattos (BTG)7prod, other, eng-internal15.4.18, 15.4.203044▼ 63%
14AcompanharAtualizar a amostra do passo de importação falha por dado obrigatório vazioArgumentNullException: Value cannot be null. Parameter name: entity Value…Backcofco7prod16.4.16, 16.4.193434▼ 45%
15Precisa de açãoBackend não encontra os arquivos do resultado de importaçãoHttpRequestException: An error occurred while sending the request. Trace: at…Backeng-develop5dev, prod16.4.16, 16.4.193034▲ 36%
16AcompanharPasta de importação (SFTP) não encontradaDirectoryNotFoundException: Could not find a part of the path…Backccr1prod16.4.19618— sem mudança
17AcompanharCache (Redis) não respondeRedisConnectionException: The message timed out in the backlog attempting to…Backgaspar3prod, other16.4.19, 16.5.31616▼ 72%
18Acompanhar Importação estoura o tempo ao ler a origem externaNpgsqlException: Erro durante importação ID 2491313 The operation has timed…Backdattos (BTG)1prod15.4.18314— sem mudança
19AcompanharArquivo de importação ausente no armazenamentoFileNotFoundException: File not found on storage Ttl. Details: FileName…Backdattos (BTG)1prod15.4.181313— sem mudança
20AcompanharAgendamento: comando de banco falha no polling de regrasEntityCommandExecutionException: Failed to execute polling task. An error…Backdattos (BTG)6prod, hom15.4.18, 16.4.19810▼ 89%
21Sem impacto Execução recusada por fluxo já parado (sem classe de erro)An error occurred while reading from the store provider's data reader. See…Backiugu4prod, other16.4.1955▲ 25%
❓ Ajuda — como ler este painel · seções que ligam quando a coleta acumular dado
❓ Como ler este painel — régua, símbolos e limites (toque para abrir)
Os 3 baldes (regra automática, auditável)
  • Precisa de ação erro de produto/dado que atinge cliente e está crescendo (≥5 ocorrências/24h) ou aparece em ≥3 ambientes sem cair (≥8/24h).
  • Acompanhar ainda não atinge cliente, ou já está diminuindo.
  • Sem impacto só em máquina de desenvolvimento ou infraestrutura, sem cliente.
  • Saturação/capacidade (disco, pool, timeout, fila) sobe para "Precisa de ação" mesmo sem cliente — precede a falha visível.

"Atinge cliente" = ambiente que não é dev (local-*), teste (eng-*), serviço ou NoWebsite. Toda contagem tem link Loki ao lado para conferir na fonte.

Símbolos
  • 🔍 vX? hipótese de regressão de uma versão recente — a confirmar, não veredito.
  • 🔗 N incidente consolidado de N erros da mesma raiz.
  • 🎫 PRD-… card Jira candidato — confirme que é o mesmo problema.
  • 🔥 módulo mais comprometido agora · crônico visto em ≥4 snapshots.
  • em alta / constante / diminuindo = ritmo recente (24h vs 72h). ▲/▼ % = tendência vs o snapshot anterior. Eixos diferentes.
  • NOVO / ESCALANDO / CRÔNICO = apareceu agora / subiu ≥50% vs ontem ou ~7d (base curta, baixa confiança) / recorrente em ≥4 snapshots. vs ontem / vs ~7d compara com o snapshot daquele período.
Cor

vermelho = precisa de ação · amarelo = acompanhar · cinza = sem impacto. Borda esquerda mais grossa = mais volume. Card apagado = perdendo força.

⏱ Horizonte: comparações cobrem ~7 dias (14 snapshots de 12/12h); não há base "vs semana/mês passado" nem horário exato de última ocorrência. 🏷 Tipo de erro é classificado por IA (pode errar — confirme no Loki). Contagens podem ser piso quando a consulta satura.