QA Telemetry · 2026-09-01 08:55

Janela 24h/72h · Ambientes afetados 56/153 · bruto 24h 1.685 · 72h 4.750 · 166 queries · anterior 2026-08-11 09:03 (3 semanas atrás) · snapshot 08:55 · copiar versão Slack/Jira ↗

🔴 9 pedem ação · 6 crescendo
🔴9 problemas pedindo ação, 6 crescendo · 2 pode ter surgido numa versão recente. Comece por: AuthorizationException: Você não tem permissão para configurar um….
Precisa de ação
793 ▲ 372% subindo
9 problemas
◆ novo nesta leitura · estimativa
pico 6.062 · 15 snapshots
Acompanhar
373 ▼ 48% caindo
10 problemas
Sem impacto
509 ▲ 19% subindo
dev / infra
Clientes afetados
32 ▲ 19% subindo
de 153

📈 Tendência — ~7 dias · está piorando ou melhorando?

03.3326.66328/06 10h: 922 erros28/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros04/08 08h: 1.504 erros11/08 09h: 1.311 erros01/09 08h: 1.675 erros28/0629/0602/0706/0704/0801/09
Último snapshot: 793 erros que pedem ação, 373 para acompanhar, 509 sem impacto.
Precisa de açãoAcompanharSem impacto
📅 desde 28/06 10h · 15 leituras (uma a cada ~12h) · eixo Y = erros/24h
ver linha do tempo detalhada — data e hora de cada leitura
03.3326.66328/06 10h: 922 erros28/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros04/08 08h: 1.504 erros11/08 09h: 1.311 erros01/09 08h: 1.675 erros28/06 10h28/06 14h29/06 08h29/06 14h30/06 08h01/07 08h02/07 08h03/07 09h04/07 09h06/07 08h07/07 09h21/07 08h04/08 08h11/08 09h01/09 08h

🧩 Saúde por módulo — qual área dói mais (24h)

🔥 Analytics · Análise alta
313/24h
Frontend · Tela/UI média
170/24h
Notificação · E-mail alta
104/24h
ver mais 8 módulos
ETL · Importação média
111/24h
Expressões · Fórmula do usuário alta
13/24h
Integrações · Storage/SFTP alta
11/24h
Plataforma · Mensageria (Rabbit) média
48/24h
Sessão · Sessão/Redis média
24/24h
Persistência · Banco da plataforma (SQL Server) média
27/24h
Processos · Cópia de arquivo alta
6/24h
Indeterminado baixa
339/24h
Módulo derivado da assinatura do erro (regra auditável; passe o mouse pra ver). alta namespace específico · média wrapper/texto · baixa só origem. Ordenado por severidade; a barra mede volume.
🎯 Resolver primeiro — o que consertar agora, por prioridade: versão nova → crescendo → vários ambientes → volume
AuthorizationException: Você não tem permissão para configurar um…CRÔNICO🔍 v16.4.11? (possível regressão da versão recente — a confirmar)🔬 investigar🕘 Pico de logs às 10h▲ 369% subindocrônico (visto em 15 de 15 snapshots)
313/24h319 · 72h
Módulo Analytics · Análise · origem Back · Concentrado em 1 cliente: qualicorp (73% dos casos) · em alta · apareceu pela 1ª vez há 64 dias
priorizado por: suspeita de versão recente (hipótese)
versão16.4.11 · 98% (+1)
A pessoa recebe recusa e não consegue configurar o processo. São usuários reais de sete clientes de produção; a Qualicorp responde por 232 das 319 ocorrências, e um único usuário concentrou todas elas em poucos minutos.
ver diagnóstico e possível causa
🔍 suspeita de versão concentrado na versão 16.4.11 e crescendo — investigar o que mudou nessa versão (hipótese a confirmar). ver só nesta versão ↗ (abre o Loki em nova aba)
🧭 Onde aconteceAcontece ao abrir ou configurar um processo, quando o sistema confere se o perfil do usuário tem o papel exigido.
👁 O que o cliente vêA pessoa recebe recusa e não consegue configurar o processo. São usuários reais de sete clientes de produção; a Qualicorp responde por 232 das 319 ocorrências, e um único usuário concentrou todas elas em poucos minutos.
🤔 Causa provávelO volume subiu de 68 para 319 em três semanas, quase tudo na versão 16.4.11. Mudou também a origem: 95 por cento agora é a conferência de papel para configurar processo, contra 7 por cento na validação de pasta, o inverso do balanço anterior. Duas leituras seguem abertas e a diferença entre elas é grande: ou a pessoa perdeu um papel que tinha, ou a tela repete a chamada e transforma uma recusa em centenas. Confirme com o usuário citado antes de agir. confiança média
📋 Regras do móduloautomacao-business-rules.md ↗ — leia as regras de negócio de Analytics pra confirmar qual se aplica
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 232 erros · 74% do dia · pico11h–12h · 0 erros · 0% do dia · horário comercial12h–13h · 52 erros · 17% do dia · horário comercial13h–14h · 3 erros · 1% do dia · horário comercial14h–15h · 0 erros · 0% do dia · horário comercial15h–16h · 0 erros · 0% do dia · horário comercial16h–17h · 16 erros · 5% do dia · horário comercial17h–18h · 2 erros · 1% do dia · horário comercial18h–19h · 0 erros · 0% do dia19h–20h · 8 erros · 3% do dia20h–21h · 0 erros · 0% do dia21h–22h · 0 erros · 0% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 10h — provável impacto real de cliente.
↳ at Dattos.Platform.Core.Entities.Analytics.Analysis.ValidateConfigPermission(Int32[] roleIds) in C:\jenkins-dev\workspace\dattos-recon-net_master\Dattos.Platform.Core\Entities\Anal
FrontException: Cannot read properties of undefined (reading 'find')…CRÔNICO🔍 v16.3.31? (possível regressão da versão recente — a confirmar)♻️ refatorar🕘 Pico de logs às 17h▲ 149% subindocrônico (visto em 15 de 15 snapshots)
170/24h172 · 72h
Módulo Frontend · Tela/UI · origem Front · 17 clientes (allcare, grupoepr, simpaul, +1) · em alta · apareceu pela 1ª vez há 64 dias
priorizado por: suspeita de versão recente (hipótese)
versão16.4.11 · 67% (+3)
A parte da tela para de responder e o usuário precisa recarregar. São 17 ambientes, com Allcare (78) e Grupo EPR (45) concentrando 123 das 172 ocorrências.
ver diagnóstico e possível causa
🔍 suspeita de versão concentrado na versão 16.3.31 e crescendo — investigar o que mudou nessa versão (hipótese a confirmar). ver só nesta versão ↗ (abre o Loki em nova aba)
🧭 Onde aconteceAcontece na tela, ao interagir com um campo de seleção ou com uma lista que ainda não carregou.
👁 O que o cliente vêA parte da tela para de responder e o usuário precisa recarregar. São 17 ambientes, com Allcare (78) e Grupo EPR (45) concentrando 123 das 172 ocorrências.
🤔 Causa provávelSubiu de 69 para 172 em três semanas e 84 por cento é a mesma família: o código lê uma propriedade de algo que está vazio. Em 45 por cento o campo é uma lista suspensa (v-select). Espalhado por quatro versões, o que aponta para defeito antigo de proteção contra valor vazio, não para regressão de uma versão. Hipótese, confirme antes de agir. confiança média
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 30 erros · 18% do dia · horário comercial10h–11h · 3 erros · 2% do dia · horário comercial11h–12h · 7 erros · 4% do dia · horário comercial12h–13h · 10 erros · 6% do dia · horário comercial13h–14h · 2 erros · 1% do dia · horário comercial14h–15h · 8 erros · 5% do dia · horário comercial15h–16h · 7 erros · 4% do dia · horário comercial16h–17h · 36 erros · 21% do dia · horário comercial17h–18h · 56 erros · 33% do dia · pico18h–19h · 10 erros · 6% do dia19h–20h · 0 erros · 0% do dia20h–21h · 0 erros · 0% do dia21h–22h · 1 erro · 1% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 17h — provável impacto real de cliente.
XdttException: Arquivo de modelo inválido ou corrompido. Arquivo de…NOVO↩ histórico de escape🐞 corrigir bug🕘 Pico de logs às 17hnovo subindo
6/24h6 · 72h
Módulo ETL · Carga de Análise (ETL) · origem Back · 3 clientes (eng-release, eng-master) · em alta · apareceu pela 1ª vez novo hoje
priorizado por: crescendo agora
versão16.5.2 · 83% (+1)
O fluxo não é restaurado. Seis ocorrências, todas em ambientes internos de engenharia e todas do mesmo usuário nosso.
ver diagnóstico
🧭 Onde aconteceAcontece ao restaurar um fluxo a partir de um arquivo de modelo.
👁 O que o cliente vêO fluxo não é restaurado. Seis ocorrências, todas em ambientes internos de engenharia e todas do mesmo usuário nosso.
🤔 Causa provávelO arquivo de modelo não passa na leitura, ou porque está de fato corrompido, ou porque veio de uma versão que a atual não lê. Sem cliente envolvido. confiança média
↩ Histórico da área4 escapes catalogados em ETL: PRD-8903, PRD-8965, Pipeline-storage, CB-1 — matriz de escape ↗. Construtor/ETL Turbo AI é a área mais frágil catalogada (boilerplate vs banner, resumo truncado, agente PDF transiente); saturação de staging DuckDB sob volume alto. Histórico da área, a confirmar — não é veredito deste erro.
📋 Regras do móduloetl-business-rules.md ↗ — leia as regras de negócio de ETL pra confirmar qual se aplica
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 0 erros · 0% do dia · horário comercial11h–12h · 0 erros · 0% do dia · horário comercial12h–13h · 0 erros · 0% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 0 erros · 0% do dia · horário comercial15h–16h · 0 erros · 0% do dia · horário comercial16h–17h · 2 erros · 33% do dia · horário comercial17h–18h · 4 erros · 67% do dia · pico18h–19h · 0 erros · 0% do dia19h–20h · 0 erros · 0% do dia20h–21h · 0 erros · 0% do dia21h–22h · 0 erros · 0% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 17h — provável impacto real de cliente.
↳ at Dattos.Platform.Services.Etls.Jobs.EtlRestoreTemplateJob.<RestoreEtlAsync>d__20.MoveNext() in C:\jenkins-dev\workspace\dattos-recon-net_master\Dattos.Platform.Services\Etls\Jobs

+ 6 que também pedem ação — abra a aba 🗂 Tabela (ordenada por volume).

📊 Gráficos — toda a análise visual num lugar só. Tudo derivado dos snapshots gravados, mesma régua da Triagem.
🎯 O que atacar — impacto — quem dói, em quem, e quantos itens pedem ação

🏆 Top ofensores por volume — com cliente mais impactado — 24h · eixo fixo (maior = 313) · cor = balde de ação

313/24h
👤 mais impactado: qualicorp · 73% · espalhado por 7 ambientes
297/24h
👤 mais impactado: NoWebsite · 100% das ocorrências · v16.4.5
203/24h
👤 mais impactado: agibank · 34% · espalhado por 20 ambientes
170/24h
👤 mais impactado: allcare · 45% · espalhado por 17 ambientes
96/24h
👤 mais impactado: yamaha · 40% · espalhado por 11 ambientes
84/24h
👤 mais impactado: natura · 18% · espalhado por 18 ambientes
81/24h
👤 mais impactado: gaspar · 78% · espalhado por 13 ambientes
81/24h
👤 mais impactado: query-srv-aws-16-4 · 57% · espalhado por 7 ambientes
64/24h
👤 mais impactado: dattos (BTG) · 99% das ocorrências · v15.4.18
60/24h
👤 mais impactado: conciliadorrm · 92% · espalhado por 3 ambientes
Precisa de açãoAcompanharSem impacto
A cabeça da distribuição costuma responder por boa parte da carga acionável; a cor mostra o balde de ação. Cliente e percentual vêm da coluna de ambiente do snapshot. Detalhe por linha na aba Tabela ↗.

📦 Carga por cliente — produção · não-ruído · 72h · eixo fixo (maior = 238)

qualicorp
238/72h
dattos (BTG)
156/72h
afextyc
116/72h
eng-release
95/72h
eng-master
90/72h
allcare
85/72h
gaspar
81/72h
conciliadorrm
75/72h
ifoodcorp
69/72h
yamaha
47/72h
grupoepr
45/72h
remessaonline
36/72h
Volume de erros não-ruído por cliente de produção (top 12); a cabeça domina e o resto é cauda longa. Detalhe por cliente na aba Contexto ↗.

🧭 Os 24 itens por classificação — contagem de itens (não de volume)

9 Precisa de ação10 Acompanhar5 Sem impacto
Poucos itens pedem ação; a maioria é monitoramento. Volume ≠ nº de itens — um único item pode somar milhares de ocorrências. Lista completa na aba Tabela ↗.
📈 Tendência no tempo — está piorando ou melhorando, e em que horário

🧪 Composição da carga por classificação — ~7 dias · cada coluna = uma leitura, normalizada a 100%

28/06 10h · 34% ação · 38% acompanhar · 28% sem impacto28/06 14h · 46% ação · 29% acompanhar · 24% sem impacto29/06 08h · 0% ação · 98% acompanhar · 2% sem impacto29/06 14h · 34% ação · 63% acompanhar · 3% sem impacto30/06 08h · 29% ação · 71% acompanhar · 0% sem impacto01/07 08h · 35% ação · 64% acompanhar · 0% sem impacto02/07 08h · 48% ação · 52% acompanhar · 1% sem impacto03/07 09h · 59% ação · 36% acompanhar · 4% sem impacto04/07 09h · 13% ação · 71% acompanhar · 16% sem impacto06/07 08h · 0% ação · 43% acompanhar · 57% sem impacto07/07 09h · 34% ação · 50% acompanhar · 16% sem impacto21/07 08h · 91% ação · 8% acompanhar · 0% sem impacto04/08 08h · 66% ação · 33% acompanhar · 1% sem impacto11/08 09h · 13% ação · 55% acompanhar · 33% sem impacto01/09 08h · 47% ação · 22% acompanhar · 30% sem impacto28/06agora
Precisa de açãoAcompanharSem impacto
topo em Precisa de ação: AuthorizationException: Você não tem… 313/24htopo em Acompanhar: InvalidCastException: Reading as… 3/24htopo em Sem impacto: session-init call failed for… 297/24h
Não é o volume (esse está na Tendência, na aba Triagem) — é a mistura: que fração de cada leitura pedia ação. Passe o mouse numa coluna para ver as frações. Os campeões refletem a leitura atual (o topo por balde de leituras passadas não é gravado).

🕘 Ritmo do dia — maior ofensor — AuthorizationException: Você não tem… por hora (BRT, 24h)

horário comercial 9–180h–1h · 0 erros · 0% do dia · fora do expediente1h–2h · 0 erros · 0% do dia · fora do expediente2h–3h · 0 erros · 0% do dia · fora do expediente3h–4h · 0 erros · 0% do dia · fora do expediente4h–5h · 0 erros · 0% do dia · fora do expediente5h–6h · 0 erros · 0% do dia · fora do expediente6h–7h · 0 erros · 0% do dia · fora do expediente7h–8h · 0 erros · 0% do dia · fora do expediente8h–9h · 0 erros · 0% do dia · fora do expediente9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 232 erros · 74% do dia · pico11h–12h · 0 erros · 0% do dia · horário comercial12h–13h · 52 erros · 17% do dia · horário comercial13h–14h · 3 erros · 1% do dia · horário comercial14h–15h · 0 erros · 0% do dia · horário comercial15h–16h · 0 erros · 0% do dia · horário comercial16h–17h · 16 erros · 5% do dia · horário comercial17h–18h · 2 erros · 1% do dia · horário comercial18h–19h · 0 erros · 0% do dia · fora do expediente19h–20h · 8 erros · 3% do dia · fora do expediente20h–21h · 0 erros · 0% do dia · fora do expediente21h–22h · 0 erros · 0% do dia · fora do expediente22h–23h · 0 erros · 0% do dia · fora do expediente23h–24h · 0 erros · 0% do dia · fora do expediente0h6h9h12h15h18h23h232
A faixa 9–18h é o horário de operação. Concentração no comercial é assinatura de uso real de cliente (não tarefa agendada); fora dele, costuma ser infra/deploy/agendado. Perfil horário só do maior ofensor deste snapshot.
👀 Acompanhar & frota — o que vigiar e o denominador de risco por versão

🛰 Saúde da frota — 50 clientes por proximidade da versão de produção (16.4.x)

40 na linha (16.4.x)9 atrás1 à frente
É o denominador que normaliza o risco por versão. Os 9 atrás (dattos-uat (BTG) 15.4.18, dattos (BTG) 15.4.18, agibank 16.3.9, cea 16.3.31, mrsdp 16.3.31) podem carregar bug já corrigido. Detalhe por cliente na aba Contexto ↗.
👀 Contexto — acompanhar · ritmo do dia · o que mudou · clientes afetados (investigação secundária)
👀 10 p/ acompanhar · 5 sem impacto housekeeping — não atinge cliente

👀 Acompanhar — ainda não atinge cliente, ou já diminuindo

InvalidCastException: Reading as… · Back · crescendo3/24h
polling-regras-agendamento-banco · Back · crescendo82/24h
fila-mensagens-conexao-recusada · Pipeline+Matching+PdfAi · crescendo48/24h
NpgsqlException: Erro durante importação ID… · Back · recorrente, sem crescer6/24h
datalake-arquivo-ausente · Query+Back · crescendo106/24h
DirectoryNotFoundException: Could not find a… · Back · recorrente, sem crescer6/24h
Passa para Precisa de ação se voltar a crescer e atingir 3 ou mais ambientes.

🩹 Ruído — o que vale consertar na fonte

Consertar a fonte (some do log de verdade) — não silenciar (silenciar cega o plantão). A barra usa só a janela de 24h (base 1.685 erros).

session-init call failed for user=postgres… · Dattos-Gateway · infraestrutura sem cliente
297/24h · 18%
consertar a fonte · 👤 sem dono · definir
InvalidOperationException: Sequence… · Back · sem tipo / baixo valor
203/24h · 12%
consertar a fonte · 👤 sem dono · definir
HttpException: The remote host closed the… · Back · sem tipo / baixo valor
7/24h · 0%
consertar a fonte · 👤 sem dono · definir
An error occurred while reading from the… · Back · sem tipo / baixo valor
2/24h · 0%
consertar a fonte · 👤 sem dono · definir
Consertando o maior (session-init call failed for…): o painel de 24h cairia de 1.685 para ~1.388.
🕘 Pico de erros às 10h uso real (9–18) vs infra/agendado

Erros que pedem atenção por hora do dia (últimas 24h). A faixa 9–18 é o horário comercial: erro que sobe nela tende a ser uso real de cliente; fora dela, costuma ser infra/deploy ou tarefa agendada (e-mail, importação).

horário comercial 9–180h–1h · 7 erros · 1% do dia · fora do expediente1h–2h · 2 erros · 0% do dia · fora do expediente2h–3h · 2 erros · 0% do dia · fora do expediente3h–4h · 2 erros · 0% do dia · fora do expediente4h–5h · 2 erros · 0% do dia · fora do expediente5h–6h · 2 erros · 0% do dia · fora do expediente6h–7h · 3 erros · 0% do dia · fora do expediente7h–8h · 6 erros · 1% do dia · fora do expediente8h–9h · 16 erros · 1% do dia · fora do expediente9h–10h · 67 erros · 6% do dia · horário comercial10h–11h · 326 erros · 28% do dia · pico11h–12h · 102 erros · 9% do dia · horário comercial12h–13h · 96 erros · 8% do dia · horário comercial13h–14h · 46 erros · 4% do dia · horário comercial14h–15h · 40 erros · 3% do dia · horário comercial15h–16h · 42 erros · 4% do dia · horário comercial16h–17h · 98 erros · 8% do dia · horário comercial17h–18h · 154 erros · 13% do dia · horário comercial18h–19h · 65 erros · 6% do dia · fora do expediente19h–20h · 54 erros · 5% do dia · fora do expediente20h–21h · 13 erros · 1% do dia · fora do expediente21h–22h · 14 erros · 1% do dia · fora do expediente22h–23h · 11 erros · 1% do dia · fora do expediente23h–24h · 6 erros · 1% do dia · fora do expediente0h6h9h12h15h18h23h326
🔁 6 novos · 6 pararam vs 2026-08-11 09:03 · 3 semanas atrás
✅ Resolvidos (provável) — pararam de aparecer e antes pediam atenção. Parou não é o mesmo que corrigido: confirme a causa.
·
−4
·
−3
·
−3
3 de 3 sem card identificado — é o esperado: a maioria some por mudança de uso ou de dado, não por correção. Ausência de card não prova nada nos dois sentidos.
👥 32 clientes atingidos · 10 em 3+ ambientes quem e onde

🌎 Por ambiente — os totais não se somam (uma mesma falha aparece em vários)

"Outros (NoWebsite)" = evento sem ambiente identificado no registro (atribuição estimada).

Homolog/UAT · 1 grupo · 120 hits
🏷 Risco por versão taxa por cliente

Ranque por taxa por cliente (erros ÷ clientes que rodam a versão), nunca por contagem bruta. Piso de 3 clientes: abaixo disso é amostra fraca.

VersãoLinhagemErros (não-ruído)ClientesTaxa/cliente
16.5.216.5.x2.27312273 amostra fraca
16.5.116.5.x86
16.4.1216.4.x61161 amostra fraca
16.4.1116.4.x1.0873927.9
16.3.3616.3.x313 amostra fraca
16.3.3116.3.x1653.2
16.3.916.3.x111 amostra fraca
15.4.1815.4.x159279.5 amostra fraca
📦 Carga por cliente (volume) top por volume

Volume de erros não-ruído por cliente de produção (top 12), base deste snapshot (59 de 153 ambientes afetados em 72h). Internos e máquinas de dev fora.

qualicorp
238/72h
dattos (BTG)
156/72h
afextyc
116/72h
eng-release
95/72h
eng-master
90/72h
allcare
85/72h
gaspar
81/72h
conciliadorrm
75/72h
ifoodcorp
69/72h
yamaha
47/72h
grupoepr
45/72h
remessaonline
36/72h
🛰 Frota — versão por cliente 50 clientes

Distribuição da frota por versão (1 barra por versão; quem está atrás da versão de produção mais comum carrega bug já corrigido). É o denominador que normaliza o risco por versão.

16.5.2
1 cliente
16.4.12 ★
1 cliente
16.4.11 ★
39 clientes
16.3.36
1 cliente
16.3.31
5 clientes
16.3.9
1 cliente
15.4.18
2 clientes
★ = versão de produção mais comum (16.4.x)atrásna linhaà frente
ver por cliente (50)
ClienteVersão dominanteTambém vistaAtraso?
dattos-uat (BTG)15.4.18⚠ versão antiga
dattos (BTG)15.4.18⚠ versão antiga
agibank16.3.9⚠ versão antiga
cea16.3.31⚠ versão antiga
mrsdp16.3.31⚠ versão antiga
nissei16.3.31⚠ versão antiga
protege16.3.31⚠ versão antiga
vibra16.3.31⚠ versão antiga
sales-stable16.3.36⚠ versão antiga
ache16.4.11✓ atual
afextyc16.4.11✓ atual
allcare16.4.11✓ atual
bayer16.4.1116.4.12✓ atual
brpartners16.4.11✓ atual
ccr16.4.11✓ atual
cervejariacidadeimperial16.4.1116.4.12✓ atual
cobasi16.4.11✓ atual
cofco16.4.11✓ atual
conciliadorrm16.4.1116.4.12✓ atual
csf-qa16.4.11✓ atual
csf16.4.11✓ atual
dellys16.4.11✓ atual
edenred16.4.11✓ atual
embarca16.4.11✓ atual
eng-master16.4.11✓ atual
eternit16.4.11✓ atual
gaspar16.4.1116.5.1✓ atual
grupoepr16.4.1116.4.12✓ atual
holambracoop16.4.1116.4.12✓ atual
ifoodcorp16.4.1116.4.12✓ atual
ipiranga16.4.11✓ atual
laponia16.4.1116.4.12✓ atual
marcio16.4.11✓ atual
martins16.4.11✓ atual
natura16.4.11✓ atual
omnicom16.4.11✓ atual
opea16.4.11✓ atual
operafidc16.4.11✓ atual
qualicorp16.4.11✓ atual
remessaonline16.4.11✓ atual
sbibhae16.4.11✓ atual
simpaul16.4.11✓ atual
solinftec16.4.11✓ atual
travelex16.4.11✓ atual
uniasselvi16.4.11✓ atual
vwfs16.4.11✓ atual
yamaha16.4.11✓ atual
zaffari16.4.1116.4.12✓ atual
sementesprodutiva16.4.12✓ atual
eng-release16.5.2↑ pré-lançamento
🗂 28 grupos · fonte de investigação — ordenada por volume 72h · filtrável por origem

Fonte crua de investigação: todos os grupos com classificação por IA, versões e link Loki. A ordem por volume 72h cobre o antigo "Top 10"; use o filtro por origem para fatiar por sistema.

#ClassificaçãoTipo de erroErroSistemaCliente principalNº amb.AmbientesVersões24h72hTendência
1Sem impactoGateway novo não abre sessão com o bancosession-init call failed for user=postgres host= Traceback (most recent call…Dattos-GatewayNoWebsite1other16.4.5297699▲ 3783%
2AcompanharServiços de dados sem conexão com a fila de mensagensTCP Connection attempt failed: ConnectionRefusedError(111, 'Connection…PipelineNoWebsite13other, prod, dev, demo16.3.36, 16.4.1139699▲ 1027%
3AcompanharServiços de dados sem conexão com a fila de mensagensTCP Connection attempt failed: ConnectionRefusedError(111, 'Connection…MatchingNoWebsite5other, prod, dev16.4.11, 16.5.27675▲ 419%
4AcompanharServiços de dados sem conexão com a fila de mensagensTCP Connection attempt failed: ConnectionRefusedError(111, 'Connection…PdfAiNoWebsite2other, prod16.4.11, 16.5.22618novo
5AcompanharAgendamento: falha ao abrir conexão no polling de regrasEntityException: Failed to execute polling task. The underlying provider…Backeng-develop5dev, prod16.4.11, 16.5.21347▲ 5683%
6Precisa de açãoAcesso negado ao configurar um processoAuthorizationException: Você não tem permissão para configurar um Processo…Backqualicorp7prod16.4.11, 16.5.2313319▲ 369%
7Sem impactoAgendador dispara fluxo que já estava paradoInvalidOperationException: Sequence contains no elements Trace: at…Backagibank20prod, other, demo, dev15.4.18, 16.3.9203296▼ 27%
8Precisa de açãoErro de tela: campo lê valor que não existeFrontException: Cannot read properties of undefined (reading 'find') Trace…Frontallcare17prod, demo, dev, local16.3.31, 16.4.11170172▲ 149%
9Precisa de açãoAgendamento não encontra o storage do clienteBusinessException: Storage não encontrado ou sem permissão de acesso…Backnatura18prod, dev, local15.4.18, 16.3.984130— sem mudança
10AcompanharFalhas variadas no banco (tempo esgotado, sintaxe, conversão)SqlException: Execution Timeout Expired / Incorrect syntax / Conversion…BackNoWebsite11other, prod, hom15.4.18, 16.3.3127120▼ 26%
11Precisa de ação Busca da lista de tarefas quebra por valor vazioNullReferenceException: Object reference not set to an instance of an object…Backyamaha11prod, demo15.4.18, 16.4.1196117— sem mudança
12AcompanharFalha de envio de e-mail (limite do servidor)SmtpException: Erro ao enviar e-mail #212199. Service not available, closing…Backdattos (BTG)2prod15.4.18, 16.4.116498▲ 227%
13AcompanharAgendamento: comando de banco falha no polling de regrasEntityCommandExecutionException: Failed to execute polling task. An error…Backgaspar13prod, dev16.3.31, 16.4.118191▲ 727%
14AcompanharConsulta não encontra os arquivos da análise no datalakeUnhandled exception on /query: IO Error: No files found that match the…Queryquery-srv-aws-16-47other, prod16.4.118181▼ 56%
15Precisa de açãoAtualizar a amostra do passo de importação falha por dado obrigatório vazioArgumentNullException: Value cannot be null. Parameter name: entity Value…Backconciliadorrm3prod16.3.31, 16.4.116062▲ 170%
16AcompanharCache (Redis) não respondeRedisConnectionException: The message timed out in the backlog attempting to…BackNoWebsite2other, prod16.5.1, 16.5.22458novo
17Precisa de açãoEnvio de e-mail sem destinatário definidoArgumentException: Erro ao enviar e-mail #212147. Destinatário do e-mail não…Backcsf-qa10prod15.4.18, 16.4.114040▲ 82%
18AcompanharBackend não encontra os arquivos do resultado de importaçãoHttpRequestException: An error occurred while sending the request. Trace: at…Backremessaonline8prod16.4.112525▼ 50%
19AcompanharPasta de importação (SFTP) não encontradaDirectoryNotFoundException: Could not find a part of the path…Backccr1prod16.4.11618— sem mudança
20Acompanhar Importação estoura o tempo ao ler a origem externaNpgsqlException: Erro durante importação ID 2491313 The operation has timed…Backdattos (BTG)1prod15.4.18617— sem mudança
21Precisa de açãoExpressão do fluxo aponta coluna que não existeSourceException: Expressão inválida. Não foi encontrado uma coluna com o nome…Backcsf-qa1prod16.4.111313novo
22Precisa de açãoArquivo de importação ausente no armazenamentoFileNotFoundException: File not found on storage Ttl. Details: FileName…Backdattos (BTG)5prod15.4.18, 16.4.111111— sem mudança
23AcompanharResposta inválida do motor de dados (502)JsonReaderException: DataEngine returned non-parseable JSON on route…Backconciliadorrm7prod16.4.1178— sem mudança
24Sem impactoNavegador fecha a conexão antes da respostaHttpException: The remote host closed the connection. The error code is…Backzaffari2prod16.4.1177novo
25Precisa de ação Restaurar modelo de fluxo falha por arquivo inválidoXdttException: Arquivo de modelo inválido ou corrompido. Arquivo de modelo…Backeng-release3prod, dev16.4.11, 16.5.266novo
26Sem impacto Execução recusada por fluxo já parado (sem classe de erro)An error occurred while reading from the store provider's data reader. See…BackNoWebsite3other, prod16.4.1124▼ 78%
27Sem impactoInfraestrutura: Redis indisponível (Agents)Redis checkpointer init FAILED (TimeoutError: Timeout connecting to server) |…AgentsNoWebsite1other03— sem mudança
28Acompanhar Teste de layout não lê coluna de tipo aninhadoInvalidCastException: Reading as 'System.Object' is not supported for fields…Backdattos (BTG)1prod15.4.1833novo
❓ Ajuda — como ler este painel · seções que ligam quando a coleta acumular dado
❓ Como ler este painel — régua, símbolos e limites (toque para abrir)
Os 3 baldes (regra automática, auditável)
  • Precisa de ação erro de produto/dado que atinge cliente e está crescendo (≥5 ocorrências/24h) ou aparece em ≥3 ambientes sem cair (≥8/24h).
  • Acompanhar ainda não atinge cliente, ou já está diminuindo.
  • Sem impacto só em máquina de desenvolvimento ou infraestrutura, sem cliente.
  • Saturação/capacidade (disco, pool, timeout, fila) sobe para "Precisa de ação" mesmo sem cliente — precede a falha visível.

"Atinge cliente" = ambiente que não é dev (local-*), teste (eng-*), serviço ou NoWebsite. Toda contagem tem link Loki ao lado para conferir na fonte.

Símbolos
  • 🔍 vX? hipótese de regressão de uma versão recente — a confirmar, não veredito.
  • 🔗 N incidente consolidado de N erros da mesma raiz.
  • 🎫 PRD-… card Jira candidato — confirme que é o mesmo problema.
  • 🔥 módulo mais comprometido agora · crônico visto em ≥4 snapshots.
  • em alta / constante / diminuindo = ritmo recente (24h vs 72h). ▲/▼ % = tendência vs o snapshot anterior. Eixos diferentes.
  • NOVO / ESCALANDO / CRÔNICO = apareceu agora / subiu ≥50% vs ontem ou ~7d (base curta, baixa confiança) / recorrente em ≥4 snapshots. vs ontem / vs ~7d compara com o snapshot daquele período.
Cor

vermelho = precisa de ação · amarelo = acompanhar · cinza = sem impacto. Borda esquerda mais grossa = mais volume. Card apagado = perdendo força.

⏱ Horizonte: comparações cobrem ~7 dias (14 snapshots de 12/12h); não há base "vs semana/mês passado" nem horário exato de última ocorrência. 🏷 Tipo de erro é classificado por IA (pode errar — confirme no Loki). Contagens podem ser piso quando a consulta satura.