QA Telemetry · 2026-08-11 09:03

Janela 24h/72h · Ambientes afetados 44/130 · bruto 24h 1.313 · 72h 1.751 · 81 queries · anterior 2026-08-04 08:55 (1 semanas atrás) · snapshot 09:03 · copiar versão Slack/Jira ↗

🔴 4 pedem ação · 2 crescendo
🔴4 problemas pedindo ação, 2 crescendo. Comece por: NullReferenceException: Object reference not set to an instance of an….
Leitura do analista confiança média: A semana fecha com um fio comum: os arquivos que a análise precisa ler não estão onde o sistema espera — 196 ocorrências em 72 horas, atravessando a Consulta, o backend e a conciliação, em quatro clientes de produção. Em paralelo, o acesso do nosso suporte está barrado por licença expirada em seis clientes na versão 16.3.31. As duas leituras são hipóteses: confirme no Loki antes de agir.
📌 A fila técnica começa por NullReferenceException: Object reference not set to an… — em alta agora.
Precisa de ação
168 ▼ 83% caindo
4 problemas
◆ novo nesta leitura · estimativa
pico 1.063 · 15 snapshots
Acompanhar
716 ▲ 43% subindo
16 problemas
Sem impacto
427 ▲ 4644% subindo
dev / infra
Clientes afetados
27 ▼ 25% caindo
de 130

📈 Tendência — ~7 dias · está piorando ou melhorando?

03.3326.66327/06 14h: 1.686 erros28/06 10h: 922 erros28/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros04/08 08h: 1.504 erros11/08 09h: 1.311 erros27/0629/0601/0704/0721/0711/08
Último snapshot: 168 erros que pedem ação, 716 para acompanhar, 427 sem impacto.
Precisa de açãoAcompanharSem impacto
📅 desde 27/06 14h · 15 leituras (uma a cada ~12h) · eixo Y = erros/24h
ver linha do tempo detalhada — data e hora de cada leitura
03.3326.66327/06 14h: 1.686 erros28/06 10h: 922 erros28/06 14h: 612 erros29/06 08h: 504 erros29/06 14h: 1.117 erros30/06 08h: 1.559 erros01/07 08h: 1.705 erros02/07 08h: 2.506 erros03/07 09h: 3.099 erros04/07 09h: 1.947 erros06/07 08h: 178 erros07/07 09h: 1.312 erros21/07 08h: 6.663 erros04/08 08h: 1.504 erros11/08 09h: 1.311 erros27/06 14h28/06 10h28/06 14h29/06 08h29/06 14h30/06 08h01/07 08h02/07 08h03/07 09h04/07 09h06/07 08h07/07 09h21/07 08h04/08 08h11/08 09h

🧩 Saúde por módulo — qual área dói mais (24h)

🔥 Conciliação · Casamento de transações alta
114/24h
Notificação · E-mail alta
47/24h
Integrações · Storage/SFTP alta
11/24h
ver mais 7 módulos
Persistência · Banco da plataforma (SQL Server) média
153/24h
Plataforma · Mensageria (Rabbit) média
70/24h
ETL · Importação alta
6/24h
Analytics · Automação de fluxo alta
134/24h
Frontend · Tela/UI média
63/24h
Processos · Execução de fluxo média
15/24h
Indeterminado baixa
271/24h
Módulo derivado da assinatura do erro (regra auditável; passe o mouse pra ver). alta namespace específico · média wrapper/texto · baixa só origem. Ordenado por severidade; a barra mede volume.
🎯 Resolver primeiro — o que consertar agora, por prioridade: versão nova → crescendo → vários ambientes → volume
NullReferenceException: Object reference not set to an instance of an…ESCALANDO ·?🎫 PRD-9187 · Tarefas pendentes · candidato · confirme ↗ (card Jira candidato — confirme)↩ histórico de escape🐞 corrigir bug🌙 Pico de logs às 17h · fora do expediente▲ 515% subindocrônico (visto em 15 de 15 snapshots)
114/24h123 · 72h
Módulo Conciliação · Casamento de transações · origem Back · 10 clientes (opea, allcare, dattos (BTG), +1) · em alta · vs ~7d ▲714% subindo · apareceu pela 1ª vez há 44 dias
priorizado por: crescendo agora
versão16.4.7 · 78% (+5)
O passo não abre e a amostra não atualiza: o usuário vê erro ao editar o fluxo.
ver diagnóstico
🎫 Card aberto relacionado: PRD-9187 (Tarefas pendentes) ↗ — Dois sinais fortes: o card cita NR (referência nula) e a rotina de Configurar/Refresh de ImportResult, que é a origem de 61% das ocorrências medidas (ImportResultRefreshProvider e leitura do identificador do staging). A condição do card, fonte sem dados carregados, é compatível com o identificador de staging vindo vazio.. Candidato, confirme que é o mesmo problema antes de assumir que já há alguém nele.
🧭 Onde aconteceAcontece ao abrir ou atualizar o passo de resultado de importação de um fluxo.
👁 O que o cliente vêO passo não abre e a amostra não atualiza: o usuário vê erro ao editar o fluxo.
🤔 Causa provávelEm 61% das falhas de 24 horas duas rotinas leem o identificador do staging no motor de dados e o recebem vazio. Subiu de 14 para 114 em uma semana, concentrado em dois clientes. Pode ser a mesma origem dos arquivos ausentes no datalake — confirme antes de tratar como problema separado. confiança média
↩ Histórico da área5 escapes catalogados em Conciliação: PRD-9833, bug-stats-47749, PRD-8915, PRD-8969, Mesclar-chave-fraca — matriz de escape ↗. Calibração de conciliação e UI de matching pesado já vazaram pra produção e recorreram após fix (travamento em 80%, concorrência EF nas estatísticas, cartesiano por chave fraca). Histórico da área, a confirmar — não é veredito deste erro.
📋 Regras do módulomatching-business-rules.md ↗ — leia as regras de negócio de Conciliação pra confirmar qual se aplica
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 3 erros · 3% do dia · horário comercial11h–12h · 0 erros · 0% do dia · horário comercial12h–13h · 0 erros · 0% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 16 erros · 14% do dia · horário comercial15h–16h · 4 erros · 4% do dia · horário comercial16h–17h · 4 erros · 4% do dia · horário comercial17h–18h · 26 erros · 23% do dia · pico18h–19h · 23 erros · 20% do dia19h–20h · 12 erros · 11% do dia20h–21h · 24 erros · 21% do dia21h–22h · 2 erros · 2% do dia22h–23h · 0 erros · 0% do dia23h–24h · 0 erros · 0% do dia
0h9h18h23h
A maior parte dos erros ocorre fora do horário comercial, com pico por volta das 17h — provável tarefa agendada, deploy ou infraestrutura, sem cliente na ponta.
🧵 traceId: 42c9bba8-45e1-4592-add… ↗ · 989a5e06-5624-4ad9-992… ↗ · 1e6cf7c2-6597-4894-82e… ↗
↳ at Dattos.Platform.Services.Matching.MatchingService.<ValidateContextAuthorizationAsync>d__66.MoveNext() in C:\jenkins-dev\workspace\dattos-recon-net_patch-15.4.18\Dattos.Platform.
ArgumentNullException: Value cannot be null. Parameter name: entity…ESCALANDO ·?🎫 PRD-9187 · Tarefas pendentes · candidato · confirme ↗ (card Jira candidato — confirme)🐞 corrigir bug🌙 Pico de logs às 23h · fora do expediente▲ 475% subindocrônico (visto em 15 de 15 snapshots)
23/24h23 · 72h
Módulo Indeterminado · origem Back · 6 clientes (operafidc, opea, dattos-uat (BTG), +2) · em alta · vs ~7d ▲475% subindo · apareceu pela 1ª vez há 44 dias
priorizado por: crescendo agora
versão16.4.7 · 83% (+2)
A amostra do passo não atualiza e o usuário não consegue conferir o dado antes de seguir com o fluxo.
ver diagnóstico
🎫 Card aberto relacionado: PRD-9187 (Tarefas pendentes) ↗ — Mesmo card do grupo de identificador de staging vazio: este grupo é a mesma rotina de atualizar a amostra do passo de resultado de importação, vista pelo erro de dado obrigatório nulo. Candidato, confirme se é o mesmo defeito.. Candidato, confirme que é o mesmo problema antes de assumir que já há alguém nele.
🧭 Onde aconteceAcontece ao atualizar a amostra de um passo de resultado de importação, quando o sistema monta a consulta ao motor de dados.
👁 O que o cliente vêA amostra do passo não atualiza e o usuário não consegue conferir o dado antes de seguir com o fluxo.
🤔 Causa provávelA montagem da consulta recebe vazio um dado obrigatório. Aparece no mesmo passo e nos mesmos clientes do problema de identificador do staging — pode ser o mesmo defeito visto de outro ponto. Confirme antes de tratar como separado. confiança média
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 1 erro · 4% do dia · horário comercial11h–12h · 0 erros · 0% do dia · horário comercial12h–13h · 1 erro · 4% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 1 erro · 4% do dia · horário comercial15h–16h · 0 erros · 0% do dia · horário comercial16h–17h · 0 erros · 0% do dia · horário comercial17h–18h · 0 erros · 0% do dia · horário comercial18h–19h · 0 erros · 0% do dia19h–20h · 5 erros · 22% do dia20h–21h · 1 erro · 4% do dia21h–22h · 3 erros · 13% do dia22h–23h · 3 erros · 13% do dia23h–24h · 8 erros · 35% do dia · pico
0h9h18h23h
A maior parte dos erros ocorre fora do horário comercial, com pico por volta das 23h — provável tarefa agendada, deploy ou infraestrutura, sem cliente na ponta.
🧵 traceId: ba22e611-73f8-41f7-9c5… ↗ · aea825b1-f560-4423-bb0… ↗ · aba21a13-c13b-45d1-b0b… ↗
↳ at Dattos.Platform.Services.Etls.Steps.ImportResultStepService.<BuildDataEngineQueryAsync>d__17.MoveNext() in C:\jenkins-dev\workspace\dattos-recon-net_release\Dattos.Platform.Serv
ArgumentException: Erro ao enviar e-mail #212147. Destinatário do…CRÔNICO🔬 investigar🕘 Pico de logs às 17h— sem mudançacrônico (visto em 15 de 15 snapshots)
20/24h22 · 72h
Módulo Notificação · E-mail · origem Back · 6 clientes (opea, dattos (BTG), atlas, +2) · em alta · vs ~7d ▲5% subindo · apareceu pela 1ª vez há 44 dias
priorizado por: 6 ambientes afetados
versão16.4.7 · 68% (+2)
O e-mail não sai. Quem esperava o aviso (resultado de execução, alerta de fluxo) não recebe nada e não fica sabendo.
ver diagnóstico
🧭 Onde aconteceAcontece na rotina que envia os e-mails da plataforma, ao preparar a mensagem.
👁 O que o cliente vêO e-mail não sai. Quem esperava o aviso (resultado de execução, alerta de fluxo) não recebe nada e não fica sabendo.
🤔 Causa provávelA mensagem chega à rotina de envio sem destinatário. Aponta para cadastro incompleto ou para o remetente do aviso não preencher o destino. Vale checar de qual aviso partem essas mensagens. confiança média
0h–1h · 0 erros · 0% do dia1h–2h · 0 erros · 0% do dia2h–3h · 0 erros · 0% do dia3h–4h · 0 erros · 0% do dia4h–5h · 0 erros · 0% do dia5h–6h · 0 erros · 0% do dia6h–7h · 0 erros · 0% do dia7h–8h · 0 erros · 0% do dia8h–9h · 0 erros · 0% do dia9h–10h · 1 erro · 5% do dia · horário comercial10h–11h · 3 erros · 15% do dia · horário comercial11h–12h · 4 erros · 20% do dia · horário comercial12h–13h · 1 erro · 5% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 0 erros · 0% do dia · horário comercial15h–16h · 0 erros · 0% do dia · horário comercial16h–17h · 0 erros · 0% do dia · horário comercial17h–18h · 5 erros · 25% do dia · pico18h–19h · 0 erros · 0% do dia19h–20h · 3 erros · 15% do dia20h–21h · 1 erro · 5% do dia21h–22h · 1 erro · 5% do dia22h–23h · 0 erros · 0% do dia23h–24h · 1 erro · 5% do dia
0h9h18h23h
A maior parte dos erros ocorre no horário comercial (9–18h), com pico por volta das 17h — provável impacto real de cliente.
🧵 traceId: ebbee15f-3d35-44c8-b33… ↗
↳ at Dattos.Platform.Services.Common.SendEmailJob.<SendMail>d__8.MoveNext()

+ 1 que também pedem ação — abra a aba 🗂 Tabela (ordenada por volume).

📊 Gráficos — toda a análise visual num lugar só. Tudo derivado dos snapshots gravados, mesma régua da Triagem.
🎯 O que atacar — impacto — quem dói, em quem, e quantos itens pedem ação

🏆 Top ofensores por volume — com cliente mais impactado — 24h · eixo fixo (maior = 306) · cor = balde de ação

306/24h
👤 mais impactado: dattos (BTG) · 29% · espalhado por 27 ambientes
183/24h
👤 mais impactado: query-srv-aws-16-4 · 41% · espalhado por 9 ambientes
153/24h
👤 mais impactado: argo · 60% · espalhado por 9 ambientes
130/24h
👤 mais impactado: operafidc · 14% · espalhado por 23 ambientes
114/24h
👤 mais impactado: opea · 49% · espalhado por 10 ambientes
68/24h
👤 mais impactado: opea · 29% · espalhado por 6 ambientes
63/24h
👤 mais impactado: mbenz · 28% · espalhado por 15 ambientes
48/24h
👤 mais impactado: aviva · 28% · espalhado por 6 ambientes
40/24h
👤 mais impactado: opea · 26% · espalhado por 11 ambientes
30/24h
👤 mais impactado: NoWebsite · 77% · espalhado por 7 ambientes
Precisa de açãoAcompanharSem impacto
A cabeça da distribuição costuma responder por boa parte da carga acionável; a cor mostra o balde de ação. Cliente e percentual vêm da coluna de ambiente do snapshot. Detalhe por linha na aba Tabela ↗.

📦 Carga por cliente — produção · não-ruído · 72h · eixo fixo (maior = 129)

opea
129/72h
argo
97/72h
dattos (BTG)
94/72h
operafidc
65/72h
allcare
36/72h
aviva
33/72h
comercialzaffari
28/72h
bayer
22/72h
mbenz
21/72h
ccr
19/72h
bunge
14/72h
remessaonline
14/72h
Volume de erros não-ruído por cliente de produção (top 12); a cabeça domina e o resto é cauda longa. Detalhe por cliente na aba Contexto ↗.

🧭 Os 27 itens por classificação — contagem de itens (não de volume)

4 Precisa de ação16 Acompanhar7 Sem impacto
Poucos itens pedem ação; a maioria é monitoramento. Volume ≠ nº de itens — um único item pode somar milhares de ocorrências. Lista completa na aba Tabela ↗.
📈 Tendência no tempo — está piorando ou melhorando, e em que horário

🧪 Composição da carga por classificação — ~7 dias · cada coluna = uma leitura, normalizada a 100%

27/06 14h · 19% ação · 66% acompanhar · 15% sem impacto28/06 10h · 34% ação · 38% acompanhar · 28% sem impacto28/06 14h · 46% ação · 29% acompanhar · 24% sem impacto29/06 08h · 0% ação · 98% acompanhar · 2% sem impacto29/06 14h · 34% ação · 63% acompanhar · 3% sem impacto30/06 08h · 29% ação · 71% acompanhar · 0% sem impacto01/07 08h · 35% ação · 64% acompanhar · 0% sem impacto02/07 08h · 48% ação · 52% acompanhar · 1% sem impacto03/07 09h · 59% ação · 36% acompanhar · 4% sem impacto04/07 09h · 13% ação · 71% acompanhar · 16% sem impacto06/07 08h · 0% ação · 43% acompanhar · 57% sem impacto07/07 09h · 34% ação · 50% acompanhar · 16% sem impacto21/07 08h · 91% ação · 8% acompanhar · 0% sem impacto04/08 08h · 66% ação · 33% acompanhar · 1% sem impacto11/08 09h · 13% ação · 55% acompanhar · 33% sem impacto27/06agora
Precisa de açãoAcompanharSem impacto
topo em Precisa de ação: NullReferenceException: Object… 114/24htopo em Acompanhar: OperationCanceledException: Erro… 2/24htopo em Sem impacto: InvalidOperationException: Sequence… 306/24h
Não é o volume (esse está na Tendência, na aba Triagem) — é a mistura: que fração de cada leitura pedia ação. Passe o mouse numa coluna para ver as frações. Os campeões refletem a leitura atual (o topo por balde de leituras passadas não é gravado).

🕘 Ritmo do dia — maior ofensor — NullReferenceException: Object… por hora (BRT, 24h)

horário comercial 9–180h–1h · 0 erros · 0% do dia · fora do expediente1h–2h · 0 erros · 0% do dia · fora do expediente2h–3h · 0 erros · 0% do dia · fora do expediente3h–4h · 0 erros · 0% do dia · fora do expediente4h–5h · 0 erros · 0% do dia · fora do expediente5h–6h · 0 erros · 0% do dia · fora do expediente6h–7h · 0 erros · 0% do dia · fora do expediente7h–8h · 0 erros · 0% do dia · fora do expediente8h–9h · 0 erros · 0% do dia · fora do expediente9h–10h · 0 erros · 0% do dia · horário comercial10h–11h · 3 erros · 3% do dia · horário comercial11h–12h · 0 erros · 0% do dia · horário comercial12h–13h · 0 erros · 0% do dia · horário comercial13h–14h · 0 erros · 0% do dia · horário comercial14h–15h · 16 erros · 14% do dia · horário comercial15h–16h · 4 erros · 4% do dia · horário comercial16h–17h · 4 erros · 4% do dia · horário comercial17h–18h · 26 erros · 23% do dia · pico18h–19h · 23 erros · 20% do dia · fora do expediente19h–20h · 12 erros · 11% do dia · fora do expediente20h–21h · 24 erros · 21% do dia · fora do expediente21h–22h · 2 erros · 2% do dia · fora do expediente22h–23h · 0 erros · 0% do dia · fora do expediente23h–24h · 0 erros · 0% do dia · fora do expediente0h6h9h12h15h18h23h26
A faixa 9–18h é o horário de operação. Concentração no comercial é assinatura de uso real de cliente (não tarefa agendada); fora dele, costuma ser infra/deploy/agendado. Perfil horário só do maior ofensor deste snapshot.
👀 Acompanhar & frota — o que vigiar e o denominador de risco por versão

🛰 Saúde da frota — 48 clientes por proximidade da versão de produção (16.4.x)

29 na linha (16.4.x)19 atrás0 à frente
É o denominador que normaliza o risco por versão. Os 19 atrás (dattos-uat (BTG) 15.4.18, dattos (BTG) 15.4.18, agibank 16.3.9, sales-v15 16.3.27, sales 16.3.30) podem carregar bug já corrigido. Detalhe por cliente na aba Contexto ↗.
👀 Contexto — acompanhar · ritmo do dia · o que mudou · clientes afetados (investigação secundária)
👀 16 p/ acompanhar · 7 sem impacto housekeeping — não atinge cliente

👀 Acompanhar — ainda não atinge cliente, ou já diminuindo

datalake-arquivo-ausente · Query+Back · crescendo231/24h
Error in _create_connection(). Traceback… · Matching · crescendo30/24h
NpgsqlException: Erro durante importação ID… · Back · recorrente, sem crescer4/24h
Error in _create_connection(). RabbitMQ… · Pipeline · crescendo40/24h
DirectoryNotFoundException: Could not find a… · Back · recorrente, sem crescer6/24h
Passa para Precisa de ação se voltar a crescer e atingir 3 ou mais ambientes.

🩹 Ruído — o que vale consertar na fonte

Consertar a fonte (some do log de verdade) — não silenciar (silenciar cega o plantão). A barra usa só a janela de 24h (base 1.313 erros).

InvalidOperationException: Sequence… · Back · sem tipo / baixo valor
306/24h · 23%
consertar a fonte · 👤 sem dono · definir
AuthorizationException: Você não tem… · Back · sem tipo / baixo valor
68/24h · 5%
consertar a fonte · 👤 sem dono · definir
RedisTimeoutException: Timeout awaiting… · Back · infraestrutura sem cliente
26/24h · 2%
consertar a fonte · 👤 sem dono · definir
An error occurred while reading from the… · Back · sem tipo / baixo valor
18/24h · 1%
consertar a fonte · 👤 sem dono · definir
session-init call failed for user=postgres… · Dattos-Gateway · infraestrutura sem cliente
6/24h · 0%
consertar a fonte · 👤 sem dono · definir
Redis checkpointer init FAILED… · Agents · infraestrutura sem cliente
3/24h · 0%
consertar a fonte · 👤 sem dono · definir
Consertando o maior (InvalidOperationException…): o painel de 24h cairia de 1.313 para ~1.007.
🕘 Pico de erros às 17h uso real (9–18) vs infra/agendado

Erros que pedem atenção por hora do dia (últimas 24h). A faixa 9–18 é o horário comercial: erro que sobe nela tende a ser uso real de cliente; fora dela, costuma ser infra/deploy ou tarefa agendada (e-mail, importação).

horário comercial 9–180h–1h · 5 erros · 1% do dia · fora do expediente1h–2h · 0 erros · 0% do dia · fora do expediente2h–3h · 0 erros · 0% do dia · fora do expediente3h–4h · 0 erros · 0% do dia · fora do expediente4h–5h · 0 erros · 0% do dia · fora do expediente5h–6h · 1 erro · 0% do dia · fora do expediente6h–7h · 1 erro · 0% do dia · fora do expediente7h–8h · 13 erros · 1% do dia · fora do expediente8h–9h · 9 erros · 1% do dia · fora do expediente9h–10h · 44 erros · 5% do dia · horário comercial10h–11h · 47 erros · 5% do dia · horário comercial11h–12h · 44 erros · 5% do dia · horário comercial12h–13h · 88 erros · 9% do dia · horário comercial13h–14h · 31 erros · 3% do dia · horário comercial14h–15h · 62 erros · 7% do dia · horário comercial15h–16h · 70 erros · 8% do dia · horário comercial16h–17h · 41 erros · 4% do dia · horário comercial17h–18h · 110 erros · 12% do dia · pico18h–19h · 60 erros · 6% do dia · fora do expediente19h–20h · 92 erros · 10% do dia · fora do expediente20h–21h · 76 erros · 8% do dia · fora do expediente21h–22h · 30 erros · 3% do dia · fora do expediente22h–23h · 39 erros · 4% do dia · fora do expediente23h–24h · 65 erros · 7% do dia · fora do expediente0h6h9h12h15h18h23h110
🔁 5 novos · 7 pararam vs 2026-08-04 08:55 · 1 semanas atrás
✅ Resolvidos (provável) — pararam de aparecer e antes pediam atenção. Parou não é o mesmo que corrigido: confirme a causa.
·
−1
·
−13
·
−9
·
−7
·
−3
5 de 5 sem card identificado — é o esperado: a maioria some por mudança de uso ou de dado, não por correção. Ausência de card não prova nada nos dois sentidos.
👥 27 clientes atingidos · 10 em 3+ ambientes quem e onde

🌎 Por ambiente — os totais não se somam (uma mesma falha aparece em vários)

"Outros (NoWebsite)" = evento sem ambiente identificado no registro (atribuição estimada).

Homolog/UAT · 2 grupos · 426 hits
🏷 Risco por versão taxa por cliente

Ranque por taxa por cliente (erros ÷ clientes que rodam a versão), nunca por contagem bruta. Piso de 3 clientes: abaixo disso é amostra fraca.

VersãoLinhagemErros (não-ruído)ClientesTaxa/cliente
16.4.716.4.x5072818.1
16.4.616.4.x2691269 amostra fraca
16.3.3516.3.x6
16.3.3316.3.x10110 amostra fraca
16.3.3116.3.x2111316.2
16.3.3016.3.x111 amostra fraca
16.3.2716.3.x212 amostra fraca
16.3.916.3.x111 amostra fraca
15.4.1815.4.x98249 amostra fraca
📦 Carga por cliente (volume) top por volume

Volume de erros não-ruído por cliente de produção (top 12), base deste snapshot (47 de 130 ambientes afetados em 72h). Internos e máquinas de dev fora.

opea
129/72h
argo
97/72h
dattos (BTG)
94/72h
operafidc
65/72h
allcare
36/72h
aviva
33/72h
comercialzaffari
28/72h
bayer
22/72h
mbenz
21/72h
ccr
19/72h
bunge
14/72h
remessaonline
14/72h
🛰 Frota — versão por cliente 48 clientes

Distribuição da frota por versão (1 barra por versão; quem está atrás da versão de produção mais comum carrega bug já corrigido). É o denominador que normaliza o risco por versão.

16.4.7 ★
28 clientes
16.4.6 ★
1 cliente
16.3.33
1 cliente
16.3.31
13 clientes
16.3.30
1 cliente
16.3.27
1 cliente
16.3.9
1 cliente
15.4.18
2 clientes
★ = versão de produção mais comum (16.4.x)atrásna linhaà frente
ver por cliente (48)
ClienteVersão dominanteTambém vistaAtraso?
dattos-uat (BTG)15.4.18⚠ versão antiga
dattos (BTG)15.4.18⚠ versão antiga
agibank16.3.9⚠ versão antiga
sales-v1516.3.27⚠ versão antiga
sales16.3.30⚠ versão antiga
acelen16.3.31⚠ versão antiga
aviva16.3.31⚠ versão antiga
bunge16.3.31⚠ versão antiga
ccab-agro16.3.31⚠ versão antiga
comercialzaffari16.3.3116.3.33⚠ versão antiga
fiergs16.3.31⚠ versão antiga
gpabr16.3.31⚠ versão antiga
mbenz16.3.31⚠ versão antiga
natura16.3.31⚠ versão antiga
remessaonline16.3.31⚠ versão antiga
sondait16.3.31⚠ versão antiga
tribanco16.3.31⚠ versão antiga
unimedvitoria16.3.31⚠ versão antiga
sales-stable16.3.3316.3.31⚠ versão antiga
uniasselvi16.4.6✓ atual
allcare16.4.716.4.6✓ atual
bayer16.4.716.4.6✓ atual
cervejariacidadeimperial16.4.716.4.6✓ atual
cofco16.4.716.4.6✓ atual
holambracoop16.4.716.4.6✓ atual
opea16.4.716.4.6✓ atual
operafidc16.4.716.4.6✓ atual
123milhas16.4.7✓ atual
afextyc16.4.7✓ atual
argo16.4.7✓ atual
atlas16.4.7✓ atual
brpartners16.4.7✓ atual
ccr16.4.7✓ atual
conciliadorrm16.4.7✓ atual
csf-qa16.4.7✓ atual
edenred16.4.7✓ atual
embarca16.4.7✓ atual
ifoodcorp16.4.7✓ atual
ipiranga16.4.7✓ atual
iugu16.4.7✓ atual
kryptonbpo16.4.7✓ atual
marcio16.4.7✓ atual
qualicorp16.4.7✓ atual
simpaul16.4.7✓ atual
solinftec16.4.7✓ atual
vwfs16.4.7✓ atual
zaffari16.4.7✓ atual
zortea16.4.7✓ atual
🗂 28 grupos · fonte de investigação — ordenada por volume 72h · filtrável por origem

Fonte crua de investigação: todos os grupos com classificação por IA, versões e link Loki. A ordem por volume 72h cobre o antigo "Top 10"; use o filtro por origem para fatiar por sistema.

#ClassificaçãoTipo de erroErroSistemaCliente principalNº amb.AmbientesVersões24h72hTendência
1Sem impactoAgendador executa fluxo que já estava paradoInvalidOperationException: Sequence contains no elements Trace: at…Backdattos (BTG)27prod, eng-internal, local, dev, other, hom15.4.18, 16.3.30306403▼ 54%
2AcompanharConsulta não encontra os arquivos da análise no datalakeUnhandled exception on /query: IO Error: No files found that match the…Queryquery-srv-aws-16-49other, prod, dev16.3.31, 16.4.6183186▼ 93%
3AcompanharConsulta ao banco estoura o tempo, concentrada em um clienteSqlException: Execution BackgroundServerProcess is still in the Failed state…Backargo9prod, dev, other15.4.18, 16.3.9153163▲ 66%
4AcompanharLicença expirada barra o acesso do suporte ao clienteBusinessException: Failed to process the job: an exception occurred. Storage…Backoperafidc23prod, eng-internal, local, dev15.4.18, 16.3.31130161▼ 23%
5AcompanharConciliação perde conexão com o servidor de mensagensError in _create_connection(). Traceback (most recent call last): File…MatchingNoWebsite7other, prod, dev16.3.31, 16.3.3330130▲ 306%
6Precisa de ação Passo de resultado da importação abre sem o identificador do stagingNullReferenceException: Object reference not set to an instance of an object…Backopea10prod, dev, local, eng-internal15.4.18, 16.3.27114123▲ 515%
7Sem impactoMotor de dados em máquina de desenvolvimento sem fila de mensagensError in _create_connection(). Traceback (most recent call last): File…DataEngineNoWebsite1other16.4.60104novo
8AcompanharErro de tela: campo de seleção quebra ao interagirFrontException: Cannot read properties of undefined (reading 'find') Trace…Frontmbenz15prod, dev, other, eng-internal, local16.3.31, 16.4.76369▼ 48%
9Sem impactoAcesso negado ao configurar ou executar processoAuthorizationException: Você não tem permissão para configurar um Processo…Backopea6prod, dev16.4.76868▲ 26%
10AcompanharTransformação do fluxo não encontra a tabela do passo anteriorError in _create_connection(). RabbitMQ blocking_connection (pika) falhou +…Pipelineopea11prod, local, dev, other16.3.31, 16.4.64062▼ 26%
11AcompanharBackend não encontra os arquivos do resultado de importaçãoHttpRequestException: An error occurred while sending the request. Trace: at…Backaviva6prod, dev, eng-internal16.3.31, 16.3.354850▼ 95%
12AcompanharFalha de envio de e-mail (limite do servidor)SmtpException: Erro ao enviar e-mail #212199. Service not available, closing…Backdattos (BTG)1prod15.4.182730▼ 49%
13Sem impactoCache de clientes estoura o tempo de respostaRedisTimeoutException: Timeout awaiting response (outbound=0KiB…BackNoWebsite1other16.4.72626novo
14Precisa de açãoAtualizar a amostra do passo de importação falha por dado obrigatório vazioArgumentNullException: Value cannot be null. Parameter name: entity Value…Backoperafidc6prod, hom, eng-internal15.4.18, 16.3.312323▲ 475%
15Precisa de açãoEnvio de e-mail sem destinatário definidoArgumentException: Erro ao enviar e-mail #212147. Destinatário do e-mail não…Backopea6prod, eng-internal15.4.18, 16.3.312022— sem mudança
16Sem impacto Execução recusada por fluxo já parado (sem classe de erro)An error occurred while reading from the store provider's data reader. See…Backopea4prod16.4.71818▲ 29%
17AcompanharPasta de importação (SFTP) não encontradaDirectoryNotFoundException: Could not find a part of the path…Backccr1prod16.4.7618— sem mudança
18Sem impactoGateway/serviço novo falhandosession-init call failed for user=postgres host= Traceback (most recent call…Dattos-GatewayNoWebsite1other16.4.4618▼ 91%
19Acompanhar Importação estoura o tempo ao ler a origem externaNpgsqlException: Erro durante importação ID 2491313 The operation has timed…Backdattos (BTG)1prod15.4.18415— sem mudança
20Precisa de açãoArquivo de importação ausente no armazenamentoFileNotFoundException: File not found on storage Ttl. Details: FileName…Backdattos (BTG)4prod, dev15.4.18, 16.4.71113— sem mudança
21AcompanharFalha ao ler/gravar no banco (EF/DB)EntityCommandExecutionException: Failed to process the job '10432337': an…Backvwfs8prod, dev16.3.31, 16.4.7911▼ 54%
22AcompanharResposta inválida do motor de dados (502)JsonReaderException: DataEngine returned non-parseable JSON on route…Backacelen7prod, eng-internal, local16.3.30, 16.3.31610▼ 96%
23AcompanharAgendamento: falha ao abrir conexão no polling de regrasEntityException: Failed to execute polling task. The underlying provider…Backsolinftec4prod16.4.746▼ 73%
24AcompanharPainel não encontra a coluna do pacote de configuraçãoIndexOutOfRangeException: ConfigPackName ConfigPackName Trace: at…Backeng-release-fix1eng-internal16.4.744novo
25AcompanharEtapa de saída cancelada ao chamar serviço externoTaskCanceledException: Error processing IOutputStep 9968. A task was…BackNoWebsite2other, prod16.3.31, 16.4.744▲ 33%
26Sem impactoInfraestrutura: Redis indisponível (Agents)Redis checkpointer init FAILED (TimeoutError: Timeout connecting to server) |…AgentsNoWebsite1other33▼ 63%
27AcompanharLimpeza de temporários encontra arquivo em usoIOException: Erro ao executar expurgo de arquivos - Diretório…Backcomercialzaffari2prod15.4.18, 16.3.3133novo
28Acompanhar Importação cancelada durante a gravaçãoOperationCanceledException: Erro durante importação ID 2596266 The operation…Backdattos (BTG)1prod15.4.1823novo
❓ Ajuda — como ler este painel · seções que ligam quando a coleta acumular dado
❓ Como ler este painel — régua, símbolos e limites (toque para abrir)
Os 3 baldes (regra automática, auditável)
  • Precisa de ação erro de produto/dado que atinge cliente e está crescendo (≥5 ocorrências/24h) ou aparece em ≥3 ambientes sem cair (≥8/24h).
  • Acompanhar ainda não atinge cliente, ou já está diminuindo.
  • Sem impacto só em máquina de desenvolvimento ou infraestrutura, sem cliente.
  • Saturação/capacidade (disco, pool, timeout, fila) sobe para "Precisa de ação" mesmo sem cliente — precede a falha visível.

"Atinge cliente" = ambiente que não é dev (local-*), teste (eng-*), serviço ou NoWebsite. Toda contagem tem link Loki ao lado para conferir na fonte.

Símbolos
  • 🔍 vX? hipótese de regressão de uma versão recente — a confirmar, não veredito.
  • 🔗 N incidente consolidado de N erros da mesma raiz.
  • 🎫 PRD-… card Jira candidato — confirme que é o mesmo problema.
  • 🔥 módulo mais comprometido agora · crônico visto em ≥4 snapshots.
  • em alta / constante / diminuindo = ritmo recente (24h vs 72h). ▲/▼ % = tendência vs o snapshot anterior. Eixos diferentes.
  • NOVO / ESCALANDO / CRÔNICO = apareceu agora / subiu ≥50% vs ontem ou ~7d (base curta, baixa confiança) / recorrente em ≥4 snapshots. vs ontem / vs ~7d compara com o snapshot daquele período.
Cor

vermelho = precisa de ação · amarelo = acompanhar · cinza = sem impacto. Borda esquerda mais grossa = mais volume. Card apagado = perdendo força.

⏱ Horizonte: comparações cobrem ~7 dias (14 snapshots de 12/12h); não há base "vs semana/mês passado" nem horário exato de última ocorrência. 🏷 Tipo de erro é classificado por IA (pode errar — confirme no Loki). Contagens podem ser piso quando a consulta satura.