Este guia deve ser utilizado para diagnosticar e resolver problemas comuns que podem ser encontrados ao trabalhar com workloads.
Entendendo lacunas em mapas de serviço
Ao visualizar mapas de dependência de serviço em workloads, podem ser observadas ocasionalmente lacunas visuais ou nós de serviço desconectados. Essas interrupções geralmente decorrem de limites de amostragem de trace, falta de telemetria ao longo do caminho da transação ou tipos de entidade não suportados.
Causas e Correções Comuns
Se os limites de amostragem forem muito baixos para uma conexão de serviço específica, o New Relic pode não ter dados de trace suficientes durante a janela de consulta para exibir a conexão entre os serviços.
Correção: atualizar o agente APM para a versão mais recente e ajustar a configuração de amostragem para habilitar a amostragem de trace aprimorada.
Um serviço no meio de um caminho de transação pode processar requests normalmente, mas falhar ao transmitir dados de span para o New Relic, quebrando a cadeia visual.
Correção: verificar se o serviço está instrumentado, checar a conectividade de rede e as regras de firewall e inspecionar os logs do agente em busca de erros de transmissão de telemetria.
Certos componentes de infraestrutura (como serviços gerenciados específicos da AWS) ou instrumentação personalizada não suportam o envio de dados de span. Nestes cenários, lacunas ao longo desse caminho de execução específico são esperadas e não podem ser resolvidas.
Nenhuma ação é necessária. Essas lacunas refletem os limites da instrumentação de distributed trace para esse componente.
Por Que os Serviços Downstream Aparecem Desconectados
Quando um serviço intermediário em um trace falha ao enviar dados de span, os serviços downstream não desaparecem do workload — eles aparecem como fragmentos isolados.
Como esses serviços downstream enviam com sucesso o contexto do trace para o New Relic, eles permanecem visíveis no workload. No entanto, sem os dados de span do serviço pai ausente, eles perdem sua âncora visual no mapa e aparecem desconectados, juntamente com quaisquer serviços filhos conectados que gerenciam.
Para resolver os nós downstream desconectados, é necessário corrigir a lacuna de telemetria no serviço intermediário usando as etapas acima.