Importante
Habilite a integração do AWS CloudWatch Metric Streams para monitor todas as métricas do CloudWatch de seus serviços da AWS, incluindo namespace personalizado. A integração individual não é mais nossa opção recomendada.
A integração da infraestrutura da New Relic inclui uma integração para relatar dados do Amazon Elasticsearch para a New Relic. Este documento explica o recurso de integração, como ativá-lo e quais dados podem ser informados.
Recurso
O Amazon Elasticsearch Service é um serviço totalmente gerenciado que oferece API fácil de usar e recursos de tempo real do Elasticsearch, além da disponibilidade, escalabilidade e segurança exigidas pela carga de trabalho de produção. A integração de monitoramento Elasticsearch da New Relic permite rastrear o status cluster , utilização da CPU, latência de leitura/gravação, taxas de transferência e outras métricas, em momentos específicos. Os dados do Elasticsearch também estão disponíveis para consultar, analisar e mapear seus dados.
Ativar integração
Para habilitar essa integração, siga os procedimentos padrão para conectar os serviços da AWS ao New Relic.
Configuração e polling
Você pode alterar a frequência de pesquisa e filtrar dados usando opções de configuração.
Informações de pesquisa padrão para a integração do Amazon Elasticsearch:
- Intervalo de sondagem New Relic : 5 minutos
- Intervalo de dados do Amazon CloudWatch: 1 minuto
Visualizar e usar dados
Para visualizar e usar os dados desta integração, acesse one.newrelic.com > All capabilities > Infrastructure > AWS e selecione um dos links de integração do Elasticsearch.
Para consultar e explorar seus dados, use o tipo de evento DatastoreSample com o valor provider apropriado:
ElasticsearchClusterpara agrupamentoElasticsearchNodepara nós
Dados métricos
A integração do Elasticsearch coleta estas métricas para cluster:
Nome | Estatísticas relevantes | Descrição |
|---|---|---|
| Mínimo máximo | Indica que todos os fragmentos de índice estão alocados para nós no cluster. |
| Mínimo máximo | Indica que os fragmentos primários de todos os índices estão alocados para nós em um cluster, mas os fragmentos de réplica de pelo menos um índice não estão. O cluster de nó único sempre inicializa com esse status cluster porque não há nenhum segundo nó ao qual uma réplica possa ser atribuída. Você pode aumentar a contagem de nós para obter um status de cluster verde ou usar a API do Amazon ES para definir a configuração |
| Mínimo máximo | Indica que os fragmentos primários e de réplica de pelo menos um índice não estão alocados para nós em um cluster. Para obter mais informações, consulte a documentação da Amazon sobre Red Cluster Status. |
| Mínimo, Máximo, Média | O número de nós no cluster do Amazon ES. |
| Mínimo, Máximo, Média | O número total de documentos pesquisáveis em todos os índices do cluster. |
| Mínimo, Máximo, Média | O número total de documentos excluídos em todos os índices do cluster. |
| Mínimo, Máximo, Média | A porcentagem máxima de recursos de CPU usados para nós de dados no cluster. |
| Mínimo | O espaço livre, em megabytes, para todos os nós de dados no cluster. |
| Mínimo máximo | O espaço total usado, em megabytes, para um cluster. |
| Máximo | Indica se o seu cluster está aceitando ou bloqueando solicitações de gravação recebidas. Um valor 0 significa que o cluster está aceitando solicitações. Um valor 1 significa que está bloqueando solicitações. |
| Máximo | A porcentagem máxima do heap Java usado para todos os nós de dados no cluster. |
| Mínimo máximo | O número de snapshots automatizados com falha para o cluster. Um valor 1 indica que nenhum snapshot automatizado foi obtido para o domínio nas últimas 36 horas. |
| Mínimo | Os créditos de CPU restantes disponíveis para nós de dados no cluster. Um crédito de CPU fornece o desempenho de um núcleo de CPU completo por um minuto. Esta métrica está disponível apenas para t2.micro.elasticsearch, t2.small.elasticsearch, e t2.medium.elasticsearch tipo de instância. |
| Mínimo | Um exame de saúde para Kibana. Um valor de 1 indica comportamento normal. Um valor 0 indica que o Kibana está inacessível. Na maioria dos casos, a saúde do Kibana reflete a saúde do cluster. |
| Mínimo máximo | Um valor 1 indica que a chave mestra de clientes KMS usada para criptografar dados em repouso foi desativada. Para restaurar o domínio às operações normais, reative a chave. |
| Mínimo máximo | Um valor 1 indica que a chave mestra de clientes KMS usada para criptografar dados em repouso foi excluída ou suas concessões foram revogadas ao Amazon ES. Não é possível recuperar domínios que estejam neste estado. Porém, se você tiver um instantâneo manual, poderá usá-lo para migrar os dados do domínio para um novo domínio. |
| Soma | O número de solicitações HTTP feitas ao cluster Elasticsearch que incluíam um cabeçalho de host inválido (ou ausente). |
| Soma | O número de solicitações feitas ao cluster Elasticsearch. |
| Soma | O número de solicitações para um domínio e o código de resposta HTTP (2xx, 3xx, 4xx, 5xx) para cada solicitação. |
| Média | A porcentagem máxima de recursos de CPU usados pelos nós principais dedicados. Recomendamos aumentar o tamanho do tipo de instância quando essa métrica atingir 60%. |
| Máximo | A porcentagem máxima do heap Java usado para todos os nós principais dedicados no cluster. Recomendamos migrar para um tipo de instância maior quando essa métrica atingir 85%. |
| Mínimo | Os créditos de CPU restantes disponíveis para nós principais dedicados no cluster. Um crédito de CPU fornece o desempenho de um núcleo de CPU completo por um minuto. Esta métrica está disponível apenas para t2.micro.elasticsearch, t2.small.elasticsearch, e t2.medium.elasticsearch tipo de instância. |
| Mínimo | Uma verificação de integridade para Falhas significam que o nó mestre parou ou não está acessível. Geralmente são o resultado de um problema de conectividade de rede ou de dependência da AWS. |
| Mínimo, Máximo, Média | A latência, em segundos, para operações de leitura em volumes do EBS. |
| Mínimo, Máximo, Média | A latência, em segundos, para operações de gravação em volumes do EBS. |
| Mínimo, Máximo, Média | As taxas de transferência, em bytes por segundo, para operações de leitura em volumes EBS. |
| Mínimo, Máximo, Média | As taxas de transferência, em bytes por segundo, para operações de gravação em volumes EBS. |
| Mínimo, Máximo, Média | O número de solicitações de entrada e saída (E/S) pendentes para um volume do EBS. |
| Mínimo, Máximo, Média | O número de operações de entrada e saída (E/S) por segundo para operações de leitura em volumes do EBS. |
| Mínimo, Máximo, Média | O número de operações de entrada e saída (E/S) por segundo para operações de gravação em volumes do EBS. |
As seguintes métricas são coletadas para o cluster do Elasticsearch e, opcionalmente, também para cada instância ou nó de um domínio:
Nome | Estatísticas relevantes | Descrição |
|---|---|---|
| Para nós: média Para cluster: Média, Máximo | O tempo médio, em milissegundos, que um fragmento leva para concluir uma operação de indexação. |
| Para nós: média Para cluster: Média, Máximo, Soma | O número de operações de indexação por minuto. |
| Para nós: média Para cluster: Média, Máximo | O tempo médio, em milissegundos, que um fragmento leva para concluir uma operação de pesquisa. |
| Para nós: média Para cluster: Média, Máximo, Soma | O número total de solicitações de pesquisa por minuto para todos os fragmentos em um nó. |
| Mínimo, Máximo, Média | A porcentagem da memória da instância que está em uso. |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | O número de vezes que a coleta de lixo da “geração jovem” foi realizada. Um número grande e cada vez maior de execuções é uma parte normal das operações do cluster. |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | A quantidade de tempo, em milissegundos, que o cluster gastou executando a coleta de lixo da "geração jovem". |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | O número de vezes que a coleta de lixo da "geração antiga" foi executada. Num cluster com recursos suficientes, este número deverá permanecer pequeno e crescer com pouca frequência. |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | A quantidade de tempo, em milissegundos, que o cluster gastou executando a coleta de lixo da "geração antiga". |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | O número de tarefas enfileiradas no conjunto de encadeamentos de mesclagem forçada. Se o tamanho da fila for consistentemente alto, considere dimensionar o cluster. |
| Para nós: Máximo Para cluster: Soma | O número de tarefas rejeitadas no conjunto de encadeamentos de mesclagem forçada. Se esse número crescer continuamente, considere dimensionar seu cluster. |
| Para nós: Máximo Para cluster: Soma, Média | O tamanho do conjunto de encadeamentos de mesclagem forçada. |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | O número de tarefas enfileiradas no conjunto de threads de índice. Se o tamanho da fila for consistentemente alto, considere dimensionar o cluster. O tamanho máximo da fila de índice é 200. |
| Para nós: Máximo Para cluster: Soma | O número de tarefas rejeitadas no conjunto de threads de índice. Se esse número crescer continuamente, considere dimensionar seu cluster. |
| Para nós: Máximo Para cluster: Soma, Média | O tamanho do conjunto de threads de índice. |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | O número de tarefas enfileiradas no conjunto de encadeamentos de pesquisa. Se o tamanho da fila for consistentemente alto, considere dimensionar o cluster. O tamanho máximo da fila de pesquisa é 1.000. |
| Para nós: Máximo Para cluster: Soma | O número de tarefas rejeitadas no conjunto de threads de pesquisa. Se esse número crescer continuamente, considere dimensionar seu cluster. |
| Para nós: Máximo Para cluster: Soma, Média | O tamanho do conjunto de threads de pesquisa. |
| Para nós: Máximo Para cluster: Soma, Máximo, Média | O número de tarefas enfileiradas no conjunto de threads em massa. Se o tamanho da fila for consistentemente alto, considere dimensionar o cluster. |
| Para nós: Máximo Para cluster: Soma | O número de tarefas rejeitadas no conjunto de encadeamentos em massa. Se esse número crescer continuamente, considere dimensionar seu cluster. |
| Para nós: Máximo Para cluster: Soma, Média | O tamanho do conjunto de threads em massa. |