Importante
Habilite la integraciónAWS CloudWatch Metric Streams para monitor todas las métricas de CloudWatch desde sus servicios de AWS, incluido el espacio de nombres personalizado. La integración individual ya no es nuestra opción recomendada.
La integración New Relic Infrastructure incluye una integración para informar datos de Amazon Elasticsearch a New Relic. Este documento explica la característica de la integración, cómo activarla y qué datos se pueden reportar.
Característica
Amazon Elasticsearch Service es un servicio completamente administrado que ofrece API fácil de usar de Elasticsearch y capacidades en tiempo real junto con la disponibilidad, escalabilidad y seguridad requeridas por la carga de trabajo de producción. La integración de monitoreo Elasticsearch de New Relic le permite rastrear el estado del clúster, la utilización de la CPU, la latencia de lectura/escritura, el rendimiento y otras métricas, en momentos específicos. Los datos de Elasticsearch también están disponibles para consultar, analizar y representar gráficamente sus datos.
Activar la integración
Para habilitar esta integración, siga los procedimientos estándar para conectar los servicios de AWS a New Relic.
Configuración y sondeo
Puede cambiar la frecuencia de sondeo y filtrar datos usando las opciones de configuración.
Información de sondeo predeterminada para la integración de Amazon Elasticsearch:
- New Relic intervalo de sondeo: 5 minutos
- Intervalo de datos de Amazon CloudWatch: 1 minuto
Ver y usar datos
Para ver y utilizar los datos de esta integración, vaya a one.newrelic.com > All capabilities > Infrastructure > AWS y seleccione uno de los enlaces de integración de Elasticsearch.
Para consultar y explorar sus datos, utilice el tipo de evento DatastoreSample con el valor provider apropiado:
ElasticsearchClusterpara clusterElasticsearchNodepara nodos
Datos métricos
La integración Elasticsearch recoge estas métricas para clúster:
Nombre | Estadísticas relevantes | Descripción |
|---|---|---|
| Mínimo máximo | Indica que todos los fragmentos de índice se asignan a nodos del clúster. |
| Mínimo máximo | Indica que los fragmentos principales de todos los índices se asignan a nodos de un clúster, pero los fragmentos de réplica de al menos un índice no. El clúster de un solo nodo siempre se inicializa con este estado de clúster porque no hay un segundo nodo al que se pueda asignar una réplica. Puede aumentar el recuento de nodos para obtener un estado de clúster verde o puede utilizar la API de Amazon ES para establecer la configuración |
| Mínimo máximo | Indica que los fragmentos principal y de réplica de al menos un índice no están asignados a nodos en un clúster. Para obtener más información, consulte la documentación de Amazon sobre el estado del clúster rojo. |
| Mínimo, Máximo, Promedio | La cantidad de nodos en el clúster de Amazon ES. |
| Mínimo, Máximo, Promedio | El número total de documentos que se pueden buscar en todos los índices del clúster. |
| Mínimo, Máximo, Promedio | El número total de documentos eliminados en todos los índices del clúster. |
| Mínimo, Máximo, Promedio | El porcentaje máximo de recursos de CPU utilizados para los nodos de datos del clúster. |
| Mínimo | El espacio libre, en megabytes, para todos los nodos de datos del clúster. |
| Mínimo máximo | El espacio total utilizado, en megabytes, para un clúster. |
| Máximo | Indica si su clúster acepta o bloquea solicitudes de escritura entrantes. Un valor de 0 significa que el clúster acepta solicitudes. Un valor de 1 significa que está bloqueando solicitudes. |
| Máximo | El porcentaje máximo del montón de Java utilizado para todos los nodos de datos del clúster. |
| Mínimo máximo | La cantidad de instantáneas automatizadas fallidas para el clúster. Un valor de 1 indica que no se tomó ninguna instantánea automática para el dominio en las 36 horas anteriores. |
| Mínimo | Los créditos de CPU restantes están disponibles para los nodos de datos del clúster. Un crédito de CPU proporciona el rendimiento de un núcleo de CPU completo durante un minuto. Esta métrica está disponible solo para t2.micro.elasticsearch, t2.small.elasticsearch, y t2.medium.elasticsearch tipo de instancia. |
| Mínimo | Un control de salud para Kibana. Un valor de 1 indica un comportamiento normal. Un valor de 0 indica que Kibana es inaccesible. En la mayoría de los casos, el estado de Kibana refleja el estado del clúster. |
| Mínimo máximo | Un valor de 1 indica que la clave maestra de los clientes de KMS utilizada para cifrar datos en reposo se ha deshabilitado. Para restaurar el dominio a sus operaciones normales, vuelva a habilitar la clave. |
| Mínimo máximo | Un valor de 1 indica que la clave maestra de los clientes de KMS utilizada para cifrar datos en reposo se eliminó o se revocaron sus concesiones a Amazon ES. No se pueden recuperar dominios que se encuentren en este estado. Sin embargo, si tiene una instantánea manual, puede usarla para migrar los datos del dominio a un nuevo dominio. |
| Suma | La cantidad de solicitudes HTTP realizadas al clúster de Elasticsearch que incluían un encabezado de host no válido (o faltante). |
| Suma | La cantidad de solicitudes realizadas al clúster de Elasticsearch. |
| Suma | La cantidad de solicitudes a un dominio y el código de respuesta HTTP (2xx, 3xx, 4xx, 5xx) para cada solicitud. |
| Promedio | El porcentaje máximo de recursos de CPU utilizados por los nodos maestros dedicados. Recomendamos aumentar el tamaño del tipo de instancia cuando esta métrica alcance el 60 por ciento. |
| Máximo | El porcentaje máximo del montón de Java utilizado para todos los nodos maestros dedicados del clúster. Recomendamos pasar a un tipo de instancia más grande cuando esta métrica alcance el 85 por ciento. |
| Mínimo | Los créditos de CPU restantes están disponibles para los nodos maestros dedicados en el clúster. Un crédito de CPU proporciona el rendimiento de un núcleo de CPU completo durante un minuto. Esta métrica está disponible solo para t2.micro.elasticsearch, t2.small.elasticsearch, y t2.medium.elasticsearch tipo de instancia. |
| Mínimo | Un control de estado para Las fallas significan que el nodo maestro se detuvo o no se puede acceder a él. Por lo general, son el resultado de un problema de conectividad de red o de dependencia de AWS. |
| Mínimo, Máximo, Promedio | La latencia, en segundos, para operaciones de lectura en volúmenes de EBS. |
| Mínimo, Máximo, Promedio | La latencia, en segundos, para operaciones de escritura en volúmenes de EBS. |
| Mínimo, Máximo, Promedio | El rendimiento, en bytes por segundo, para operaciones de lectura en volúmenes de EBS. |
| Mínimo, Máximo, Promedio | El rendimiento, en bytes por segundo, para operaciones de escritura en volúmenes de EBS. |
| Mínimo, Máximo, Promedio | El número de solicitudes de entrada y salida (E/S) pendientes para un volumen de EBS. |
| Mínimo, Máximo, Promedio | El número de operaciones de entrada y salida (E/S) por segundo para operaciones de lectura en volúmenes de EBS. |
| Mínimo, Máximo, Promedio | El número de operaciones de entrada y salida (E/S) por segundo para operaciones de escritura en volúmenes de EBS. |
Se recopilan las siguientes métricas para el clúster Elasticsearch, y opcionalmente también para cada instancia o nodo en un dominio:
Nombre | Estadísticas relevantes | Descripción |
|---|---|---|
| Para nodos: promedio Para clúster: Promedio, Máximo | El tiempo promedio, en milisegundos, que le toma a un fragmento completar una operación de indexación. |
| Para nodos: promedio Para clúster: Promedio, Máximo, Suma | El número de operaciones de indexación por minuto. |
| Para nodos: promedio Para clúster: Promedio, Máximo | El tiempo promedio, en milisegundos, que le toma a un fragmento completar una operación de búsqueda. |
| Para nodos: promedio Para clúster: Promedio, Máximo, Suma | El número total de solicitudes de búsqueda por minuto para todos los fragmentos de un nodo. |
| Mínimo, Máximo, Promedio | El porcentaje de la memoria de la instancia que está en uso. |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | El número de veces que se ha realizado la recolección de basura de la "generación joven". Una cantidad grande y cada vez mayor de ejecuciones es una parte normal de las operaciones del clúster. |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | La cantidad de tiempo, en milisegundos, que el clúster ha dedicado a realizar la recolección de basura de "generación joven". |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | El número de veces que se ha ejecutado la recolección de basura de "vieja generación". En un clúster con recursos suficientes, este número debería seguir siendo pequeño y crecer con poca frecuencia. |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | La cantidad de tiempo, en milisegundos, que el clúster ha dedicado a realizar la recolección de basura de "antigua generación". |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | El número de tareas en cola en el grupo de subprocesos de fusión forzada. Si el tamaño de la cola es constantemente alto, considere ampliar su clúster. |
| Para nodos: Máximo Para clúster: suma | El número de tareas rechazadas en el grupo de subprocesos de fusión forzada. Si este número crece continuamente, considere ampliar su clúster. |
| Para nodos: Máximo Para clúster: suma, promedio | El tamaño del grupo de subprocesos de fusión forzada. |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | El número de tareas en cola en el grupo de subprocesos de índice. Si el tamaño de la cola es constantemente alto, considere ampliar su clúster. El tamaño máximo de la cola de índice es 200. |
| Para nodos: Máximo Para clúster: suma | El número de tareas rechazadas en el grupo de subprocesos de índice. Si este número crece continuamente, considere ampliar su clúster. |
| Para nodos: Máximo Para clúster: suma, promedio | El tamaño del grupo de subprocesos de índice. |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | El número de tareas en cola en el grupo de subprocesos de búsqueda. Si el tamaño de la cola es constantemente alto, considere ampliar su clúster. El tamaño máximo de la cola de búsqueda es 1000. |
| Para nodos: Máximo Para clúster: suma | El número de tareas rechazadas en el grupo de hilos de búsqueda. Si este número crece continuamente, considere ampliar su clúster. |
| Para nodos: Máximo Para clúster: suma, promedio | El tamaño del grupo de hilos de búsqueda. |
| Para nodos: Máximo Para clúster: suma, máximo, promedio | El número de tareas en cola en el grupo de subprocesos masivos. Si el tamaño de la cola es constantemente alto, considere ampliar su clúster. |
| Para nodos: Máximo Para clúster: suma | El número de tareas rechazadas en el grupo de subprocesos masivos. Si este número crece continuamente, considere ampliar su clúster. |
| Para nodos: Máximo Para clúster: suma, promedio | El tamaño del grupo de subprocesos masivos. |