• /
  • EnglishEspañolFrançais日本語한국어Português
  • Inicia sesiónComenzar ahora

Te ofrecemos esta traducción automática para facilitar la lectura.

En caso de que haya discrepancias entre la versión en inglés y la versión traducida, se entiende que prevalece la versión en inglés. Visita esta página para obtener más información.

Crea una propuesta

Integración de monitoreo Google Cloud Dataproc

La integración de New Relic con Google Cloud Platform (GCP) incluye una que informa los datos de Google Cloud Dataproc a New Relic. Este documento explica cómo activar la integración de GCP Dataproc y describe los datos que reporta.

Característica

Cloud Dataproc es el servicio administrado de Google Cloud para ejecutar Apache Hadoop, Apache Spark y otras workloads de procesamiento de datos de código abierto. La integración de Dataproc de New Relic recopila métricas de HDFS, YARN, trabajos y operaciones para cada clúster de Dataproc.

Activar la integración

Para habilitar la integración, siga los procedimientos estándar para conectar su servicio de GCP a New Relic:

Frecuencia de sondeo

Las integraciones de New Relic consultan sus servicios de GCP de acuerdo con un intervalo de sondeo que varía según la integración. La frecuencia de sondeo para Google Cloud Dataproc es de 5 minutos. La resolución es 1 punto de datos cada minuto.

Importante

Cloud Dataproc admite intervalos de sondeo de 1 minuto para integraciones de WIF en versión preliminar limitada. Para solicitar acceso, comuníquese con el soporte de New Relic.

Federación de identidades de workload (Workload Identity Federation)

Buscar y utilizar datos

Después de habilitar la integración, sus recursos de Dataproc aparecen como entidades en el explorador de entidades de New Relic. Para ver los dashboards y administrar los servicios, vaya a one.newrelic.com > All capabilities > Infrastructure > GCP.

Todas las métricas de Dataproc disponibles en el monitoreo de la nube de GCP se recopilan como métricas dimensionales en el tipo de evento Metric. Las métricas adicionales más allá de esta tabla se recopilan automáticamente. Consulte la documentación de métricas de Dataproc de Google para obtener la lista completa.

Entidad

Datos métricos

Métricas clave — Cluster

Nombre de la métrica

Unidad

Descripción

gcp.dataproc.cluster.hdfs.datanodes

Contar

Número de DataNodes de HDFS en ejecución en el clúster.

gcp.dataproc.cluster.hdfs.storage_capacity

Gibibytes

Capacidad de almacenamiento de HDFS disponible en el clúster.

gcp.dataproc.cluster.hdfs.storage_utilization

Por ciento

Fracción del almacenamiento HDFS actualmente en uso en el clúster.

gcp.dataproc.cluster.hdfs.unhealthy_blocks

Contar

Número de bloques HDFS en mal estado en el clúster.

gcp.dataproc.cluster.job.submitted_count

Contar

Número de trabajos enviados al clúster.

gcp.dataproc.cluster.job.running_count

Contar

Número de trabajos actualmente en ejecución en el clúster.

gcp.dataproc.cluster.job.failed_count

Contar

Número de trabajos que han fallado en el clúster.

gcp.dataproc.cluster.job.completion_time

Segundos

Tiempo desde el envío del trabajo hasta que Dataproc informa la finalización.

gcp.dataproc.cluster.job.duration

Segundos

Tiempo que los trabajos han pasado en un estado determinado, desglosado por estado.

gcp.dataproc.cluster.operation.submitted_count

Contar

Número de operaciones de clúster enviadas.

gcp.dataproc.cluster.operation.running_count

Contar

Número de operaciones del clúster actualmente en ejecución.

gcp.dataproc.cluster.operation.failed_count

Contar

Número de operaciones del clúster que han fallado.

gcp.dataproc.cluster.operation.completion_time

Segundos

Tiempo desde el envío de la operación hasta que Dataproc informa la finalización.

gcp.dataproc.cluster.yarn.allocated_memory_percentage

Por ciento

Fracción de memoria YARN asignada actualmente.

gcp.dataproc.cluster.yarn.memory_size

Gibibytes

Memoria total de YARN disponible en el clúster.

gcp.dataproc.cluster.yarn.pending_memory_size

Gibibytes

Memoria YARN actualmente solicitada pero aún no asignada por el planificador.

gcp.dataproc.cluster.yarn.containers

Contar

Número de contenedores de YARN en el clúster.

gcp.dataproc.cluster.yarn.apps

Contar

Número de aplicaciones YARN activas en el clúster.

gcp.dataproc.cluster.yarn.nodemanagers

Contar

Número de NodeManagers de YARN en ejecución en el clúster.

gcp.dataproc.cluster.yarn.virtual_cores

Contar

Número de núcleos virtuales de YARN en el clúster.

Para obtener la lista completa de métricas de Dataproc, consulte la documentación de métricas de Dataproc de Google.

Cuenta de servicio o cuenta de usuario

Buscar y utilizar datos

Después de activar la integración y esperar unos minutos (según la frecuencia de sondeo ), los datos aparecerán en la New Relic UI. Para buscar y utilizar sus datos, incluidos enlaces a su y configuración de alertas, vaya a one.newrelic.com > All capabilities > Infrastructure > GCP > (select an integration).

Los datos se adjuntan al siguiente tipo de evento:

Entidad

Tipo de evento

Proveedor

Grupo

GcpDataprocClusterSample

GcpDataprocCluster

Para obtener más información sobre cómo utilizar sus datos, consulte Comprender y utilizar los datos de integración.

Datos del clúster de procesamiento de datos

Métrica

Unidad

Descripción

cluster.hdfs.Datanodes

Contar

Indica la cantidad de HDFS DataNodes que se ejecutan dentro de un clúster.

cluster.hdfs.StorageCapacity

Gibibytes

Indica la capacidad del sistema HDFS que se ejecuta en el clúster en GB.

cluster.hdfs.StorageUtilization

Por ciento

El porcentaje de almacenamiento HDFS utilizado actualmente.

cluster.hdfs.UnhealthyBlocks

Contar

Indica la cantidad de bloques en mal estado dentro del clúster.

cluster.job.CompletionTime

Segundos

El tiempo que tardaron en completarse los trabajos desde el momento en que el usuario envía un trabajo hasta el momento en que Dataproc informa que se completó.

cluster.job.Duration

Segundos

El tiempo que los trabajos han pasado en un estado determinado.

cluster.job.Failures

Contar

Indica la cantidad de trabajos que han fallado en un clúster.

cluster.job.Running

Contar

Indica el número de trabajos que se ejecutan en un clúster.

cluster.job.Submitted

Contar

Indica el número de trabajos que se han enviado a un clúster.

cluster.operation.CompletionTime

Segundos

El tiempo que tardaron en completarse las operaciones desde el momento en que el usuario envía una operación hasta el momento en que Dataproc informa que se completó.

cluster.operation.Duration

Segundos

El tiempo que las operaciones han permanecido en un estado determinado.

cluster.operation.Failures

Contar

Indica el número de operaciones que han fallado en un clúster.

cluster.operation.Running

Contar

Indica el número de operaciones que se ejecutan en un clúster.

cluster.operation.Submitted

Contar

Indica el número de operaciones que se han enviado a un clúster.

cluster.yarn.AllocatedMemoryPercentage

Por ciento

Se asigna el porcentaje de memoria YARN.

cluster.yarn.Apps

Contar

Indica el número de aplicaciones YARN activas.

cluster.yarn.Containers

Contar

Indica el número de contenedor YARN.

cluster.yarn.MemorySize

Gibibytes

Indica el tamaño de la memoria YARN en GB.

cluster.yarn.Nodemanagers

Contar

Indica la cantidad de YARN NodeManagers que se ejecutan dentro del clúster.

cluster.yarn.PendingMemorySize

Gibibytes

La solicitud de memoria actual, en GB, que está pendiente de ser cumplida por el programador.

cluster.yarn.VirtualCores

Contar

Indica el número de núcleos virtuales en YARN.

Copyright © 2026 New Relic Inc.

This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.