Referência de métricas e atributos do IBM MQ OpenTelemetry
Esta referência abrange as métricas e atributos do IBM MQ coletados via OpenTelemetry: as métricas que o exportador mq-metric-samples publica e o coletor encaminha para o New Relic. Aplica-se a ambas as implantações de host Linux e Kubernetes; a forma da métrica é idêntica.
Coleta de métricas
Todas as métricas mantêm o formato bruto do Prometheus que o exportador emite: nomes com sublinhado (ibmmq_*) e os rótulos brutos qmgr, queue e channel, além do atributo de identidade target.name e da tag opcional cluster.name que o coletor anexa. A síntese de entidade do IBM MQ do New Relic depende desse formato, portanto o coletor encaminha os nomes e rótulos inalterados.
Importante
Ative as estatísticas de MQI em cada gerenciador de filas, ou as métricas de taxas de transferência e tempo ficarão vazias. A integridade do gerenciador de filas, a profundidade da fila e o status do canal são relatados prontos para uso, mas as métricas de atividade de MQI (as tabelas de taxas de transferência da fila e atividade de MQI do gerenciador de filas — ibmmq_queue_mqput_count, ibmmq_queue_average_queue_time_seconds e assim por diante) exigem que a coleta de estatísticas esteja ativada, o que está desativado por padrão. Ative-o uma vez por gerenciador de filas com MQSC — por exemplo, ALTER QMGR STATMQI(ON) STATQ(ON), depois ALTER QLOCAL(...) STATQ(ON) para qualquer fila na qual você deseja estatísticas por fila (ou confie no padrão STATQ do gerenciador de filas). Sem isso, o exportador fica íntegro e a entidade aparece, mas esses painéis são renderizados em branco. Consulte a documentação do mq-metric-samples para obter as estatísticas exatas das quais cada métrica depende.
Dica
As métricas de status relatam valores numéricos de enum, não 1/0 — consulte a referência de códigos de status abaixo antes de alertar sobre elas. Os contadores são convertidos para temporalidade delta pelo coletor, portanto, use sum() / rate() em uma janela em vez de latest() ao criar gráficos deles.
As tabelas abaixo agrupam as métricas do OpenTelemetry por área. Para listar todas as métricas que estão realmente reportando na sua conta, execute:
FROM Metric SELECT uniques(metricName,2000)WHERE metricName LIKE'ibmmq_%' SINCE 1day ago
Métrica
Métrica
Descrição
ibmmq_qmgr_status
Estado de execução do gerenciador de filas (2 = em execução).
ibmmq_qmgr_command_server_status
Estado de execução do servidor de comandos (2 = em execução).
ibmmq_qmgr_channel_initiator_status
Estado de execução do iniciador de canal (o processo do gerenciador de filas que inicia e gerencia os canais MQ) (2 = em execução).
ibmmq_qmgr_connection_count
Número atual de conexões com o gerenciador de filas.
ibmmq_qmgr_uptime
Tempo de operação do gerenciador de filas, em segundos.
ibmmq_qmgr_active_listeners
Número de listeners ativos.
ibmmq_qmgr_active_services
Número de serviços ativos.
ibmmq_qmgr_concurrent_connections_high_water_mark
Pico de conexões simultâneas.
Métrica
Descrição
ibmmq_qmgr_cpu_load_one_minute_average_percentage
Média de carga da CPU de 1 minuto para o gerenciador de filas (também _five_ e _fifteen_minute_).
ibmmq_qmgr_user_cpu_time_percentage
Tempo de CPU no espaço do usuário consumido pelo gerenciador de filas.
ibmmq_qmgr_system_cpu_time_percentage
Tempo de CPU do sistema (kernel) consumido pelo gerenciador de filas.
Espaço livre no sistema de arquivos do gerenciador de filas.
ibmmq_qmgr_mq_fdc_file_count
Número de arquivos de dump de diagnóstico do IBM MQ (FFST/FDC — gravados quando o gerenciador de filas registra um erro interno). Uma contagem crescente sinaliza problemas que merecem ser investigados.
Métrica
Descrição
ibmmq_queue_depth
Número atual de mensagens na fila.
ibmmq_queue_attribute_max_depth
Profundidade máxima da fila configurada.
ibmmq_queue_oldest_message_age
Idade da mensagem mais antiga na fila, em segundos.
ibmmq_queue_uncommitted_messages
Número de mensagens não confirmadas.
ibmmq_queue_time_since_put
Segundos desde o último MQPUT para a fila.
ibmmq_queue_time_since_get
Segundos desde o último MQGET da fila.
ibmmq_queue_input_handles
Identificadores de entrada abertos (consumidores) na fila.
ibmmq_queue_output_handles
Identificadores de saída abertos (produtores) na fila.
ibmmq_queue_browse_handles
Identificadores de navegação abertos na fila.
ibmmq_queue_publish_handles
Identificadores de publicação abertos na fila.
ibmmq_queue_qfile_current_size
Tamanho atual do arquivo da fila no disco.
ibmmq_queue_qfile_max_size
Tamanho máximo do arquivo de fila no disco.
Esses contadores rastreiam as principais chamadas de API de mensagens do IBM MQ por fila: MQPUT / MQPUT1 (colocar uma mensagem em uma fila) e MQGET (obter uma mensagem de uma fila). Eles exigem que as estatísticas de MQI sejam ativadas no gerenciador de filas (consulte Coleta de métricas).
Esses contadores em todo o gerenciador de filas resumem a atividade e as falhas da API em todos os objetos — úteis para detectar erros de aplicativo e rotatividade de transação. Eles exigem que as estatísticas de MQI sejam ativadas (consulte Coleta de métricas).
Métrica
Descrição
ibmmq_qmgr_interval_mqput_mqput1_total_count
Total de MQPUT + MQPUT1 chamadas no intervalo.
ibmmq_qmgr_interval_destructive_get_total_count
Total de chamadas MQGET destrutivas no intervalo.
ibmmq_qmgr_published_to_subscribers_message_count
Mensagens publicadas para assinantes (taxas de transferência de publicação/assinatura).
Mensagens expiradas em todo o gerenciador de filas.
ibmmq_qmgr_purged_queue_count
Filas expurgadas.
As métricas de status do IBM MQ relatam valores numéricos de enum, não1/0 — e o valor saudável ("running") difere por métrica (2 para o status no nível do gerenciador de filas, 3 para o status do canal). Alerta sobre a desigualdade em relação ao valor em execução (por exemplo, ibmmq_qmgr_status != 2):
Métrica
Valor saudável
Significado
ibmmq_qmgr_status
2
O gerenciador de filas está em execução
ibmmq_qmgr_command_server_status
2
Servidor de comandos em execução
ibmmq_qmgr_channel_initiator_status
2
O iniciador de canal está em execução
ibmmq_channel_status
3
O canal está em execução
Qualquer outro valor (ou um ponto de dados ausente) significa que o componente não está em seu estado de execução.
Atributos de recurso
O coletor anexa atributos de identidade e contexto a cada métrica do IBM MQ. Alguns são comuns a todas as implantações; outros dependem se o coletor é executado em um host Linux ou no Kubernetes.
Atributo
Descrição
Exemplo
target.name
Atributo de identidade estável — o primeiro segmento de cada GUID de entidade do IBM MQ. Injetado como o rótulo de coleta targetName, depois renomeado para target.name pelo coletor.
prod-mq-01, prod-mq-cluster
qmgr
Nome do gerenciador de filas (rótulo bruto do exportador; chaves de síntese de entidade nele).
QM1
queue
Nome da fila (em métricas com escopo de fila).
APP.ORDERS.IN
channel
Nome do canal (em métricas com escopo de canal).
APP.SVRCONN
cluster.name
Tag de agrupamento opcional para gerenciadores de filas no mesmo cluster MQ. Não faz parte do GUID da entidade; é seguro deixar sem definição ou alterar mais tarde.
prod-mq
instrumentation.provider
Sempre opentelemetry para esta integração; use-o para definir o escopo das consultas para o caminho do OpenTelemetry.
opentelemetry
Atributo
Descrição
Exemplo
host.id
Identificador do host que executa o coletor, do processador resourcedetection (detectores system / ec2). Vincula o gerenciador de filas à sua entidade de host subjacente.
i-1234567890abcdef0
Atributo
Descrição
Exemplo
k8s_namespace
Namespace do pod do exportador descoberto, marcado pelas regras de relabel do coletor.
ibmmq
k8s_pod
Nome do pod do exportador descoberto.
qm1-0
host.id
Identificador do nó executando o pod, de resourcedetection.
ip-10-0-1-23
Detalhes da coleta de métricas
Frequência de coleta
Intervalo padrão: 60 segundos (scrape_interval do coletor). Ele deve ser maior ou igual ao próprio pollInterval do exportador mq-metric-samples.
Configurável: ajuste IBMMQ_SCRAPE_INTERVAL (Linux) ou scrape_interval no Helm values.yaml (Kubernetes).
Fonte de dados
Todas as métricas se originam do exportador mq-metric-samples, que consulta cada gerenciador de filas via PCF e republica as estatísticas como métricas do Prometheus em um endpoint HTTP /metrics. O receptor prometheus do coletor extrai esse endpoint.
Tipos métricos
Medidores — valores pontuais, como ibmmq_qmgr_status, ibmmq_queue_depth e ibmmq_channel_status. Gráfico com latest().
Contadores — totais cumulativos como ibmmq_queue_mqput_count. O processador cumulativetodelta do coletor os converte para temporalidade delta, então crie gráficos com sum() ou rate() em vez de latest().