monitoring AI Agent Skills

Browse 42 skills related to monitoring

phoenix-observability

21.8k
davila7davila7

Open-source AI observability platform for LLM tracing, evaluation, and monitoring. Use when debugging LLM applications with detailed traces, running evaluations on datasets, or monitoring production AI systems with real-time insights.

ObservabilityPhoenixArize+5
141 days ago

langsmith-observability

21.8k
davila7davila7

LLM observability platform for tracing, evaluation, and monitoring. Use when debugging LLM applications, evaluating model outputs against datasets, monitoring production systems, or building systematic testing pipelines for AI applications.

ObservabilityLangSmithTracing+6
141 days ago

railway-metrics

21.8k
davila7davila7

Query resource usage metrics for Railway services. Use when user asks about resource usage, CPU, memory, network, disk, or service performance like "how much memory is my service using" or "is my service slow".

RailwayMetricsMonitoring+5
141 days ago

virus-monitor

1.8k
openclawopenclaw

Virus-Monitoring für Wien (Abwasser + Sentinel)

healthviennamonitoring+3
141 days ago

power-management-monitor

376
a5c-aia5c-ai

Monitor system power state including battery, AC, sleep, and wake events

powerbatterysystem+2
141 days ago

sentry-desktop-setup

376
a5c-aia5c-ai

Configure Sentry for comprehensive desktop application crash reporting, error monitoring, performance tracking, and release health for Electron and native desktop apps

desktopmonitoringcrash-reporting+3
141 days ago

shift-right-testing

215
proffesor-for-testingproffesor-for-testing

Testing in production with feature flags, canary deployments, synthetic monitoring, and chaos engineering. Use when implementing production observability or progressive delivery.

shift-rightproduction-testingcanary+3
141 days ago

qe-shift-right-testing

215
proffesor-for-testingproffesor-for-testing

Testing in production with feature flags, canary deployments, synthetic monitoring, and chaos engineering. Use when implementing production observability or progressive delivery.

shift-rightproduction-testingcanary+3
141 days ago

observability-testing-patterns

215
proffesor-for-testingproffesor-for-testing

Observability and monitoring validation patterns for dashboards, alerting, log aggregation, APM traces, and SLA/SLO verification. Use when testing monitoring infrastructure, dashboard accuracy, alert rules, or metric pipelines.

observabilitymonitoringkibana+5
141 days ago

workflow-monitor

196
atholaathola

automatically create GitHub issues for workflow improvements via /fix-workflow. Use when workflows fail, timeout, or show inefficient patterns. Do not use when normal workflow execution, simple command errors.

workflowmonitoringerror-detection+2
141 days ago

web-research-workflow

97
yonatangrossyonatangross

Unified decision tree for web research and competitive monitoring. Auto-selects WebFetch, Tavily, or agent-browser based on target site characteristics and available API keys. Includes competitor page tracking, snapshot diffing, and change alerting. Use when researching web content, scraping, extracting raw markdown, capturing documentation, or monitoring competitor changes.

researchbrowserwebfetch+6
141 days ago

monitoring-observability

97
yonatangrossyonatangross

Monitoring and observability patterns for Prometheus metrics, Grafana dashboards, Langfuse LLM tracing, and drift detection. Use when adding logging, metrics, distributed tracing, LLM cost tracking, or quality drift monitoring.

monitoringobservabilityprometheus+6
141 days ago

Sentry Error Monitoring & Testing

71
PramodDuttaPramodDutta

Integration testing with Sentry for error tracking, performance monitoring, and release health verification in production environments.

sentrymonitoringerror-tracking+1
141 days ago

Production Smoke Suite

71
PramodDuttaPramodDutta

Build lightweight production smoke test suites that verify critical user paths, API health, and third-party integrations after every deployment.

smoke-testingproductiondeployment-verification+3
141 days ago

Synthetic Monitoring Testing

71
PramodDuttaPramodDutta

Synthetic monitoring test creation for uptime checking, user journey simulation, API health verification, and multi-region availability testing.

syntheticmonitoringuptime+2
141 days ago

Alerting & Monitoring Testing

71
PramodDuttaPramodDutta

Testing monitoring and alerting configurations including threshold validation, alert routing, escalation policies, and false-positive rate monitoring.

alertingmonitoringthreshold+2
141 days ago

mlops-workflows

40
manutejmanutej

Comprehensive MLOps workflows for the complete ML lifecycle - experiment tracking, model registry, deployment patterns, monitoring, A/B testing, and production best practices with MLflow

mlopsmlflowexperiment-tracking+9
141 days ago

project-aeo-monitoring-tools

34
vasilyu1983vasilyu1983

Build custom AI search monitoring tools for competitive AEO analysis. Covers API access, scraping architecture, legal compliance, and cost estimation.

aeomonitoringscraping+3
141 days ago

Datadog Observability

15
bobmatnycbobmatnyc

Full-stack observability with Datadog APM, logs, metrics, synthetics, and RUM. Use when implementing monitoring, tracing, alerting, or cost optimization for production systems.

observabilitymonitoringapm+5
141 days ago

Linux Production Shell Scripts

14
zebbernzebbern

This skill should be used when the user asks to "create bash scripts", "automate Linux tasks", "monitor system resources", "backup files", "manage users", or "write production shell scripts". It provides ready-to-use shell script templates for system administration.

bashscriptingautomation+3
141 days ago

monitoring-observability

13
williamzujkowskiwilliamzujkowski

Master monitoring and observability for distributed systems

monitoringobservabilityprometheus+6
141 days ago

Observability with Prometheus & Grafana

10
bobmatnycbobmatnyc

Production-grade observability stack with Prometheus metrics, Grafana dashboards, PromQL query language, alerting rules, and AI-powered anomaly detection for modern cloud-native applications

observabilitymonitoringprometheus+7
141 days ago

devops-role-skill

9
enunoenuno

Professional DevOps engineering skill for creating CI/CD pipelines, implementing infrastructure as code, managing environments, and establishing monitoring and observability across all deployment stages.

devopscicdinfrastructure+3
141 days ago

logging-and-monitoring

7
louloulinlouloulin

Comprehensive logging, monitoring, and observability expert for distributed systems

loggingmonitoringobservability+1
141 days ago

model-usage

7
openxjarvisopenxjarvis

Track and report model usage and costs

monitoringusagecosts
141 days ago

sag

7
openxjarvisopenxjarvis

System administration and monitoring

sysadminmonitoring
141 days ago

performance-optimizer

7
louloulinlouloulin

Application and infrastructure performance analysis and optimization expert

performanceoptimizationprofiling+1
141 days ago

devops-engineer

7
louloulinlouloulin

DevOps engineer expert, proficient in continuous integration/continuous deployment (CI/CD), infrastructure automation, and site reliability engineering (SRE).

devopscicdinfrastructure+3
141 days ago

alert-system

6
huiferhuifer

Automated alert system for key events in drug discovery. Use for tracking competitor milestones, clinical trial updates, regulatory decisions, and publications of interest. Keywords: alerts, monitoring, tracking, notifications, competitive intelligence

alertsmonitoringnotifications+1
141 days ago

analyzing-ransomware-leak-site-intelligence

2
mukul975mukul975

Monitor and analyze ransomware group data leak sites (DLS) to track victim postings, extract threat intelligence on group tactics, and assess sector-specific ransomware risk for proactive defense.

ransomwareleak-sitedata-leak+5
141 days ago

sentry

2
qhkmqhkm

Monitor and resolve Sentry issues, view project stats, and manage error tracking.

sentrymonitoringerrors+1
141 days ago

Agent Dashboard

1
hanabi-jpnhanabi-jpn

Real-time agent monitoring with health scoring, cost tracking, and web dashboard

monitoringdashboardanalytics+2
141 days ago

beacon-node

1
lodekeeperlodekeeper

Query and analyze Ethereum beacon nodes via the Beacon API. Health checks, chain analysis, validator info, peer diagnostics, and fork monitoring.

ethereumbeaconconsensus+2
141 days ago

fte.health.check

assadsharifassadsharif

Run the full system health check — vault structure, watcher liveness, orchestrator status, and security baseline — and aggregate results into a single pass/degrade/fail report.

healthdiagnosticsystem+2
141 days ago

research-assistant

theagentledgertheagentledger

Structured web research framework for AI agents. Teaches your agent to conduct multi-source research, synthesize findings into actionable briefs, maintain a research library, and track evolving topics over time. Use when you need market research, competitor analysis, topic deep-dives, or ongoing monitoring of trends and news. Works with any agent that has web search capabilities.

researchweb-searchanalysis+2
141 days ago

Log Analyzer

novas10novas10

Parse log files to find errors, detect patterns, analyze trends, and alert on anomalies

logslog-analysiserror-detection+2
141 days ago

system-info

novas10novas10

Retrieve and display system information including CPU, memory, disk usage, network status, and OS details

systemmonitoringdisk-space+3
141 days ago

WP Alerting

morrealevmorrealev

This skill should be used when the user asks about 'alerting', 'alerts', 'Slack notifications', 'email alerts', 'monitoring alerts', 'threshold alerts', 'health reports', 'escalation', 'incident notifications', 'uptime alerts', 'error alerts', 'performance alerts', 'scheduled reports', or mentions setting up notification channels for WordPress monitoring events.

alertingslacknotifications+2
141 days ago

server-monitor

novas10novas10

Monitor server health including CPU, RAM, disk usage, uptime, and process activity with alerting

monitoringserveruptime+4
141 days ago

newrelic-cli-skills

vince-winkintelvince-winkintel

Monitor, query, and manage New Relic observability data via the newrelic CLI. Covers NRQL queries, APM performance triage, deployment markers, alert management, infrastructure monitoring, and agent diagnostics. Use when user asks about application performance, error rates, slow transactions, deployment tracking, or New Relic configuration.

newrelicobservabilityapm+3
141 days ago

senior-observability

arielperez82arielperez82

Comprehensive observability skill for monitoring, logging, distributed tracing, alerting, and SLI/SLO implementation across distributed systems. Includes dashboard generation, alert rule creation, error budget calculation, and metrics analysis. Use when implementing monitoring stacks, designing alerting strategies, setting up distributed tracing, or defining SLO frameworks.

observabilitymonitoringlogging+14
141 days ago

IoT Monitor

novas10novas10

Monitor IoT sensors for temperature, humidity, air quality, motion, and other environmental data in real time

iotsensorstemperature+2
141 days ago