spark-engineer

1.8k
openclawopenclaw

Use when building Apache Spark applications, distributed data processing pipelines, or optimizing big data workloads. Invoke for DataFrame API, Spark SQL, RDD operations, performance tuning, streaming analytics.

193 days ago

azure-observability

1.6k
microsoftmicrosoft

Azure Observability Services including Azure Monitor, Application Insights, Log Analytics, Alerts, and Workbooks. Provides metrics, APM, distributed tracing, KQL queries, and interactive reports.

192 days ago

azure-cosmos-py

1.6k
microsoftmicrosoft

Azure Cosmos DB SDK for Python (NoSQL API). Use for document CRUD, queries, containers, and globally distributed data. Triggers: "cosmos db", "CosmosClient", "container", "document", "NoSQL", "partition key".

192 days ago

azure-cosmos-rust

1.6k
microsoftmicrosoft

Azure Cosmos DB SDK for Rust (NoSQL API). Use for document CRUD, queries, containers, and globally distributed data. Triggers: "cosmos db rust", "CosmosClient rust", "container", "document rust", "NoSQL rust", "partition key".

192 days ago

azure-monitor-opentelemetry-ts

1.6k
microsoftmicrosoft

Instrument applications with Azure Monitor and OpenTelemetry for JavaScript (@azure/monitor-opentelemetry). Use when adding distributed tracing, metrics, and logs to Node.js applications with Application Insights.

192 days ago

sentry-performance-tracing

1.5k
Jeremylongshore Claude Code Plugins Plus Skills Sentry Performance TracingJeremylongshore Claude Code Plugins Plus Skills Sentry Performance Tracing

Execute set up performance monitoring and distributed tracing with Sentry. Use when implementing performance tracking, tracing requests, or monitoring application performance. Trigger with phrases like "sentry performance", "sentry tracing", "sentry APM", "monitor performance sentry".

192 days ago

setting-up-distributed-tracing

1.5k
Jeremylongshore Claude Code Plugins Plus Skills Distributed Tracing SetupJeremylongshore Claude Code Plugins Plus Skills Distributed Tracing Setup

This skill automates the setup of distributed tracing for microservices. It helps developers implement end-to-end request visibility by configuring context propagation, span creation, trace collection, and analysis. Use this skill when the user requests to set up distributed tracing, implement observability, or troubleshoot performance issues in a microservices architecture. The skill is triggered by phrases such as 'setup tracing', 'implement distributed tracing', 'configure opentelemetry', or 'add observability to microservices'.

192 days ago

distributed-training-setup

1.5k
Jeremylongshore Claude Code Plugins Plus Skills Distributed Training SetupJeremylongshore Claude Code Plugins Plus Skills Distributed Training Setup

Configure distributed training setup operations. Auto-activating skill for ML Training. Triggers on: distributed training setup, distributed training setup Part of the ML Training skill category. Use when working with distributed training setup functionality. Trigger with phrases like "distributed training setup", "distributed setup", "distributed".

192 days ago

moai-lang-scala

776
modu-aimodu-ai

Scala 3.4+ development specialist covering Akka, Cats Effect, ZIO, and Spark patterns. Use when building distributed systems, big data pipelines, or functional programming applications.

193 days ago

moai-lang-elixir

776
modu-aimodu-ai

Elixir 1.17+ development specialist covering Phoenix 1.7, LiveView, Ecto, and OTP patterns. Use when developing real-time applications, distributed systems, or Phoenix projects.

193 days ago

file-uploads

756
dadbodgeoffdadbodgeoff

Production-grade secure file upload pipeline with multi-stage validation, malware scanning (ClamAV), hash-based duplicate detection, and race condition protection using distributed locks.

192 days ago

checkpoint-resume

756
dadbodgeoffdadbodgeoff

Exactly-once processing semantics with distributed coordination for file-based data pipelines. Atomic file claiming, status tracking, and automatic retry with in-memory fallback.

192 days ago

distributed-lock

756
dadbodgeoffdadbodgeoff

Prevent race conditions across multiple instances. Only one instance can hold a lock at a time. Automatic expiration prevents deadlocks.

192 days ago

circuit-breaker

756
dadbodgeoffdadbodgeoff

Implement the circuit breaker pattern to prevent cascade failures in distributed systems. Use when adding resilience to API clients, external service calls, or any operation that can fail and should fail fast.

192 days ago

queue

527
Joelhooks Swarm Tools QueueJoelhooks Swarm Tools Queue

Guide for job queue patterns in multi-agent coordination. Use when deciding between background jobs vs inline execution, submitting long-running tasks, monitoring job progress, and handling failures. Covers when to queue, job priority, retry strategies, and monitoring patterns.

queuebackground-jobsdistributed-work+2
192 days ago

api-design

445
AarononthewebAaronontheweb

Design stable, compatible public APIs using extend-only design principles. Manage API compatibility, wire compatibility, and versioning for NuGet packages and distributed systems.

192 days ago

aspire-integration-testing

445
AarononthewebAaronontheweb

Write integration tests using .NET Aspire's testing facilities with xUnit. Covers test fixtures, distributed application setup, endpoint discovery, and patterns for testing ASP.NET Core apps with real dependencies.

192 days ago

milvus-integration

376
a5c-aia5c-ai

Milvus distributed vector database configuration for large-scale RAG applications

192 days ago

ray-distributed-trainer

376
a5c-aia5c-ai

Distributed computing skill using Ray for parallel training, hyperparameter search, and resource management.

192 days ago

tla-plus-generator

376
a5c-aia5c-ai

Generate and analyze TLA+ specifications for distributed systems verification

193 days ago

tensorflow-trainer

376
a5c-aia5c-ai

TensorFlow/Keras model training skill with callbacks, distributed strategies, and TensorBoard integration.

192 days ago

opentelemetry-llm

376
a5c-aia5c-ai

OpenTelemetry instrumentation for LLM applications with distributed tracing

193 days ago

distributed-caching

376
a5c-aia5c-ai

Expert skill for distributed cache design, implementation, and optimization using Redis and Memcached. Design cache architectures, configure eviction policies, implement caching patterns (cache-aside, write-through, write-behind), monitor cache performance, and optimize memory usage.

192 days ago

tracing-schema-generator

376
a5c-aia5c-ai

Generate distributed tracing schemas for OpenTelemetry with Jaeger/Zipkin integration

193 days ago

distributed-task-orchestrator

375
Shuyu Labs Webcode Distributed Task OrchestratorShuyu Labs Webcode Distributed Task Orchestrator

Decompose complex tasks into parallel sub-agents. Use for multi-step operations, batch processing, or when user mentions "parallel", "agents", or "orchestrate".

192 days ago

performance-engineer

360
DokhacgiakhoaDokhacgiakhoa

Expert performance engineer specializing in modern observability, application optimization, and scalable system performance. Masters OpenTelemetry, distributed tracing, load testing, multi-tier caching, Core Web Vitals, and performance monitoring.

193 days ago

building-team-culture

326
RefoundAIRefoundAI

Help users build and maintain strong team culture. Use when someone is defining team values, creating psychological safety, onboarding to a new team, navigating cultural change, or building distributed team norms.

193 days ago

debugging-techniques

296
ancolemanancoleman

Debugging workflows for Python (pdb, debugpy), Go (delve), Rust (lldb), and Node.js, including container debugging (kubectl debug, ephemeral containers) and production-safe debugging techniques with distributed tracing and correlation IDs. Use when setting breakpoints, debugging containers/pods, remote debugging, or production debugging.

192 days ago

designing-distributed-systems

296
ancolemanancoleman

When designing distributed systems for scalability, reliability, and consistency. Covers CAP/PACELC theorems, consistency models (strong, eventual, causal), replication patterns (leader-follower, multi-leader, leaderless), partitioning strategies (hash, range, geographic), transaction patterns (saga, event sourcing, CQRS), resilience patterns (circuit breaker, bulkhead), service discovery, and caching strategies for building fault-tolerant distributed architectures.

192 days ago

Spring Boot Scheduling

279
HoangNguyen0403HoangNguyen0403

Standards for scheduled tasks and distributed locking with ShedLock

193 days ago

AgentDB Advanced Features

215
proffesor-for-testingproffesor-for-testing

Master advanced AgentDB features including QUIC synchronization, multi-database management, custom distance metrics, hybrid search, and distributed systems integration. Use when building distributed AI systems, multi-agent coordination, or advanced vector search applications.

192 days ago

flow-nexus-neural

215
proffesor-for-testingproffesor-for-testing

Train and deploy neural networks in distributed E2B sandboxes with Flow Nexus

neural-networksdistributed-trainingmachine-learning+3
192 days ago

Swarm Orchestration

215
proffesor-for-testingproffesor-for-testing

Orchestrate multi-agent swarms with agentic-flow for parallel task execution, dynamic topology, and intelligent coordination. Use when scaling beyond single agents, implementing complex workflows, or building distributed AI systems.

192 days ago

contract-testing

215
proffesor-for-testingproffesor-for-testing

Consumer-driven contract testing for microservices using Pact, schema validation, API versioning, and backward compatibility testing. Use when testing API contracts or coordinating distributed teams.

contractpactconsumer-driven+3
193 days ago

swarm-advanced

215
proffesor-for-testingproffesor-for-testing

Advanced swarm orchestration patterns for research, development, testing, and complex distributed workflows

swarmdistributedparallel+4
192 days ago

chaos-engineering-resilience

215
proffesor-for-testingproffesor-for-testing

Chaos engineering principles, controlled failure injection, resilience testing, and system recovery validation. Use when testing distributed systems, building confidence in fault tolerance, or validating disaster recovery.

chaosresiliencefault-injection+3
192 days ago

qe-chaos-engineering-resilience

215
proffesor-for-testingproffesor-for-testing

Chaos engineering principles, controlled failure injection, resilience testing, and system recovery validation. Use when testing distributed systems, building confidence in fault tolerance, or validating disaster recovery.

chaosresiliencefault-injection+3
192 days ago

observability-design

206
rsmdtrsmdt

Monitoring strategies, distributed tracing, SLI/SLO design, and alerting patterns. Use when designing monitoring infrastructure, defining service level objectives, implementing distributed tracing, creating alert rules, building dashboards, or establishing incident response procedures. Covers the three pillars of observability and production readiness.

193 days ago

observability-monitoring

188
aiskillstoreaiskillstore

Structured logging, metrics, distributed tracing, and alerting strategies

192 days ago

swarm-orchestration

188
aiskillstoreaiskillstore

Orchestrate multi-agent swarms with agentic-flow for parallel task execution, dynamic topology, and intelligent coordination. Use when scaling beyond single agents, implementing complex workflows, or building distributed AI systems.

193 days ago

agentdb-advanced-features

188
aiskillstoreaiskillstore

Master advanced AgentDB features including QUIC synchronization, multi-database management, custom distance metrics, hybrid search, and distributed systems integration. Use when building distributed AI systems, multi-agent coordination, or advanced vector search applications.

193 days ago

when-training-neural-networks-use-flow-nexus-neural

188
aiskillstoreaiskillstore

This SOP provides a systematic workflow for training and deploying neural networks using Flow Nexus platform with distributed E2B sandboxes. It covers architecture selection, distributed training, ...

193 days ago

advanced-agentdb-vector-search-implementation

188
aiskillstoreaiskillstore

Master advanced AgentDB features including QUIC synchronization, multi-database management, custom distance metrics, and hybrid search for distributed AI systems.

193 days ago

building-with-dapr

150
panaversitypanaversity

Use when building distributed microservices with Dapr sidecar architecture. Triggers include Dapr components, service invocation, state management, pub/sub, secrets, bindings, configuration, actors, and workflows. NOT for direct infrastructure clients (use building-with-kafka-strimzi instead).

193 days ago

azure-observability

134
microsoftmicrosoft

Azure Observability Services including Azure Monitor, Application Insights, Log Analytics, Alerts, and Workbooks. Provides metrics, APM, distributed tracing, KQL queries, and interactive reports.

192 days ago

net-observability

134
mitkoxmitkox

Implement observability patterns with OpenTelemetry, structured logging, and distributed tracing

193 days ago

microservices-patterns

132
MicrockMicrock

Design microservices architectures with service boundaries, event-driven communication, and resilience patterns. Use when building distributed systems, decomposing monoliths, or implementing microservices.

193 days ago

workflow-orchestration-patterns

132
MicrockMicrock

Design durable workflows with Temporal for distributed systems. Covers workflow vs activity separation, saga patterns, state management, and determinism constraints. Use when building long-running processes, distributed transactions, or microservice orchestration.

192 days ago