scoring AI Agent Skills

Browse 10 skills related to scoring

testability-scoring

215
proffesor-for-testingproffesor-for-testing

AI-powered testability assessment using 10 principles of intrinsic testability with Playwright and optional Vibium integration. Evaluates web applications against Observability, Controllability, Algorithmic Simplicity, Transparency, Stability, Explainability, Unbugginess, Smallness, Decomposability, and Similarity. Use when assessing software testability, evaluating test readiness, identifying testability improvements, or generating testability reports.

testabilityscoringplaywright+6
142 days ago

qe-testability-scoring

215
proffesor-for-testingproffesor-for-testing

AI-powered testability assessment using 10 principles of intrinsic testability with Playwright and optional Vibium integration. Evaluates web applications against Observability, Controllability, Algorithmic Simplicity, Transparency, Stability, Explainability, Unbugginess, Smallness, Decomposability, and Similarity. Use when assessing software testability, evaluating test readiness, identifying testability improvements, or generating testability reports.

testabilityscoringplaywright+6
142 days ago

esm

100
adaptyvbioadaptyvbio

ESM2 protein language model for embeddings and sequence scoring. Use this skill when: (1) Computing pseudo-log-likelihood (PLL) scores, (2) Getting protein embeddings for clustering, (3) Filtering designs by sequence plausibility, (4) Zero-shot variant effect prediction, (5) Analyzing sequence-function relationships. For structure prediction, use chai or boltz. For QC thresholds, use protein-qc.

sequence-designembeddingsscoring
142 days ago

ipsae

100
adaptyvbioadaptyvbio

Binder design ranking using ipSAE (interprotein Score from Aligned Errors). Use this skill when: (1) Ranking binder designs for experimental testing, (2) Filtering BindCraft or RFdiffusion outputs, (3) Comparing AF2/AF3/Boltz predictions, (4) Predicting binding success rates, (5) Need better ranking than ipTM or iPAE. For structure prediction, use chai or alphafold. For QC thresholds, use protein-qc.

rankingscoringbinding
142 days ago

dag-confidence-scorer

43
curiositechcuriositech

Assigns confidence scores to agent outputs based on multiple factors including source quality, consistency, and reasoning depth. Produces calibrated confidence estimates. Activate on 'confidence score', 'how confident', 'certainty level', 'output confidence', 'reliability score'. NOT for validation (use dag-output-validator) or hallucination detection (use dag-hallucination-detector).

dagqualityconfidence+2
142 days ago

dag-capability-ranker

43
curiositechcuriositech

Ranks skill matches by fit, performance history, and contextual relevance. Applies multi-factor scoring including success rate, resource usage, and task alignment. Activate on 'rank skills', 'best skill for', 'skill ranking', 'compare skills', 'optimal skill'. NOT for semantic matching (use dag-semantic-matcher) or skill catalog (use dag-skill-registry).

dagregistryranking+2
142 days ago

evaluator

30
SimHackerSimHacker

Independent assessment without debate context — adversarial loop prevents gaming

moollmevaluationadversarial+2
142 days ago

rubric

30
SimHackerSimHacker

Measurable criteria translating qualitative debate to quantitative scores

moollmscoringcriteria+2
142 days ago

sales-call-analysis

arielperez82arielperez82

Sales call evaluation frameworks, scoring methodology, and coaching insights for B2B sales. Enables systematic assessment of sales conversations against proven methodologies (SPIN, Challenger, MEDDIC) with quantified scorecards and improvement recommendations.

salescall-analysiscoaching+5
142 days ago

lead-qualification

arielperez82arielperez82

Enterprise lead scoring rubrics, ICP matching, and qualification frameworks (BANT, MEDDIC, CHAMP) for B2B sales. Enables systematic lead scoring against ideal customer profiles with configurable criteria and threshold-based routing.

saleslead-qualificationscoring+6
142 days ago