Caliper

Revoir · 70
Indexé par la communauté

Know if your agent skill actually works. A lightweight evaluation harness that tracks a success rate across Claude Code, Codex, Pi, and Hermes.

Verified installs0
Stars36
Version1.0.0
Qualité72/100 · Solide
Confiance70/100 · Sandbox uniquement
Audit82/100 · Revue nécessaire

Profil de l’actif

Agents de code et de développement

Code review, repo analysis, testing, CI, GitHub, DevOps, and developer workflow skills.

Voir la catégorie

Scénario

Agents de code

I need a coding agent that can understand a repository, edit code, and review pull requests.

Adéquation Agent

Claude Code + OpenAI Agents + CLI

Compatible avec Codex, Claude Code, Cursor, CLI ou des Agents personnalisés.

Installer

Prêt

npx skills add edonadei/caliper

Maintenance

À jour

27 jours depuis le dernier push

Risque

Revue nécessaire

Low GitHub adoption signal

Qualité GitHub

36

72/100 Qualité · 78/100 Confiance

Tags de couverture

CodingAgents de codeAgents de codeevaluationtesting

Notes de revue

Low GitHub adoption signal · Quality score needs review

Carte d’adoption Agent

Confiance, audit et préparation à l’installation en un coup d’œil

Ces scores combinent les métadonnées publiques du dépôt, les signaux de revue OpenAgentSkill, la fraîcheur de maintenance et la préparation à l’installation. Ils servent à présélectionner et ne remplacent pas la revue humaine.

Qualité

Solide
72

Solid option that is likely worth shortlisting for production workflows.

Confiance

Sandbox uniquement
70

Candidate utile avec des signaux de confiance incomplets ou mixtes. Gardez-la dans un espace isolé jusqu’à ce que la boucle de résultats confirme son adéquation.

Audit

Revue nécessaire
82

Revue lisible par machine de la préparation à l’installation, des métadonnées de sécurité, de la maintenance et du risque d’adoption.

Trust Score OpenAgentSkill v5

Revue humaine avant installation

Exécutez uniquement dans un sandbox et comparez les alternatives proches avant usage réel.

PythonCodexClaude CodeCursorOpenAgentSkill CLI

Stars

36 stars GitHub

Activité du dépôt

36 stars et 4 forks

Maintenance

27 jours depuis le dernier push

Licence

MIT

Installer

npx skills add edonadei/caliper

Sécurité d’installation

Chemin d’installation standard de package ou runtime

Surface de permissions

Exécution shell ou de commande

Résultats Agent

Pas encore de données de résultats Agent

Documentation

Contexte README/SKILL.md solide

Résumé des risques

Revoir avant production

  • Low GitHub adoption signal
  • Quality score needs review
  • GitHub adoption: 36 GitHub stars
  • Stars/forks activity: 36 stars, 4 forks; issue activity unavailable in current metadata

Préparation à l’installation

Chemin d’installation disponible

  • Le chemin d’installation est disponible
  • La preuve du dépôt est disponible
  • La licence est déclarée
  • Pas encore de preuve de résultat Agent-Proven

Métadonnées lisibles par Agent

Données de décision lisibles par machine pour ce skill.

Utilisez ce bloc ou le JSON intégré pour décider si un Agent doit installer ce skill, choisir une alternative ou demander d’abord une revue humaine.

Ouvrir JSON

Tâches adaptées

  • workflows Agents de code
  • Équipes Claude Code
  • builders willing to evaluate younger projects
  • Inspect source files

Agents adaptés

PythonCodexClaude CodeCursorOpenAgentSkill CLIOpenAI AgentsCLI

Décision d’installation

Commande
npx skills add edonadei/caliper
Politique
Revoir
Revue humaine
Oui

Confiance et risque

Confiance
70/100
Audit
82/100
Niveau de risque
Revue nécessaire

Boucle de résultat

Endpoint
/api/agent/outcome
ID d’événement
resolve
Résultats
5

Commande d’installation

npx skills add edonadei/caliper

Ne pas utiliser quand

  • Équipes qui nécessitent un SLA soutenu par le fournisseur
  • production agents without a repository review
  • Low GitHub adoption signal
  • Indices de permissions à haut risque : exécution shell ou de commande
  • Quality score needs review

Sécurité Agent v2

58/100 · Revoir avant installation

Révisé avec notes de permissionsRevoir

Candidat utilisable, mais l’Agent doit afficher les notes de permissions et d’audit avant l’installation.

Une approbation humaine est requise avant l’installation dans un espace de travail réel.

Résoudre via API

Élevé

Exécution shell ou de commande

Les métadonnées de la skill font référence à des workflows de terminal, CLI, shell, sous-processus ou exécution de commande.

Moyen

Accès réseau

La skill récupère probablement des pages distantes, API, dépôts ou services externes.

  • Indices de permissions à haut risque : exécution shell ou de commande
  • Low GitHub adoption signal

Cibles d’installation

Installer ce skill dans votre workflow Agent

Utilisez le point de terminaison public pour récupérer la commande, la checklist, les prompts et les liens canoniques.

skill install

OpenAgentSkill CLI

Resolve policy, run the source installer safely, and report a verified install receipt.

$ npx --yes https://github.com/Leon-Drq/openagentskill/releases/download/cli-v0.2.1/openagentskill-0.2.1.tgz install edonadei-caliper

Plan de résolution Agent

Laissez un Agent vérifier la pertinence avant l’installation.

L’API Resolve renvoie la skill sélectionnée, des alternatives, la politique de sécurité, les notes d’audit, la cible d’installation et un prompt prêt à l’emploi.

Ouvrir le plan texte

L’Agent doit vérifier

  • Task fit and alternatives from Resolve API.
  • Audit score, trust score, and safety policy warnings.
  • Install target compatibility for Codex, Claude Code, Cursor, or CLI.

Copier le prompt

Task: Use Caliper in this workspace.
Resolve first: https://www.openagentskill.com/api/agent/resolve?task=Use%20Caliper%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Review install handoff: https://www.openagentskill.com/api/skills/edonadei-caliper/install
Install command: npx skills add edonadei/caliper
Before running it, summarize audit warnings, required permissions, and the fallback skill if install is risky.

Relais Agent

Donnez à l’Agent le chemin d’installation, pas un autre annuaire.

Utilisez le point de terminaison public pour récupérer la commande, la checklist, les prompts et les liens canoniques.

Ouvrir l’API d’installation

Prompt Agent

Use Caliper for this task. Review https://www.openagentskill.com/api/skills/edonadei-caliper/install, then install with: npx skills add edonadei/caliper

Métadonnées Registry

Profil lisible par Agent pour la sélection automatique de skills.

L’API Registry fournit les signaux de décision, confiance, audit, cas d’usage et installation sans analyser l’interface.

Ouvrir Manifest

Adéquation Agent

73/100

Agents de code

Plateformes

Python, Claude Code, OpenAI Agents

Rapport d’audit

Revue nécessaire · 82/100

Revue lisible par machine de la préparation à l’installation, des métadonnées de sécurité, de la maintenance et du risque d’adoption.

Voir le rapport d’auditVoir le rapport d’évaluation

Panneau de décision Agent

Companion skill for Coding agents

Shortlist this skill and compare it with close alternatives before production adoption.

73
Préparation
Préselection
Étape

Rôle dans la pile

Skill complémentaire

Pertinence principale

Agents de code

Libellé de confiance

Liste solide

Chemin d’installation

Commande prête

À utiliser lorsque

  • workflows Agents de code
  • Équipes Claude Code
  • builders willing to evaluate younger projects

Preuves

  • recent repository activity
  • install command or GitHub repo available
  • profil qualité 72/100
  • 4 événements OpenAgentSkill

revoir d’abord

  • Low GitHub adoption signal

Chemin d’implémentation

  1. 1Installez-le dans un Agent en sandbox et exécutez une tâche de Agents de code de bout en bout.
  2. 2Compare output quality, latency, and failure behavior against at least one alternative.
  3. 3Promote it into production only after reviewing repository permissions, license, and maintenance signals.

Profil de confiance

Sandbox uniquement

Candidate utile avec des signaux de confiance incomplets ou mixtes. Gardez-la dans un espace isolé jusqu’à ce que la boucle de résultats confirme son adéquation.

70
Trust Score OpenAgentSkill

Adoption GitHub

Vérifier

36 stars GitHub

Activité stars/forks

Vérifier

36 stars et 4 forks; l’activité des issues n’est pas disponible dans les métadonnées actuelles

Maintenance récente

Validé

27 jours depuis le dernier push

Clarté de licence

Validé

MIT

Signaux positifs

  • Revue IA approuvée
  • Le chemin d’installation est disponible
  • La preuve du dépôt est disponible
  • Dépôt maintenu récemment
  • La commande d’installation ne présente aucun motif de haut risque évident
  • La boucle de résultats est prête mais nécessite la première exécution réelle de l’Agent

Réviser avant installation

  • Low GitHub adoption signal
  • Quality score needs review
  • GitHub adoption: 36 GitHub stars
  • Stars/forks activity: 36 stars, 4 forks; issue activity unavailable in current metadata
  • Pas encore de rapports de résultats Agent réels
  • Une revue humaine est requise avant une installation sans surveillance

Action recommandée

Exécutez uniquement dans un sandbox et comparez les alternatives proches avant usage réel.

Profil qualité

Solide candidat pour les workflows Agent

Solid option that is likely worth shortlisting for production workflows.

72
Stars GitHub
36
Actualité
il y a 27 jours
Prêt à installer
Oui
Licence
MIT
Réviser avant installation: Low GitHub adoption signal

Adéquation au workflow

Utilisez cette skill dans ces scénarios

Adéquation au workflow

Ajouter à un workflow complet

Liste d’alternatives

Comparer avant installation

Similar skills that may fit this task.

Tout comparer

Vue d’ensemble

# Caliper: Know if your agent skill actually works

[![PyPI](https://img.shields.io/pypi/v/caliper-eval.svg)](https://pypi.org/project/caliper-eval/) [![Python](https://img.shields.io/pypi/pyversions/caliper-eval.svg)](https://pypi.org/project/caliper-eval/) [![Skills](https://skills.sh/b/edonadei/caliper)](https://skills.sh/edonadei/caliper)

Caliper is a lightweight evaluation harness for agent skills. Write a short spec of what "good" looks like, run it again and again, and get a **success rate** you can track. It also runs every task _without_ the skill, so you learn whether the skill is doing the work or the base agent would have passed anyway. Works with the agent you already use: Claude Code, Codex, Pi, or Hermes.

**Teach your agent to evaluate:**

```bash npx skills@latest add edonadei/caliper ```

**Or run it yourself:**

```bash caliper run commit-commands.eval.yaml --k 3 --baseline ```

You write a spec, a few lines of YAML describing what "working" means, which you hand-write or have `/grill-skill` generate for you. With `--baseline`, Caliper runs each task with and without the skill and diffs the two runs task by task:

<!-- Terminal output of `caliper compare`, rendered to SVG so the box-drawing table stays aligned on every screen. Regenerate with: python docs/render_readme_samples.py --> ![caliper compare, no skill vs with skill on commit-commands: both tasks go 33.3% to 100.0% (+66.7%); tokens 290K to 180K, wall 1m 1s to 42s](docs/assets/compare-baseline.svg)

---

Agent skills are hard to test. A skill that works on your machine, on this prompt, today, might fail tomorrow after a model update or a one-line prompt edit. Caliper makes reliability measurable: define what success looks like, run the skill repeatedly, and get a success rate you can track over time.

Use Caliper to answer questions like:

- Did my prompt edit actually improve the skill? - Is the skill doing the work, or would the base agent pass without it? - Does it still pa

Compatibilité plateforme

pythonFULL

Détails techniques

Version
1.0.0
Licence
MIT
Dernière mise à jour
18 août 2026
Publié
26 juil. 2026

Frameworks et outils

Python

Instantané de décision

Skill complémentaire

73
Prêt
Préselection
Étape

recent repository activity

Audit

Revue d’installation

Revue d’installation et d’adoption

82
Revue nécessaire
Sécurité
84/100
Maintenance
100/100
Installer
92/100
Ouvrir l’audit completVoir le rapport d’évaluation

Preuves validées par Agent

Preuves validées par Agent

Rapports après resolve, revue, installation et une exécution limitée.

0
Validé
Needs first agent runAuto-installation: revoir d’abordDernier: Inconnu
Taux de réussite
Échec récent
Résultats
0
Qualité de sortie
Échecs
0
Non pertinent
0
Installations
0
Bloqué par le risque
0
Configuration requise
0
Production
0

Aucune donnée de résultat Agent pour l’instant. La première exécution peut signaler succès, besoin de configuration, blocage de risque, échec ou non-pertinence via /api/agent/outcome.

Installer

Ajouter au workflow Agent

Gratuit et open source. Examinez le rapport avant l’installation dans des Agents de production.

Boucle de croissance

Kit de partage

X

Brouillon guidé par scénario pour Caliper, prêt pour une publication manuelle sur X.

Note du curateur
For the next repo task, this is a skill worth shortlisting before another blank prompt.

Caliper: Lightweight evaluation harness for agent skills to track success rates across multiple agent runtimes.

36 stars

https://www.openagentskill.com/skills/edonadei-caliper?ref=x
Ouvrir le brouillon X
Réponse facultative avec commande d’installation
Listing + install path for Caliper:
https://www.openagentskill.com/skills/edonadei-caliper?ref=x

Install: npx skills add edonadei/caliper

Source de la fiche

Indexé par la communauté

Revendiable

Cette fiche a été indexée à partir de sources publiques et n’est pas marquée officielle tant qu’une revendication de mainteneur n’est pas approuvée.

Créateur
edonadei
Indexé par
Index communautaire OpenAgentSkill

L’attribution renvoie au dépôt public ou au profil du créateur. Les créateurs peuvent revendiquer la fiche pour mettre à jour les signaux de propriété.

Revendiquer ce skill

Revendication du propriétaire

Revendiquer cette fiche de skill

Cette fiche Indexé par la communauté est attribuée à edonadei, mais n’est pas encore marquée officielle. Revendiquez-la pour ajouter un signal de propriétaire vérifié et rendre les futures mises à jour de lancement, d’installation et d’audit plus fiables.

Kit de backlinks créateur

Ajoutez les badges de preuve à votre README

Affichez la fiche canonique, les signaux actuels de confiance et d’audit, ainsi que de vraies preuves Agent-Proven là où les développeurs évaluent le dépôt.

[![Listed on OpenAgentSkill](https://www.openagentskill.com/api/badge/edonadei-caliper?metric=listed&label=Listed)](https://www.openagentskill.com/skills/edonadei-caliper)
[![OpenAgentSkill Trust](https://www.openagentskill.com/api/badge/edonadei-caliper?metric=trust&label=Trust)](https://www.openagentskill.com/skills/edonadei-caliper)
[![OpenAgentSkill Audit](https://www.openagentskill.com/api/badge/edonadei-caliper?metric=audit&label=Audit)](https://www.openagentskill.com/skills/edonadei-caliper/audit)
[![Agent Proven](https://www.openagentskill.com/api/badge/edonadei-caliper?metric=proven&label=Agent%20Proven)](https://www.openagentskill.com/skills/edonadei-caliper)

Auteur

E

edonadei

@edonadei

Adéquation plateforme

Signaux de santé

Stars GitHub
36
Score de qualité
44/100
Dernier push GitHub
26 juil. 2026
Indications de framework
1
Vues OpenAgentSkill
4
Copies d’installation
0
Clics sortants
0

Signal de communauté

Indiquez si ce skill semble utile à votre workflow Agent. Les retours agrégés améliorent le classement au fil du temps.

Confiance et sécurité

Sandbox uniquement

70
  • Adoption GitHub36 stars GitHubVérifier
  • Activité stars/forks36 stars et 4 forks; l’activité des issues n’est pas disponible dans les métadonnées actuellesVérifier
  • Maintenance récente27 jours depuis le dernier pushValidé
  • Clarté de licenceMITValidé
  • Complétude README/SKILL.mdLes métadonnées incluent suffisamment de contexte d’usage et de workflowValidé
  • Risque dépendances/runtimeSurface d’exécution de commandesInfo