Laporan audit skill

llm-gold-bound-failure-check Laporan audit.

Diagnose whether an LLM classifier's validation-gate failure is GOLD-BOUND before spending on prompt revision or model changes. Use when: (1) a scoring pipeline over-predicts a label (precision low, recall high) and a prompt clarification is proposed to tighten it, (2) a pilot/validation gate fails and the fix candidates are prompt edits, (3) inter-rater agreement on the weak label was already low (κ < ~0.6). Core check: if gold POSITIVES share the exact feature the revision would exclude, no prompt can pass a gold-scored gate — recall craters while precision barely moves. Also documents the verified surgical-pilot design (single-section diff, tune/holdout split, pre-registered gate, perturbation check on untouched sections).

Ditinjau · TinjauPerlu ditinjauDihasilkan 24 Agu 2026Audit metadata heuristik
80
Audit
79
Kepercayaan
64
Kualitas
86
Keamanan
100
Maintain
92
Pasang

Trust Score OpenAgentSkill

79
Shortlist kuat

Trust Score OpenAgentSkill

The Trust Score helps an agent decide whether a skill is safe enough to shortlist before installation.

Adopsi GitHub

Peringatan

48

47 star GitHub

Aktivitas star/fork

Peringatan

43

47 star dan 0 fork; aktivitas issue tidak tersedia dalam metadata saat ini

Pemeliharaan terbaru

Lulus

100

Diperbarui hari ini

Kejelasan lisensi

Lulus

86

MIT

Kelengkapan README/SKILL.md

Lulus

86

Metadata memuat konteks penggunaan dan alur kerja yang cukup

Risiko dependensi/runtime

Lulus

90

Tidak ada petunjuk risiko dependensi besar dalam metadata publik

Ketersediaan pemasangan

Lulus

92

npx skills add kennethkhoocy/applied-micro-skills --skill llm-gold-bound-failure-check

Keamanan perintah pemasangan

Lulus

92

Jalur pemasangan paket atau runtime standar

Cakupan izin

Lulus

86

Akses sistem file atau dokumen

Bukti repositori

Lulus

86

https://github.com/kennethkhoocy/applied-micro-skills/tree/main/plugins/applied-micro/skills/llm-gold-bound-failure-check

Status peninjauan

Lulus

88

Data tinjauan AI tersedia

Hasil terbukti Agent

Info

54

Belum ada data hasil Agent

Pemeriksaan

Tinjauan pemasangan dan adopsi

9 Lulus · 6 Perlu ditinjau

Jalur pemasangan

92

Lulus

npx skills add kennethkhoocy/applied-micro-skills --skill llm-gold-bound-failure-check

Repositori

88

Lulus

https://github.com/kennethkhoocy/applied-micro-skills/tree/main/plugins/applied-micro/skills/llm-gold-bound-failure-check

Lisensi

86

Lulus

MIT

Pemeliharaan

100

Lulus

Diperbarui hari ini

Tinjauan AI

88

Lulus

Approved with no listed issues

Kelengkapan README/SKILL.md

86

Lulus

Usable description available

Risiko dependensi

90

Lulus

Tidak ada petunjuk risiko dependensi besar dalam metadata publik

Keamanan perintah pemasangan

92

Lulus

Jalur pemasangan paket atau runtime standar

Cakupan izin

86

Lulus

Akses sistem file atau dokumen

Aktivitas star/fork

43

Perbaiki

47 star dan 0 fork; aktivitas issue tidak tersedia dalam metadata saat ini

Adopsi

42

Periksa

47 star GitHub

Peringatan

  • Low GitHub adoption signal
  • Quality score needs review
  • GitHub adoption: 47 GitHub stars
  • Stars/forks activity: 47 stars, 0 forks; issue activity unavailable in current metadata

Metode

This report combines public metadata, AI review output, repository freshness, install readiness, OpenAgentSkill events, quality scoring, trust checks, and the agent safety gate. It is not a full source-code security review.

Bandingkan opsi sekitar

Skill terkait untuk diaudit berikutnya