Evaluasi sebelum pemasangan

agent-harness Laporan evaluasi.

Keputusan pemasangan yang dapat dibaca mesin untuk Agent: kecocokan tugas, Trust Score, Audit Score, keamanan pemasangan, cakupan izin, dan rencana validasi konkret sebelum skill menyentuh workspace.

Perlu ditinjauRisiko sedangTinjau Kebijakan
81
Laporan evaluasi
81
Kepercayaan
87
Audit
59
Keamanan Agent

Tinjauan manual

Memerlukan persetujuan manusia sebelum memasang ke workspace nyata.

Gerbang wajib

Pemeriksaan yang harus dilalui Agent sebelum memasang

Buka JSON

Kecocokan tugas

94

Lulus

Task wording matches this skill metadata.

  • Evaluate agent-harness before installing it in an agent workflow
  • Riset
  • Research agents workflows; Claude Code teams; teams that value GitHub adoption signals

Jalur pemasangan

92

Lulus

Install handoff is available.

  • npx skills add alirezarezvani/claude-skills --skill agent-harness

Keamanan perintah pemasangan

92

Lulus

Jalur pemasangan paket atau runtime standar

  • npx skills add alirezarezvani/claude-skills --skill agent-harness

Skor kepercayaan

81

Peringatan

Good trust signals with a few areas worth checking before rollout.

  • Shortlist kuat
  • 25K star GitHub
  • MIT

Skor audit

87

Peringatan

Perlu ditinjau

  • Financial research output is not financial advice; require human review before any live investment decision

Gerbang keamanan Agent

59

Peringatan

Kandidat yang dapat digunakan, tetapi Agent harus menampilkan catatan izin dan audit sebelum memasang.

  • Memerlukan persetujuan manusia sebelum memasang ke workspace nyata.
  • Petunjuk izin berisiko tinggi: eksekusi shell atau perintah

Kejelasan lisensi

86

Lulus

MIT

  • MIT

Cakupan izin

62

Peringatan

shell or command execution, filesystem or document access

  • Shell or command execution: high
  • Network access: medium
  • Filesystem access: medium

Rencana validasi

Langkah Agent berikutnya

  1. 1Inspect repository, README/SKILL.md, license, and recent commits before production use.
  2. 2Install in an isolated workspace or sandbox with no production secrets available.
  3. 3Run the smallest representative task and record files touched, commands run, network access, and outputs.
  4. 4Compare the selected skill against at least one alternative when the eval status is review or failed.
  5. 5Promote only after the agent reports a successful verification result and unresolved warnings are accepted.

Jangan gunakan ketika

Kondisi yang membutuhkan skill lain

  • Tim yang membutuhkan SLA dengan dukungan vendor
  • production agents without a repository review
  • The skill relies on external scripts (goal_compiler.py, loop_controller.py, etc.) not fully reviewed in this excerpt; their security posture should be verified independently.
  • No OpenAgentSkill engagement data yet
  • Petunjuk izin berisiko tinggi: eksekusi shell atau perintah
  • Financial research output is not financial advice; require human review before any live investment decision

Pemeriksaan pendukung

Sinyal kepercayaan di balik keputusan

Kelengkapan README/SKILL.md

Lulus

86

Metadata memuat konteks penggunaan dan alur kerja yang cukup

Pemeliharaan terbaru

Lulus

100

Diperbarui hari ini

Alternatif tersedia

Lulus

82

Alternative skills are available for comparison.