Evaluasi sebelum pemasangan

Mermaid Skill Laporan evaluasi.

Keputusan pemasangan yang dapat dibaca mesin untuk Agent: kecocokan tugas, Trust Score, Audit Score, keamanan pemasangan, cakupan izin, dan rencana validasi konkret sebelum skill menyentuh workspace.

GagalRisiko tinggiBlokir Kebijakan
84
Laporan evaluasi
83
Kepercayaan
90
Audit
62
Keamanan Agent

do not auto install

Permission surface: shell or command execution, filesystem or document access

Gerbang wajib

Pemeriksaan yang harus dilalui Agent sebelum memasang

Buka JSON

Kecocokan tugas

94

Lulus

Task wording matches this skill metadata.

  • Evaluate Mermaid Skill before installing it in an agent workflow
  • Alat umum
  • GitHub automation workflows; Claude Code teams; builders willing to evaluate younger projects

Jalur pemasangan

92

Lulus

Install handoff is available.

  • npx skills add Agents365-ai/mermaid-skill

Keamanan perintah pemasangan

92

Lulus

Jalur pemasangan paket atau runtime standar

  • npx skills add Agents365-ai/mermaid-skill

Skor kepercayaan

83

Lulus

Good trust signals with a few areas worth checking before rollout.

  • Shortlist kuat
  • 176 star GitHub
  • MIT

Skor audit

90

Peringatan

Perlu ditinjau

  • Permission surface may require sandboxing

Gerbang keamanan Agent

62

Peringatan

Kandidat yang dapat digunakan, tetapi Agent harus menampilkan catatan izin dan audit sebelum memasang.

  • Memerlukan persetujuan manusia sebelum memasang ke workspace nyata.
  • Petunjuk izin berisiko tinggi: eksekusi shell atau perintah

Kejelasan lisensi

86

Lulus

MIT

  • MIT

Cakupan izin

48

Gagal

shell or command execution, filesystem or document access

  • Shell or command execution: high
  • Network access: medium
  • Filesystem access: medium

Rencana validasi

Langkah Agent berikutnya

  1. 1Inspect repository, README/SKILL.md, license, and recent commits before production use.
  2. 2Install in an isolated workspace or sandbox with no production secrets available.
  3. 3Run the smallest representative task and record files touched, commands run, network access, and outputs.
  4. 4Compare the selected skill against at least one alternative when the eval status is review or failed.
  5. 5Promote only after the agent reports a successful verification result and unresolved warnings are accepted.

Jangan gunakan ketika

Kondisi yang membutuhkan skill lain

  • Tim yang membutuhkan SLA dengan dukungan vendor
  • Lingkungan berkompliansi tinggi tanpa tinjauan keamanan internal
  • No major risk signals from current metadata
  • Petunjuk izin berisiko tinggi: eksekusi shell atau perintah
  • Permission surface may require sandboxing
  • Permission surface needs review: shell or command execution, filesystem or document access

Pemeriksaan pendukung

Sinyal kepercayaan di balik keputusan

Kelengkapan README/SKILL.md

Lulus

100

Metadata memuat konteks penggunaan dan alur kerja yang cukup

Pemeliharaan terbaru

Lulus

100

7 hari sejak push

Alternatif tersedia

Lulus

82

Alternative skills are available for comparison.