Informe de auditoría del skill

evaluating-code-models Informe de auditoría.

Evaluates code generation models across HumanEval, MBPP, MultiPL-E, and 15+ benchmarks with pass@k metrics. Use when benchmarking code models, comparing coding abilities, testing multi-language support, or measuring code generation quality. Industry standard from BigCode Project used by HuggingFace leaderboards.

Bloqueado · BloquearRequiere revisiónGenerado 11 oct 2026Auditoría heurística de metadatos
80
Auditoría
75
Confianza
77
Calidad
79
Seguridad
88
Maintain
92
Instalar

Trust Score de OpenAgentSkill

75
Lista sólida

Trust Score de OpenAgentSkill

The Trust Score helps an agent decide whether a skill is safe enough to shortlist before installation.

Adopción en GitHub

Info

76

825 estrellas de GitHub

Actividad de stars/forks

Info

71

825 estrellas y 176 forks; la actividad de issues no está disponible en los metadatos actuales

Mantenimiento reciente

Aprobado

88

1 meses desde el último push

Claridad de licencia

Aprobado

86

MIT

Completitud de README/SKILL.md

Aprobado

94

Los metadatos incluyen suficiente contexto de uso y flujo de trabajo

Riesgo de dependencias/runtime

Advertencia

44

command execution surface, credential or environment access

Disponibilidad de instalación

Aprobado

92

npx skills add sangrokjung/claude-forge --skill evaluating-code-models

Seguridad del comando de instalación

Aprobado

92

Ruta estándar de paquete o instalación en tiempo de ejecución

Superficie de permisos

Fallido

36

secrets or environment access, shell or command execution

Evidencia del repositorio

Aprobado

86

https://github.com/sangrokjung/claude-forge/tree/main/skills/evaluating-code-models

Estado de revisión

Aprobado

88

Hay datos de revisión por IA disponibles

Resultados comprobados por Agent

Info

54

Aún no hay datos de resultados del Agent

Comprobaciones

Revisión de instalación y adopción

8 Aprobado · 9 Requiere revisión

Ruta de instalación

92

Aprobado

npx skills add sangrokjung/claude-forge --skill evaluating-code-models

Repositorio

88

Aprobado

https://github.com/sangrokjung/claude-forge/tree/main/skills/evaluating-code-models

Licencia

86

Aprobado

MIT

Mantenimiento

88

Aprobado

1 meses desde el último push

Revisión por IA

88

Aprobado

Approved with no listed issues

Completitud de README/SKILL.md

94

Aprobado

Usable description available

Riesgo de dependencias

44

Corregir

command execution surface, credential or environment access

Seguridad del comando de instalación

92

Aprobado

Ruta estándar de paquete o instalación en tiempo de ejecución

Superficie de permisos

36

Corregir

secrets or environment access, shell or command execution

Actividad de stars/forks

71

Revisar

825 estrellas y 176 forks; la actividad de issues no está disponible en los metadatos actuales

Adopción

88

Aprobado

825 estrellas de GitHub

Advertencias

  • Dependency or permission surface needs review
  • Permission surface may require sandboxing
  • Quality score needs review
  • Permission surface needs review: secrets or environment access, shell or command execution
  • Dependency/runtime risk: command execution surface, credential or environment access
  • Permission surface: secrets or environment access, shell or command execution

Método

This report combines public metadata, AI review output, repository freshness, install readiness, OpenAgentSkill events, quality scoring, trust checks, and the agent safety gate. It is not a full source-code security review.

Comparar opciones cercanas

Skills relacionados para auditar después