Informe de auditoría del skill
evaluating-code-models Informe de auditoría.
Evaluates code generation models across HumanEval, MBPP, MultiPL-E, and 15+ benchmarks with pass@k metrics. Use when benchmarking code models, comparing coding abilities, testing multi-language support, or measuring code generation quality. Industry standard from BigCode Project used by HuggingFace leaderboards.
Trust Score de OpenAgentSkill
Trust Score de OpenAgentSkill
The Trust Score helps an agent decide whether a skill is safe enough to shortlist before installation.
Adopción en GitHub
Info76
825 estrellas de GitHub
Actividad de stars/forks
Info71
825 estrellas y 176 forks; la actividad de issues no está disponible en los metadatos actuales
Mantenimiento reciente
Aprobado88
1 meses desde el último push
Claridad de licencia
Aprobado86
MIT
Completitud de README/SKILL.md
Aprobado94
Los metadatos incluyen suficiente contexto de uso y flujo de trabajo
Riesgo de dependencias/runtime
Advertencia44
command execution surface, credential or environment access
Disponibilidad de instalación
Aprobado92
npx skills add sangrokjung/claude-forge --skill evaluating-code-models
Seguridad del comando de instalación
Aprobado92
Ruta estándar de paquete o instalación en tiempo de ejecución
Superficie de permisos
Fallido36
secrets or environment access, shell or command execution
Evidencia del repositorio
Aprobado86
https://github.com/sangrokjung/claude-forge/tree/main/skills/evaluating-code-models
Estado de revisión
Aprobado88
Hay datos de revisión por IA disponibles
Resultados comprobados por Agent
Info54
Aún no hay datos de resultados del Agent
Comprobaciones
Revisión de instalación y adopción
Ruta de instalación
92
npx skills add sangrokjung/claude-forge --skill evaluating-code-models
Repositorio
88
https://github.com/sangrokjung/claude-forge/tree/main/skills/evaluating-code-models
Licencia
86
MIT
Mantenimiento
88
1 meses desde el último push
Revisión por IA
88
Approved with no listed issues
Completitud de README/SKILL.md
94
Usable description available
Riesgo de dependencias
44
command execution surface, credential or environment access
Seguridad del comando de instalación
92
Ruta estándar de paquete o instalación en tiempo de ejecución
Superficie de permisos
36
secrets or environment access, shell or command execution
Actividad de stars/forks
71
825 estrellas y 176 forks; la actividad de issues no está disponible en los metadatos actuales
Adopción
88
825 estrellas de GitHub
Advertencias
- Dependency or permission surface needs review
- Permission surface may require sandboxing
- Quality score needs review
- Permission surface needs review: secrets or environment access, shell or command execution
- Dependency/runtime risk: command execution surface, credential or environment access
- Permission surface: secrets or environment access, shell or command execution
Método
This report combines public metadata, AI review output, repository freshness, install readiness, OpenAgentSkill events, quality scoring, trust checks, and the agent safety gate. It is not a full source-code security review.
Comparar opciones cercanas
Skills relacionados para auditar después
Code Review
Review a branch or diff against repository standards and the originating spec in two independent analysis passes.
169K Estrellas · Informe de auditoría
Appsmith
Platform to build admin panels, internal tools, and dashboards. Integrates with 25+ databases and any API.
41K Estrellas · Informe de auditoría
Implement
Implement work from an approved spec or ticket set, run focused and full tests, invoke code review, and commit the result to the current branch.
176K Estrellas · Informe de auditoría