VLMEvalKit
Open-source evaluation toolkit of large multi-modality models (LMMs), support 220+ LMMs, 80+ benchmarks
Profil aset
Agent pemrograman dan pengembangan
Code review, repo analysis, testing, CI, GitHub, DevOps, and developer workflow skills.
Skenario
Agent pemrograman
I need a coding agent that can understand a repository, edit code, and review pull requests.
Kecocokan Agent
Claude Code + OpenAI Agents + CLI
Cocok untuk Codex, Claude Code, Cursor, CLI, atau Agent khusus.
Pasang
Siap
npx skills add open-compass/VLMEvalKit
Pemeliharaan
Aktif
2 bulan sejak push
Risiko
Perlu ditinjau
Financial research output is not financial advice; require human review before any live investment decision
Kualitas GitHub
4.2K
100/100 Kualitas · 90/100 Kepercayaan
Tag cakupan
Catatan ulasan
Financial research output is not financial advice; require human review before any live investment decision · Financial research output is not financial advice; require human review before any live investment decision.
Kartu adopsi Agent
Kepercayaan, audit, dan kesiapan pemasangan dalam sekali lihat
Skor ini menggabungkan metadata repositori publik, sinyal ulasan OpenAgentSkill, kebaruan pemeliharaan, dan kesiapan pemasangan. Ini adalah sinyal shortlist, bukan pengganti peninjauan manusia.
Kualitas
Sangat baikHigh-confidence pick with strong adoption and healthy maintenance signals.
Kepercayaan
Do not auto-installTrust Score v5 found insufficient evidence for agent installation. Treat this as discovery material, not an executable recommendation.
Audit
Perlu ditinjauTinjauan yang dapat dibaca mesin tentang kesiapan pemasangan, metadata keamanan, pemeliharaan, dan risiko adopsi.
Trust Score OpenAgentSkill v5
Tinjauan manusia sebelum pemasangan
Choose a stronger alternative or inspect the source manually before any install attempt.
Star
4.2K star GitHub
Aktivitas repositori
4.2K star dan 723 fork
Pemeliharaan
2 bulan sejak push
Lisensi
Apache-2.0
Pasang
npx skills add open-compass/VLMEvalKit
Keamanan pemasangan
Jalur pemasangan paket atau runtime standar
Cakupan izin
Akses sistem file atau dokumen
Hasil Agent
Early agent signal: 0% success from 1 agent outcomes
Dokumentasi
Konteks README/SKILL.md kuat
Ringkasan risiko
Tinjau sebelum produksi
- Financial research output is not financial advice; require human review before any live investment decision.
- Recent failure rate is elevated: 100%
- 1 failed agent outcome(s) reported
- Agent Proven outcomes: Early agent signal: 0% success from 1 agent outcomes
Kesiapan pemasangan
Jalur pemasangan tersedia
- Jalur pemasangan tersedia
- Bukti repositori tersedia
- Lisensi dinyatakan
- Early agent signal (24/100 Agent Proven)
Metadata yang dapat dibaca Agent
Data keputusan yang dapat dibaca mesin untuk skill ini.
Gunakan blok ini atau JSON tersemat untuk memutuskan apakah Agent perlu memasang skill ini, memilih alternatif, atau meminta tinjauan manusia terlebih dahulu.
Tugas yang sesuai
- alur kerja Agent pemrograman
- Tim Claude Code
- Tim yang menghargai sinyal adopsi GitHub
- Inspect source files
Agent yang sesuai
Keputusan pemasangan
- Perintah
- npx skills add open-compass/VLMEvalKit
- Kebijakan
- Tinjau
- Tinjauan manusia
- Ya
Kepercayaan dan risiko
- Kepercayaan
- 58/100
- Audit
- 93/100
- Tingkat risiko
- Perlu ditinjau
Lingkar hasil
- Endpoint
- /api/agent/outcome
- ID event
- resolve
- Hasil
- 5
Perintah pemasangan
npx skills add open-compass/VLMEvalKitJangan gunakan ketika
- Tim yang membutuhkan SLA dengan dukungan vendor
- Lingkungan berkompliansi tinggi tanpa tinjauan keamanan internal
- No major risk signals from current metadata
- Financial research output is not financial advice; require human review before any live investment decision
- Financial research output is not financial advice; require human review before any live investment decision.
Skill alternatif
Remove AI Watermarks
4.3K Star
npx skills add wiltodelta/remove-ai-watermarks
Skill alternatif
Aily Blockly
3.8K Star
npx skills add ailyProject/aily-blockly
Skill alternatif
AliceVision
3.5K Star
npx skills add alicevision/AliceVision
Skill alternatif
MaaNTE
2.6K Star
npx skills add 1bananachicken/MaaNTE
Keamanan Agent v2
77/100 · Tinjau sebelum memasang
Kandidat yang dapat digunakan, tetapi Agent harus menampilkan catatan izin dan audit sebelum memasang.
Memerlukan persetujuan manusia sebelum memasang ke workspace nyata.
Sedang
Akses jaringan
Skill kemungkinan mengambil halaman jarak jauh, API, repositori, atau layanan eksternal.
Sedang
Akses sistem file
Skill dapat membaca atau menulis file proyek, dokumen, artefak yang dihasilkan, atau status workspace lokal.
- Financial research output is not financial advice; require human review before any live investment decision
Target pemasangan
Pasang skill ini di alur Agent Anda
Gunakan endpoint publik untuk mengambil perintah, checklist keamanan, prompt target, dan tautan kanonis.
OpenAgentSkill CLI
Resolve policy, run the source installer safely, and report a verified install receipt.
$ npx --yes https://github.com/Leon-Drq/openagentskill/releases/download/cli-v0.2.1/openagentskill-0.2.1.tgz install open-compass-vlmevalkitRencana resolusi Agent
Biarkan Agent memverifikasi kecocokan sebelum memasang.
API Resolve mengembalikan skill utama, alternatif, kebijakan keamanan, catatan audit, target pemasangan, dan prompt siap pakai.
Buka JSON
/api/agent/resolve?task=Use%20VLMEvalKit%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Teks Resolve
/api/agent/resolve?task=Use%20VLMEvalKit%20for%20an%20agent%20workflow&agent=codex&max_risk=medium&format=text
Serah-terima pemasangan
/api/skills/open-compass-vlmevalkit/install
Agent harus memeriksa
- Task fit and alternatives from Resolve API.
- Audit score, trust score, and safety policy warnings.
- Install target compatibility for Codex, Claude Code, Cursor, or CLI.
Salin prompt
Task: Use VLMEvalKit in this workspace.
Resolve first: https://www.openagentskill.com/api/agent/resolve?task=Use%20VLMEvalKit%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Review install handoff: https://www.openagentskill.com/api/skills/open-compass-vlmevalkit/install
Install command: npx skills add open-compass/VLMEvalKit
Before running it, summarize audit warnings, required permissions, and the fallback skill if install is risky.Serah-terima Agent
Berikan jalur pemasangan kepada Agent, bukan direktori lain.
Gunakan endpoint publik untuk mengambil perintah, checklist keamanan, prompt target, dan tautan kanonis.
Serah-terima pemasangan
/api/skills/open-compass-vlmevalkit/install
Format teks LLM
/api/skills/open-compass-vlmevalkit/install?format=text
Cari alternatif
/api/skills/search?q=VLMEvalKit&limit=3
Prompt Agent
Use VLMEvalKit for this task. Review https://www.openagentskill.com/api/skills/open-compass-vlmevalkit/install, then install with: npx skills add open-compass/VLMEvalKitMetadata Registry
Profil yang dapat dibaca Agent untuk pemilihan skill otomatis.
API Registry menyediakan sinyal keputusan, kepercayaan, audit, use case, dan pemasangan tanpa mengikis UI.
Manifest
/api/registry/manifest/open-compass-vlmevalkit
Teks LLM
/api/registry/manifest/open-compass-vlmevalkit?format=text
Alias pemasangan
/api/registry/install/open-compass-vlmevalkit
Rekomendasikan
/api/registry/recommend?task=Use%20VLMEvalKit%20in%20an%20agent%20workflow&limit=3
Kecocokan Agent
Agent pemrograman
Platform
Python, Computer Vision, Claude Code, OpenAI Agents
Laporan audit
Perlu ditinjau · 93/100
Tinjauan yang dapat dibaca mesin tentang kesiapan pemasangan, metadata keamanan, pemeliharaan, dan risiko adopsi.
Panel keputusan Agent
Pilihan utama untuk Agent pemrograman
Use this as a leading candidate, then validate the README and install path in your own agent stack.
Peran di stack
Pilihan utama
Kecocokan utama
Agent pemrograman
Label kepercayaan
Siap produksi
Jalur pemasangan
Perintah siap
Gunakan saat
- alur kerja Agent pemrograman
- Tim Claude Code
- Tim yang menghargai sinyal adopsi GitHub
Bukti
- 4,229 star GitHub
- recent repository activity
- install command or GitHub repo available
- profil kualitas 100/100
- 132 event interaksi OpenAgentSkill
tinjau dulu
- No major risk signals from current metadata
Jalur implementasi
- 1Pasang di Agent sandbox dan jalankan satu tugas Agent pemrograman dari awal hingga akhir.
- 2Compare output quality, latency, and failure behavior against at least one alternative.
- 3Promote it into production only after reviewing repository permissions, license, and maintenance signals.
Profil kepercayaan
Do not auto-install
Trust Score v5 found insufficient evidence for agent installation. Treat this as discovery material, not an executable recommendation.
Adopsi GitHub
Lulus4.2K star GitHub
Aktivitas star/fork
Lulus4.2K star dan 723 fork; aktivitas issue tidak tersedia dalam metadata saat ini
Pemeliharaan terbaru
Lulus2 bulan sejak push
Kejelasan lisensi
LulusApache-2.0
Sinyal positif
- Listing yang diverifikasi manual
- Tinjauan AI disetujui
- Jalur pemasangan tersedia
- Bukti repositori tersedia
- Repositori yang baru dipelihara
- Sinyal adopsi GitHub yang bermakna
- Perintah pemasangan tidak memiliki pola berisiko tinggi yang jelas
- Aktivitas penggunaan OpenAgentSkill terdeteksi
- kepercayaan hasil 25% dari 1 laporan
Tinjau sebelum memasang
- Financial research output is not financial advice; require human review before any live investment decision.
- Recent failure rate is elevated: 100%
- 1 failed agent outcome(s) reported
- Agent Proven outcomes: Early agent signal: 0% success from 1 agent outcomes
- Tinjauan manusia diperlukan sebelum pemasangan tanpa pengawasan
Tindakan yang disarankan
Choose a stronger alternative or inspect the source manually before any install attempt.
Profil kualitas
Sangat baik kandidat untuk alur kerja Agent
High-confidence pick with strong adoption and healthy maintenance signals.
Kecocokan alur kerja
Gunakan skill ini pada skenario berikut
Build and ship code
Coding agents
I need a coding agent that can understand a repository, edit code, and review pull requests.
Search private knowledge
RAG and knowledge
I need my agent to build a RAG workflow over documents and retrieve reliable context.
Automate repeated work
Workflow automation
I need my agent to automate a repeated workflow across tools and files.
Kecocokan alur kerja
Tambahkan ke alur kerja lengkap
Turn skills into distribution
Content growth agent
A workflow for turning newly indexed skills into SEO briefs, social drafts, comparison pages, and reusable publishing workflows.
Inspect, patch, and verify code
Coding review agent
A workflow for software agents that inspect repositories, review pull requests, generate tests, and turn findings into shippable patches.
Ingest, retrieve, and cite
RAG knowledge base
A workflow for document-heavy agents that ingest files, create searchable knowledge, retrieve relevant context, and answer with grounded sources.
Daftar alternatif
Bandingkan sebelum memasang
Similar skills that may fit this task.
Remove AI Watermarks
AI watermark remover. CLI and Python library to strip visible and invisible AI watermarks (Gemini / Nano Banana sparkle, SynthID) and provenance metadata (C2PA, EXIF, IPTC) from images.
Aily Blockly
AI IDE for hardware development, support Arduino, MicroPython, ESP32, STM32, RP2040, Nrf5x...
AliceVision
3D Computer Vision Framework
MaaNTE
MaaNTE. Nevertheless to Everless automatic assistant 异环小助手
Ringkasan
Open-source evaluation toolkit of large multi-modality models (LMMs), support 220+ LMMs, 80+ benchmarks
Imported by the skill-only GitHub discovery pipeline because it matches agent skill, automation, domain workflow, RAG, document-processing, data, finance, security, or developer-tool signals. Protocol-server projects are excluded from automated imports.
Kompatibilitas platform
Detail teknis
- Versi
- 1.0.0
- Lisensi
- Apache-2.0
- Pembaruan terakhir
- 18 Agu 2026
- Diterbitkan
- 16 Jun 2026
Framework dan alat
Ringkasan keputusan
Pilihan utama
4,229 star GitHub
Audit
Tinjauan pemasangan
Tinjauan pemasangan dan adopsi
- Keamanan
- 89/100
- Pemeliharaan
- 88/100
- Pasang
- 92/100
Bukti tervalidasi Agent
Bukti tervalidasi Agent
Laporan hasil setelah resolve, tinjau, pasang, dan satu eksekusi terbatas.
- Tingkat sukses
- 0%
- Kegagalan terbaru
- 100%
- Hasil
- 1
- Kualitas output
- —
- Gagal
- 1
- Tidak relevan
- 0
- Pemasangan
- 1
- Diblokir risiko
- 0
- Perlu penyiapan
- 0
- Produksi
- 0
Early agent signal: 1 outcome, 0% success, Agent Proven Score 24/100.
Pasang
Tambahkan ke alur Agent
Gratis dan sumber terbuka. Tinjau laporan sebelum memasang pada Agent produksi.
Siklus pertumbuhan
Kit berbagi
Draf berbasis skenario untuk VLMEvalKit, siap untuk posting manual di X.
A practical pick for a repeatable workflow: VLMEvalKit: Open-source evaluation toolkit of large multi-modality models (LMMs), support 220+ LMMs, 80+ benchmarks 4.2K stars https://www.openagentskill.com/skills/open-compass-vlmevalkit?ref=x
Balasan opsional dengan perintah pemasangan
Listing + install path for VLMEvalKit: https://www.openagentskill.com/skills/open-compass-vlmevalkit?ref=x Install: npx skills add open-compass/VLMEvalKit
Sumber listing
Diindeks komunitas
Listing ini diindeks dari sumber publik dan belum ditandai resmi hingga klaim pemelihara disetujui.
- Kreator
- open-compass
- Sumber
- open-compass/VLMEvalKit
- Diindeks oleh
- Indeks komunitas OpenAgentSkill
Atribusi menautkan ke repositori publik atau profil kreator. Kreator dapat mengklaim listing untuk memperbarui sinyal kepemilikan.
Klaim skill iniKlaim pemilik
Klaim listing skill ini
Listing Diindeks komunitas ini dikaitkan dengan open-compass, tetapi belum ditandai resmi. Klaim untuk menambahkan sinyal pemilik terverifikasi dan membuat pembaruan peluncuran, pemasangan, serta audit berikutnya lebih tepercaya.
Kit backlink kreator
Tambahkan badge bukti ke README Anda
Tampilkan listing kanonis, sinyal kepercayaan dan audit saat ini, serta bukti Agent-Proven nyata di tempat pengembang mengevaluasi repositori.
[](https://www.openagentskill.com/skills/open-compass-vlmevalkit)
[](https://www.openagentskill.com/skills/open-compass-vlmevalkit)
[](https://www.openagentskill.com/skills/open-compass-vlmevalkit/audit)
[](https://www.openagentskill.com/skills/open-compass-vlmevalkit)Penulis
open-compass✓
@open-compass
Kecocokan platform
Sinyal kesehatan
- Star GitHub
- 4.2K
- Skor kualitas
- 69/100
- Push GitHub terakhir
- 17 Jun 2026
- Petunjuk framework
- 2
- Tampilan OpenAgentSkill
- 25
- Salinan pemasangan
- 1
- Klik keluar
- 0
Sinyal komunitas
Bagikan apakah skill ini bermanfaat untuk alur kerja Agent Anda. Masukan gabungan meningkatkan peringkat dari waktu ke waktu.
Kepercayaan & keamanan
Do not auto-install
- Adopsi GitHub4.2K star GitHubLulus
- Aktivitas star/fork4.2K star dan 723 fork; aktivitas issue tidak tersedia dalam metadata saat iniLulus
- Pemeliharaan terbaru2 bulan sejak pushLulus
- Kejelasan lisensiApache-2.0Lulus
- Kelengkapan README/SKILL.mdMetadata memuat konteks penggunaan dan alur kerja yang cukupLulus
- Risiko dependensi/runtimeTidak ada petunjuk risiko dependensi besar dalam metadata publikLulus
Skill terkait
Remove AI Watermarks
AI watermark remover. CLI and Python library to strip visible and invisible AI watermarks (Gemini / Nano Banana sparkle, SynthID) and provenance metadata (C2PA, EXIF, IPTC) from images.
4.3K StarAily Blockly
AI IDE for hardware development, support Arduino, MicroPython, ESP32, STM32, RP2040, Nrf5x...
3.8K StarAliceVision
3D Computer Vision Framework
3.5K StarMaaNTE
MaaNTE. Nevertheless to Everless automatic assistant 异环小助手
2.6K Star