Annuaire de skills

Découvrez des skills réutilisables pour les AI agents.

Recherchez de vrais skills GitHub par tâche et vérifiez Stars, confiance, audit, catégorie et chemin d’installation avant de les utiliser.

Chaque recommandation reste clairement reliée à son dépôt, son audit et son chemin d’installation.

Résultats de recherche: benchmarks

Annuaire en anglais

Benchmarking PDF libraries

337
Stars
62/100
Confiance
Catégorie: document-processingAudit
Cua88

Open-source infrastructure for Computer-Use Agents. Sandboxes, SDKs, and benchmarks to train and evaluate AI agents that can control full desktops (macOS, Linux, Windows).

21K
Stars
88/100
Confiance
Catégorie: automationAudit

#1 Persistent memory for AI coding agents based on real-world benchmarks

23K
Stars
82/100
Confiance
Catégorie: coding-agentsAudit

Open-source evaluation toolkit of large multi-modality models (LMMs), support 220+ LMMs, 80+ benchmarks

4.2K
Stars
85/100
Confiance
Catégorie: robotics-iotAudit

access to david ondrej's personal agent skills

2.7K
Stars
76/100
Confiance
Catégorie: utilityAudit

Awesome-GraphRAG: A curated list of resources (surveys, papers, benchmarks, and opensource projects) on graph-based retrieval-augmented generation.

2.5K
Stars
84/100
Confiance
Catégorie: rag-knowledgeAudit

🏆 Top-1 on 5+ benchmarks | Web UI | Supports MiroThinker, Claude, Kimi, OpenAI

3.0K
Stars
76/100
Confiance
Catégorie: researchAudit

A Claude Code skill that diagnoses social media accounts and analyzes viral content across Chinese platforms (Xiaohongshu, Douyin, Kuaishou, etc.), providing benchmarks, breakdowns, and copywriting drafts.

174
Stars
77/100
Confiance
Catégorie: marketing-growthAudit

Open-source industrial-grade ASR models supporting Mandarin, Chinese dialects and English, achieving a new SOTA on public Mandarin ASR benchmarks, while also offering outstanding singing lyrics recognition capability.

1.9K
Stars
83/100
Confiance
Catégorie: media-automationAudit

Reference implementations of MLPerf® training benchmarks

1.8K
Stars
76/100
Confiance
Catégorie: ml-automationAudit

An Agent Skill helping you to optimize Xcode incremental and clean builds by running benchmarks and optimizing build settings.

1.1K
Stars
80/100
Confiance
Catégorie: agent-skillsAudit

This skill should be used for time series machine learning tasks including classification, regression, clustering, forecasting, anomaly detection, segmentation, and similarity search. Use when working with temporal data, sequential patterns, or time-indexed observations requiring specialized algorithms beyond standard ML approaches. Particularly suited for univariate and multivariate time series analysis with scikit-learn compatible APIs.

34K
Stars
80/100
Confiance
Catégorie: researchAudit