Deep Research Bench
DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents
Asset-Profil
Recherche und Wissensarbeit
Deep research, source comparison, literature review, RAG, knowledge search, and reports.
Szenario
RAG and knowledge
I need my agent to build a RAG workflow over documents and retrieve reliable context.
Agent-Fit
Claude Code + CLI + Codex
Geeignet für Codex, Claude Code, Cursor, CLI oder benutzerdefinierte Agents.
Installieren
Bereit
npx skills add Ayanami0730/deep_research_bench
Wartung
Aktiv
3 Monate seit dem letzten Push
Risiko
Prüfung nötig
Financial research output is not financial advice; require human review before any live investment decision
GitHub-Qualität
753
76/100 Qualität · 79/100 Vertrauen
Abdeckungs-Tags
Review-Notizen
Financial research output is not financial advice; require human review before any live investment decision · Financial research output is not financial advice; require human review before any live investment decision.
Agent-Adoptionskarte
Vertrauen, Audit und Installationsbereitschaft auf einen Blick
Diese Werte kombinieren öffentliche Repository-Metadaten, OpenAgentSkill-Reviewsignale, Wartungsaktualität und Installationsbereitschaft. Sie helfen bei der Vorauswahl, ersetzen aber keine menschliche Prüfung.
Qualität
StarkSolid option that is likely worth shortlisting for production workflows.
Vertrauen
Nur SandboxNützlicher Kandidat mit fehlenden oder gemischten Vertrauenssignalen. Bis der Ergebniszyklus die Passung belegt, in einem isolierten Arbeitsbereich verwenden.
Audit
Prüfung nötigMaschinenlesbare Prüfung von Installationsbereitschaft, Sicherheitsmetadaten, Wartung und Akzeptanzrisiko.
OpenAgentSkill Trust Score v5
Menschliche Prüfung vor Installation
Nur in einer Sandbox ausführen und nahe Alternativen vergleichen, bevor sie produktiv eingesetzt wird.
Stars
753 GitHub-Stars
Repository-Aktivität
753 Stars und 82 Forks
Wartung
3 Monate seit dem letzten Push
Lizenz
Apache-2.0
Installieren
npx skills add Ayanami0730/deep_research_bench
Installationssicherheit
Standard-Paket- oder Laufzeit-Installationspfad
Berechtigungsfläche
Dateisystem- oder Dokumentzugriff
Agent-Ergebnisse
Noch keine Agent-Ergebnisdaten
Dokumentation
Usable metadata, review docs
Risikoübersicht
Vor Produktion prüfen
- Financial research output is not financial advice; require human review before any live investment decision.
- Quality score needs review
Installationsbereitschaft
Installationspfad verfügbar
- Installationspfad ist verfügbar
- Repository-Belege sind verfügbar
- Lizenz ist angegeben
- Noch keine Agent-Proven-Ergebnisbelege
Agent-lesbare Metadaten
Maschinenlesbare Entscheidungsdaten für diesen Skill.
Nutze diesen Block oder das eingebettete JSON, um zu entscheiden, ob ein Agent diesen Skill installieren, eine Alternative wählen oder zuerst menschliche Prüfung anfordern soll.
Geeignete Aufgaben
- RAG and knowledge-Workflows
- Claude-Code-Teams
- Teams, die GitHub-Adoptionssignale schätzen
- Chunk documents
Geeignete Agents
Installationsentscheidung
- Befehl
- npx skills add Ayanami0730/deep_research_bench
- Richtlinie
- Prüfen
- Menschliche Prüfung
- Ja
Vertrauen und Risiko
- Vertrauen
- 71/100
- Audit
- 81/100
- Risikoebene
- Prüfung nötig
Ergebnis-Loop
- Endpoint
- /api/agent/outcome
- Event-ID
- resolve
- Ergebnisse
- 5
Installationsbefehl
npx skills add Ayanami0730/deep_research_benchNicht verwenden, wenn
- Teams, die ein vom Anbieter unterstütztes SLA benötigen
- Hochregulierte Umgebungen ohne interne Sicherheitsprüfung
- No major risk signals from current metadata
- Financial research output is not financial advice; require human review before any live investment decision
- Financial research output is not financial advice; require human review before any live investment decision.
Alternative
Last30days Skill
53.5K Stars
npx skills add mvanhorn/last30days-skill -g
Alternative
Academic Research Skills
38.4K Stars
npx skills add Imbad0202/academic-research-skills
Alternative
GPT Researcher
28.0K Stars
npx skills add assafelovic/gpt-researcher
Alternative
DeepResearch
19.8K Stars
npx skills add Alibaba-NLP/DeepResearch
Agent-Sicherheit v2
65/100 · Vor Installation prüfen
Nutzbarer Kandidat, aber der Agent sollte Berechtigungs- und Auditnotizen vor der Installation anzeigen.
Vor der Installation in einem echten Arbeitsbereich ist menschliche Freigabe erforderlich.
Mittel
Netzwerkzugriff
Die Skill ruft wahrscheinlich Remote-Seiten, APIs, Repositories oder externe Dienste ab.
Mittel
Dateisystemzugriff
Die Skill kann Projektdateien, Dokumente, generierte Artefakte oder den lokalen Arbeitsbereich lesen oder schreiben.
- Financial research output is not financial advice; require human review before any live investment decision
Installationsziele
Diesen Skill im Agent-Workflow installieren
Über den öffentlichen Endpunkt erhältst du Befehl, Sicherheitscheckliste, Ziel-Prompts und kanonische Links.
OpenAgentSkill CLI
Resolve policy, run the source installer safely, and report a verified install receipt.
$ npx --yes https://github.com/Leon-Drq/openagentskill/releases/download/cli-v0.2.1/openagentskill-0.2.1.tgz install ayanami0730-deep-research-benchAgent-Auflösungsplan
Lass einen Agent die Eignung vor der Installation prüfen.
Die Resolve API liefert die beste Skill, Alternativen, Sicherheitsrichtlinien, Auditnotizen, Installationsziel und einen direkt nutzbaren Prompt.
JSON öffnen
/api/agent/resolve?task=Use%20Deep%20Research%20Bench%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Resolve-Text
/api/agent/resolve?task=Use%20Deep%20Research%20Bench%20for%20an%20agent%20workflow&agent=codex&max_risk=medium&format=text
Installationsübergabe
/api/skills/ayanami0730-deep-research-bench/install
Agent sollte prüfen
- Task fit and alternatives from Resolve API.
- Audit score, trust score, and safety policy warnings.
- Install target compatibility for Codex, Claude Code, Cursor, or CLI.
Prompt kopieren
Task: Use Deep Research Bench in this workspace.
Resolve first: https://www.openagentskill.com/api/agent/resolve?task=Use%20Deep%20Research%20Bench%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Review install handoff: https://www.openagentskill.com/api/skills/ayanami0730-deep-research-bench/install
Install command: npx skills add Ayanami0730/deep_research_bench
Before running it, summarize audit warnings, required permissions, and the fallback skill if install is risky.Agent-Übergabe
Gib dem Agent den Installationspfad, nicht noch ein Verzeichnis.
Über den öffentlichen Endpunkt erhältst du Befehl, Sicherheitscheckliste, Ziel-Prompts und kanonische Links.
Installationsübergabe
/api/skills/ayanami0730-deep-research-bench/install
LLM-Textformat
/api/skills/ayanami0730-deep-research-bench/install?format=text
Alternativen finden
/api/skills/search?q=Deep%20Research%20Bench&limit=3
Agent-Prompt
Use Deep Research Bench for this task. Review https://www.openagentskill.com/api/skills/ayanami0730-deep-research-bench/install, then install with: npx skills add Ayanami0730/deep_research_benchRegistry-Metadaten
Agent-lesbares Profil für die automatische Skill-Auswahl.
Die Registry API stellt Entscheidungs-, Vertrauens-, Audit-, Use-Case- und Installationssignale ohne UI-Scraping bereit.
Manifest
/api/registry/manifest/ayanami0730-deep-research-bench
LLM-Text
/api/registry/manifest/ayanami0730-deep-research-bench?format=text
Installationsalias
/api/registry/install/ayanami0730-deep-research-bench
Empfehlen
/api/registry/recommend?task=Use%20Deep%20Research%20Bench%20in%20an%20agent%20workflow&limit=3
Agent-Fit
RAG and knowledge
Use-Case-Tags
Plattformen
Python, Research Agent, Claude Code
Audit-Bericht
Prüfung nötig · 81/100
Maschinenlesbare Prüfung von Installationsbereitschaft, Sicherheitsmetadaten, Wartung und Akzeptanzrisiko.
Agent-Entscheidungspanel
Primäre Wahl für RAG and knowledge
Use this as a leading candidate, then validate the README and install path in your own agent stack.
Rolle im Stack
Primäre Wahl
Primäre Eignung
RAG and knowledge
Vertrauenslabel
Produktionsbereit
Installationspfad
Befehl bereit
Verwenden wenn
- RAG and knowledge-Workflows
- Claude-Code-Teams
- Teams, die GitHub-Adoptionssignale schätzen
Evidenz
- 753 GitHub-Stars
- recent repository activity
- install command or GitHub repo available
- Qualitätsprofil 76/100
- 29 OpenAgentSkill-Interaktionen
zuerst prüfen
- No major risk signals from current metadata
Implementierungspfad
- 1Installieren Sie es in einem Sandbox-Agent und führen Sie eine RAG and knowledge-Aufgabe vollständig aus.
- 2Compare output quality, latency, and failure behavior against at least one alternative.
- 3Promote it into production only after reviewing repository permissions, license, and maintenance signals.
Vertrauensprofil
Nur Sandbox
Nützlicher Kandidat mit fehlenden oder gemischten Vertrauenssignalen. Bis der Ergebniszyklus die Passung belegt, in einem isolierten Arbeitsbereich verwenden.
GitHub-Akzeptanz
Info753 GitHub-Stars
Star-/Fork-Aktivität
Info753 Stars und 82 Forks; Issue-Aktivität ist in den aktuellen Metadaten nicht verfügbar
Aktuelle Wartung
Info3 Monate seit dem letzten Push
Lizenzklarheit
BestandenApache-2.0
Positive Signale
- KI-Prüfung genehmigt
- Installationspfad ist verfügbar
- Repository-Belege sind verfügbar
- Aussagekräftiges GitHub-Adoptionssignal
- Der Installationsbefehl weist kein offensichtliches Hochrisikomuster auf
- Ergebniszyklus ist bereit, benötigt aber den ersten echten Agent-Lauf
Vor Installation prüfen
- Financial research output is not financial advice; require human review before any live investment decision.
- Quality score needs review
- Noch keine echten Agent-Ergebnisberichte
- Vor unbeaufsichtigter Installation ist menschliche Prüfung erforderlich
Empfohlene Aktion
Nur in einer Sandbox ausführen und nahe Alternativen vergleichen, bevor sie produktiv eingesetzt wird.
Qualitätsprofil
Stark Kandidat für Agent-Workflows
Solid option that is likely worth shortlisting for production workflows.
Workflow-Eignung
Diese Skill in diesen Szenarien nutzen
Search private knowledge
RAG and knowledge
I need my agent to build a RAG workflow over documents and retrieve reliable context.
Build and ship code
Coding agents
I need a coding agent that can understand a repository, edit code, and review pull requests.
Investigate faster
Research agents
I need my agent to research a topic, compare sources, and produce a concise report.
Workflow-Eignung
Zum vollständigen Workflow hinzufügen
Ingest, retrieve, and cite
RAG knowledge base
A workflow for document-heavy agents that ingest files, create searchable knowledge, retrieve relevant context, and answer with grounded sources.
Turn skills into distribution
Content growth agent
A workflow for turning newly indexed skills into SEO briefs, social drafts, comparison pages, and reusable publishing workflows.
Inspect, patch, and verify code
Coding review agent
A workflow for software agents that inspect repositories, review pull requests, generate tests, and turn findings into shippable patches.
Alternativen-Shortlist
Vor Installation vergleichen
Similar skills that may fit this task.
Last30days Skill
Research the last 30 days across Reddit, X, YouTube, Hacker News, Polymarket, GitHub, and the web, then synthesize a grounded brief for an AI agent.
Academic Research Skills
Academic Research Skills for Claude Code: research → write → review → revise → finalize
GPT Researcher
Run autonomous deep research over web and local sources
DeepResearch
Tongyi Deep Research, the Leading Open-source Deep Research Agent
Übersicht
DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents
Imported by the skill-only GitHub discovery pipeline because it matches agent skill, automation, domain workflow, RAG, document-processing, data, finance, security, or developer-tool signals. Protocol-server projects are excluded from automated imports.
Plattformkompatibilität
Technische Details
- Version
- 1.0.0
- Lizenz
- Apache-2.0
- Letzte Aktualisierung
- 18. Aug. 2026
- Veröffentlicht
- 14. Juni 2026
Frameworks & Tools
Entscheidungsübersicht
Primäre Wahl
753 GitHub-Stars
Audit
Installationsprüfung
Installations- und Adoptionsprüfung
- Sicherheit
- 88/100
- Wartung
- 76/100
- Installieren
- 92/100
Von Agent belegte Evidenz
Von Agent belegte Evidenz
Ergebnisberichte nach Resolve, Prüfung, Installation und einem begrenzten Lauf.
- Erfolgsrate
- —
- Letzter Fehler
- —
- Ergebnisse
- 0
- Ausgabequalität
- —
- Fehlgeschlagen
- 0
- Nicht relevant
- 0
- Installationen
- 0
- Durch Risiko blockiert
- 0
- Einrichtung erforderlich
- 0
- Produktion
- 0
Noch keine Agent-Ergebnisdaten. Der erste Lauf kann Erfolg, Einrichtungsbedarf, Risikoblockaden, Fehler oder Irrelevanz über /api/agent/outcome melden.
Installieren
Zum Agent-Workflow hinzufügen
Kostenlos und Open Source. Bericht vor der Installation in Produktions-Agents prüfen.
Wachstums-Loop
Share-Kit
Szenariobasierter Entwurf für Deep Research Bench, bereit für einen manuellen X-Post.
Before you hand an agent source-backed research, give it a repeatable starting point. Deep Research Bench: DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents 753 stars https://www.openagentskill.com/skills/ayanami0730-deep-research-bench?ref=x
Optionale Antwort mit Installationsbefehl
Listing + install path for Deep Research Bench: https://www.openagentskill.com/skills/ayanami0730-deep-research-bench?ref=x Install: npx skills add Ayanami0730/deep_research_bench
Quelle des Eintrags
Community-indexiert
Dieser Eintrag wurde aus öffentlichen Quellen indexiert und ist erst nach Genehmigung eines Maintainer-Anspruchs offiziell.
- Ersteller
- Ayanami0730
- Indexiert von
- OpenAgentSkill Community-Index
Die Zuordnung verlinkt auf das öffentliche Repository oder Creator-Profil. Creator können den Eintrag beanspruchen, um Eigentümersignale zu aktualisieren.
Diesen Skill beanspruchenEigentümeranspruch
Diesen Skill-Eintrag beanspruchen
Dieser Community-indexiert-Eintrag wird Ayanami0730 zugeschrieben, ist aber noch nicht offiziell markiert. Beanspruche ihn, um ein verifiziertes Eigentümersignal hinzuzufügen und künftige Launch-, Installations- und Audit-Updates vertrauenswürdiger zu machen.
Creator-Backlink-Kit
Evidenz-Badges in deine README einfügen
Zeige den kanonischen Eintrag, aktuelle Vertrauens- und Audit-Signale sowie echte Agent-Proven-Evidenz dort, wo Entwickler das Repository bewerten.
[](https://www.openagentskill.com/skills/ayanami0730-deep-research-bench)
[](https://www.openagentskill.com/skills/ayanami0730-deep-research-bench)
[](https://www.openagentskill.com/skills/ayanami0730-deep-research-bench/audit)
[](https://www.openagentskill.com/skills/ayanami0730-deep-research-bench)Autor
Ayanami0730
@ayanami0730
Plattform-Fit
Gesundheitssignale
- GitHub-Stars
- 753
- Qualitätswert
- 47/100
- Letzter GitHub-Push
- 11. Mai 2026
- Framework-Hinweise
- 2
- OpenAgentSkill-Aufrufe
- 23
- Installationskopien
- 0
- Externe Klicks
- 0
Community-Signal
Teile mit, ob dieser Skill für deinen Agent-Workflow nützlich ist. Zusammengefasstes Feedback verbessert das Ranking im Laufe der Zeit.
Vertrauen & Sicherheit
Nur Sandbox
- GitHub-Akzeptanz753 GitHub-StarsInfo
- Star-/Fork-Aktivität753 Stars und 82 Forks; Issue-Aktivität ist in den aktuellen Metadaten nicht verfügbarInfo
- Aktuelle Wartung3 Monate seit dem letzten PushInfo
- LizenzklarheitApache-2.0Bestanden
- README/SKILL.md-VollständigkeitÖffentliche Metadaten benötigen mehr README/SKILL.md-KontextInfo
- Abhängigkeits-/LaufzeitrisikoKeine wesentlichen Abhängigkeitsrisikohinweise in öffentlichen MetadatenBestanden
Ähnliche Skills
Last30days Skill
Research the last 30 days across Reddit, X, YouTube, Hacker News, Polymarket, GitHub, and the web, then synthesize a grounded brief for an AI agent.
53.5K StarsAcademic Research Skills
Academic Research Skills for Claude Code: research → write → review → revise → finalize
38.4K StarsGPT Researcher
Run autonomous deep research over web and local sources
28.0K StarsDeepResearch
Tongyi Deep Research, the Leading Open-source Deep Research Agent
19.8K Stars