pdf-extract

Prüfen · 63
Im Registry indexiert

Fast, zero-AI text extraction from PDFs that have a text layer (digitally created PDFs from Word, Typst, WeasyPrint, wkhtmltopdf, LaTeX, etc). Uses pymupdf (fitz) - instant and deterministic. Use when you need to quickly pull raw text from a known text-layer PDF, e.g. "extract te

Verified installs0
Stars83
Version1.0.0
Qualität66/100 · Vielversprechend
Vertrauen63/100 · Nur Sandbox
Audit77/100 · Prüfung nötig

Asset-Profil

Design und kreative Produktion

Design assets, images, video, audio, multimodal media, presentation, and creative production skills.

Bereich ansehen

Szenario

Multimodal media

I need my agent to process images, video, or audio and extract useful information.

Agent-Fit

Claude Code + CLI + Codex

Geeignet für Codex, Claude Code, Cursor, CLI oder benutzerdefinierte Agents.

Installieren

Bereit

npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract

Wartung

Aktuell

1 Tage seit dem letzten Push

Risiko

Prüfung nötig

Dependency or permission surface needs review

GitHub-Qualität

83

66/100 Qualität · 71/100 Vertrauen

Abdeckungs-Tags

DesignMultimodal mediaDesign und Kreativitätagent-skill

Review-Notizen

Dependency or permission surface needs review · Permission surface may require sandboxing

Agent-Adoptionskarte

Vertrauen, Audit und Installationsbereitschaft auf einen Blick

Diese Werte kombinieren öffentliche Repository-Metadaten, OpenAgentSkill-Reviewsignale, Wartungsaktualität und Installationsbereitschaft. Sie helfen bei der Vorauswahl, ersetzen aber keine menschliche Prüfung.

Qualität

Vielversprechend
66

Useful candidate, but compare it with alternatives before adopting.

Vertrauen

Nur Sandbox
63

Nützlicher Kandidat mit fehlenden oder gemischten Vertrauenssignalen. Bis der Ergebniszyklus die Passung belegt, in einem isolierten Arbeitsbereich verwenden.

Audit

Prüfung nötig
77

Maschinenlesbare Prüfung von Installationsbereitschaft, Sicherheitsmetadaten, Wartung und Akzeptanzrisiko.

OpenAgentSkill Trust Score v5

Menschliche Prüfung vor Installation

Nur in einer Sandbox ausführen und nahe Alternativen vergleichen, bevor sie produktiv eingesetzt wird.

CodexClaude CodeCursorOpenAgentSkill CLI

Stars

83 GitHub-Stars

Repository-Aktivität

83 Stars und 11 Forks

Wartung

1 Tage seit dem letzten Push

Lizenz

MIT

Installieren

npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract

Installationssicherheit

Standard-Paket- oder Laufzeit-Installationspfad

Berechtigungsfläche

secrets or environment access, shell or command execution

Agent-Ergebnisse

Noch keine Agent-Ergebnisdaten

Dokumentation

Starker README/SKILL.md-Kontext

Risikoübersicht

Vor Produktion prüfen

  • Quality score needs review
  • Permission surface needs review: secrets or environment access, shell or command execution
  • GitHub adoption: 83 GitHub stars
  • Stars/forks activity: 83 stars, 11 forks; issue activity unavailable in current metadata

Installationsbereitschaft

Installationspfad verfügbar

  • Installationspfad ist verfügbar
  • Repository-Belege sind verfügbar
  • Lizenz ist angegeben
  • Noch keine Agent-Proven-Ergebnisbelege

Agent-lesbare Metadaten

Maschinenlesbare Entscheidungsdaten für diesen Skill.

Nutze diesen Block oder das eingebettete JSON, um zu entscheiden, ob ein Agent diesen Skill installieren, eine Alternative wählen oder zuerst menschliche Prüfung anfordern soll.

JSON öffnen

Geeignete Aufgaben

  • Document processing-Workflows
  • Claude-Code-Teams
  • builders willing to evaluate younger projects
  • Read uploaded files

Geeignete Agents

CodexClaude CodeCursorOpenAgentSkill CLICLI

Installationsentscheidung

Befehl
npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract
Richtlinie
Blockieren
Menschliche Prüfung
Ja

Vertrauen und Risiko

Vertrauen
63/100
Audit
77/100
Risikoebene
Prüfung nötig

Ergebnis-Loop

Endpoint
/api/agent/outcome
Event-ID
resolve
Ergebnisse
5

Installationsbefehl

npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract

Nicht verwenden, wenn

  • Teams, die ein vom Anbieter unterstütztes SLA benötigen
  • Hochregulierte Umgebungen ohne interne Sicherheitsprüfung
  • No major risk signals from current metadata
  • Hinweise auf Hochrisiko-Berechtigungen: Shell or command execution, Secrets or environment access
  • Dependency or permission surface needs review

Agent-Sicherheit v2

33/100 · Automatische Installation vermeiden

Blocked for auto-installBlockieren

This skill should not be selected by an agent without explicit human security review.

Do not auto-install. Inspect the source, dependencies, and permission surface first.

Per API auflösen

Hoch

Shell- oder Befehlsausführung

Die Skill-Metadaten verweisen auf Terminal-, CLI-, Shell-, Subprozess- oder Befehlsausführungs-Workflows.

Mittel

Browser automation

Skill may drive a browser or interact with web pages.

Mittel

Netzwerkzugriff

Die Skill ruft wahrscheinlich Remote-Seiten, APIs, Repositories oder externe Dienste ab.

Mittel

Dateisystemzugriff

Die Skill kann Projektdateien, Dokumente, generierte Artefakte oder den lokalen Arbeitsbereich lesen oder schreiben.

  • Hinweise auf Hochrisiko-Berechtigungen: Shell or command execution, Secrets or environment access
  • Dependency or permission surface needs review

Installationsziele

Diesen Skill im Agent-Workflow installieren

Über den öffentlichen Endpunkt erhältst du Befehl, Sicherheitscheckliste, Ziel-Prompts und kanonische Links.

skill install

OpenAgentSkill CLI

Resolve policy, run the source installer safely, and report a verified install receipt.

$ npx --yes https://github.com/Leon-Drq/openagentskill/releases/download/cli-v0.2.1/openagentskill-0.2.1.tgz install henkisdabro-pdf-extract

Agent-Auflösungsplan

Lass einen Agent die Eignung vor der Installation prüfen.

Die Resolve API liefert die beste Skill, Alternativen, Sicherheitsrichtlinien, Auditnotizen, Installationsziel und einen direkt nutzbaren Prompt.

Textplan öffnen

Agent sollte prüfen

  • Task fit and alternatives from Resolve API.
  • Audit score, trust score, and safety policy warnings.
  • Install target compatibility for Codex, Claude Code, Cursor, or CLI.

Prompt kopieren

Task: Use pdf-extract in this workspace.
Resolve first: https://www.openagentskill.com/api/agent/resolve?task=Use%20pdf-extract%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Review install handoff: https://www.openagentskill.com/api/skills/henkisdabro-pdf-extract/install
Install command: npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract
Before running it, summarize audit warnings, required permissions, and the fallback skill if install is risky.

Agent-Übergabe

Gib dem Agent den Installationspfad, nicht noch ein Verzeichnis.

Über den öffentlichen Endpunkt erhältst du Befehl, Sicherheitscheckliste, Ziel-Prompts und kanonische Links.

Installations-API öffnen

Agent-Prompt

Use pdf-extract for this task. Review https://www.openagentskill.com/api/skills/henkisdabro-pdf-extract/install, then install with: npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract

Registry-Metadaten

Agent-lesbares Profil für die automatische Skill-Auswahl.

Die Registry API stellt Entscheidungs-, Vertrauens-, Audit-, Use-Case- und Installationssignale ohne UI-Scraping bereit.

Manifest öffnen

Agent-Fit

67/100

Document processing

Plattformen

Claude Code

Audit-Bericht

Prüfung nötig · 77/100

Maschinenlesbare Prüfung von Installationsbereitschaft, Sicherheitsmetadaten, Wartung und Akzeptanzrisiko.

Audit-Bericht ansehenEval-Bericht ansehen

Agent-Entscheidungspanel

Fallback candidate for Document processing

Prototype with this skill first; keep a fallback candidate ready.

67
Bereitschaft
Prototyp
Phase

Rolle im Stack

Fallback-Kandidat

Primäre Eignung

Document processing

Vertrauenslabel

Zuerst prototypisieren

Installationspfad

Befehl bereit

Verwenden wenn

  • Document processing-Workflows
  • Claude-Code-Teams
  • builders willing to evaluate younger projects

Evidenz

  • recent repository activity
  • install command or GitHub repo available
  • Qualitätsprofil 66/100
  • 4 OpenAgentSkill-Interaktionen

zuerst prüfen

  • No major risk signals from current metadata

Implementierungspfad

  1. 1Installieren Sie es in einem Sandbox-Agent und führen Sie eine Document processing-Aufgabe vollständig aus.
  2. 2Compare output quality, latency, and failure behavior against at least one alternative.
  3. 3Promote it into production only after reviewing repository permissions, license, and maintenance signals.

Vertrauensprofil

Nur Sandbox

Nützlicher Kandidat mit fehlenden oder gemischten Vertrauenssignalen. Bis der Ergebniszyklus die Passung belegt, in einem isolierten Arbeitsbereich verwenden.

63
OpenAgentSkill Trust Score

GitHub-Akzeptanz

Prüfen

83 GitHub-Stars

Star-/Fork-Aktivität

Prüfen

83 Stars und 11 Forks; Issue-Aktivität ist in den aktuellen Metadaten nicht verfügbar

Aktuelle Wartung

Bestanden

1 Tage seit dem letzten Push

Lizenzklarheit

Bestanden

MIT

Positive Signale

  • KI-Prüfung genehmigt
  • Installationspfad ist verfügbar
  • Repository-Belege sind verfügbar
  • Kürzlich gewartetes Repository
  • Der Installationsbefehl weist kein offensichtliches Hochrisikomuster auf
  • Ergebniszyklus ist bereit, benötigt aber den ersten echten Agent-Lauf

Vor Installation prüfen

  • Quality score needs review
  • Permission surface needs review: secrets or environment access, shell or command execution
  • GitHub adoption: 83 GitHub stars
  • Stars/forks activity: 83 stars, 11 forks; issue activity unavailable in current metadata
  • Dependency/runtime risk: command execution surface, credential or environment access
  • Permission surface: secrets or environment access, shell or command execution
  • Noch keine echten Agent-Ergebnisberichte
  • Vor unbeaufsichtigter Installation ist menschliche Prüfung erforderlich

Empfohlene Aktion

Nur in einer Sandbox ausführen und nahe Alternativen vergleichen, bevor sie produktiv eingesetzt wird.

Qualitätsprofil

Vielversprechend Kandidat für Agent-Workflows

Useful candidate, but compare it with alternatives before adopting.

66
GitHub-Stars
83
Aktualität
vor 1 Tagen
Installationsbereit
Ja
Lizenz
MIT

Workflow-Eignung

Diese Skill in diesen Szenarien nutzen

Workflow-Eignung

Zum vollständigen Workflow hinzufügen

Alternativen-Shortlist

Vor Installation vergleichen

Similar skills that may fit this task.

Alle vergleichen

Übersicht

--- name: pdf-extract description: Fast, zero-AI text extraction from PDFs that have a text layer (digitally created PDFs from Word, Typst, WeasyPrint, wkhtmltopdf, LaTeX, etc). Uses pymupdf (fitz) - instant and deterministic. Use when you need to quickly pull raw text from a known text-layer PDF, e.g. "extract text from this PDF", "read this PDF", "get the content of", "what does this PDF say", "quickly read this PDF". Do NOT use for scanned/image PDFs or when you need structured output (tables, headings, OCR, AI analysis) - use the pdf-processing-pro skill in this plugin for those cases. allowed-tools: Bash, Read, Write ---

# PDF Text Extraction

Extract text from PDF files using pymupdf via `uv run --with pymupdf`.

## Prerequisites

- `uv` installed - see <https://docs.astral.sh/uv/getting-started/installation/> - No venv or pre-installation needed - `uv run --with` handles caching automatically

## Extract text from a single PDF

```bash uv run --with pymupdf python3 -c " import fitz doc = fitz.open('/path/to/file.pdf') for page in doc: text = page.get_text().strip() if text: print(text) print() " ```

## Extract and save to file

```bash uv run --with pymupdf python3 -c " import fitz

doc = fitz.open('/path/to/file.pdf') pages = [] for page in doc: text = page.get_text().strip() if text: pages.append(text)

with open('/path/to/output.txt', 'w') as f: f.write('\n\n'.join(pages))

print(f'Extracted {len(pages)} pages') " ```

## Extract specific pages

```bash uv run --with pymupdf python3 -c " import fitz

doc = fitz.open('/path/to/file.pdf') # Pages are 0-indexed for i in range(2, 5): # Pages 3-5 text = doc[i].get_text().strip() if text: print(text) " ```

## Batch extract from multiple PDFs

```bash uv run --with pymupdf python3 -c " import fitz import glob import os

for pdf_path in glob.glob('/path/to/folder/*.pdf'): doc = fitz.open(pdf_path) text = '\n\n'.join(p.get_text().strip() for p in doc if p.get_text().strip()) out_path = pdf_path.rsplit('.', 1)[0] + '.txt' with open(out_path, 'w') as f: f.write(text) print(f'{os.path.basename(pdf_path)}: {len(doc)} pages extracted') " ```

## Get PDF metadata

```bash uv run --with pymupdf python3 -c " import fitz doc = fitz.open('/path/to/file.pdf') meta = doc.metadata print(f'Title: {meta.get(\"title\", \"N/A\")}') print(f'Author: {meta.get(\"author\", \"N/A\")}') print(f'Pages: {len(doc)}') print(f'Creator: {meta.get(\"creator\", \"N/A\")}') " ```

## Key notes

- pymupdf is imported as `fitz` (legacy naming from the MuPDF library) - Pages are 0-indexed: `doc[0]` is the first page - `get_text()` returns plain text; use `get_text("blocks")` for positioned blocks - `get_text("html")` returns HTML with formatting preserved - The package caches after the first `uv run --with pymupdf` invocation - subsequent runs are instant

## When to use this vs pdf-processing-pro

| Use pdf-extract | Use pdf-processing-pro | |---|---| | PDF created digitally (Word, Typst, LaTeX, wkhtmltopdf, WeasyPrint) | Scanned or image-based PDF (photo, fax, scan) | | Need raw text quickly - less than a second | Need structured output: tables, headings, forms | | Bulk/batch extraction without AI cost | OCR required (scanned documents) | | Offline, no API key, no extra dependencies | Form filling, validation, batch workflows | | Simple text content, no tables needed | Tables or structured layout are important |

Technische Details

Version
1.0.0
Lizenz
MIT
Letzte Aktualisierung
21. Aug. 2026
Veröffentlicht
21. Aug. 2026

Entscheidungsübersicht

Fallback-Kandidat

67
Bereit
Prototyp
Phase

recent repository activity

Audit

Installationsprüfung

Installations- und Adoptionsprüfung

77
Prüfung nötig
Sicherheit
76/100
Wartung
100/100
Installieren
92/100
Vollständiges Audit öffnenEval-Bericht ansehen

Von Agent belegte Evidenz

Von Agent belegte Evidenz

Ergebnisberichte nach Resolve, Prüfung, Installation und einem begrenzten Lauf.

0
Belegt
Needs first agent runAuto-Installation: zuerst prüfenLetzter: Unbekannt
Erfolgsrate
Letzter Fehler
Ergebnisse
0
Ausgabequalität
Fehlgeschlagen
0
Nicht relevant
0
Installationen
0
Durch Risiko blockiert
0
Einrichtung erforderlich
0
Produktion
0

Noch keine Agent-Ergebnisdaten. Der erste Lauf kann Erfolg, Einrichtungsbedarf, Risikoblockaden, Fehler oder Irrelevanz über /api/agent/outcome melden.

Installieren

Zum Agent-Workflow hinzufügen

Kostenlos und Open Source. Bericht vor der Installation in Produktions-Agents prüfen.

Wachstums-Loop

Share-Kit

X

Szenariobasierter Entwurf für pdf-extract, bereit für einen manuellen X-Post.

Kuratorenhinweis
pdf-extract: Fast, zero-AI text extraction from PDFs that have a text layer (digitally created PDFs from W...

83 stars

https://www.openagentskill.com/skills/henkisdabro-pdf-extract?ref=x
X-Entwurf öffnen
Optionale Antwort mit Installationsbefehl
Listing + install path for pdf-extract:
https://www.openagentskill.com/skills/henkisdabro-pdf-extract?ref=x

Install: npx skills add henkisdabro/wookstar-claude-plugins --skill pdf-extract
Antwortentwurf öffnen

Quelle des Eintrags

Registry-indexiert

Beanspruchbar

Dieser Eintrag wurde aus öffentlichen Quellen indexiert und ist erst nach Genehmigung eines Maintainer-Anspruchs offiziell.

Ersteller
henkisdabro
Indexiert von
OpenAgentSkill Community-Index

Die Zuordnung verlinkt auf das öffentliche Repository oder Creator-Profil. Creator können den Eintrag beanspruchen, um Eigentümersignale zu aktualisieren.

Diesen Skill beanspruchen

Eigentümeranspruch

Diesen Skill-Eintrag beanspruchen

Dieser Registry-indexiert-Eintrag wird henkisdabro zugeschrieben, ist aber noch nicht offiziell markiert. Beanspruche ihn, um ein verifiziertes Eigentümersignal hinzuzufügen und künftige Launch-, Installations- und Audit-Updates vertrauenswürdiger zu machen.

Creator-Backlink-Kit

Evidenz-Badges in deine README einfügen

Zeige den kanonischen Eintrag, aktuelle Vertrauens- und Audit-Signale sowie echte Agent-Proven-Evidenz dort, wo Entwickler das Repository bewerten.

[![Listed on OpenAgentSkill](https://www.openagentskill.com/api/badge/henkisdabro-pdf-extract?metric=listed&label=Listed)](https://www.openagentskill.com/skills/henkisdabro-pdf-extract)
[![OpenAgentSkill Trust](https://www.openagentskill.com/api/badge/henkisdabro-pdf-extract?metric=trust&label=Trust)](https://www.openagentskill.com/skills/henkisdabro-pdf-extract)
[![OpenAgentSkill Audit](https://www.openagentskill.com/api/badge/henkisdabro-pdf-extract?metric=audit&label=Audit)](https://www.openagentskill.com/skills/henkisdabro-pdf-extract/audit)
[![Agent Proven](https://www.openagentskill.com/api/badge/henkisdabro-pdf-extract?metric=proven&label=Agent%20Proven)](https://www.openagentskill.com/skills/henkisdabro-pdf-extract)

Autor

H

henkisdabro

@henkisdabro

Plattform-Fit

Gesundheitssignale

GitHub-Stars
83
Qualitätswert
37/100
Letzter GitHub-Push
21. Aug. 2026
Framework-Hinweise
Unbekannt
OpenAgentSkill-Aufrufe
4
Installationskopien
0
Externe Klicks
0

Community-Signal

Teile mit, ob dieser Skill für deinen Agent-Workflow nützlich ist. Zusammengefasstes Feedback verbessert das Ranking im Laufe der Zeit.

Vertrauen & Sicherheit

Nur Sandbox

63
  • GitHub-Akzeptanz83 GitHub-StarsPrüfen
  • Star-/Fork-Aktivität83 Stars und 11 Forks; Issue-Aktivität ist in den aktuellen Metadaten nicht verfügbarPrüfen
  • Aktuelle Wartung1 Tage seit dem letzten PushBestanden
  • LizenzklarheitMITBestanden
  • README/SKILL.md-VollständigkeitMetadaten enthalten ausreichend Nutzungs- und Workflow-KontextBestanden
  • Abhängigkeits-/Laufzeitrisikocommand execution surface, credential or environment accessPrüfen