Skip to content

Latest commit

 

History

6 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 

Repository files navigation

PDF Allrounder

Status ChatGPT Skill Language Formats

Ein deutschsprachiger ChatGPT Skill zum Lesen, Erstellen, Bearbeiten, Prüfen, Erkennen und Konvertieren von PDF-Dateien. Der PDF Allrounder legt besonderen Wert auf Layouttreue, bearbeitbare Inhalte und eine visuelle Qualitätskontrolle vor der Auslieferung.

Inhaltsverzeichnis

Überblick

Der PDF Allrounder übernimmt vollständige PDF-Workflows in ChatGPT. Er kann Dokumente analysieren, neue PDFs erzeugen, bestehende Dateien bearbeiten, Scans per OCR durchsuchbar machen und Inhalte zwischen mehreren Dateiformaten konvertieren.

Der Skill behält standardmäßig die Sprache des Quelldokuments bei. Falls eine Konvertierung unterschiedliche Ergebnisse für Optik und Bearbeitbarkeit erzeugen würde, erkennt der Skill diese Entscheidung und fragt nur dann nach, wenn sie das Resultat wesentlich verändert.

Features

  • PDF-Dateien lesen, analysieren und zusammenfassen
  • Professionell formatierte PDFs erstellen
  • PDFs zusammenführen, teilen, drehen, beschneiden und neu anordnen
  • Text, Tabellen, Bilder, Metadaten und Lesezeichen extrahieren
  • Gescannte Dokumente mit OCR durchsuchbar machen
  • PDF-Formulare und einfache PDF-Elemente bearbeiten
  • Kopfzeilen, Fußzeilen, Seitennummern und Wasserzeichen hinzufügen
  • Dateien in PDF und aus PDF zurückkonvertieren
  • Finale PDF-Seiten rendern und visuell kontrollieren
  • Quellen schützen und Ergebnisse als neue Dateien ausgeben

Unterstützte Formate

Format In PDF konvertieren Aus PDF konvertieren Hinweise
Word / DOCX Ja Ja Layout oder Bearbeitbarkeit priorisieren
Excel / XLSX Ja Ja Rückkonvertierung nur für erkannte Tabellen
PowerPoint / PPTX Ja Ja Originalgetreue oder bearbeitbare Folien möglich
JPG / PNG Ja Ja Auflösung und Seitenformat werden geprüft
TXT Ja Ja Struktur und Lesereihenfolge können abweichen
Markdown Ja Ja Tabellen, Codeblöcke und Links werden geprüft
HTML Ja Ja Druck-CSS und Seitenumbrüche werden berücksichtigt

Schnellstart

1. Skill aufrufen

@manage-pdf-files

2. Datei hinzufügen

Lade die gewünschte PDF-, Word-, Excel-, PowerPoint-, Bild-, Text-, Markdown- oder HTML-Datei in ChatGPT hoch.

3. Aufgabe beschreiben

@manage-pdf-files Konvertiere diese PDF in eine bearbeitbare Word-Datei. Behalte Überschriften, Tabellen und Bilder so gut wie möglich bei.

Für bessere Ergebnisse kannst du zusätzlich das Zielformat, die gewünschte Sprache, die Seitengröße und die Priorität zwischen Layouttreue und Bearbeitbarkeit angeben.

Beispiele

PDF in Word konvertieren
@manage-pdf-files Konvertiere diese PDF in eine bearbeitbare DOCX-Datei. Übernimm Tabellen, Bilder und Überschriften.
Word in PDF konvertieren
@manage-pdf-files Erstelle aus dieser Word-Datei eine druckfertige PDF und prüfe alle Seiten visuell.
Gescannte PDF mit OCR erkennen
@manage-pdf-files Mache diese gescannte deutsche PDF durchsuchbar. Prüfe Namen, Zahlen und Datumsangaben besonders sorgfältig.
Mehrere PDFs zusammenführen
@manage-pdf-files Führe diese PDF-Dateien in der hochgeladenen Reihenfolge zusammen und füge fortlaufende Seitenzahlen ein.
PDF in PowerPoint umwandeln
@manage-pdf-files Konvertiere diese PDF in PowerPoint. Die Folien sollen optisch möglichst genau dem Original entsprechen.
Tabellen nach Excel übertragen
@manage-pdf-files Extrahiere alle Tabellen aus dieser PDF in eine Excel-Datei. Prüfe Zahlen, Spalten und Einheiten mit der Quelle.

So arbeitet der Skill

flowchart TD
    A[Datei und Aufgabe prüfen] --> B{Konvertierung nötig?}
    B -- Nein --> C[PDF lesen oder bearbeiten]
    B -- Ja --> D{Optik oder Bearbeitbarkeit?}
    D --> E[Passende Methode wählen]
    C --> F[Ergebnis erzeugen]
    E --> F
    F --> G[Seiten rendern]
    G --> H{Fehler sichtbar?}
    H -- Ja --> F
    H -- Nein --> I[Finale Datei liefern]
Loading
  1. Aufgabe, Quelldatei und Zielformat bestimmen
  2. PDF-Seiten und Dokumentstruktur untersuchen
  3. Passende Bearbeitungs- oder Konvertierungsmethode auswählen
  4. Ergebnis als neue Datei erzeugen
  5. Finale Seiten rendern und visuell kontrollieren
  6. Sichtbare oder inhaltliche Fehler korrigieren
  7. Ergebnis mit kurzen Hinweisen zu unvermeidbaren Abweichungen ausgeben

Layouttreue oder Bearbeitbarkeit

Eine PDF speichert vor allem das fertige Seitenbild. Die ursprüngliche Absatz-, Tabellen-, Folien- oder Zellenstruktur ist darin häufig nicht mehr vollständig enthalten.

Priorität Ergebnis Vorteil Möglicher Nachteil
Originalgetreue Optik Seiten oder Elemente werden möglichst exakt übernommen Sehr hohe visuelle Übereinstimmung Inhalte können teilweise nur als Bild vorliegen
Bearbeitbare Inhalte Texte, Tabellen und Elemente werden rekonstruiert Inhalte lassen sich weiterbearbeiten Kleine Layoutabweichungen sind möglich

Tip

Gib in deiner Anfrage ausdrücklich an, ob dir originalgetreue Optik oder bearbeitbare Inhalte wichtiger sind.

Projektstruktur

manage-pdf-files/
├── SKILL.md
├── agents/
│   └── openai.yaml
├── assets/
│   └── icon.svg
└── references/
    └── conversion-matrix.md
Datei Aufgabe
SKILL.md Enthält Trigger, Arbeitsablauf und Qualitätsregeln
agents/openai.yaml Enthält die Darstellung des Skills in ChatGPT
assets/icon.svg Enthält das Skill-Icon
references/conversion-matrix.md Ordnet Formate, Methoden und Prüfungen zu

Note

Diese README ist die öffentliche Projektdokumentation. Sie gehört bei einer GitHub-Veröffentlichung in das Stammverzeichnis des Repositories, ist aber kein Bestandteil des installierbaren Skill-Pakets.

Qualitätsstandard

Vor der Auslieferung prüft der Skill insbesondere:

  • abgeschnittenen oder überlappenden Text
  • falsche Seitenreihenfolge
  • unerwartete leere Seiten
  • unlesbare Tabellen und fehlerhafte Zahlen
  • unscharfe oder verzerrte Bilder
  • falsche Glyphen, Umlaute und Sonderzeichen
  • fehlende Kopfzeilen, Fußzeilen oder Seitennummern
  • OCR-Fehler bei Namen, Zahlen und Datumsangaben
  • Unterschiede zwischen Quelle und Ergebnis

Einschränkungen

Important

Eine Rückkonvertierung aus PDF ist nicht immer vollständig verlustfrei. Der Skill nennt unvermeidbare Unterschiede transparent.

  • PowerPoint-Animationen können in einer PDF nicht erhalten bleiben.
  • Komplexe Tabellen müssen nach der Extraktion gegebenenfalls nachgearbeitet werden.
  • Digitale Signaturen können durch Änderungen ungültig werden.
  • Interaktive Formulare, Ebenen und Barrierefreiheits-Tags benötigen unter Umständen besondere Bearbeitung.
  • OCR kann bei schlechter Scanqualität, Handschrift oder ungewöhnlichen Schriften unsicher sein.

Sicherheit

  • Quelldateien werden nicht überschrieben.
  • Passwortschutz und Zugriffsbeschränkungen werden nicht umgangen.
  • Es werden nur vom Benutzer bereitgestellte Berechtigungen verwendet.
  • Unsichere OCR-Ergebnisse werden gekennzeichnet und nicht erfunden.
  • Interne Werkzeughinweise und Platzhalter werden aus finalen Dateien entfernt.

Mitwirken

Verbesserungsvorschläge und neue Anwendungsfälle sind willkommen.

  1. Beschreibe das Problem oder den gewünschten PDF-Workflow nachvollziehbar.
  2. Füge nach Möglichkeit eine anonymisierte Beispieldatei hinzu.
  3. Erkläre das erwartete Ergebnis und die gewünschte Qualitätsprüfung.
  4. Vermeide sensible oder urheberrechtlich geschützte Testdaten ohne Erlaubnis.

Lizenz

Für dieses Projekt ist derzeit keine öffentliche Lizenz festgelegt. Füge vor einer öffentlichen Weitergabe eine passende LICENSE-Datei hinzu, zum Beispiel die MIT License, Apache License 2.0 oder eine eigene Lizenz.


Wenn dir der Skill hilft, kannst du das Repository mit einem Star markieren oder die Dokumentation mit anderen teilen.

About

Ein deutschsprachiger ChatGPT Skill zum Lesen, Erstellen, Bearbeiten, Prüfen, Erkennen und Konvertieren von PDF-Dateien – mit OCR, zahlreichen Dateiformaten und visueller Qualitätskontrolle.

Topics

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors