Zurück zum Blog

OCR für Tabellen: Gescannte PDFs in Excel oder CSV umwandeln

DocToTable Team
3 Min. Lesezeit
ocrscanexcelcsvanleitung

PDFs in Sekunden in Tabellen umwandeln

Keine Anmeldung. Präzise Extraktion. Sofort als CSV oder Excel exportieren.

Kurzantwort

Wenn sich Text in einem PDF nicht markieren lässt, besteht die Seite meist aus einem Bild und benötigt OCR. Gute Ausgangsbedingungen sind eine gerade Seite, deutlicher Kontrast und ungefähr 300 DPI. Prüfen Sie danach in der Vorschau und im Export besonders Zahlen, Satzzeichen und Spaltenzuordnung.

PDFs in Sekunden in Tabellen umwandeln

Keine Anmeldung. Präzise Extraktion. Sofort als CSV oder Excel exportieren.

Wann ist OCR erforderlich?

OCR (optische Zeichenerkennung) wird benötigt, wenn ein PDF keinen nutzbaren Text enthält. Typische Hinweise sind:

  • Beim Markieren wird die ganze Seite statt einzelner Wörter ausgewählt.
  • Das Dokument ist ein Scan oder Foto.
  • Buchstabenränder wirken unscharf oder gezackt.
  • Schatten, schiefe Seiten oder Papierstrukturen sind sichtbar.

Ein natives PDF enthält dagegen meist auswählbaren Text und scharfe, gleichmäßige Schrift. Für den allgemeinen Ablauf lesen Sie PDF-Tabellen in Excel umwandeln.

Scanqualität verbessern

Die OCR kann nur Informationen erkennen, die im Bild ausreichend deutlich sind. Achten Sie auf:

  • Auflösung: Etwa 300 DPI sind für gedruckte Dokumente ein sinnvoller Ausgangspunkt.
  • Ausrichtung: Gerade Seiten verhindern, dass Zeilen und Spalten optisch zusammenlaufen.
  • Kontrast: Dunkler Text auf hellem Hintergrund ist leichter zu erkennen.
  • Beleuchtung: Vermeiden Sie Schatten, Reflexionen und ungleichmäßiges Licht.
  • Layout: Stempel, handschriftliche Notizen oder Wasserzeichen können Tabellenzellen überdecken.

Wenn die Vorschau unbrauchbar ist, verbessern Sie möglichst die Quelldatei, statt fehlerhafte Daten im Tabellenprogramm mühsam zu reparieren.

So verarbeitet DocToTable gescannte Tabellen

DocToTable liest die gescannte Seite per OCR und erkennt anschließend die Tabellenstruktur samt Zeilen und Spalten automatisch. Vor dem Export sehen Sie eine Vorschau. Notwendige Änderungen nehmen Sie nach dem Download vor.

Die Ausgabe steht als Excel-Datei (.xlsx) oder CSV zur Verfügung. Ohne Anmeldung können Sie drei begrenzte Browser-Vorschauen mit jeweils den ersten zwei Seiten nutzen. Das Kontingent ist endlich und wird nicht täglich zurückgesetzt. Berechtigte Konten können einmalig zehn Seitenguthaben erhalten.

Schritt für Schritt

  1. Öffnen Sie DocToTable auf Deutsch und laden Sie ein PDF hoch.
  2. Warten Sie, bis OCR und Tabellenerkennung abgeschlossen sind.
  3. Prüfen Sie die Vorschau auf erkennbare Spalten, Überschriften und Kontrollwerte.
  4. Exportieren Sie als Excel oder CSV.
  5. Vergleichen Sie das Ergebnis mit dem Original und korrigieren Sie es bei Bedarf im Tabellenprogramm.

Pro Upload wird ein PDF verarbeitet. Für mehrere Dateien wiederholen Sie den Ablauf einzeln.

Qualitätskontrolle vor und nach dem Export

In der Vorschau

  • Prüfen Sie ähnliche Zeichen wie 0 und O, 1 und l.
  • Kontrollieren Sie Dezimaltrennzeichen, Minuszeichen und Währungssymbole.
  • Achten Sie darauf, ob zusammengehörige Werte in derselben Spalte stehen.

Im Tabellenprogramm

  • Vergleichen Sie Summen und Salden mit dem PDF.
  • Zählen Sie Positionen oder Datensätze.
  • Suchen Sie nach wiederholten Kopf- und Fußzeilen.
  • Prüfen Sie Datum, Währung und Dezimalformat.

Bei mehrseitigen Dokumenten hilft zusätzlich der Leitfaden Mehrseitige PDF-Tabellen in Excel umwandeln.

Häufige Fragen

Funktioniert OCR auch bei Fotos?

Bildbasierte PDFs können verarbeitet werden. Perspektive, Schatten und geringe Auflösung verschlechtern jedoch die Erkennung; ein gerader Scan ist meist die bessere Quelle.

Ist 300 DPI zwingend erforderlich?

Nein. Es ist ein praktischer Richtwert, keine Garantie. Entscheidend ist, ob Zeichen und Tabellenstruktur deutlich sichtbar sind.

Kann ich gescannte Tabellen als CSV exportieren?

Ja. CSV eignet sich für Skripte und Importe; Excel ist oft angenehmer für manuelle Prüfung und Formatierung.

Wie werden hochgeladene Dateien verarbeitet?

Verbindliche Informationen dazu finden Sie in der deutschen Datenschutzerklärung. Vermeiden Sie pauschale Annahmen über Speicherung oder Löschung und prüfen Sie die dort beschriebenen Bedingungen.

Gescannte Tabelle ausprobieren

Laden Sie ein repräsentatives PDF hoch, prüfen Sie die erkannten Werte und vergleichen Sie den Export mit dem Original.

PDFs in Sekunden in Tabellen umwandeln

Keine Anmeldung. Präzise Extraktion. Sofort als CSV oder Excel exportieren.

PDFs in Sekunden in Tabellen umwandeln

Keine Anmeldung. Präzise Extraktion. Sofort als CSV oder Excel exportieren.

OCR für Tabellen: Gescannte PDFs in | Blog | DocToTable