Grundlagen · KI und IT für konkrete Arbeitsaufgaben
Wie wird ein gescanntes Dokument für KI lesbar?
Kurz gesagt
Ein Scan ist für den Computer zunächst nur ein Bild aus Punkten. Erst die Texterkennung, abgekürzt OCR, verwandelt diese Punkte in echten, durchsuchbaren Text. Ist der Scan schief, unscharf oder handschriftlich, entstehen dabei Lesefehler, die die KI dann übernimmt.
Das Problem
Sie haben einen Brief der Steuerverwaltung eingescannt und möchten ihn von der KI zusammenfassen lassen. Die Antwort ist seltsam: Beträge stimmen nicht, ein Datum fehlt, oder die KI meldet, sie finde keinen Text in der Datei.
Das liegt meist nicht an der KI selbst, sondern am Scan. Für den Computer ist ein eingescanntes Blatt zunächst ein Foto. Er sieht helle und dunkle Punkte, aber keine Buchstaben.
Besonders ärgerlich ist das, wenn die Fehler nicht auffallen. Wird aus «CHF 1'850» beim Lesen «CHF 1'350», klingt die Zusammenfassung trotzdem glaubwürdig. Wer dann auf diese Zahl hin handelt, hat ein Problem.
Einfach erklärt
OCR steht für «Optical Character Recognition», auf Deutsch optische Zeichenerkennung oder kurz Texterkennung. Ein Programm untersucht das Bild, erkennt die Formen von Buchstaben und Ziffern und schreibt sie als echten Text in die Datei.
Danach ist das Dokument durchsuchbar: Sie können Wörter markieren, kopieren und mit der Suchfunktion finden. Genau diesen Text braucht eine KI, um sicher damit zu arbeiten.
Es gibt zwei Wege, wie Text aus einem Scan in die KI gelangt:
| Weg | Wie es funktioniert | Stärken und Schwächen |
|---|---|---|
| Klassische OCR vorab | Scanner-App oder PDF-Programm erkennt den Text, dann laden Sie die Datei hoch | zuverlässig bei sauberem Druck, Ergebnis vorab kontrollierbar |
| KI liest das Bild direkt | Moderne KI-Chats mit Bilderkennung schauen das Bild selbst an | bequem, kommt mit Tabellen oft gut zurecht, kann aber Unleserliches erraten |
So erkennen Sie, ob ein PDF bereits Text enthält: Öffnen Sie es und versuchen Sie, ein Wort mit der Maus zu markieren. Lässt es sich markieren und kopieren, ist Text vorhanden. Wird stattdessen ein Rechteck über die ganze Seite gezogen, ist es nur ein Bild.
So lösen Sie es mit KI – Schritt für Schritt
So machen Sie ein Papierdokument für die KI gut lesbar:
- Gut scannen: Legen Sie das Blatt gerade auf den Scanner oder fotografieren Sie es bei Tageslicht von oben, ohne Schatten. Eine Auflösung von 300 dpi ist für Text ein bewährter Wert.
- Scanner-App mit Texterkennung nutzen: Viele Smartphone-Apps, etwa die Scanfunktion in Notizen- oder Office-Apps, erstellen durchsuchbare PDF. Achten Sie auf Optionen wie «Text erkennen» oder «OCR».
- Markiertest machen: Öffnen Sie das PDF und markieren Sie ein Wort. Klappt das, ist Text vorhanden.
- Vertrauliches schwärzen: Decken Sie AHV-Nummer, Kontonummern und Namen ab, bevor Sie die Datei hochladen, sofern Sie sie für Ihre Frage nicht brauchen. Echte Schwärzung entfernt den Text, ein schwarzer Balken darüber allein reicht in PDF nicht immer.
- Hochladen und zuerst abschreiben lassen: Bitten Sie die KI, den erkannten Text zunächst Wort für Wort wiederzugeben. So sehen Sie, was sie tatsächlich gelesen hat.
- Unsichere Stellen markieren lassen: Verlangen Sie, dass die KI unleserliche Stellen kennzeichnet, statt zu raten. Die Vorlage unten hilft dabei.
- Mit dem Original vergleichen: Kontrollieren Sie Beträge, Fristen und Namen am Papier.
- Erst dann auswerten: Lassen Sie die KI erst jetzt zusammenfassen oder Fragen beantworten. Wie das geht, zeigt Fragen an ein Dokument stellen.
Vorlage zum Kopieren
Ich lade einen eingescannten [Dokumenttyp, z. B. Brief der Gemeinde] hoch.
1. Gib zuerst den erkannten Text vollständig wieder.
2. Markiere jede Stelle, die du nicht sicher lesen kannst, mit [unleserlich] statt zu raten.
3. Liste alle Zahlen, Beträge und Daten separat in einer Tabelle auf.
4. Fasse danach in [Anzahl] einfachen Sätzen zusammen, was von mir verlangt wird und bis wann.Ersetzen Sie Dokumenttyp und Anzahl Sätze; bei mehrseitigen Scans lohnt es sich, Seite für Seite vorzugehen.
Worauf Sie achten müssen
- Handschrift ist schwierig: Moderne KI kann Handschrift oft erstaunlich gut lesen, irrt sich aber gerade bei Zahlen und Namen. Prüfen Sie hier besonders sorgfältig.
- Zahlen verwechseln: Typische Verwechslungen sind 1 und 7, 3 und 8, 0 und O. Bei Schweizer Beträgen mit Apostroph kann zudem die Tausendertrennung verloren gehen.
- Tabellen und Spalten: Zweispaltige Briefe oder Formulare werden manchmal in falscher Reihenfolge gelesen. Dann vermischen sich Absätze.
- Datenschutz: Gescannte Dokumente enthalten oft viele Personendaten. Nutzen Sie nur Werkzeuge, die Ihr Betrieb freigegeben hat, und laden Sie nur hoch, was nötig ist.
- Dateigrösse: Sehr grosse Scans werden von manchen Diensten abgelehnt. Mehr zu Formaten und Grenzen erklärt Warum kann die KI meine Datei nicht lesen?.
Ein Beispiel aus der Praxis
Ein Beispiel: Ein Treuhandbüro in Aarau erhielt von einem Kunden einen Stapel fotografierter Quittungen. Die KI sollte daraus eine Spesenliste erstellen.
Vorher lud die Mitarbeiterin die schiefen Handyfotos direkt hoch. In der Liste fehlten zwei Belege, und ein Betrag war falsch. Nachher fotografierte sie die Quittungen neu, gerade und gut belichtet, liess die KI zuerst den Text wiedergeben und unsichere Stellen markieren. Die Liste war vollständig, und die zwei markierten Beträge prüfte sie am Original.
So hilft Ihnen Alpasana
Wenn Sie regelmässig mit Belegen, Briefen und Formularen arbeiten, bietet absofort praxisnahe Kurse zu KI und IT für konkrete Arbeitsaufgaben. Dazu gehören zum Beispiel die Vorbereitung von Buchhaltungsunterlagen und die Bürokommunikation mit KI.
Sie üben an konkreten Aufgaben, wie Sie KI verantwortungsvoll einsetzen und die Ergebnisse prüfen. Ein KI-Lerncoach begleitet Sie, und Ihren Abschluss können Sie mit einem verifizierbaren Nachweis zeigen.
Häufige Fragen
Brauche ich ein spezielles Programm für OCR?
Nicht unbedingt. Viele Scanner, Smartphone-Apps und PDF-Programme haben die Texterkennung bereits eingebaut. Suchen Sie in den Einstellungen nach «Text erkennen» oder «durchsuchbares PDF».
Kann ich ein Foto statt eines Scans verwenden?
Ja, wenn das Foto scharf, gerade und gut belichtet ist. Achten Sie darauf, dass das ganze Blatt zu sehen ist und keine Finger oder Schatten den Text verdecken.
Funktioniert OCR auch mit Fraktur oder alten Dokumenten?
Teilweise. Alte Schriften und vergilbtes Papier führen zu mehr Fehlern. Für historische Dokumente gibt es spezialisierte Programme, und eine Kontrolle durch einen Menschen bleibt nötig.
Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.
Weiterlesen in der Galaxie
- Warum kann die KI meine Datei nicht lesen?KI Datei nicht lesbar? Checkliste zu Dateiformaten, Grösse, Passwortschutz und Scans – so finden Sie die Ursache für Uploadprobleme und lösen sie selbst.
- Wie stelle ich der KI Fragen zu einem eigenen Dokument?KI Fragen zu Dokument stellen: So finden Sie in langen Unterlagen gezielt die richtige Textstelle, mit Zitat und Seitenangabe zum Nachprüfen im Original.
- Was kann Mistral OCR mit gescannten Dokumenten?Mistral OCR einfach erklärt: Wie Texterkennung gescannte PDF und Tabellen in weiterverarbeitbaren Text überführt und wo Kontrolle nötig bleibt.
- Kann ChatGPT meine PDF lesen und erklären?ChatGPT PDF lesen lassen: So laden Sie einen langen Bericht hoch, lassen ihn verständlich erklären und prüfen die Zusammenfassung mit Seitenangaben.
- Welche Daten kann KI verarbeiten?Strukturierte und unstrukturierte Daten einfach erklärt: Ob Tabellen, Briefe, PDFs und Fotos für KI nutzbar sind und wie Sie Ihre Unterlagen sinnvoll vorbereiten.