Text aus einem Bild auslesen
Die KI liest den Text in einem Foto, einem Screenshot oder einem Scan und macht daraus Text, den du bearbeiten kannst. Korrigiere ihn und kopiere ihn dann oder speichere ihn als Textdatei. Das Bild wird nur auf diesem Gerät gelesen.
- Kostenlos
- Kein Upload
- Keine Anmeldung
- Funktioniert offline
So geht’s
Drücke auf „Datei wählen“ und suche ein Bild mit Text aus. Die KI liest seinen Text.
Vergleiche den Text mit dem Bild. Falsch gelesenen Text kannst du direkt dort korrigieren.
Drücke auf „Kopieren“, um den Text in eine andere App einzufügen, oder auf „Speichern“, um ihn als Textdatei (text.txt) zu speichern.
Häufige Fragen
Wird mein Bild irgendwohin gesendet?
Nein. Auch die KI, die den Text liest, läuft auf deinem Gerät. Beim ersten Mal werden die Bausteine der KI (etwa 43 MB) von der TEMOTO-Website geladen, aber nachdem du ein Bild gewählt hast, wird nichts nach außen gesendet.
Welche Sprachen kann es lesen?
Japanisch (Hiragana, Katakana und Kanji, auch vertikal geschrieben) und Englisch. Es liest auch chinesische Schriftzeichen und Buchstaben mit Akzent (Französisch, Deutsch und andere), getestet wurden damit aber nur kurze Texte. Koreanisch, Russisch, Thai, Arabisch und andere Schriften kann es nicht lesen. Stehen solche Zeichen in einer Zeile mit Japanisch oder Englisch, werden sie eventuell weggelassen oder als andere Zeichen gelesen, ohne Warnung.
Wie genau ist es?
In den Testbildern wurden bei gedrucktem waagerechtem Text etwa 4 von 1.000 Zeichen falsch gelesen, bei vertikal geschriebenem Japanisch etwa 16 von 1.000. Sehr kleine oder unscharfe Schrift wird häufiger falsch gelesen (etwa 17 von 100 Zeichen bei Buchstaben von 6 Pixeln Höhe). Vergleiche den Text mit dem Bild, bevor du ihn verwendest.
Kann es Handschrift lesen?
Mit echter Handschrift wurde es nicht getestet. Handgeschriebener Text wird eventuell häufiger falsch oder gar nicht gelesen.
Was ist mit Tabellen und Text in Spalten?
Der Text wird gelesen, aber Zeilen können in der falschen Reihenfolge erscheinen. Text nebeneinander, etwa die Artikel und Preise auf einem Kassenbon, wird als eine Zeile gelesen. Prüfe nach dem Lesen die Reihenfolge.
Kann es große Bilder lesen?
Ein Bild, dessen längere Seite mehr als 3.200 Pixel hat, wird vor dem Lesen auf 3.200 Pixel verkleinert. Wurde kleine Schrift übersehen, versuche ein Bild, das auf den Teil zugeschnitten ist, den du lesen möchtest.
Kann ich es auf dem Handy nutzen?
Ja. Es braucht WebAssembly SIMD, verwende daher eine aktuelle Version von Chrome, Edge oder Firefox oder Safari ab 16.4. Beim ersten Mal werden die Bausteine der KI geladen, daher ist WLAN empfehlenswert. In Apps wie LINE klappt das Speichern eventuell nicht. Öffne die Seite dann noch einmal in Safari oder Chrome.
Einschränkungen
- Die KI kann Zeichen falsch lesen oder übersehen. Vergleiche den Text mit dem Bild, bevor du ihn verwendest.
- Handschrift, sehr kleine Schrift und unscharfe Schrift werden häufiger falsch gelesen. Bei Tabellen und Spalten können Zeilen in der falschen Reihenfolge erscheinen.
- Seitlich gedrehte oder auf dem Kopf stehende Bilder lassen sich so, wie sie sind, nicht lesen. Wenn das Tool erkennt, dass ein Bild gedreht ist, sagt es, in welche Richtung es mit „Bilder drehen und spiegeln“ gedreht werden muss.
- Jedes Mal lässt sich ein Bild lesen. Ein Bild, dessen längere Seite mehr als 3.200 Pixel hat, wird zuerst verkleinert. Bei bewegten Bildern (GIF, animiertes WebP oder PNG) wird nur das erste Einzelbild gelesen.
- Eine Datei darf bis zu 50 MB groß sein, ein Bild bis zu 50 Megapixel haben. HEIC (das Fotoformat von iPhones) funktioniert nur in Browsern, die es öffnen können (vor allem Safari).
- Beim ersten Mal werden die Bausteine der KI (etwa 43 MB) geladen. Danach werden meist die auf diesem Gerät gespeicherten Bausteine verwendet.
- Vor Dingen in deiner eigenen Umgebung, etwa Browsererweiterungen, können wir dich nicht schützen.