<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Ocr on Fuchsbau</title><link>https://this-is-fine.io/tags/ocr/</link><description>Recent content in Ocr on Fuchsbau</description><generator>Hugo</generator><language>de-DE</language><lastBuildDate>Mon, 05 Oct 2026 09:10:00 +0200</lastBuildDate><atom:link href="https://this-is-fine.io/tags/ocr/index.xml" rel="self" type="application/rss+xml"/><item><title>Paperless-ngx im Lab: vom Scan zum brauchbaren Archiv</title><link>https://this-is-fine.io/posts/20261005-paperless-ngx-dokumentenarchiv/</link><pubDate>Mon, 05 Oct 2026 09:10:00 +0200</pubDate><guid>https://this-is-fine.io/posts/20261005-paperless-ngx-dokumentenarchiv/</guid><description>&lt;p&gt;Ein Scanner löst das Papierproblem nur zur Hälfte. Danach liegt die Rechnung nicht mehr auf dem Schreibtisch, sondern als &lt;code&gt;scan_0042.pdf&lt;/code&gt; in einem Verzeichnis. Man kann sie öffnen, aber noch lange nicht zuverlässig wiederfinden. Bei E-Mails ist es ähnlich: Der Anhang ist irgendwo vorhanden, der Zusammenhang steckt im Postfach, und ob beides wirklich gesichert ist, bleibt eine andere Frage.&lt;/p&gt;
&lt;p&gt;

&lt;a href="https://docs.paperless-ngx.com/" rel="external noopener" target="_blank"&gt;Paperless-ngx&lt;/a&gt;
 soll in meinem Lab genau diese Lücke schließen: Dokumente aufnehmen, durchsuchbar machen und mit brauchbaren Metadaten versehen. Die interessante Arbeit begann allerdings erst nach dem ersten erfolgreichen Upload. Wie landet ein Scan vollständig im Archiv? Was darf ein Sprachmodell entscheiden? Und wie stelle ich Dateien und Datenbank so wieder her, dass sie auch zusammenpassen?&lt;/p&gt;</description></item></channel></rss>