Warum eure Dokumente unsichtbar bleiben
Der Text eines PDF liegt nicht als Klartext in der Datei. Er steckt in komprimierten Inhaltsströmen, je Schriftart eigen kodiert. Office-Dateien sind seit 2007 ZIP-Container mit komprimiertem XML darin. Eine Suche, die die Rohbytes dieser Dateien liest, findet darin prinzipbedingt nichts — und genau deshalb sind so viele Menschen überzeugt, ein Dokument sei "nicht auf diesem Rechner", obwohl es die ganze Zeit da war.
- PDF — der Text liegt in FlateDecode-komprimierten Inhaltsströmen
- DOCX, XLSX, PPTX — ZIP-Container mit komprimiertem XML
- ODT, ODS, ODP — dasselbe Prinzip, anderes XML
- Windows-Suche — indiziert nur ausgewählte Ordner und lässt ganze Laufwerke aus
📄 Das Dokument finden, nicht nur den Dateinamen
Deskora durchsucht PDF, Word, Excel, PowerPoint und OpenDocument — auf allen Laufwerken.
Deskora kostenlos herunterladenWelche Formate durchsucht werden
Deskora entnimmt den lesbaren Text eines Dokuments und durchsucht diesen. Hier steht, was abgedeckt ist — und was bewusst nicht.
| Format | Was durchsucht wird |
|---|---|
| PDF (.pdf) | Vollständiger Seitentext, auch aus komprimierten Strömen und CID-Schriften. Die Seitenzahl wird gemeldet. |
| Word (.docx, .docm) | Fließtext, Tabellen, Kopf- und Fußzeilen, Fußnoten. Gelöschter Text aus der Änderungsverfolgung bleibt draußen. |
| Excel (.xlsx, .xlsm) | Alle Zellen aller Blätter, Zeichenkettenpool und Inline-Texte. Der Blattname wird gemeldet. |
| PowerPoint (.pptx, .ppsx) | Aller Folientext in Foliennreihenfolge. Die Foliennummer wird gemeldet. |
| OpenDocument (.odt) | Vollständiger Fließtext samt Überschriften und Tabellen. |
| OpenDocument (.ods) | Alle Zellen aller Tabellen. Der Tabellenname wird gemeldet. |
| OpenDocument (.odp) | Aller Folientext. Der Folienname wird gemeldet. |
| RTF (.rtf) | Vollständiger Text, Steuerwörter und Zeichencodes aufgelöst. |
| TXT, LOG, CSV, XML, JSON | Wird direkt durchsucht, Byte für Byte — der schnelle Pfad, unverändert. |
| .doc, .xls, .msg | Nicht unterstützt. Die alten Binärformate und Mail-Container sind ein eigenes Thema und werden bewusst weggelassen statt halbherzig begonnen. |
Wie es arbeitet
Die Textentnahme ist teuer, deshalb passiert sie einmal. Danach liegt der Text komprimiert im Index, und jede weitere Suche fühlt sich an wie eine Klartextsuche.
🔍 Textentnahme
PDF-Inhaltsströme werden ausgepackt und über die Schrifttabellen dekodiert; Office-Dateien werden entpackt und ihr XML korrekt gelesen — samt Entitäten und Absatztrennung.
💾 Persistenter Index
Der entnommene Text wird komprimiert zwischengespeichert. Neu entnommen wird nur, wenn sich Größe oder Änderungszeit der Datei ändern.
🌙 Leiser Hintergrundaufbau
Niedrigste Thread- und Ein-/Ausgabepriorität, jederzeit abbrechbar. Ihr sollt davon nichts merken.
📄 Echte Fundstellen
Ein Treffer meldet Seite 7, Blatt "Umsatz" oder Folie 3 — keine bedeutungslose Zeilennummer.
Deskora im Vergleich
Ehrlicher Vergleich. Deskora ist kostenlose Desktop-Software und keine Beweismittelplattform für Kanzleien — und tut auch nicht so.
| Deskora | Windows-Suche | Agent Ransack | dtSearch | |
|---|---|---|---|---|
| Sucht in PDF | Ja | Nur indizierte Ordner | Ja | Ja |
| Sucht in Office-Dateien | Ja | Nur indizierte Ordner | Ja | Ja |
| Erfasst alle Laufwerke | Ja | Nein | Ja | Ja |
| Reguläre Ausdrücke | Ja | Nein | Ja | Ja |
| Meldet Seite / Blatt / Folie | Ja | Nein | Nein | Ja |
| Preis | Kostenlos | Enthalten | Kostenlos / kostenpflichtig | Ab mehreren hundert Euro |
Für wen das gemacht ist
⚖️ Kanzlei und Steuerberatung
Ein Aktenzeichen steht in der Kopfzeile eines PDF, im dritten Blatt einer Tabelle und in einem eingescannten Vertrag. Über den Dateinamen findet man keines davon. Über den Inhalt alle drei — samt Angabe, welche Seite zu öffnen ist.
🔬 Forschung und Studium
Hunderte Papers, dutzende Datensätze, Notizen in drei Formaten. "In welchem Paper stand diese Methode?" ist eine Inhaltsfrage, und sie sollte eine Sekunde dauern und keinen Nachmittag.
🔧 Technische Dokumentation
Teilenummern und Fehlercodes stehen in Handbüchern, nicht in deren Dateinamen. Eine Suche, die ins Handbuch hineinliest, macht aus einem Ordner voller PDFs eine Wissensbasis.
Eure Dokumente bleiben auf eurem Rechner
Die Textentnahme läuft vollständig lokal. Nichts wird hochgeladen, nichts an einen Server geschickt, kein Konto verlangt. Der Dokumentindex lässt sich komplett abschalten, auf ausgewählte Ordner begrenzen oder mit Ausschlüssen versehen — denn ein Programm, das alle Laufwerke kennt, muss euch die Grenze ziehen lassen.
Häufige Fragen
Findet Deskora Text in eingescannten PDFs?
Nein. Ein eingescanntes PDF ist ein Bild von Text, nicht Text. Dafür wäre Texterkennung nötig, und das ist eine eigene Größenordnung. Deskora meldet dann schlicht keinen Treffer, statt so zu tun als ob.
Was ist mit passwortgeschützten Dateien?
Die werden übersprungen. Deskora versucht nicht, Verschlüsselung aufzubrechen — auch nicht im verbreiteten Fall eines leeren Benutzerkennworts. Diese Sperre hat der Ersteller bewusst gesetzt.
Bremst das meinen Rechner aus?
Der Index wird im Hintergrund mit niedrigster Thread- und Ein-/Ausgabepriorität aufgebaut und ist jederzeit abbrechbar. Die Klartextsuche bleibt unberührt: sie läuft weiterhin direkt auf der Datei, ohne Kopie.
Wie viel Platz braucht der Index?
Der entnommene Text wird komprimiert gespeichert und ist ein Bruchteil der Dokumente selbst. Ein paar tausend Dokumente kosten typischerweise einige dutzend Megabyte.
Funktioniert das auch mit nicht-lateinischer Schrift?
Ja. Chinesisch, Japanisch, Kyrillisch, Arabisch und Devanagari werden verarbeitet, und die Suche ohne Rücksicht auf Groß-/Kleinschreibung funktioniert auch jenseits von ASCII — "МОСКВА" findet "Москва", und "STRASSE" findet "Straße".
Kann ich reguläre Ausdrücke benutzen?
Ja, in ECMAScript-Syntax. Ein fehlerhafter Ausdruck erzeugt einen Hinweis am Eingabefeld, statt still nichts zu tun.
📄 Das Dokument finden, nicht nur den Dateinamen
Deskora durchsucht PDF, Word, Excel, PowerPoint und OpenDocument — auf allen Laufwerken.
Deskora kostenlos herunterladen