Software für Dokumenten Digitalisierung mit automatischer Benennung der Dateien

Registriert
Okt. 2013
Beiträge
145
Hallo,

ich möchte gern meine Dokumenten Digitalisieren und suche eine Software die anhand des Inhaltes des Dokumentes einen Dateinamen vergibt.

Gibt es sowas oder brauche ich für so was zwingest einen Dokumentenscanner.

Danke
 
Habe ich mir angesehen aber konnte nicht rausfinden wo oder wie ich das einstellen kann das es meine Dokumente automatisch aufgrund des Inhaltes Bennent. Und auch Google hat mir dazu nicht viel ausgespuckt.
 
Wie soll das gehen? Bei einheitlichen Dokumenten würde es da wohl Lösungen geben. Sonst würde eine Automatik nur wirres Zeug auslesen und ob das als Dateiname tauglich ist wäre dann die Frage.
 
  • Gefällt mir
Reaktionen: cumulonimbus8 und Black_Devil_Tbg
Also wir haben "Automatic PDF Processor" (dt. Firma Gillmeister Software)
Da kann man Dokumente durchsuchen und mit den gefundenen Texten allerlei Dinge anstellen. u.a. umbennen, in bestimmte Ordner kopieren oder verschieben usw.

ABER ich weis nicht ob es nur nach Schlagwörtern durchsuchen kann und ob es andere Dateitypen als PDF bearbeiten kann und es ist Win-exklusiv.
Ist üblicherweise auf einem Win-Server installiert und überwacht einen (oder mehrere) Ordner und arbeitet die Dateien darin ab...

Es gibt eine kostenfreie 30-Tage Demo, da kannst du dir das mal anschauen...
 
  • Gefällt mir
Reaktionen: Black_Devil_Tbg
Da wirst du um einen Scanner nicht herumkommen. Wie sonst soll der Weg vom Papier zum digitalen Dokument aussehen. Die gängigen Scanprogramme können ein durchsuchbares PDF erstellen, den Dateinamen mit Scandatum usw. versehen, aber m.W. gibt es noch kein KI-gestütztes Programm, das einen Dateinamen anhand des Inhalts generiert.
 
  • Gefällt mir
Reaktionen: Black_Devil_Tbg und coasterblog
Ich hab beruflich (ELO) und privat (ecoDMS) mit so etwas zu tun und eine automatische Benennung gibt es, nur nicht so wie du dir das wünschst. Die sieht in etwa so aus: Datum/Uhrzeit (Std./Min./Sek.) ..... .pdf oder .tiff
 
  • Gefällt mir
Reaktionen: Black_Devil_Tbg
Also ich abe soeben nbochmal geschaut.
Das Programm, was ich in Post #6 nannte, kann das, was du suchst, musst es nur konfigurieren.
Es müssen aber PDFs mit lesbaren Text sein ein Scan oder Foto muss vorher wohl durch nen OCR...
 
  • Gefällt mir
Reaktionen: Black_Devil_Tbg
Black_Devil_Tbg schrieb:
das es meine Dokumente automatisch aufgrund des Inhaltes Bennent
Paperless-ngx hat im Hintergrund eine Datenbank. Der Dateiname wird vollkommen irrelevant.
 
  • Gefällt mir
Reaktionen: Nebuk und Black_Devil_Tbg
Paperless benennt Dokumente auch sehr wohl bis zu einem gewissen Grad automatisch.

Als erstes werden mögliche Datümer für dein Dokument selektiert. Das kannst du auch anpassen, z.B. eins der vorgeschlagenen, aus dem Dokument geparsten selektieren.

Dann kannst du Korrespondent und Dokumententyp pflegen.

Dabei kannst du aus vielen Optionen wählen:

1718477410887.png


Die Maske sieht dann so aus:

1718477462572.png


Das heisst, nach einiger Zeit werden Typ und Korrespondent automatisch richtig erkannt. Das Datum ist mit wenigen Clicks geupdated.

Der Name der Datei, wenn ich sie dann runterlade ist automatisch:
Datum Korrespondent Titel
also im obigen Falle
2022-06-24 FC Köln Dauerkarte Saison 22-23.pdf

Aber auch das Format ist anpassbar.
 
  • Gefällt mir
Reaktionen: Black_Devil_Tbg
Alter Thread, aber die Aussage "gibt es nicht" steht hier zweimal und stimmt inzwischen nicht mehr.

Der Unterschied ist, dass es kein OCR mehr ist. OCR liest Zeichen, und daran scheitert es bei zerknitterten Belegen. Googles Gemini bekommt stattdessen das komplette Dokument, alle Seiten, und erfasst den Zusammenhang: worum es geht, von wem es kommt, wozu es gehört. Daraus fallen beide Entscheidungen ab, Dateiname und Zielordner. Passt kein vorhandener Ordner, wird einer vorgeschlagen, der in deine Struktur passt. Vorlagen pro Absender braucht es dafür nicht.

Ich hab das selbst als Android-App gebaut (Scanager), bin also befangen. Drive optional, nur lokal geht auch.

Zum Datenschutz, korrigiert gegenüber der ersten Fassung dieses Beitrags: Die Seite läuft über eine eigene Cloud Function in europe-west3 an die Gemini-API, über den bezahlten Zugang. Die Funktion liegt damit in der EU, der Modellaufruf selbst geht aber an den globalen Endpunkt - EU-gebundene Verarbeitung ist das also nicht, und so hätte ich es nicht nennen dürfen. Google sagt für den bezahlten Zugang zu, dass Eingaben und Antworten nicht ins Training gehen. Was ich ursprünglich zu weit gefasst hatte: Prompts und Antworten werden 55 Tage protokolliert, um Missbrauch zu erkennen, und wenn etwas von den Sicherheitsfiltern markiert wird, können autorisierte Google-Mitarbeiter es einsehen (https://ai.google.dev/gemini-api/docs/abuse-monitoring). Keine routinemäßige Sichtung, aber eben auch kein "nie". Meine Funktion speichert weder Bild noch Ergebnis, lokal liegt alles in SQLCipher.

Der Ordnervorschlag sitzt meistens, nicht immer. Ausprobieren kostet nichts, ein paar Scans sind frei und ein Konto braucht es dafür nicht.

https://play.google.com/store/apps/details?id=de.moll.aiscanner

Nachtrag 18.09.2026: Datenschutz-Absatz korrigiert. Dort stand vorher, die Inhalte würden "nicht von Menschen gesichtet" - das war falsch, richtig ist die 55-Tage-Regel oben. Dazu präzisiert, dass die Funktion in der EU läuft, der Modellaufruf aber nicht.
 
Zuletzt bearbeitet:
Aber die Grundaussage war ja nicht: geht nicht, sondern nimm paperless...und daran hat sich auch nix geändert ;)
 
@johako Stimmt, da hast du recht :) „Nimm paperless" war die Kernaussage, und die steht ja auch weiter.

Der Unterschied ist eher, wo man landet: paperless lernt über Korrespondenten und Regeln und will einen Server, der läuft. Bei mir läuft nichts zuhause, das Verstehen passiert am Dokument selbst, und der Ordner fällt gleich mit ab. Für einen großen Altbestand bleibt paperless die robustere Kiste, das seh ich genauso.
 
Zurück
Oben