Metadaten in digitalen Archiven: EXIF, IPTC, XMP und Kontext

Aktualisiert am 12. Juli 2026 / in Digitale Archive

Inhaltsübersicht

Dateien bewahren Inhalte. Metadaten erklären, was diese Inhalte bedeuten, woher sie stammen und wie sie zusammengehören. Ohne Titel, Datum, Personen, Ort, Provenienz oder Dokumenttyp bleibt selbst eine technisch einwandfreie Datei oft nur schwer verständlich.

Kurz gesagt

Metadaten machen Dateien auffindbar und verständlich. Dauerhaft wichtige Angaben dürfen deshalb nicht ausschließlich in einer proprietären Programmdatenbank liegen.

Die tragenden Informationen gehören möglichst in standardisierte Dateifelder, Sidecars oder dokumentierte Begleitdateien. Programme dürfen sie verwalten; Datenhoheit und Migration bestimmen jedoch die Archivstrategie.

Metadaten sind kein Zusatz

Metadaten gehören fachlich zum Archivgut. Sie machen Bilder auffindbar, unterscheiden Dokumenttypen, verbinden Quellen mit Ereignissen und halten Entscheidungen nachvollziehbar. Ordner und Dateinamen bilden eine wichtige Grundordnung, können aber nicht jeden Zusammenhang ausdrücken.

Die dauerhafte Metadatenstrategie muss unabhängig von einer einzelnen Programmdatenbank funktionieren. Programme dürfen Metadaten pflegen und auswerten; die langfristig relevante Information sollte möglichst in standardisierten Feldern, Sidecars oder dokumentierten Begleitdateien erhalten bleiben.

Technische, beschreibende und administrative Metadaten

Technische Metadaten beschreiben etwa Dateiformat, Auflösung, Kamera oder Erstellungssoftware. Beschreibende Metadaten benennen Titel, Personen, Orte, Ereignisse, Schlagwörter oder Dokumenttypen. Administrative Metadaten halten Rechte, Herkunft, Bearbeitungsstand, Aufbewahrung oder Zuständigkeit fest.

Ein gutes Archiv benötigt nicht möglichst viele Felder, sondern wenige verbindliche Angaben, die konsistent gepflegt und später verstanden werden.

EXIF

EXIF entsteht vor allem bei Kameras und Smartphones. Es enthält technische Aufnahmedaten, Zeitstempel und teilweise GPS-Koordinaten. Diese Angaben sind nützlich, aber nicht automatisch historisch korrekt: Kamerauhren können falsch sein, Scans tragen das Scan- statt des Aufnahmedatums und Bearbeitungen verändern Felder.

EXIF ist daher eine technische Quelle, keine unfehlbare Wahrheit.

IPTC und XMP

IPTC-Felder werden traditionell für Bildbeschreibung, Urheber, Rechte und Schlagwörter verwendet. XMP bietet ein erweiterbares, standardisiertes Modell und kann in Dateien oder in XMP-Sidecars gespeichert werden. Für Fotoarchive ist XMP besonders wichtig, weil Beschreibungen, Stichwörter, Orte und weitere Angaben programmeübergreifend transportiert werden können.

Sidecars müssen gemeinsam mit der zugehörigen Datei benannt, verschoben und gesichert werden. Liegen Informationen nur in einer internen Datenbank, ist ein getesteter Exportweg erforderlich.

PDF- und Dokumentmetadaten

PDF-Dateien können Titel, Autor, Erstellungsdaten und XMP-Metadaten enthalten. In Dokumentenarchiven kommen fachliche Felder wie Korrespondent, Dokumenttyp, Belegdatum, Akte oder Aufbewahrungsstatus hinzu. Nicht jedes DMS-Feld lässt sich sinnvoll in eine einzelne PDF-Datei schreiben. Deshalb muss dokumentiert sein, welche Information in der Datei, im Export oder in einer Begleitstruktur führend ist.

OCR-Text ist ebenfalls eine wichtige Erschließungsebene, aber keine verlässliche inhaltliche Beschreibung. Er erleichtert die Suche und muss bei wichtigen Dokumenten stichprobenweise kontrolliert werden.

Dublin Core und medienübergreifende Beschreibung

Dublin Core zeigt ein einfaches medienübergreifendes Prinzip: Ressourcen lassen sich unter anderem durch Titel, Urheber, Datum, Beschreibung, Quelle, Rechte und Beziehung beschreiben. Nicht jedes private Archiv muss Dublin Core technisch implementieren. Die Felder helfen jedoch, eine verständliche Mindestbeschreibung für sehr unterschiedliche Objekte zu entwerfen.

Personen, Orte und GPS

Personenmetadaten können als Namen, Schlagwörter, Gesichtszonen oder Beziehungen vorliegen. Gesichtserkennung liefert Vorschläge, ersetzt aber keine menschliche Bestätigung. Dauerhaft wichtig sind kontrollierte Namen, gegebenenfalls Lebensdaten und der Bezug zum Familienkontext.

GPS-Koordinaten sind präzise Messwerte, aber noch kein Ortswissen. Ein Archiv sollte zusätzlich verständliche Ortsnamen und bei historischen Orten den damaligen Kontext dokumentieren. Datenschutz und Schutz privater Wohnorte sind dabei zu berücksichtigen.

Schlagwörter und kontrollierte Begriffe

Unbegrenzte freie Schlagwörter führen schnell zu Dubletten und Varianten. Eine kleine, dokumentierte Begriffsliste ist meist belastbarer. Synonyme, Schreibweisen und Hierarchien sollten bewusst geregelt werden. Automatisch erzeugte KI-Schlagwörter bleiben zunächst Vorschläge und dürfen bestätigte Angaben nicht ungeprüft überschreiben.

Ein praktisches Fotoarchiv kann beispielsweise Oberbegriffe wie Familien_Fahrzeuge, Familien_Tiere, Personen, Personen_Familie und Personen_Verwandte verwenden. Unter Familien_Fahrzeuge lassen sich einzelne Fahrzeuge oder Halterbezüge hierarchisch einordnen. Die im Bestand angezeigten Trefferzahlen sind nützliche Arbeitsinformationen, aber keine dauerhaften Metadaten.

Bei Personenbegriffen muss die Bedeutung jeder Ebene eindeutig sein. Personen kann etwa die zentrale Namenshierarchie bilden, während Personen_Familie und Personen_Verwandte Rollen oder Auswahlgruppen ausdrücken. Wird dieselbe Person parallel an mehreren Stellen als eigener Namensbegriff geführt, entstehen auseinanderlaufende Schreibweisen und Trefferbestände. Stabiler ist ein führender Personenbegriff; zusätzliche Einordnungen werden als übergeordnete Hierarchie oder getrennte, dokumentierte Beziehung gepflegt.

Führende Instanz und Rückschreiben

Für jede Metadatenklasse muss feststehen, welches System führend ist. Im Fotoarchiv kann digiKam Personen und XMP pflegen; im Dokumentenarchiv führt ein DMS Dokumenttyp und Korrespondent; das Dateisystem bildet die stabile Grundstruktur. Mehrere Programme dürfen lesen, aber nicht unkoordiniert dieselben Felder überschreiben.

Nach Änderungen wird geprüft, ob relevante Metadaten tatsächlich in Datei, Sidecar oder vollständigem Export angekommen sind. Datenbank-Backups bleiben zusätzlich wichtig, ersetzen aber keine offene Übergabestruktur.

Mindestregeln für ein Metadaten-Silo

  1. Pflichtfelder je Objektart festlegen.
  2. Führende Instanz für jedes Feld bestimmen.
  3. Standards und zulässige Begriffe dokumentieren.
  4. Originalwerte von späteren Ergänzungen unterscheiden.
  5. KI-Ergebnisse erst nach Bestätigung übernehmen.
  6. Sidecars immer mit ihren Dateien sichern.
  7. Exporte und Wiederherstellung regelmäßig testen.
  8. Datenschutz, Rechte und Übergabe berücksichtigen.

Fazit

Metadaten machen aus Dateien ein verständliches Archiv. EXIF, IPTC, XMP, PDF-Felder, GPS und Schlagwörter erfüllen unterschiedliche Aufgaben und brauchen klare Zuständigkeiten. Entscheidend ist eine sparsame, dokumentierte und offene Metadatenstrategie, die auch nach einem Programmwechsel lesbar bleibt.

Persönliche Unterstützung

Dieser Artikel vermittelt die fachlichen Grundlagen. Wenn Sie die beschriebenen Methoden auf einen konkreten Bestand oder ein bestehendes System übertragen möchten, finden Sie ergänzende Informationen unter Dienstleistungen.