State-Centric Framework for Canonical Representation and Change Analysis of Evolving Documents in Information Systems

Publikation: Beitrag in FachzeitschriftForschungsartikelBeigetragenBegutachtung

Abstract

Informationssysteme verarbeiten zunehmend Dokumentensammlungen, die sich kontinuierlich weiterentwickeln, wiederholt abgefragt werden und eine nachvollziehbare Verarbeitung relevanter Änderungen erfordern. Dennoch werden Dokumente häufig als statische Artefakte betrachtet. Dadurch bleibt ihre zeitliche Entwicklung weitgehend unberücksichtigt, was sowohl die explizite Modellierung von Dokumentzuständen als auch den systematischen Vergleich unterschiedlicher Versionen erschwert.

Der vorliegende Beitrag stellt ein zustandszentriertes Framework zur Repräsentation und Analyse evolvierender Dokumente vor. Dokumente werden dabei nicht als unveränderliche Objekte, sondern als strukturierte und versionierte Zustände innerhalb eines Informationsraums aufgefasst. Jeder Dokumentzustand wird in kanonisierter Form und als hierarchisch zerlegte Struktur repräsentiert sowie mit seinem kontextuell gültigen Vorgänger verknüpft. Änderungen werden folglich nicht als implizite Unterschiede zwischen externen Dokumentartefakten verstanden, sondern als formal definierte Zustandsübergänge zwischen vergleichbaren Dokumentzuständen.

Das Framework umfasst drei aufeinander abgestimmte Ebenen: eine deterministische Repräsentation durch Kanonisierung und hierarchische Zerlegung, eine zeitliche Organisation mittels expliziter Vorgängerbeziehungen sowie Vergleichsmechanismen, die auf strukturierten Dokumentzuständen operieren. Das Framework wird exemplarisch durch einen hierarchischen, hashbasierten Ansatz instanziiert.

Die praktische Umsetzbarkeit des Ansatzes wird anhand einer kontrollierten und reproduzierbaren Fallstudie untersucht. Diese basiert auf einer Folge von JSON-Dokumentzuständen, vordefinierten Korrespondenzinformationen sowie einer ausführbaren Referenzimplementierung. Die Ergebnisse zeigen, dass semantisch äquivalente Dokumentrepräsentationen identische kanonische Hashwerte erzeugen. Darüber hinaus konnten vorgegebene strukturelle Änderungen überall dort zuverlässig erkannt und lokalisiert werden, wo gültige Korrespondenzinformationen vorlagen. Gleichzeitig verdeutlichen mehrdeutige Komponentenidentitäten die Grenzen einer präzisen Änderungslokalisierung, sofern keine persistenten Identifikatoren verfügbar sind.

Die analytische Betrachtung sowie die reproduzierbare Fallstudie liefern gemeinsam belastbare Hinweise auf die konzeptionelle Konsistenz und die praktische Anwendbarkeit des Frameworks unter den zugrunde gelegten Annahmen zur Dokumentrepräsentation. Damit schafft der Ansatz eine Grundlage für eine deterministische und nachvollziehbare Analyse evolvierender Dokumente in Informationssystemen.
Titel in Übersetzung
Zustandszentriertes Framework zur kanonischen Repräsentation und Änderungsanalyse evolvierender Dokumente in Informationssystemen

Details

OriginalspracheEnglisch
Aufsatznummer7644
Seitenumfang62
FachzeitschriftApplied Sciences : open access journal
Jahrgang16
Ausgabenummer15
PublikationsstatusVeröffentlicht - 1 Aug. 2026
Peer-Review-StatusJa

Externe IDs

ORCID /0009-0009-9342-629X/work/222683236
ORCID /0000-0001-7540-4235/work/222762014

Schlagworte

Forschungsprofillinien der TU Dresden

Fächergruppen, Lehr- und Forschungsbereiche, Fachgebiete nach Destatis

Ziele für nachhaltige Entwicklung

Schlagwörter

  • change-aware information systems, document comparison, document state representation, evolving documents, canonicalization, deterministic comparability, hierarchical hashing, change detection, traceability, reproducible case study, Informationssysteme, Dokumentenvergleich, Dokumentzustandsrepräsentation, Kanonisierung, Vergleichbarkeit, Hashing, Änderungserkennung, Nachvollziehbarkeit, Fallstudie