Definition
Die mittlere lineare Distanz, gemessen in der Anzahl der zwischenliegenden Worttokens, zwischen syntaktisch verbundenen Kopf- und Dependenztokens in einem abhängigkeitssyntaktisch annotierten Korpus; berechnet als Mittelwert der absoluten Positionsdifferenzen über alle annotierten Abhängigkeiten und als Index syntaktischer Lokalität verwendet.
Prinzip
Prinzip
Kürzere durchschnittliche Abhängigkeitsdistanzen bedeuten größere lineare Lokalität syntaktischer Relationen, was mit geringerer Kurzzeitgedächtnisbelastung und schnellerer inkrementeller Verarbeitung in vielen experimentellen und korpusbasierten Studien korreliert; längere Distanzen spiegeln größere Trennung zwischen abhängigen Elementen und potenziell erhöhten Verarbeitungsaufwand wider.
Demonstration
Demonstration
Illustratives Szenario → Satz 1 (benachbartes Subjekt–Verb): „Katzen schlafen.“ Subjekt–Verb-Distanz = 1. Satz 2 (eingeschobener Relativsatz): „Die Katze, die der Hund jagte, schläft.“ Die Subjekt–Verb-Distanz ist wegen des eingesetzten Materials größer; die mittlere Abhängigkeitsdistanz über die Abhängigkeiten von Satz 2 ist höher, was unter Lokalitätsannahmen einen höheren Verarbeitungsaufwand vorhersagt.
Fehlanwendung
Fehlanwendung
Eine geringere mittlere Abhängigkeitsdistanz als Beweis für syntaktische Einfachheit werten, ohne Abhängigkeitsdichte, mehrfache Einbettungen, Unterschiede in Annotationsschemata oder die kompensierende Rolle morphologischer Markierung und prosodischer Hinweise zu berücksichtigen.
Konsequenz
Konsequenz
Abhängigkeitsdistanz wird in typologischen Vergleichen, Registerstudien und psycholinguistischen Vorhersagen genutzt; aggregierte Zunahmen der mittleren Abhängigkeitsdistanz in Korpora deuten auf größere durchschnittliche lineare Trennung von Argumenten hin und können mit längeren Lesezeiten oder höherer kognitiver Belastung in Verarbeitungsmodellen korrelieren, abhängig von Annotation und Genre-Kontrolle.
Umkehrung
Umkehrung
In Sprachen mit freier Wortstellung, umfangreicher Kasusmarkierung, reicher Morphologie oder starken prosodischen Hinweisen ist die lineare Distanz möglicherweise ein schlechterer Prädiktor für Verarbeitungsaufwand; nicht-projektive Abhängigkeiten oder unterschiedliche Annotationenkonventionen erschweren ebenfalls die Interpretation linearer Distanzmaße.
Abgrenzung
Abgrenzung
Eindeutig innerhalb: Korpora, die mit einem konsistenten Abhängigkeits-Schema und einer konsistenten Tokenisierung annotiert sind, wobei Distanz als absolute Differenz der Tokenpositionen gemessen wird. Randfall: Vergleich über Korpora hinweg mit unterschiedlichen Parsern oder Tokenisierungen. Eindeutig außerhalb: konstituentenbasierte Maße syntaktischer Tiefe, die keine linearen Kopf–Abhängigkeits-Distanzen verwenden.
Semantische Spannung
Semantische Spannung
Abhängigkeitsdistanz ↔ Informationsdichte — die Minimierung der linearen Distanz reduziert Lokalitätskosten, kann jedoch die Informationsmenge pro Wort erhöhen und einen Zielkonflikt zwischen Lokalität und pro-Token-Informationsbelastung erzeugen.
Synthese
Synthese
Die mittlere Abhängigkeitsdistanz ist ein messbarer Proxy für syntaktische Lokalität und in vielen Kontexten informativ; kognitive Schlussfolgerungen benötigen jedoch kontrollierte Annotation, Berücksichtigung morphologischer und prosodischer Signale sowie ergänzende Evidenz.