Clustering von deutschen Ortsnamen

Ederberg, Hans-Peter; Wartena, Christian

research

Clustering von deutschen Ortsnamen

Authors: Hans-Peter Ederberg
Christian Wartena
Publication date: 1 January 2017
Publisher: Hannover : Hochschule Hannover
Doi

Abstract

Diese Studie untersucht Gruppen von Ortsnamen in Deutschland (in den Postleitregionen) nach vorhandenen Ähnlichkeiten. Als Messgröße wird ein Häufigkeitsvektor von Trigrammen in jeder Gruppe herangezogen. Mit der Anwendung des Average Linkage-Algorithmus auf die Messgröße werden Cluster aus räumlich zusammenhängenden Gebieten gebildet, obwohl das Verfahren keine Kenntnis über die Lage der Cluster zueinander besitzt. In den Clustern werden die zehn häufigsten n-Gramme ermittelt, um charakteristische Wortpartikel darzustellen. Die von den Clustern umschriebenen Gebiete lassen sich zwanglos durch historische oder linguistische Entwicklungen erklären. Das hier verwendete Verfahren setzt jedoch kein linguistisches, geographisches oder historisches Wissen voraus, ermöglicht aber die Gruppierung von Namen in eindeutiger Weise unter Berücksichtigung einer Vielzahl von Wortpartikeln in einem Schritt. Die Vorgehensweise ohne Vorwissen unterscheidet diese Studie von den meisten bisher angewendeten Untersuchungen

Similar works

Full text

Open in the Core reader

Download PDF

Available Versions

Server für wissenschaftliche Schriften der Hochschule Hannover

oai:serwiss.opus4:1028

Last time updated on 19/04/2017