Information Retrieval

Aus InfoWissWiki - Das Wiki der Informationswissenschaft
Zur Navigation springen Zur Suche springen

Definition

Mit Information Retrieval bezeichnet man Methoden und Verfahren, die der Aufbereitung und Speicherung von 'verdatetem' Wissen und der Gewinnung von Informationen dienen. (Luckhardt 2001)

Im Gegensatz zum Begriff "Inforamtion Retrieval" beinhaltet die genannte Definition neben dem Wiederfinden auch die Aufbereitung und Speicherung von Wissen.

Probleme

Der folgende Abschnitt befasst sich mit allgemeinen Problemen die beim Information Retrieval auftreten.

Charakteristika des Gebietes

  • Vage Anfragen
Die von den Nutzern formulierten Anfragen sind oft sehr ungenau formuliert, nicht unbedingt aus Unerfahrenheit oder Unwissenheit sondern weil er noch gar keine klare VOrstellung von der Antwort hat nach der er eigentlich sucht.
  • Unsicheres Wissen
Dem Retrieval System fehlen in der Regel Kenntnisse über den Inhalt der Dokumente. Dies führt zu fehlerhaften und fehlenden Antworten. Besondere Probleme bei Texten bereiten z. B. Homonyme (Worte, die gleich geschrieben werden; z. B. Bank - Geldinstitut, Sitzgelegenheit) und Synonyme (Bank und Geldinstitut).

Probleme bei der Suche nach Information

  • Die nahezu unüberschaubare Größe des Web und seine Dynamik, es werden permanent Änderungen vorgenommen, die keiner zentralen Verwaltung unterliegen.
  • Die Heterogenität der Dokumente im WWW bietet einerseits eine große Vielfalt, erschwert aber auch
  • Weltweite Verteilung
  • Fehlende Organisation und Struktur
  • Konkurrenz
  • Deep oder invisible Web
  • Spamming
… weitere Daten zur Seite „Information Retrieval
Mit Information Retrieval bezeichnet man Methoden und Verfahren, die der Aufbereitung und Speicherung von 'verdatetem' Wissen und der Gewinnung von Informationen dienen +