@phdthesis{Schaer2013, author = {Schaer, Philipp}, title = {Der Nutzen informetrischer Analysen und nicht-textueller Dokumentattribute f{\"u}r das Information Retrieval in digitalen Bibliotheken}, url = {https://nbn-resolving.org/urn:nbn:de:hbz:kob7-8960}, institution = {Institut f{\"u}r Management}, school = {Universit{\"a}t Koblenz-Landau, Campus Koblenz, Universit{\"a}tsbibliothek}, pages = {v, 371}, year = {2013}, abstract = {Die Suche nach wissenschaftlicher Literatur ist eine Forschungsherausforderung f{\"u}r das Information Retrieval im besonderen Umfeld der digitalen Bibliotheken. Aktuelle Nutzerstudien zeigen, dass im klassischen IR-Modell zwei typische Schw{\"a}chen auszumachen sind: das Ranking der gefundenen Dokumente und Probleme bei der Formulierung von Suchanfragen. Gleichzeitig ist zu sehen, dass traditionelle Retrievalsysteme, die prim{\"a}r textuelle Dokument- und Anfragemerkmale nutzen, bei IR-Evaluationskampagnen wie TREC und CLEF in ihrer Leistung seit Jahren stagnieren. Zwei informetrisch-motivierte Verfahren zur Suchunterst{\"u}tzung werden vorgestellt und mittels einer Laborevaluation mit den beiden IR-Testkollektionen GIRT und iSearch sowie 150 und 65 Topics evaluiert. Die Verfahren sind: (1) eine auf der Kookkurrenz von Dokumentattributen basierende Anfrageerweiterung und (2) ein Rankingansatz, der informetrische Beobachtungen zur Produktivit{\"a}t von Informationserzeugern ausnutzt. Beide Verfahren wurden mit einer Referenzimplementation auf Basis der Suchmaschine Solr verglichen. Beide Verfahren zeigen positive Effekte beim Einsatz von zus{\"a}tzlichen Dokumentattributen wie Autorennamen, ISSN-Codes und kontrollierten Schlagw{\"o}rtern. Bei der Anfrageerweiterung konnte ein positiver Effekt in Form einer Verbesserung der Precision (bpref +12\%) und des Recall (R +22\%) erzielt werden. Die alternativen Rankingans{\"a}tze konnten beim Ansatz von Autorennamen und ISSN-Codes die Baseline erreichen bzw. diese beim Einsatz der kontrollierten Schlagw{\"o}rter {\"u}ber- treffen (MAP +14\%). Einen negativen Einfluss auf das Ranking hatten allerdings die Einbeziehung von Faktoren wie Verlagsnamen oder Erscheinungsorten. F{\"u}r beide Verfahren konnte eine substantiell andere Sortierung der Ergebnismenge, gemessen anhand von Kendalls, beobachtet werden. Zus{\"a}tzlich zu der verbesserten Relevanz der Ergebnisliste kann der Nutzer so eine neue Sicht auf die Dokumentenmenge gewinnen. Die Anfrageerweiterung mit Autorennamen, ISSN-Codes und Thesaurustermen zeigt das bisher ungenutzte Potential, das sich in digitalen Bibliotheken durch die Datenf{\"u}lle und -qualit{\"a}t ergibt. Die Rankingverfahren konnten die Leistung des Baseline-Systems {\"u}bertreffen, nachdem eine {\"U}berpr{\"u}fung auf Vorliegen einer Power Law-Verteilung und eine anschließende Filterung durchgef{\"u}hrt wurde. Dies zeigt, dass die Rankingverfahren nicht universell f{\"u}r alle Suchanfragen anwendbar sind, sondern ein Vorhandensein bestimmter H{\"a}ufigkeitsverteilungen voraussetzen. So wird die enge Verbindung der Verfahren zu informetrischen Gesetzm{\"a}ßigkeiten wie Bradfords, Lotkas oder Zipfs Gesetz deutlich. Die beiden in der Arbeit evaluierten Verfahren sind als interaktive Suchunterst{\"u}tzungsdienste in der sozialwissenschaftlichen digitalen Bibliothek Sowiport implementiert. Die Verfahren lassen sich {\"u}ber entsprechende Web- Schnittstellen auch in anderen Anwendungskontexten einsetzen.}, subject = {Informetrie}, language = {de} }