Show simple item record

2009-03-06Dissertation DOI: 10.18452/15906
Re-Ranking auf Basis von Bradfordizing für die verteilte Suche in digitalen Bibliotheken
dc.contributor.authorMayr, Philipp
dc.date.accessioned2017-06-18T09:15:02Z
dc.date.available2017-06-18T09:15:02Z
dc.date.created2009-05-05
dc.date.issued2009-03-06
dc.identifier.urihttp://edoc.hu-berlin.de/18452/16558
dc.description.abstractTrotz großer Dokumentmengen für datenbankübergreifende Literaturrecherchen erwarten akademische Nutzer einen möglichst hohen Anteil an relevanten und qualitativen Dokumenten in den Trefferergebnissen. Insbesondere die Reihenfolge und Struktur der gelisteten Ergebnisse (Ranking) spielt, neben dem direkten Volltextzugriff auf die Dokumente, inzwischen eine entscheidende Rolle beim Design von Suchsystemen. Nutzer erwarten weiterhin flexible Informationssysteme, die es unter anderem zulassen, Einfluss auf das Ranking der Dokumente zu nehmen bzw. alternative Rankingverfahren zu verwenden. In dieser Arbeit werden zwei Mehrwertverfahren für Suchsysteme vorgestellt, die die typischen Probleme bei der Recherche nach wissenschaftlicher Literatur behandeln und damit die Recherchesituation messbar verbessern können. Die beiden Mehrwertdienste semantische Heterogenitätsbehandlung am Beispiel Crosskonkordanzen und Re-Ranking auf Basis von Bradfordizing, die in unterschiedlichen Phasen der Suche zum Einsatz kommen, werden hier ausführlich beschrieben und im empirischen Teil der Arbeit bzgl. der Effektivität für typische fachbezogene Recherchen evaluiert. Vorrangiges Ziel der Promotion ist es, zu untersuchen, ob das hier vorgestellte alternative Re-Rankingverfahren Bradfordizing im Anwendungsbereich bibliographischer Datenbanken zum einen operabel ist und zum anderen voraussichtlich gewinnbringend in Informationssystemen eingesetzt und dem Nutzer angeboten werden kann. Für die Tests wurden Fragestellungen und Daten aus zwei Evaluationsprojekten (CLEF und KoMoHe) verwendet. Die intellektuell bewerteten Dokumente stammen aus insgesamt sieben wissenschaftlichen Fachdatenbanken der Fächer Sozialwissenschaften, Politikwissenschaft, Wirtschaftswissenschaften, Psychologie und Medizin. Die Evaluation der Crosskonkordanzen (insgesamt 82 Fragestellungen) zeigt, dass sich die Retrievalergebnisse signifikant für alle Crosskonkordanzen verbessern; es zeigt sich zudem, dass interdisziplinäre Crosskonkordanzen den stärksten (positiven) Effekt auf die Suchergebnisse haben. Die Evaluation des Re-Ranking nach Bradfordizing (insgesamt 164 Fragestellungen) zeigt, dass die Dokumente der Kernzone (Kernzeitschriften) für die meisten Testreihen eine signifikant höhere Precision als Dokumente der Zone 2 und Zone 3 (Peripheriezeitschriften) ergeben. Sowohl für Zeitschriften als auch für Monographien kann dieser Relevanzvorteil nach Bradfordizing auf einer sehr breiten Basis von Themen und Fragestellungen an zwei unabhängigen Dokumentkorpora empirisch nachgewiesen werden.ger
dc.description.abstractIn spite of huge document sets for cross-database literature searches, academic users expect a high ratio of relevant and qualitative documents in result sets. It is particularly the order and structure of the listed results (ranking) that play an important role when designing search systems alongside the direct full text access for documents. Users also expect flexible information systems which allow influencing the ranking of documents and application of alternative ranking techniques. This thesis proposes two value-added approaches for search systems which treat typical problems in searching scientific literature and seek to improve the retrieval situation on a measurable level. The two value-added services, semantic treatment of heterogeneity (the example of cross-concordances) and re-ranking on Bradfordizing, which are applied in different search phases, are described in detail and their effectiveness in typical subject-specific searches is evaluated in the empirical part of the thesis. The preeminent goal of the thesis is to study if the proposed, alternative re-ranking approach Bradfordizing is operable in the domain of bibliographic databases, and if the approach is profitable, i.e. serves as a value added, for users in information systems. We used topics and data from two evaluation projects (CLEF and KoMoHe) for the tests. The intellectually assessed documents come from seven academic abstracting and indexing databases representing social science, political science, economics, psychology and medicine. The evaluation of the cross-concordances (82 topics altogether) shows that the retrieval results improve significantly for all cross-concordances, indicating that interdisciplinary cross-concordances have the strongest (positive) effect on the search results. The evaluation of Bradfordizing re-ranking (164 topics altogether) shows that core zone (core journals) documents display significantly higher precision than was seen for documents in zone 2 and zone 3 (periphery journals) for most test series. This post-Bradfordizing relevance advantage can be demonstrated empirically across a very broad basis of topics and two independent document corpora as well for journals and monographs.eng
dc.language.isoger
dc.publisherHumboldt-Universität zu Berlin, Philosophische Fakultät I
dc.rights.urihttp://rightsstatements.org/vocab/InC/1.0/
dc.subjectEvaluationger
dc.subjectBradfordizingger
dc.subjectCrosskonkordanzenger
dc.subjectheterogen erschlossene Fachdatenbankenger
dc.subjectInformation Retrievalger
dc.subjectRe-Rankingger
dc.subjectKernzeitschriftenger
dc.subjectRelevanzger
dc.subjectdigitale Bibliothekenger
dc.subjectbibliographischen Datenbankenger
dc.subjectZeitschriftenartikelger
dc.subjectMonographienger
dc.subjectevaluationeng
dc.subjectBradfordizingeng
dc.subjectcross-concordanceseng
dc.subjectheterogeneous indexed databaseseng
dc.subjectInformation Retrievaleng
dc.subjectre-rankingeng
dc.subjectcore journalseng
dc.subjectrelevanceeng
dc.subjectdigital librarieseng
dc.subjectbibliographic databaseseng
dc.subjectjournal articleseng
dc.subjectmonographseng
dc.subject.ddc020 Bibliotheks- und Informationswissenschaften
dc.titleRe-Ranking auf Basis von Bradfordizing für die verteilte Suche in digitalen Bibliotheken
dc.typedoctoralThesis
dc.identifier.urnurn:nbn:de:kobv:11-10097590
dc.identifier.doihttp://dx.doi.org/10.18452/15906
dc.identifier.alephidHU004204848
dc.date.accepted2009-02-18
dc.contributor.refereeUmstätter, Walther
dc.contributor.refereeKrause, Jürgen
dc.subject.dnb02 Schrift, Buch, Bibliothek, Information und Dokumentation
dc.subject.rvkST 252
dc.subject.rvkAN 9300
dc.subject.rvkAK 28100
dc.subject.rvkAN 96300
dc.subject.rvkST 205
local.edoc.pages235
local.edoc.type-nameDissertation
bua.departmentPhilosophische Fakultät I

Show simple item record