SSOAR Logo
    • Deutsch
    • English
  • English 
    • Deutsch
    • English
  • Login
SSOAR ▼
  • Home
  • About SSOAR
  • Guidelines
  • Publishing in SSOAR
  • Cooperating with SSOAR
    • Cooperation models
    • Delivery routes and formats
    • Projects
  • Cooperation partners
    • Information about cooperation partners
  • Information
    • Possibilities of taking the Green Road
    • Grant of Licences
    • Download additional information
  • Operational concept
Browse and search Add new document OAI-PMH interface
JavaScript is disabled for your browser. Some features of this site may not work without it.

Download PDF
Download full text

(1.224Mb)

Citation Suggestion

Please use the following Persistent Identifier (PID) to cite this document:
https://nbn-resolving.org/urn:nbn:de:0168-ssoar-96545-7

Exports for your reference manager

Bibtex export
Endnote export

Display Statistics
Share
  • Share via E-Mail E-Mail
  • Share via Facebook Facebook
  • Share via Bluesky Bluesky
  • Share via Reddit reddit
  • Share via Linkedin LinkedIn
  • Share via XING XING

Retrievability in an integrated retrieval system: an extended study

[journal article]

Roy, Dwaipayan
Carevic, Zeljko
Mayr, Philipp

Abstract

Retrievability measures the influence a retrieval system has on the access to information in a given collection of items. This measure can help in making an evaluation of the search system based on which insights can be drawn. In this paper, we investigate the retrievability in an integrated search ... view more

Retrievability measures the influence a retrieval system has on the access to information in a given collection of items. This measure can help in making an evaluation of the search system based on which insights can be drawn. In this paper, we investigate the retrievability in an integrated search system consisting of items from various categories, particularly focussing on datasets, publications and variables in a real-life digital library. The traditional metrics, that is, the Lorenz curve and Gini coefficient, are employed to visualise the diversity in retrievability scores of the three retrievable document types (specifically datasets, publications, and variables). Our results show a significant popularity bias with certain items being retrieved more often than others. Particularly, it has been shown that certain datasets are more likely to be retrieved than other datasets in the same category. In contrast, the retrievability scores of items from the variable or publication category are more evenly distributed. We have observed that the distribution of document retrievability is more diverse for datasets as compared to publications and variables.... view less


Die Wiederauffindbarkeit misst den Einfluss eines Retrievalsystems auf den Zugang zu Informationen in einer bestimmten Sammlung von Elementen. Dieses Maß kann dabei helfen, eine Bewertung des Suchsystems vorzunehmen, auf deren Grundlage Erkenntnisse gewonnen werden können. In diesem Beitrag untersuc... view more

Die Wiederauffindbarkeit misst den Einfluss eines Retrievalsystems auf den Zugang zu Informationen in einer bestimmten Sammlung von Elementen. Dieses Maß kann dabei helfen, eine Bewertung des Suchsystems vorzunehmen, auf deren Grundlage Erkenntnisse gewonnen werden können. In diesem Beitrag untersuchen die Autor*innen die Auffindbarkeit in einem integrierten Suchsystem, das aus Elementen aus verschiedenen Kategorien besteht, wobei sie sich insbesondere auf Datensätze, Publikationen und Variablen in einer realen digitalen Bibliothek konzentrieren. Die traditionellen Metriken, d.h. die Lorenz-Kurve und der Gini-Koeffizient, werden verwendet, um die Unterschiede in den Auffindbarkeitswerten der drei auffindbaren Dokumenttypen (insbesondere Datensätze, Publikationen und Variablen) zu visualisieren. Die Ergebnisse zeigen eine signifikante Verzerrung der Popularität, wobei bestimmte Elemente häufiger abgerufen werden als andere. Es hat sich insbesondere gezeigt, dass bestimmte Datensätze mit größerer Wahrscheinlichkeit abgerufen werden als andere Datensätze derselben Kategorie. Im Gegensatz dazu sind die Abrufbarkeitswerte von Elementen aus der Kategorie der Variablen oder Veröffentlichungen gleichmäßiger verteilt. Die Autor*innen konnten feststellen, dass die Verteilung der Auffindbarkeit von Dokumenten für Datensätze im Vergleich zu Veröffentlichungen und Variablen unterschiedlicher ist.... view less

Keywords
information retrieval; information system

Classification
Information and Documentation, Libraries, Archives

Free Keywords
Retrievability; Dataset retrieval; Interactive IR; Diversity

Document language
English

Publication Year
2024

Page/Pages
p. 287-301

Journal
International Journal on Digital Libraries, 25 (2024) 2

Issue topic
Special Issue on Selected Papers from the Joint Conference on Digital Libraries (JCDL 2021 and 2022)

DOI
https://doi.org/10.1007/s00799-023-00363-4

ISSN
1432-1300

Status
Published Version; peer reviewed

Licence
Creative Commons - Attribution 4.0

FundingFunded by the German Research Foundation (DFG) - Grant MA 3964/10-1, the "Establishing Contextual Dataset Retrieval - transferring concepts from document to dataset retrieval" (ConDATA) project at GESIS


GESIS LogoDFG LogoOpen Access Logo
Home  |  Legal notices  |  Operational concept  |  Privacy policy
© 2007 - 2025 Social Science Open Access Repository (SSOAR).
Based on DSpace, Copyright (c) 2002-2022, DuraSpace. All rights reserved.
 

 


GESIS LogoDFG LogoOpen Access Logo
Home  |  Legal notices  |  Operational concept  |  Privacy policy
© 2007 - 2025 Social Science Open Access Repository (SSOAR).
Based on DSpace, Copyright (c) 2002-2022, DuraSpace. All rights reserved.