scieee AI-readable full text Open interactive document viewer

OER-Repositorien für Data Literacy: Analysen und Befunde

Kehrein, Paul; Geiger, Jonathan D.; Hahn, Constanze; Kleinhans, Agnes; Xia, Ning

Abstract

Die Landschaft des Forschungsdatenmanagements (FDM) in Deutschland ist groß und sehr verzweigt. Zahlreiche FDM-Projekte, insbesondere die Konsortien der Nationalen Forschungsdateninfrastruktur (NFDI), Landesinitiativen, Datenkompetenzzentren und viele weitere mehr erstellen und kuratieren Schulungsmaterialien zu FDM und Data Literacy. Diese Materialien werden in der Regel im Rahmen der Projekte als Open Educational Resources (OER) veröffentlicht. Die Publikation erfolgt meist in eigenen Repositorien, wodurch eine Vielzahl solcher Repositorien entstanden ist. Für die Nutzenden von OER ist dies allerdings eine herausfordernde Situation: Da keine Repositorien-übergreifende Suche existiert, sind effiziente Such- und Orientierungsprozesse erschwert. Das DALIA-Projekt hat daher speziell für den Bereich FDM- und Data-Literacy-OER eine Webplattform entwickelt, die eine zentrale Suche und Auffindbarkeit von Materialien ermöglicht. Um einen Überblick über die Vielzahl der existierenden Repositorien und deren Funktionen zu erhalten, wurde eine Analyse von 86 Repositorien durchgeführt. Die Ergebnisse dieser Untersuchung werden im vorliegenden Beitrag vorgestellt.

Full text

DALIA Datenanalyse von OER-Repositorien für Data Literacy Abstract Die Landschaft des Forschungsdatenmanagements (FDM) in Deutschland ist groß und sehr verzweigt. Zahlreiche FDM-Projekte, insbesondere die Konsortien der Nationalen Forschungsdateninfrastruktur (NFDI), Landesinitiativen, Datenkompetenzzentren und viele weitere mehr erstellen und kuratieren Schulungsmaterialien zu FDM und Data Literacy. Diese Materialien werden in der Regel im Rahmen der Projekte als Open Educational Resources (OER) veröffentlicht. Die Publikation erfolgt meist in eigenen Repositorien, wodurch eine Vielzahl solcher Repositorien entstanden ist. Für die Nutzenden von OER ist dies allerdings eine herausfordernde Situation: Da keine Repositorien-übergreifende Suche existiert, sind effiziente Suchund Orientierungsprozesse erschwert. Das DALIA-Projekt hat daher speziell für den Bereich FDMund Data-Literacy-OER eine Webplattform entwickelt, die eine zentrale Suche und Auffindbarkeit von Materialien ermöglicht. Um einen Überblick über die Vielzahl der existierenden Repositorien und deren Funktionen zu erhalten, wurde eine Analyse von 86 Repositorien durchgeführt. Die Ergebnisse dieser Untersuchung werden im vorliegenden Beitrag vorgestellt. Hintergrund Datenkompetenzen sind essentiell im Studium und in der Forschung für den Umgang mit Forschungsdaten. Dazu gehören zum Beispiel das Erheben, Analysieren, Dokumentieren und Veröffentlichen dieser Daten (vgl. Schüller und Busch 2019). Viele Institutionen und Projekte haben bereits Open Educational Resources (OER) entwickelt, die Kompetenzen im Umgang mit Forschungsdaten vermitteln. Diese OER sollen nachgenutzt werden und stehen daher öffentlich zugänglich zur Verfügung. Doch wo genau sind diese Materialien abgelegt und welche technischen und funktionalen Zugriffsoptionen bieten die jeweiligen Repositorien? Hierbei besteht bislang eine Lücke in den Untersuchungen: Während sich viele Studien mit der Erstellung und Nutzung von OER beschäftigen (vgl. beispielsweise Deimann, Neumann und Muuß-Merholz 2015; Otto 2021), fehlt es an systematischen Analysen der Repositorien und ihrer Funktionalitäten selbst. An dieser Stelle setzt das Projekt DALIA an. Es baut eine Registratur (“Referatorium”) und ein Suchsystem für Lehrund Lernmaterialien zu Forschungsdatenmanagement und Data Literacy auf. Ein wichtiger Bestandteil der Projektarbeit von DALIA war die Analyse dieser bereits bestehenden Repositorien, die entsprechende Materialien enthalten. Ziel war es, einen Überblick über die Ausgangssituation zu gewinnen, die aktuelle Repositorienlandschaft zu erfassen und auf Grundlage der Repositorienanalyse Anforderungen für die Entwicklung der DALIA-Plattform selbst abzuleiten. Dazu wurden zunächst die Repositorien von einschlägigen Einrichtungen, darunter die Konsortien der 2 DALIA Datenanalyse von OER-Repositorien für Data Literacy Nationalen Forschungsdateninfrastruktur (NFDI), der Datenkompetenzzentren und nationalen (Landes-)Initiativen, im Jahre 2024 gesichtet und in einer Liste zusammengestellt. Dies geschah sowohl in manueller Recherchearbeit als auch im Anschluss an verschiedene DALIA-Workshops und im Austausch mit verschiedenen Akteur*innen im Bereich Forschungsdatenmanagement, in denen weitere Repositorien der Projekte gesammelt wurden. Daraus ergab sich eine Übersicht von 86 Repositorien verschiedenster Art, darunter projekteigene Webseiten, Zenodo-Communitys, YouTube-Kanäle mit Lernvideos sowie GitHubund GitLab-Repositorien. Im Rahmen der Analyse wurde ein Schema entwickelt, um eine Reihe von Eigenschaften bzw. Metadaten der Repositorien systematisch zu erfassen. Die Kategorien und Attribute dieses Schemas lauten wie folgt: ● basic meta information ○ repository name ○ link ○ NFDI consortium / RDM network ○ repository type ○ infrastructure ○ access ○ volume ● quality and curation ○ feedback options ○ metadata standards ○ quality criteria ● technology and functionalities ○ statistical data ○ user features ○ API Die Vollständigkeit der erhobenen Metadaten variiert deutlich zwischen den Kategorien. Angaben wie die Zugehörigkeit zu NFDI-Konsortien, Art des Repositoriums oder vorhandene Feedback-Optionen ließen sich für die meisten oder sogar alle Repositorien im Rahmen der DALIA-Projektarbeit ermitteln und bieten daher eine solide Grundlage für die Analyse. Andere Metadaten, wie zum Beispiel die verwendeten Metadatenstandards, waren hingegen nur bei einem kleinen Teil der Repositorien verfügbar, da nur wenige eine entsprechende Dokumentation dieser veröffentlicht haben. Aufgrund dieser lückenhaften Datenbasis wurden diese Merkmale in der Analyse nicht oder lediglich am Rande berücksichtigt. Ergebnisse der Analyse Die Kategorie “basic meta information” umfasst die grundlegenden Eigenschaften und Strukturen der untersuchten Repositorien. Bei der Mehrheit von 58 Repositorien handelt es sich um Sammlungen bzw. Sammelstellen von Materialien, in denen die Materialien direkt gehostet werden, 20 3 DALIA Datenanalyse von OER-Repositorien für Data Literacy Repositorien enthalten lediglich Verweise auf externe Lernressourcen (“Referatorium”) und acht Repositorien stellen eine Mischform aus Material-Hosting und Verweisen dar (siehe Abbildungen 1 und 2). Abbildung 1: Typenverteilung der analysierten Repositorien als Säulendiagramm (Bildquelle: eigene Darstellung). Abbildung 2: Typenverteilung der analysierten Repositorien als Tortendiagramm (Bildquelle: eigene Darstellung). 4 DALIA Datenanalyse von OER-Repositorien für Data Literacy Bezüglich der zugrundeliegenden Infrastrukturanbieter sind die meisten Repositorien auf Plattformen wie Zenodo, YouTube oder GitHub angesiedelt. Dabei sind Zenodo-Communitys mit 19 Repositorien und YouTube-Kanäle mit 15 Repositorien am häufigsten vertreten (siehe Abbildungen 3 und 4). Dies verdeutlicht die zentrale Rolle von Plattformen wie Zenodo für das Hosting von OER. Hinsichtlich der Zugänglichkeit sind fast alle Repositorien offen zugänglich (Open Access), d. h. alle 86 Repositorien. Lediglich vier verlangen eine Registrierung, und zwei Repositorien enthalten neben offenen Lernressourcen auch solche Inhalte, die nur über einen kostenpflichtigen Zugang abrufbar sind. In Summe beinhalten diese Repositorien fast zehntausend Lernressourcen, wobei zu beachten ist, dass bei etwa einem Drittel (29 Repositorien) keine Daten zur Anzahl der enthaltenen Lernressourcen vorlagen, sodass die tatsächliche Summe deutlich höher sein dürfte. Abbildung 3: Infrastrukturen der Repositorien als Säulendiagramm (Bildquelle: eigene Darstellung). 5 DALIA Datenanalyse von OER-Repositorien für Data Literacy Abbildung 4: Infrastrukturen der Repositorien als Tortendiagramm und ohne fehlende Angaben (Bildquelle: eigene Darstellung). Die Kategorie “quality and curation” umfasst den Bereich des Qualitätsmanagements der Repositorien, einschließlich Feedbackoptionen, der Verwendung von Metadatenstandards sowie die Verwendung expliziter Qualitätskonzepte. Für 19 Repositorien konnten hinsichtlich der Möglichkeiten für Feedback keine Daten erhoben werden. Die übrigen Repositorien bieten überwiegend Kontaktmöglichkeiten, viele auch Kommentarfunktionen oder die Möglichkeit, Issues oder Helpdesk-Tickets anzulegen (siehe Abbildungen 5 und 6). 6 DALIA Datenanalyse von OER-Repositorien für Data Literacy Abbildung 5: Feedbackmöglichkeiten der Repositorien als Säulendiagramm (Bildquelle: eigene Darstellung). Abbildung 6: Feedbackmöglichkeiten der Repositorien als Tortendiagramm (Bildquelle: eigene Darstellung). 7 DALIA Datenanalyse von OER-Repositorien für Data Literacy Bezüglich der Verwendung von Metadatenstandards konnte lediglich bei fünf Repositorien die Verwendung von standardisierten Vokabularen festgestellt werden. Die meisten Repositorien verwenden eigene, oft nicht dokumentierte Begriffsstandards, um Filtermöglichkeiten innerhalb des Repositoriums bereitzustellen; diese sind dadurch de facto aber nicht mit anderen Standards kompatibel. Hinsichtlich der Kuratierungskonzepte verfügen 24 Repositorien (ca. 27 %) über ein explizites Konzept. Die Analyse von Metadaten der Kategorie “technology and functionalities” dient dazu, die Bandbreite und Verbreitung technischer Funktionalitäten festzustellen. Statistische Features fanden sich in ca. 52 % (45 Repositorien), wobei Kennzahlen zu Views und Downloads am häufigsten implementiert sind, gefolgt von Likes und Dislikes. Weitere statistische Funktionalitäten wie zum Beispiel Ratings oder Zitationsraten sind hingegen deutlich seltener vorhanden (siehe Abbildungen 7 und 8). Abbildung 7: Statistische Funktionalitäten der Repositorien als Säulendiagramm (Bildquelle: eigene Darstellung). 8 DALIA Datenanalyse von OER-Repositorien für Data Literacy Abbildung 8: Statistische Funktionalitäten der Repositorien als Tortendiagramm (Bildquelle: eigene Darstellung). Neben statistischen Werten bieten viele Repositorien auch weitere Funktionen für Nutzer*innen an. Bei 15 der untersuchten Repositorien (knapp 17 %) konnten hierzu keine Daten erhoben werden und bei sieben Repositorien (ca. 8 %) ließen sich keine zusätzlichen Funktionalitäten für Nutzer*innen feststellen. Die Mehrheit der Repositorien wies dagegen eine sehr breite Palette an zusätzlichen Funktionalitäten auf, darunter die Möglichkeit, einem Thema oder den Ersteller*innen zu folgen, eine Ressource zu zitieren, diese zu speichern oder herunterzuladen und weitere mehr (siehe Abbildungen 9 und 10). Einige Repositorien schlagen außerdem weitere Inhalte vor (Empfehlungssysteme), die sich nach Auswahl (ähnliche OER wie die vom User ausgewählte), Ressource des Monats, Beliebtheit, Kompetenzniveau und Neueingängen unterscheiden. “Workspace” bezeichnet hier die Möglichkeit, direkt im Repositorium Code auszuführen (siehe Abbildungen 9 und 10). 9