Fiktionale Texte sind aufgrund hoher Lizenz- und Aufbereitungskosten in den gängigen deutschen Referenzkorpora stark unterrepräsentiert. Text+ schafft mit DeLiKo-XL@DNB einen möglichen Ausweg aus diesem Dilemma. Darin erschließt die Deutsche Nationalbibliothek (DNB) zusammen mit dem Leibniz-Institut für Deutsche Sprache (IDS) erstmals einen umfangreichen Bestand für die Forschung.
Mit 287 585 fiktionalen Publikationen umfasst das Korpus alle deutschen im EPUB-Format veröffentlichten belletristischen E-Books zwischen 2012 und 2024 sowie alle 362 digital verfügbaren Titel, die jemals für den Deutschen Buchpreis nominiert waren – insgesamt sind das 20,9 Milliarden Token (Wörter und Satzzeichen).
Mit der Korpus-Analyseplattform KorAP kann das Korpus auf vielfältige Weise genutzt werden. Möglich sind zum Beispiel die flexible, metadatenbasierte Erstellung virtueller Unterkorpora, mehrschichtige Annotationen, komplexe Suchanfragen in sechs Sprachen (u. a. CQP). Dabei unterstützt ein Anfrage Assistent das Formulieren von Suchanfragen und eine Query by Example-Funktion das Auffinden komplexer Konstruktionen anhand von Beispielen. Für die praktische Anwendung bieten R- und Python-Bibliotheken sowie Video-Tutorials der Universität Mannheim einen niederschwelligen Einstieg.
Möglich wurde diese Nutzbarmachung durch die Einführung der Urheberrechtsschranke §60d UrhG, die Text-und-Data-Mining zu wissenschaftlichen Zwecken erlaubt. Auf dieser rechtlichen Grundlage und unter der Voraussetzung, dass die Volltexte, deren Annotation und die KorAP-Instanz stets in der Infrastruktur der DNB verbleiben, können Forschende ohne Anmeldung das Korpus frei und online durchsuchen und analysieren. Die einzige Einschränkung ist ein Kontext von 50 Wörtern pro Suchtreffer.
Zum DeLiKo-Korpus:
KorAP-Quellcode:
Andere Beiträge
Bereitstellung von DMP Services für die Agrosystemforschung: DMP4NFDI in FAIRagro (Base4NFDI)
FAIRagro-DMP-Service stärkt Forschungsdatenmanagement in der Agrosystemforschung
FAIRagro hat gemeinsam mit DMP4NFDI einen umfassenden Service für Datenmanagementpläne (DMPs) in der Agrosystemforschung entwickelt. Basierend auf dem Open-Source-Tool RDMO stellt der Dienst ein disziplinspezifisches DMP-Template mit Hilfetexten, Antwortvorschlägen und direkter Anbindung an den FAIRagro-Helpdesk bereit. Der Service unterstützt Forschende bei der Einhaltung von Fördervorgaben, fördert gute wissenschaftliche Praxis und verbessert die Auffindbarkeit, Zugänglichkeit und Wiederverwendbarkeit von Forschungsdaten gemäß den FAIR-Prinzipien. Das Angebot entstand im Rahmen mehrerer gemeinsamer Inkubatorprojekte mit DMP4NFDI und wird kontinuierlich weiterentwickelt, unter anderem durch die Integration kontrollierter Vokabulare in Zusammenarbeit mit TS4NFDI.
Wie eine Studie aus NFDI4Health den EHDS mitgestaltet
NFDI4Health gestaltet den European Health Data Space
Mit wissenschaftlicher Evidenz unterstützt NFDI4Health die Entwicklung des European Health Data Space (EHDS) und trägt zu interoperablen Standards für Gesundheitsdaten sowie einer stärkeren Gesundheitsforschung in Europa bei.
Humanities@NFDI: Gemeinsam für nachhaltige Forschungsdaten
Fächerübergreifende Kooperation für den Erhalt des kulturellen Erbes
Die Humanities@NFDI-Initiative vereint vier NFDI-Konsortien, um Forschungsdaten aus den Geistes- und Kulturwissenschaften nachhaltig zugänglich und nachnutzbar zu machen. Durch gemeinsame Standards, Vokabulare und Community-Formate stärkt die Zusammenarbeit die Vernetzung und schafft die Grundlage für interdisziplinäre Forschung.
Recent Comments