Wikipedia · einfach zusammengefasst · Stand
RIS (Dateiformat)
RIS (Research Information Systems) ist ein standardisiertes Dateiformat für die Literaturverwaltung, insbesondere für den Export und Import …
Inhalt6 Abschnitte
Zweck und Verbreitung
RIS (Research Information Systems) ist ein standardisiertes Textdateiformat für den Austausch bibliographischer Daten zwischen Literaturverwaltungsprogrammen. Es dient insbesondere dazu, Angaben zu Büchern, Aufsätzen und anderen Quellen zu exportieren, zu speichern und anschließend in ein anderes Programm zu importieren. RIS gilt als das älteste und benutzerfreundlichste Austauschformat dieser Programmklasse und wird weltweit verwendet.
Unterstützt wird RIS von zahlreichen Bibliotheksprogrammen, digitalen Bibliotheken und Online-Katalogen. Zu den genannten Angeboten gehören Web of Science, Springer Nature, Scopus, das ACM-Portal, ScienceDirect und Accordance Bible Software. Auch Titeldatensätze aus dem frei zugänglichen Gemeinsamen Verbundkatalog (GVK) des Gemeinsamen Bibliotheksverbunds (GBV) lassen sich als RIS-Dateien auf einem lokalen Rechner speichern. Die Deutsche Nationalbibliothek bietet dagegen keinen RIS-Export an.
Entstehung
Das Format entstand im Zusammenhang mit dem Literaturverwaltungsprogramm Reference Manager, kurz RefMan. Dieses wurde ab 1983 von dem deutsch-amerikanischen Hämatologen Ernest Beutler und seinem Sohn Earl, einem IT-Spezialisten, entwickelt. Damit begründeten sie die Klasse der professionellen Literaturverwaltungsprogramme. Die Abkürzung RIS geht auf den Namen ihrer Firma Research Information Systems zurück.
RefMan gehörte zuletzt zum Medienkonzern Thomson Reuters. Dieser beendete 2008 die Weiterentwicklung und stellte 2015 den Verkauf ein, um sich auf das Literaturverwaltungsprogramm EndNote zu konzentrieren. Das RIS-Format blieb davon unabhängig als Austauschformat in Gebrauch.
Aufbau einer RIS-Datei
Eine RIS-Datei ist eine Textdatei aus einzelnen Datenzeilen. Jede Zeile enthält zuerst einen vordefinierten Feldnamen, den sogenannten Tag. Ein Tag besteht aus zwei Großbuchstaben. Darauf folgen zwei Leerzeichen, ein Bindestrich und ein weiteres Leerzeichen; anschließend steht der Feldwert. Eine typische Zeile lautet beispielsweise „AU - Einstein, Albert“.
Der erste Eintrag eines Datensatzes muss der Tag TY sein. Er legt den Dokument- oder Literaturtyp fest; sein Wert muss aus einer vorgegebenen Liste gewählt werden. Der letzte Eintrag muss ER sein, der das Ende des Datensatzes kennzeichnet. Eine Datei kann einen oder mehrere Datensätze enthalten. Nach den Vorgaben stehen zwischen mehreren Datensätzen keine zusätzlichen Leerzeilen. Manche Programme, darunter Citavi, fügen beim Export dennoch eine Leerzeile ein und akzeptieren beim Import auch mehrere Leerzeilen.
Jede Zeile soll nach der bei IBM-PC-kompatiblen Computern sowie unter DOS oder Windows üblichen Konvention mit zwei ASCII-Zeichen enden: Wagenrücklauf (carriage return) und Zeilenvorschub (line feed). Unter UNIX wird ein Zeilenende normalerweise nur durch den Zeilenvorschub markiert; dies muss beim Erstellen oder Verarbeiten einer RIS-Datei beachtet werden.
Tags und Literaturtypen
Die Reihenfolge der Tags zwischen TY und ER ist beliebig. Die meisten Tags dürfen innerhalb eines Zitats nur einmal vorkommen. Wiederholt werden dürfen insbesondere AU, A1, A2 und weitere Autorenfelder, außerdem KW für Schlüsselwörter und UR für URLs. Bei mehreren Autoren, Schlüsselwörtern oder URLs steht jeder Wert in einer eigenen Datenzeile.
Wichtige Tags sind unter anderem: TY für den Referenztyp, T1 für den Haupttitel, TI für den Buchtitel, AU für einen Autor in der Form „Nachname, Vorname, Namenszusatz“, A1 für den Hauptautor, A2 für einen Nebenautor und A4 für einen Übersetzer. PY bezeichnet das Veröffentlichungsdatum beziehungsweise -jahr im Format YYYY/MM/DD. SP und EP stehen für Anfangs- und Endseite, VL für die Bandnummer und IS für die Heftnummer. JO, JF, JA, J1 und J2 enthalten unterschiedliche Angaben zum Periodikum beziehungsweise zur Zeitschrift. CY bezeichnet den Publikationsort, PB den Verlag, SN die ISSN oder ISBN, N1 Anmerkungen, N2 eine Zusammenfassung, UR eine Webadresse, L1 einen PDF-Link und L2 einen Volltext-Link.
Die Bedeutung eines Tags kann vom Dokumenttyp abhängen. Bei einem herausgegebenen Buch des Typs EDBOOK steht AU beispielsweise für den Herausgeber. Einige Programme verwenden einzelne Tags zudem in eigener Bedeutung. Ein strenges Standardisierungsgremium fehlt. Trotzdem lassen sich die bibliographischen Angaben der meisten Monographien, Sammelwerke und Zeitschriftenaufsätze eindeutig und übersichtlich darstellen.
Der in TY angegebene Literaturtyp wird durch einen festgelegten Code bezeichnet. Häufige Typen sind BOOK für ein vollständiges Buch, CHAP für ein Buchkapitel, EDBOOK für ein herausgegebenes Buch, JOUR für eine Zeitschrift beziehungsweise einen Zeitschriftenbeitrag, MGZN für einen Magazinartikel, NEWS für eine Zeitung, CONF für einen Konferenzband, THES für eine Abschlussarbeit oder Dissertation, RPRT für einen Bericht und PAT für ein Patent. Weitere Typen erfassen unter anderem Abstracts (ABST), audiovisuelle Materialien (ADVS), Kunstwerke (ART), Computerprogramme (COMP), Kataloge (CTLG), Datendateien (DATA), elektronische Zitate (ELEC), Karten (MAP), Filme (MPCT), Musiknoten (MUSIC), persönliche Mitteilungen (PCOMM), Tonaufnahmen (SOUND), unveröffentlichte Arbeiten (UNPB) und Videoaufnahmen (VIDEO). GEN dient als allgemeiner Typ.
Typische Datensätze
Ein RIS-Datensatz für Albert Einsteins Zeitschriftenaufsatz „Die Grundlage der allgemeinen Relativitätstheorie“ beginnt mit „TY - JOUR“. Danach folgen „TI - Die Grundlage der allgemeinen Relativitätstheorie“, „AU - Einstein, Albert“ und „PY - 1916“. Die Seiten werden mit „SP - 769“ und „EP - 822“, die Zeitschrift mit „JO - Annalen der Physik“ und der Band mit „VL - 49“ angegeben. „ER -“ beendet den Datensatz.
Eine Datei kann unmittelbar danach einen weiteren Datensatz enthalten. Der Aufsatz „Zur Elektrodynamik bewegter Körper“ wird ebenfalls als JOUR erfasst, mit dem Autor Albert Einstein, dem Jahr 1905, den Seiten 891–921, der Zeitschrift „Annalen der Physik“ und dem Band 17. Jeder der beiden Datensätze besitzt sein eigenes TY am Anfang und ER am Ende.
Vergleich mit ENW und BIB
RIS, ENW von EndNote und BIB von BibTeX sind textbasierte Austauschformate. Meist tragen ihre Dateien die Endungen .ris, .enw beziehungsweise .bib; gelegentlich wird für alle drei auch .txt verwendet. Sie speichern ähnliche bibliographische Informationen, verwenden aber unterschiedliche Schreibweisen und Strukturen.
Beim Beispiel „Christoph Hein: Das Narrenschiff: Roman. 1. Auflage. Suhrkamp, Berlin 2025, ISBN 978-3-518-43226-6 (750 S.)“ beginnt RIS mit „TY - BOOK“ und endet mit „ER -“. Autor, Titel, Untertitel, Jahr, Verlag, Ort, Seitenzahl, Auflage und ISBN werden unter anderem durch AU, T1, T4, PY, PB, CY, SP, ET und SN gekennzeichnet. ENW stellt Felder dagegen mit Prozentzeichen dar, etwa „%A“ für den Autor und „%T“ für den Titel. BibTeX verwendet einen geklammerten Eintrag wie „@book{Hein.2025, ...}“ und ausgeschriebene Feldnamen wie author, title, year, publisher, address, pages, edition und isbn.