Was ist das RIS-Dateiformat?
Eine .ris-Datei enthält Informationen zu zitierten Publikationen oder Verweise auf diese, gespeichert im Textformat, das von Research Information Systems in den frühen 1990er Jahren entwickelt wurde. Das Format wurde geschaffen, um den Datenaustausch zwischen verschiedenen Literaturverwaltungsprogrammen zu standardisieren, und ist heute eng mit Clarivate und EndNote verbunden. Es verwendet eine für Menschen lesbare Syntax und kann mit jedem Texteditor geöffnet werden. Eine einzelne .ris-Datei kann Informationen zu einer oder mehreren Publikationen enthalten. Jede in .ris-Dateien referenzierte Publikation muss mit zwei erforderlichen Tags versehen werden:
TY- Art der Publikation,ER- Ende des Datensatzes, signalisiert den Übergang zur nächsten Publikation.
Das Format basiert auf einer 6-Zeichen-Struktur für jede neue Zeile. Die ersten beiden Zeichen definieren den Feldtyp (Tag), die nächsten zwei sind Leerzeichen, gefolgt von einem Bindestrich und einem Leerzeichen. Jede Zeile muss mit MS-Windows-Zeilenendezeichen enden - CR und LF. Es gibt verschiedene Typen von Tags in .ris-Dateien, zum Beispiel:
AU,A1,A2,A3,A4- Autoren der Publikation,AB- ein Abstract,L1,L2,L3- verschiedene Arten von Links,SP,EP- Start- und Endseitenzahlen,TI,T1,T2,T3,TT- Titel,VL- Bandnummer,Y1,Y2- Datumsangaben.
Einige Tags unterliegen Längenbeschränkungen oder Einschränkungen hinsichtlich des Datentyps, aber es gibt keine Einschränkungen bei der Tag-Reihenfolge. Für Publikationstypen können die in der Spezifikation aufgeführten Kürzel verwendet werden - etwa JOUR für einen Zeitschriftenartikel oder BOOK für eine Monografie. Viele Anwendungen und Systeme nutzen .ris-Zitationsdateien, darunter digitale Bibliotheken und Bibliothekskataloge. Das Format ist eng verwandt mit .BIB (BibTeX) und .ENW (EndNote-Export), die in wissenschaftlichen Arbeitsabläufen ähnliche Zwecke erfüllen.
Sicherheit
RISIKO: LOWRIS-Dateien sind reiner Text-Metadaten - kein Code, keine Makros, praktisch kein direktes Risiko. Die einzigen praktischen Bedenken sind hygienischer Natur: Ein URL-Feld kann auf beliebige Ziele zeigen (Literaturverwaltungsprogramme öffnen sie nicht automatisch), und Zitationsdateien aus nicht vertrauenswürdigen Quellen können schlicht falsche oder Spam-Metadaten enthalten. Sicher in jedem Texteditor zu öffnen.
Formatdetails
kurz gefasstProgramme zum Öffnen von RIS-Dateien
Technische Details
technische Spezifikation| Dateityp | Klartextformat mit Tags für bibliografische Daten; vollständig für Menschen lesbar, keine binären Abschnitte |
| Tag-Struktur | Jeder Tag besteht aus zwei Großbuchstaben im ASCII-Format, gefolgt von zwei Leerzeichen, einem Bindestrich und einem Leerzeichen (z. B. `TY - `, `AU - `) |
| Pflichtbeginn eines Datensatzes | Jeder Datensatz muss mit dem `TY`-Tag beginnen, der den Referenztyp angibt (z. B. `TY - JOUR`), als allererstes Feld |
| Datensatzabschluss | Jeder Datensatz endet mit `ER - ` auf einer eigenen Zeile; üblicherweise folgt eine Leerzeile vor dem nächsten Datensatz |
| Zeilenenden | Die Spezifikation erfordert Windows-CRLF-Zeilenenden; moderne Parser akzeptieren in der Regel auch Unix-LF |
| MIME-Typ | `application/x-research-info-systems` |
| Referenztyp-Codes | Über 40 standardisierte `TY`-Werte, darunter `JOUR` (Zeitschriftenartikel), `BOOK` (Buch), `CONF` (Konferenzbeitrag), `THES` (These), `CHAP` (Buchkapitel), `RPRT` (Bericht) |
| Autorenfelder | Mehrere Autoren-Tags unterstützt - `AU`, `A1` (primär), `A2` (sekundär), `A3` (tertiär), `A4` (untergeordnet); ein Autor pro Tag-Zeile |
| Unterstützung mehrerer Datensätze | Eine einzelne `.ris`-Datei kann beliebig viele Referenzdatensätze enthalten, jeder durch sein eigenes `TY`/`ER`-Paar begrenzt |
| Tag-Reihenfolge | Keine Pflicht-Reihenfolge für Tags innerhalb eines Datensatzes, außer dass `TY` zuerst und `ER` zuletzt erscheinen muss |
| URL- und Linkfelder | `L1` speichert einen lokalen Dateipfad oder URL, `L2` eine Volltext-URL, `L3` eine verwandte URL; alle drei können mehrfach pro Datensatz erscheinen |
| Datumsdarstellung | Datumsangaben in den Tags `Y1` und `Y2` nach dem Muster `YYYY/MM/DD/other`; Monat, Tag und die vierte Freitextkomponente sind optional |
| Fortsetzung von Abstracts | Das `AB`-Tag unterstützt mehrzeilige Abstracts; Fortsetzungszeilen beginnen gemäß der ursprünglichen Spezifikation mit sechs führenden Leerzeichen |
| Dateiidentifizierung | Keine Magic Bytes oder Binärkopf; Dateien werden am Inhaltsmuster `TY - ` am Anfang des ersten Datensatzes erkannt |
| Zeichenkodierung | Die ursprüngliche Spezifikation setzte ASCII/ANSI voraus; aktuelle Implementierungen exportieren und importieren häufig UTF-8 zur Unterstützung nicht-lateinischer Schriften |
| Interoperabilität | Nativer Import/Export unterstützt von EndNote, Zotero, Mendeley, JabRef, Web of Science, PubMed, Google Scholar und den meisten institutionellen Repositorien |
| Veröffentlicht | Early 1990s (Reference Manager, Research Information Systems); publicly documented tag set, no formal standards body |
| Offener Standard | Ja · lizenzgebührenfrei |
| Spezifikation | en.wikipedia.org |