Co to jest format pliku RIS?
Plik .ris zawiera informacje o cytowanych publikacjach lub odniesienia do nich, zapisane w formacie tekstowym opracowanym przez Research Information Systems na początku lat 90. Format ten został stworzony w celu standaryzacji wymiany danych między różnymi narzędziami do zarządzania cytowaniami i jest obecnie szeroko kojarzony z firmą Clarivate oraz programem EndNote. Wykorzystuje on składnię czytelną dla człowieka i może być otwarty za pomocą dowolnego edytora tekstu. Pojedynczy plik .ris może zawierać informacje o jednej lub wielu publikacjach. Każda publikacja wymieniona w plikach .ris musi być oznaczona za pomocą dwóch wymaganych tagów:
TY- typ publikacji,ER- koniec rekordu (end of record), sygnalizujący przejście do następnej publikacji.
Format opiera się na 6-znakowej strukturze dla każdej nowej linii. Pierwsze dwa znaki definiują typ pola (tag), kolejne dwa to spacje, po których następuje łącznik i spacja. Każda linia musi kończyć się znakami nowej linii systemu MS Windows - CR i LF. W plikach .ris stosuje się różne rodzaje tagów, na przykład:
AU,A1,A2,A3,A4- autorzy danej publikacji,AB- abstrakt,L1,L2,L3- różne rodzaje linków,SP,EP- numery stron początkowej i końcowej,TI,T1,T2,T3,TT- tytuły,VL- numer tomu,Y1,Y2- daty.
Niektóre tagi są ograniczone limitami długości lub typem danych, które mogą zawierać, ale nie ma restrykcji co do kolejności tagów. W przypadku typów publikacji można używać skrótów wymienionych w specyfikacji - takich jak JOUR dla artykułu w czasopiśmie lub BOOK dla monografii. Wiele aplikacji i systemów korzysta z plików cytowań .ris, w tym biblioteki cyfrowe i katalogi biblioteczne. Format ten jest ściśle powiązany z .BIB (BibTeX) oraz .ENW (eksport EndNote), które służą do podobnych celów w pracy naukowej.
Bezpieczeństwo
RYZYKO: LOWPliki RIS to metadane w formacie tekstowym - nie zawierają kodu ani makr, co oznacza praktycznie zerowe bezpośrednie ryzyko. Jedyne obawy dotyczą higieny cyfrowej: pole URL może prowadzić do dowolnej strony (menedżery bibliografii nie otwierają ich automatycznie), a pliki cytowań z niezaufanych źródeł mogą zawierać błędne lub spamerskie metadane. Bezpieczne do otwarcia w dowolnym edytorze tekstu.
Szczegóły formatu
w pigułceProgramy otwierające pliki RIS
Szczegóły techniczne
specyfikacja| Typ pliku | Tagowany format bibliograficzny w formie zwykłego tekstu; w pełni czytelny dla człowieka, bez sekcji binarnych |
| Struktura tagów | Każdy tag to dwie wielkie litery ASCII, po których następują dwie spacje, łącznik i spacja (np. `TY - `, `AU - `) |
| Obowiązkowy początek rekordu | Każdy rekord musi zaczynać się od tagu `TY` określającego typ odniesienia (np. `TY - JOUR`) jako pierwsze pole |
| Terminator rekordu | Każdy rekord kończy się tagiem `ER - ` w osobnej linii; zazwyczaj po nim następuje pusta linia przed kolejnym rekordem |
| Końce linii | Specyfikacja wymaga końców linii w stylu Windows (CRLF); nowoczesne parsery zazwyczaj akceptują również format Unix (tylko LF) |
| Typ MIME | `application/x-research-info-systems` |
| Kody typów publikacji | Ponad 40 standaryzowanych wartości `TY`, w tym `JOUR` (artykuł w czasopiśmie), `BOOK` (książka), `CONF` (materiał konferencyjny), `THES` (praca dyplomowa), `CHAP` (rozdział książki), `RPRT` (raport) |
| Pola autorów | Obsługiwanych jest wiele tagów autorów - `AU`, `A1` (główny), `A2` (drugorzędny), `A3` (trzeciorzędny), `A4` (pomocniczy); jeden autor na linię tagu |
| Obsługa wielu rekordów | Pojedynczy plik `.ris` może zawierać dowolną liczbę rekordów bibliograficznych, z których każdy jest ograniczony własną parą `TY`/`ER` |
| Kolejność tagów | Brak obowiązkowej kolejności tagów wewnątrz rekordu, z wyjątkiem `TY`, który musi być pierwszy, i `ER`, który musi być ostatni |
| Pola URL i linków | `L1` przechowuje lokalną ścieżkę do pliku lub URL, `L2` URL do pełnego tekstu, `L3` powiązany URL; wszystkie trzy mogą wystąpić wielokrotnie w rekordzie |
| Reprezentacja daty | Daty przechowywane w tagach `Y1` i `Y2` przy użyciu wzorca `RRRR/MM/DD/inne`; miesiąc, dzień i czwarty komponent tekstowy są opcjonalne |
| Kontynuacja abstraktu | Tag `AB` obsługuje wieloliniowe abstrakty; linie kontynuacji zaczynają się od sześciu spacji zgodnie z oryginalną specyfikacją |
| Identyfikacja pliku | Brak magicznych bajtów czy nagłówka binarnego; pliki są identyfikowane przez wzorzec zawartości `TY - ` na początku pierwszego rekordu |
| Kodowanie znaków | Oryginalna specyfikacja zakładała ASCII/ANSI; obecne implementacje powszechnie eksportują i importują UTF-8, aby obsługiwać znaki spoza alfabetu łacińskiego |
| Interoperacyjność | Natywny import/eksport obsługiwany przez EndNote, Zotero, Mendeley, JabRef, Web of Science, PubMed, Google Scholar oraz większość repozytoriów instytucjonalnych |
| Wydano | Early 1990s (Reference Manager, Research Information Systems); publicly documented tag set, no formal standards body |
| Otwarty standard | Tak · bezpłatny (royalty-free) |
| Specyfikacja | en.wikipedia.org |