Che cos'è il formato di file RIS?
Un file .ris contiene informazioni su pubblicazioni citate o riferimenti ad esse, salvate in formato testo sviluppato da Research Information Systems nei primi anni '90. Il formato è stato creato per standardizzare lo scambio di dati tra vari strumenti software di citazione ed è oggi ampiamente associato a Clarivate ed EndNote. Utilizza una sintassi leggibile dall'uomo e può essere aperto con qualsiasi editor di testo. Un singolo file .ris può contenere informazioni su una o più pubblicazioni. Ogni pubblicazione referenziata nei file .ris deve essere contrassegnata da due tag obbligatori:
TY- tipo di pubblicazione,ER- fine del record (end of record), che segnala il passaggio alla pubblicazione successiva.
Il formato si basa su una struttura di 6 caratteri per ogni nuova riga. I primi due caratteri definiscono il tipo di campo (tag), i due successivi sono spazi, seguiti da un trattino e uno spazio. Ogni riga deve terminare con i caratteri di nuova riga di MS Windows - CR e LF. Esistono vari tipi di tag utilizzati nei file .ris, ad esempio:
AU,A1,A2,A3,A4- autori della pubblicazione,AB- un abstract,L1,L2,L3- vari tipi di collegamenti,SP,EP- numeri di pagina iniziale e finale,TI,T1,T2,T3,TT- titoli,VL- numero del volume,Y1,Y2- date.
Alcuni tag sono limitati dalla lunghezza o dal tipo di dati che possono contenere, ma non ci sono restrizioni sull'ordine dei tag. Per i tipi di pubblicazione, si possono usare le abbreviazioni elencate nella specifica - come JOUR per un articolo di rivista o BOOK per una monografia. Molte applicazioni e sistemi utilizzano i file di citazione .ris, inclusi cataloghi bibliotecari e biblioteche digitali. Il formato è strettamente correlato a .BIB (BibTeX) e .ENW (esportazione EndNote), che servono a scopi simili nei flussi di lavoro accademici.
Sicurezza e incolumità
RISCHIO: LOWI file RIS sono metadati in testo semplice - nessun codice, nessuna macro, rischio diretto effettivamente nullo. Le uniche preoccupazioni pratiche riguardano l'igiene dei dati: un campo URL potrebbe puntare ovunque (i gestori di riferimenti non li aprono automaticamente) e i file di citazione da fonti non attendibili potrebbero semplicemente contenere metadati errati o spam. Sicuro da aprire in qualsiasi editor di testo.
Dettagli del formato
in sintesiProgrammi che aprono file RIS
Dettagli tecnici
specifiche approfondite| Tipo di file | Formato bibliografico con tag in testo semplice; completamente leggibile dall'uomo senza sezioni binarie |
| Struttura dei tag | Ogni tag è composto da due lettere ASCII maiuscole seguite da due spazi, un trattino e uno spazio (es. `TY - `, `AU - `) |
| Inizio record obbligatorio | Ogni record deve aprirsi con il tag `TY` che specifica il tipo di riferimento (es. `TY - JOUR`) come primissimo campo |
| Terminatore di record | Ogni record si chiude con `ER - ` su una riga a sé stante; tipicamente segue una riga vuota prima del record successivo |
| Fine riga | La specifica richiede terminazioni di riga CRLF in stile Windows; i parser moderni generalmente accettano anche solo LF in stile Unix |
| Tipo MIME | `application/x-research-info-systems` |
| Codici tipo di riferimento | Oltre 40 valori `TY` standardizzati tra cui `JOUR` (articolo di rivista), `BOOK` (libro), `CONF` (atti di conferenza), `THES` (tesi), `CHAP` (capitolo di libro), `RPRT` (rapporto) |
| Campi autore | Supportati tag per autori multipli - `AU`, `A1` (primario), `A2` (secondario), `A3` (terziario), `A4` (sussidiario); un autore per riga di tag |
| Supporto multi-record | Un singolo file `.ris` può contenere un numero qualsiasi di record di riferimento, ciascuno delimitato dalla propria coppia `TY`/`ER` |
| Ordine dei tag | Nessun ordine obbligatorio per i tag all'interno di un record, tranne per `TY` che deve apparire per primo e `ER` che deve apparire per ultimo |
| Campi URL e link | `L1` memorizza un percorso file locale o URL, `L2` un URL al testo completo, `L3` un URL correlato; tutti e tre possono apparire più volte per record |
| Rappresentazione della data | Date memorizzate nei tag `Y1` e `Y2` usando lo schema `AAAA/MM/GG/altro`; mese, giorno e il quarto componente di testo libero sono opzionali |
| Continuazione abstract | Il tag `AB` supporta abstract su più righe; le righe di continuazione iniziano con sei spazi iniziali secondo la specifica originale |
| Identificazione del file | Nessun magic byte o intestazione binaria; i file sono identificati dal pattern di contenuto `TY - ` all'inizio del primo record |
| Codifica dei caratteri | La specifica originale prevedeva ASCII/ANSI; le implementazioni attuali esportano e importano comunemente in UTF-8 per supportare alfabeti non latini |
| Interoperabilità | Importazione/esportazione nativa supportata da EndNote, Zotero, Mendeley, JabRef, Web of Science, PubMed, Google Scholar e dalla maggior parte dei repository istituzionali |
| Rilasciato | Early 1990s (Reference Manager, Research Information Systems); publicly documented tag set, no formal standards body |
| Standard aperto | Sì · royalty-free |
| Specifica | en.wikipedia.org |