O que é o formato de ficheiro RIS?
Um arquivo .ris contém informações sobre publicações citadas ou referências a elas, salvas em formato de texto desenvolvido pela Research Information Systems no início dos anos 1990. O formato foi criado para padronizar a troca de dados entre várias ferramentas de software de citação e agora está amplamente associado à Clarivate e ao EndNote. Ele utiliza uma sintaxe legível por humanos e pode ser aberto usando qualquer editor de texto. Um único arquivo .ris pode conter informações sobre uma ou mais publicações. Cada publicação referenciada em arquivos .ris deve ser marcada usando duas tags obrigatórias:
TY- tipo de publicação,ER- fim do registro (end of record), sinalizando a transição para a próxima publicação.
O formato é baseado em uma estrutura de 6 caracteres para cada nova linha. Os dois primeiros caracteres definem o tipo de campo (tag), os dois seguintes são espaços, seguidos por um hífen e um espaço. Cada linha deve terminar com caracteres de nova linha do Microsoft Windows - CR e LF. Existem vários tipos de tags usadas em arquivos .ris, por exemplo:
AU,A1,A2,A3,A4- autores da publicação,AB- um resumo (abstract),L1,L2,L3- vários tipos de links,SP,EP- números de página inicial e final,TI,T1,T2,T3,TT- títulos,VL- número do volume,Y1,Y2- datas.
Algumas tags são limitadas por restrições de comprimento ou pelo tipo de dados que podem conter, mas não há restrições na ordem das tags. Para tipos de publicações, podem ser usados os atalhos listados na especificação - como JOUR para artigo de periódico ou BOOK para uma monografia. Muitos aplicativos e sistemas usam arquivos de citação .ris, incluindo bibliotecas digitais e catálogos de bibliotecas. O formato está intimamente relacionado ao .BIB (BibTeX) e .ENW (EndNote export), que servem a propósitos semelhantes em fluxos de trabalho acadêmicos.
Segurança e proteção
RISCO: LOWArquivos RIS são metadados em texto simples - sem código, sem macros, risco direto efetivamente zero. As únicas preocupações práticas são de nível de higiene: um campo de URL pode apontar para qualquer lugar (gerenciadores de referências não os abrem automaticamente) e arquivos de citação de fontes não confiáveis podem simplesmente conter metadados incorretos ou spam. Seguro para abrir em qualquer editor de texto.
Detalhes do formato
em resumoProgramas que abrem arquivos RIS
Detalhes técnicos
especificação profunda| Tipo de arquivo | Formato bibliográfico marcado em texto simples; totalmente legível por humanos sem seções binárias |
| Estrutura da tag | Cada tag consiste em duas letras ASCII maiúsculas seguidas por dois espaços, um hífen e um espaço (ex: `TY - `, `AU - `) |
| Início de registro obrigatório | Cada registro deve abrir com a tag `TY` especificando o tipo de referência (ex: `TY - JOUR`) como o primeiríssimo campo |
| Terminador de registro | Cada registro fecha com `ER - ` em sua própria linha; uma linha em branco normalmente segue antes do próximo registro |
| Finais de linha | A especificação exige finais de linha CRLF no estilo Windows; parsers modernos geralmente aceitam apenas LF no estilo Unix também |
| Tipo MIME | `application/x-research-info-systems` |
| Códigos de tipo de referência | Mais de 40 valores `TY` padronizados, incluindo `JOUR` (artigo de periódico), `BOOK` (livro), `CONF` (trabalho de conferência), `THES` (tese), `CHAP` (capítulo de livro), `RPRT` (relatório) |
| Campos de autor | Múltiplas tags de autor suportadas - `AU`, `A1` (primário), `A2` (secundário), `A3` (terciário), `A4` (subsidiário); um autor por linha de tag |
| Suporte a múltiplos registros | Um único arquivo `.ris` pode conter qualquer número de registros de referência, cada um delimitado por seu próprio par `TY`/`ER` |
| Ordenação de tags | Nenhuma ordem obrigatória para as tags dentro de um registro, exceto que `TY` deve aparecer primeiro e `ER` deve aparecer por último |
| Campos de URL e link | `L1` armazena um caminho de arquivo local ou URL, `L2` uma URL de texto completo, `L3` uma URL relacionada; todos os três podem aparecer várias vezes por registro |
| Representação de data | Datas armazenadas nas tags `Y1` e `Y2` usando o padrão `AAAA/MM/DD/outro`; mês, dia e o quarto componente de texto livre são opcionais |
| Continuação de resumo | A tag `AB` suporta resumos de várias linhas; as linhas de continuação começam com seis caracteres de espaço iniciais, conforme a especificação original |
| Identificação do arquivo | Sem magic bytes ou cabeçalho binário; os arquivos são identificados pelo padrão de conteúdo `TY - ` no início do primeiro registro |
| Codificação de caracteres | A especificação original assumia ASCII/ANSI; implementações atuais comumente exportam e importam UTF-8 para suportar scripts não latinos |
| Interoperabilidade | Importação/exportação nativa suportada por EndNote, Zotero, Mendeley, JabRef, Web of Science, PubMed, Google Scholar e a maioria dos repositórios institucionais |
| Lançado | Early 1990s (Reference Manager, Research Information Systems); publicly documented tag set, no formal standards body |
| Padrão aberto | Sim · livre de royalties |
| Especificação | en.wikipedia.org |