Что такое формат файла RIS?
Файл .ris содержит информацию о цитируемых публикациях или ссылки на них, сохраненные в текстовом формате, разработанном Research Information Systems в начале 1990-х годов. Формат был создан для стандартизации обмена данными между различными программными инструментами цитирования и сейчас широко ассоциируется с Clarivate и EndNote. Он использует человекочитаемый синтаксис и может быть открыт с помощью любого текстового редактора. Один файл .ris может содержать информацию об одной или нескольких публикациях. Каждая публикация, указанная в файлах .ris, должна быть помечена двумя обязательными тегами:
TY- тип публикации,ER- конец записи, сигнализирующий о переходе к следующей публикации.
Формат основан на 6-символьной структуре для каждой новой строки. Первые два символа определяют тип поля (тег), следующие два - пробелы, затем дефис и еще один пробел. Каждая строка должна заканчиваться символами новой строки MS Windows - CR и LF. В файлах .ris используются различные типы тегов, например:
AU,A1,A2,A3,A4- авторы данной публикации,AB- аннотация,L1,L2,L3- различные типы ссылок,SP,EP- номера начальной и конечной страниц,TI,T1,T2,T3,TT- заголовки,VL- номер тома,Y1,Y2- даты.
Некоторые теги ограничены по длине или типу данных, которые они могут содержать, но ограничений на порядок тегов нет. Для типов публикаций могут использоваться сокращения, указанные в спецификации, такие как JOUR для журнальной статьи или BOOK для монографии. Многие приложения и системы используют файлы цитирования .ris, включая цифровые библиотеки и библиотечные каталоги. Формат тесно связан с .BIB (BibTeX) и .ENW (экспорт EndNote), которые служат аналогичным целям в академических рабочих процессах.
Безопасность и защита
РИСК: LOWФайлы RIS - это текстовые метаданные: без кода, без макросов, практически нулевой прямой риск. Единственные практические опасения касаются гигиены: поле URL может указывать куда угодно (менеджеры ссылок не открывают их автоматически), а файлы цитирования из ненадежных источников могут содержать неверные или спам-метаданные. Безопасно открывать в любом текстовом редакторе.
Детали формата
в двух словахПрограммы, открывающие файлы RIS
Технические подробности
глубокая спецификация| Тип файла | Текстовый библиографический формат с тегами; полностью человекочитаемый, без бинарных разделов |
| Структура тегов | Каждый тег состоит из двух заглавных букв ASCII, за которыми следуют два пробела, дефис и пробел (например, `TY - `, `AU - `) |
| Обязательное начало записи | Каждая запись должна начинаться с тега `TY`, указывающего тип ссылки (например, `TY - JOUR`), в качестве самого первого поля |
| Терминатор записи | Каждая запись закрывается тегом `ER - ` на отдельной строке; за ним обычно следует пустая строка перед следующей записью |
| Окончания строк | Спецификация требует окончаний строк CRLF в стиле Windows; современные парсеры обычно принимают и только Unix LF |
| MIME-тип | `application/x-research-info-systems` |
| Коды типов ссылок | Более 40 стандартизированных значений `TY`, включая `JOUR` (журнальная статья), `BOOK` (книга), `CONF` (материалы конференции), `THES` (диссертация), `CHAP` (глава книги), `RPRT` (отчет) |
| Поля авторов | Поддерживается несколько тегов авторов - `AU`, `A1` (основной), `A2` (вторичный), `A3` (третичный), `A4` (вспомогательный); один автор на строку тега |
| Поддержка нескольких записей | Один файл `.ris` может содержать любое количество записей ссылок, каждая из которых ограничена собственной парой `TY`/`ER` |
| Порядок тегов | Нет обязательного порядка тегов внутри записи, за исключением того, что `TY` должен быть первым, а `ER` - последним |
| Поля URL и ссылок | `L1` хранит путь к локальному файлу или URL, `L2` - URL полного текста, `L3` - связанный URL; все три могут появляться несколько раз в одной записи |
| Представление даты | Даты хранятся в тегах `Y1` и `Y2` по шаблону `ГГГГ/ММ/ДД/другое`; месяц, день и четвертый компонент в свободном текстовом формате являются необязательными |
| Продолжение аннотации | Тег `AB` поддерживает многострочные аннотации; строки продолжения начинаются с шести ведущих пробелов согласно оригинальной спецификации |
| Идентификация файла | Нет магических байтов или бинарного заголовка; файлы идентифицируются по шаблону содержимого `TY - ` в начале первой записи |
| Кодировка символов | Оригинальная спецификация предполагала ASCII/ANSI; современные реализации обычно экспортируют и импортируют UTF-8 для поддержки нелатинских шрифтов |
| Совместимость | Нативный импорт/экспорт поддерживается EndNote, Zotero, Mendeley, JabRef, Web of Science, PubMed, Google Scholar и большинством институциональных репозиториев |
| Выпущен | Early 1990s (Reference Manager, Research Information Systems); publicly documented tag set, no formal standards body |
| Открыть стандартное | Да · без роялти |
| Спецификация | en.wikipedia.org |