arXiv.org
arXiv.org — это крупнейший в мире бесплатный электронный архив научных статей и препринтов, функционирующий в режиме открытого доступа. Специализируется преимущественно на точных и естественных науках: физике, математике, информатике, количественной биологии, количественной финансовой сфере, статистике, электротехнике и системной инженерии. Архив предоставляет исследователям возможность оперативно публиковать результаты своих работ до их рецензирования в научных журналах, что ускоряет научную коммуникацию и обеспечивает приоритет открытий. Название происходит от домена первого уровня .org и аббревиатуры «arXiv» (произносится как «архив»; буква «X» соответствует греческой букве «хи» — χ).
История
Основание и ранние годы
Проект был запущен 14 августа 1991 года американским физиком Полом Гинспаргом, работавшим в Лос-Аламосской национальной лаборатории (США). Первоначально архив назывался «xxx.lanl.gov» и предназначался для обмена препринтами в области физики высоких энергий. Идея заключалась в том, чтобы заменить традиционную рассылку бумажных копий статей по почте на электронную систему, доступную через Интернет. Первая статья, загруженная в архив, была посвящена теории струн.
В 1993 году, с ростом популярности и объёма данных, сервер был перенесён на постоянную основу. В 1998 году Пол Гинспарг передал управление архивом Корнеллскому университету (США), где проект получил новое название — arXiv.org. В 2001 году архив был переведён на новую программную платформу, разработанную в Корнеллском университете.
Развитие и расширение
В 2000-е годы arXiv значительно расширил тематику. В 2004 году были добавлены разделы по математике и информатике, а в 2007 году — по количественной биологии и статистике. В 2010 году появился раздел по количественной финансовой сфере, а в 2019 году — по электротехнике и системной инженерии. Количество ежегодно загружаемых статей неуклонно росло: если в 1991 году было загружено около 300 статей, то к 2020 году этот показатель превысил 180 000.
В 2012 году, в связи с ростом операционных расходов, Корнеллский университет объявил о поиске дополнительных источников финансирования. В 2013 году была запущена программа добровольных пожертвований от научных учреждений и организаций (arXiv Member Institutions). К 2023 году более 200 университетов и исследовательских центров по всему миру участвовали в финансировании архива.
Модерация и система подачи
Процесс подачи
Любой исследователь может загрузить свою статью на arXiv, но для этого требуется регистрация. Новая учётная запись создаётся не автоматически: система проверяет личность пользователя, часто через подтверждение принадлежности к научному учреждению или через рекомендацию от уже зарегистрированного автора. После регистрации автор может загружать статьи, которые проходят предварительную модерацию.
Модерация
Модерация на arXiv не является полноценным рецензированием (peer-review). Модераторы — добровольцы из числа учёных — проверяют статьи на соответствие тематике раздела, наличие явных ошибок, плагиата или несоответствия научным стандартам. Статьи, не соответствующие критериям, могут быть отклонены или перемещены в другой раздел. Система модерации направлена на поддержание минимального качества и предотвращение спама, но не гарантирует научной достоверности.
Версионность
Автор может обновлять свою статью после публикации. Каждая новая версия получает номер (v1, v2, v3 и т.д.), а предыдущие версии остаются доступными для просмотра. Это позволяет отслеживать эволюцию работы и исправлять ошибки.
Структура и тематические разделы
arXiv организован по тематическим разделам, каждый из которых имеет свой код и подразделы. Основные разделы:
| Раздел | Код | Подразделы (примеры) |
|---|---|---|
| Физика | physics | Общая физика, физика высоких энергий, астрофизика, квантовая физика, конденсированное состояние |
| Математика | math | Алгебра, анализ, геометрия, топология, теория чисел, дифференциальные уравнения |
| Информатика | cs | Искусственный интеллект, компьютерное зрение, машинное обучение, сети, базы данных |
| Количественная биология | q-bio | Геномика, молекулярные сети, популяционная биология |
| Количественная финансовая сфера | q-fin | Финансовые рынки, портфельное управление, риск-менеджмент |
| Статистика | stat | Теория вероятностей, статистическое обучение, биостатистика |
| Электротехника и системная инженерия | eess | Обработка сигналов, системы управления, коммуникации |
Каждая статья получает уникальный идентификатор (например, arXiv:2301.00001v1), который используется для ссылок и цитирования.
Значение и влияние
Ускорение научной коммуникации
arXiv стал ключевым инструментом для оперативного распространения научных знаний. В областях, где скорость публикации критична (например, в физике высоких энергий или машинном обучении), исследователи часто публикуют препринты на arXiv до или одновременно с подачей в журнал. Это позволяет коллегам немедленно ознакомиться с результатами, дать обратную связь и использовать их в своих работах.
Открытый доступ
Все статьи на arXiv доступны бесплатно для чтения и скачивания. Это способствует демократизации науки, позволяя учёным из развивающихся стран, небольших университетов и независимым исследователям получать доступ к новейшим исследованиям без платных подписок.
Приоритет и датирование
Система фиксации даты подачи статьи обеспечивает приоритет научного открытия. В случае споров о первенстве дата загрузки на arXiv часто признаётся научным сообществом как доказательство.
Критика и ограничения
Несмотря на широкое признание, arXiv имеет ряд недостатков:
- Отсутствие рецензирования: статьи могут содержать ошибки, непроверяемые утверждения или даже быть мошенническими. Ответственность за достоверность лежит на авторах.
- Модерация: субъективность модераторов может приводить к отклонению работ, которые не вписываются в мейнстримные направления.
- Перегрузка: огромный поток статей затрудняет поиск качественных работ. Для решения этой проблемы существуют сторонние сервисы, такие как «arXiv Sanity» или «Paper Digest».
- Проблемы с плагиатом: несмотря на проверки, случаи плагиата встречаются.
Интересные факты
- В 2011 году arXiv отметил 20-летие, и к этому моменту в архиве было более 700 000 статей. К 2023 году их число превысило 2,3 миллиона.
- Самая цитируемая статья на arXiv — работа по алгоритму глубокого обучения «Attention Is All You Need» (2017), которая положила начало архитектуре трансформеров.
- В 2021 году arXiv ввёл систему «arXiv Labs» для экспериментов с новыми функциями, такими как автоматическая классификация статей с помощью машинного обучения.
- Архив поддерживается на добровольные пожертвования научных учреждений, а также грантами от Национального научного фонда США (NSF) и других организаций.
Источники
- Официальный сайт arXiv.org
- История arXiv на сайте Корнеллского университета
- Статья «The arXiv.org preprint server: a 30-year retrospective» (2021)
- Документация по модерации и структуре arXiv
BFOmetr — база данных и аналитика по компаниям России.
На главную BFOmetr →