Открыть сервис

arXiv.org

arXiv.org — это крупнейший в мире бесплатный электронный архив научных статей и препринтов, функционирующий в режиме открытого доступа. Специализируется преимущественно на точных и естественных науках: физике, математике, информатике, количественной биологии, количественной финансовой сфере, статистике, электротехнике и системной инженерии. Архив предоставляет исследователям возможность оперативно публиковать результаты своих работ до их рецензирования в научных журналах, что ускоряет научную коммуникацию и обеспечивает приоритет открытий. Название происходит от домена первого уровня .org и аббревиатуры «arXiv» (произносится как «архив»; буква «X» соответствует греческой букве «хи» — χ).

История

Основание и ранние годы

Проект был запущен 14 августа 1991 года американским физиком Полом Гинспаргом, работавшим в Лос-Аламосской национальной лаборатории (США). Первоначально архив назывался «xxx.lanl.gov» и предназначался для обмена препринтами в области физики высоких энергий. Идея заключалась в том, чтобы заменить традиционную рассылку бумажных копий статей по почте на электронную систему, доступную через Интернет. Первая статья, загруженная в архив, была посвящена теории струн.

В 1993 году, с ростом популярности и объёма данных, сервер был перенесён на постоянную основу. В 1998 году Пол Гинспарг передал управление архивом Корнеллскому университету (США), где проект получил новое название — arXiv.org. В 2001 году архив был переведён на новую программную платформу, разработанную в Корнеллском университете.

Развитие и расширение

В 2000-е годы arXiv значительно расширил тематику. В 2004 году были добавлены разделы по математике и информатике, а в 2007 году — по количественной биологии и статистике. В 2010 году появился раздел по количественной финансовой сфере, а в 2019 году — по электротехнике и системной инженерии. Количество ежегодно загружаемых статей неуклонно росло: если в 1991 году было загружено около 300 статей, то к 2020 году этот показатель превысил 180 000.

В 2012 году, в связи с ростом операционных расходов, Корнеллский университет объявил о поиске дополнительных источников финансирования. В 2013 году была запущена программа добровольных пожертвований от научных учреждений и организаций (arXiv Member Institutions). К 2023 году более 200 университетов и исследовательских центров по всему миру участвовали в финансировании архива.

Модерация и система подачи

Процесс подачи

Любой исследователь может загрузить свою статью на arXiv, но для этого требуется регистрация. Новая учётная запись создаётся не автоматически: система проверяет личность пользователя, часто через подтверждение принадлежности к научному учреждению или через рекомендацию от уже зарегистрированного автора. После регистрации автор может загружать статьи, которые проходят предварительную модерацию.

Модерация

Модерация на arXiv не является полноценным рецензированием (peer-review). Модераторы — добровольцы из числа учёных — проверяют статьи на соответствие тематике раздела, наличие явных ошибок, плагиата или несоответствия научным стандартам. Статьи, не соответствующие критериям, могут быть отклонены или перемещены в другой раздел. Система модерации направлена на поддержание минимального качества и предотвращение спама, но не гарантирует научной достоверности.

Версионность

Автор может обновлять свою статью после публикации. Каждая новая версия получает номер (v1, v2, v3 и т.д.), а предыдущие версии остаются доступными для просмотра. Это позволяет отслеживать эволюцию работы и исправлять ошибки.

Структура и тематические разделы

arXiv организован по тематическим разделам, каждый из которых имеет свой код и подразделы. Основные разделы:

РазделКодПодразделы (примеры)
ФизикаphysicsОбщая физика, физика высоких энергий, астрофизика, квантовая физика, конденсированное состояние
МатематикаmathАлгебра, анализ, геометрия, топология, теория чисел, дифференциальные уравнения
ИнформатикаcsИскусственный интеллект, компьютерное зрение, машинное обучение, сети, базы данных
Количественная биологияq-bioГеномика, молекулярные сети, популяционная биология
Количественная финансовая сфераq-finФинансовые рынки, портфельное управление, риск-менеджмент
СтатистикаstatТеория вероятностей, статистическое обучение, биостатистика
Электротехника и системная инженерияeessОбработка сигналов, системы управления, коммуникации

Каждая статья получает уникальный идентификатор (например, arXiv:2301.00001v1), который используется для ссылок и цитирования.

Значение и влияние

Ускорение научной коммуникации

arXiv стал ключевым инструментом для оперативного распространения научных знаний. В областях, где скорость публикации критична (например, в физике высоких энергий или машинном обучении), исследователи часто публикуют препринты на arXiv до или одновременно с подачей в журнал. Это позволяет коллегам немедленно ознакомиться с результатами, дать обратную связь и использовать их в своих работах.

Открытый доступ

Все статьи на arXiv доступны бесплатно для чтения и скачивания. Это способствует демократизации науки, позволяя учёным из развивающихся стран, небольших университетов и независимым исследователям получать доступ к новейшим исследованиям без платных подписок.

Приоритет и датирование

Система фиксации даты подачи статьи обеспечивает приоритет научного открытия. В случае споров о первенстве дата загрузки на arXiv часто признаётся научным сообществом как доказательство.

Критика и ограничения

Несмотря на широкое признание, arXiv имеет ряд недостатков:

  • Отсутствие рецензирования: статьи могут содержать ошибки, непроверяемые утверждения или даже быть мошенническими. Ответственность за достоверность лежит на авторах.
  • Модерация: субъективность модераторов может приводить к отклонению работ, которые не вписываются в мейнстримные направления.
  • Перегрузка: огромный поток статей затрудняет поиск качественных работ. Для решения этой проблемы существуют сторонние сервисы, такие как «arXiv Sanity» или «Paper Digest».
  • Проблемы с плагиатом: несмотря на проверки, случаи плагиата встречаются.

Интересные факты

  • В 2011 году arXiv отметил 20-летие, и к этому моменту в архиве было более 700 000 статей. К 2023 году их число превысило 2,3 миллиона.
  • Самая цитируемая статья на arXiv — работа по алгоритму глубокого обучения «Attention Is All You Need» (2017), которая положила начало архитектуре трансформеров.
  • В 2021 году arXiv ввёл систему «arXiv Labs» для экспериментов с новыми функциями, такими как автоматическая классификация статей с помощью машинного обучения.
  • Архив поддерживается на добровольные пожертвования научных учреждений, а также грантами от Национального научного фонда США (NSF) и других организаций.

Источники

  • Официальный сайт arXiv.org
  • История arXiv на сайте Корнеллского университета
  • Статья «The arXiv.org preprint server: a 30-year retrospective» (2021)
  • Документация по модерации и структуре arXiv

BFOmetr — база данных и аналитика по компаниям России.

На главную BFOmetr →