Представь: ты три месяца корпел над статьёй, наконец выгрузил препринт на arXiv — и через час получаешь уведомление. Тебе не просто вернули рукопись на доработку. Тебе запретили публиковаться на год. И теперь любой твой будущий материал обязан пройти рецензирование в журнале, прежде чем arXiv его хотя бы примет к рассмотрению. Именно такой сценарий стал реальностью с мая 2026 года, когда крупнейший в мире архив научных препринтов, содержащий почти 3 миллиона работ, объявил войну «AI slop» — низкопробному контенту, сгенерированному нейросетями и не вычитанному авторами. По данным AI Haven, ещё в марте 2026 года arXiv готовился к статусу независимой некоммерческой организации, и одной из причин стал колоссальный наплыв AI-мусора, из-за которого процент отказов в 2025 году взлетел до 4–12%.
Новость прозвучала жёстко. В кулуарах IT-конференций её уже окрестили «научным остракизмом». Но если ты не хочешь оказаться в чёрном списке, давай разберёмся, что именно запрещено, как проверить свою работу и какие инструменты помогут тебе спать спокойно.
Что именно запрещено: разбор критериев arXiv с примерами нарушений
Политика arXiv теперь предельно проста: если в твоей рукописи найдут «неопровержимые доказательства» того, что ты не проверил результаты, сгенерированные большой языковой моделью (LLM), — тебя ждёт годичный бан. По сути, это красная карточка в футболе: одно грубое нарушение — и ты вне игры до следующего сезона. Как сообщает Ars Technica, под «доказательствами» понимаются классические симптомы AI slop: галлюцинации (фактические ошибки, которых не существует), фиктивные ссылки на несуществующие статьи и даже метакомментарии, которые нейросеть иногда оставляет в тексте вроде «I hope this answers your question».
Например, LLM может сгенерировать ссылку на статью «Smith et al. 2025, Nature» с DOI 10.1038/imaginary2025, который никогда не существовал. Другой частый случай — фраза «как показано в работе (Johnson, 2024)», где Johnson вообще не публиковал такой работы. А метакомментарии типа «I have generated a comprehensive analysis based on the provided data. Please let me know if you need any modifications» — это чистый маркер того, что автор даже не удосужился перечитать текст.
Механика санкций, которую раскрыло издание 404 Media, — это «правило одного удара». Модератор документирует проблему, председатель секции arXiv подтверждает её, и бан вступает в силу. У автора есть право на апелляцию, но сам процесс подчёркивает: шутки кончились. Пожизненно — да, именно пожизненно — ты попадёшь под требование сначала пройти рецензирование в авторитетном журнале, прежде чем arXiv вообще прикоснётся к твоей работе. И это ещё не всё: по данным Science, модераторы arXiv столкнулись с утроением количества отказов за 2025 год, что вынудило платформу ещё в ноябре 2025 года прекратить приём обзорных статей по computer science без рецензий, а в январе 2026 ввести обязательное подтверждение от действующего автора для новичков.
Для сравнения — политика родственных платформ: bioRxiv и medRxiv, управляемые организацией openRxiv, также ужесточают правила. Как писал ScienceNet.cn ещё в ноябре 2025 года, они с самого начала запретили нарративные обзоры без рецензирования и теперь совместно отклоняют более десяти подозрительных AI-рукописей ежедневно. Их главный научный стратег Ричард Север назвал политику arXiv «разумной мерой». Так что тенденция глобальная: индустрия научных препринтов переходит от романтической эпохи «пусть расцветают сто цветов» к жёсткому compliance.
Масштаб бедствия: как AI-слоп захватил научные публикации
Если тебе кажется, что проблема преувеличена, — вот отрезвляющая статистика. Исследование учёных из Колумбийского университета, опубликованное в The Lancet в 2026 году, показало: в первые семь недель 2026 года каждая 277-я биомедицинская статья содержала сфабрикованные ссылки. Для сравнения: в 2023 году этот показатель составлял 1 из 2828. Темпы роста пугают. А отдельный анализ arXiv выявил более 146 000 сфабрикованных цитат, появившихся в архиве за 2025 год.
Представь себе авиарейс, в котором один пассажир из 277 проносит на борт бомбу. В науке эта «бомба» подрывает доверие ко всей системе экспертного знания. Именно поэтому модераторы arXiv, по данным Science, стали отклонять в три раза больше работ, чем раньше. AI slop — это не просто неопрятный текст. Это яд, который разъедает основы научной коммуникации: если препринты больше нельзя читать без детектора, вся идея быстрого обмена знаниями летит в тартарары.
Чек-лист: пошаговая проверка статьи перед отправкой в arXiv
Итак, ты хочешь опубликоваться и не попасть под бан. Действуй как сапёр, обезвреживающий мину. Вот твой чек-лист из пяти шагов.
- 1. Ручная вычитка на галлюцинации. Перепроверь все факты и все ссылки, которые есть в тексте. Проверь, существуют ли цитируемые статьи, верны ли номера страниц, не придуманы ли авторы. Даже если ты правил текст после LLM, свежись с источником.
- 2. Поиск метакомментариев. Ищи фразы типа «как я уже говорил», «I hope this helps», «feel free to adjust». Нейросети любят оставлять такое в черновиках. Если нашёл — удаляй без жалости.
- 3. Прогон через AI-детектор. Обязательно используй специализированный инструмент, даже если ты уверен в тексте. Ни один детектор не даёт 100% точности, но он покажет подозрительные фрагменты, которые стоит перепроверить.
- 4. Верификация библиографии. Каждую ссылку прогони через CrossRef или Google Scholar. Если она ведёт в никуда — ты нашёл галлюцинацию.
- 5. Согласование с соавторами. Если над статьёй работали несколько человек, введите правило двойной проверки: каждый автор проходит по чек-листу перед отправкой. Один невнимательный соавтор может подставить всю команду.
Помни: arXiv смотрит на «неопровержимые доказательства», а не на подозрения. Если ты поймал ошибку до отправки и исправил её — ты чист.
Инструменты для детекции AI-текста: обзор и сравнение
Какой детектор выбрать, чтобы не получилось ложного срабатывания? По данным eWeek на апрель 2026 года, лидирует Originality.ai с заявленной точностью 94,5% для парафразированного контента и более 99% для текстов GPT-4. GPTZero и Copyleaks также в топе, а узкоспециализированный SynthQuery затачивается именно под научные тексты. Но важный нюанс от Quetext: относись к детектору как к фильтру, а не приговору. Если алгоритм пометил кусок как «подозрительный», это повод присмотреться, а не повод переписывать всё с нуля.
Чтобы сориентироваться в зоопарке инструментов, мы свели ключевые параметры в таблицу:
| Инструмент | Точность (общая) | Точность для научных текстов | Специализация | Цена |
|---|---|---|---|---|
| Originality.ai | 94.5% (парафраз), >99% (GPT-4) | Высокая | Обнаружение AI и плагиата | Платный (от $14.95/мес) |
| GPTZero | ~90% | Средняя | Образовательный сектор | Бесплатный базовый, Pro от $9.99/мес |
| Copyleaks | ~93% | Высокая | AI + плагиат | Платный (от $10.99/мес) |
| SynthQuery | ~95% | Очень высокая | Специализирован на научных публикациях и препринтах | Бесплатный для академического использования |
На практике я советую комбинировать: быстрый скрининг через Originality.ai, затем ручная проверка помеченных мест. И не забывай, что детекторы могут ошибаться на стилистически выверенных текстах, которые писал человек с академическим бэкграундом. Цена ошибки — твоя репутация и год простоя, так что лучше перебдеть.
Будущее научной коммуникации и что делать уже сегодня
Новые правила arXiv — это не конец науки, а её взросление. Мы входим в эру, когда препринт перестаёт быть черновиком «как есть» и становится продуктом, за который автор несёт полную ответственность. С 1 июля 2026 года arXiv официально отделится от Корнелльского университета и станет независимой некоммерческой организацией (по данным AI Haven). Это даст платформе ещё больше автономии для ужесточения модерации и введения новых политик, но и повысит ответственность перед глобальным научным сообществом. По данным 404 Media, возможность апелляции сохраняется, но ставки высоки. Модераторы будут только строже, а комьюнити — требовательнее к прозрачности.
Что делать тебе прямо сейчас? Прими новые правила игры как данность. Чтобы не пропустить следующие ужесточения и лайфхаки по выживанию в мире AI-слопа, подписывайся на рассылку «Деньги не пахнут»
Вердикт автора
arXiv наносит ответный удар по AI-слоперам: год бана — это как дисквалификация за допинг. Ожидаем, что комьюнити расколется на «честных» и «ловкачей», которые будут искать способы обмануть детекторы. Для медиа это золотая жила — каждый новый скандал с фальшивыми ссылками будет генерировать трафик. А деньги, как известно, не пахнут, даже если контент слегка отдаёт нейросетью.
Комментарии (0)
Комментариев пока нет. Будьте первым!