3 августа 2026 г.
Новости технологий

arXiv: Годовая дисквалификация для исследователей, подавших ошибочные статьи, сгенерированные ИИ

18 мая 2026 г.Платон Велесов3 мин

В условиях, когда платформы для препринтов и научные издательства наводнены статьями, сгенерированными искусственным интеллектом, arXiv занимает более жёсткую позицию. Платформа объявляет о годовой дисквалификации для тех, кто подаёт статьи, создание которых, очевидно, не было проверено авторами.

Пионерская платформа для научных препринтов arXiv будет отстранять на год любого исследователя, который опубликовал ошибочную статью, явно сгенерированную искусственным интеллектом.

«Если статья содержит неопровержимые доказательства того, что авторы не проверили результаты, сгенерированные большой языковой моделью (LLM), это означает, что мы не можем доверять ничему, что содержится в этой статье», — пояснил в четверг Томас Диттерих, заместитель руководителя платформы, в своём сообщении на X.

Год дисквалификации и строго регламентированное возвращение

Он добавил, что команда приняла решение об отстранении от платформы на год для любого автора, подписавшего подобную статью. После этого года дисквалификации платформа будет принимать статьи от такого автора только в том случае, если они уже были одобрены рецензируемым журналом или конференцией. Иными словами, для этих лиц ценность публикации на arXiv станет практически нулевой.

«Наш кодекс поведения гласит, что, подписываясь под статьёй как автор, каждый автор берёт на себя полную ответственность за всё её содержимое, независимо от способа его создания», — пояснил он.

Некоторые исследователи, такие как экономист Джеймс Д. Миллер, выражают обеспокоенность тем, что все авторы статьи могут быть подвергнуты санкциям: «Означает ли это, что вы ожидаете от каждого автора проверки каждой ссылки и гарантии её подлинности и точности? Что произойдёт, если один из авторов не сможет проверить ссылку, потому что она написана на незнакомом ему языке или касается технической темы, которую он не понимает, в то время как другой автор статьи способен это сделать?» — спрашивает он.

«Мы отмечаем, что инструменты могут давать полезные и релевантные результаты, но также и ошибки или вводящие в заблуждение данные; поэтому важно знать, какие инструменты использовались для оценки и интерпретации научных работ», — пояснялось на сайте в его политике модерации.

И команда arXiv уже напоминала своим коллегам, что, «подписываясь как автор статьи, они индивидуально несут полную ответственность за всё её содержимое, независимо от того, как оно было сгенерировано. Если языковые инструменты генеративного ИИ производят неуместные высказывания, плагиат, предвзятый контент, ошибки, неточности, ошибочные ссылки или вводящий в заблуждение контент, и эти результаты включаются в научные работы, ответственность за это лежит на авторе(ах).»

Однако объём статей, содержащих такого рода проблемы, настолько велик, что arXiv, похоже, был вынужден если не ужесточить санкции, то по крайней мере публично заявить о них.

Томас Диттерих завершает свою публикацию, приводя несколько примеров неоспоримых доказательств такого использования: «вымышленные ссылки, мета-комментарии LLM («вот резюме на 200 слов; хотите, чтобы я внёс изменения?», «данные в этой таблице приведены для примера, заполните её реальными цифрами из ваших экспериментов»)». Отвечая на вопрос 404 Media, он добавил, что платформа не будет делать исключений из этого правила, но существует процедура апелляции, и модераторы платформы должны чётко документировать нарушения. Руководитель arXiv по соответствующей дисциплине должен подтвердить нарушение перед наложением санкции.

Журналы и материалы конференций также наводнены проблемным контентом, сгенерированным ИИ

Платформы для препринтов, как и научные журналы, всё чаще наводняются статьями, сгенерированными ИИ и не проверенными должным образом. Недавнее исследование показало, что материалы научных конференций могут массово включать статьи, написанные (или сгенерированные ИИ) с целью продажи исследователям места для их подписи за плату от 11 до 400 долларов.

Также регулярно можно обнаружить научные статьи, содержащие причудливые диаграммы, сгенерированные ИИ. Например, была найдена статья, опубликованная в марте 2025 года в журнале Alexandria Engineering Journal, издаваемом Elsevier, которая должна была представлять математическое моделирование механики улитки уха и связанных с ней дисфункций. В ней можно найти такие совершенно фантастические и неуместные иллюстрации:

Статья на данный момент ещё не отозвана.

ACL также принимает меры

Платформы для препринтов — не единственные, кто реагирует на эту проблему. Так, например, организаторы конференции Ассоциации вычислительной лингвистики (ACL), которая состоится в июле, были вынуждены опубликовать специальное заявление об отклонении статей, содержащих вымышленные ссылки. Организация объясняет, что многие предложения были отклонены в самом начале именно из-за таких проблем.

Однако организация добавляет, что даже после этих фильтров были упущения: «во время последних проверок окончательных версий статей, принятых для ACL 2026, мы выявили более сотни статей, содержащих ссылки на несуществующие публикации». И она добавляет, что «в результате мы приняли решение автоматически отклонить эти принятые статьи, чтобы сохранить качество и надёжность материалов конференции».