Новости IT-индустрии

arXiv: Год отстранения для исследователей, публикующих ошибочные статьи, сгенерированные ИИ

18 мая 2026 г.Павел Игнатьев3 мин

В ответ на массовый наплыв – массовые меры

В то время как платформы для препринтов и научные издательства наводнены статьями, сгенерированными искусственным интеллектом, arXiv ужесточает свои правила. Платформа объявляет о годичном отстранении для тех, кто представляет материалы, генерация которых явно не была проверена.

Пионерская платформа для научных препринтов arXiv отстранит на год любого исследователя, который разместит ошибочную и явно сгенерированную ИИ статью.

«Если статья содержит неопровержимые доказательства того, что авторы не проверили результаты, сгенерированные большой языковой моделью (LLM), это означает, что мы не можем доверять ничему, что содержится в этой статье», — пояснил в четверг Томас Диттерих, заместитель руководителя платформы, в своем сообщении на X.

Год отстранения и строго регламентированное возвращение

Он добавил, что команда приняла решение об отстранении на год от платформы для любого автора, подписавшего подобную статью. После этого года отстранения платформа примет статьи, подписанные этим автором, только если они уже были приняты журналом или конференцией, которые провели рецензирование. Это фактически означает, что для таких людей ценность размещения материалов на arXiv станет практически нулевой.

«Наш кодекс поведения гласит, что, подписывая статью как автор, каждый берет на себя полную ответственность за все ее содержимое, независимо от способа ее создания», — обосновал он.

Некоторые исследователи, такие как экономист Джеймс Д. Миллер, выражают обеспокоенность тем, что все авторы статьи могут быть подвергнуты санкциям: «Означает ли это, что вы ожидаете от каждого автора проверки каждой ссылки и гарантии ее подлинности и точности? Что произойдет, если один из авторов не сможет проверить ссылку, потому что она написана на незнакомом ему языке или касается технической темы, которую он не понимает, в то время как другой соавтор статьи способен это сделать?» — спрашивает он.

«Мы отмечаем, что инструменты могут давать полезные и релевантные результаты, но также и ошибки или вводящие в заблуждение данные; поэтому важно знать, какие инструменты использовались для оценки и интерпретации научных работ», — пояснял сайт в своей политике модерации.

И команда arXiv уже напоминала своим коллегам, что «подписывая статью как автор, каждый из них индивидуально несет полную ответственность за все ее содержимое, независимо от того, как оно было сгенерировано. Если генеративные языковые ИИ-инструменты производят неуместные высказывания, плагиат, предвзятый контент, ошибки, неточности, ошибочные ссылки или вводящий в заблуждение контент, и эти результаты включаются в научные работы, ответственность за это лежит на авторе(ах).»

Но объем статей, содержащих такого рода проблемы, настолько велик, что arXiv, похоже, был вынужден, если не ужесточить санкции, то по крайней мере сделать их публичными.

Томас Диттерих завершает свою ветку, приводя несколько примеров неопровержимых доказательств такого использования: «вымышленные ссылки, мета-комментарии LLM («вот резюме на 200 слов; хотите, чтобы я внес изменения?», «данные в этой таблице приведены для примера, дополните их реальными цифрами из ваших экспериментов»)». Он добавил, что платформа не будет делать исключений из этого правила, но при этом существует процедура апелляции, и модераторы платформы должны четко документировать сообщения. Руководитель arXiv по соответствующей дисциплине должен подтвердить санкцию.

Журналы и материалы конференций также наводнены проблемными ИИ-генерированными материалами

Платформы для препринтов, как и научные журналы, все чаще наводняются статьями, сгенерированными ИИ и не проверенными. Недавнее исследование показало, что в материалах научных конференций массово могут публиковаться статьи (написанные или сгенерированные ИИ) с целью продать исследователям "теплое место" для их подписи за 11-400 долларов.

Также регулярно можно обнаружить научные статьи, включающие причудливые диаграммы, сгенерированные ИИ. Например, была найдена статья, опубликованная в марте 2025 года в журнале Alexandria Engineering Journal издательства Elsevier, которая должна была представлять математическое моделирование механики улитки и связанных с ней дисфункций. В ней можно найти такие совершенно фантастические и неподходящие иллюстрации:

Пример фантастической иллюстрации, сгенерированной ИИ
Пример фантастической иллюстрации из статьи, предположительно сгенерированной ИИ.

Статья на данный момент еще не отозвана.

ACL также принимает меры

Платформы для препринтов не единственные, кто реагирует. Так, например, организаторы конференции Ассоциации по вычислительной лингвистике (ACL), которая состоится в июле, были вынуждены опубликовать специальное заявление относительно отклонения статей, содержащих вымышленные ссылки. Организация объясняет, что многие предложения были отклонены на ранних этапах из-за подобных проблем.

Но они добавляют, что даже после этих фильтров были упущения: «во время последних проверок окончательных версий статей, принятых для ACL 2026, мы выявили более сотни статей, содержащих ссылки на несуществующие публикации». И они добавляют, что «в результате мы приняли решение автоматически отклонить эти принятые статьи, чтобы сохранить качество и надежность материалов конференции».