ArXiv на год заблокирует исследователей за публикацию статей с участием ИИ

2 мин
ArXiv на год заблокирует исследователей за публикацию статей с участием ИИ

Система с препринтами научных работ ArXiv заявляет, что будет блокировать авторов на один год, если они представят статьи, содержащие сгенерированный ИИ контент, такой как вымышленные цитаты, текстовые филлеры или метакомментарии.

«Если инструменты генеративного ИИ генерируют неподобающий язык, плагиат, предвзятый контент, ошибки, неточности, некорректные ссылки или вводящий в заблуждение контент, и этот итог включается в научные работы, ответственность за это несёт автор. Мы недавно уточнили наши санкции за это. Если в представленной работе содержатся неопровержимые доказательства того, что авторы не проверили результаты генерации LLM, это означает, что мы не можем доверять ничему в статье», — объявил Томас Дитерих, председатель секции компьютерных наук ArXiv. 

Доказательствами злоупотребления помощью ИИ станут «галлюцинаторные ссылки, метакомментарии от LLM («вот краткое изложение на 200 слов; хотите, чтобы я внёс какие-либо изменения?»; «данные в этой таблице носят иллюстративный характер, заполните ее реальными цифрами из ваших экспериментов»»). 

Авторов будут блокировать на год и требовать, чтобы последующие публикации на arXiv сначала были приняты авторитетным рецензируемым изданием.

Дитерих сообщил также, что это правило «одного нарушения» — то есть, авторы, уличённые в использовании ИИ в своих публикациях один раз, будут забанены, — но решения можно обжаловать. «Я хочу подчеркнуть, что мы применяем это только к случаям неопровержимых доказательств. Я равным образом должен добавить, что наш внутренний процедура требует, чтобы сначала модератор задокументировал проблему, а затем председатель секции подтвердил её, прежде чем налагать наказание», — заключил он. 

Осенью в ArXiv объявили, что больше не будут принимать обзорные статьи и аналитические доклады по информатике, которые не были рецензированы и приняты академическим журналом или конференцией. Модификация правил обусловлено наводнением этой категории низкопробными статьями, созданными при помощи искусственного интеллекта.

В марте сообщалось, что с 2022 года большинство статей на сервисе в области программной инженерии были посвящены теме LLM. На них приходится 70% новых материалов.

Читают сейчас

Версия патча GitLab: 19.2.2, 19.1.4, 19.0.6. Среди закрытых уязвимостей — опасные XSS и обход прав в CI/CD

9 минут назад

Версия патча GitLab: 19.2.2, 19.1.4, 19.0.6. Среди закрытых уязвимостей — опасные XSS и обход прав в CI/CD

12 августа 2026 года GitLab выпустил внеплановые патчи для Community Edition и Enterprise Edition — версии 19.2.2, 19.1.4 и 19.0.6. Всего закрыто 13 уязвимостей: шесть с высокой степенью критичности,

Российские школьники получили золотые и серебряные медали на 38-й Международной олимпиаде по информатике IOI 2026

34 минуты назад

Российские школьники получили золотые и серебряные медали на 38-й Международной олимпиаде по информатике IOI 2026

Российские школьники получили две золотых и две серебряных медали на 38-й Международной олимпиаде по информатике IOI 2026 (International Olympiad in Informatics), которая проходила в Ташкенте с 9 по 1

Телеканал PBS опасается потери 50 ТБ данных после завершения обслуживания облачным провайдером

1 час назад

Телеканал PBS опасается потери 50 ТБ данных после завершения обслуживания облачным провайдером

Американский телеканал PBS подал иск против компании Iron Mountain Data Centers, чтобы восстановить доступ к 50 ТБ данных, включая телепередачи, видео и другие материалы за 70 лет. Филиал Nine PBS ука

Энтузиаст уместил Steam Deck в корпус размером с оригинальный Game Boy

2 часа назад

Энтузиаст уместил Steam Deck в корпус размером с оригинальный Game Boy

Энтузиаст PhyFawkes создал необычную версию Steam Deck™ под названием SteamBoy. Он перенес начинку портативной консоли Valve в вертикальный корпус, размеры которого соответствуют оригинальной консоли

2 часа назад

Mistral обновила OCR-модель до версии 4.1

Обозначим сразу, что OCR 4.1 — это не новая схема, а доработка OCR 4. Основной упор сделали на обработку перегруженных страниц, где текст, изображения и подписи идут плотно и наслаиваются друг на друг