Исследование: 89% биомедицинских статей к 2025 году изменят язык благодаря ИИ

Анализ 1,19 млн публикаций из PubMed Central выявил резкий рост лексики, характерной для текстов, использующих большие языковые модели

22 августа 2026, 22:16Искусственный интеллектDarth Sahara4

Препринт, опубликованный 11 августа на arXiv, исследует распространённость написания с помощью ИИ в биомедицинской литературе. Авторы провели анализ 1 194 287 полнотекстовых публикаций из PubMed Central — открытой базы данных биомедицинских публикаций. Для статей, выпущенных в декабре 2025 года, методом была установлена доля в 89%: в текстах наблюдалось чрезмерное использование специфических для больших языковых моделей слов, частота которых возросла с появлением ИИ.

Авторы не ставили задачу определить, какие статьи были полностью написаны ИИ. Они отслеживали изменения в лексике, характерной для текстов эпохи LLM, сопоставляя фактическую частоту слов с прогнозируемым трендом, основанным на данных предыдущих лет. Затем для каждой публикации оценивалось наличие статистически значимого избытка такой лексики. Таким образом, выявленные 89% отражают долю работ, где присутствует специфический признак, а не долю статей, созданных искусственным интеллектом.

Изображение сгенерировано: Nano Banana

Сигнал оказался значительно сильнее в разделах Discussion («Обсуждение»), чем в Methods («Методы»). В сопоставимых по длине выборках он был обнаружен в 68% и 32% текстов соответственно. При анализе всего раздела Methods авторы также выявили этот признак более чем в половине публикаций.

Такой результат указывает на различия в характере применения языковых моделей внутри одной научной работы, однако сам по себе он не позволяет определить, какую часть текста авторы создали с использованием ИИ.

Исследователи подчеркивают, что статистический метод не способен установить степень участия ИИ в конкретной статье и тем более определить, оказала ли такая помощь влияние на научные данные, результаты или выводы. Это принципиально отличает полученную оценку от утверждения об авторстве ИИ. В исследовании также упоминается, что многие из этих работ еще не прошли рецензирование.

Тем не менее, полученная оценка непосредственно затрагивает вопрос происхождения научных текстов. Если редактирование с помощью ИИ действительно стало столь распространённым, то редакциям журналов и научным организациям придётся решить, как фиксировать использование больших языковых моделей в публикациях. Авторы полагают, что их метод может быть использован при разработке соответствующих норм и рекомендаций, однако окончательная оценка самого метода и его интерпретаций ещё требует независимой проверки.

Источники:letsdatasciencearXivИскусственный интеллект4Искусственный интеллектБиомедицинаPubMedНаучная этикаНаучные публикацииArXivПроисхождение данных22 авг 22:16

Источник
Оцените статью
Dfiles.ru