18.09.2026
Исследователи оценили распространённость помощи больших языковых моделей в 1,19 млн англоязычных статей из PubMed Central. По их методике, в декабре 2025 года признаки написания или редактирования с помощью LLM присутствовали в 89% полных текстов, однако результат пока опубликован только в виде препринта.
Исследователи из Германии и Бельгии представили статистический метод оценки использования больших языковых моделей (LLM) в научных публикациях. Согласно их расчётам, в декабре 2025 года признаки помощи LLM присутствовали в 89% изученных биомедицинских статей. Средняя оценка за весь 2025 год составила 77%.
Авторы проанализировали 1 194 287 англоязычных полнотекстовых статей, опубликованных в 2017–2025 годах и размещённых в PubMed Central — открытом архиве биомедицинской литературы Национальной медицинской библиотеки США. Метод отслеживает частоту 379 слов, употребление которых заметно выросло после распространения ChatGPT. Ожидаемую частоту слов без влияния LLM рассчитывали по трендам 2018–2022 годов.
При сравнении фрагментов одинаковой длины в декабре 2025 года наиболее высокая оценка получена для разделов с обсуждением результатов — 68%, а также для аннотаций — 67%. Для разделов с описанием методов показатель составил 32%. Авторы связывают различие с тем, что LLM чаще применяются при интерпретации и изложении результатов, чем при описании процедур.
Метод не устанавливает использование ИИ в каждой конкретной статье, а оценивает его распространённость по изменениям словаря во всём корпусе. Расчёт также предполагает, что без появления ChatGPT прежние языковые тенденции продолжались бы линейно. Кроме того, работа опубликована как препринт и ещё не прошла рецензирование.
Источник: arxiv.org