Post #52
150
Сегодня в Scientometrics вышла наша статья о том, как использование ИИ при написании научных текстов связано с их цитируемостью.
Мы изучили 234 073 статьи за 2019–2025 годы, объединив данные arXiv и Crossref. Обучили классификатор распознавать в аннотациях признаки редактирования языковыми моделями, а затем сопоставили их с числом цитирований.
Статьи с признаками использования ИИ в аннотациях получали примерно на 7% больше цитирований. Разница сохранялась после учёта журнала, возраста публикации, числа соавторов и источников, длины аннотации и предыдущей цитируемости авторов. Дополнительная проверка на модели, обученной на данных 2021–2022 годов, показала сходную картину: такие статьи цитировались выше прогноза.
Здесь нужна оговорка: мы выявляем стилистические признаки, а не подтверждённые случаи использования ИИ. И наблюдаемая связь сама по себе не доказывает причинность.
Возможное объяснение — языковые модели помогают понятнее представить исследование, благодаря чему его легче найти и заметить. Тогда цитируемость может отражать ещё и то, насколько хорошо автор умеет пользоваться инструментами для работы с текстом. Для оценки учёных, распределения финансирования и университетских рейтингов это имеет значение.
Есть и небольшая самоирония: при языковой редактуре этой статьи мы тоже использовали ChatGPT и указали это в благодарностях. Ждем на 7% цитат больше ожидаемого.
Статья в открытом доступе
Мы изучили 234 073 статьи за 2019–2025 годы, объединив данные arXiv и Crossref. Обучили классификатор распознавать в аннотациях признаки редактирования языковыми моделями, а затем сопоставили их с числом цитирований.
Статьи с признаками использования ИИ в аннотациях получали примерно на 7% больше цитирований. Разница сохранялась после учёта журнала, возраста публикации, числа соавторов и источников, длины аннотации и предыдущей цитируемости авторов. Дополнительная проверка на модели, обученной на данных 2021–2022 годов, показала сходную картину: такие статьи цитировались выше прогноза.
Здесь нужна оговорка: мы выявляем стилистические признаки, а не подтверждённые случаи использования ИИ. И наблюдаемая связь сама по себе не доказывает причинность.
Возможное объяснение — языковые модели помогают понятнее представить исследование, благодаря чему его легче найти и заметить. Тогда цитируемость может отражать ещё и то, насколько хорошо автор умеет пользоваться инструментами для работы с текстом. Для оценки учёных, распределения финансирования и университетских рейтингов это имеет значение.
Есть и небольшая самоирония: при языковой редактуре этой статьи мы тоже использовали ChatGPT и указали это в благодарностях. Ждем на 7% цитат больше ожидаемого.
Статья в открытом доступе
- 🔥 9
- 👍 7
- 🤔 4
- 🫡 2









