Аудит 2,47 млн биомедицинских статей показал, что вымышленные ссылки в рецензируемых научных работах стали системной проблемой. С 2023 года частота таких случаев выросла более чем в 12 раз.
Исследователи из Колумбийского университета и других организаций опубликовали в The Lancet крупнейший на сегодня анализ цитирований в биомедицинских публикациях. Команда под руководством Максима Топаза проверила материалы из открытого архива PubMed Central, вышедшие с января 2023 года по февраль 2026 года.
Авторы изучили 97,1 млн ссылок и отметили 4046 как вымышленные. Они встретились в 2810 статьях. Ссылка считалась вымышленной, если указанный в ней заголовок не находился ни в одной из четырех крупных баз: PubMed, Crossref, OpenAlex и Google Scholar.
В 2023 году уровень держался примерно на отметке 4 вымышленные ссылки на 10 тыс. статей. С середины 2024 года показатель начал быстро расти: к концу 2025 года он достиг 51,3 на 10 тыс., а в первые семь недель 2026 года — 56,9 на 10 тыс.
Авторы связывают этот рост с широким распространением языковых моделей, таких как ChatGPT, которое началось в конце 2022 года. По их оценке, из-за стандартной задержки между отправкой статьи и публикацией в 100–200 дней следы текста, созданного ИИ, должны были массово появиться в PubMed Central лишь к середине 2024 года.
При этом исследователи не исключают и другие причины. В их числе — активность paper mills, то есть фабрик научных публикаций, а также возможные изменения в практике индексирования материалов.
Проблему усугубляет то, что такие ссылки трудно заметить. Они соответствуют теме статьи, оформлены по правилам, указывают реальных исследователей и содержат правдоподобные годы публикации. В одной статье по урологии 18 из 30 проверенных ссылок оказались вымышленными, хотя все они выглядели уместно для узкой хирургической темы.
Исследование также выявило признаки координированной работы фабрик публикаций. Два автора фигурировали в 11 статьях одного хирургического журнала, где суммарно нашли 15 вымышленных ссылок по темам вроде диагностики с применением CRISPR и микробиома кишечника.
На момент проверки 98,4% затронутых статей не получили никакой реакции от издателей. Обзорные статьи пострадали сильнее других: частота вымышленных ссылок в них была на 57% выше. Авторы подчеркивают, что это особенно рискованно, потому что именно обзоры часто становятся основой для клинических рекомендаций.
Если рекомендации ссылаются на работу с частично вымышленными источниками, вся цепочка доказательств, на которой строятся решения о лечении, оказывается под сомнением.
Научное сообщество уже начало реагировать, но меры пока применяются неравномерно. Arxiv ужесточил санкции за непроверенный вывод LLM в рукописях, включая галлюцинированные источники, и предупредил о возможном годовом запрете для нарушителей. Отдельный анализ принятых статей NeurIPS 2025 ранее показал, что даже ведущие конференции по ИИ плохо выявляют вымышленные ссылки.
В качестве одного из возможных инструментов авторы упоминают CiteAudit — систему с открытым кодом для автоматической проверки цитирований. При этом она также показывает, что коммерческие языковые модели слабо справляются с поиском собственных ошибок в ссылках.
Исследователи предложили четыре шага:
- автоматическую проверку ссылок до рецензирования;
- добавление метаданных о добросовестности в наборы данных статей;
- повторную проверку уже опубликованных работ;
- отдельную категорию «вымышленные ссылки» в базах данных по исследовательской добросовестности.
Авторы также указали, что во время работы над исследованием использовали Claude для написания кода и проверки грамматики.
Источник: The Lancet, The Decoder.






















