Нейросети придумали учёных, которых никогда не существовало. Под их именами в научные базы данных уже загружены тысячи статей.
Исследователи Samsung и Варшавского университета опубликовали препринт (предварительная версия научной статьи) о «призрачных» авторах — вымышленных именах, которые языковые модели выдают снова и снова, когда их просят придумать эксперта. Чаще других всплывают имена Елена Васкес и Маркус Чен: по подсчётам авторов работы, эти двое успели побывать вулканологами, астронавтами, героями триллеров, ведущими подкастов и соавторами научных публикаций в сотнях сгенерированных документов.
На Zenodo (универсальный бесплатный репозиторий с открытым доступом для научных работ) исследователи нашли более 1,6 тысяч записей, подписанных такими именами. Публикации ссылаются на несуществующие журналы, а даты выхода проставлены задним числом. Завести там бесплатный аккаунт и получить уникальный цифровой код статьи DOI может кто угодно, а дальше материалы подхватывают агрегаторы: те же имена обнаружились на других платформах, где сложились целые «исследовательские коллективы» из авторов, сгенерированных разными нейросетями, и в поиске Google Scholar и Semantic Scholar — без какой-либо проверки.
У каждой модели, как выяснили авторы, свой набор излюбленных имён: Claude чаще выдаёт Елену Амару Окафор, Gemini — Ариса Торна и Лену Петрову, ChatGPT — Элару Восс и Маркуса Чена. Некоторые имена «слипаются» и появляются вместе. Препринт не прошёл рецензирование, его выводы пока не подтверждены независимо. Ни одна из платформ для ученых публично на исследование не отвечали, поэтому неизвестно, сколько из записей администрация репозитория посчитает мусором и собирается ли их удалять.