🤖 Vibe Citing: когда ИИ выдумывает источники, а никто не проверяет
В лексиконе ИИ-эпохи появился новый термин - «vibe citing» (по аналогии с vibe coding). Это когда языковые модели генерируют академические ссылки, не проверяя, существуют ли цитируемые работы на самом деле. Источники выглядят правдоподобно: правильный формат, знакомые имена авторов, реалистичные названия журналов. Только вот работ этих не существует.
И проблема уже вышла далеко за рамки студенческих рефератов.
🧠 Провал на топовой ИИ-конференции NeurIPS 2025 Исследователи просканировали почти 5 000 принятых статей на самую престижную ИИ-конференцию мира (NeurIPS 2025) и нашли 100 сфабрикованных цитат в 51 работе. Ни один из рецензентов (в рамках хваленого peer review) этого не заметил. Причина проста: из-за бума ИИ количество заявок выросло на 220% за 5 лет. Рецензенты перегружены и физически не могут прокликивать каждую из 30-60 ссылок в статье, а идеальный синтаксис «галлюцинаций» обманывает человеческий глаз.
💼 Корпоративный позор KPMG (июнь 2026) В корпоративном секторе ситуация не лучше. В октябре 2025 года консалтинговый гигант KPMG выпустил большой отчет «Total Experience: Redefining Excellence in the Age of Agentic AI»
На днях GPTZero проверили этот отчет и выяснили шокирующую деталь: из 45 цитат только 5 (!) указывали на реальные источники. Остальные 40 - это либо склейка названий разных статей, либо чистые галлюцинации. Около половины утверждений в отчете оказались выдумкой. ИИ-ассистент, которому поручили найти примеры «agentic AI», перестарался и просто выдумал несуществующие кейсы для реальных компаний.
В итоге швейцарский банк UBS, британская служба здравоохранения (NHS) и швейцарские железные дороги возмутились откровенным фейкам, и буквально пару дней назад KPMG пришлось удалить отчет.
⚠️ Почему это страшно? Это не плагиат и не намеренная фабрикация данных человеком. Это новый вид академического загрязнения, который масштабируется мгновенно. LLM отлично усвоили формат цитирования, но не понимают смысла. Если такие ссылки попадут в обучающие датасеты для следующих поколений ИИ, мы получим рекурсивное отравление данных. Отличить правду от выдумки станет невозможно.
#ИИ #VibeCiting #Нейросети #GPTZero
В лексиконе ИИ-эпохи появился новый термин - «vibe citing» (по аналогии с vibe coding). Это когда языковые модели генерируют академические ссылки, не проверяя, существуют ли цитируемые работы на самом деле. Источники выглядят правдоподобно: правильный формат, знакомые имена авторов, реалистичные названия журналов. Только вот работ этих не существует.
И проблема уже вышла далеко за рамки студенческих рефератов.
🧠 Провал на топовой ИИ-конференции NeurIPS 2025 Исследователи просканировали почти 5 000 принятых статей на самую престижную ИИ-конференцию мира (NeurIPS 2025) и нашли 100 сфабрикованных цитат в 51 работе. Ни один из рецензентов (в рамках хваленого peer review) этого не заметил. Причина проста: из-за бума ИИ количество заявок выросло на 220% за 5 лет. Рецензенты перегружены и физически не могут прокликивать каждую из 30-60 ссылок в статье, а идеальный синтаксис «галлюцинаций» обманывает человеческий глаз.
💼 Корпоративный позор KPMG (июнь 2026) В корпоративном секторе ситуация не лучше. В октябре 2025 года консалтинговый гигант KPMG выпустил большой отчет «Total Experience: Redefining Excellence in the Age of Agentic AI»
На днях GPTZero проверили этот отчет и выяснили шокирующую деталь: из 45 цитат только 5 (!) указывали на реальные источники. Остальные 40 - это либо склейка названий разных статей, либо чистые галлюцинации. Около половины утверждений в отчете оказались выдумкой. ИИ-ассистент, которому поручили найти примеры «agentic AI», перестарался и просто выдумал несуществующие кейсы для реальных компаний.
В итоге швейцарский банк UBS, британская служба здравоохранения (NHS) и швейцарские железные дороги возмутились откровенным фейкам, и буквально пару дней назад KPMG пришлось удалить отчет.
⚠️ Почему это страшно? Это не плагиат и не намеренная фабрикация данных человеком. Это новый вид академического загрязнения, который масштабируется мгновенно. LLM отлично усвоили формат цитирования, но не понимают смысла. Если такие ссылки попадут в обучающие датасеты для следующих поколений ИИ, мы получим рекурсивное отравление данных. Отличить правду от выдумки станет невозможно.
#ИИ #VibeCiting #Нейросети #GPTZero