← Все статьи

25% ссылок в ИИ-ответах не подтверждают утверждения

Иллюстрация к статье «25% ссылок в ИИ-ответах не подтверждают утверждения»

Искусственный интеллект всё чаще становится главным источником информации для миллионов пользователей. Но доверять ему слепо - опасно. Новые исследования показывают: цитирование в ИИ-ответе вовсе не означает, что источник действительно подтверждает то, к чему его привязали. Это создаёт фундаментальную проблему достоверности, которая касается и бизнеса, и потребителей.

Цитирование не равно поддержке

Критический обзор 45 исследований GEO, опубликованный на arXiv в июле 2026 года, раскрывает масштаб проблемы. В ранних генеративных движках только 51,5% предложений были полностью подтверждены цитируемыми источниками. 74,5% цитирований фактически поддерживали утверждение, к которому были привязаны. Это означает: примерно каждое четвёртое цитирование не подтверждает то, о чём говорит ИИ.

Проблема не исчезла с развитием технологий. Более новые исследования показывают, что доля credible-source составляет от 71,4% до 86,3% в зависимости от ассистента и темы. Анализ 98 020 атомарных утверждений классифицировал примерно 11% как недостаточно подтверждённые. ИИ-системы могут процитировать страницу, которая не поддерживает утверждение, или даже сослаться на синтетический контент, который сам был сгенерирован ИИ.

Что скрывается за видимым цитированием

Аудит более 19 000 извлечённых текстовых страниц выявил тревожную картину: примерно 16% страниц были помечены детектором как ИИ-генерированные. А 27,1% URL вообще не удалось просканировать - они были недоступны, удалены или не являлись текстовыми.

Это означает, что видимая цитата может вести на страницу, которая не подтверждает утверждение. Или на синтетический контент, который питает систему и создаёт замкнутый круг дезинформации. Когда ИИ цитирует ИИ-сгенерированный контент, достоверность всей цепочки рушится.

77.5% - это «всё или ничего»

Иллюстрация к статье «25% ссылок в ИИ-ответах не подтверждают утверждения» (2)

Исследование Ranqo, проанализировавшее 100 000+ ответов ИИ по 100+ брендам, выявило важную закономерность. 77,5% ячеек (бренд, промпт, движок) строго «всегда» или «никогда» не упоминаются. Это означает, что поведение ИИ-систем удивительно детерминировано: если бренд появляется в ответе, он появляется всегда; если не появляется - никогда.

Собственный домен бренда составляет только 2,9% всех цитирований. Основной объём цитирований приходится на сторонние ресурсы - корпоративные сайты, YouTube, Reddit, редакционные медиа и Wikipedia. Списки (listicles) - самый цитируемый формат контента, составляющий около 21% всех цитирований.

При этом широкие discovery-вопросы показывают бренд чаще (23%), чем конкретные проблемные и use-case вопросы (11%). Это означает, что ИИ лучше знает бренды на общем уровне, но хуже - в конкретных сценариях использования.

Обратная сторона GEO-оптимизации

Обзор 45 исследований выявил контринтуитивный результат: GEO-переписывание может навредить. В воспроизводимом эксперименте RAG-пайплайна, охватившем 171 003 документа и 2 700 запросов, переписывание тела страницы для добавления цитат и источников снизило производительность на каждом этапе retrieval.

Иллюстрация к статье «25% ссылок в ИИ-ответах не подтверждают утверждения» (3)

Начальный retrieval top-20 упал примерно на 9%. Top-10 после reranking - примерно на 16%. Финальное цитирование - примерно на 6%. Механически вставленные фразы о цитировании могут сместить распределение словаря документа от запроса, что снижает его рейтинг в embedding retrieval и reranking.

Это ключевой вывод для маркетологов: полировка страницы для лучшего поглощения в ответах ИИ и сохранение её retrievable как кандидата - две силы, которые могут тянуть в противоположные стороны. Если гнаться за первым, можно потерять второе, и итог будет отрицательным.

Что реально работает

Обзор 45 исследований показывает: самые воспроизводимые факторы - структурные, а не риторические. Эксперимент, охвативший 252 000 испытаний на шести LLM и восемнадцати факторах, выявил, что релевантность запросу и позиция в контексте - главные детерминанты первого цитирования. Перемещение источника выше в контексте даёт больший эффект, чем большинство переписываний.

Это означает: создавайте контент, который отвечает на целевой вопрос напрямую (topical relevance), и дайте странице структурные основы - ясность, организацию, сигналы авторитета - которые позволят ей занять высокое место в retrieval и reranking. И только потом инвестируйте в декорации на уровне предложений.

Generic-эвристики («добавь статистику», «добавь цитаты») переносятся плохо. Одна и та же техника может потерять или изменить эффект в зависимости от домена и движка.

Почему одно измерение ничего не показывает

Данные о волатильности показывают: за 45 дней ежедневных измерений на четырёх движках Jaccard similarity на уровне источников составила около 0,34-0,42. Это означает, что более половины списка цитирований меняется день ото дня. Измерение один раз не даёт никакой информации о реальной видимости.

Обзор рекомендует измерять GEO по четырём измерениям: запуск, парафраз, дата и движок. Семь-восемь повторений на промпт - минимальная отправная точка.

Что делать бизнесу

Первое - не доверяйте одному цитированию. Проверяйте, действительно ли источник подтверждает утверждение, которое ему приписывают. Если вы видите, что ИИ цитирует вашу страницу в негативном контексте - это риск, который нужно отслеживать.

Второе - фокусируйтесь на структурных основах. Topical relevance и позиция в контексте работают лучше, чем любые риторические приёмы. Отвечайте на вопросы напрямую, организуйте контент чётко, стройте авторитет.

Третье - измеряйте системно. Одно измерение не показывает ничего. Нужны повторные замеры, парафразы, разные даты и разные движки.

Четвёртое - будьте осторожны с переписыванием. Оптимизация для цитирования может снизить retrievability. Тестируйте изменения и измеряйте их влияние на всех этапах.

Вывод

ИИ-поиск - это не чёрный ящик, а система с измеримыми закономерностями. Компании, которые поймут, что цитирование не равно поддержке, а структурные факторы важнее риторических, получат преимущество. В мире, где ИИ становится главным источником информации, побеждают те, кто строит доверие на фактах и прозрачности, а не на манипуляциях.

Хотите так же для своего бренда?

Начнём с бесплатного GEO-аудита — покажем, как вас видят нейросети прямо сейчас.
Выберите мессенджер
Telegram
WhatsApp