Почему нейросеть каждый раз отвечает по-разному – и как тогда измерять видимость бренда
CiteFlow · август 2026
Проведите эксперимент. Спросите Алису или GigaChat: «посоветуй [ваша категория] в [ваш город]». Запишите ответ. Откройте новый чат и задайте тот же вопрос ещё раз. И ещё раз. Скорее всего, вы получите три разных списка компаний.
Это не глюк – так устроена генерация
Каждый ответ языковой модели генерируется заново, и результат каждый раз немного другой. На наших замерах GigaChat на один и тот же вопрос ответил сначала текстом в 2710 символов с одним списком компаний, а через две минуты – текстом в 2372 символа с заметно другим списком. У генеративного ответа Яндекса между прогонами меняется даже состав сайтов, на которые он опирается: один источник исчезает, другой появляется.
Масштаб явления подтверждён и академически: работа «Don't Measure Once» показала, что идентичные запросы в ИИ-поиске расходятся между прогонами примерно в половине случаев.
Следствие: одиночный замер – это случайность, а не факт
«Сегодня вас нет в ответе, завтра есть» может означать ровно ничего: изменился не рынок, а бросок кубика. Отчёт о «видимости бренда в нейросетях», в котором каждый вопрос проверен один раз, измеряет не видимость, а однократную реализацию случайной величины. График «динамики» по таким точкам – интерпретация шума.
Это не абстрактная придирка. На типичной панели запросов разброс между прогонами легко съедает 5–10 процентных пунктов – то есть «рост с 18% до 23%» при одиночных замерах неотличим от отсутствия изменений.
Как измерять честно
Инструментов три, и все давно известны статистике.
Повторы. Каждый вопрос задаётся минимум трижды (K≥3) каждому движку. Метрика считается по распределению ответов, а не по одному ответу.
Интервал неопределённости. Рядом с каждой цифрой – диапазон, в который ляжет результат при повторении измерения тем же протоколом: «12% ± 3 п.п.», а не просто «12%».
Минимальный обнаружимый эффект (MDE). Для каждой панели считается порог, ниже которого изменение неотличимо от шума. Изменение на 2 п.п. при MDE 5 п.п. – это погрешность, и честный отчёт так и пишет.
Три вопроса к любому отчёту о видимости
Если вы покупаете мониторинг нейросетей – у сервиса или у агентства, – задайте три вопроса. Первый: сколько раз проверялся каждый запрос? Второй: можно ли открыть сырые ответы нейросети, из которых посчитаны проценты? Третий: написана ли рядом с цифрой её погрешность?
Ответы «один», «нет» и «нет» означают, что перед вами снимок случайности с красивыми графиками.
Полный протокол измерения CiteFlow – панель, повторы, знаменатели метрик, правило эха, хранение сырья – опубликован на странице методологии. Проверить свой бренд этим протоколом можно бесплатно за несколько минут.