Два независимых исследования 2026 года — перехват сетевого трафика ChatGPT и разбор «зрения» ИИ-агентов — сходятся в одном выводе: ИИ цитирует не лучший контент, а самый читаемый для машины. Ниже — что именно видит робот на вашем сайте и что исправить, чтобы попасть в его ответы.
Вот реальная запись внутреннего монолога ChatGPT, извлечённая из его сетевого трафика. Модель зашла на официальный сайт продукта, чтобы проверить цены, — и не смогла:
«Цены не отображаются напрямую в результатах поиска, возможно, они скрыты за JavaScript... Я не могу их прочитать. Я могу использовать сторонние источники... буду использовать цитаты из G2, где это уместно».
Владелец этого сайта потратил деньги на контент, дизайн и SEO. А ссылку в ответе ChatGPT — вместе с доверием пользователя — получил агрегатор G2. Не потому, что у G2 информация лучше. Потому что робот смог её прочитать.
Эту запись обнаружил Сугантан Моханадасан (Suganthan Mohanadasan), сооснователь Keyword Insights и Snippet Digital, в исследовании «How ChatGPT Actually Picks Sources (I Read the Network Traffic, Not the Outputs)», опубликованном на Search Engine Journal в июне 2026 года. Вместо привычного «чёрного ящика» — тысяч промтов и анализа ответов — он вскрыл сам процесс: через Network Panel в Chrome DevTools прочитал JSON-трафик ChatGPT и собрал около 1240 записей об источниках, которые модель загружала во время реальных поисковых сессий.
Второе исследование пришло с другой стороны. Слободан «Сани» Манич (Slobodan Manic), CRO-специалист и контрибьютор ядра WordPress, в статье «How AI Agents See Your Website (And How to Build for Them)» на сайте No Hacks разобрал, каким «зрением» пользуются ИИ-агенты — ChatGPT Atlas, Claude Computer Use, Google Project Mariner — когда не просто читают страницу, а действуют на ней: кликают, заполняют формы, покупают.
Один автор смотрел на то, как ИИ выбирает, кого цитировать. Другой — на то, как ИИ физически видит страницу. Выводы совпали. Разберём по порядку.
Четыре канала, по которым ChatGPT читает ваш сайт
По данным Моханадасана, каждый документ, который ChatGPT загружает в контекст, помечен скрытым полем result_source. Значений четыре, и они описывают четыре разных мира:
|
Канал |
Что это |
Кто туда попадает |
|---|---|---|
|
labrador |
Лицензированный «белый список» издателей |
Reuters, WSJ, The Guardian, Wikipedia, arXiv. Сниппеты по ~1080 символов — фактически полные выдержки. Без прямого соглашения с OpenAI туда не попасть |
|
bright |
Прокси-сеть скрейпинга Bright Data |
Коммерческие запросы, e-commerce, финансы. Через неё ChatGPT читает Reddit, Forbes, Rtings |
|
oxylabs |
Прокси-сеть Oxylabs |
Региональная пресса и общий открытый веб |
|
serp |
Обычный веб-поиск (вероятно, индекс Bing) |
Чаще всего новостные запросы |
Практический смысл: обычный сайт — ваш и мой — конкурирует только в скрейпинговом сегменте (bright и oxylabs). А значит, первое условие видимости в ИИ — быть легко скрейпируемым: чистый HTML, никаких блокировок прокси-сетей, никакого критичного контента, спрятанного за скриптами.
30% запросов вообще не доходят до веба
Перед поиском ChatGPT классифицирует намерение пользователя (поле turn_use_case). И если запрос получает метку text — веб-поиск не запускается вообще: модель отвечает из собственных весов.
Моханадасан зафиксировал, что даже инструкции («как поменять колесо») и медицинские запросы («последние рекомендации по лечению диабета 2 типа») примерно в 30% случаев обрабатывались без единого обращения к интернету. Прежде чем оптимизировать страницу под информационный запрос, стоит проверить: инициирует ли этот запрос поиск в принципе. Если нет — трафика из него не будет физически, сколько ни вкладывай в контент.
Один вопрос — до 40 скрытых запросов
В «рассуждающих» моделях один вопрос пользователя разворачивается в веер из 15–40 скрытых подзапросов. Спросите ИИ о сравнении цен на софт — и он начнёт точечно прощупывать сеть: запросы вида site:domain.com/pricing, проверка догадок о цене, сканирование конкурентов, которых пользователь даже не называл.

Image Credit: Suganthan Mohanadasan
Механика парсинга при этом почти примитивна: модель ищет в HTML символы валют, цифры и ключевые слова — буквально «грепает» код. Если робот не находит $ и цифру рядом с ним в чистом HTML, страница отбрасывается. Цены, тарифы и характеристики должны лежать в простом тексте, а не собираться скриптом на лету.
Загружен ≠ процитирован: кейс Reddit против YouTube
Самое отрезвляющее наблюдение исследования — разрыв между тремя состояниями сайта в ответе ИИ:
-
Fetched — страница скачана в контекст (пользователь этого не видит);
-
Cited — страница стала кликабельной сноской у конкретного предложения;
-
Mentioned — бренд назван в тексте, но ссылка ведёт на чужой сайт.
В выборке Моханадасана Reddit и YouTube загружались почти одинаково часто: 278 и 201 раз. Но Reddit получил 11 цитирований, а YouTube — ноль. Причина механическая: цитата должна привязываться к конкретному тексту. Из Reddit робот забирает текст треда целиком, из YouTube — только тайтл и описание, но не транскрипт видео.
Отсюда два правила. Чтобы получить сноску, мало быть релевантным теме — нужно быть лучшим текстовым подтверждением конкретного факта. И второе: ChatGPT дедуплицирует результаты по домену, так что двадцать «водянистых» статей схлопнутся в одну запись. Одна сильная страница с фактами бьёт сетку слабых.
Отдельная деталь для локального бизнеса: в трафике зафиксирована переменная local_results_limit = 2. На запрос «кофейня рядом» ChatGPT покажет два заведения. Борьба идёт не за топ-10 — за топ-2.
Теперь вторая половина картины: как ИИ-агент видит страницу
Исследование Моханадасана объясняет, кого ИИ цитирует. Статья Манича объясняет, что ИИ вообще способен разглядеть, — и здесь главная мысль формулируется в одну строку:
Оптимизация сайта под ИИ-агентов — это на 90% та же работа по веб-доступности (accessibility), которую специалисты продвигают уже десятилетиями.
Манич описывает три способа, которыми агенты «смотрят» на страницу. Одни (Claude Computer Use, Project Mariner) делают скриншоты и анализируют пиксели — гибко, но дорого и хрупко. Другие (ChatGPT Atlas, Playwright MCP) пикселей не видят вовсе: они читают дерево доступности (Accessibility Tree) — ту самую структуру, что создавалась для скринридеров слабовидящих пользователей. Третьи комбинируют оба подхода.
Следствие прямое: если кнопка «Купить» свёрстана как <div> без роли button, агент не понимает, что на неё можно нажать. Покупка не состоится — не из-за цены или текста, а из-за вёрстки. ИИ-агент навигирует по вашему сайту ровно так же, как незрячий пользователь с VoiceOver или NVDA.
Рецепт Манича прозаичен и потому убедителен:
-
Семантический HTML вместо бесконечных <div>: <header>, <nav>, <main>, <article>, <button>, <a> — это автоматически выстраивает корректное дерево доступности;
-
ARIA-атрибуты (aria-label, aria-expanded) — там, где HTML не хватает, но они не чинят сломанную вёрстку, а дополняют чистую;
-
SSR/SSG вместо тяжёлых SPA: агенты умеют исполнять JavaScript, но серверный рендеринг парсится быстрее, стабильнее и с меньшим числом ошибок — что напрямую смыкается с историей про G2 из логов ChatGPT.
И тестировать это можно без единого ИИ-инструмента: скринридер, вкладка Accessibility в Chrome DevTools, Lighthouse, Axe. Манич формулирует критерий, который стоит повесить на стену: если вы можете совершить покупку на своём сайте с закрытыми глазами — с клавиатуры, под синтезатор речи, — ИИ-агент тоже справится.
Что делать: чек-лист по мотивам обоих исследований
По данным Манича, доля нечеловеческого трафика в интернете уже превысила 51%. Робот — больше не второстепенный посетитель, а половина вашей аудитории. Вот что оба исследования, независимо друг от друга, предписывают для неё сделать:
-
Выведите факты в чистый HTML. Цены, тарифы, характеристики — простым текстом, без JS-рендеринга. Робот ищет $ и цифру; не нашёл — процитировал G2.
-
Проверьте, что вы не блокируете скрейперов. Ваш канал в ChatGPT — прокси-сети Bright Data и Oxylabs. Закрылись от них — исчезли из ответов.
-
Пишите страницы-подтверждения фактов, а не «обзорную воду». Цитату получает лучший текстовый пруф конкретного утверждения. Одна сильная страница > 20 слабых (дедупликация по домену).
-
Верстайте семантически и проверяйте скринридером. Дерево доступности — интерфейс, через который ИИ-агент кликает и покупает. <div>-кнопка невидима для него.
-
Проверяйте, запускает ли ваш запрос веб-поиск вообще. ~30% информационных запросов ChatGPT закрывает из собственной памяти — под них оптимизировать бессмысленно.
-
Для локального бизнеса — цельтесь в топ-2, потому что local_results_limit = 2.
Десять лет доступность продавали как этику и заботу о меньшинстве пользователей. Оказалось, это была подготовка к аудитории, которая уже составляет половину трафика и решает, кого цитировать, а кого — нет. Самое дешёвое SEO 2026 года выглядит как работа для скринридеров.
Источники:
-
Suganthan Mohanadasan, «How ChatGPT Actually Picks Sources (I Read the Network Traffic, Not the Outputs)» — Search Engine Journal, июнь 2026.
-
Slobodan «Sani» Manic, «How AI Agents See Your Website (And How to Build for Them)» — No Hacks, февраль 2026.
Maxim Safianov
0 комментариев
Комментариев пока нет — будьте первым.
Войдите, чтобы комментарий опубликовался сразу:
…или оставьте комментарий как гость — гостевые комментарии появляются после модерации.