RESONEO провели масштабное исследование ChatGPT Retrieval, чтобы понять, какие страницы попадают в AI-ответы, какие фрагменты контента видит модель и как работает поиск источников.
Исследователи проанализировали 27 000 страниц, 58 000 извлеченных URL и 1 249 реальных ответов ChatGPT, собранных в июле 2026 года. Результаты дают интересное представление о том, что происходит со страницей между ее индексацией и появлением ссылки в ответе ChatGPT.
Что происходит со страницей в ChatGPT
Одна из главных особенностей исследования заключается в том, что найденная ChatGPT страница далеко не всегда открывается моделью полностью.
Из 58 000 извлеченных URL дальнейший путь прошли только некоторые страницы.
| Этап | Количество |
|---|---|
| Извлечено URL | 58 000 |
| Повышено до потенциальных источников | 7 600 |
| Процитировано в ответах | 5 000 |
| Фактически открыто и прочитано | 760 |
Получается важный момент для GEO: попадание страницы в retrieval не означает, что ChatGPT обязательно откроет и прочитает весь документ.
На раннем этапе система может принимать решение на основании значительно меньшего объема информации.
Что именно видит ChatGPT при retrieval
В типичном результате retrieval страница представлена примерно тремя основными элементами:
Title + URL + короткий текстовый snippet.
Для собственного поискового индекса OpenAI исследование показывает следующие характеристики сниппета:
- максимальная длина составляет около 202 символов;
- в 83,6% случаев сниппет содержит H1;
- в 77% случаев H1 начинается прямо с первого символа сниппета;
- после H1 остается примерно 146 символов для основного текста;
- Meta Description не используется для формирования этого сниппета.
Таким образом, значительная часть информации о странице может быть представлена буквально несколькими предложениями.
Почему первые символы страницы важны
Именно поэтому для GEO важна не только глубина материала, но и информационная плотность первых фрагментов страницы.
Даже изображения могут влиять на retrieval
Исследование обнаружило еще одну интересную деталь.
alt изображения может занимать около 50 символов ограниченного пространства сниппета. Если перед основным текстом находится изображение с длинным alt, часть доступного пространства может быть занята описанием изображения.В условиях ограничения примерно в 202 символа это уже существенно.
Как разные режимы ChatGPT используют поиск
Здесь важно понимать разницу между режимами.
Free Think — режим Thinking в бесплатной версии ChatGPT, в котором модель дополнительно анализирует запрос и выполняет поиск.
Paid Thinking — аналогичный режим для платных пользователей,использующий более широкий набор возможностей поиска и моделей.
RESONEO сравнили, откуда ChatGPT получает найденные веб-страницы в этих режимах. Под URL здесь понимаются найденные веб-страницы, которые система рассматривает как потенциальные источники для ответа. Это не означает, что каждая из них будет открыта или процитирована.
Free Think
В среднем система находила 35,3 URL на разговор.
| Источник | Доля |
|---|---|
| Собственный индекс OpenAI | 74,7% |
| 3,1% | |
| Oxylabs | 22,2% |
Paid Thinking
В среднем система находила 35,1 URL на разговор.
| Источник | Доля |
|---|---|
| Собственный индекс OpenAI | 24,7% |
| 75,3% |
Разница получается очень существенной.
В исследовании Free Think в основном опирался на собственный индекс OpenAI, тогда как Paid Thinking значительно сильнее использовал Google. Поэтому один и тот же пользовательский запрос в разных режимах ChatGPT потенциально может формировать ответ на основе разных наборов веб-страниц.
Thinking находит больше страниц
Есть еще одно интересное сравнение:
| Режим | Среднее количество URL |
|---|---|
| Free Instant | 15,1 |
| Free Think | 35,3 |
Таким образом, режим Thinking в исследовании находил более чем в два раза больше потенциальных источников, чем Free Instant. Это важно учитывать при анализе GEO: результаты присутствия сайта в ChatGPT могут зависеть не только от самого запроса, но и от режима, в котором пользователь его задает.
Search Index и Read Cache — это не одно и то же
Еще один важный вывод исследования связан с тем, как OpenAI хранит найденные страницы.
| Механизм | Что хранится |
|---|---|
| Search index | Короткий сниппет страницы для retrieval |
| Read cache | Полная страница, преобразованная в Markdown |
Это означает, что после изменения страницы ChatGPT не обязательно сразу увидит новую версию ее сниппета.
Read cache также может быть долгоживущим
Полная версия страницы в read cache может сохраняться несколько недель или даже месяцев. Причем после того, как страница была открыта одним пользователем, ее сохраненная версия потенциально может использоваться для другого пользователя без нового обращения к исходному сайту.
Получается, что изменения на сайте не обязательно моментально отражаются во всех слоях системы.
Что это означает для GEO
Исследование показывает, что традиционный подход «написать большую статью и оптимизировать ее под ключевые слова» становится недостаточным.
Для AI-поиска необходимо учитывать несколько уровней:
- Indexing — попала ли страница в индекс.
- Retrieval — какой фрагмент страницы был извлечен.
- Extraction — какую информацию модель получила из найденного документа.
- Citation — была ли страница в итоге использована как источник ответа.
Поэтому GEO стоит рассматривать не только как оптимизацию страницы под поисковое ранжирование. Это еще и оптимизация контента для извлечения AI-системой.
Какие элементы страницы особенно важны
Исходя из данных исследования, особое внимание стоит уделять:
- Title — должен четко описывать содержание страницы;
- H1 — должен однозначно обозначать основную тему;
- первым 100-150 символам после H1 — именно здесь может находиться значительная часть информации, доступной на этапе retrieval;
- структуре страницы — контент должен быть понятен без необходимости читать весь документ;
- alt-текстам изображений — они могут занимать часть ограниченного пространства сниппета.
Главная идея здесь достаточно простая:
Необходимо оптимизировать не только всю страницу, но и тот небольшой фрагмент, который AI-система увидит первой.
Главный вывод
Исследование RESONEO хорошо показывает отличие между классическим SEO и GEO. В SEO мы привыкли думать о странице как о целом документе: ее содержании, ссылках, технических факторах, авторитетности и позициях.
В AI-поиске появляется дополнительный вопрос:
«Какой именно фрагмент этой страницы увидит модель и сможет ли она понять его без открытия всего документа?»
Именно поэтому GEO постепенно смещается от простой оптимизации под ranking к оптимизации всей цепочки:
retrieval → extraction → citation
Чем точнее страница представлена на каждом из этих этапов, тем выше вероятность, что ее информация будет использована в итоговом AI-ответе.
Источник:
исследование RESONEO «ChatGPT Retrieval»


2 комментария
пока что вообще не понимаю как попасть в ГПТ, и есть ли я там уже каким-то образом и как усилить видимость.. все это очень новое.. а теперь еще и не одним CHATGPT едины.. ИИшек слишком много, а некоторых приходится вообще бананить, потому что они берега теряют при сканировании
Вот банить не рекомендую, только откровенных китайских ботов.
Да, но рынок развивается, возможно через 2-3 года выдачи стандартной уже не будет с ссылками, а будут только чатботы.