Как сайту попасть в источники и цитаты ChatGPT

Как попасть в источники ChatGPT

📌 TL;DR

Чтобы попасть в источники ChatGPT, разрешите краулеру OAI-SearchBot в robots.txt, сделайте контент извлекаемым (прямой ответ, списки, таблицы) и нарастите авторитет домена. Важная оговорка для РФ: ChatGPT недоступен в России, поэтому канал работает на аудиторию в доступных странах.

Это разбор одного из каналов AEO. Полная картина по всем платформам собрана в материале полное руководство по AEO: как попасть в ответы нейросетей.

ChatGPT Search показывает ответ на запрос и подставляет ссылки на источники, на основе которых этот ответ собран. Цитаты идут двумя способами: инлайн прямо в тексте ответа и в боковой панели со списком сайтов. Если ваш сайт оказался в этом списке, пользователь видит ваш бренд в момент принятия решения, а не среди десяти синих ссылок, по которым ещё надо кликнуть.

Функцию официально запустили 31 октября 2024 года, а с февраля 2025 года поиск стал доступен даже без входа в аккаунт. Это сильно расширило аудиторию: теперь генеративный ответ со ссылками получает не только подписчик, но и любой случайный пользователь, который зашёл задать вопрос.

Смысл попадания в источники простой. В обычной выдаче пользователь сам выбирает из десяти ссылок. В ответе ChatGPT движок уже выбрал за него три-пять сайтов и процитировал их. Конкуренция здесь жёстче, а доверие к названному источнику выше, потому что его рекомендует сама модель. Это и есть суть AEO: вы боретесь не за позицию в списке, а за право быть тем источником, на который сошлётся нейросеть.

Важно понимать и природу самого ответа. ChatGPT не выдаёт готовую страницу из индекса, как классический поисковик. Он формулирует ответ своими словами и подкрепляет его ссылками на сайты, которые подтверждают сказанное. Поэтому ваш контент должен быть не просто проиндексирован, а написан так, чтобы из него легко вытащить точную и проверяемую формулировку. Расплывчатый текст без конкретики модель процитирует с меньшей охотой, чем материал с чётким ответом на заданный вопрос.

Ответ ChatGPT Search с инлайн-цитатами и боковой панелью источников

Ответ ChatGPT Search с инлайн-цитатами и боковой панелью источников

Почему для российского бизнеса этот канал работает «вовне»?

Потому что ChatGPT официально недоступен в России: сервис блокирует доступ по IP. Оплата российскими картами не проходит, а VPN OpenAI часто детектирует и ограничивает. Это объективные факты, которые нельзя приукрашивать при планировании канала. Честный разговор с клиентом начинается именно здесь, а не с обещаний трафика.

Из этого следует практический вывод. Для российского бизнеса ChatGPT как канал имеет смысл в одном сценарии: если ваша аудитория находится в странах, где сервис доступен. Это экспортные продукты, IT, услуги для зарубежного рынка, англоязычный контент. Для бизнеса, который работает строго на внутренний рынок РФ, приоритетнее Яндекс Нейро, Алиса и GigaChat, и вкладываться в ChatGPT в первую очередь не стоит.

Есть и техническое ограничение для самих специалистов. Локально проверить, как ваш сайт выглядит в выдаче ChatGPT, из России затруднительно: тестировать приходится через доступную инфраструктуру или силами партнёров в других странах. Это усложняет замер видимости, поэтому канал чаще оценивают по косвенным сигналам, а не по прямой проверке цитат. Планировать работу нужно с поправкой на этот разрыв между действием и измерением результата.

Честный итог: ChatGPT не основной канал для большинства российских компаний. Но если ваша аудитория есть в доступных странах, игнорировать его нельзя, и подготовка к нему почти не отличается от обычной работы над качеством сайта. Те же правки усиливают видимость и в других нейросетях, так что усилия не пропадают.

Какие краулеры OpenAI нужно пускать на сайт?

У OpenAI три официальных краулера, и они выполняют разные задачи. Управляются они через файл robots.txt в корне сайта. Чтобы попадать в поиск, нужно разрешить именно тот бот, который выводит сайты в выдачу ChatGPT, а не путать его с обучающим.

Ключевой момент: за показ сайтов в поиске отвечает OAI-SearchBot. Он уважает robots.txt, поэтому если вы его заблокируете, в источники ChatGPT Search вы не попадёте. Отдельно работает GPTBot, который собирает данные для обучения моделей, и ChatGPT-User, который подгружает страницу в ответ на конкретное действие пользователя внутри чата.

Частая стратегия выглядит так: разрешить показ в поиске, но не отдавать контент в обучение. Для этого ставят Allow для OAI-SearchBot и Disallow для GPTBot. Так сайт остаётся видимым в выдаче, но его тексты не уходят в обучающую выборку моделей. Решение это осознанное, и принимать его стоит на уровне бизнеса, а не по умолчанию.

Краулер OpenAI Зачем нужен Что делать в robots.txt
OAI-SearchBot Выводит сайты в поиск ChatGPT, уважает robots.txt Разрешить (Allow) для цитирования
GPTBot Сбор данных для обучения моделей, уважает robots.txt По выбору: Disallow, если не хотите в обучение
ChatGPT-User Загрузка страницы по действию пользователя Обычно разрешают

Чек-лист по доступности для краулеров ChatGPT:

  • OAI-SearchBot разрешён в robots.txt (иначе сайт не попадёт в поиск).
  • Решено осознанно, пускать ли GPTBot в обучение.
  • Контент рендерится в HTML без обязательного исполнения JavaScript.
  • Важные тексты не спрятаны за авторизацией или скриптами.
  • robots.txt лежит в корне домена и отдаёт корректные директивы.

Важный технический нюанс: AI-краулеры читают сырой HTML и не исполняют JavaScript. Если ключевой текст подгружается скриптом на стороне клиента, бот его просто не увидит. Поэтому контент, который должен попасть в источники, обязан присутствовать в исходном HTML страницы. Это часть сквозного принципа: нейросеть читает код, и без технической базы любая красота на экране для неё невидима.

Какие факторы повышают шанс попасть в источники?

Публичной формулы ранжирования цитат OpenAI не раскрывала, поэтому точных весов факторов нет. Но по наблюдениям SEO-специалистов видна повторяющаяся картина: модель опирается на сильный, структурированный и авторитетный контент. Ниже факторы по убыванию влияния в практике, а не по официальному рейтингу. Воспринимайте их как рабочую гипотезу, проверенную на реальных проектах, а не как гарантию.

Первый блок про авторитет. Чем больше доменов ссылается на ваш сайт, тем выше воспринимаемая авторитетность ресурса. Сюда же относится сила бренда: если о вас пишут на сторонних изданиях, модель чаще выбирает вас как надёжный источник. Дистрибуция контента на внешние площадки усиливает этот эффект и работает на узнаваемость даже там, где прямого трафика пока нет.

Второй блок про структуру и формат. Хорошо извлекаются короткие секции, списки и сравнительные таблицы. Прямой ответ в первых строках помогает модели вытащить готовую формулировку без додумывания. Разметка Schema.org делает данные машиночитаемыми, а конкретные цифры и статистика с указанием источника повышают цитируемость, потому что модель ценит проверяемые факты.

Третий блок про актуальность. Свежесть контента имеет значение: устаревшие материалы цитируются реже, особенно по темам, где факты быстро меняются. Регулярное обновление ключевых страниц работает на видимость в поиске ChatGPT так же, как и в классической выдаче. Дата последнего обновления и живой контент дают модели сигнал, что источнику можно доверять.

Отдельно про llms.txt. Этот файл предлагают как способ подсказать моделям структуру сайта, но OpenAI официально не подтверждала, что читает его. Поэтому относитесь к llms.txt как к необязательному дополнению, а не как к обязательному условию попадания в источники. Время лучше вложить в то, что работает наверняка: доступ для OAI-SearchBot, чистый HTML и авторитет домена.

Здесь же стоит сказать про порядок приоритетов. Сначала закрываются технические блокеры: доступ для краулера, рендеринг в HTML, корректный robots.txt. Без этой базы остальные усилия бессмысленны, потому что модель просто не дойдёт до вашего контента. Это сквозной принцип Максима Гончаренко: без техники и разметки сайт остаётся максимально плохо считываемым (МПК), и никакой объём текста этого не исправит. Только после технической базы имеет смысл вкладываться в структуру, разметку Schema.org и наращивание ссылочного профиля. Перепрыгивать через этот порядок невыгодно: красивый контент на закрытом для бота сайте не принесёт ни одной цитаты.

Как устроен поисковый индекс ChatGPT?

Индекс ChatGPT Search композитный, то есть собран из нескольких источников данных. По словам вице-президента по инжинирингу OpenAI, Bing остаётся одним из ключевых сервисов в этой связке. Но сводить весь индекс только к Bing неверно: это лишь один из потоков, а не вся картина.

Помимо опоры на Bing, OpenAI использует партнёрские соглашения с поставщиками контента и собственный краулер. То есть данные приходят из нескольких потоков одновременно, и итоговая выдача формируется на их пересечении. Это значит, что улучшение видимости в Bing помогает, но не гарантирует попадание в источники, и оптимизировать всё только под один движок недальновидно.

Практический вывод для специалиста: работайте над качеством сайта в целом, а не подгоняйте его под единственный поисковик. Сильный домен, извлекаемый контент и открытый доступ для OAI-SearchBot влияют на видимость независимо от того, через какой именно поток данных модель найдёт вашу страницу. Это и есть устойчивая стратегия, которая не рассыплется при смене источников в индексе.

Из композитной природы индекса вытекает ещё одно следствие для замера результата. Раз данные приходят из нескольких потоков, появление вашего сайта в источниках не привязано к одному предсказуемому событию вроде переиндексации в Bing. Видимость нарастает постепенно, по мере того как сайт укрепляет авторитет и попадает в разные потоки данных. Поэтому ждать резкого скачка цитат после одной правки не стоит: реалистичная динамика это плавный рост на горизонте нескольких месяцев, который видно скорее по совокупности упоминаний, чем по отдельной проверке.

Аудит готовности к ChatGPT от Optimentor

Я, Максим Гончаренко, основатель Optimentor, несколько лет занимаюсь продвижением бизнесов в ответах нейросетей. По ChatGPT работа всегда начинается с честной оценки: есть ли у вас аудитория в доступных странах и стоит ли вообще вкладываться в этот канал, или приоритет лучше отдать Яндексу и отечественным сервисам. Я не продаю канал, который вам не подходит.

Если канал релевантен, дальше идёт техническая проверка: открыт ли OAI-SearchBot, рендерится ли контент в HTML, насколько страницы извлекаемы и какой у домена авторитет. Эти же проверки одновременно усиливают видимость и в других нейросетях, поэтому работа не пропадает зря даже при ограничениях по РФ. Важно помнить и про цикл: набор базы цитирования занимает обычно от 3 до 6 месяцев, это не быстрый канал.

🔍 Точка входа простая

Технический аудит сайта на готовность к нейросетям — 5000 ₽

По итогам вы получаете список конкретных правок по robots.txt, структуре и разметке. Это понятный первый шаг, чтобы понять, реально ли вашему сайту попадать в источники ChatGPT и где сейчас слабые места.

Написать: @optimentor | Сайт: optimentor.ru

Частые вопросы (FAQ)

Гарантирует ли разрешение OAI-SearchBot попадание в источники?

Нет. Разрешение OAI-SearchBot убирает техническую блокировку и делает сайт видимым для поиска, но не гарантирует цитирование. Дальше решают авторитет домена, структура контента и упоминания бренда на сторонних площадках.

Нужен ли файл llms.txt для ChatGPT?

Нет, это необязательно. OpenAI официально не подтверждала, что читает llms.txt. Используйте его как дополнение, а не как обязательное условие попадания в источники.

Можно ли проверить выдачу ChatGPT из России?

Напрямую затруднительно: сервис блокирует российские IP, а VPN часто детектируется. Видимость обычно оценивают через доступную инфраструктуру или силами партнёров в других странах.

ChatGPT берёт источники только из Bing?

Нет. Индекс композитный: опора на Bing плюс партнёрства и собственный краулер OpenAI. Поэтому оптимизация только под Bing не даёт полной картины.

В чём разница между OAI-SearchBot и GPTBot?

OAI-SearchBot выводит сайты в поиск ChatGPT, а GPTBot собирает данные для обучения моделей. Можно разрешить первый и закрыть второй, чтобы попадать в поиск, но не отдавать контент в обучение.

Сколько времени нужно, чтобы попасть в источники?

Канал небыстрый. Набор базы цитирования обычно занимает от 3 до 6 месяцев и зависит от роста авторитета домена и регулярности обновления контента.

📚 Что почитать дальше

Автор: Максим Гончаренко, Optimentor. 2026.