Перейти к содержимому

Как малому бизнесу попасть в ответы ChatGPT и других ИИ-ассистентов?

Люди всё чаще не ищут, а спрашивают. Открывают ChatGPT, Perplexity, Claude или ИИ-режим Google, описывают задачу одной фразой — «физиотерапевт во Вроцлаве, который говорит по-русски» — и пишут тому, кого им назвали. Этот гайд о том, как малый бизнес попадает в такие ответы. Всё, что здесь сказано про поведение краулеров, взято из документации самих компаний; ссылки — внизу страницы.

Обновлено:

Коротко

  • ИИ-ассистенты могут процитировать только те страницы, которые смогли скачать и прочитать. Текст, который появляется только после выполнения JavaScript, для них обычно невидим.
  • У каждой ИИ-компании несколько разных краулеров с разными задачами: закрыв обучающий, вы не закрываете поисковый — и наоборот.
  • Google прямо пишет: никакой особой разметки и «файла для ИИ» не нужно. Страница должна быть в индексе и иметь право показываться со сниппетом — этого достаточно, чтобы попасть в ссылки-источники.
  • Ассистенты цитируют ответы, а не буклеты. Страницу, которая отвечает на один настоящий вопрос и делает это конкретно, цитируют; страницу, которая хвалит компанию, — нет.
  • Большая часть рекомендаций рождается не на вашем сайте, а в каталогах, профилях и на форумах. Если вас больше нигде нет, вас трудно порекомендовать.
  • Видимость в ИИ набирается медленно: недели до того, как страницу подхватят, месяцы — до того, как новое имя начнёт всплывать в конкурентных рекомендациях. Кто обещает неделю, тот что-то вам продаёт.

Почему клиенты вдруг стали находить бизнесы через ChatGPT?

Изменилась форма вопроса. Вместо двух ключевых слов и десяти синих ссылок человек описывает ситуацию одним предложением и получает один ответ с горсткой источников. Бизнес больше не борется за позицию в выдаче — он борется за то, чтобы ассистент счёл его источником, который стоит процитировать.

Для многих сайтов малого бизнеса вывод неприятный. Классическая главная — тёплый заголовок, три карточки услуг, форма обратной связи — не даёт ассистенту почти ничего, что можно процитировать. Она рассказывает, кто вы, но не отвечает ни на один вопрос, который человек действительно задал. Ассистент, собирающий ответ на «сколько стоит сайт для малого бизнеса в Польше», не находит на ней ничего и берёт кусок с чужой страницы. В этом весь механизм — и он объясняет, почему дорогой современный сайт может полностью отсутствовать в ИИ-ответах, пока простенькая страница конкурента цитируется дважды.

Хорошая новость в том, что порог здесь технический и редакторский, а не денежный. Не нужны ни абонемент агентства, ни подписка на сервис отслеживания видимости. Нужны страницы, которые отвечают на настоящие вопросы и написаны тем, кто в теме, — и сайт, который краулер прочитает без запуска браузера. Почти всё, о чём пойдёт речь дальше, стоит только внимания: бесплатные проверки из следующего раздела занимают один вечер и решают, сможет ли вообще кто-нибудь увидеть то, что вы напишете потом.

Как ИИ-ассистенты вообще находят ваши страницы?

ИИ-ассистенты находят страницы через краулеров, и у каждой компании их несколько, с разными задачами: одни собирают данные для обучения моделей, другие строят индекс, из которого берутся ответы, третьи скачивают страницу прямо сейчас, пока человек ждёт. Каждый управляется в robots.txt отдельно, поэтому решение по одному из них не переносится на остальных автоматически.

Из того, как задокументированы эти краулеры, следуют две вещи. Во-первых, «закрыться от ИИ» — это не один рубильник, а набор решений, и самая частая авария такая: запретили поисковый краулер, целясь в обучающий. Бизнес, который в 2024-м одним размашистым правилом отказался от обучения на своих текстах, мог тихо отказаться заодно и от поисковых ответов ChatGPT. Во-вторых, ассистент, отвечающий на живой вопрос, может пойти за вашей страницей прямо в эту секунду — поэтому страница, которая собирает своё содержимое в браузере, а не отдаёт его в HTML, оказывается невидимой ровно тогда, когда это важнее всего.

У Google устройство другое: его ИИ-функции работают на обычном поисковом индексе. В собственной документации Google сказано: «no additional requirements to appear in AI Overviews or AI Mode, nor other special optimizations necessary» — никаких дополнительных требований, чтобы появиться в AI Overviews или AI Mode, и никакой особой оптимизации; создавать новые машиночитаемые файлы, текстовые файлы для ИИ или разметку тоже не нужно. Зато Google прямо задаёт нижний порог: чтобы страницу могли показать как ссылку-источник в AI Overviews или AI Mode, она должна быть проиндексирована и иметь право показываться в поиске Google со сниппетом. На практике это значит, что старая работа — попасть в индекс и быть полезным — так и осталась работой.

Задокументированные ИИ-краулеры и что делает каждый (документация вендоров, проверено 23 августа 2026)
КраулерКто запускаетЧто делаетЕсли запретить
OAI-SearchBotOpenAIПоказывает сайты в поисковых функциях ChatGPT«Will not be shown in ChatGPT search answers» — сайт не будет показан в поисковых ответах ChatGPT, хотя может остаться навигационной ссылкой
GPTBotOpenAIСобирает материалы из веба для улучшения базовых моделей OpenAIСигнал, что контент не следует использовать для обучения. Видимость в поиске — отдельная настройка, за неё отвечает OAI-SearchBot
ChatGPT-UserOpenAIСкачивает страницу по действию пользователя внутри ChatGPTOpenAI предупреждает, что правила robots.txt могут не применяться: страницу запросил человек
PerplexityBotPerplexityПоказывает сайты и ссылается на них в результатах Perplexity; «not used to crawl content for AI foundation models» — не используется для сбора данных под обучение моделейСайт перестаёт появляться в результатах Perplexity
Perplexity-UserPerplexityЗаходит на страницу, пока Perplexity отвечает на конкретный вопрос пользователя«Generally ignores robots.txt rules» — как правило, игнорирует robots.txt, потому что заход инициирован человеком
Claude-SearchBotAnthropicАнализирует материалы из веба, чтобы улучшать качество поисковых результатов ClaudeAnthropic заявляет, что её боты соблюдают директивы robots.txt
ClaudeBotAnthropicСобирает материалы из веба для обучения и разработки ClaudeAnthropic заявляет, что ClaudeBot соблюдает директивы robots.txt
Claude-UserAnthropicСкачивает страницу, когда она нужна для ответа на вопрос пользователя ClaudeУправляется собственной записью user-agent в robots.txt, отдельно от ClaudeBot
Задокументированные ИИ-краулеры и что делает каждый (документация вендоров, проверено 23 августа 2026) — OpenAI отмечает, что изменение в robots.txt доходит до OAI-SearchBot примерно за 24 часа; Perplexity говорит то же самое про PerplexityBot.

Что проверить малому бизнесу, прежде чем писать что-то новое?

Пять бесплатных проверок идут раньше нового контента: они решают, увидит ли кто-нибудь то, что вы опубликуете потом. Большинство сайтов малого бизнеса заваливают хотя бы одну. Никакой объём написанного не спасёт страницу, которую ассистент не может прочитать, — поэтому сначала они, и именно в таком порядке.

Две проверки стоит выделить. На JavaScript сильнее всего спотыкаются как раз современные и дорого выглядящие сайты: одностраничное приложение может прекрасно ранжироваться в Google, который скрипты выполняет, и при этом быть пустым листом для краулера ассистента. Проверка хостинга важна потому, что даёт самый запутанный симптом: в браузере всё хорошо, в robots.txt всё разрешено, а краулеры не приходят вообще. Подставить чужой user-agent со своего компьютера тоже ничего не доказывает: настоящих краулеров узнают по подписи, а не по имени в строке user-agent. Страница, помеченная в Search Console как проиндексированная, — это доказательство. Запрос, который вы отправили себе сами, с именем, которое сами и вписали, — нет.

  1. 1 Откройте свою страницу с выключенным JavaScript и посмотрите, что уцелело. В Chrome: DevTools, Cmd/Ctrl+Shift+P, команда «Disable JavaScript», перезагрузка. Текст, который исчез, — это текст, которого ИИ-краулеры, скорее всего, никогда не видят: крупные из них скачивают JavaScript-файлы, но не выполняют их.
  2. 2 Прочитайте свой robots.txt. Убедитесь, что поисковые краулеры разрешены — явная пара строк `User-agent: OAI-SearchBot` и `Allow: /` не оставляет места для толкований — и что вы не закрыли их заодно, когда хотели отказаться только от обучения моделей.
  3. 3 Проверьте настройки хостинга или CDN, а не только robots.txt. Некоторые платформы блокируют ИИ-краулеров по умолчанию, и страница может быть открыта в robots.txt, пока сетевой уровень молча отказывает в запросе. В Cloudflare это Security → Settings (политики ИИ-ботов), на большинстве хостингов — файрвол или защита от ботов.
  4. 4 Подключите Google Search Console и Bing Webmaster Tools и отправьте карту сайта в обе. Это единственный честный способ узнать, проиндексированы ваши страницы или просто опубликованы.
  5. 5 Убедитесь, что на каждую важную страницу ведёт ссылка с другой страницы. Страницы, которые существуют только в карте сайта, находят поздно и считают неважными.

Какая страница вообще попадает в цитаты?

В цитаты попадает страница, которая целиком отвечает на один вопрос — теми словами, которыми его задаёт клиент, и с конкретикой, которую можно проверить. Ассистенты цитируют куски, а не сайты целиком, поэтому единица работы — самодостаточный раздел, который не теряет смысла, когда его вырывают и вставляют в чужой ответ.

Об одном стоит сказать прямо, потому что рынок сейчас шумит именно об этом: писать отдельную «машиночитаемую» версию своих текстов — не та работа. Отдавать краулерам не то, что видят люди, называется клоакингом, и спам-политики Google прямо говорят, что за это сайт может лишиться позиций целиком. В цитаты попадает та же страница, которую человек нашёл бы по-настоящему полезной. Структура выше просто помогает эту пользу извлечь: это форматирование поверх правды, а не замена тому, что вы действительно хотите сказать.

  • Один ясный вопрос на страницу, сформулированный так, как спрашивает человек, — не слоган и не название продукта.
  • Ответ в первых двух-трёх предложениях каждого раздела. Если ответ приходит в шестом абзаце, вырвут не тот кусок.
  • Настоящие числа, даты, имена и единицы измерения: цена с валютой, срок в днях, дата, на которую всё проверено. Расплывчатость — главная причина, по которой страницу пропускают в пользу конкурента.
  • Таблицы для всего, что сравнивается. По нашим наблюдениям, строка таблицы переживает цитирование, а та же информация, размазанная по абзацу, обычно нет.
  • Разделы, которые стоят сами по себе: никаких «как сказано выше», никаких местоимений, отсылающих к заголовку, — вместо «он» повторяется название.
  • Видимая дата обновления, которая не врёт. Свежие страницы обычно выигрывают у залежавшихся, но подделка даты — манипуляция, и она проверяема.
  • Прямой разговор о том, когда вы клиенту не подходите. Занимает это один абзац — и отличает страницу-источник от страницы-рекламы сильнее, чем всё остальное в этом списке.

Почему хорошего сайта самого по себе мало?

Хорошего сайта мало потому, что большинство рекомендаций рождается не на нём. Когда человек просит ассистента посоветовать студию, клинику или поставщика, ответ собирается там, где бизнесы перечисляют и обсуждают: каталоги, профессиональные профили, форумы, площадки с отзывами. Бизнес, который существует только на собственном домене, трудно порекомендовать.

Эту часть малый бизнес откладывает, потому что она административная, а не творческая, — и обычно именно она решает больше всего. Её же невозможно передать кому-то целиком: аккаунты ваши, подтверждение ваше, а данные должны быть правдой. Заложите на неё день, сделайте один раз нормально и дальше не трогайте, пока не изменится что-то настоящее — адрес, телефон, новая услуга. Провал здесь выглядит не как «сделали плохо». Он выглядит как «сделали наполовину и бросили», оставив по всему интернету три разные версии своего телефона.

  • Профиль компании в той профессиональной сети, которой вы правда пользуетесь, — заполненный, а не оставленный заглушкой.
  • Два-три отраслевых каталога, выбранных потому, что ими пользуются настоящие клиенты, а не потому, что туда берут всех. Регистрация в двадцати нерелевантных — типичный ссылочный спам, и относятся к ней соответственно.
  • Google Business Profile, а если ваши клиенты на айфонах, то и Apple Business Connect — при условии, что у вас есть реальный адрес или зона обслуживания.
  • Одинаковые название, адрес и контакты везде. Разнобой превращает один бизнес в несколько похожих.
  • Настоящие отзывы от настоящих клиентов на площадках, которые вам не принадлежат. Это единственный законный путь к репутационным сигналам — и причина, по которой покупка отзывов — одновременно и мошенничество, и плохое вложение денег.

Что делать, если клиенты говорят на нескольких языках?

Публикуйте по настоящей версии на каждом языке, каждую по своему адресу, и пишите их, а не прогоняйте через переводчик. По нашему опыту, ассистенты, отвечающие по-польски или по-немецки, опираются на источники на этих же языках — и бизнес с одной только английской страницей тихо отсутствует в большой части собственного рынка.

Отсюда два практических правила. Свяжите языковые версии тегами hreflang — со ссылкой на самих себя и с x-default, — чтобы каждый адрес понимался как та же страница на другом языке, а не как дубль. И выкатывайте все языки сразу: наполовину переведённый сайт рекламирует версии, которых нет, и приносит ошибки в Search Console вместо охвата.

Правило посложнее — редакторское. Переведённая страница читается как переведённая: идиомы чуть мимо, примеры чужие, цены не в той валюте — и это ровно тот тон, на который читатель на этом рынке делает скидку. Если вы не можете написать нативно сами или заказать нативный текст, лучше меньше языков, но по-настоящему. Два убедительных языка сильнее четырёх машинных — и для человека, который читает, и для ассистента, который решает, чьей странице доверять.

Чего не делать, даже если вам это активно продают?

Не делайте ничего, что фабрикует сигналы вместо того, чтобы их заработать. Все эти приёмы — тот же поисковый спам, что был всегда, только в новых словах, и последствия у него прежние: вплоть до того, что сайт вообще перестанет появляться в результатах, а на восстановление уйдут месяцы.

Сюда же, но мягче, — файл `llms.txt`. Опубликовать его ничего не стоит, и пусть будет: у нас он тоже есть. Но ни один крупный вендор не обещал читать его как сигнал для ранжирования или цитирования, и страниц, которые стоит цитировать, он не заменит. Относитесь к нему как к аккуратности, а не как к рычагу. То же и с большинством сервисов, которые продаются как «платформы видимости в ИИ»: полезные из них измеряют происходящее, и платить за это разумно, когда уже есть что измерять. Заставить ассистента процитировать страницу, которая ни на что не отвечает, не может ни один.

  • Фальшивые отзывы и отзывы за вознаграждение, а также разметка звёздного рейтинга на вашем же сайте, за которой не стоит проверяемый источник.
  • Массовая регистрация в слабых каталогах ради ссылок, а не ради клиентов.
  • Сетки пустых сгенерированных сайтов, ссылающихся на ваш домен.
  • Текст, спрятанный для краулеров, или страница, которая отдаётся ботам не в том виде, в каком её видят люди.
  • Инструкции, зашитые в страницу, чтобы управлять ассистентом, который её читает. Спам-политики Google прямо распространяются на попытки манипулировать генеративными ответами в поиске и относятся к ним как к любому другому спаму.
  • Оплата тем, кто обещает «гарантированное место в ChatGPT». OpenAI действительно продаёт явно помеченные рекламные размещения через собственный кабинет, но это реклама, обозначенная как реклама, и это не то же самое, что органические цитаты, о которых весь этот гайд. Цитирование как источника устроено совсем иначе, и деньгами его не сдвинуть.

Сколько это честно занимает?

Обход и индексация проходят быстро — дни, если проверки выше пройдены и консоли подключены. Цитирование идёт медленно. Это наши рабочие оценки, а не цифры вендоров: ассистенты, которые ходят за страницами вживую, могут подхватить новую страницу за недели, а вот новое имя в конкурентных рекомендациях — вопрос месяцев.

Порядок событий стоит знать, потому что он подсказывает, когда пора волноваться. Сначала приходят краулеры. Потом страницы попадают в индекс. Потом за страницами начинают ходить в тот момент, когда кто-то действительно задаёт вопрос, — это первый настоящий признак, что что-то работает, и в логах сервера он виден раньше, чем где-либо ещё. Рекомендации по имени приходят последними и зависят скорее от присутствия за пределами сайта, о котором шла речь выше, чем от того, насколько хорошо написана страница.

Если за два месяца жизни страницы не изменилось совсем ничего — ни визитов краулеров, ни записей в индексе, — проблема обычно не в текстах. Либо стоит технический блок, либо на домен пока ничего не ссылается — то есть разбираться надо с JavaScript и настройками хостинга или с внешними профилями, а не выпускать новые страницы. Публиковать ещё страницы — стандартная реакция, и она неверная: десять невидимых страниц ровно так же невидимы, как одна.

Как понять, что это работает?

Понять, работает ли видимость в ИИ, помогают четыре измерения, и ни одно из них не стоит денег. Снимите базовый замер до того, как что-то опубликуете: иначе сравнивать потом будет не с чем, а соблазн увидеть прогресс, которого нет, у всех одинаково силён.

Аналитика всё это недосчитает, и лучше знать это заранее: мы стабильно видим, что часть трафика от ассистентов приходит без реферера и оседает в «прямых заходах». Поэтому самое чистое измерение остаётся самым нетехническим — спрашивать у новых обращений, как они вас нашли, и записывать ответ туда, куда вы потом действительно заглянете. Полгода таких записей стоят больше любого дашборда, и это единственный след, который связывает видимость с деньгами, а не с активностью.

  1. 1 Запишите фиксированный список вопросов, которые ваши клиенты реально задали бы, — на каждом языке, на котором вы продаёте. Задайте их ассистентам сегодня и сохраните ответы. Это ваш базовый замер, и обычно в нём ноль упоминаний.
  2. 2 Следите за индексацией в Search Console и Bing Webmaster Tools: сколько ваших страниц действительно в индексе, а не сколько вы опубликовали.
  3. 3 Смотрите в логах сервера или CDN, приходят ли ИИ-краулеры, и отделяйте индексирующих ботов от живых заходов по запросу человека. В Cloudflare это журнал Security → Events, на большинстве хостингов — сырой access-лог. Поищите в логе восемь строк user-agent из таблицы выше: те, что заканчиваются на -User, — это живые заходы, и визит ChatGPT-User или Perplexity-User означает, что ассистент пришёл на вашу страницу, пока кому-то отвечал. Более раннего настоящего сигнала не бывает.
  4. 4 Повторяйте тот же список вопросов раз в две недели, не меняя формулировок. Менять слова кажется продуктивным — и убивает сравнение.

Всё, о чём вы могли задуматься.

Мне всё время говорят, что для ИИ нужен какой-то специальный файл. Он нужен?
Нет. Документация Google прямо говорит, что для её ИИ-функций не нужны ни дополнительные файлы, ни разметка, — ссылка есть в источниках ниже. Структурированные данные по-прежнему полезны, чтобы точно описать бизнес, но это не входной билет, и ни один файл не заставит ассистента процитировать страницу, которая ни на что не отвечает.
Если я запрещу ИИ обучаться на моих текстах, я пропаду из ChatGPT?
Не обязательно: краулеры разные. OpenAI документирует GPTBot для обучения моделей и OAI-SearchBot для показа сайтов в поисковых функциях ChatGPT, и каждый управляется в robots.txt отдельно. Запрет GPTBot сам по себе не убирает вас из поисковых ответов ChatGPT. Запрет OAI-SearchBot — убирает.
Нужно платить OpenAI или Perplexity, чтобы туда попасть?
За органические цитаты — нет: ни формы подачи, ни возможности что-то купить. OpenAI действительно продаёт помеченные рекламные размещения в ChatGPT через свой рекламный кабинет, но это реклама, а не цитирование как источника. Кто берёт с вас деньги за «гарантированное попадание» в ИИ-ответы, продаёт то, чего не существует.
ChatGPT советует конкурента, а не меня. Почему?
Обычно потому, что конкурент присутствует в большем числе мест, чем вы. Ассистенты берут рекомендации из каталогов, профилей, отзывов и статей не реже, чем с сайтов самих компаний, — и выигрывает тот, кого перечислили, о ком написали и кому оставили отзывы, даже если его собственный сайт хуже вашего. Это и есть работа за пределами сайта, самая неблагодарная часть.
Ассистент говорит про мой бизнес неправду. Как это исправить?
Исправлять надо в источнике, а не спорить с ассистентом. Найдите, где живёт неверная информация — устаревшая запись в каталоге, старый профиль, ваша же залежавшаяся страница, — и почините там, а потом убедитесь, что правильная версия прямо написана у вас на сайте. Ассистенты отражают то, что говорит интернет: чтобы изменить ответ, надо изменить интернет.
ИИ-ответы убьют трафик на мой сайт?
Скорее изменят его, чем убьют. Часть вопросов, которые раньше приводили к визиту, теперь закрывается без него, а те визиты, что остаются, приходят ближе к решению — от людей, которые уже понимают, чего хотят. Из-за этого качество того, что вы публикуете, начинает значить больше, чем количество визитов.
Блог обязателен?
Дело не в регулярности публикаций, а в охвате тем. Несколько страниц, которые честно отвечают на вопросы ваших клиентов, дадут больше, чем блог с еженедельными новостями компании. Обновляйте эти страницы, когда меняется что-то настоящее, и честно пишите, когда делали это в последний раз.
Мы маленький местный бизнес. Это вообще реально без агентства?
Да, почти всё. Проверки и профили — это администрирование, а не экспертиза: их сделает любой методичный человек. Настоящая работа — тексты, и здесь студия может закрыть техническую часть, структуру и черновик. Но сама конкретика, которую в итоге цитируют, — ваши цены, ваши сроки, то, за что вы не берётесь, — есть только у вас в голове, так что эта часть в любом случае ваша.

Источники

Хотите, чтобы мы прогнали эти проверки по вашему сайту?

Мы берём несколько таких проверок в месяц. Пришлите адрес — за два рабочих дня скажем, беремся или нет. Если беремся, пришлём короткий письменный отчёт, независимо от того, будете вы работать с нами дальше или нет; если нет — скажем прямо. Это дружеская услуга, а не сервис, которого можно требовать. Это техническая проверка, а не юридический и не маркетинговый аудит.

Попросить посмотреть

Написано Soul Design — небольшой веб-студией из Вроцлава. Делаем сайты для малого бизнеса на английском, польском, немецком и русском.

← Назад к гайдам