Пошаговый порядок сбора ядра: от списка маркеров до таблицы «группа запросов — страница». С реальными цифрами отсева: из тысяч собранных строк в работу уходит меньше половины, и это нормальный результат, а не ошибка сбора.
- Порядок: маркеры → расширение → чистка → группировка → привязка к страницам.
- Отсев на чистке — от трети до половины собранного, это норма.
- Группировать нужно по совпадению выдачи, а не по похожести слов.
- Готовое ядро — таблица, где у каждой группы есть адрес страницы и ответственный запрос.
- Без проверки выдачи любой сбор превращается в список слов с цифрами.
Шаг 1. Маркеры
Откуда брать
Из трёх источников: как услугу называют клиенты в заявках и звонках, какие разделы у конкурентов из топа, какие формулировки уже приносят показы в Вебмастере. Внутренние термины компании в маркеры не годятся — их никто не ищет.
Сколько нужно
От двадцати до пятидесяти. Меньше — ядро получится узким, больше — расширение даст неуправляемый объём мусора.
Проверка маркеров
Каждый маркер прогоняется через выдачу до расширения. Если по нему в топе не ваша тема, расширять его бессмысленно — вы соберёте тысячу чужих запросов.
Шаг 2. Расширение
Что использовать
Статистику Wordstat со связанными запросами, подсказки поиска, данные Вебмастера и Search Console по уже существующим показам. Для больших ядер — платные сервисы, они экономят время, но принципиально новых источников спроса не дают.
Что получается на выходе
Тысячи строк. На нашем сборе по одной теме из 509 маркеров вышло 23 830 фраз, из которых после чистки осталось 22 254 — и это ещё хороший результат, потому что тема узкая.
Про лимиты сервисов
У бесплатных источников есть суточные ограничения на число запросов. Планируйте сбор с запасом по времени: попытка выбрать всё за один вечер упирается в лимит на середине.
Шаг 3. Чистка
Что убирать
Чужие смыслы и омонимы, названия конкурентов, города и страны, где вы не работаете, запросы с другим интентом (работа, обучение, самостоятельное выполнение вместо заказа услуги), явный мусор из подсказок.
Как ловить омонимы
По ассоциациям и по выдаче. Если в связанных запросах всплывает чужая тема — внутри частотности сидит чужой спрос. Мы так отсеяли «полировку стекла» с 7 561 показом: почти всё это автостёкла, а не окна в зданиях.
Про интент «работа» и «обучение»
Отдельная большая группа, которую часто забывают: «сео специалист» — это в основном поиск работы, а не подрядчика. Такие запросы дают показы и ноль заявок.
Сколько остаётся
От половины до двух третей. Если отсеялось меньше десятой части, скорее всего чистку не сделали, а просто посмотрели.
Шаг 4. Группировка
Критерий
Совпадение выдачи. Если по двум запросам поиск показывает в основном одни и те же страницы — их закрывает одна ваша страница. Если выдачи разные, это разные страницы, даже когда слова почти одинаковые.
Мягкая и жёсткая кластеризация
Жёсткая требует, чтобы совпадали почти все результаты, — даёт много мелких групп. Мягкая допускает частичное совпадение — даёт крупные группы, но иногда сваливает в кучу разные интенты. Для коммерческих страниц надёжнее жёсткая, для информационных подходит мягкая.
Что делать с сотнями групп
Схлопывать вручную по головным запросам. Автоматика не понимает, что «сколько стоит» и «цена» — это одна страница, а «купить» и «своими руками» — разные, даже если выдача частично пересекается.
Шаг 5. Привязка к страницам
Таблица результата
У каждой группы: головной запрос, суммарная частотность, тип интента, адрес страницы и её статус — существует, дорабатывается, нужно создать. Без последней колонки ядро остаётся исследованием, а не планом работ.
Одна страница — один интент
Если в группу попали и «купить», и «как выбрать», их надо разнести: это разные страницы и разные тексты. Попытка закрыть оба интента одной страницей обычно проигрывает обеим специализированным.
Проверка на каннибализацию
Две страницы не должны отвечать на один запрос. Если такое обнаружилось — объединяйте их и ставьте редирект, иначе поиск сам выберет одну, и не факт, что нужную.
Типичные ошибки при сборе
Собрали и не привязали к страницам
Самая частая: таблица на три тысячи строк лежит в файле, а сайт живёт своей жизнью. Ядро без колонки «адрес страницы» — это исследование, а не рабочий документ.
Взяли частотность и не открыли выдачу
Приводит к страницам под чужой спрос. Проверка занимает минуту на запрос и делается обязательно для всех головных формулировок кластера.
Сделали страницу под каждый кластер автоматики
Кластеризатор режет по формальному признаку, поэтому выдаёт больше групп, чем нужно страниц. Схлопывать соседние группы приходится руками — по совпадению выдачи.
Смешали интенты на одной странице
Попытка ответить и тем, кто хочет заказать, и тем, кто делает сам, обычно проигрывает обеим специализированным страницам. Интент разделяется на этапе группировки, а не при написании текста.
Частые вопросы
Для небольшого сайта услуг — два-три дня работы. Для крупного каталога — недели, и основное время уходит не на сбор, а на чистку и группировку. Автоматический сбор без ручной проверки делается за час и годится только на выброс.
Да, на бесплатных источниках: Wordstat со связанными запросами, подсказки поиска, Вебмастер, разделы конкурентов. Дольше и без автоматической кластеризации, но результат сопоставимый. Платные инструменты экономят время, а не открывают скрытый спрос.
Проверьте выдачу по двум головным запросам из соседних групп. Если поиск показывает одни и те же сайты — группы надо объединить. Если разные — разделение верное. Это единственная проверка, которая работает: похожесть слов ничего не говорит.
Значит спрос в нише узкий, и это ценный результат: вы узнали правду до того, как построили сайт на тридцать разделов. Дальше два пути — расширять тему смежными вопросами или идти в соседние ниши, где спрос есть.
Как отдельные страницы — нет, продвигаться по чужому бренду тяжело и юридически рискованно. Как источник понимания — да: посмотрите, что люди спрашивают вместе с конкурентом, и закройте эти вопросы на своих страницах.
Схлопывать руками, глядя на выдачу по головным запросам. Автоматика режет по формальному признаку и создаёт лишние группы там, где нужна одна страница. Реально нужное число страниц почти всегда меньше числа кластеров.