Обзор источников и инструментов сбора семантики: что даёт каждый, чем заменить платные сервисы и почему сбор данных — самая простая часть работы, а всё интересное начинается на проверке.
- Бесплатных источников хватает для ядра небольшого сайта — платные экономят время, а не открывают спрос.
- Для российского рынка данные берутся из Яндекса: зарубежные сервисы РФ-выдачу не покрывают.
- Любой сервис даёт цифры без смысла — проверка выдачей обязательна независимо от инструмента.
- У бесплатных источников суточные лимиты, сбор планируется с запасом по времени.
- Данные из Вебмастера и Search Console показывают только то, где вы уже показываетесь.
Бесплатные источники
Статистика Wordstat
Основной источник частотности для российского рынка: показы, связанные запросы, разбивка по регионам и динамика. Через API Яндекс.Директа то же самое собирается автоматически, но требует доступа и упирается в суточные лимиты.
Подсказки поиска
Живые формулировки, которые люди вводят прямо сейчас. Ценны тем, что показывают разговорный язык, а не то, как тему называют профессионалы.
Вебмастер и Search Console
Запросы, по которым вы уже показываетесь. Для расширения ядра бесполезны, для доработки существующих страниц — лучший источник: видно, где вы почти в топе.
Конкуренты из выдачи
Структура разделов сайтов из топа — готовая карта спроса, проверенная тем, что они уже там стоят. Самый недооценённый бесплатный источник.
Платные сервисы
Что покупается
Время и автоматизация: массовый съём частотности, кластеризация по выдаче, отслеживание позиций, выгрузка запросов конкурентов. На больших ядрах ручной сбор нереален, и это единственный весомый аргумент за оплату.
Чего не покупается
Скрытого спроса. Все сервисы работают с одними и теми же источниками, поэтому принципиально новых запросов вы не увидите. Разница в удобстве и объёме, а не в данных.
Про зарубежные инструменты
Для российского рынка они почти бесполезны: российских локаций в них нет, частотность и выдачу по РФ они не отдают. Работать приходится через данные Яндекса напрямую.
Проверка данных
Первое правило
Любая цифра проверяется выдачей. Инструмент не понимает, что «glm» — это газонокосилки, а не языковая модель; он видит только число показов.
Второе правило
Сравнивайте базовую частотность с уточнённой. Разница в десятки раз означает, что фраза входит в большое число чужих запросов, и её реальный спрос гораздо меньше.
Третье правило
Смотрите ассоциации. Если рядом с вашим запросом ищут явно чужую тему, внутри цифры сидит чужой спрос — и планировать по ней страницу нельзя.
Что ломается на практике
Токены и доступы протухают
Автоматический сбор через API живёт до истечения токена, и узнаёте вы об этом в момент, когда данные нужны срочно. Проверяйте доступы до начала работ, а не в процессе — у нас в этой сессии сбор частотности встал именно из-за просроченного токена.
Лимиты кончаются на середине
Суточные ограничения у бесплатных источников считаются в запросах, а не в строках результата. Большое ядро собирается несколько дней, и это надо закладывать в срок.
Выгрузки не сходятся между собой
Разные сервисы дают разные цифры по одному запросу — из-за периодов, регионов и способов подсчёта. Не пытайтесь их согласовать: выберите один источник как основной и сравнивайте внутри него.
Минимальный рабочий набор
Что реально нужно, чтобы собрать ядро для сайта услуг, и в каком порядке этим пользоваться.
Для сбора
Статистика показов Яндекса — основной источник частотности. Подсказки поиска — для живых формулировок. Этого достаточно, чтобы получить несколько тысяч строк по любой теме.
Для проверки
Живая выдача: открывается вручную или снимается автоматически, если запросов много. Без этого шага все остальные бессмысленны — именно здесь отсеиваются чужие смыслы.
Для группировки
Таблица и голова: сравниваете выдачи по головным запросам и объединяете совпадающие. На ядре до пятисот строк это делается за вечер и точнее автоматики.
Для контроля
Вебмастер: через месяц после публикации показывает, по каким формулировкам вы начали показываться. Это обратная связь по качеству ядра — если показы идут не по тем запросам, группировка была неверной.
Частые вопросы
Ручной группировкой по выдаче: берёте головные запросы, смотрите топ-10 по каждому и объединяете те, где сайты совпадают. Долго, но для ядра на несколько сотен запросов вполне выполнимо и точнее автоматики.
В них нет российских локаций, поэтому ни частотности, ни выдачи по РФ они не отдают. Для российского рынка источник один — данные Яндекса: статистика показов, подсказки и живая выдача.
Как порядку величины — да, как точному числу — нет. Все сервисы берут данные из одного источника и по-разному их обрабатывают. Важнее не точность цифры, а проверка смысла: что именно люди ищут за этой формулировкой.
Достаточно для ядра небольшого сайта — тысячи строк, если растянуть сбор на несколько дней из-за суточных лимитов. Ограничение не в объёме данных, а в скорости их получения.
Смотреть их структуру — обязательно, это готовая карта спроса. Выгружать их запросы сервисами — полезно, но не необходимо: те же формулировки находятся через подсказки и связанные запросы.
Отдельно по каждому: частотность одной и той же фразы различается в разы, и решение о создании страницы принимается по своему региону. Список формулировок при этом можно собрать один раз по Москве — там спрос полнее.