Как собрать семантику самому — вопрос про порядок действий, а не про секретный сервис за много денег. Семантическое ядро для интернет-магазина или сайта услуг собирается вручную: Яндекс Wordstat, таблица, несколько вечеров и дисциплина при чистке. Платные подписки ускоряют рутину, но не отменяют главного — ключевые запросы приходится осмысливать головой. Первая выгрузка на 40 000 строк выглядит триумфом ровно до момента, когда доходит очередь до раскладки списка по страницам.
Дальше — что подготовить до первого захода в Wordstat, пять шагов от маркеров до посадочных страниц, набор инструментов на старте, сравнение трёх подходов по времени и деньгам, пять типовых ошибок и честная граница, за которой ручной сбор перестаёт окупаться. Материал опирается на практику с 2007 года: семантику для 100+ проектов приходилось собирать и руками в таблице, и конвейером из собственных скриптов. Разница между двумя способами не в качестве, а в количестве потраченных вечеров.
Сбор семантики без иллюзий: что подготовить до первого запроса в Wordstat
Сбор семантики начинается не в Wordstat, а в таблице с ассортиментом. Семантическое ядро — это список запросов, разложенный по страницам сайта, а не выгрузка на 40 000 строк, скачанная за вечер. Файл без раскладки не даёт ни структуры каталога, ни плана работ, ни ответа на вопрос, что писать первым.
Подготовка занимает час и экономит дни:
- Выпишите товары и услуги реальными названиями — как в прайсе и на складе.
- Отберите 3–5 сайтов конкурентов из топа по главному запросу ниши.
- Зафиксируйте регион продвижения: город, область или вся Россия.
- Заведите аккаунт Яндекса — без входа Wordstat статистику не отдаёт.
- Откройте пустую таблицу в Excel или Google Sheets под будущие столбцы.
Столбцы задаются сразу: запрос, частотность, минус-слово, кластер, страница. Перекраивать таблицу на тысяче строк дороже, чем продумать разметку на старте.
Интерфейсы сервисов перерисовывают регулярно: кнопки переезжают, отчёты переименовывают. Поэтому дальше разбирается суть действий, а не расположение элементов на экране — логика живёт дольше любого редизайна.
Порядок шагов задан природой задачи: каждая следующая операция работает с результатом предыдущей. Расширять нечего, пока нет маркеров; чистить нечего, пока нет расширения.
Как собрать семантику самому: 5 шагов от маркеров до посадочных страниц
Пять шагов идут строго друг за другом. Расширение опирается на маркеры, чистка — на расширенный список, кластеризация — на очищенный, раскладка по страницам — на кластеры. Пропуск чистки превращает кластеризацию в сортировку мусора: группы собираются вокруг фраз, которые магазину не нужны. Пропуск кластеризации оставляет таблицу без ответа на главный вопрос — какая страница какой спрос закрывает.
Шаг 1. Собрать маркеры из ассортимента, прайса и сайтов конкурентов
Маркер — короткий запрос, который обозначает товар или услугу целиком: «фрезерный станок», «доставка пиццы», «сбор семантики». От маркеров растёт всё ядро, поэтому пропущенная на этом шаге категория превращается в дыру в структуре сайта.
Источники лежат близко: товарные категории и карточки, прайс и складские остатки, поиск по сайту и письма клиентов, разделы меню у 3–5 конкурентов из топа, названия брендов и моделей. Внутренний поиск особенно честен — покупатели пишут туда ровно то, что ищут, без редакторских правок.
- Выпишите названия категорий и подкатегорий каталога в один столбец.
- Добавьте синонимы, сокращения и сленг покупателей — «болгарка» рядом с «угловой шлифмашиной».
- Сведите список в одну таблицу и удалите повторы.
Покупатель называет товар не так, как отдел закупок. Каталожное «шлифмашина угловая аккумуляторная» в поисковой строке звучит как «болгарка на аккумуляторе», и обе формы идут в маркеры на равных. Каждый маркер проверяется одним вопросом: продаётся ли это прямо сейчас. Товара нет в наличии и не планируется — строка убирается, иначе ядро вырастет вокруг ассортимента конкурентов.
По практике небольшой сайт услуг выходит на несколько десятков маркеров, широкий каталог — на несколько сотен. Ориентир задаёт ассортимент, а не отраслевые нормативы.
На выходе: один столбец маркеров без дублей — фундамент для расширения.
Шаг 2. Расширить список через Wordstat, подсказки и Букварикс
Расширение превращает десятки маркеров в тысячи запросов. Левая колонка Wordstat показывает фразы с вхождением маркера, правая — что искали те же посетители до и после. Поисковые подсказки добавляют разговорные формулировки, которые в статистику попадают с задержкой. Базы вроде Букварикса отдают длинный хвост пачкой, без поштучного перебора.
Операторы человеческим языком: кавычки фиксируют состав фразы и отсекают всё, что шире; восклицательный знак закрепляет форму слова, поэтому «!станок» перестаёт собирать «станки». Регион переключается до сбора — цифры по Москве и по Новосибирску расходятся в разы, а перепутанная география ломает расчёты дальше по цепочке.
- Прогоните каждый маркер по левой и правой колонке с выставленным регионом.
- Снимите поисковые подсказки по верхним маркерам прямо из строки поиска.
- Догрузите длинный хвост из базы и слейте выгрузки в одну таблицу.
Базовая частотность показывает интерес к теме, а не к конкретной фразе: число у слова «станок» складывается из сотен разных намерений. Опираться на такую цифру при отборе рано — уточнение идёт после чистки, по укороченному списку.
Сезонность проверяется отдельно. У товаров с выраженным сезоном — теплицы, шины, ёлочные игрушки — история запросов показывает, где годовой спрос, а где летний всплеск, который зимой не повторится. График подсказывает и календарь работ: текст под такой запрос выкладывается заранее, а не в неделю пика, когда индексация уже не успевает.
На выходе: сырая выгрузка запросов с частотностями — со всем мусором внутри.
Шаг 3. Вычистить мусор и собрать минус-слова
Самый скучный шаг конвейера и самый окупаемый. Сырая выгрузка наполовину состоит из фраз, которые не принесут магазину ни заказа, ни показа по делу.
Что вычищается из списка:
- Дубли и переформулировки — «купить станок недорого» и «недорого купить станок».
- Чужие бренды и модели, которых нет в наличии и не будет.
- Города вне зоны доставки — «фрезерный станок Владивосток» при отгрузке по ЦФО.
- Слова «бесплатно», «скачать», «чертежи», «б/у» при продаже нового.
- Витальные запросы конкурентов — название чужой компании с адресом или телефоном.
- Взрослая и посторонняя лексика, приехавшая из правой колонки.
- Отсортируйте выгрузку по алфавиту и снимите очевидные дубли.
- Пройдите список сверху вниз, отправляя мусорные слова в отдельный столбец минус-слов.
- Снимите уточнённую частотность в кавычках по укороченному списку.
Минус-слова копятся в отдельном столбце и переиспользуются при следующем расширении — поэтому чистка запросов идёт итерациями, а не одним проходом. Тот же набор потом уходит в контекстную рекламу и режет мусорные показы ещё до первого клика.
Уточнённая частотность в кавычках снимается уже после чистки. Перебирать так сырую выгрузку — платить временем за фразы, которые всё равно вылетят; по укороченному списку тот же съём проходит быстрее и даёт цифры, на которые опираются при расстановке приоритетов.
На первом проходе отсеивается заметная часть выгрузки. Это нормальный результат чистки, а не признак кривого сбора.
На выходе: чистый список запросов плюс готовый список минус-слов.
Шаг 4. Разбить запросы на кластеры
Кластеризация отвечает на один вопрос: какие запросы закрываются одной страницей. Группа собирается так, чтобы под неё писался один заголовок, один title и один текст без раздвоения смысла. Если внутри просятся два разных текста — кластер развалился на два, и делить лучше сразу.
Ручной способ — по смыслу: запросы читаются глазами и раскладываются по темам. Машинный — по топу выдачи: если по двум запросам Яндекс показывает одни и те же сайты, спрос за ними стоит один. Hard-кластеризация требует пересечения у всех запросов кластера и даёт узкие точные группы для интернет-магазина. Soft допускает пересечение через связующий запрос и собирает широкие темы для блога.
- Отсортируйте чистый список по убыванию частотности.
- Соберите группы вокруг высокочастотных и среднечастотных запросов.
- Проверьте спорные запросы по выдаче Яндекса — совпадают сайты или нет.
Пограничные запросы удобно складывать на отдельный лист и проверять пачкой: выдача по ним переписывается чаще, чем по высокочастотным, поэтому решение по такой группе принимается последним.
Честная граница ручного метода: до нескольких сотен запросов группировка в таблице реальна за вечер-два. Дальше внимание рассыпается, группы начинают пересекаться, один запрос попадает сразу в два кластера. На объёмах от тысячи запросов дешевле отдать шаг сервисам с кластеризацией по топу — Rush Analytics, Serpstat, Key Collector. Собственный кластеризатор автора разбирает 2 000 запросов за 2 дня — от 500 ₽ за тысячу.
На выходе: таблица «запрос — частотность — кластер».
Шаг 5. Разложить кластеры по страницам сайта
Финальный шаг превращает таблицу в план работ. Каждому кластеру назначается один адрес — существующая страница или новая. Список типов задаётся заранее: категория, подкатегория, фильтр или теговая страница, карточка товара, статья блога, страница услуги.
- Присвойте каждому кластеру тип страницы и адрес.
- Отметьте статус: страница есть, страницу дописать, страницу создать.
- Сверьте, что один смысл не назначен двум адресам.
Правило «один кластер — одна посадочная страница» держится на каннибализации: две страницы под один смысл делят между собой ссылки и поведенческие сигналы, и в топ не заходит ни одна.
Кластеры без страницы делятся натрое: часть уходит в план разработки каталога, часть — в контент-план блога, часть отсеивается как нерентабельная. Проектирование структуры сайта под собранное ядро — отдельная задача, и живёт она в разделе SEO и архитектура.
Порядок работ задаётся спросом и готовностью. Сначала кластеры с высокой частотностью и существующей страницей — дописать дешевле, чем создать. Дальше новые категории и теговые страницы, в конце длинный хвост для блога. Готовая карта работает и после сбора: по ней пишутся title, строится перелинковка и считается, сколько текстов ушло в работу.
На выходе: карта «кластер — URL — тип страницы — статус».
Инструменты для сбора семантики: что реально нужно на старте
Стартовый набор помещается в пять позиций:
- Яндекс Wordstat — первоисточник частотности по России, работает бесплатно после входа в аккаунт; ручной режим утомляет на списках в сотни маркеров.
- Букварикс — быстрый способ достать длинный хвост по маркеру одной выгрузкой, без поштучного обхода колонок Wordstat.
- Key Collector — десктопный сборщик под большие объёмы: парсинг, съём частотности, чистка по спискам стоп-слов в одном окне.
- Serpstat и Rush Analytics — облачные сервисы, где рядом стоят сбор, частотность и кластеризация по топу выдачи.
- Excel или Google Sheets — рабочий стол сборщика: фильтры, формулы, сортировки, отдельный столбец минус-слов.
Тарифы и лимиты меняются несколько раз в год, поэтому условия стоит проверять на сайте сервиса перед оплатой. Цифры из статей годичной давности устаревают быстрее, чем пишутся.
Что на старте не нужно: парсер под миллионные базы, отдельная подписка под съём подсказок, анализ ссылочного профиля. Эти задачи приходят позже, когда ядро уже разложено по страницам, а первые тексты собирают показы.
Порядок подключения простой. Сначала Wordstat и таблица на первом маркерном списке. Потом база длинного хвоста — когда ручной перебор начинает съедать вечера. В последнюю очередь сервис с кластеризацией, под объёмы, где группировка в таблице перестаёт сходиться.
Набор программ вторичен, методика первична. Сбор семантики связкой «Wordstat плюс таблица» повторяет логику Букварикс — Key Collector — Rush Analytics, просто медленнее. Ядро на пару сотен запросов доезжает до конца и без подписок.
Руками, инструментами или у специалиста: сравнение по времени, деньгам и объёму
Выбор подхода решается не принципами, а двумя величинами: размером будущего ядра и стоимостью собственного часа. Небольшому сайту услуг конвейер не нужен, каталогу на тысячи позиций ручная таблица встанет дороже подписки. Ниже — три способа собрать одно и то же ядро, разложенные по времени, деньгам и результату на выходе.
| Что сравнивается | Руками: Wordstat + таблица | Инструменты: Букварикс, Key Collector, Serpstat, Rush Analytics | Заказ у специалиста |
|---|---|---|---|
| Комфортный размер ядра | до нескольких сотен запросов | тысячи запросов | ограничение задаёт срок, а не объём |
| Затраты времени | несколько вечеров на сбор и столько же на чистку | часы на прогон плюс время на освоение интерфейса | кластеризация 2 000 запросов за 2 дня |
| Затраты денег | деньги не тратятся, платится временем | платная подписка, условия проверять на сайте сервиса | от 500 ₽ за 1 000 запросов |
| Качество кластеризации | на глаз, по смыслу; спорные группы остаются спорными | по топу выдачи, hard и soft на выбор | по топу плюс ручная проверка пограничных запросов |
| Что достаётся кроме списка запросов | понимание спроса из первых рук | выгрузка с частотностями и готовыми группами | карта страниц, минус-слова, приоритеты по частотности |
Выводы простые. Первое ядро полезно собрать руками — за пару вечеров в голове укладывается спрос ниши, и техзадания подрядчикам после этого пишутся другим языком. Повторные сборы дешевле отдавать инструментам: рутина одинаковая, а внимание тратится на смыслы. Ядро на тысячи запросов в таблице собирается дольше, чем окупается: вечера уходят, а страницы стоят. Комбинация тоже рабочая — маркеры и чистка на себя, кластеризация на сервис или на подрядчика.
Пять ошибок, из-за которых собранное ядро приходится переделывать
Ошибки сбора вскрываются не сразу — обычно через полгода, когда страницы написаны, а трафик идёт мимо кассы.
- Сбор без выставленного региона. Частотность приезжает по всей стране, ядро раздувается запросами из городов без доставки, план страниц строится на чужом спросе.
- Ставка на базовую частотность. Фраза с большой цифрой оказывается пустой в кавычках, и страница пишется под запрос, который в такой формулировке никто не вводит.
- Отказ от чистки ради скорости. Мусор доезжает до кластеров, группы превращаются в свалку, а списка минус-слов для рекламы не остаётся вовсе.
- Смешение коммерческих и информационных запросов. «Купить» и «как выбрать» в одном кластере дают страницу, которая не отвечает ни покупателю, ни читателю: интент размазан.
- Двадцать кластеров на одной странице. Экономия времени оборачивается текстом обо всём сразу, релевантность падает, в топ страница не заходит.
После запуска страниц результат сбора проверяется отчётами Яндекс.Метрики и Вебмастера: по каким запросам приходят люди, где показы есть, а кликов нет, какая страница собирает отказы. Без такой сверки промах обнаружится поздно — вместе с переписыванием текстов. Настройка счётчиков, целей и отчётов — задача из раздела веб-аналитика.
Где заканчивается ручной сбор и начинается работа специалиста
Ручной сбор — рабочий метод с понятным пределом, а не ошибка новичка. Граница видна по пяти признакам:
- Ядро перевалило за несколько тысяч запросов, и таблица открывается с тяжёлым вздохом.
- Кластеры не сходятся: запросы кочуют между группами при каждой пересборке.
- Вечера на сбор стоят дороже, чем работа по договору.
- Запускается новая категория, а решение по структуре нужно за пару дней.
- Список собран, но раскладка по страницам не складывается в структуру каталога.
Ни один из сигналов не отменяет пройденного пути: маркеры, собранные владельцем бизнеса, точнее тех, что снимают по каталогу со стороны. Отдавать стоит рутину — расширение, съём частотности, кластеризацию, — а знание ассортимента остаётся внутри компании.
Семантикой автор занимается с 2007 года, в SEO — 21 год: 100+ проектов, от сайтов услуг до товаров на маркетплейсах. В кейсе stvmed ядро на 350 ключей стало опорой для карточки товара, инфографики и работы с отзывами.
Прикинуть размер будущего ядра можно без обязательств. Квиз на сайте собирает вводные за пару минут, дальше приходит ответ с оценкой объёма и сроков; прямой разговор через контакты выходит быстрее, если каталог сложный. Что входит в работу под ключ — на странице сбор семантического ядра.
FAQ
Сколько времени занимает сбор семантики самому?
Ответ: для небольшого сайта услуг первый проход укладывается в несколько вечеров — маркеры, расширение, чистка, черновая группировка. Интернет-магазин с широким каталогом растягивает работу на недели. Срок задают ширина ассортимента и аккуратность чистки, а не скорость печати.
Сколько запросов нужно интернет-магазину?
Ответ: считать стоит не запросы, а страницы. Ядро закрывает категории, подкатегории, фильтры и карточки товара, поэтому объём задаётся структурой каталога, а не круглой цифрой из брифа. В кейсе stvmed старт получился на 350 ключей под одну товарную линейку.
Реально ли собрать семантику бесплатно, на одном Wordstat?
Ответ: реально, если ядро небольшое и времени на ручной перебор не жалко. Платные сервисы продают скорость и кластеризацию по топу выдачи, а не доступ к закрытым данным: частотность приходит из одного источника. Ограничение бесплатного пути — усидчивость сборщика.
Чем hard-кластеризация отличается от soft?
Ответ: hard требует совпадения сайтов в топе у каждой пары запросов группы — кластеры выходят узкими и точными, под категории и карточки магазина. Soft связывает запросы через промежуточный, поэтому темы получаются шире и удобнее для блога.
Как понять, что ядро собрано плохо?
Ответ: признаки видны прямо в таблице. Один запрос попал в два кластера, в группе соседствуют «купить» и «как выбрать», в списке остались чужие бренды и другие города, кластеров больше, чем страниц в плане. Проверка — прогон 10 спорных запросов по выдаче.
Что выгоднее — собрать семантику самому или заказать?
Ответ: первое небольшое ядро окупается самостоятельным сбором, понимание спроса дороже сэкономленных часов. Объёмы от нескольких тысяч запросов дешевле отдавать: ориентир по кластеризации — от 500 ₽ за тысячу фраз, а вечера остаются на продажи.


