Коротко: семантическое ядро — это не список слов, а карта соответствия «запрос → страница». Рабочий порядок: собрать сиды из продукта, конкурентов и внутренней аналитики, расширить через Wordstat, снять частотность по своему региону, вычистить мусор минус-словами, проверить интент по фактической выдаче, сгруппировать запросы в кластеры и назначить каждому кластеру ровно одну посадочную страницу.
Что такое семантическое ядро и зачем оно нужно
Семантическое ядро — набор поисковых запросов, по которым сайт должен находиться, разложенный по страницам. Ключевое слово здесь — «разложенный». Выгрузка на 12 000 фраз без колонки «посадочная страница» — это сырьё, а не ядро. Сырьё нельзя внедрить: непонятно, что писать, где писать и надо ли вообще.
Готовое ядро отвечает на три вопроса:
- Какие страницы нужны. Каждый устойчивый кластер запросов — кандидат на отдельную страницу, подкатегорию или раздел.
- Что на этих страницах писать. Формулировки запросов показывают, что человек выясняет до покупки: цену, сроки, совместимость, гарантию, способ монтажа, условия возврата.
- Каких страниц быть не должно. Если под идею нет кластера — страницу делать не надо. Она добавит мусора в индекс и не принесёт трафика.
Из ядра дальше вырастает структура каталога, план статей, черновики заголовков и описаний (см. title, description и мета-теги) и схема внутренней перелинковки. Поэтому ядро собирают до того, как сверстали разделы, а не после — переделывать структуру на живом сайте всегда дороже, чем спроектировать её один раз.
Ядро без карты страниц бесполезно. Если после сбора в таблице нет колонки «на какую страницу», работа не закончена — она даже не начата.

Источники сидов: откуда берутся первые запросы
Сиды — базовые фразы, от которых расширяется всё остальное. Их не нужно много: 50–200 хороших сидов дают на выходе десятки тысяч расширений. Плохие сиды дают десятки тысяч мусора.
Продукт и его синонимы
Выпишите, что вы продаёте, всеми возможными словами: категория, подкатегория, материал, назначение, формат поставки. Одна и та же вещь у разных людей называется по-разному: «серверный шкаф», «телекоммуникационная стойка», «рэк». Все варианты — отдельные сиды, у каждого своя частотность.
Язык клиента, а не язык компании
Внутренние названия («решение уровня Enterprise», артикулы, названия тарифов) люди не ищут. Ищут по проблеме и по бытовому названию. Самый дешёвый источник клиентской лексики — записи звонков, чат на сайте и переписка в мессенджерах: там человек формулирует так же, как в поисковой строке.
Разделы конкурентов
Откройте меню и хлебные крошки трёх-пяти конкурентов, которые стабильно в топе. Их структура — уже сделанная кем-то кластеризация. Копировать её вслепую нельзя (у конкурента может быть другой ассортимент и другие ошибки), но как источник сидов и как проверка «а не забыли ли мы целый раздел» это работает.
Подсказки поиска и блоки «вместе с этим ищут»
Подсказки строятся на реальном спросе, включая свежий, которого ещё нет в исторических выгрузках. Пройдите по алфавиту: вводите сид и по очереди добавляйте букву. Отдельно снимите подсказки с мобильной выдачи — они отличаются.
Внутренний поиск по сайту
Самый недооценённый источник. Люди уже пришли к вам и словами написали, чего не нашли. Запросы с нулевым результатом — прямое указание на отсутствующие страницы или отсутствующий товар.
Обращения в поддержку и вопросы менеджерам
Повторяющийся вопрос — это готовый информационный кластер и готовая страница FAQ. Если вопрос задают в тикетах десять раз в месяц, его задают и поисковику.
Отчёт по запросам из панели вебмастера
Показывает, по каким фразам сайт уже показывается, включая те, о которых вы не догадывались. Обращайте внимание на строки с большим числом показов и низким CTR: это либо не тот интент, либо неудачный сниппет. И на позиции 11–30 — это ближайший к деньгам резерв.
Расширение через Wordstat: операторы и типы частотности
Wordstat даёт число показов по фразе за месяц в выбранном регионе. Без операторов эта цифра почти всегда завышена: базовая частотность суммирует все запросы, содержащие ваши слова в любых словоформах и с любыми добавками.
# Базовая частотность: все словоформы + любые дополнительные слова
семантическое ядро
# Фразовая: только эти слова, без «хвостов», словоформы любые
"семантическое ядро"
# Точная: фиксируем словоформу каждого слова
"!семантическое !ядро"
# Минус-слова: убираем нецелевые хвосты прямо на сборе
семантическое ядро -бесплатно -онлайн -реферат -скачать
# Группировка альтернатив: сбор нескольких сидов одним заходом
(сбор|составление|подбор) семантического ядра
# Фиксация предлога: без ! предлоги отбрасываются как стоп-слова
окна !в москве
# Комбинация: точная форма + минус-слова
"!семантическое !ядро" -яндекса -конкурента
Почему базовая частотность обманывает
Пример из реальных данных: базовая частотность фразы «семантическое ядро» — около 3 700 показов в месяц по России. Но внутрь этой цифры входят «семантическое ядро сайта», «как собрать семантическое ядро», «семантическое ядро онлайн», «семантическое ядро бесплатно», «семантическое ядро конкурента» и ещё сотни хвостов. Каждый из них — отдельный интент: кто-то ищет методику, кто-то бесплатный сервис, кто-то способ подсмотреть у конкурента. Планировать одну страницу под «3 700 показов» — значит планировать под несуществующий трафик.
| Обозначение | Как записывается | Что считает | Когда использовать |
|---|---|---|---|
| W | семантическое ядро | Все запросы, где встречаются оба слова в любых формах, плюс любые добавленные слова | Оценка объёма темы целиком, поиск направлений расширения |
| "W" | "семантическое ядро" | Только фраза без дополнительных слов, словоформы свободные | Отсев тем, где весь спрос сидит в хвостах |
| "!W" | "!семантическое !ядро" | Точная форма каждого слова, без добавок | Расчёт реального потенциала конкретной посадочной |
| "!W" с предлогом | "!ремонт !окон !в !москве" | То же, но предлог не выбрасывается | Гео-запросы и конструкции, где предлог меняет смысл |
Практическое правило: расширяться по базовой частотности, приоритизировать по точной. Разрыв между W и "!W" в десятки раз — нормальная ситуация для общих фраз и сигнал, что тему надо дробить на подтемы.
Частотность — это показы, а не переходы. Даже первое место не собирает весь объём: часть показов уходит в рекламу, часть — в блоки быстрых ответов, часть — в уточнённые запросы. Считайте частотность верхней границей, а не прогнозом трафика.

Регион меняет всё: съём частотности по городам
Частотность без указания региона — среднее по стране, и оно почти никогда не соответствует вашей ситуации. Различия бывают трёх видов:
- Объём. Одна и та же услуга в столице и в городе-миллионнике различается по спросу в разы, а не на проценты.
- Формулировки. В одном регионе говорят «шиномонтаж», в другом добавляют «переобувка»; локальные топонимы и районные названия живут только в своём регионе.
- Выдача. По одному и тому же запросу в разных городах разный состав топа: где-то маркетплейсы и агрегаторы забирают всё, где-то в топе локальные компании. Это напрямую влияет на реалистичность попадания.
Поэтому съём делают минимум в двух срезах: по стране (для понимания темы и приоритетов контента) и по своему региону присутствия (для планирования коммерческих страниц). Если бизнес работает в нескольких городах, снимайте частотность по каждому — иначе легко построить структуру под спрос, которого у вас нет.
Отдельный вопрос — надо ли делать страницу под каждый город. Ответ зависит от того, есть ли у вас в этом городе реальное присутствие и уникальное содержимое: адрес, склад, мастера, цены, сроки доставки. Если ничего этого нет, гео-страница превращается в шаблонный дубль. Про выбор между городскими поддоменами и папками — в разборе поддомен или подкаталог.
Чистка ядра: минус-слова и мусорные интенты
После расширения в файле оказывается в 20–50 раз больше строк, чем нужно. Чистка идёт в два прохода: механический и смысловой.
Механический проход
Приводим к нижнему регистру, схлопываем пробелы, убираем дубли, вычитаем стоп-лист. Это делается любым скриптом за секунды и снимает основную массу.
# нормализация и дедупликация выгрузки
tr '[:upper:]' '[:lower:]' < raw.txt | tr -s ' ' | sed 's/^ //; s/ $//' | sort -u > clean.txt
# вычитание стоп-слов: stop.txt — по одному слову или фрагменту в строке
grep -v -F -i -f stop.txt clean.txt > filtered.txt
# что именно отсеялось — обязательно просматривать глазами
grep -F -i -f stop.txt clean.txt | head -50
# контроль объёма на каждом шаге
wc -l raw.txt clean.txt filtered.txt
Что попадает в стоп-лист
- Чужие бренды и модели. Если вы их не продаёте — это не ваш трафик. Если продаёте, это отдельный кластер с отдельной страницей, а не примесь к общей категории.
- «Своими руками», «самому», «чертёж», «схема сборки». Человек собирается делать сам и ничего не купит. Исключение — если у вас медийная стратегия и вы осознанно собираете информационный трафик.
- Игровой, сериальный и музыкальный шум. Классическая ловушка омонимии: «фракция», «клан», «сезон», «серия», «аккорды», «майнкрафт». Часто именно эти хвосты и создают львиную долю базовой частотности.
- Вакансии и обучение. «Работа», «вакансии», «зарплата», «курсы», «обучение», «профессия» — другой интент и другая аудитория.
- Учебный шум. «Реферат», «курсовая», «презентация», «доклад», «гост», «википедия».
- Пиратский хвост. «Скачать», «бесплатно», «торрент», «взлом», «кряк» — если вы не раздаёте бесплатную версию.
- Чужая география. Города и страны, где вы не работаете.
- Дубли по словоформам и перестановкам. «Купить окна пвх» и «окна пвх купить» — одна и та же цель. Оставляйте самый частотный вариант как главный, остальные держите в кластере как вспомогательные.
Никогда не удаляйте отсеянное безвозвратно. Держите отдельный файл «мусор» и просматривайте его после каждого прохода: минус-слово «схема» вместе с «схема сборки» унесёт и коммерческое «схема подключения», под которое у вас есть страница.
Проверка интента: главный этап, который пропускают
Здесь ломается большинство ядер. Запрос с хорошей частотностью выглядит привлекательно, но частотность ничего не говорит о том, чего хочет человек. Высокочастотная фраза регулярно оказывается нецелевой: человек ищет комплектующие, а не изделие; инструкцию по ремонту, а не покупку; чужой продукт с похожим названием; или вообще другую предметную область.
Как проверять интент
Единственный надёжный источник — фактическая выдача. Поисковая система уже провела эксперимент на миллионах людей и показала то, что они выбирают. Порядок действий:
- Открыть выдачу по запросу в нужном регионе, в режиме без персонализации (приватное окно, чистая сессия).
- Выписать типы первых десяти результатов: карточка товара, категория каталога, статья, форум, видео, агрегатор, маркетплейс, справочник, сайт производителя.
- Посмотреть на колдунщики и блоки: товарная галерея, картинки, видео, быстрые ответы, карты. Их состав — прямая подсказка об интенте.
- Прочитать заголовки: что обещают страницы, попавшие в топ. Если восемь из десяти — инструкции, коммерческая страница на это место не встанет.
Правило простое: тип вашей страницы должен совпадать с типом страниц, которые уже в топе. Спорить с выдачей — дорого и бессмысленно.
Три типа интента
- Информационный. «Как», «что такое», «почему», «отличие», «инструкция», «своими руками». Посадочная — статья, руководство, справочный раздел. Такие запросы не продают напрямую, но формируют верх воронки и хорошо цитируются в блоках ответов.
- Коммерческий. Делится на два подтипа. Транзакционный: «купить», «заказать», «цена», «стоимость», «с доставкой» — посадочная категория или карточка. Исследовательский: «лучший», «сравнение», «отзывы», «рейтинг», «что выбрать» — посадочная обзор или страница сравнения, но с коммерческими блоками.
- Навигационный. Бренд, «официальный сайт», «личный кабинет», «вход», «контакты». Посадочная — конкретная страница бренда или раздел. Чужие навигационные запросы забирать бесполезно: человек ищет конкретную компанию и уйдёт к ней.
Слова-маркеры помогают отсортировать быстро, но окончательное решение всегда за выдачей. «Цена» встречается и в информационных запросах («от чего зависит цена»), а «как» — во вполне коммерческих («как заказать»).
| Тип запроса | Интент | Тип посадочной | Реалистичные ожидания |
|---|---|---|---|
| Частотный общий («окна пвх») | Смешанный, чаще коммерческо-исследовательский | Корневая категория или витрина раздела | Самый долгий и конкурентный участок; занимается в последнюю очередь, после того как взяты подкатегории |
| Средний («окна пвх в частный дом») | Коммерческий | Подкатегория, страница решения | Основная рабочая зона; движение заметно после того, как страница набрала историю и ссылки внутри сайта |
| Низкочастотный длинный хвост («какой профиль выбрать для холодного балкона») | Информационный | Статья, раздел FAQ, ответ в базе знаний | Самый быстрый отклик; трафика на страницу мало, но кластеров много и суммарно они дают больше общих фраз |
| Брендовый (свой бренд) | Навигационный | Главная, страница о компании, вход в кабинет | Обычно занимается без усилий; задача — не потерять и не отдать агрегаторам |
| Брендовый (чужой бренд) | Навигационный | Страница бренда в каталоге, если товар реально есть | Занять первое место практически нереально; имеет смысл только при наличии товара в наличии |
| Гео («окна пвх в балашихе») | Коммерческий локальный | Страница филиала с уникальными данными: адрес, склад, сроки | Работает там, где есть реальное присутствие; без него шаблонные копии не дают результата |
Отдельная проверка — не забрали ли выдачу целиком маркетплейсы и агрегаторы. Если весь топ-10 занят площадками, а сайтов производителей и магазинов там нет, кластер стоит понизить в приоритете независимо от частотности.

Кластеризация: по смыслу и по общности выдачи
Кластеризация — группировка запросов, которые можно продвигать одной страницей. Есть два подхода, и на практике они работают в паре.
Ручная по смыслу
Вы сами решаете, что «окна в дом» и «окна для коттеджа» — одно. Быстро, дёшево, не требует инструментов. Минус — субъективность: логика владельца сайта часто не совпадает с логикой поиска. «Ремонт окон» и «замена стеклопакета» кажутся одним, а в выдаче это разные наборы страниц.
По общности выдачи
Формальный метод: два запроса попадают в один кластер, если у них совпадает не менее N URL в топ-10. Порог обычно 3–5 и настраивается под тематику: в конкурентных коммерческих темах берут выше, в узких — ниже.
- Hard-кластеризация. Каждый запрос группы пересекается по выдаче с каждым другим. Кластеры мелкие и чистые, ошибок мало, но их получается много.
- Soft-кластеризация. Достаточно пересечения с центральным запросом группы. Кластеры крупнее, но растёт риск склеить разный интент через связующее звено.
Рабочая схема: сначала hard для получения надёжного скелета, затем ручное объединение мелких кластеров там, где по смыслу и по типу страницы они действительно одинаковы. Автоматика без ручной проверки даёт странные группы; ручная работа без автоматики закрепляет ваши заблуждения о том, как думает поиск.
Разные интенты нельзя вести на одну страницу. Страница, которая пытается быть одновременно каталогом и инструкцией, проигрывает и коммерческим страницам, и статьям: она не отвечает целиком ни на один запрос, а поведенческие сигналы у неё хуже, чем у специализированных конкурентов.
Кластер → страница: как ядро превращается в структуру сайта
Финальный этап. У каждого кластера должна появиться ровно одна посадочная и один главный запрос, вокруг которого строится заголовок.
Где брать новые страницы
- Подкатегории каталога — под средние коммерческие кластеры с устойчивым спросом.
- Страницы фильтров — только под те сочетания, где есть и спрос, и товар, и уникальное описание. Открывать в индекс все комбинации фильтров нельзя: это генератор околодублей.
- Страницы решений и применений («окна для дачи», «для панельного дома») — под кластеры, которые описывают ситуацию, а не товар.
- Статьи и справочные разделы — под информационные кластеры.
- Страницы сравнения — под исследовательские кластеры «А или Б», «чем отличается».
Где не плодить дубли
- Отдельные страницы под словоформы и перестановки слов.
- Отдельные страницы под синонимы, если выдача по ним одинаковая.
- Копии одной страницы под каждый город без реального отличия в содержимом.
- Комбинации фильтров с нулевым спросом и пустой выдачей товаров.
Если каннибализация уже случилась — две страницы конкурируют за один кластер, — выбирают главную, а вторую либо переписывают под соседний кластер, либо склеивают. Механика склейки и типовые ошибки разобраны в руководстве по редиректам. Разметку страниц, которые получились из кластеров (товар, статья, вопрос-ответ), стоит сразу заложить: см. структурированные данные.
# Структура файла ядра: одна строка = один запрос
# CSV с разделителем «;», кодировка UTF-8
query;freq_base;freq_exact;region;cluster;landing;intent;priority
семантическое ядро;3725;;Россия;core-general;/articles/semantic-core-guide;info;1
семантическое ядро сайта;608;;Россия;core-general;/articles/semantic-core-guide;info;1
как собрать семантическое ядро;482;;Россия;core-howto;/articles/semantic-core-guide;info;1
сбор семантического ядра;332;;Россия;core-howto;/articles/semantic-core-guide;info;2
кластеризация семантического ядра;61;;Россия;core-clustering;/articles/semantic-core-guide;info;2
семантическое ядро онлайн;136;;Россия;core-tool;/keywords;commercial;1
семантическое ядро сервис;120;;Россия;core-tool;/keywords;commercial;1
структура сайта seo;56;;Россия;site-structure;NEW: раздел о структуре;info;3
краулинговый бюджет;50;;Россия;crawl-budget;NEW: статья о бюджете обхода;info;3
# Колонка landing заполняется всегда. Допустимые значения:
# существующий URL — кластер уже покрыт
# NEW: краткое описание — страницу нужно создать
# DROP: причина — кластер сознательно не берём
Строк «NEW» в файле обычно оказывается больше, чем ожидалось, — это и есть план работ. Строк без значения в колонке landing быть не должно вообще.

Приоритизация: почему «сначала самые жирные» не работает
Интуитивный порядок — брать запросы по убыванию частотности — приводит к тому, что команда полгода бьётся о самые конкурентные фразы и не получает ничего. Приоритет считается по трём факторам одновременно:
- Спрос — точная частотность кластера по нужному региону, а не базовая частотность главного запроса.
- Реалистичность — состав выдачи: возраст и авторитетность сайтов в топе, доля агрегаторов и маркетплейсов, наличие сайтов вашего масштаба.
- Близость к деньгам — насколько кластер близок к покупке. Транзакционный кластер на 100 показов часто ценнее информационного на 3 000.
Практический порядок запуска:
- Быстрые победы. Запросы, по которым сайт уже показывается на позициях примерно 11–30 (данные из панели вебмастера). Страница есть, интент совпадает, нужна доработка контента и внутренних ссылок.
- Коммерческие средние кластеры, где в топе есть сайты вашего масштаба.
- Информационный длинный хвост — дёшево в производстве, даёт вход в тему и внутренние ссылки на коммерческие страницы.
- Высокочастотные общие запросы — в последнюю очередь, когда раздел уже набрал массу качественных подстраниц.
Никто не может гарантировать позицию или срок её достижения. Любое обещание «топ-3 за месяц» — либо незнание, либо намерение использовать методы, за которые сайт получает санкции. Накрутка поведенческих факторов относится ровно к этой категории рисков: результат нестабилен, а фильтр за неё снимается долго и не всегда.
Типовые ошибки и поддержка ядра
- Ядро ради ядра. Собрали, отчитались, положили в архив. Ценность нулевая: работает не файл, а внедрённая структура.
- Тысячи запросов без карты страниц. Объём выгрузки не показатель качества. 800 разложенных по страницам запросов полезнее 40 000 неразложенных.
- Каннибализация. Несколько страниц под один кластер. Поиск сам выбирает, какую показывать, и меняет решение — позиции скачут, а внутренний вес размазан.
- Гео-дорвеи. Сотни страниц под города, различающиеся только подстановкой топонима. Быстро распознаются как шаблонные и не приносят трафика.
- Игнорирование интента. Коммерческая страница под информационный запрос и наоборот. Самая частая причина ситуации «страница есть, а трафика нет».
- Ядро один раз и навсегда. Спрос сезонный и меняющийся: появляются новые модели, форматы, термины. Пересматривать состав стоит ежеквартально, а после запуска новых товаров или услуг — сразу.
Краулинговый бюджет
Робот тратит на сайт ограниченный объём обращений. Чем больше страниц-пустышек, дублей и бесконечных комбинаций фильтров, тем меньше внимания достаётся тем страницам, ради которых всё делалось. Раздутая структура вредит дважды: обход важных страниц замедляется, а сайт в целом выглядит менее качественным.
Правильно собранное ядро сокращает бюджет обхода естественным образом — вы просто не создаёте страниц, у которых нет своего кластера. Проверять состояние индекса и находить страницы, которые никому не нужны, помогает регулярный технический аудит: базовый список пунктов — в чеклисте SEO-аудита.
Как проверить
- Снять частотность и разложить запросы — инструмент подбора ключевых слов: показывает частотность, связанные фразы и помогает разбить список на группы перед ручной проверкой интента.
- Проверить страницы, которые вы назначили посадочными — SEO-аудит страницы: заголовки, мета-теги, дубли, техническая доступность. Страница с правильным кластером и сломанной технической частью не ранжируется.
- Разобраться, почему созданной страницы нет в поиске — разбор сайта нет в поиске: индексация, robots, канонические адреса, качество контента.
Частые вопросы
Сколько запросов должно быть в семантическом ядре
Столько, сколько нужно, чтобы покрыть все страницы, которые вы реально готовы сделать и поддерживать. Для небольшого сервиса это может быть 300–500 запросов в 40–60 кластерах, для крупного каталога — десятки тысяч. Размер файла не является показателем качества: показателем является доля запросов с заполненной колонкой «посадочная страница».
Можно ли собрать ядро бесплатно
Да. Wordstat, подсказки поиска, панель вебмастера и внутренний поиск по сайту доступны бесплатно и покрывают основную часть работы. Платные сервисы экономят время на массовом съёме частотности и автоматической кластеризации по выдаче, но не заменяют ручную проверку интента.
Как быстро появится результат
Точных сроков не существует: они зависят от конкуренции в тематике, возраста и технического состояния сайта, качества страниц. Раньше всего обычно откликаются низкочастотные информационные кластеры и запросы, по которым сайт уже показывается во второй-третьей десятке. Общие высокочастотные фразы — самый долгий участок. Любой конкретный срок, названный заранее, — выдумка.
Нужно ли делать отдельную страницу под каждый низкочастотный запрос
Нет. Отдельная страница нужна кластеру, а не запросу. Если пять формулировок дают одинаковую выдачу, это один кластер и одна страница; остальные формулировки используются внутри текста, в подзаголовках и в разделе вопросов.
Что делать с запросами, где в топе только маркетплейсы
Оценивать трезво. Если в топ-10 нет ни одного сайта вашего типа, попадание туда маловероятно независимо от качества страницы. Такие кластеры либо откладывают, либо закрывают другим способом: через присутствие на самих площадках, через более узкие подзапросы, где площадок нет, или через информационные страницы вокруг темы.
Как часто пересобирать ядро
Полная пересборка нужна редко — при смене ассортимента или выходе на новый рынок. Регулярная работа другая: раз в квартал добавлять новые запросы из панели вебмастера и внутреннего поиска, проверять кластеры, потерявшие спрос, и искать каннибализацию среди новых страниц.
Чеклист сбора ядра
- Собраны сиды минимум из пяти источников, включая внутренний поиск и обращения клиентов.
- Расширение сделано с операторами Wordstat, минус-слова заданы уже на этапе сбора.
- Частотность снята и в базовом, и в точном виде; приоритеты считаются по точной.
- Частотность снята по каждому региону присутствия, а не только по стране.
- Проведена механическая чистка, отсеянное сохранено в отдельный файл и просмотрено.
- Интент проверен по фактической выдаче для всех кластеров, попавших в план работ.
- Кластеры получены по общности выдачи и проверены вручную на смешение интентов.
- У каждого кластера ровно одна посадочная: существующий URL, «NEW» или «DROP» с причиной.
- Проверено, что ни одна существующая страница не назначена двум кластерам сразу.
- Приоритет расставлен по спросу, реалистичности и близости к деньгам, а не по частотности.
- Список «NEW» превращён в план публикаций с ответственными и сроками.
- Назначена дата следующего пересмотра ядра.