Семантическое ядро: как собрать и разложить по страницам

Сбор и группировка запросов
SEO/GEO

Зачем ядро собирают до того, как писать тексты

Семантическое ядро - список запросов, по которым сайт должен находиться в поиске, разложенный по конкретным страницам. Сказать это можно одной строкой, а работы за этим на день-неделю, смотря сколько у сайта направлений.

Что бывает без ядра, видно на любом блоге, который писали «по темам». Две статьи заходят на один и тот же запрос и делят показы между собой: поиск не понимает, какую из них показывать, и не выводит наверх ни одну. Часть спроса не закрыта ничем - люди ищут, страницы нет. Еще часть текстов написана про то, чего никто не спрашивает, потому что автору тема казалась важной.

Ядро снимает все три проблемы, потому что превращает спрос в карту. У каждой фразы появляется адрес, который на нее отвечает, и статус этого адреса.

Рекламные фразы и ядро под поиск собирают одними и теми же инструментами, а задачи у них разные. В рекламе фразы нужны для показов и минус-слов, в поиске - для структуры сайта. Особняком стоят разговорные и вопросные запросы, по которым сайт попадает в ответы нейросетей: их собирают по своей логике, об этом разбор семантики под AI-поиск. Здесь - классическая выдача Google и Яндекса.

Если вы первый раз подходите к теме, начните с материала что такое поисковая оптимизация, там разобран механизм целиком.

Опорные запросы: с чего начинается сбор

Сбор начинается не с сервиса, а со списка опорных запросов. Опорный запрос - короткая фраза, от которой сервис разворачивает хвост: вы вводите «семантическое ядро» и получаете все запросы, которые эту фразу содержат. В статьях опорные запросы называют масками или маркерами - это одно и то же.

Берут их из четырех мест.

  • Из списка услуг или ассортимента. То, что вы продаете, люди как-то называют, и часто не теми словами, что написаны у вас на сайте
  • Из заголовков тех конкурентов, что уже стоят в топе по вашей теме. Их H1 и есть готовые опорные фразы
  • Из вопросов, которые клиенты задают в переписке до покупки
  • Из отчета по запросам в Google Search Console (GSC), если сайт уже собирает показы

Последний источник используют реже прочих, хотя он самый дешевый. У работающего сайта уже есть список фраз, по которым его находят, и часть из них никогда не попадала в ядро - поиск подобрал их сам. Как читать этот отчет, показано в материале про отчеты Google Search Console.

Рабочий потолок - десять опорных запросов на одно направление. После десятого фразы идут внахлест: одиннадцатая и двенадцатая вытягивают тот же хвост, что и первые три, а в файле копятся дубли.

Как это выглядело у нас. Три направления, по десять опорных запросов в каждом:

  • база SEO: seo продвижение, seo оптимизация, что такое seo, seo аудит, seo специалист, продвижение сайта в google, продвижение сайта в яндексе, раскрутка сайта, seo для бизнеса, поисковая оптимизация
  • техническая часть: robots txt, sitemap xml, индексация сайта, скорость загрузки сайта, core web vitals, google search console, 301 редирект, микроразметка schema, технический аудит сайта, дубли страниц
  • контент и семантика: семантическое ядро, подбор ключевых слов, кластеризация запросов, тз для копирайтера, мета теги, title и description, перелинковка сайта, seo текст, частотность запросов, seo статья

Список опорных фраз проверяют до сбора, иначе вы соберете хвост не той темы. Проверка занимает пять минут. Вбейте каждую фразу в поиск и посмотрите, что стоит в первой десятке. Если там страницы, похожие на те, что вы собираетесь делать, фраза рабочая. Если выдача забита сервисами, магазинами или новостями, фразу из списка вычеркивайте. Спрос есть, но он не ваш.

Сбор 21 августа 2026 года: тридцать опорных фраз дали 5 459 строк, из них 5 042 уникальные. Пропорция примерно такая и будет: одна опорная фраза приносит от полутора до двух сотен строк, если тема ходовая.

Wordstat: что дает и где упирается

Wordstat отдает статистику показов Яндекса. Вводите фразу, получаете список запросов, которые ее содержат, и число рядом с каждым.

Число рядом с фразой показывает, сколько раз за последние 30 дней люди искали в широком соответствии запросы, включающие вашу фразу. То есть «семантическое ядро» с частотой 3 929 - это сумма показов по «семантическое ядро», «семантическое ядро сайта», «как собрать семантическое ядро» и еще сотне вариантов. Это верхняя граница спроса на тему, а не число переходов, которые вы получите, и не число людей, набравших фразу дословно.

До сбора выставляют режим «Топы запросов» и регион. Регион меняет картину сильнее прочего.

Таблица Wordstat с частотами по запросу семантическое ядро
Wordstat в режиме «Топы запросов»: справа частота, сверху счетчик найденных фраз

Лимит в 200 фраз на опорный запрос. На узких темах вы его не замечаете, на популярных упираетесь сразу. У нас в потолок уперлись три опорных запроса из тридцати: «seo продвижение», «seo оптимизация» и «раскрутка сайта». Счетчик показывает, что найдено несколько тысяч фраз, а в таблице их двести.

Wordstat показывает лимит в 200 фраз по запросу seo продвижение
Найдено несколько тысяч фраз, отдано двести. Дальше опорный запрос дробится на узкие

Что делать: дробить опорный запрос на несколько узких. Вместо «seo продвижение» брать «seo продвижение сайта», «seo продвижение цена», «seo продвижение самостоятельно» - и собирать каждый отдельно. Хвост забирают по частям.

Период всегда последние 30 дней. Выбрать произвольные даты нельзя, даже если интерфейс намекает на обратное. Сезонный спрос смотрят в отдельном режиме истории запросов, в основной таблице его нет.

«Все регионы» - это не весь мир. Строка означает трафик Яндекса целиком - Россию и часть СНГ. Для Казахстана, Узбекистана или русскоязычной аудитории в США цифры Wordstat почти ничего не скажут, люди там ищут в Google. Русскоязычный спрос за пределами зоны Яндекса виден только во втором источнике.

Wordstat отдал нам 1 750 строк против 3 709 у Keyword Planner - меньше трети общего объема. Для темы SEO это ожидаемо, аудитория сидит в Google.

Keyword Planner: что дает и чем отличается

Планировщик ключевых слов Google (Keyword Planner) лежит внутри рекламного кабинета Google Ads и открывается через раздел «Инструменты». Аккаунт нужен, активные кампании - нет.

Метрика здесь другая - среднее число запросов в месяц за последние 12 месяцев по конкретной фразе, без суммирования по вариантам. Google дополнительно отдает помесячные данные.

Результат определяют две настройки - язык и местоположение. Язык русский, местоположение - «Все местоположения», если вы работаете на несколько стран или на диаспору. Эта пара настроек дает то, чего нет в Wordstat: русскоязычный спрос по всему миру.

Настройки языка и местоположения в Планировщике ключевых слов Google
Пара настроек, которая дает русскоязычный спрос за пределами зоны Яндекса

Диапазоны вместо точных чисел. Без активных кампаний Google показывает диапазоны вида «от 1 тыс. до 10 тыс.». По диапазону в 10 раз приоритеты не расставить. Достаточно запустить кампанию с минимальным бюджетом: после этого аккаунт видит точные значения.

Выгрузку не забрать программно. Кнопка «Скачать» закрыта от автоматических кликов. Нажатие проходит, файл не создается. Таблица в интерфейсе виртуализована - в разметке лежит около шестнадцати строк, сколько бы вы ни выбрали на странице. Настройки выставляет кто угодно, кнопку «Скачать» жмет человек. Три клика на три направления.

Кодировка выгрузки. Файл приходит в UTF-16LE с табуляцией вместо запятой и двумя строками служебной преамбулы перед заголовками. Excel и Google-таблицы открывают его криво: кодировку приходится указывать руками.

Идеи не привязаны к опорному запросу. Wordstat всегда говорит, из какой фразы выросла строка. Google этого не сообщает. Вы загрузили десять опорных фраз, получили тысячи идей единым списком, и какая откуда - неизвестно. Если вам нужна привязка, собирайте по одному направлению за раз и подписывайте выгрузку сами.

Помесячные колонки и срез за полгода. В выгрузке есть колонки вида «Searches: Mar 2026» - объем по каждому месяцу отдельно. Среднее по последним шести колонкам показывает текущий спрос, а не усредненный за год. Разница между годовым средним и полугодовым срезом доходит до двух с лишним раз.

Помесячные колонки поисковых объемов в выгрузке Keyword Planner
Из этих шести колонок считается текущий спрос вместо годового среднего

В нашем сборе годовое среднее против среза за полгода:

  • «тз для копирайтера»: с 1 900 до 3 820, рост вдвое
  • «тз для копирайтера пример»: с 2 900 до 4 950
  • «сео текст пример»: с 1 000 до 1 797
  • «мета описание»: с 480 до 813
  • «сео продвижение сайта в яндексе»: с 1 600 до 683, падение на 57%
  • «продвижение сайта в google»: с 1 300 до 743
  • «продвижение с оплатой за трафик»: с 590 до 325

По годовому среднему обе тенденции не видны. Запрос про продвижение в Яндексе с частотой 1 600 и запрос про задание копирайтеру с частотой 1 900 стоят почти вровень, и в плане они окажутся рядом. По срезу за шесть месяцев между ними уже пятикратный разрыв: 683 против 3 820. Первую тему можно не трогать вовсе, вторая просится в ближайший месяц.

На срез уходит около часа, и он меняет порядок статей в плане.

Почему нельзя сортировать общий список по частоте

Обычный ход: обе выгрузки сводят в один файл, сортируют по убыванию частоты и пишут сверху вниз. Так делать нельзя. Wordstat считает показы за 30 дней по широкому соответствию, и в число зашиты все фразы, содержащие ваш запрос. Keyword Planner считает число запросов по конкретной фразе за месяц, усредненное по году и округленное до шага сетки. Первая метрика по природе завышена относительно второй, причем на разных темах по-разному: где хвост длинный, разрыв больше.

В нашем файле 331 фраза встретилась в обоих источниках. Числа рядом с ними расходятся в разы. Это не ошибка сбора, метрики меряют разные вещи.

Отсюда три рабочих правила:

  • сравнивать частоты можно только внутри одного источника
  • сопоставлять между источниками только порядки величины: сотни против тысяч, а не разницу в 12%
  • если фраза есть в обоих, брать для приоритета один источник - тот, чей рынок вам ближе

Механика расхождения подробно разобрана в статье почему Wordstat и Keyword Planner не сходятся. Здесь хватает главного - смешанный список не сортируют.

Чистка: пять признаков мусорной фразы

Все статьи по теме пишут «удалите нецелевые запросы» и идут дальше. Какая доля собранного оказывается мусором и как его увидеть, не пишет никто. У мусора пять устойчивых признаков, и на нашем сборе каждый посчитан.

Запрос ведет в интерфейс сервиса. Наверху выгрузки Keyword Planner, отсортированной по объему, стояли «google search console» с частотой 3 350 000, «searchconsole» - 823 000, «google webmastertool» - 110 000, «webmaster google console» - 49 500, «wordstat yandex» - 8 100. Миллионы запросов в месяц, и все они бесполезны. Человек, набирающий «google search console», ищет кнопку входа в сервис, а не статью про отчеты. Он не кликнет на вас, даже если вы окажетесь первым.

Признак читается по ответу. Если на запрос отвечает сам сервис, а не текст, строка уходит. Такие запросы называют навигационными.

Чужой бренд в хвосте. Названия агентств и сервисов, попавшие в хвост опорных фраз. У нас это «seo fortuna», «novelit», «seotica» и подобные - около 400 строк в одном направлении. По ним ищут конкретную компанию, а не услугу. Страницу под чужой бренд вы не сделаете, а если сделаете, она соберет трафик людей, которым нужны не вы.

География мимо рынка. «Москва», «спб» и еще полсотни городов в хвосте. Если вы не продаете в этом городе, фраза уходит. Локальный спрос требует отдельной страницы с адресом и телефоном, статья в блоге его не заберет.

Другая аудитория за теми же словами. Классика - вакансии и обучение. «seo специалист вакансии» с частотой 228, «seo специалист обучение» - 148. Фразы совпадают с вашими, а спрос за ними чужой: одни ищут работу, другие - обучение. Если вы не продаете курсы, эти строки уходят.

Чужая платформа или движок. «sitemap xml wordpress» - 4 400, «wp sitemap» - 320, «yoast seo robots txt» - 320. Запрос про вашу тему, но привязанный к системе, которой у вас нет. Читатель приходит за инструкцией по своему движку, не находит ее и уходит.

Фрагмент таблицы семантики с колонками источника, направления и частоты
Рабочий файл сбора: помеченные строки уходят до группировки

Из 5 459 строк в работе осталось около 4 100. Около 400 из выпавших - дубли между источниками, остальное мусор по пяти признакам. Примерно четверть сбора не пригодилась, и это нормальная доля. Если у вас выкинулось два процента, значит вы плохо смотрели.

Почему чистить надо до группировки, а не после. Мусорные высокочастотники стягивают на себя целые группы. «google search console» с частотой 3 350 000 при автоматической разбивке становится центром группы, вокруг него собираются двадцать нормальных фраз, и приоритет номер один получает вся эта группа. Вы садитесь писать статью под навигационный запрос, по которому на первом месте в выдаче стоит сам Google. Чистка после группировки этого уже не исправит, структура сложилась вокруг мусора.

Кластеризация: одна страница или две

Фразы разбивают на группы, каждая группа получает одну страницу. Ошибка на этом шаге дает две страницы, конкурирующие между собой, и обе не выходят наверх.

Проверяют это по выдаче. Берете две спорные фразы и вбиваете каждую в поиск. Сравниваете первую десятку. Если в обоих случаях стоят одни и те же страницы, поиск считает это одной темой, и вам нужна одна страница. Если выдача расходится - темы разные, страниц две.

Пример из нашей семантики. «Семантическое ядро» и «как собрать семантическое ядро» дают почти одинаковую выдачу - оба запроса ведут на большие руководства. Одна страница, эта самая. А «кластеризация запросов» и «частотность запросов» дают разную первую десятку. Под первым запросом стоят статьи и сервисы разбивки, под вторым - материалы про Wordstat. Это две страницы, даже если обе фразы про семантику.

Три общих адреса в топ-10 - минимальный порог, при котором фразы объединяют. Пять и больше - вопросов не остается. Один-два - разводить.

Намерение важнее темы. Две фразы про одно и то же уходят на разные страницы, если люди за ними хотят разного. «Семантическое ядро» и «семантическое ядро цена» - формально одна тема, а спрос за ними противоположный: по первому ищут ответ, по второму - подрядчика. Отвечают на них разные типы страниц. Под ценовым запросом стоят страницы услуг, под общим - руководства. Намерение читается по тому, что стоит в топе.

Чем разбивают четыре тысячи строк. Сервисы вроде Rush Analytics, Key Collector, Serpstat и Топвизора снимают выдачу по каждой фразе и считают пересечения сами. Мягкий режим объединяет фразы, у которых есть общие адреса с центром группы, жесткий требует пересечения между всеми фразами группы разом.

Это ядро мы разбивали языковой моделью. Очищенный файл ушел в Claude Code, оттуда вернулась черновая группировка с названиями групп. Четыре тысячи строк раскладываются за минуты вместо дня ручной сортировки.

Слабость у модели своя. Она не видит выдачу и группирует фразы по смыслу слов. «Семантическое ядро цена» и «семантическое ядро это» для нее соседние фразы, хотя страницы им нужны разные. Поэтому черновую разбивку проверяют по топу. Спорные пары уходят в поиск, дальше работает правило трех общих адресов. Таких пар набралось несколько десятков, час работы.

Сервисы ошибаются иначе. Они смешивают запросы с разным намерением, если выдача по ним похожа. «Купить» и «отзывы» попадают в одну группу, потому что маркетплейсы стоят и там, и там. Результат зависит от региона съема - разбивки по Москве и по Алматы выйдут разными. А на молодых темах, где выдача не устоялась, пересечения случайны и группы получаются мусорные.

Фразы-сироты. После разбивки остаются одиночные фразы, которые ни в одну группу не вошли - редкие формулировки и опечатки. Их не выбрасывают, но и страниц под них не делают. Они уходят в список правок к существующим текстам: подзаголовок, абзац, пункт FAQ. Часть из них через полгода вырастет в отдельную тему, и тогда вы это увидите на следующем пересборе.

Когда группе не нужна своя страница. Смотреть надо на сумму частот группы, а не на отдельную фразу. Двадцать фраз по 20-50 показов дают в сумме больше, чем одиночный запрос с частотой 300. Универсального порога здесь нет. В узкой нише группа на сотню показов стоит отдельной страницы, в конкурентной такая же группа не окупит текста. Сравнивают внутри своего ядра. Если группа на порядок слабее соседних, ей место разделом внутри родственной статьи.

Карта страниц: что должно получиться на выходе

Файл со списком фраз результатом не считается. Работа заканчивается таблицей, где у каждой группы есть адрес.

Достаточно шести колонок:

  • группа - название по смыслу, человеческими словами
  • опорная фраза группы - та, что уйдет в заголовок и title
  • суммарная частота группы, с пометкой источника
  • тип запроса - информационный, коммерческий или навигационный
  • URL - адрес страницы, существующей или будущей
  • статус - опубликована, черновик, нет страницы

Строка выглядит так. Группа «сбор семантики», опорная фраза «семантическое ядро», частота 3 929 по Wordstat, тип информационный, адрес /blog/seo-i-geo/semanticheskoe-yadro-kak-sobrat, статус - черновик.

Тип запроса определяет формат страницы. Информационный требует статьи с разбором, коммерческий - страницы услуги с ценой и формой, навигационный вы уже выкинули на чистке.

Порядок, в котором закрывают группы:

  1. Сначала группы, где спрос есть, а страницы нет. Это чистый недобор трафика, и закрывается он быстрее всего
  2. Потом группы, где страница есть, но слабая - тонкий текст или чужой заголовок. Переписать существующее дешевле, чем создать новое
  3. В конце - группы с низкой суммарной частотой, которые пойдут разделами внутрь уже написанных статей

Дальше по каждой группе работа расходится на три задачи. Заголовок и описание страницы пишут под опорную фразу - про title и description есть отдельный материал, а если текст пишете не вы, понадобится ТЗ копирайтеру. Сам текст - что такое SEO-текст и чем он отличается от обычной статьи.

Один адрес - одна группа. Если две группы указывают на один URL, разбивка сделана неправильно, и дальше либо группы объединяют, либо страницы разводят. Дубли в колонке адресов - самая частая ошибка в карте, и заканчивается она конкуренцией собственных страниц.

Карта страниц пригодится и при проверке сайта: сверка структуры с ядром входит в чек-лист SEO-аудита отдельным пунктом.

Как ядро стареет и когда пересобирать

Спрос меняется в обе стороны, и наш сбор показывает это на дистанции в полгода.

Растет все, что связано с заданием на текст. За шесть месяцев «тз для копирайтера» вырос вдвое, «сео текст пример» - в 1,8 раза. Падает все, что про продвижение как услугу: минус 57% у запроса про продвижение в Яндексе, минус 43% у «продвижение сайта в google», минус 45% у «продвижение с оплатой за трафик».

Собранное год назад ядро этих сдвигов не содержит. Вы продолжаете писать по плану, составленному под спрос, которого больше нет.

Пример из работы. Интернет-магазин спортивной обуви, ядро годовой давности. Пересбор дал два результата. Первый - десятки формулировок, под которые не было ни одной страницы. Они ушли в план статей. Второй - в группах с готовыми страницами набор фраз сместился, и заголовки пришлось переписывать.

Полный пересбор имеет смысл раз в полгода, сверка с отчетом по запросам в GSC - раз в месяц. Пересбор занимает столько же, сколько первый сбор, сверка - двадцать минут.

Признаки, что пора пересобирать, не дожидаясь календаря:

  • в отчете по запросам появились фразы, которых в ядре нет, и они собирают показы
  • фразы из ядра исчезли из отчета, значит спрос ушел или страница выпала
  • вы запустили новую услугу или направление, которых в прошлом сборе не было
  • сменился рынок - добавилась страна, а с ней другой язык поиска и другая поисковая система

Первый признак срабатывает чаще остальных. Поиск сам приносит формулировки, до которых вы не додумались, и часть новых страниц берется оттуда.

Порядок работы целиком

Весь порядок с числами того сбора, на котором построена статья:

  1. Тридцать опорных запросов, разбитых на три направления по десять
  2. Wordstat в режиме «Топы запросов» - 1 750 строк, три опорных фразы уперлись в лимит двухсот
  3. Keyword Planner, язык русский, «Все местоположения» - 3 709 строк, срез считается за последние шесть месяцев
  4. Свод в один файл с колонкой источника - без смешивания частот
  5. Снятие дублей и чистка по пяти признакам - ушло около 1 300 строк, осталось 4 100
  6. Группировка по выдаче, спорные случаи руками
  7. Карта страниц: группа, опорная фраза, частота, тип, адрес, статус

Полный цикл на трех направлениях занял день работы - с разбивкой моделью и без времени на выгрузку. Руками те же объемы разбирали бы несколько дней.

Частые вопросы

Что такое семантическое ядро простыми словами?

Это список запросов, по которым люди должны находить ваш сайт, разложенный по страницам. Каждая фраза привязана к конкретному адресу, который на нее отвечает. Список без такой привязки ядром еще не считается.

Сколько запросов должно быть в ядре?

Столько, сколько дает спрос в вашей теме после чистки. Для блога по одной теме это тысячи фраз, у нас три направления дали 4 100 рабочих строк. Для сайта услуг с десятью страницами хватит нескольких сотен. Число фраз ничего не говорит о качестве ядра - смотреть надо на то, сколько групп получилось и сколько из них закрыто страницами.

Сколько стоит собрать семантическое ядро?

Отдельной услугой сбор продают редко. Чаще он идет первым этапом ежемесячной работы по продвижению и в счете не выделяется - так работаем и мы. Если ядро все-таки покупают само по себе, цена зависит от того, сколько направлений и рынков в работе и проверяют ли группы по выдаче руками: одно направление с чисткой и разбивкой - работа на день-два, ядро на интернет-магазин с сотнями категорий считается неделями. Разброс на рынке кратный, потому что под одним названием продают и выгрузку из Wordstat без обработки, и готовую карту страниц. Ориентиры по стоимости - в статье сколько стоит SEO-продвижение.

Чем платные сервисы лучше бесплатных?

Бесплатная связка Wordstat и Keyword Planner дает те же частоты, что и платные сервисы, источник данных у всех один. Платите вы за скорость и за съем выдачи. Сервис забирает хвост в обход лимита двухсот фраз, снимает топ-10 по тысячам запросов и группирует автоматически - руками эта работа встанет в несколько дней. На одном направлении разница незаметна, на десяти становится решающей.

Можно ли собрать ядро по конкурентам?

Как дополнение - да, как единственный метод - нет. Выгрузка видимости конкурента показывает, по каким фразам он уже стоит в выдаче, и это хороший источник опорных запросов. Но вы получите копию чужой структуры вместе с чужими ошибками и без того спроса, который конкурент пропустил. Список по конкурентам прогоняют через свой сбор и дополняют им ядро.

Нужно ли ядро для блога или только для коммерческих страниц?

Блогу оно нужнее. У страницы услуги запрос очевиден из названия, ошибиться сложно. Статьи пишут десятками, и без карты они начинают заходить на одни и те же фразы: две публикации про одно, третья на тему без спроса. Ядро для блога решает, о чем писать следующий текст и какой запрос он забирает.

Об авторе

Марат Аксанов, performance‑маркетолог. 12 лет в маркетинге и медиа.

Сертифицированный специалист DV360, Google Ads и Google Analytics.

Заказать аудит вашего проекта или консультацию:

Марат Аксанов, performance-маркетолог