Семантическое ядро: как собрать, кластеризовать и превратить в структуру
Семантическое ядро — это полный список запросов, по которым вас могут искать, разбитый на группы. Собирают его не с Вордстата, а с конкурентов: сначала смотрят, по каким запросам они стоят в топе, потом расширяют этот список и кластеризуют. И только из кластеров получаются страницы — а не наоборот.
Ниже — порядок работы целиком, с живыми вопросами из чата сообщества и с данными о том, какими инструментами специалисты пользуются на самом деле: мы посчитали упоминания по 30 124 сообщениям за январь 2023 — сентябрь 2026.
Главное правило, с которого всё начинается
Самая частая ошибка новичка выглядит так: взяли список страниц сайта и под каждую подобрали ключи. В чате сообщества это сформулировали короче и точнее:
«Для каждого свой кластер, причём не кластер под страницу, а страницы создаются на основе кластеров: может, их нужно будет больше, или наоборот — некоторые страницы надо объединить, если они отвечают на один кластер. А семантика — это общий список всех ключей проекта».
Из этого следует весь порядок работы. Сначала выясняем, что и как люди спрашивают. Потом группируем. И только потом решаем, сколько у сайта должно быть страниц и каких.
Порядок: не начинайте с Вордстата
Вопрос из чата, который задаёт структуру этой статьи: «Правильно ли я понимаю, что просто идти в Вордстат и искать ключи — гиблое дело?»
Да, в большинстве случаев. Вордстат отвечает на вопрос «сколько людей ищут вот эту фразу», но не отвечает на вопрос «какие фразы вообще существуют в моей нише и какие из них приводят деньги». Разумный порядок другой:
- Понять бизнес. Что продаём, кому, в каких городах, какие есть ограничения — доставка, лицензии, сегменты.
- Отобрать конкурентов, которые уже в топе по основным запросам, и выгрузить их видимость: по каким запросам они ранжируются и какие у них посадочные.
- Посмотреть, как у них устроена структура: меню, фильтры, теги, хабы. Это и есть подсказка, какие кластеры существуют в нише.
- Собрать маски — короткие базовые фразы, от которых потом расширяется ядро.
- Расширить через Вордстат, поисковые подсказки и выгрузки конкурентов.
- Почистить от мусора.
- Кластеризовать и проверить кластеры руками.
- Спроектировать структуру страниц и перелинковку.
- Внедрить: заголовки, тексты, товары, шаблоны.
Шаги 2 и 3 — то, что отличает рабочее ядро от списка фраз. Конкуренты уже оплатили гипотезы своими деньгами, и их выдача показывает, какие запросы вообще формируют спрос.
Где брать запросы
| Источник | Что даёт | Чем осторожничать |
|---|---|---|
| Вордстат | Частотность и расширение по маскам | Показывает спрос, но не структуру ниши |
| Поисковые подсказки | Живые формулировки, в том числе новые | Подмешан навигационный и случайный шум |
| Видимость конкурентов | Готовые кластеры и посадочные | Конкурент тоже может ошибаться |
| Вебмастер и Search Console | Запросы, по которым вас УЖЕ находят | Только то, где вы уже видимы |
| Внутренний поиск сайта | Чего люди не нашли у вас | Нужен счётчик поиска и трафик |
| Отдел продаж и чаты | Слова клиентов, которых нет в выгрузках | Не всегда есть частотность |
| Отзывы и форумы | Проблемные формулировки, боли | Длинный хвост с нулевой частотой |
Отдельно про последние три строки: именно там находятся формулировки, которых нет ни у одного конкурента. Это самый дешёвый способ получить страницы без конкуренции — и самый игнорируемый.
Частотность: три числа вместо одного
Путаница здесь стоит целых проектов. В Вордстате одно и то же словосочетание даёт разные числа в зависимости от того, как его записать:
- Базовая частотность —
ремонт холодильников. Сумма всех запросов, где встречаются эти слова в любых формах и с любыми добавками. Самое большое и самое обманчивое число. - Фразовая —
"ремонт холодильников". Только эта фраза со всеми словоформами, без лишних слов. - Точная —
"!ремонт !холодильников". Ровно в этой форме.
Разница между базовой и точной в коммерческих нишах легко бывает десятикратной. Планировать работу по базовой — верный способ пообещать клиенту трафик, которого нет.
Что ещё важно:
Регион. Частотность по России и по вашему городу — разные величины, и выбор зависит от того, где вы продаёте. Если городов несколько, региональность настраивается отдельно.
Сезонность. Смотреть историю запроса, а не срез за месяц: «купить ёлку» в июне и в декабре — это два разных бизнеса.
Накрученная частотность. В конкурентных нишах встречаются запросы с искусственно раздутыми числами — их парсят сервисами для позиций. Признак: высокая частотность при пустой или странной выдаче.
Чистка: что выбрасывать
Минусация — скучная часть, которая экономит потом месяцы. Типовые списки, которые идут в минус почти всегда:
- другие города и регионы, если вы там не работаете;
- «бесплатно», «скачать», «своими руками» — если вы продаёте услугу;
- «б/у», «запчасти», «ремонт» — если вы продаёте новое;
- «вакансии», «работа», «зарплата» — если вы не нанимаете;
- «отзывы сотрудников», «как устроиться»;
- бренды конкурентов, если вы не делаете страницу сравнения осознанно;
- порнография, спам и случайные омонимы: «тёрка» бывает кухонная и музыкальная.
Пример из чата, который показывает жанр: в запросе на семантолога формулировали задачу так — «жёсткая минусация: инфо, б/у, запчасти» и дальше по списку ниши. Это нормальный объём работы на базе в сто тысяч фраз.
Отдельно — неявные дубли: «ремонт стиральных машин» и «стиральных машин ремонт» это одно и то же, а вот «ремонт стиральной машины» и «ремонт стиральных машин» алгоритм кластеризации может развести, хотя страница нужна одна.
Кластеризация: как группировать
Смысл кластеризации — не в том, чтобы разложить фразы по папкам «логично», а в том, чтобы понять, что поисковик считает одним и тем же запросом. Делается это по выдаче: если по двум фразам в топ-10 совпадает несколько адресов, значит, поисковик считает их одной задачей, и одной страницей на них отвечать можно.
Два режима, которые вы встретите в любом сервисе:
- Hard — все фразы кластера должны пересекаться по выдаче друг с другом. Кластеры получаются мелкими и надёжными.
- Soft — достаточно пересечения с центральной фразой. Кластеры крупнее, но внутрь попадает лишнее.
Порог — сколько общих адресов считать достаточным. Обычно 3–5 для топ-10. Выше порог — чище кластеры и больше страниц, ниже — наоборот.
Что делать после машины: смотреть глазами. Алгоритм не знает вашего бизнеса. Он разведёт «купить диван» и «диван купить», если выдача дрогнула, и объединит два разных товара, если их продают одни и те же агрегаторы.
Из кластеров — в структуру
Самый ценный шаг, который чаще всего пропускают.
- Каждому кластеру — своя задача пользователя. Выпишите её словами: «человек хочет узнать цену», «человек выбирает между двумя вариантами», «человек готов заказать».
- Решите, где эта задача закрывается. Существующей страницей, новой посадочной, фильтром каталога, статьёй.
- Объедините кластеры, которые отвечают на одно. Две страницы под один интент будут конкурировать между собой, и поисковик сам выберет, какую показывать, — ровно как с дублями.
- Проверьте интент по выдаче. Если по запросу в топе статьи, коммерческая страница туда не попадёт, сколько её ни оптимизируй. И наоборот.
- Решите, что делать с фильтрами. Сочетания «товар + параметр», по которым есть спрос, превращаются в посадочные; остальные закрываются от индексирования.
- Нарисуйте перелинковку: из хаба в кластеры, между соседними кластерами, обратно в хаб.
Правило объёма: страниц должно быть столько, сколько у вас есть что сказать. Тысяча страниц под тысячу кластеров, на которых нет ничего кроме заголовка, — это не структура, а заявка на «малополезный контент» из списка нарушений Яндекса.
Чем пользуются на самом деле
Здесь обычно идёт список из двадцати сервисов, половиной которых автор не пользовался. Мы посчитали иначе: взяли архив чата сообщества — 30 124 сообщения с января 2023 по сентябрь 2026 — и посмотрели, какие инструменты специалисты упоминают в рабочих разговорах. Считали и число упоминаний, и число разных людей.
| Инструмент | Упоминаний | Разных людей | Из них в 2026 |
|---|---|---|---|
| Ahrefs | 163 | 94 | 36 |
| Топвизор | 113 | 70 | 20 |
| Вордстат | 101 | 63 | 16 |
| Key Collector | 91 | 58 | 12 |
| Semrush | 71 | 51 | 18 |
| Инструменты Арсенкина | 58 | 36 | 6 |
| Keys.so | 38 | 28 | 10 |
| Мутаген | 42 | 23 | 9 |
| Мегаиндекс | 40 | 22 | 1 |
| Пиксель Тулс | 22 | 19 | 5 |
| Букварикс | 19 | 16 | 2 |
| KeyAssort | 12 | 8 | 3 |
| Just-Magic | 8 | 7 | 1 |
Это не рейтинг качества: упоминание может быть и рекомендацией, и жалобой. Но картина читается.
Key Collector жив, но уже не единственный. В чате про него спрашивают прямо: «правильно ли я понимаю, что для сбора СЯ уже не используют KeyCollector, а пользуются KeyAssort? Он же пару лет как перестал парсить Вордстат». Ответ сообщества был коротким: тратить деньги на Key Collector не обязательно, у XMLRiver есть бесплатная программа. В цифрах то же самое: 58 человек за всё время, но только 12 упоминаний в 2026 году.
Мегаиндекс практически ушёл из разговоров: 22 человека за всё время и одно упоминание за 2026 год.
Зарубежные сервисы держатся вопреки ожиданиям: Ahrefs — самый упоминаемый инструмент в выборке.
Вывод для работы: набор инструментов меняется, а порядок действий — нет. Собрать маски, расширить, почистить, кластеризовать по выдаче, проверить руками можно любым сочетанием сервисов, включая бесплатные.
Если спроса почти нет
Живой вопрос из чата: «Я создаю сервис для инвесторов и трейдеров, он уникален для СНГ. Если мало ключевых слов по Вордстату с нормальной частотностью — я не смогу подняться в поиске?»
Ответы, которые там прозвучали, стоит привести целиком, потому что они точнее любого учебника:
- мало ключей не значит «не подняться»: это значит, что аудитория будет меньше, а продвижение в узкой теме часто проще;
- если спрос не сформирован, вопрос не в SEO, а в том, стоит ли вообще выбирать этот канал: иногда дешевле идти другими;
- и при этом всю целевую семантику всё равно нужно собрать, кластеризовать, продумать структуру посадочных и реализовать их.
Добавлю от себя: там, где спроса на продукт ещё нет, он почти всегда есть на проблему. Люди не ищут ваш сервис по названию категории, которой не существует, но ищут то, что болит. Эти запросы и становятся ядром.
И обратная сторона — низкочастотные запросы недооценивают. В чате вспоминали показательный случай: шестизначная прибыль пришла с запроса «шкафы купе по индивидуальным размерам», а высокочастотные «шкафы купе» едва дотянули до сотни тысяч.
Чек-лист
- Выписать бизнес-ограничения: что продаём, где, кому, чего не делаем.
- Отобрать пять-десять конкурентов из топа и выгрузить их запросы и структуру.
- Собрать маски, расширить через Вордстат и подсказки.
- Снять фразовую и точную частотность, а не только базовую.
- Почистить по минус-словам, убрать неявные дубли.
- Кластеризовать по выдаче, выбрать режим и порог осознанно.
- Проверить кластеры руками, объединить то, что отвечает на один интент.
- Проверить интент по выдаче: коммерция или информация.
- Спроектировать страницы и перелинковку, а не «подобрать ключи к страницам».
- Решить, что делать с фильтрами и сочетаниями.
- Зафиксировать, какие страницы создаются, какие объединяются и какие закрываются.
- Через два-три месяца свериться с Вебмастером: по каким запросам вас стали находить, и дополнить ядро ими.
Частые вопросы
С чего начинать сбор семантического ядра?
Не с Вордстата. Сначала — бизнес-ограничения и конкуренты: по каким запросам в топе стоят те, кто уже решил эту задачу, и как устроены их посадочные. Из этого получаются маски, и только потом идёт расширение через Вордстат и подсказки, чистка и кластеризация.
Чем базовая частотность отличается от точной?
Базовая (ремонт холодильников) считает все запросы, где встречаются эти слова в любых формах и с любыми добавками. Фразовая ("ремонт холодильников") — только эту фразу со словоформами. Точная ("!ремонт !холодильников") — ровно эту форму. Разница между базовой и точной в коммерческих нишах бывает десятикратной, поэтому планировать по базовой нельзя.
Что такое кластеризация и зачем она нужна?
Это группировка запросов по тому, считает ли их поисковик одной задачей. Проверяется по выдаче: если в топ-10 по двум фразам совпадает несколько адресов, на них можно отвечать одной страницей. Без кластеризации получается либо десять страниц под один интент, которые конкурируют между собой, либо одна страница под десять разных задач.
Hard или soft кластеризация?
Hard требует, чтобы все фразы кластера пересекались по выдаче друг с другом — кластеры мелкие и надёжные. Soft достаточно пересечения с центральной фразой — кластеры крупнее, но внутрь попадает лишнее. Для коммерческих проектов обычно берут hard с порогом 3–5 и дальше смотрят глазами.
Сколько запросов должно быть в ядре?
Правильный ответ — столько, сколько есть в нише, а не «чем больше, тем лучше». Ядро на сто тысяч фраз для небольшого сайта услуг чаще всего означает, что в него не глядя насыпали чужих городов, информационных запросов и мусора. Ценность измеряется не размером файла, а количеством задач пользователя, которые вы закрыли страницами.
Можно ли собрать семантику бесплатно?
Можно. Вордстат, поисковые подсказки, Вебмастер и Search Console дают основу, у XMLRiver есть бесплатная программа, часть инструментов Арсенкина работает без оплаты. Платные сервисы экономят время и дают видимость конкурентов — но порядок действий они не меняют.
Нужен ли Key Collector в 2026 году?
Не обязательно. В нашем чате на прямой вопрос «тратить ли деньги на Key Collector, если он давно не парсит Вордстат» ответили, что тратить не надо, и предложили бесплатную программу XMLRiver. По упоминаниям видно то же: за всё время о нём писали 58 человек, но в 2026 году — всего 12 упоминаний.
Что делать, если по моей теме почти нет запросов?
Проверить, не сформулирована ли потребность другими словами: люди ищут проблему, а не название новой категории. Если спроса действительно нет, SEO просто не ваш основной канал — и это нормальный вывод, а не поражение. Узкая тема при этом продвигается проще, потому что в ней меньше конкурентов.
Как понять, коммерческий запрос или информационный?
Посмотреть выдачу. Если в топ-10 статьи и ответы — запрос информационный, и страница услуги туда не попадёт, сколько её ни оптимизируй. Если карточки, каталоги и страницы услуг — коммерческий. Смешанная выдача означает, что место есть и для того, и для другого.
Нужно ли собирать семантику под нейросети отдельно?
Нет. Генеративные ответы в Яндексе и Google строятся на обычной выдаче, и отдельного «ядра под ИИ» не существует. Что меняется — формулировки: люди задают нейросети полные вопросы, поэтому в ядро стоит добавлять вопросительные формы и отвечать на них заголовками. Подробнее — в разборе ответов нейросетей.
Как часто обновлять ядро?
Раз в квартал сверяться с Вебмастером и Search Console: по каким запросам вас уже находят, каких нет в ядре, где показы есть, а кликов нет. Плюс внеочередной пересбор, когда меняется ассортимент, появляется новая услуга или заметно меняется выдача в нише.
Одна страница — один кластер?
Почти: страницы создаются на основе кластеров, но соответствие не всегда один к одному. Два кластера, отвечающих на одну задачу, объединяют в одну страницу; широкий кластер иногда разбивают на несколько. Решение принимается по интенту и по выдаче, а не по тому, сколько строк получилось в файле.
Что делать с запросами, по которым нет страницы и не будет?
Если спрос реальный, а страницу делать нечем — это сигнал к ассортименту или услугам, а не к SEO. Если спрос нецелевой, он уходит в минус-слова. Худший вариант — создать страницу ради запроса и оставить её пустой: такие страницы и попадают под определение малополезного контента.
Сколько времени занимает сбор ядра?
Для сайта услуг с десятком направлений — несколько дней вместе с кластеризацией и проверкой. Для интернет-магазина с большим каталогом — недели, и основная часть времени уходит не на сбор, а на чистку и проверку кластеров руками. Автоматический сбор без ручной проверки экономит дни и стоит месяцев.
Спросите в чате сообщества
Самое интересное всплывает в обсуждении: в чате отвечают практикующие специалисты, те, кто занимается продвижением каждый день. Приносите свои случаи и спорьте — вступление бесплатное, в том числе для заказчиков.