К содержимому
← Все статьи
9 мин чтения

Сбор семантического ядра под Узбекистан: языковые гибриды и две графики

Узбекистан ломает стандартный процесс сбора семантики: один и тот же товар ищут четырьмя способами, а инструменты частотности видят не всё. Разбираем рабочую методику.

Четыре формы одного запроса

Реальный пользователь из Ташкента ищет один и тот же холодильник как «холодильник купить», «muzlatgich narxi», «музлатгич нархи» и гибридом «холодильник narxi». Все четыре формы дают разную выдачу и разную конкуренцию.

Гибриды — не аномалия, а норма разговорной практики: русские существительные с узбекскими служебными словами и наоборот. Инструменты частотности показывают их плохо, потому что нормализаторы запросов пытаются привести фразу к одному языку.

Отсюда первое правило: собирать семантику нужно минимум в трёх проходах — русский, узбекская латиница, узбекская кириллица — и отдельно вручную проверять гибриды через подсказки в поисковой строке.

Источники частотности и их слепые зоны

Яндекс Wordstat с оператором региона даёт числа по Узбекистану, но покрывает преимущественно русскоязычный спрос — узбекская латиница в нём представлена фрагментарно. Числа Wordstat включают все словоформы, поэтому берите точное вхождение в кавычках с восклицательными знаками для реальной оценки.

Google Keyword Planner при выбранном таргетинге на Узбекистан показывает диапазоны, а не точные значения, если нет активной кампании. Диапазон «100–1000» бесполезен для приоритизации, поэтому его используют для проверки наличия спроса, а не для сравнения запросов между собой.

Самый надёжный источник — собственный отчёт «Эффективность» в Search Console с фильтром по стране «Узбекистан» и группировкой по запросам. Он показывает узбекоязычные и гибридные фразы, которых нет ни в одном внешнем инструменте, потому что это реальные показы вашего сайта.

Подсказки и подсветка выдачи

Автоподсказки Google и Яндекса — бесплатный источник живого спроса. Вводите корневое слово на латинице и на кириллице, фиксируйте варианты продолжения. Особенно полезны подсказки с географией: «kir yuvish mashinasi toshkent», «ремонт кондиционеров чиланзар».

Блок «Похожие запросы» внизу выдачи и блок «Люди также спрашивают» дают информационные формулировки, под которые нужны отдельные страницы. Собирайте их вручную по 20–30 корневым словам — автоматизация здесь часто ловит бан по капче.

Обратите внимание на подсветку жирным в сниппетах конкурентов: поисковик подсвечивает слова, которые считает синонимами вашего запроса. Это прямая подсказка, какие формулировки объединять в один кластер, а какие разводить.

Нормализация: приводим четыре формы к одной сущности

После сбора у вас будет несколько тысяч строк, где одна сущность размазана по формам. Нужен словарь соответствий: латиница ↔ кириллица ↔ русский эквивалент. Транслитерация делается скриптом по таблице соответствий узбекского алфавита, но требует ручной вычитки: сочетания o', g', sh, ch дают ошибки при автоматической конверсии.

Суммировать частотности разных форм напрямую нельзя — это разные запросы с разной выдачей. Правильно хранить их как варианты одной сущности с отдельными числами и решать по каждому, нужна ли отдельная посадочная страница или достаточно вхождения в тексте.

Признак того, что нужны разные страницы: выдача по двум формам пересекается меньше чем наполовину. Если в топ-10 стоят те же сайты и те же URL — хватает одной страницы с обоими вариантами в тексте и в alt изображений.

Кластеризация под структуру сайта

Кластеризация по выдаче надёжнее кластеризации по словам. Метод: для каждого запроса выгружается топ-10 URL, запросы объединяются в кластер, если пересечение URL превышает установленный порог — обычно от трёх до пяти общих адресов.

Для Узбекистана порог приходится держать мягче, чем для России: выдача менее устойчива, потому что в нишах мало сильных локальных сайтов и в топе часто оказываются агрегаторы и маркетплейсы. Слишком жёсткий порог даёт сотни микрокластеров по одному запросу.

Итог кластеризации — не список слов, а карта страниц: какой URL закрывает какой кластер, какие страницы нужно создать, какие объединить. Именно этот документ идёт в работу контент-команде.

Частые ошибки при сборе

Первая: собирать семантику только на русском, потому что «все понимают русский». Понимают, но ищут иначе — и вы отдаёте конкурентам весь узбекоязычный мобильный трафик из регионов.

Вторая: включать в ядро запросы с нулевой региональной частотностью ради «объёма ядра». Страница под запрос без спроса — это расход бюджета на контент и лишний повод для каннибализации.

Третья: игнорировать сезонность. Кондиционеры, школьные товары, свадебная тематика в Узбекистане имеют выраженные пики. Wordstat даёт помесячную историю — используйте её для планирования сроков публикации, а не публикуйте всё разом.

Нужен сайт или реклама? Обсудим ваш проект.