Массовая проверка частотности: почему один CSV даёт несопоставимые цифры

Массовую проверку частотности больше не обязательно строить на ручном вводе фраз или стороннем сборщике: у Яндекс Вордстата действует официальный API, а Планировщик ключевых слов Google принимает списки из CSV. Однако выгрузить две колонки и сравнить их построчно недостаточно — сервисы по-разному определяют период, соответствие фразы и состав учитываемых запросов.
Практический результат должен быть не просто таблицей с числами, а воспроизводимым срезом: поисковая система, регион, устройство, период и правило соответствия фиксируются для каждой строки. Именно это отличает массовую проверку спроса от быстрого сбора несопоставимых показателей.
Что изменилось в массовой проверке Wordstat
Главное обновление по сравнению со старыми инструкциями — появление официального канала автоматизации. В сообщении Яндекса об открытии API от 9 июня 2025 года перечислены доступные данные: частотность, популярные и похожие формулировки, динамика интереса, а также срезы по регионам, устройствам и периодам. Компания также указала, что результаты можно выгружать для сводных отчётов.
Это не означает, что Wordstat принимает произвольный файл и одним действием возвращает готовое семантическое ядро. API позволяет программе последовательно отправлять фразы, получать структурированный ответ и собирать общую таблицу. Очистка списка, контроль дублей, выбор регионов и интерпретация значений остаются отдельными этапами.
Сначала определите, какую частотность нужно получить
До загрузки списка зафиксируйте единицу анализа. Фраза без операторов может охватывать запросы с дополнительными словами, тогда как более строгое условие отвечает на другой вопрос. Поэтому широкое значение нельзя молча подменять точным и использовать оба показателя в одной колонке.
Для каждой задачи полезно заранее определить пять параметров:
- поисковую систему — Яндекс или Google, поскольку их показатели не являются общей рыночной статистикой;
- территорию — страну, область или город, а не неопределённый регион продвижения;
- период — последние 30 дней, отдельные месяцы либо среднее значение;
- устройства — все устройства вместе или отдельный срез по компьютерам, телефонам и планшетам;
- правило соответствия — какие словоформы, дополнения и близкие варианты входят в значение.
Если хотя бы один параметр меняется, создайте отдельную колонку или отдельную выгрузку. Например, спрос по России и спрос по одному городу нельзя складывать, если городской показатель уже входит в общероссийский. Аналогично среднее за год не следует ставить в один временной ряд с числом запросов за последние 30 дней.
Как собрать список через API Wordstat
Для регулярной проверки подготовьте таблицу с исходной фразой, её уникальным идентификатором, регионом и типом устройства. Перед отправкой удалите полные дубли, приведите пробелы к единому виду и сохраните исходное написание в отдельной колонке: это позволит вернуть результат к нужной странице или товарной категории.
Действующая документация API Wordstat описывает четыре метода: дерево регионов, популярные запросы, динамику и региональное распределение. Метод topRequests возвращает сведения за последние 30 дней и число запросов для фраз, содержащих заданное ключевое слово; dynamics строит дневные, недельные или месячные ряды; regions показывает распределение по территориям. Запросы передаются методом POST в формате JSON, а устройство можно задавать как компьютер, телефон, планшет или все устройства.
Массовый сценарий строится как очередь: программа берёт фразу, добавляет идентификаторы регионов и устройства, отправляет запрос, сохраняет ответ и переходит к следующей строке. При ошибке лимита строка не должна исчезать — её следует пометить для повторной попытки после указанного сервером интервала. Документация предупреждает об общей и персональной квотах, включая ограничения на число обращений в секунду и за день, но не публикует на этой странице универсального числового лимита; поэтому скорость нельзя задавать по чужому устаревшему значению.
Для разовой небольшой работы интерфейс Wordstat может быть проще разработки интеграции. API оправдан, когда один и тот же набор нужно перепроверять по расписанию, разбивать по регионам или устройствам либо соединять с каталогом. Доступ требует Яндекс ID, OAuth-токена, регистрации ClientId и заявки на подключение, поэтому этот путь необходимо заложить в процесс заранее.
Как обработать список в Планировщике Google
В Google Ads откройте Планировщик ключевых слов и выберите получение объёма поиска и прогнозов. Список можно вставить в поле или загрузить из CSV; для простого файла Google требует одну колонку с заголовком Keyword. До запуска проверьте выбранные территорию, язык и поисковую сеть.
Здесь особенно важно не смешивать исторический спрос с рекламным прогнозом. Справка Google о показателях Планировщика определяет среднее число запросов как среднее по выбранному диапазону, территории и сети с учётом близких вариантов; по умолчанию используется период в 12 месяцев. Google отдельно предупреждает, что значения округляются, а историческая статистика и прогноз показов рассчитываются по разным правилам: прогноз дополнительно зависит от ставки, бюджета, сезонности и прежнего качества рекламы.
Поэтому для оценки поискового спроса выгружайте именно исторический показатель среднего числа запросов, а прогнозные показы, клики и стоимость храните отдельно. Если задача связана с сезонным товаром, среднего за год мало: просмотрите помесячную динамику и не отбрасывайте фразу только из-за невысокого годового среднего.
Рабочий порядок для сотен и тысяч фраз
- Соберите исходный список и присвойте каждой строке постоянный идентификатор. Не объединяйте разные намерения пользователя только из-за похожего написания.
- Удалите точные дубли, пустые строки, адреса страниц и служебные пометки. Варианты с разным порядком слов пока сохраните: их объединение зависит от правил конкретного сервиса.
- Разделите сбор по поисковым системам. Для каждой партии запишите регион, период, устройство и режим соответствия.
- Получите результаты и сохраните необработанный ответ отдельно от рабочей таблицы. Это позволит проверить преобразования без повторного обращения к сервису.
- Отметьте строки без данных, ошибки авторизации и превышение квоты разными статусами. Нулевое или отсутствующее значение нельзя автоматически считать доказательством полного отсутствия спроса.
- Проверьте выборку вручную: несколько популярных, средних и редких фраз. Если одна и та же настройка дала необъяснимо разные форматы или периоды, исправьте сбор до кластеризации всего массива.
Как свести результаты без ложной точности
В итоговой таблице оставьте исходную фразу, нормализованный вариант, систему, территорию, устройство, период, тип показателя, значение и дату получения. Названия колонок «частота» недостаточно: читатель файла через месяц не поймёт, относится ли число к последним 30 дням, среднему за год или рекламному прогнозу.
Не складывайте показатели Яндекса и Google в якобы общий объём рынка. Один человек может пользоваться обеими системами, а сами платформы используют разные правила агрегации; простая сумма создаст показатель без подтверждаемой методики. Для приоритизации безопаснее сравнивать фразы внутри одного источника и одного набора настроек.
Абсолютное число также не определяет ценность страницы. После проверки частотности список нужно разделить по намерению пользователя, сезонности и географии, а затем сопоставить с существующими и планируемыми страницами. Высокий показатель у широкой формулировки может скрывать несколько разных задач, тогда как менее частотная конкретная фраза точнее описывает нужный товар или действие.
Для разового списка подходит CSV в Планировщике Google и ручная проверка небольшой выборки в Wordstat. Для повторяющихся отчётов и многочисленных региональных срезов рациональнее официальный API Wordstat с журналом ошибок и контролем квот. В обоих случаях качество результата определяется не скоростью выгрузки, а тем, сохранены ли рядом с каждым числом условия его получения.
Читайте также:
Подпишитесь на рассылку
Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.