Как использовать regex в Google Search Console

Как использовать regex в Google Search Console
David Kaufmann
Уроки SEO

Фильтры regex — самый быстрый способ вытащить из Google Search Console настоящие ответы. Зная пару-тройку шаблонов, вы отделите брендовый трафик от небрендового, соберёте все вопросы, которые люди задают перед тем, как попасть к вам, или выделите одну папку сайта — и всё это без выгрузки хотя бы одной строки.

В этом руководстве — готовые рецепты, которые работают, плюс правила RE2, из-за которых остальные молча ломаются. Всё описанное ниже работает внутри отчёта Performance, никаких дополнений не нужно.

Где в Google Search Console можно использовать regex

Чтобы открыть regex: Performance > Search results > + New filter > выбираете Query или Page > выбираете Custom (regex) в выпадающем списке.

Появляется второй список с вариантами Matches regex и Doesn't match regex. Второй вариант — ваш отрицательный фильтр, и пользоваться им вы будете постоянно.

Где живёт regex в Google Search Console: путь в отчёте Performance от Search results к New filter, затем к Query или Page и к опции Custom regex, а дальше переключатель Matches regex и Doesn't match regex
Regex находится в отчёте Performance в фильтрах Query и Page, с переключателем Matches / Doesn't match

Синтаксис RE2: что Google поддерживает (а что нет)

Google работает на RE2 — собственном движке регулярных выражений. Он быстрый и лишён нескольких возможностей, которых можно было бы ждать от Python или JavaScript. Четыре правила порождают большинство ситуаций «почему это не работает»:

  • Ваш шаблон совпадает в любом месте строки, если вы не поставите якорь ^ (начало) или $ (конец). Поэтому seo совпадёт и с «seo tools», и с «best seo agency».
  • Согласно документации Google, сопоставление не чувствительно к регистру по умолчанию. Поставьте в начало (?-i), если нужен учёт регистра. Данные по запросам и так хранятся в нижнем регистре, поэтому регистр кусается только на URL страниц.
  • Lookahead, lookbehind и обратных ссылок в RE2 нет. Когда рука тянется к отрицательному lookahead, переключите фильтр на Doesn't match regex.
  • GSC ограничивает шаблон примерно 4 096 символами. Если упёрлись в лимит, разделите шаблон на два фильтра, наложенных друг на друга.

Следите за невалидными шаблонами: GSC не показывает синтаксическую ошибку, если regex составлен неправильно. Он просто возвращает ноль результатов — ровно как валидный шаблон без совпадений. Если фильтр вернул пусто, сначала исключите сломанный шаблон.

Четыре правила RE2, о которые спотыкается regex в Google Search Console: ставьте якорь ^ или $, иначе совпадение произойдёт где угодно, сопоставление по умолчанию регистронезависимо, нет lookahead и обратных ссылок, а лимит — примерно 4 096 символов
Четыре правила RE2: якоря, регистронезависимость, отсутствие lookahead и обратных ссылок и лимит в 4 096 символов

Готовые regex-фильтры для GSC

Вставляйте их прямо в фильтр Query или Page. Не забудьте заменить бренд и папки из примеров на свои.

  • Брендовые запросы (Query > Matches regex). Перечислите бренд и то, как его чаще всего пишут с ошибками: seocrawl|seo crawl|seocrawl ai
  • Небрендовые запросы (Query > Doesn't match regex). Тот же самый шаблон, просто переключите фильтр на «Doesn't match». Это и есть настоящая мера вашего органического охвата.
  • Похожие написания бренда (Query > Matches regex). ? делает символ необязательным, поэтому один шаблон ловит сразу несколько опечаток: seo ?crawl|seocrwal|seo crawel|secrawl
  • Запросы-вопросы (Query > Matches regex). Привязано к началу, чтобы получить только запросы, которые начинаются с вопросительного слова: ^(who|what|when|where|why|how|is|are|can|do|does|should)\b
  • Одна папка или путь (Page > Matches regex). Экранируйте точки в своём домене обратным слешем: example\.com/(blog|guides|docs)/
  • Несколько ключевых слов сразу (Query > Matches regex). Вертикальная черта — это обычное ИЛИ: buy|purchase|order|pricing|cost
  • Исключить ненужные слова (Query > Doesn't match regex). Уберите соискателей, любителей халявы или название конкурента: jobs|salary|free|login
  • Длиннохвостые запросы по числу слов (Query > Matches regex). Это совпадает с любым запросом из четырёх слов и более — чистый источник идей для FAQ и контента: \S+(\s+\S+){3,}

Собираем фильтр по шагам: небрендовые вопросы

Допустим, вы хотите посмотреть, как себя чувствует небрендовый трафик из запросов-вопросов.

  • Откройте Performance > Search results и добавьте фильтр Query.
  • Выберите Custom (regex), поставьте Doesn't match regex и вставьте шаблон своего бренда (seocrawl|seo crawl). Примените.
  • Добавьте второй фильтр Query, Matches regex, и вставьте шаблон вопросов (^(who|what|when|where|why|how)\b). Примените.

GSC складывает оба фильтра, так что в таблице теперь только небрендовые вопросы, отсортированные по кликам.

Переключите сортировку на показы — и перед вами спрос, по которому вы ранжируетесь, но почти не получаете кликов, и можно браться за следующую пачку контент-брифов.

Наложение двух фильтров Query в Google Search Console, чтобы выделить небрендовый трафик из вопросов: первый фильтр — Doesn't match regex по шаблону бренда, второй — Matches regex по шаблону вопросительных слов, результат — таблица небрендовых вопросов
Наложите фильтр Doesn't-match по бренду на фильтр Matches по вопросам, чтобы увидеть небрендовые вопросы

Чиним regex, который ничего не находит

Таблица пустая? Вот как это разобрать:

СимптомПочемуКак чинить
Фильтр ничего не возвращает, хотя данные естьВы слишком жёстко привязались якорями: ^how$ совпадает только с одним словом «how»Уберите $, если вам не нужно точное совпадение
Шаблон возвращает ноль строк без ошибкиВы использовали возможность, которой нет в RE2 (lookahead, обратная ссылка), и весь шаблон стал невалиднымПерепишите отрицание как фильтр «Doesn't match regex»
Шаблон, который должен совпадать, не совпадаетСпецсимвол читается буквально: точки, слеши и вопросительные знаки в regex имеют значениеЭкранируйте их обратным слешем
Не появляются запросы с заглавными буквамиДанные по запросам хранятся в нижнем регистреПишите шаблон строчными буквами

Перестаньте набирать regex каждую сессию

Regex в GSC мощный, но он ничего не запоминает. Каждую сессию вы заново набираете тот же шаблон бренда, тот же фильтр вопросов, тот же путь до папки.

GSC даёт regex и фильтры «contains», но не даёт сохранённой таксономии, поэтому большинство команд каждую неделю выгружает данные в таблицу и размечает запросы вручную.

Для команд, которым нужны все запросы в одном месте (а не только то, что влезло в одну сессию), такая группировка уже встроена в SEO-дашборд SEOcrawl AI. Вы навешиваете теги на ключевые слова и страницы поверх своих реальных кликов и показов из Search Console, а затем режете отчёт по любому своему измерению: бренд, тематический кластер, интент, этап воронки.

Тегирование работает тремя способами: вручную, правилами автотегирования, которые классифицируют новые запросы по мере их появления, или прямо из Claude или ChatGPT через MCP SEOcrawl AI.

Теги сохраняются и переиспользуются, поэтому разделение на брендовое и небрендовое, написанное один раз, продолжит работать и в следующем месяце, без перенабора. А поскольку данные приходят из вашего собственного Google Search Console, а не из спарсенной панели, здесь нет ограничения по строкам и нет потолка выгрузки в 1 000 строк.

Search Console забывает ваш regex в момент, когда вы закрываете вкладку. SEOcrawl AI сохраняет те же шаблоны — брендовые и небрендовые, запросы-вопросы, отдельная папка — как переиспользуемые сегменты, поэтому фильтр, собранный однажды, будет на месте и на следующей неделе, без перенабора.

Сохранённые сегменты на основе regex для брендовых и вопросительных запросов в SEOcrawl AI
Брендовое против небрендового: настроено один раз и переиспользуется каждый месяц

Соберите сегмент один раз и переиспользуйте каждый месяц. SEOcrawl AI навешивает теги на ключевые слова и страницы из Search Console, а затем позволяет резать клики и показы по бренду, кластеру или интенту без ограничения по строкам. Попробуйте SEOcrawl AI или посмотрите SEO-дашборд.

Частые вопросы

Поддерживает ли Google Search Console regex?

Да. Отчёт Performance принимает regex в фильтрах Query и Page через опцию Custom (regex) на синтаксисе RE2 от Google. Доступны и Matches regex, и Doesn't match regex, а несколько фильтров можно складывать друг на друга. Фильтры Country, Device и Search Appearance его не поддерживают.

Чувствителен ли regex в Google Search Console к регистру?

Нет, по умолчанию нет. В официальной документации Google сказано, что сопоставление regex в отчёте Performance регистронезависимо, если только вы не поставите в начало (?-i), чтобы включить учёт регистра. Поскольку GSC хранит данные по запросам в нижнем регистре, на практике регистр влияет только на фильтры по URL страниц, так что этот флаг почти никому не нужен.

Как отфильтровать брендовые запросы с помощью regex?

Добавьте фильтр Query, выберите Custom (regex) и перечислите свой бренд и его частые опечатки через вертикальную черту, например seocrawl|seo crawl|seocrwal. Оставьте Matches regex, чтобы увидеть брендовый трафик. Чтобы увидеть всё остальное, примените тот же шаблон с Doesn't match regex.

Почему мой regex ничего не находит?

Обычно причина в одном из четырёх: вы слишком жёстко привязались якорями ^ или $; вы использовали неподдерживаемую возможность вроде lookahead или обратной ссылки, из-за чего весь шаблон становится невалидным и ничего не возвращает; вы не экранировали спецсимвол, например точку или слеш; или вы написали заглавные буквы против данных в нижнем регистре.

Как сохранить свои regex-фильтры, чтобы не набирать их заново при каждом заходе?

В GSC нет функции сохранения, поэтому шаблоны исчезают вместе с сессией. SEOcrawl AI решает это так: вы один раз размечаете и группируете свои ключевые слова из GSC — вручную, правилами автотегирования или через MCP. Затем переиспользуете эти сегменты во всех отчётах. Теги ложатся на ваши собственные данные Search Console, поэтому нет лимита по ключевым словам и не нужно каждую неделю всё пересобирать.

Автор: David Kaufmann

David Kaufmann

Последние 10 с лишним лет я полностью одержим SEO — и, честно говоря, не хотел бы иначе.

Моя карьера вышла на новый уровень, когда я работал старшим SEO-специалистом в Chess.com — одном из ста самых посещаемых сайтов интернета. Работа в таком масштабе: миллионы страниц, десятки языков и одна из самых конкурентных выдач — научила меня тому, чему не научит ни один курс и ни один сертификат. Этот опыт изменил моё представление о том, как выглядит по-настоящему сильное SEO, и лёг в основу всего, что я построил потом.

Из него выросло SEO Alive — агентство для брендов, которые всерьёз занимаются органическим ростом. Мы не продаём дашборды и ежемесячные отчёты. Мы строим стратегии, которые реально двигают цифры, соединяя классическое SEO с новым и захватывающим миром Generative Engine Optimization (GEO): чтобы ваш бренд появлялся не только в синих ссылках Google, но и внутри ответов, которые ChatGPT, Perplexity и Google AI Overviews каждый день выдают миллионам людей.

А поскольку инструмента, который нормально закрывает оба этих мира, я так и не нашёл, я сделал его сам — SEOcrawl AI, платформу SEO-аналитики корпоративного уровня, где в одном месте собраны позиции, технические аудиты, мониторинг ссылок, здоровье краулинга и отслеживание видимости бренда в ИИ. Это та платформа, которой мне всегда не хватало.

→ Читать все статьи автора David
Больше статей от David Kaufmann

Откройте больше материалов этого автора