LSI
Также: LSI-фразы, Latent Semantic Indexing
LSI (LSI-фразы) — термин из SEO-жаргона, обозначающий тематически связанные слова и словосочетания на странице. Google официально LSI не использует, но связанная семантика реально влияет на релевантность.
Как работает
Название пришло из алгоритма Latent Semantic Indexing (LSA) — метода 1980-х годов для анализа связей между словами через математическое разложение матриц слово-документ. К современному Google этот конкретный алгоритм отношения не имеет: Джон Мюллер и другие представители Google Search неоднократно подтверждали в блоге и на конференциях, что «LSI» как фактор ранжирования не существует.
Что реально работает — современные модели языка: BERT (с 2019 года), MUM (с 2021), последующие обновления. Они анализируют контекст фразы через окружающие слова: страница про «яблочный пирог» с упоминаниями теста, духовки, корицы, начинки понимается алгоритмом как рецепт, а страница про «Apple Pie» с упоминаниями iOS и iPad — как обзор функции iPhone.
В SEO-практике под LSI-фразами обычно понимают именно такие тематически близкие слова, которые нужно естественно включить в текст. Собирают их из подсказок Wordstat, «Похожих запросов» Google, разделов «Люди также спрашивают», блоков «Похожие товары» в выдаче. Формально это не LSA, но название прижилось.
Пример для страницы «Электрический чайник»:
- рабочие термины: мощность, объём, материал корпуса, автоотключение
- сопутствующие: накипь, фильтр, температура, чашка чая
- поведенческие: купить, доставка, отзывы, цена
Почему важно для SEO
Google и Яндекс оценивают, насколько полно страница раскрывает тему запроса. Текст «Купить электрический чайник» без слова «мощность», «объём», «фильтр» алгоритмически выглядит поверхностным — как заглушка под ключевик, а не как контентная страница.
Правильный набор тематических фраз даёт два эффекта. Прежде всего — рост позиций по основному запросу за счёт лучшей семантической полноты. Плюс попадание в топ по десяткам вторичных запросов из длинного хвоста, которые пользователь формулирует не так, как основной ключ.
Google Search Central в документации о качественном контенте описывает это как «топикальную релевантность» и «глубину охвата темы». Прямых упоминаний LSI там нет — но принцип тот же, что seo-специалисты называют работой с LSI-фразами.
Проверим весь сайт?
Пара минут — и увидите отчёт по каждой странице.
Проверить сайтЧастые ошибки
- Список LSI-фраз механически впихнут в конец текста через запятую — Google распознаёт это как переспам и понижает страницу.
- Собраны нерелевантные фразы: для «купить чайник» добавлены «ремонт чайников» и «схема чайника».
- Перепутаны LSI-фразы и синонимы основного ключа — они делают разную работу.
- Список собран один раз при создании страницы и не обновляется годами — тематика поиска сдвигается.
- LSI-фразы вписаны только в один абзац, а не распределены по всему тексту — Google оценивает контекст в пределах смысловых блоков.
- Взяли готовый LSI-словарь из seo-сервиса без проверки — там часто мусорные слова из парных запросов.
Как проверить
Google Trends и «Похожие запросы» на странице выдачи — базовый источник тематических фраз. Wordstat в разделе «Что ещё искали пользователи» — то же самое для Яндекса. SEO-сервисы Ahrefs, Serpstat, Key Collector собирают LSI-фразы автоматически, но требуют ручной чистки от мусора.
SEO Crawler при обходе анализирует текстовое содержимое каждой страницы и сравнивает его с тематикой запросов, по которым страница уже получает трафик из GSC/Вебмастера. В отчёте это блок «Семантика» — с указанием, каких тематических фраз не хватает на странице для полного раскрытия темы.
Вывод
LSI как алгоритма у Google нет — это устоявшееся название для тематически связанных фраз. Что реально работает — полнота раскрытия темы через естественный набор сопутствующих терминов: рабочих понятий, вторичных запросов, поведенческих слов. Собирайте фразы из выдачи и подсказок, распределяйте по тексту, не сваливайте в мусорный список внизу страницы.
Проверим весь сайт?
Пара минут — и увидите отчёт по каждой странице.
Проверить сайт