Семантический SEO-анализ онлайн ключевых слов и смыслов текстов по методу DSSO
SEO анализ текста: что проверяет сервис DSSO.pro
Ранжирующие системы перешли от простого анализа слов на анализ смыслового посыла текстов и составляющих микро-интентов. Проверка текста по DSSO в первую очередь оценивает смысловое наполнение статьи по 60+ параметрам, включая LSI-дополнения, рассчитывая индекс релевантной привлекательности IRAT. Формула его подсчёта напрямую вытекает из того, как мыслят нейросети с помощью векторных LLM-моделей ранжирования. Чего нет у общепризнанных онлайн-сервисов.
Семантический анализ DSSO.pro также работает и с ключевыми словами, оценивая их оптимизацию. Без глубокого понимания того, какие слова и смысловые посылы (интенты) используют потенциальные клиенты для поиска информации в интернете, невозможно эффективно сделать анализ ключевиков и микро-смыслов текстов, чтобы оптимизировать контент для привлечения целевой аудитории на сайт. Анализ отдельных слов, фраз и смысловой семантики по методу DSSO с этим справляется гораздо эффективнее известных онлайн SEO-сервисов. Форма для семантического анализа – ниже.
Частые вопросы про SEO-анализатор DSSO.pro
Что такое индекс IRAT и как он считается?
IRAT (Index of Relevant Attractiveness of Texts) – индекс релевантной привлекательности текста. В отличие от классической тошноты, которая считает процент ключевых слов, IRAT оценивает смысловое наполнение через векторные модели – так, как это делают современные нейросети и LLM-алгоритмы ранжирования. Формула учитывает семантическую плотность, распределение n-грамм и LSI-связей. Ни один другой бесплатный онлайн-сервис не даёт такой оценки. Также не требуется регистрации на нашем сервисе, чтобы начать им бесплатно пользоваться.
Чем DSSO.pro отличается от Advego и Text.ru?
Advego и Text.ru анализируют текст по классическим метрикам: тошнота, водность, частотность ключевых слов. Это полезно, но сегодня уже недостаточно – поисковики давно перешли на семантический анализ. DSSO идёт дальше: рассчитывает индекс IRAT, анализирует n-граммы (биграммы и триграммы), оценивает лексическое разнообразие и смысловую плотность – то есть, смотрит на текст так же, как ранжирующие нейросети поисковых систем.
Какие метрики проверяет анализатор?
Анализатор оценивает текст страницы по большому списку параметров одновременно, основная их часть: смысловая плотность и релевантность, тошнота, водность, лексическое разнообразие, читабельность и естественность распределения слов. Подробное описание каждой метрики – на странице паспорта DSSO.
| Диапазоны тошноты | Классическая тошнота текстов (показатель заспамленности текста) * |
|---|---|
| Отличная (1 - 3) |
Анализ свидетельствует о естественном использовании ключевых слов. Текст воспринимается написанным для людей, а не для поисковиков. Ключевые слова гармонично вплетены в контент, встречаются по мере необходимости, не создают ощущения спама. Такое текстовое содержание даст сайту хорошие поведенческие факторы, что положительно скажется на ранжировании. В SEO ценятся естественность, информативность и решение проблем пользователя, и этот процент соответствует данным критериям.
|
| Хорошая (3 - 5) |
В этом диапазоне контент также остается достаточно естественным. Ключевые слова использованы уверенно, без излишеств. Такой процент может быть обусловлен необходимостью более частого упоминания ключевого слова, например, в технических текстах, обзорах продуктов или статьях, где объект обсуждения естественно повторяется. Для SEO это все еще приемлемый уровень, который позволяет поисковым системам четко понимать тематику страницы, не вызывая подозрений в попытках манипуляции.
|
| Средняя (5 - 7) |
В этом диапазоне текст начинает вызывать некоторые вопросы. Возможно, ключевые слова используются немного более часто необходимого. Написанное может граничить с небольшой переоптимизацией, особенно если одинаковые словоформы основных ключевых слов встречаются и так не редко. Для поисковых систем это может быть сигналом к более внимательной оценке контента на предмет его ценности. Пользователь может начать замечать повторения, что ухудшает читабельность и поведенческие факторы. В сегодняшних реалиях SEO, где акцент делается на качестве и уникальности, такой процент уже не является идеальным.
|
| Плохая (более 7) |
Этот диапазон однозначно указывает на переоптимизацию и спам ключевыми словами. Такое текстовое содержание неприятно для чтения, что гарантированно ведет к плохим поведенческим факторам – быстрый отказ, меньшее время на странице, возможно, сайт будет наказан поисковыми системами. Google и Yandex активно борются с таким контентом, применяя санкции, которые приводят к значительному падению позиций или исключению страницы из индекса.
|
|
* - такие показатели тошноты текста являются нормой для текстов литературной направленности. Для текстов технического склада цифровые показатели тошноты, в зависимости от содержания, могут быть увеличены в полтора-два раза, считаясь нормой. Формула подсчёта классической тошноты не учитывает объём контента, поэтому этот показатель необъективен. Например, контент объёмом 1500 знаков с показателем 7 будет перенасыщен «ключами», а статья на 15000 знаков не будет. Соответственно, оценка классической тошноты более применима для относительного сравнения SEO-оптимизации текстов примерно одного объёма, а не для оценки конкретного текста самого по себе. В любом случае максимальный цифровой показатель классической тошноты, являющийся нормой, должен быть не более 7. |
|
| Диапазоны тошноты | Академическая тошнота текстов (общий показатель качества) * |
|---|---|
| Отличная (0% - 3%) |
Максимальное количество повторений самого часто используемого слова с его словоформами не превышает разумных пределов. Текст воспринимается естественно, легко, ключевые слова не "выпирают", читабельность на высоте. Идеальный показатель для большинства видов контента.
|
| Хорошая (3% - 5%) |
Максимальное количество повторений самого частотного слова и его словоформ находится по прежнему в диапазоне нормы. Это вполне приемлемый и нормальный показатель. Ключевые слова используются достаточно, чтобы раскрыть тему и быть релевантными, и их присутствие в таком количестве не утомляет читателя.
|
| Средняя (5% - 7%) |
Максимальное количество повторений наиболее частотного слова и его словоформ находится в заметном диапазоне числа раз. На таком уровне повторы ключевых слов становятся заметными. Читателю может быть сложнее воспринимать написанное, возникать ощущение монотонности. Требуется анализ и, возможно, редактирование для улучшения плавности изложения.
|
| Плохая (более 7%) |
Максимальное количество повторений самого частотного слова и его словоформ начинает превышать нормальные и разумные пределы - тревожный показатель, который указывает на высокую степень "неестественности" текста. Написанное, скорее всего, трудно читать, что выглядит "переспамно", раньше такие тексты назывались, написанными для ботов. На сегодня такое также смотрится негативно, плохо воспринимаясь поисковыми системами. Необходима серьёзная переработка.
|
| * - такие показатели тошноты текста являются нормой для текстов литературной направленности. Для текстов технического склада цифровые показатели тошноты, в зависимости от содержания, могут быть увеличены в полтора-два раза, считаясь нормой. | |
| Диапазоны разнообразия | Лексическое разнообразие текста (показатель числа дублей слов в тексте) * |
|---|---|
| Плохая (0 - 0.5) |
Контент с очень низким лексическим разнообразием. Характеризуется сильным повторением одних и тех же слов. Может указывать на бедность словарного запаса, монотонность, или избыточный спам одинаковыми ключевыми словами, при условии, что эти ключевые слова являются значимыми. Такое часто трудно читать и воспринимать.
|
| Средняя (0.5 - 0.7) |
Лексическое разнообразие на среднем уровне. Слова повторяются, но не настолько часто, чтобы контент был совсем нечитаемым. Такое встречается в текстах, где определённые термины или концепции часто упоминаются. Есть потенциал для улучшения, например, за счёт использования синонимов или перефразирования.
|
| Хорошая (0.7 - 0.9) |
Достойный уровень лексического разнообразия. Написанное читается легко, слова повторяются и дублируются умеренно. Присуще качественным, хорошо структурированным текстам, где автор старается избегать избыточных повторов. Это часто является хорошим целевым диапазоном для большинства типов контента.
|
| Отличная (0.9 - 1) |
Текстовый анализ говорит, что он имеет высокое лексическое разнообразие. Каждое значимое слово используется редко или преимущественно лишь раз. Что может быть характерно для художественных текстов, высокоинформативных статей, где каждая фраза несёт новую информацию, или текстов, которые были тщательно отредактированы для максимальной уникальности слов. В некоторых случаях (очень редко) может указывать на то, что текст слишком "разбавлен" новыми словами без достаточного акцента на ключевых понятиях, но это скорее исключение. В подавляющем большинстве случаев это признак высококачественного и разнообразного контента.
|
| * - такие показатели лексического разнообразия текста являются нормой для текстов литературной направленности. Для текстов технического склада цифровые показатели разнообразия, в зависимости от содержания, могут быть уменьшены в полтора-два раза, считаясь нормой. | |
| Диапазоны водности | Водность текстов (показатель величины изобилия стоп-слов) |
|---|---|
| Отличная (до 30%) |
Анализ текста говорит, что он максимально насыщен информацией. Каждое предложение несет важный смысл, минимум "лишних" слов и оборотов. Читается легко и быстро, без потери времени на продирание сквозь "воду". Такие тексты очень ценны не только для литературного стиля, но для экспертных статей, инструкций, технических описаний. Нюанс: иногда, при сильном стремлении к низкой водности, контент может стать слишком сухим и сложно воспринимаемым для обычного читателя, тут важен баланс.
|
| Хорошая (30% - 45%) |
Имеется сбалансированный текст. Он информативен, но при этом достаточно читабелен и не кажется слишком сухим. Это оптимальный диапазон для большинства типов контента: блоговых статей, описаний товаров, информационных материалов. Здесь есть место для связующих фраз, но они не являются избыточными.
|
| Средняя (45% - 60%) |
Водность выше среднего. Текст содержит повышенное количество "пустых" фраз и стоп-слов, канцеляризмов или общих расхожих выражений. Читатель может начать испытывать дискомфорт, информационная плотность снижается. Такой контент, возможно, требует редактуры для улучшения качества и повышения эффективности.
|
| Плохая (более 60%) |
Крайне высокая водность. Контент переполнен "водой", очень много общих фраз, вводных конструкций, повторов, которые не добавляют смысла. Данный контент будет скучен, сложно воспринимаем и мало ценен как для пользователей, так для поисковых систем. Он однозначно требует серьезной переработки (сокращения, перефразирования, добавления конкретики).
|
| Диапазоны индекса | Индекс удобочитаемости Флеша (Flesch Reading Ease) * |
|---|---|
| Индекс очень низкий (0 - 29) |
Очень сложный текст, как правило, используемый в научной или специальной технической литературе. Понимание требует хороших экспертных знаний в данной области. Нужно отлично знать терминологию и тематику, применяемую в тексте.
|
| Индекс ниже среднего (30 - 49) |
Текст сложен для восприятия, использует специализированную терминологию и сложную структуру предложений. Требует высшего образования или соответствующего знания для понимания. Или нужно быть очень начитанным, отменно разбираясь в теме.
|
| Индекс выше среднего (50 - 59) |
Контент более сложный, чем средне-типовой, он требует более высокого уровня образования или некоторых специализированных знаний. Подходит для студентов образованием уровня колледжей или начальных лет ВУЗ-ов.
|
| Индекс хороший (60 - 69) |
Текст достаточно прост, но требует немного больше внимания. Возможно, появляются специальные термины. Условная категория - 10-11 класс. Многие неразвлекательные статьи, общеобразовательные журналы, книги с тематикой, не требующей особых спецзнаний попадают в эту категорию.
|
| Индекс отличный (70 - 79) |
Стандартный уровень сложности для широкой аудитории на любые общие темы. Условная категория - 8-9 класс. Тексты такого уровня подходят для большинства взрослых читателей.
|
| Индекс высокий (80 – 89) |
Легкий и простой для чтения текст, понимаемый большинством людей. Условная категория - 5-7 класс. Газетные общетематические статьи, легкая художественная литература, обычно, находятся в этом диапазоне.
|
| Индекс очень высокий (90 – 100) |
Контент чрезвычайно легок для понимания. Подходит для аудитории младших классов, примерно от уровня 4 класса и младше. Это уровень комиксов, простых рассказов для детей начальных классов, лёгкого чтива, сказок, маленьких рассказов, стихотворений для детворы.
|
| * - индекс удобочитаемости Флеша оценивает читабельность текста по шкале в диапазоне 0 - 100. Разные диапазоны соответствуют разным уровням сложности для условных целевых аудиторий. Для правильных показателей нужно, чтобы в тексте было минимум 100 слов. | |
| Диапазоны индекса | Индекс восприятия информации Колман-Лиау (Coleman-Liau index) * |
|---|---|
| «Визионер» (17 и выше) |
Контент для восприятия человеком типа «Лидер мысли», формирующий будущее и целые области. Он обладает уникальным видением и способностью вдохновлять других на инновации. Академические работы, узкоспециализированные научные труды, тяжелый юридический язык (законы, судебные акты), «канцелярит» и аналогичное.
|
| «Мастер» (13 - 16) |
Текст для восприятия человеком типа «Признанный эксперт» с выдающимися достижениями. Способным разрабатывать новые методы и подходы, вести исследовательскую деятельность. Это научно-популярные статьи, специальное профильное обучение (вуз), сложные инструкции и т.д.
|
| «Эксперт» (9 - 12) |
Контент для восприятия человеком типа «Эксперт». Специалист, который обладает глубоким пониманием своей области и способен решать сложные задачи. Может выступать в качестве консультанта и наставника для других.
|
| «Компетентный» (6 - 8) |
Текст для восприятия человеком типа «Компетентный». Он способен самостоятельно решать задачи средней сложности. Уверенно применяет знания и навыки, может вносить небольшой вклад в улучшение процессов.
|
| «Практикующий» (4 - 5) |
Контент для восприятия человеком типа «Практикующий». Такой человек способен выполнять базовые задачи под руководством. Обладает некоторым опытом и пониманием основных процессов, но нуждается в дальнейшем развитии.
|
| «Начинающий» (2 – 3) |
Текст для восприятия человеком типа «Начинающий». У него присутствует теоретическое понимание основ или был краткий опыт работы. Обучение все еще ведется, необходима помощь и наставничество.
|
| «Полный новичок» (0 - 1) |
Контент для восприятия человеком типа «Полный новичок». Человек не имеет никакого формального или практического опыта в данной области. Знания отсутствуют, требуется базовое ознакомление с концепциями.
|
| * - индекс Колман-Лиау (CLI) оценивает лёгкость восприятия, человеком смысла текста, понимая суть написанного. Разные диапазоны соответствуют разным уровням сложности для условных целевых аудиторий. Для правильных показателей нужно, чтобы в тексте было минимум 100 слов. | |
Анализ текста по закону Ципфа |
|---|
|
Классический анализ текста по закону Ципфа – это метод оценки естественности текста, который определяет закономерность расположения слов. Согласно этому закону, частота употребления слов обратно пропорциональна их рангу. Суть закона: самое часто используемое слово (общее число словоформ), которому присваивают первый ранг, в тексте должно встречается примерно вдвое чаще, чем второе по частоте, в три раза чаще, чем третье и так далее. Оценка текста по закону Ципфа – не самодостаточная и абсолютная, но далеко не лишняя. Для общего ранжирования имеет значение качество контента, страницы в целом, есть ли ответ на то, что ищет пользователь, скорость загрузки, ссылочная масса, авторитет ресурса и многое другое. Для правильного SEO все слова на графике, идущие после ключевых слов, прямо или косвенно, должны быть из категории LSI-слов (Latent Semantic Indexing) – это семантически связанные смыслом термины. Чем такие слова ближе к началу графика, тем релевантность текста поисковому запросу (ключевым словам) выше. |
