Анализ сайта webdatacommons.org
Основное Готовность: 35%
Домен
webdatacommons.org
Состояние доменного имени
?
Проверяем корректность доменного имени и наличие технических проблем на уровне домена.
Длина домена велика. Но если вы продвигаете запрос, входящий в название домена, то это хорошо.
Домен второго уровня идеален для продвижения.
Ответ сервера
200 Успешный ответ
HTTP-код ответа и цепочка редиректов
?
Код 200 — страница доступна. Коды 3xx — редиректы (цепочки замедляют загрузку и размывают ссылочный вес). Коды 4xx/5xx — ошибки, поисковик не сможет проиндексировать страницу.
Сервер настроен корректно.
Безопасность
Сайт небезопасен
Использование HTTPS и SSL-сертификат
?
HTTPS — обязательный стандарт. Google и Яндекс отдают предпочтение защищённым сайтам. Отсутствие SSL или просроченный сертификат ведут к предупреждениям в браузере и снижению позиций.
На сайте не найден защищенный протокол ssl и сайт не открывается по https!
Не настроен HSTS (Strict-Transport-Security) — рекомендуется включить.
Поздравляем! Сайт не содержится в реестре РКН.
Кодировка
utf-8
Кодировка символов страницы
?
Стандарт — UTF-8. Неправильная кодировка вызывает нечитаемые символы и мешает поисковику корректно распознать текст страницы.
Указана кодировка на странице utf-8.
Язык
Атрибут lang в HTML-теге
?
Атрибут lang (<html lang="ru">) сообщает поисковикам и браузерам, на каком языке написана страница. Помогает при ранжировании в региональном поиске.
Язык страницы не указан. Рекомендуется явно указать язык документа!
Скорость загрузки
~0,23сек
Время отклика сервера (TTFB)
?
Time To First Byte — время до получения первого байта от сервера. Норма до 200 мс. Медленный отклик ухудшает пользовательский опыт и ранжирование: Яндекс и Google учитывают скорость страниц.
Скорость загрузки сайта 0,23сек оптимальна.
Объем документа
31Кб
Размер HTML-кода страницы
?
Слишком большой HTML замедляет парсинг браузером и сканирование поисковым роботом. Рекомендуется не более 200 Кб.
Объем html-документа 31Кб оптимален.
Структура html-документа корректна.
Ресурсы
Ресурсы: 2
Внешние ресурсы страницы (CSS, JS, изображения)
?
Количество и тип подключённых ресурсов влияют на скорость загрузки. Большое число запросов увеличивает время рендеринга страницы.
Кол-во файлов ресурсов 2 достаточно.
Показать полный список ресурсов
| Тип | Название | Значение |
|---|---|---|
| stylesheet | text/css | style.css |
| js | text/javascript | http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js |
Серверные заголовки
Кол-во: 5
HTTP-заголовки ответа сервера
?
Заголовки сервера передают браузеру и поисковику служебную информацию: кеширование, безопасность (CSP, HSTS), сжатие (gzip). Правильная настройка ускоряет загрузку и повышает защищённость.
Найдены серверные заголовки 5шт. Подробнее про серверные заголовки.
Показать полный список серверных заголовков
| Ключ | Значение |
|---|---|
| Server | nginx/1.14.1 |
| Date | Mon, 24 Aug 2026 16:27:47 GMT |
| Connection | keep-alive |
| ETag | "6784dbb4-7e98" |
| Accept-Ranges | bytes |
CMS
Не определена
Система управления сайтом (движок)
?
CMS — это движок, на котором работает сайт (WordPress, 1C-Bitrix, Tilda и др.). Знание CMS помогает понять возможности SEO-оптимизации и подобрать подходящие инструменты. «Не определена» — вероятно, самописный сайт или нестандартная сборка.
CMS не определена. Вероятно, сайт самописный либо движок надёжно скрыт. Это не ошибка.
Веб-сервер
Программное обеспечение сервера
?
Веб-сервер — это ПО, которое отдаёт страницы посетителям (nginx, Apache, IIS, LiteSpeed и др.). Определяется по серверным заголовкам ответа (Server, X-Powered-By и т.п.). «Не определён» — сервер намеренно скрывает эти заголовки, это нормальная практика безопасности.
Сайт работает на веб-сервере nginx.
Мета-теги Готовность: 17%
Title
Web Data Commons
Заголовок страницы в браузере и поисковой выдаче
?
Title — главный SEO-заголовок страницы. Влияет на CTR в поиске и ранжирование. Оптимальная длина: 50–70 символов. Ключевые слова — ближе к началу.
Необходимо увеличить число символов в title (текущее значение мало: 16, минимум: 25, оптимально: от 40 до 45)
Дублей словоформ в title не найдено.
Description
Описание страницы в поисковой выдаче (сниппет)
?
Meta Description — текст под заголовком в выдаче. Напрямую на позиции не влияет, но влияет на CTR. Оптимальная длина: 120–160 символов.
Установите мета-тег description!
Keywords
Список ключевых слов страницы (устаревший тег)
?
Meta Keywords не учитывается Яндексом и Google для ранжирования с 2009–2012 годов. Заполнение не обязательно, но не вредит. Конкурент может использовать содержимое для анализа.
Установите мета-тег keywords!
Канонический Url
Указывает поисковику основную версию страницы
?
Canonical (rel=canonical) предотвращает проблему дублей страниц. Должен точно совпадать с URL проверяемой страницы. Неправильный canonical может передать ссылочный вес на другую страницу.
Рекомендуем прописать канонический Url.
Robots
Ошибок нет
Директивы для поисковых роботов на уровне страницы
?
Meta Robots управляет индексацией конкретной страницы: index/noindex — индексировать ли, follow/nofollow — следовать ли по ссылкам. Noindex полностью исключает страницу из поиска.
Meta-тег robots не указан. Страница свободна для индексации.
Адаптивность
Настройка масштабирования на мобильных устройствах
?
Тег viewport (<meta name="viewport">) сообщает браузеру, как масштабировать страницу на мобильных. Стандарт: width=device-width, initial-scale=1. Отсутствие — признак отсутствия мобильной версии.
Meta-тег viewport не указан. Страница не адаптивная.
Разметка OpenGraph
Не найдено
Мета-теги для красивых превью в соцсетях
?
OpenGraph (og:title, og:description, og:image) управляет тем, как страница выглядит при репосте в социальных сетях и мессенджерах. Отсутствие OG-тегов — невзрачный превью при шеринге.
Разметка OpenGraph не задана. Страница не оптимизирована под социальные сети. Мета-теги с разметкой Og помогают социальным роботам лучше структурировать Ваш сайт.
Все мета-теги
Кол-во: 0
Полный список мета-тегов страницы
?
Таблица всех meta-тегов, включая нестандартные. Позволяет найти опечатки, дубли и лишние теги.
Мета-теги не найдены. Без них роботы и устройства действуют по умолчанию (не всегда это хорошо).
Оптимизация Готовность: 82%
Структура
Ошибок нет
Семантические HTML-элементы страницы
?
Проверяет наличие основных структурных элементов: nav, header, footer, main. Корректная семантическая структура помогает поисковику понять архитектуру страницы.
Структура документа корректна (теги <html> и <body> присутствуют в одном экземпляре).
Контент
Ошибок нет
Объём и качество текстового содержимого
?
Анализирует объём полезного текста на странице. Слишком мало — страница может считаться малополезной. Слишком много — ухудшается читаемость и восприятие.
Слова из title 3 встречаются в тексте достаточно.
Абзацев с текстом 11 достаточно.
Среднее число слов в абзаце 143 достаточно.
Кол-во знаков контента 14166 на странице оптимально.
Кол-во слов 2165 на странице оптимально.
Заголовки
Ошибок нет
Иерархия заголовков H1–H6
?
H1 должен быть один и содержать ключевой запрос. H2–H6 описывают подразделы. Пропуск уровней (H1 → H3) и несколько H1 — типичные ошибки, снижающие понятность страницы для поисковика.
На странице присутствуют заголовки <h1> 1. Это прекрасно.
На странице присутствуют заголовки <h2> 7. Это хорошо.
На странице присутствуют заголовки <h3> 5.
Тошнота
5,92
Насколько одно слово доминирует в тексте
?
Классическая тошнота = √(частота самого повторяющегося слова). Норма до 7–8: текст воспринимается естественно. Выше — поисковик может счесть страницу переспамленной.
Тошнота превышает норму 5. Измените текст страницы!
Академич. тошнота
24,20%
Насколько текст перенасыщен ключевыми словами
?
Академическая тошнота = (частота слова / общее количество слов) × 100%. Показывает долю конкретного слова в тексте. Норма 5–15%.
Академическая тошнота превышает норму 5-15%. Измените текст страницы!
Семантическое ядро
20
Наиболее часто встречающиеся слова на странице
?
Топ слов по частоте использования. Показывает, какие слова доминируют в тексте с точки зрения поисковика.
Контент страницы содержит осмысленный текст и слова.
Показать список слов
| Слово | Кол-во | Частота |
|---|---|---|
| corpus | 35 | 1,62% |
| product | 31 | 1,43% |
| released | 27 | 1,25% |
| microdata | 27 | 1,25% |
| extracted | 26 | 1,20% |
| common | 25 | 1,15% |
| microformat | 18 | 0,83% |
| tables | 18 | 0,83% |
| schema | 16 | 0,74% |
| commons | 14 | 0,65% |
| available | 14 | 0,65% |
| project | 13 | 0,60% |
| json-ld | 11 | 0,51% |
| matching | 11 | 0,51% |
| download | 10 | 0,46% |
| embedded | 10 | 0,46% |
| extraction | 10 | 0,46% |
| conference | 10 | 0,46% |
| version | 10 | 0,46% |
| standard | 10 | 0,46% |
Индексация Готовность: 30%
Индексирование
Ошибок нет
Разрешено ли индексирование страницы
?
Проверяет, не закрыта ли страница от индексации через robots.txt, meta robots или X-Robots-Tag. Страница, закрытая от индексации, не появится в поисковой выдаче.
Анкоров на странице 109 оптимально. Поисковые роботы обязательно проиндексируют сайт.
Robots.txt
Найден корректный robots.txt
Файл управления сканированием сайта роботами
?
Robots.txt указывает поисковым роботам, какие страницы сканировать, а какие — нет. Ошибки в файле могут случайно закрыть важные разделы от индексации.
Robots.txt настроен корректно. Размер файла: 23 байт. Загружен за: 0сек.
Проверяемая страница не запрещена в robots.txt.
Robots.txt доступен по постоянному адресу
Показать содержимое robots.txt
User-agent: *
Allow: /
Sitemap
Кол-во: 0
XML-карта сайта для поисковиков
?
Sitemap.xml помогает поисковику быстрее находить и индексировать страницы. Особенно важен для крупных сайтов и новых страниц, на которые ещё нет входящих ссылок.
Robots.txt не содержит ссылку на карту сайта. Рекомендуется добавить карту сайта и указать ссылку на нее в robots.txt.
Внутренние ссылки
Кол-во: 42
Ссылки на другие страницы своего сайта
?
Внутренние ссылки распределяют ссылочный вес между страницами и помогают поисковику обходить сайт. Пустые анкоры и ссылки на запрещённые robots.txt страницы — типичные ошибки.
Внутренних ссылок на странице 42 оптимально.
Внутренние ссылки не запрещены к индексации в robots.txt.
Показать внутренние ссылки
| Url | Анкор | Состояние | Анализировать |
|---|---|---|---|
| /structureddata/2024-12/stats/schema_org_subsets.html |
schema.org class-specific subsets
|
|
Анализировать url |
| /structureddata/schemaorgtables/2023/index.html |
Schema.org Table
Corpus 2023
|
|
Анализировать url |
| /structureddata/2023-12/stats/schema_org_subsets.html |
schema.org
class-specific subsets
|
|
Анализировать url |
| /../largescaleproductcorpus/wdc-block/ |
WDC Block
|
|
Анализировать url |
| /structureddata/2022-12/stats/schema_org_subsets.html |
schema.org
class-specific subsets
|
|
Анализировать url |
| /largescaleproductcorpus/wdc-products/ |
WDC Products
|
|
Анализировать url |
| /structureddata/sotab/ |
Schema.org
Table Annotation Benchmark
|
|
Анализировать url |
| /structureddata/2021-12/stats/schema_org_subsets.html |
schema.org
class-specific subsets
|
|
Анализировать url |
| /largescaleproductcorpus/v2020/index.html |
WDC Product Data Corpus
V.2020
|
|
Анализировать url |
| /2020-12/stats/schema_org_subsets.html |
December 2020 WDC schema.org Product and Offer
subsets
|
|
Анализировать url |
| /structureddata/schemaorgtables/ |
Schema.org Table Corpus
|
|
Анализировать url |
| /2020-12/stats/schema_org_subsets.html |
schema.org class-specific subsets
|
|
Анализировать url |
| /structureddata/2020-12/stats/stats.html |
RDFa,
Microdata, Microformat, and
Embedded JSON-LD
|
|
Анализировать url |
| /largescaleproductcorpus/v2/index.html |
Version 2.0
|
|
Анализировать url |
| /largescaleproductcorpus/v2/index.html |
Version 2.0
|
|
Анализировать url |
| /largescaleproductcorpus/v2/index.html |
WDC
Product Data Corpus and Gold Standard V2.0
|
|
Анализировать url |
| /structureddata/2019-12/stats/stats.html |
RDFa,
Microdata, Microformat, and
Embedded JSON-LD
|
|
Анализировать url |
| /largescaleproductcorpus/v2/index.html |
Version
2.0
|
|
Анализировать url |
| /T4LTE/ |
Web Tables for Long-Tail Entity Extraction
(T4LTE)
|
|
Анализировать url |
| /TDGT/ |
Time-Dependent Ground Truth (TDGT)
|
|
Анализировать url |
| /largescaleproductcorpus\papers\Bizer2019_Article_UsingTheSemanticWebAsASourceOf.pdf |
Using the
Semantic Web as a Source of Training Data
|
|
|
| /structureddata/2018-12/stats/stats.html |
RDFa, Microdata, Microformat, and Embedded
JSON-LD
|
|
Анализировать url |
| /largescaleproductcorpus/index.html |
WDC Training Dataset and Gold
Standard for Large-Scale Product Matching
|
|
Анализировать url |
| /structureddata/2017-12/stats/stats.html |
RDFa, Microdata, Microformat, and Embedded
JSON-LD
|
|
Анализировать url |
| /structureddata/2016-10/stats/stats.html |
RDFa, Microdata, Microformat, and Embedded
JSON-LD
|
|
Анализировать url |
| /productcorpus/index.html |
Gold Standard for Product
Matching and Product Feature Extraction
|
|
Анализировать url |
| /isadb/index.html |
web-scale "IsA" database
|
|
Анализировать url |
| /webtables/goldstandard.html |
T2D Gold Standard
|
|
Анализировать url |
| /structureddata/2013-11/stats/schema_org_subsets.html |
Class-Specific Subsets of the Schema.org
Data contained in the Winter 2013 Microdata Corpus
|
|
Анализировать url |
| /framework/index.html |
WDC
Extraction Framework
|
|
Анализировать url |
| /webtables/index.html |
WDC
Web Tables
|
|
Анализировать url |
| /hyperlinkgraph/index.html |
WDC Hyperlink
Graph
|
|
Анализировать url |
| /hyperlinkgraph/index.html |
Hyperlink
Graph
|
|
Анализировать url |
| /structureddata/2012-08/stats/microdata_products_detail.html |
types of products that are
offered by e-shops using Microdata markup
|
|
Анализировать url |
| /structureddata/vocabulary-usage-analysis/index.html |
new
analysis on vocabulary usage
|
|
Анализировать url |
| /structureddata/index.html |
<span itemprop="name">RDFa, Microdata, and Microformat</span>
|
|
Анализировать url |
| /webtables/index.html |
<span itemprop="name">Web Tables</span>
|
|
Анализировать url |
| /hyperlinkgraph/index.html |
<span itemprop="name">Hyperlink Graph</span>
|
|
Анализировать url |
| /isadb/index.html |
<span itemprop="name">WebIsA Database</span>
|
|
Анализировать url |
| /productcorpus/index.html |
first corpus
|
|
Анализировать url |
| /largescaleproductcorpus/index.html |
second corpus
|
|
Анализировать url |
| /framework/index.html |
Extraction Framework
|
|
Анализировать url |
Внешние ссылки
Кол-во: 48
Ссылки на сторонние сайты
?
Исходящие внешние ссылки передают часть ссылочного веса на чужие сайты. Ссылки на авторитетные ресурсы безопасны; ссылки на мусорные сайты могут навредить репутации страницы.
Внешних ссылок на странице 48 слишком много. Спрячьте лишние ссылки в тег noindex или атрибут rel='nofollow'!
На странице присутствуют ссылки на субдомены 2.
Показать внешние ссылки
| Url | Анкор | Анализировать |
|---|---|---|
| commoncrawl.org |
Common
Crawl
|
Анализировать url |
| uni-mannheim.de |
Improving
Hierarchical Product Classification using Domain-specific Language Modelling
|
Анализировать url |
| km-ecomm-www.github.io |
Knowledge Management in e-Commerce workshop
|
Анализировать url |
| www2021.thewebconf.org |
The Web Conference 2021
|
Анализировать url |
| data.dws.informatik.uni-mannheim.de |
Intermediate
Training of BERT for Product Matching
|
Анализировать url |
| di2kg.inf.uniroma3.it |
DI2KG workshop
|
Анализировать url |
| vldb2020.org |
VLDB2020
|
Анализировать url |
| data.dws.informatik.uni-mannheim.de |
Using
schema.org Annotations for Training and Maintaining Product Matchers
|
Анализировать url |
| wims2020.sigappfr.org |
WIMS2020
|
Анализировать url |
| wikicfp.com |
CfP
|
Анализировать url |
| ir-ischool-uos.github.io |
Semantic Web Challenge
|
Анализировать url |
| iswc2020.semanticweb.org |
ISWC2020
|
Анализировать url |
| springer.com |
Datenbank-Spektrum
Journal
|
Анализировать url |
| dl.acm.org |
The WDC training
dataset and gold standard for large-scale product matching
|
Анализировать url |
| sites.google.com |
ECNLP Workshop
|
Анализировать url |
| www2019.thewebconf.org |
WWW2019
|
Анализировать url |
| github.com |
Web Data
Integration Framework (WInte.r)
|
Анализировать url |
| wim.uni-mannheim.de |
Profiling
the Potential of Web Tables for Augmenting Cross-domain Knowledge Bases
|
Анализировать url |
| www2016.ca |
WWW'16
|
Анализировать url |
| github.com |
Yahoo GitHub repository
|
Анализировать url |
| yahoolabs.tumblr.com |
Yahoo
tumblr posting
|
Анализировать url |
| webscience-journal.net |
The Graph Structure in the Web -
Analyzed on Different Aggregation Levels
|
Анализировать url |
| webscience-journal.net |
Journal of Web
Science
|
Анализировать url |
| wim.uni-mannheim.de |
Heuristics
for Fixing Common Errors in Deployed schema.org Microdata
|
Анализировать url |
| 2015.eswc-conferences.org |
ESWC2015
|
Анализировать url |
| blog.commoncrawl.org |
guest
post
|
Анализировать url |
| iswc2014.semanticweb.org |
ISWC'14
|
Анализировать url |
| uni-mannheim.de |
The WebDataCommons Microdata, RDFa and Microformat Dataset Series
|
Анализировать url |
| websci14.org |
WebSci'14
|
Анализировать url |
| uni-mannheim.de |
Graph Structure in the Web - Aggregated by Pay-Level Domain
|
Анализировать url |
| uni-mannheim.de |
Graph
Structure in the Web - Revisited
|
Анализировать url |
| uni-mannheim.de |
Integrating Product Data from Websites offering Microdata Markup
|
Анализировать url |
| uni-mannheim.de |
Deployment of RDFa, Microdata, and Microformats on the Web -- A Quantitative
Analysis
|
Анализировать url |
| groups.google.com |
Details
|
Анализировать url |
| aws.amazon.com |
AWS Summit 2012 Berlin
|
Анализировать url |
| slideshare.net |
Slides
|
Анализировать url |
| aws.amazon.com |
Amazon EC2 cloud services
|
Анализировать url |
| apache.org |
Apache Software License
|
Анализировать url |
| groups.google.com |
Web Data
Commons mailing list
|
Анализировать url |
| groups.google.com |
Web Data Commons Google
Group
|
Анализировать url |
| dws.informatik.uni-mannheim.de |
<span itemprop="subOrganization" itemscope="" itemtype="http://schema.org/Organization"><span itemprop="name">Data and Web Science Research Group</span></span>
|
Анализировать url |
| dws.informatik.uni-mannheim.de |
<span itemprop="accountablePerson">Christian Bizer</span>
|
Анализировать url |
| planet-data.eu |
PlanetData
|
Анализировать url |
| lod2.eu |
LOD2
|
Анализировать url |
| aws.amazon.com |
Amazon Web Services in
Education Grant Award
|
Анализировать url |
| dfg.de |
German Research Foundation (DFG)
|
Анализировать url |
| alwr-bw.de |
ViCe
|
Анализировать url |
| mwk.baden-wuerttemberg.de |
Ministry of Economy, Research and Arts of Baden
- Württemberg
|
Анализировать url |
Конкуренты Готовность: 0%
Конкуренты в Яндексе
Кол-во: 0
Топ сайтов-конкурентов в Яндексе
?
Сайты, чаще всего появляющиеся в ТОПе Яндекса по запросам из семантического ядра этой страницы.
Мы не нашли у вас конкурентов в Яндексе. Сайт или очень молодой или плохо продвигается.
Конкурентов в ТОП-10 Яндекса не нашлось.
Конкуренты в Google
Кол-во: 0
Топ сайтов-конкурентов в Google
?
Сайты, чаще всего появляющиеся в ТОПе Google по запросам из семантического ядра этой страницы.
Конкуренты в Google тоже не найдены. Займитесь продвижением сайта!
Конкурентов в ТОП-10 Google не нашлось.
ЗоЗПП: права потребителей Готовность: 100%
Нарушения
Не выявлены
Признаков дистанционной продажи товаров (интернет-магазина) не обнаружено — требования ЗоЗПП о раскрытии информации продавца к сайту не применяются. Нарушений нет.
ФЗ-149: рекомендательные технологии Готовность: 100%
Нарушения
Не выявлены
Рекомендательные блоки («с этим покупают», «похожие товары» и т.п.) на сайте не обнаружены — требования ст. 10.7 ФЗ-149 к сайту не применяются. Нарушений нет.
ФЗ-38: реклама Готовность: 100%
Нарушения
Не выявлены
Рекламных тематик с обязательными оговорками (медицина, БАД, кредиты и займы, новостройки) на сайте не обнаружено. Нарушений нет.
ФЗ-436: защита детей Готовность: 100%
Нарушения
Не выявлены
Признаков информационной продукции (новости, видео, книги, игры, курсы) не обнаружено — обязательная возрастная маркировка по ФЗ-436 сайту не требуется. Нарушений нет.
Вердикт
Выполнен подробный анализ сайта webdatacommons.org: готовность на 41%. Чтобы выполнить все условия и попасть на первую страницу выдачи поисковых систем требуется:
Постарайтесь исправить общие ошибки.
Исправьте ошибки в мета-тегах.
Исправьте ошибки индексации.
Поделитесь с друзьями: