Анализ сайта mainlp.github.io
Основное Готовность: 75%
Домен
mainlp.github.io
Состояние доменного имени
?
Проверяем корректность доменного имени и наличие технических проблем на уровне домена.
Используйте для продвижения только домен второго уровня.
Длина домена велика. Но если вы продвигаете запрос, входящий в название домена, то это хорошо.
Ответ сервера
200 Успешный ответ
HTTP-код ответа и цепочка редиректов
?
Код 200 — страница доступна. Коды 3xx — редиректы (цепочки замедляют загрузку и размывают ссылочный вес). Коды 4xx/5xx — ошибки, поисковик не сможет проиндексировать страницу.
Сервер настроен корректно.
Цепочка редиректов:
http://mainlp.github.io
301 MovedPermanently
https://mainlp.github.io/
200 OK
Безопасность
Сайт безопасен
Использование HTTPS и SSL-сертификат
?
HTTPS — обязательный стандарт. Google и Яндекс отдают предпочтение защищённым сайтам. Отсутствие SSL или просроченный сертификат ведут к предупреждениям в браузере и снижению позиций.
На сайте работает защищенный протокол ssl и сайт открывается по https.
Ssl-сертификат действителен до 09.01.2027 2:59:59.
Включён HSTS (Strict-Transport-Security) — защита от подмены на http.
HTTP автоматически перенаправляется на HTTPS.
Поздравляем! Сайт не содержится в реестре РКН.
Кодировка
utf-8
Кодировка символов страницы
?
Стандарт — UTF-8. Неправильная кодировка вызывает нечитаемые символы и мешает поисковику корректно распознать текст страницы.
Указана кодировка на странице utf-8.
Язык
en
Атрибут lang в HTML-теге
?
Атрибут lang (<html lang="ru">) сообщает поисковикам и браузерам, на каком языке написана страница. Помогает при ранжировании в региональном поиске.
Язык документа указан явно: en.
Скорость загрузки
~0,40сек
Время отклика сервера (TTFB)
?
Time To First Byte — время до получения первого байта от сервера. Норма до 200 мс. Медленный отклик ухудшает пользовательский опыт и ранжирование: Яндекс и Google учитывают скорость страниц.
Скорость загрузки сайта 0,40сек оптимальна.
Объем документа
32Кб
Размер HTML-кода страницы
?
Слишком большой HTML замедляет парсинг браузером и сканирование поисковым роботом. Рекомендуется не более 200 Кб.
Объем html-документа 32Кб оптимален.
Структура html-документа корректна.
Ресурсы
Ресурсы: 13
Внешние ресурсы страницы (CSS, JS, изображения)
?
Количество и тип подключённых ресурсов влияют на скорость загрузки. Большое число запросов увеличивает время рендеринга страницы.
Кол-во файлов ресурсов 13 много для одной страницы. Приемлемо до 10. Проведите оптимизацию файлов ресурсов!
Показать полный список ресурсов
| Тип | Название | Значение |
|---|---|---|
| stylesheet | https://cdn.jsdelivr.net/npm/bootstrap@4.6.1/dist/css/bootstrap.min.css | |
| stylesheet | https://cdn.jsdelivr.net/npm/mdbootstrap@4.20.0/css/mdb.min.css | |
| stylesheet | /assets/fontawesome/css/fontawesome.css | |
| stylesheet | /assets/fontawesome/css/brands.css | |
| stylesheet | /assets/fontawesome/css/regular.css | |
| stylesheet | /assets/fontawesome/css/solid.css | |
| stylesheet | text/css | https://fonts.googleapis.com/css?family=Roboto:300,400,500,700|Roboto+Slab:100,300,400,500,700|Material+Icons |
| stylesheet | https://cdn.jsdelivr.net/gh/jwarby/jekyll-pygments-themes@master/github.css | |
| stylesheet | /assets/css/main.css | |
| js | https://cdn.jsdelivr.net/npm/jquery@3.6.0/dist/jquery.min.js | |
| js | https://cdn.jsdelivr.net/npm/bootstrap@4.6.1/dist/js/bootstrap.bundle.min.js | |
| js | https://cdn.jsdelivr.net/npm/mdbootstrap@4.20.0/js/mdb.min.js | |
| js | /assets/js/common.js |
Серверные заголовки
Кол-во: 18
HTTP-заголовки ответа сервера
?
Заголовки сервера передают браузеру и поисковику служебную информацию: кеширование, безопасность (CSP, HSTS), сжатие (gzip). Правильная настройка ускоряет загрузку и повышает защищённость.
Найдены серверные заголовки 18шт. Подробнее про серверные заголовки.
Показать полный список серверных заголовков
| Ключ | Значение |
|---|---|
| Server | GitHub.com |
| Access-Control-Allow-Origin | * |
| Strict-Transport-Security | max-age=31556952 |
| ETag | "6a7c7d98-80bc" |
| Cache-Control | max-age=600 |
| x-proxy-cache | MISS |
| x-github-request-id | 0AD4:1C389F:28A108:2BCFBD:6A89DA77 |
| x-github-edge-region | swedencentral |
| Accept-Ranges | bytes |
| Age | 0 |
| Date | Sat, 22 Aug 2026 17:20:55 GMT |
| Via | 1.1 varnish |
| X-Served-By | cache-bma-essb1270043-BMA |
| X-Cache | MISS |
| x-cache-hits | 0 |
| x-timer | S1787419256.841982,VS0,VE116 |
| Vary | Accept-Encoding |
| x-fastly-request-id | e6c0413838663f3dbf1fb1c07a755148928941c0 |
CMS
Не определена
Система управления сайтом (движок)
?
CMS — это движок, на котором работает сайт (WordPress, 1C-Bitrix, Tilda и др.). Знание CMS помогает понять возможности SEO-оптимизации и подобрать подходящие инструменты. «Не определена» — вероятно, самописный сайт или нестандартная сборка.
CMS не определена. Вероятно, сайт самописный либо движок надёжно скрыт. Это не ошибка.
Веб-сервер
GitHub.com
Программное обеспечение сервера
?
Веб-сервер — это ПО, которое отдаёт страницы посетителям (nginx, Apache, IIS, LiteSpeed и др.). Определяется по серверным заголовкам ответа (Server, X-Powered-By и т.п.). «Не определён» — сервер намеренно скрывает эти заголовки, это нормальная практика безопасности.
В заголовке Server указано: GitHub.com.
Мета-теги Готовность: 32%
Title
MaiNLP research lab
Заголовок страницы в браузере и поисковой выдаче
?
Title — главный SEO-заголовок страницы. Влияет на CTR в поиске и ранжирование. Оптимальная длина: 50–70 символов. Ключевые слова — ближе к началу.
Необходимо увеличить число символов в title (текущее значение мало: 19, минимум: 25, оптимально: от 40 до 45)
Дублей словоформ в title не найдено.
Description
Munich AI & NLP lab
Описание страницы в поисковой выдаче (сниппет)
?
Meta Description — текст под заголовком в выдаче. Напрямую на позиции не влияет, но влияет на CTR. Оптимальная длина: 120–160 символов.
Необходимо увеличить число символов в description (текущее значение мало: 20, минимум: 80, оптимально: от 120 до 130)
Keywords
Список ключевых слов страницы (устаревший тег)
?
Meta Keywords не учитывается Яндексом и Google для ранжирования с 2009–2012 годов. Заполнение не обязательно, но не вредит. Конкурент может использовать содержимое для анализа.
Установите мета-тег keywords!
Канонический Url
https://mainlp.github.io/
Указывает поисковику основную версию страницы
?
Canonical (rel=canonical) предотвращает проблему дублей страниц. Должен точно совпадать с URL проверяемой страницы. Неправильный canonical может передать ссылочный вес на другую страницу.
Канонический Url прописан корректно.
Robots
Ошибок нет
Директивы для поисковых роботов на уровне страницы
?
Meta Robots управляет индексацией конкретной страницы: index/noindex — индексировать ли, follow/nofollow — следовать ли по ссылкам. Noindex полностью исключает страницу из поиска.
Meta-тег robots не указан. Страница свободна для индексации.
Адаптивность
width=device-width, initial-scale=1, shrink-to-fit=no
Настройка масштабирования на мобильных устройствах
?
Тег viewport (<meta name="viewport">) сообщает браузеру, как масштабировать страницу на мобильных. Стандарт: width=device-width, initial-scale=1. Отсутствие — признак отсутствия мобильной версии.
Meta-тег viewport со значением-константой width=device-width задаёт ширину страницы в соответствии с размером экрана.
Meta-тег viewport со значением initial-scale=1.0 определяет масштаб 1:1, т.е. «не масштабировать».
Разметка OpenGraph
Не найдено
Мета-теги для красивых превью в соцсетях
?
OpenGraph (og:title, og:description, og:image) управляет тем, как страница выглядит при репосте в социальных сетях и мессенджерах. Отсутствие OG-тегов — невзрачный превью при шеринге.
Разметка OpenGraph не задана. Страница не оптимизирована под социальные сети. Мета-теги с разметкой Og помогают социальным роботам лучше структурировать Ваш сайт.
Все мета-теги
Кол-во: 3
Полный список мета-тегов страницы
?
Таблица всех meta-тегов, включая нестандартные. Позволяет найти опечатки, дубли и лишние теги.
Найдены мета-теги 3шт. Мета-теги не видимы для человека и предназначены для обмена информацией между веб-страницей и поисковыми системами, браузерами и другими веб-службами. С ними роботы 🤖 и устройства ведут себя более ожидаемо.
Показать полный список мета-тегов
| Тип | Название | Значение |
|---|---|---|
| name | viewport | width=device-width, initial-scale=1, shrink-to-fit=no |
| name | author | MaiNLP research lab |
| name | description | Munich AI & NLP lab |
Оптимизация Готовность: 85%
Структура
Ошибок нет
Семантические HTML-элементы страницы
?
Проверяет наличие основных структурных элементов: nav, header, footer, main. Корректная семантическая структура помогает поисковику понять архитектуру страницы.
Структура документа корректна (теги <html> и <body> присутствуют в единственном экземпляре).
Контент
Есть ошибки
Объём и качество текстового содержимого
?
Анализирует объём полезного текста на странице. Слишком мало — страница может считаться малополезной. Слишком много — ухудшается читаемость и восприятие.
Абзацев с текстом 1 слишком мало. Добавьте больше абзацев с текстом (тег <p>)!
Слова из title 3 встречаются в тексте достаточно.
Среднее число слов в абзаце 100 достаточно.
Кол-во знаков контента 8832 на странице оптимально.
Кол-во слов 1246 на странице оптимально.
Заголовки
Ошибок нет
Иерархия заголовков H1–H6
?
H1 должен быть один и содержать ключевой запрос. H2–H6 описывают подразделы. Пропуск уровней (H1 → H3) и несколько H1 — типичные ошибки, снижающие понятность страницы для поисковика.
На странице присутствуют заголовки <h1> 1. Это прекрасно.
На странице присутствуют заголовки <h2> 59. Это хорошо.
Тошнота
8,72
Насколько одно слово доминирует в тексте
?
Классическая тошнота = √(частота самого повторяющегося слова). Норма до 7–8: текст воспринимается естественно. Выше — поисковик может счесть страницу переспамленной.
Тошнота превышает норму 3. Измените текст страницы!
Академич. тошнота
14,04%
Насколько текст перенасыщен ключевыми словами
?
Академическая тошнота = (частота слова / общее количество слов) × 100%. Показывает долю конкретного слова в тексте. Норма 5–15%.
Академическая тошнота страницы в пределах нормы.
Семантическое ядро
20
Наиболее часто встречающиеся слова на странице
?
Топ слов по частоте использования. Показывает, какие слова доминируют в тексте с точки зрения поисковика.
Контент страницы содержит осмысленный текст и слова.
Показать список слов
| Слово | Кол-во | Частота |
|---|---|---|
| student | 76 | 6,10% |
| assistant | 32 | 2,57% |
| university | 25 | 2,01% |
| external | 14 | 1,12% |
| research | 13 | 1,04% |
| postdoc | 13 | 1,04% |
| mainlp | 12 | 0,96% |
| professor | 11 | 0,88% |
| barbara | 10 | 0,80% |
| visiting | 10 | 0,80% |
| munich | 9 | 0,72% |
| co-supervisor | 8 | 0,64% |
| amsterdam | 7 | 0,56% |
| 2024–2025 | 7 | 0,56% |
| co-supervised | 6 | 0,48% |
| 2023–2024 | 6 | 0,48% |
| center | 5 | 0,40% |
| science | 5 | 0,40% |
| workshop | 5 | 0,40% |
| mentored | 5 | 0,40% |
Индексация Готовность: 60%
Индексирование
Ошибок нет
Разрешено ли индексирование страницы
?
Проверяет, не закрыта ли страница от индексации через robots.txt, meta robots или X-Robots-Tag. Страница, закрытая от индексации, не появится в поисковой выдаче.
Анкоров на странице 86 оптимально. Поисковые роботы обязательно проиндексируют сайт.
Robots.txt
Найден корректный robots.txt
Файл управления сканированием сайта роботами
?
Robots.txt указывает поисковым роботам, какие страницы сканировать, а какие — нет. Ошибки в файле могут случайно закрыть важные разделы от индексации.
Robots.txt настроен корректно. Размер файла: 71 байт. Загружен за: 0сек.
Проверяемая страница не запрещена в robots.txt.
Robots.txt доступен по постоянному адресу
Цепочка редиректов для файла robots.txt:
http://mainlp.github.io/robots.txt
301 MovedPermanently
https://mainlp.github.io/robots.txt
200 OK
Показать содержимое robots.txt
User-agent: *
Disallow:
Sitemap: https://mainlp.github.io/sitemap.xml
Sitemap
Кол-во: 1
XML-карта сайта для поисковиков
?
Sitemap.xml помогает поисковику быстрее находить и индексировать страницы. Особенно важен для крупных сайтов и новых страниц, на которые ещё нет входящих ссылок.
Robots.txt содержит карту сайта. Это прекрасно!
Robots.txt не содержит ошибок в карте сайта.
Показать карту сайта
| Url | Статус |
|---|---|
| https://mainlp.github.io/sitemap.xml |
|
Внутренние ссылки
Кол-во: 11
Ссылки на другие страницы своего сайта
?
Внутренние ссылки распределяют ссылочный вес между страницами и помогают поисковику обходить сайт. Пустые анкоры и ссылки на запрещённые robots.txt страницы — типичные ошибки.
Внутренних ссылок на странице 11 оптимально.
Внутренние ссылки не запрещены к индексации в robots.txt.
Показать внутренние ссылки
| Url | Анкор | Состояние | Анализировать |
|---|---|---|---|
| / |
Home<span class="sr-only">(current)</span>
|
|
Анализировать url |
| /jobs/ |
Jobs
|
|
Анализировать url |
| /events/ |
Events
|
|
Анализировать url |
| /projects/ |
Projects
|
|
Анализировать url |
| /thesis/ |
Thesis
|
|
Анализировать url |
| /publications/ |
Publications
|
|
Анализировать url |
| /contact/ |
Contact
|
|
Анализировать url |
| /events-archive/ |
earlier events
|
|
Анализировать url |
| /jobs |
→Open positions
|
|
Анализировать url |
| /contact/ |
→ directions
|
|
Анализировать url |
| /contact |
Impressum
|
|
Анализировать url |
Внешние ссылки
Кол-во: 74
Ссылки на сторонние сайты
?
Исходящие внешние ссылки передают часть ссылочного веса на чужие сайты. Ссылки на авторитетные ресурсы безопасны; ссылки на мусорные сайты могут навредить репутации страницы.
Внешних ссылок на странице 74 слишком много. Спрячьте лишние ссылки в тег noindex или атрибут rel='nofollow'!
Показать внешние ссылки
| Url | Анкор | Анализировать |
|---|---|---|
| cis.lmu.de |
Center for Information and Language Processing (CIS)
|
Анализировать url |
| bplank.github.io |
Prof. Dr. Barbara Plank
|
Анализировать url |
| dialres.github.io |
Dialects in NLP — A Resource Perspective
|
Анализировать url |
| ardmediathek.de |
tv segment on BR (Bayerischer Rundfunk)
|
Анализировать url |
| ellis.eu |
ELLIS news on Collaborative Science in Action
|
Анализировать url |
| aiformedia.network |
AI for Media Network news
|
Анализировать url |
| uni-freiburg.de |
Hermann-Paul lecture
|
Анализировать url |
| cl.uni-heidelberg.de |
talk at the Computational Linguistics Colloquium of the Heidelberg Institute for Theoretical Studies
|
Анализировать url |
| sites.google.com |
First Workshop on Bridging NLP and Public Opinion Research (NLPOR)
|
Анализировать url |
| noisy-text.github.io |
keynote at the WNUT workshop at NAACL 2025
|
Анализировать url |
| ai-news.lmu.de |
keynote lecture on "Foundations of AI" at the LMU grand AI-HUB opening
|
Анализировать url |
| comedinlp.github.io |
keynote at the CoMeDi workshop at COLING 2025
|
Анализировать url |
| bplank.github.io |
Barbara Plank
|
Анализировать url |
| cis.uni-muenchen.de |
Diego Frassinelli
|
Анализировать url |
| michael-hedderich.de |
Michael A. Hedderich
|
Анализировать url |
| scholar.google.com |
Mahdi Dhaini
|
Анализировать url |
| scholar.google.it |
Silvia Casola
|
Анализировать url |
| rlitschk.github.io |
Robert Litschko
|
Анализировать url |
| scholar.google.com |
Monica Riedler
|
Анализировать url |
| cis.uni-muenchen.de |
Raoyuan Zhao
|
Анализировать url |
| saeub.github.io |
Andreas Säuberli
|
Анализировать url |
| koernerfelicia.github.io |
Felicia Körner
|
Анализировать url |
| florian-eichin.com |
Florian Eichin
|
Анализировать url |
| cis.lmu.de |
Soh-Eun (Ryan) Shim
|
Анализировать url |
| scholar.google.com |
Shijia Zhou
|
Анализировать url |
| mckysse.github.io |
Beiduo Chen
|
Анализировать url |
| elenasenger.netlify.app |
Elena Senger
|
Анализировать url |
| pmmon.github.io |
Philipp Mondorf
|
Анализировать url |
| jorisbaan.nl |
Joris Baan
|
Анализировать url |
| noah-13.github.io |
Xinyuan Cheng
|
Анализировать url |
| robvanderg.github.io |
Rob van der Goot
|
Анализировать url |
| staff.fnwi.uva.nl |
Raquel Fernández
|
Анализировать url |
| wilkeraziz.github.io |
Wilker Aziz
|
Анализировать url |
| sites.google.com |
Anna Korhonen
|
Анализировать url |
| unibz.it |
Raffaella Bernardi
|
Анализировать url |
| sites.google.com |
Alessandro Vietti
|
Анализировать url |
| nlp4health-lab.github.io |
Iacer Calixto
|
Анализировать url |
| saifmohammad.com |
Saif M. Mohammad
|
Анализировать url |
| sprachlit.lmu.de |
Lars Bülow
|
Анализировать url |
| wesselpoelman.nl |
Wessel Poelman
|
Анализировать url |
| linkedin.com |
Domenico De Cristofaro
|
Анализировать url |
| stat.lmu.de |
Bolei Ma
|
Анализировать url |
| en.wisostat.statistik.uni-muenchen.de |
Cornelia Gruber
|
Анализировать url |
| verenablaschke.github.io |
Verena Blaschke
|
Анализировать url |
| xinpeng-wang.github.io |
Xinpeng Wang
|
Анализировать url |
| logan-siyao-peng.github.io |
Siyao (Logan) Peng
|
Анализировать url |
| janetlauyeung.github.io |
Yang Janet Liu
|
Анализировать url |
| sxu3.github.io |
Shanshan Xu
|
Анализировать url |
| mxij.me |
Max Müller-Eberstein
|
Анализировать url |
| elisabassignana.github.io |
Elisa Bassignana
|
Анализировать url |
| scholar.google.com |
Leon Weber-Genzel
|
Анализировать url |
| jjzha.github.io |
Mike Zhang
|
Анализировать url |
| dteodore.github.io |
Daniela Teodorescu
|
Анализировать url |
| mariabarrett.github.io |
Maria Barrett
|
Анализировать url |
| kdd.isti.cnr.it |
Benedetta Muscato
|
Анализировать url |
| uni.lu |
Anne-Marie Lutgen
|
Анализировать url |
| yupei.nl |
Yupei Du
|
Анализировать url |
| github.com |
on our github page
|
Анализировать url |
| huggingface.co |
on our huggingface page
|
Анализировать url |
| erc.europa.eu |
European Research Council (ERC)
|
Анализировать url |
| dff.dk |
Danmarks Frie Forskningsfond (DFF)
|
Анализировать url |
| bayern.de |
Bayerische Staatsregierung HTA
|
Анализировать url |
| mcml.ai |
Munich Center for Machine Learning (MCML)
|
Анализировать url |
| bidt.digital |
Bayerisches Forschungsinstitut für Digitale Transformation (bidt)
|
Анализировать url |
| imminent.translated.com |
Translated, Imminent Research Grant
|
Анализировать url |
| ellis.eu |
ELLIS Europe NLP Program
|
Анализировать url |
| ellismunich.ai |
ELLIS Unit Munich
|
Анализировать url |
| github.com |
<i class="fab fa-github" title="GitHub"></i> MaiNLP
|
Анализировать url |
| bsky.app |
<i class="fa-brands fa-bluesky"></i> mainlp.bsky.social
|
Анализировать url |
| jekyllrb.com |
Jekyll
|
Анализировать url |
| github.com |
al-folio
|
Анализировать url |
| pages.github.com |
GitHub Pages
|
Анализировать url |
| fontawesome.com |
Font Awesome
|
Анализировать url |
| creativecommons.org |
CC-BY 4.0
|
Анализировать url |
Конкуренты Готовность: 0%
Конкуренты в Яндексе
Кол-во: 0
Топ сайтов-конкурентов в Яндексе
?
Сайты, чаще всего появляющиеся в ТОПе Яндекса по запросам из семантического ядра этой страницы.
Мы не нашли у вас конкурентов в Яндексе. Сайт или очень молодой или плохо продвигается.
Конкурентов в ТОП-10 Яндекса не нашлось.
Конкуренты в Google
Кол-во: 0
Топ сайтов-конкурентов в Google
?
Сайты, чаще всего появляющиеся в ТОПе Google по запросам из семантического ядра этой страницы.
Конкуренты в Google тоже не найдены. Займитесь продвижением сайта!
Конкурентов в ТОП-10 Google не нашлось.
ЗоЗПП: права потребителей Готовность: 100%
Нарушения
Не выявлены
Признаков дистанционной продажи товаров (интернет-магазина) не обнаружено — требования ЗоЗПП о раскрытии информации продавца к сайту не применяются. Нарушений нет.
ФЗ-149: рекомендательные технологии Готовность: 100%
Нарушения
Не выявлены
Рекомендательные блоки («с этим покупают», «похожие товары» и т.п.) на сайте не обнаружены — требования ст. 10.7 ФЗ-149 к сайту не применяются. Нарушений нет.
ФЗ-38: реклама Готовность: 100%
Нарушения
Не выявлены
Рекламных тематик с обязательными оговорками (медицина, БАД, кредиты и займы, новостройки) на сайте не обнаружено. Нарушений нет.
ФЗ-436: защита детей Готовность: 100%
Нарушения
Не выявлены
Признаков информационной продукции (новости, видео, книги, игры, курсы) не обнаружено — обязательная возрастная маркировка по ФЗ-436 сайту не требуется. Нарушений нет.
Вердикт
Оптимизация сайта mainlp.github.io выполнена всего на 63%. Чтобы исправить ситуацию и попасть в ТОП необходимо:
Исправьте ошибки в мета-тегах.
Исправьте ошибки индексации.
Поделитесь с друзьями: