Анализ страницы https://giellalt.uit.no/ling/corpusindex.html
Основное Готовность: 70%
Домен
giellalt.uit.no
Состояние доменного имени
?
Проверяем корректность доменного имени и наличие технических проблем на уровне домена.
Используйте для продвижения только домен второго уровня.
Отличный запоминающийся домен.
Ответ сервера
200 Успешный ответ
HTTP-код ответа и цепочка редиректов
?
Код 200 — страница доступна. Коды 3xx — редиректы (цепочки замедляют загрузку и размывают ссылочный вес). Коды 4xx/5xx — ошибки, поисковик не сможет проиндексировать страницу.
Сервер настроен корректно.
Безопасность
Сайт безопасен
Использование HTTPS и SSL-сертификат
?
HTTPS — обязательный стандарт. Google и Яндекс отдают предпочтение защищённым сайтам. Отсутствие SSL или просроченный сертификат ведут к предупреждениям в браузере и снижению позиций.
Не настроен HSTS (Strict-Transport-Security) — рекомендуется включить.
На сайте работает защищенный протокол ssl и сайт открывается по https.
Ssl-сертификат действителен до 23.06.2027 15:40:40.
Поздравляем! Сайт не содержится в реестре РКН.
Кодировка
utf-8
Кодировка символов страницы
?
Стандарт — UTF-8. Неправильная кодировка вызывает нечитаемые символы и мешает поисковику корректно распознать текст страницы.
Указана кодировка на странице utf-8.
Язык
Атрибут lang в HTML-теге
?
Атрибут lang (<html lang="ru">) сообщает поисковикам и браузерам, на каком языке написана страница. Помогает при ранжировании в региональном поиске.
Язык страницы не указан. Рекомендуется явно указать язык документа!
Скорость загрузки
~0,26сек
Время отклика сервера (TTFB)
?
Time To First Byte — время до получения первого байта от сервера. Норма до 200 мс. Медленный отклик ухудшает пользовательский опыт и ранжирование: Яндекс и Google учитывают скорость страниц.
Скорость загрузки сайта 0,26сек оптимальна.
Объем документа
21Кб
Размер HTML-кода страницы
?
Слишком большой HTML замедляет парсинг браузером и сканирование поисковым роботом. Рекомендуется не более 200 Кб.
Объем html-документа 21Кб оптимален.
Структура html-документа корректна.
Ресурсы
Ресурсы: 12
Внешние ресурсы страницы (CSS, JS, изображения)
?
Количество и тип подключённых ресурсов влияют на скорость загрузки. Большое число запросов увеличивает время рендеринга страницы.
Кол-во файлов ресурсов 12 много для одной страницы. Приемлемо до 10. Проведите оптимизацию файлов ресурсов!
Показать полный список ресурсов
| Тип | Название | Значение |
|---|---|---|
| stylesheet | text/css | ../skin/basic.css |
| stylesheet | text/css | ../skin/screen.css |
| stylesheet | text/css | ../skin/print.css |
| stylesheet | text/css | ../skin/profile.css |
| stylesheet | https://maxcdn.bootstrapcdn.com/bootstrap/4.0.0/css/bootstrap.min.css | |
| stylesheet | text/css | ../skin/custom.css |
| js | text/javascript | ../skin/getBlank.js |
| js | text/javascript | ../skin/getMenu.js |
| js | text/javascript | ../skin/fontsize.js |
| js | https://code.jquery.com/jquery-3.2.1.slim.min.js | |
| js | https://cdnjs.cloudflare.com/ajax/libs/popper.js/1.12.9/umd/popper.min.js | |
| js | https://maxcdn.bootstrapcdn.com/bootstrap/4.0.0/js/bootstrap.min.js |
Серверные заголовки
Кол-во: 5
HTTP-заголовки ответа сервера
?
Заголовки сервера передают браузеру и поисковику служебную информацию: кеширование, безопасность (CSP, HSTS), сжатие (gzip). Правильная настройка ускоряет загрузку и повышает защищённость.
Найдены серверные заголовки 5шт. Подробнее про серверные заголовки.
Показать полный список серверных заголовков
| Ключ | Значение |
|---|---|
| Date | Thu, 20 Aug 2026 07:21:35 GMT |
| Server | Apache/2.4.58 |
| ETag | "5464-5cc725dd2fe00" |
| Accept-Ranges | bytes |
| Vary | Accept-Encoding |
CMS
Apache Forrest
Система управления сайтом (движок)
?
CMS — это движок, на котором работает сайт (WordPress, 1C-Bitrix, Tilda и др.). Знание CMS помогает понять возможности SEO-оптимизации и подобрать подходящие инструменты. «Не определена» — вероятно, самописный сайт или нестандартная сборка.
В мета-теге generator указано: Apache Forrest.
Веб-сервер
Программное обеспечение сервера
?
Веб-сервер — это ПО, которое отдаёт страницы посетителям (nginx, Apache, IIS, LiteSpeed и др.). Определяется по серверным заголовкам ответа (Server, X-Powered-By и т.п.). «Не определён» — сервер намеренно скрывает эти заголовки, это нормальная практика безопасности.
Сайт работает на веб-сервере Apache.
Мета-теги Готовность: 32%
Title
Documentation for corpus work
Заголовок страницы в браузере и поисковой выдаче
?
Title — главный SEO-заголовок страницы. Влияет на CTR в поиске и ранжирование. Оптимальная длина: 50–70 символов. Ключевые слова — ближе к началу.
Необходимо увеличить число символов в title (текущее значение: 29, оптимально: от 40 до 45)
Дублей словоформ в title не найдено.
Description
Описание страницы в поисковой выдаче (сниппет)
?
Meta Description — текст под заголовком в выдаче. Напрямую на позиции не влияет, но влияет на CTR. Оптимальная длина: 120–160 символов.
Установите мета-тег description!
Keywords
Список ключевых слов страницы (устаревший тег)
?
Meta Keywords не учитывается Яндексом и Google для ранжирования с 2009–2012 годов. Заполнение не обязательно, но не вредит. Конкурент может использовать содержимое для анализа.
Установите мета-тег keywords!
Канонический Url
Указывает поисковику основную версию страницы
?
Canonical (rel=canonical) предотвращает проблему дублей страниц. Должен точно совпадать с URL проверяемой страницы. Неправильный canonical может передать ссылочный вес на другую страницу.
Рекомендуем прописать канонический Url.
Robots
Ошибок нет
Директивы для поисковых роботов на уровне страницы
?
Meta Robots управляет индексацией конкретной страницы: index/noindex — индексировать ли, follow/nofollow — следовать ли по ссылкам. Noindex полностью исключает страницу из поиска.
Meta-тег robots не указан. Страница свободна для индексации.
Адаптивность
width=device-width, initial-scale=1
Настройка масштабирования на мобильных устройствах
?
Тег viewport (<meta name="viewport">) сообщает браузеру, как масштабировать страницу на мобильных. Стандарт: width=device-width, initial-scale=1. Отсутствие — признак отсутствия мобильной версии.
Meta-тег viewport со значением-константой width=device-width задаёт ширину страницы в соответствии с размером экрана.
Meta-тег viewport со значением initial-scale=1.0 определяет масштаб 1:1, т.е. «не масштабировать».
Разметка OpenGraph
Не найдено
Мета-теги для красивых превью в соцсетях
?
OpenGraph (og:title, og:description, og:image) управляет тем, как страница выглядит при репосте в социальных сетях и мессенджерах. Отсутствие OG-тегов — невзрачный превью при шеринге.
Разметка OpenGraph не задана. Страница не оптимизирована под социальные сети. Мета-теги с разметкой Og помогают социальным роботам лучше структурировать Ваш сайт.
Все мета-теги
Кол-во: 4
Полный список мета-тегов страницы
?
Таблица всех meta-тегов, включая нестандартные. Позволяет найти опечатки, дубли и лишние теги.
Найдены мета-теги 4шт. Мета-теги не видимы для человека и предназначены для обмена информацией между веб-страницей и поисковыми системами, браузерами и другими веб-службами. С ними роботы 🤖 и устройства ведут себя более ожидаемо.
Показать полный список мета-тегов
| Тип | Название | Значение |
|---|---|---|
| name | Generator | Apache Forrest |
| name | Forrest-version | 0.10-dev |
| name | Forrest-skin-name | sdbootstrap |
| name | viewport | width=device-width, initial-scale=1 |
Оптимизация Готовность: 72%
Структура
Ошибок нет
Семантические HTML-элементы страницы
?
Проверяет наличие основных структурных элементов: nav, header, footer, main. Корректная семантическая структура помогает поисковику понять архитектуру страницы.
Структура документа корректна (теги <html> и <body> присутствуют по одному на документ).
Контент
Есть ошибки
Объём и качество текстового содержимого
?
Анализирует объём полезного текста на странице. Слишком мало — страница может считаться малополезной. Слишком много — ухудшается читаемость и восприятие.
Абзацев с текстом 4 слишком мало. Добавьте больше абзацев с текстом (тег <p>)!
Кол-во слов 286 слишком мало. Добавьте больше текста (минимум 400 слов)!
Слова из title 4 встречаются в тексте достаточно.
Среднее число слов в абзаце 25 достаточно.
Кол-во знаков контента 2344 на странице оптимально.
Заголовки
Ошибок нет
Иерархия заголовков H1–H6
?
H1 должен быть один и содержать ключевой запрос. H2–H6 описывают подразделы. Пропуск уровней (H1 → H3) и несколько H1 — типичные ошибки, снижающие понятность страницы для поисковика.
На странице присутствуют заголовки <h1> 1. Это прекрасно.
На странице присутствуют заголовки <h2> 4. Это хорошо.
На странице присутствуют заголовки <h3> 2.
Тошнота
4,36
Насколько одно слово доминирует в тексте
?
Классическая тошнота = √(частота самого повторяющегося слова). Норма до 7–8: текст воспринимается естественно. Выше — поисковик может счесть страницу переспамленной.
Тошнота превышает норму 3. Измените текст страницы!
Академич. тошнота
26,22%
Насколько текст перенасыщен ключевыми словами
?
Академическая тошнота = (частота слова / общее количество слов) × 100%. Показывает долю конкретного слова в тексте. Норма 5–15%.
Академическая тошнота превышает норму 5-15%. Измените текст страницы!
Семантическое ядро
20
Наиболее часто встречающиеся слова на странице
?
Топ слов по частоте использования. Показывает, какие слова доминируют в тексте с точки зрения поисковика.
Контент страницы содержит осмысленный текст и слова.
Показать список слов
| Слово | Кол-во | Частота |
|---|---|---|
| corpus | 19 | 6,64% |
| overview | 10 | 3,50% |
| maintenance | 5 | 1,75% |
| infrastructure | 3 | 1,05% |
| documentation | 3 | 1,05% |
| analysis | 3 | 1,05% |
| meetings | 3 | 1,05% |
| important | 3 | 1,05% |
| metadata | 3 | 1,05% |
| sentence | 3 | 1,05% |
| alignment | 3 | 1,05% |
| interface | 3 | 1,05% |
| installations | 3 | 1,05% |
| technical | 2 | 0,70% |
| machine | 2 | 0,70% |
| translation | 2 | 0,70% |
| linguistic | 2 | 0,70% |
| languages | 2 | 0,70% |
| introduction | 2 | 0,70% |
| repositories | 2 | 0,70% |
Индексация Готовность: 0%
Индексирование
Ошибок нет
Разрешено ли индексирование страницы
?
Проверяет, не закрыта ли страница от индексации через robots.txt, meta robots или X-Robots-Tag. Страница, закрытая от индексации, не появится в поисковой выдаче.
Анкоров на странице 141 оптимально. Поисковые роботы обязательно проиндексируют сайт.
Robots.txt
Не найден
Файл управления сканированием сайта роботами
?
Robots.txt указывает поисковым роботам, какие страницы сканировать, а какие — нет. Ошибки в файле могут случайно закрыть важные разделы от индексации.
Файл robots.txt не найден (ошибка 404). Крайне рекомендуем добавить файл robots.txt, это правило хорошего тона для поисковых роботов.
Sitemap
Кол-во: 0
XML-карта сайта для поисковиков
?
Sitemap.xml помогает поисковику быстрее находить и индексировать страницы. Особенно важен для крупных сайтов и новых страниц, на которые ещё нет входящих ссылок.
Robots.txt не содержит ссылку на карту сайта. Рекомендуется добавить карту сайта и указать ссылку на нее в robots.txt.
Внутренние ссылки
Кол-во: 117
Ссылки на другие страницы своего сайта
?
Внутренние ссылки распределяют ссылочный вес между страницами и помогают поисковику обходить сайт. Пустые анкоры и ссылки на запрещённые robots.txt страницы — типичные ошибки.
Внутренних ссылок на странице 117 оптимально.
Показать первые 100 внутренних ссылок
| Url | Анкор | Состояние |
|---|---|---|
| /../index.html |
Home
|
|
| /../index.html |
Infrastructure
|
|
| /../infra/Infrastructure.html |
Transducer infrastructure
|
|
| /../infra/TechnicalMaintenance.html |
Technical maintenance
|
|
| /../infra/ApplicationInfrastructure.html |
Application infrastructure
|
|
| /../infra/ServersAndUsers.html |
Servers, users and access
|
|
| /../infra/OldInfraDocumentation.html |
Old documentation
|
|
| /../presentations/PresentationsAboutInfra.html |
Presentations
|
|
| /../index.html |
Tools
|
|
| /../keyboards/Overview.html |
Keyboards
|
|
| /../proof/index.html |
Proofing tools
|
|
| /../proof/gramcheck/GrammarCheckerDocumentation.html |
Grammar checker
|
|
| /../dicts/dicts.html |
Dictionaries
|
|
| /../ling/corpusindex.html |
Corpus
|
|
| /../ped/index.html |
ICALL
|
|
| /../mt/MachineTranslation.html |
Machine translation
|
|
| /../tm/TranslationMemory.html |
Translation memory
|
|
| /../ling/LinguisticAnalysis.html |
Linguistic analysis
|
|
| /../ml/MachineLearning.html |
Machine learning
|
|
| /../tts/ESpeakNG.html |
Text-to-speech
|
|
| /../localisation/Localisation.html |
Localisation
|
|
| /../index.html |
Languages/linguistics
|
|
| /../ling/common.html |
Linguistic issues
|
|
| /../lang/index.html |
Languages
|
|
| /../index.html |
Administration
|
|
| /../admin/meetings.html |
Meetings
|
|
| /../ling/corpus_intro.html |
Introduction
|
|
| /../ling/CorpusTools.html |
Corpus Tools
|
|
| /../ling/corpus_repositories.html |
Repositories
|
|
| /../ling/corpus_xsl_file.html |
Metadata files
|
|
| /../infra/corpus_collectors_howto.html |
Korpussamlerens 1-2-3
|
|
| /../ling/corpus_conversion.html |
Corpus collector's manual
|
|
| /../ling/corpus_maintenance.html |
Maintenance
|
|
| /../ling/corpus_analysis_for_xserve.html |
Corpus analysis
|
|
| /../ling/corpus_conversion_tech.html |
Corpus conversion
|
|
| /../ling/langrec.html |
Language recognition
|
|
| /../ling/UnicodeNormalisation.html |
Unicode normalisation
|
|
| /../tools/ocr.html |
OCR
|
|
| /../ling/WikipediaAsCorpus.html |
Wikipedia as corpus
|
|
| /../tools/tca2.html |
Overview
|
|
| /../tools/Bargovuohki.html |
Workflow
|
|
| /../ling/corpus_improve_alignment.html |
Improving PDF-files
|
|
| /../tools/TCA2_parameters.html |
TCA2 parameters
|
|
| /../ling/corpus_analyze.html |
Graph. interface
|
|
| /../tools/other_aligners.html |
Alternatives
|
|
| /../admin/corpus/Meeting_2017-06-21.html |
2017-06-21
|
|
| /../admin/corpus/Meeting_2017-07-04.html |
2017-07-04
|
|
| /../admin/corpus/Meeting_2012-03-22.html |
2012-03-22
|
|
| /../admin/corpus/Meeting_2012-03-12.html |
2012-03-12
|
|
| /../admin/corpus/Meeting_2012-02-29.html |
2012-02-29
|
|
| /../admin/corpus/Meeting_2012-02-17.html |
2012-02-17
|
|
| /../admin/corpus/Meeting_2012-02-13.html |
2012-02-13
|
|
| /../admin/corpus/Meeting_2012-02-07.html |
2012-02-07
|
|
| /../admin/corpus/Meeting_2012-02-01.html |
2012-02-01
|
|
| /../admin/corpus/Meeting_2012-01-25.html |
2012-01-25
|
|
| /../admin/corpus/Meeting_2012-01-19.html |
2012-01-19
|
|
| /../admin/corpus/Meeting_2012-01-12.html |
2012-01-12
|
|
| /../admin/corpus/Meeting_2011-12-20.html |
2011-12-20
|
|
| /../admin/corpus/Meeting_2011-12-14.html |
2011-12-14
|
|
| /../admin/corpus/Meeting_2011-12-08.html |
2011-12-08
|
|
| /../admin/corpus/Meeting_2011-11-28.html |
2011-11-28
|
|
| /../admin/corpus/Meeting_2011-11-25.html |
2011-11-25
|
|
| /../admin/corpus/Meeting_2011-04-07.html |
2011-04-07
|
|
| /../infra/korp/index.html |
Installations
|
|
| /../ling/Ordbild.html |
Overview
|
|
| /../ling/ordbild/OversiktOverOrdbild.html |
Plan for content
|
|
| /../ling/spoken/SpokenCorpora.html |
Overview
|
|
| /../ling/spoken/LIA.html |
Overview
|
|
| /../freiburg/freiburg.html |
Overview
|
|
| /../freiburg/ELAN.html |
ELAN documentation
|
|
| /../freiburg/ELANtiers.html |
Elan tiers
|
|
| /../freiburg/FST.html |
FSTs
|
|
| /../freiburg/GRAID.html |
GRAID
|
|
| /../freiburg/GTcorpus.html |
GT corpus
|
|
| /../freiburg/Metadata.html |
Metadata
|
|
| /../freiburg/TLA.html |
TLA
|
|
| /../freiburg/Toolbox.html |
Toolbox
|
|
| /../freiburg/Transcription.html |
Transcription
|
|
| /corpus_intro.html |
Introduction
|
|
| /CorpusTools.html |
The corpus tools
|
|
| /corpus_repositories.html |
Corpus repositories
|
|
| /corpus_xsl_file.html |
Metadata files
|
|
| /../infra/corpus_collectors_howto.html |
Korpussamlerens 1-2-3 (juridisk intro for kontakt med tekstprodusenter)
|
|
| /corpus_conversion.html |
Corpus collector's manual (how to work)
|
|
| /corpus_maintenance.html |
Corpus maintenance
|
|
| /corpus_analysis_for_xserve.html |
Corpus analysis (for Korp)
|
|
| /corpus_conversion_tech.html |
Corpus conversion (technical)
|
|
| /langrec.html |
Language recognition
|
|
| /UnicodeNormalisation.html |
Unicode Normalisation (how to fix decomposed Sami letters)
|
|
| /../tools/ocr.html |
OCR
|
|
| /WikipediaAsCorpus.html |
Wikipedia as a Corpus
|
|
| /../tools/tca2.html |
Overview
|
|
| /../tools/Bargovuohki.html |
Workflow
|
|
| /../ling/corpus_improve_alignment.html |
Improving PDF-files
|
|
| /../tools/TCA2_parameters.html |
TCA2 parameters
|
|
| /../ling/corpus_analyze.html |
Graph. interface
|
|
| /../tools/other_aligners.html |
Alternatives
|
|
| /../admin/corpus/Meeting_2017-06-21.html |
06-21
|
|
| /../admin/corpus/Meeting_2017-07-04.html |
07-04
|
|
| /../admin/corpus/Meeting_2012-03-22.html |
03-22
|
|
Внешние ссылки
Кол-во: 9
Ссылки на сторонние сайты
?
Исходящие внешние ссылки передают часть ссылочного веса на чужие сайты. Ссылки на авторитетные ресурсы безопасны; ссылки на мусорные сайты могут навредить репутации страницы.
Внешних ссылок на странице 9 слишком много. Спрячьте лишние ссылки в тег noindex или атрибут rel='nofollow'!
Показать внешние ссылки
| Url | Анкор |
|---|---|
| divvun.no |
<img class="logoImage" alt="Divvuns & Giellateknos techdoc" src="../images/divvun-logo.png" height="30" title="Divvun site">
|
| giellatekno.uit.no |
<img class="logoImage" alt="Divvuns & Giellateknos techdoc" src="../images/giellatekno_logo.png" height="30" title="Giellatekno site">
|
| giellatekno.uit.no |
Bugzilla
|
| uit.no |
<img class="logoImage" alt="UiT Norgga árktalaš universitehta" src="../images/UiT_Navn_sam_rod.png" height="150" title="UiT Norgga árktalaš universitehta">
|
| giellatekno.uit.no |
<img class="logoImage" alt="" src="../images/giellatekno_logo.png" height="50" title="UiT Norgga árktalaš universitehta">
|
| gtweb.uit.no |
Saami languages
|
| gtweb.uit.no |
Kven, Meänkieli, Veps, Võro
|
| gtweb.uit.no |
Komi-Zyrian, Komi-Permyak, Udmurt, Moksha, Erzya, Hill Mari, Meadow Mari
|
| altlab.ualberta.ca |
Artlab: Plains Cree
|
Конкуренты Готовность: 0%
Конкуренты в Яндексе
Кол-во: 0
Топ сайтов-конкурентов в Яндексе
?
Сайты, чаще всего появляющиеся в ТОПе Яндекса по запросам из семантического ядра этой страницы.
Мы не нашли у вас конкурентов в Яндексе. Сайт или очень молодой или плохо продвигается.
Конкурентов в ТОП-10 Яндекса не нашлось.
Конкуренты в Google
Кол-во: 0
Топ сайтов-конкурентов в Google
?
Сайты, чаще всего появляющиеся в ТОПе Google по запросам из семантического ядра этой страницы.
Конкуренты в Google тоже не найдены. Займитесь продвижением сайта!
Конкурентов в ТОП-10 Google не нашлось.
ЗоЗПП: права потребителей Готовность: 100%
Нарушения
Не выявлены
Признаков дистанционной продажи товаров (интернет-магазина) не обнаружено — требования ЗоЗПП о раскрытии информации продавца к сайту не применяются. Нарушений нет.
ФЗ-149: рекомендательные технологии Готовность: 100%
Нарушения
Не выявлены
Рекомендательные блоки («с этим покупают», «похожие товары» и т.п.) на сайте не обнаружены — требования ст. 10.7 ФЗ-149 к сайту не применяются. Нарушений нет.
ФЗ-38: реклама Готовность: 100%
Нарушения
Не выявлены
Рекламных тематик с обязательными оговорками (медицина, БАД, кредиты и займы, новостройки) на сайте не обнаружено. Нарушений нет.
ФЗ-436: защита детей Готовность: 100%
Нарушения
Не выявлены
Признаков информационной продукции (новости, видео, книги, игры, курсы) не обнаружено — обязательная возрастная маркировка по ФЗ-436 сайту не требуется. Нарушений нет.
Вердикт
Страница https://giellalt.uit.no/ling/corpusindex.html готова к продвижению на 44%. Чтобы еще улучшить страницу и попасть на первые места поисковой выдачи необходимо:
Исправьте ошибки в мета-тегах.
Исправьте ошибки индексации.
Поделитесь с друзьями: