Анализ страницы https://stanfordnlp.github.io/CoreNLP
Основное Готовность: 100%
Домен
stanfordnlp.github.io
Состояние доменного имени
?
Проверяем корректность доменного имени и наличие технических проблем на уровне домена.
Используйте для продвижения только домен второго уровня.
Длина домена велика. Но если вы продвигаете запрос, входящий в название домена, то это хорошо.
Ответ сервера
200 Успешный ответ
HTTP-код ответа и цепочка редиректов
?
Код 200 — страница доступна. Коды 3xx — редиректы (цепочки замедляют загрузку и размывают ссылочный вес). Коды 4xx/5xx — ошибки, поисковик не сможет проиндексировать страницу.
Сервер настроен корректно.
Цепочка редиректов:
https://stanfordnlp.github.io/CoreNLP
301 MovedPermanently
https://stanfordnlp.github.io/CoreNLP/
200 OK
Безопасность
Сайт безопасен
Использование HTTPS и SSL-сертификат
?
HTTPS — обязательный стандарт. Google и Яндекс отдают предпочтение защищённым сайтам. Отсутствие SSL или просроченный сертификат ведут к предупреждениям в браузере и снижению позиций.
Не настроен HSTS (Strict-Transport-Security) — рекомендуется включить.
На сайте работает защищенный протокол ssl и сайт открывается по https.
Ssl-сертификат действителен до 07.11.2026 2:41:43.
Поздравляем! Сайт не содержится в реестре РКН.
Кодировка
UTF-8
Кодировка символов страницы
?
Стандарт — UTF-8. Неправильная кодировка вызывает нечитаемые символы и мешает поисковику корректно распознать текст страницы.
Указана кодировка на странице UTF-8.
Язык
en-US
Атрибут lang в HTML-теге
?
Атрибут lang (<html lang="ru">) сообщает поисковикам и браузерам, на каком языке написана страница. Помогает при ранжировании в региональном поиске.
Язык документа указан явно: en-US.
Скорость загрузки
~0,77сек
Время отклика сервера (TTFB)
?
Time To First Byte — время до получения первого байта от сервера. Норма до 200 мс. Медленный отклик ухудшает пользовательский опыт и ранжирование: Яндекс и Google учитывают скорость страниц.
Скорость загрузки сайта 0,77сек оптимальна.
Объем документа
28Кб
Размер HTML-кода страницы
?
Слишком большой HTML замедляет парсинг браузером и сканирование поисковым роботом. Рекомендуется не более 200 Кб.
Объем html-документа 28Кб оптимален.
Структура html-документа корректна.
Ресурсы
Ресурсы: 6
Внешние ресурсы страницы (CSS, JS, изображения)
?
Количество и тип подключённых ресурсов влияют на скорость загрузки. Большое число запросов увеличивает время рендеринга страницы.
Кол-во файлов ресурсов 6 достаточно.
Показать полный список ресурсов
| Тип | Название | Значение |
|---|---|---|
| stylesheet | https://stanfordnlp.github.io/CoreNLP/assets/css/font-awesome.min.css | |
| stylesheet | https://use.fontawesome.com/releases/v5.6.3/css/all.css | |
| stylesheet | https://stanfordnlp.github.io/CoreNLP/assets/css/just-the-docs.css | |
| js | https://www.googletagmanager.com/gtag/js?id=UA-133356038-1 | |
| js | text/javascript | https://stanfordnlp.github.io/CoreNLP/assets/js/vendor/lunr.min.js |
| js | text/javascript | https://stanfordnlp.github.io/CoreNLP/assets/js/just-the-docs.js |
Серверные заголовки
Кол-во: 18
HTTP-заголовки ответа сервера
?
Заголовки сервера передают браузеру и поисковику служебную информацию: кеширование, безопасность (CSP, HSTS), сжатие (gzip). Правильная настройка ускоряет загрузку и повышает защищённость.
Найдены серверные заголовки 18шт. Подробнее про серверные заголовки.
Показать полный список серверных заголовков
| Ключ | Значение |
|---|---|
| Server | GitHub.com |
| x-origin-cache | HIT |
| Access-Control-Allow-Origin | * |
| ETag | "68ffae76-7025" |
| Cache-Control | max-age=600 |
| x-proxy-cache | MISS |
| x-github-request-id | 5F6C:B07E3:31F52D:3250F5:6A887203 |
| x-github-edge-region | fra |
| Accept-Ranges | bytes |
| Age | 0 |
| Date | Fri, 21 Aug 2026 15:42:59 GMT |
| Via | 1.1 varnish |
| X-Served-By | cache-fra-eddf8230100-FRA |
| X-Cache | MISS |
| x-cache-hits | 0 |
| x-timer | S1787326980.599213,VS0,VE210 |
| Vary | Accept-Encoding |
| x-fastly-request-id | 82335b522d1bca1d816e9c2215b831429b43d0ae |
CMS
Jekyll v3.10.0
Система управления сайтом (движок)
?
CMS — это движок, на котором работает сайт (WordPress, 1C-Bitrix, Tilda и др.). Знание CMS помогает понять возможности SEO-оптимизации и подобрать подходящие инструменты. «Не определена» — вероятно, самописный сайт или нестандартная сборка.
В мета-теге generator указано: Jekyll v3.10.0.
Веб-сервер
GitHub.com
Программное обеспечение сервера
?
Веб-сервер — это ПО, которое отдаёт страницы посетителям (nginx, Apache, IIS, LiteSpeed и др.). Определяется по серверным заголовкам ответа (Server, X-Powered-By и т.п.). «Не определён» — сервер намеренно скрывает эти заголовки, это нормальная практика безопасности.
В заголовке Server указано: GitHub.com.
Мета-теги Готовность: 50%
Title
Overview - CoreNLP
Заголовок страницы в браузере и поисковой выдаче
?
Title — главный SEO-заголовок страницы. Влияет на CTR в поиске и ранжирование. Оптимальная длина: 50–70 символов. Ключевые слова — ближе к началу.
Необходимо увеличить число символов в title (текущее значение мало: 18, минимум: 25, оптимально: от 40 до 45)
Дублей словоформ в title не найдено.
Description
NLP Processing In Java
Описание страницы в поисковой выдаче (сниппет)
?
Meta Description — текст под заголовком в выдаче. Напрямую на позиции не влияет, но влияет на CTR. Оптимальная длина: 120–160 символов.
Необходимо увеличить число символов в description (текущее значение мало: 22, минимум: 80, оптимально: от 120 до 130)
Keywords
CoreNLP, Java, NLP, Natural Language Processing
Список ключевых слов страницы (устаревший тег)
?
Meta Keywords не учитывается Яндексом и Google для ранжирования с 2009–2012 годов. Заполнение не обязательно, но не вредит. Конкурент может использовать содержимое для анализа.
Keywords установлены.
Канонический Url
https://stanfordnlp.github.io/CoreNLP/
Указывает поисковику основную версию страницы
?
Canonical (rel=canonical) предотвращает проблему дублей страниц. Должен точно совпадать с URL проверяемой страницы. Неправильный canonical может передать ссылочный вес на другую страницу.
Канонический Url прописан корректно.
Robots
Ошибок нет
Директивы для поисковых роботов на уровне страницы
?
Meta Robots управляет индексацией конкретной страницы: index/noindex — индексировать ли, follow/nofollow — следовать ли по ссылкам. Noindex полностью исключает страницу из поиска.
Meta-тег robots не указан. Страница свободна для индексации.
Адаптивность
width=device-width, initial-scale=1
Настройка масштабирования на мобильных устройствах
?
Тег viewport (<meta name="viewport">) сообщает браузеру, как масштабировать страницу на мобильных. Стандарт: width=device-width, initial-scale=1. Отсутствие — признак отсутствия мобильной версии.
Meta-тег viewport со значением-константой width=device-width задаёт ширину страницы в соответствии с размером экрана.
Meta-тег viewport со значением initial-scale=1.0 определяет масштаб 1:1, т.е. «не масштабировать».
Разметка OpenGraph
Кол-во: 6
Мета-теги для красивых превью в соцсетях
?
OpenGraph (og:title, og:description, og:image) управляет тем, как страница выглядит при репосте в социальных сетях и мессенджерах. Отсутствие OG-тегов — невзрачный превью при шеринге.
Разметка OpenGraph задана. Страница оптимизирована под социальные сети.
Показать полный список og мета-тегов
| Тип | Значение |
|---|---|
| og:title | Overview |
| og:locale | en_US |
| og:description | NLP Processing In Java |
| og:url | https://stanfordnlp.github.io/CoreNLP/ |
| og:site_name | CoreNLP |
| og:type | website |
Все мета-теги
Кол-во: 19
Полный список мета-тегов страницы
?
Таблица всех meta-тегов, включая нестандартные. Позволяет найти опечатки, дубли и лишние теги.
Найдены мета-теги 19шт. Мета-теги не видимы для человека и предназначены для обмена информацией между веб-страницей и поисковыми системами, браузерами и другими веб-службами. С ними роботы 🤖 и устройства ведут себя более ожидаемо.
Показать полный список мета-тегов
| Тип | Название | Значение |
|---|---|---|
| name | keywords | CoreNLP, Java, NLP, Natural Language Processing |
| name | viewport | width=device-width, initial-scale=1 |
| name | generator | Jekyll v3.10.0 |
| name | description | NLP Processing In Java |
| name | twitter:card | summary |
| name | twitter:card | summary_large_image |
| name | twitter:site | @stanfordnlp |
| name | twitter:creator | @stanfordnlp |
| name | twitter:title | CoreNLP |
| name | twitter:description | High-performance human language analysis tools, now with native deep learning modules in Python, available in many human languages. |
| name | twitter:image | https://stanfordnlp.github.io/CoreNLP/assets/images/corenlp-logo.png |
| name | google-site-verification | h3zCtOJy9KzG1XWf5-3ppU1liaJ8NkpGvK_BbOOq3-4 |
| property | og:title | Overview |
| property | og:locale | en_US |
| property | og:description | NLP Processing In Java |
| property | og:url | https://stanfordnlp.github.io/CoreNLP/ |
| property | og:site_name | CoreNLP |
| property | og:type | website |
| property | twitter:title | Overview |
Оптимизация Готовность: 42%
Структура
Ошибок нет
Семантические HTML-элементы страницы
?
Проверяет наличие основных структурных элементов: nav, header, footer, main. Корректная семантическая структура помогает поисковику понять архитектуру страницы.
Структура документа корректна (теги <html> и <body> присутствуют в одном экземпляре).
Контент
Есть ошибки
Объём и качество текстового содержимого
?
Анализирует объём полезного текста на странице. Слишком мало — страница может считаться малополезной. Слишком много — ухудшается читаемость и восприятие.
Слова из title 2 встречаются в тексте редко. Добавьте в контент страницы слова из тега <title>!
Абзацев с текстом 25 достаточно.
Среднее число слов в абзаце 26 достаточно.
Кол-во знаков контента 6082 на странице оптимально.
Кол-во слов 911 на странице оптимально.
Заголовки
Ошибок нет
Иерархия заголовков H1–H6
?
H1 должен быть один и содержать ключевой запрос. H2–H6 описывают подразделы. Пропуск уровней (H1 → H3) и несколько H1 — типичные ошибки, снижающие понятность страницы для поисковика.
На странице присутствуют заголовки <h2> 5. Это хорошо.
На странице присутствуют заголовки <h3> 3.
Тошнота
5,57
Насколько одно слово доминирует в тексте
?
Классическая тошнота = √(частота самого повторяющегося слова). Норма до 7–8: текст воспринимается естественно. Выше — поисковик может счесть страницу переспамленной.
Тошнота превышает норму 3. Измените текст страницы!
Академич. тошнота
16,90%
Насколько текст перенасыщен ключевыми словами
?
Академическая тошнота = (частота слова / общее количество слов) × 100%. Показывает долю конкретного слова в тексте. Норма 5–15%.
Академическая тошнота превышает норму 5-15%. Измените текст страницы!
Семантическое ядро
20
Наиболее часто встречающиеся слова на странице
?
Топ слов по частоте использования. Показывает, какие слова доминируют в тексте с точки зрения поисковика.
Контент страницы содержит осмысленный текст и слова.
Показать список слов
| Слово | Кол-во | Частота |
|---|---|---|
| corenlp | 31 | 3,40% |
| download | 13 | 1,43% |
| stanford | 12 | 1,32% |
| mirror | 9 | 0,99% |
| parser | 8 | 0,88% |
| pipeline | 7 | 0,77% |
| dependency | 7 | 0,77% |
| arabic | 5 | 0,55% |
| language | 5 | 0,55% |
| languages | 4 | 0,44% |
| annotators | 4 | 0,44% |
| parsing | 4 | 0,44% |
| coreference | 4 | 0,44% |
| chinese | 4 | 0,44% |
| annotations | 4 | 0,44% |
| you’re | 4 | 0,44% |
| license | 4 | 0,44% |
| simple | 3 | 0,33% |
| programming | 3 | 0,33% |
| speech | 3 | 0,33% |
Индексация Готовность: 0%
Индексирование
Ошибок нет
Разрешено ли индексирование страницы
?
Проверяет, не закрыта ли страница от индексации через robots.txt, meta robots или X-Robots-Tag. Страница, закрытая от индексации, не появится в поисковой выдаче.
Анкоров на странице 138 оптимально. Поисковые роботы обязательно проиндексируют сайт.
Robots.txt
Не найден
Файл управления сканированием сайта роботами
?
Robots.txt указывает поисковым роботам, какие страницы сканировать, а какие — нет. Ошибки в файле могут случайно закрыть важные разделы от индексации.
Файл robots.txt не найден (ошибка 404). Крайне рекомендуем добавить файл robots.txt, это правило хорошего тона для поисковых роботов.
Sitemap
Кол-во: 0
XML-карта сайта для поисковиков
?
Sitemap.xml помогает поисковику быстрее находить и индексировать страницы. Особенно важен для крупных сайтов и новых страниц, на которые ещё нет входящих ссылок.
Robots.txt не содержит ссылку на карту сайта. Рекомендуется добавить карту сайта и указать ссылку на нее в robots.txt.
Внутренние ссылки
Кол-во: 69
Ссылки на другие страницы своего сайта
?
Внутренние ссылки распределяют ссылочный вес между страницами и помогают поисковику обходить сайт. Пустые анкоры и ссылки на запрещённые robots.txt страницы — типичные ошибки.
Внутренних ссылок на странице 69 оптимально.
Показать внутренние ссылки
| Url | Анкор | Состояние |
|---|---|---|
| /CoreNLP |
<div class="site-logo"></div>
|
|
| /CoreNLP/index.html |
Overview
|
|
| /CoreNLP/usage.html |
Usage
|
|
| /CoreNLP/download.html |
Download
|
|
| /CoreNLP/migration.html |
Migration
|
|
| /CoreNLP/cmdline.html |
Command Line Usage
|
|
| /CoreNLP/api.html |
CoreNLP API
|
|
| /CoreNLP/simple.html |
Simple API
|
|
| /CoreNLP/repl.html |
Interactive mode (REPL)
|
|
| /CoreNLP/corenlp-server.html |
CoreNLP Server
|
|
| /CoreNLP/caseless.html |
Caseless models
|
|
| /CoreNLP/human-languages.html |
Using CoreNLP on other human languages
|
|
| /CoreNLP/other-languages.html |
Using CoreNLP within other programming languages and packages
|
|
| /CoreNLP/demo.html |
Demo
|
|
| /CoreNLP/pipeline.html |
Pipeline
|
|
| /CoreNLP/annotators.html |
Full List Of Annotators
|
|
| /CoreNLP/new_annotator.html |
Custom Annotators
|
|
| /CoreNLP/tokenize.html |
Tokenization
|
|
| /CoreNLP/cleanxml.html |
CleanXML
|
|
| /CoreNLP/ssplit.html |
Sentence Splitting
|
|
| /CoreNLP/mwt.html |
Multi Word Token Expansion
|
|
| /CoreNLP/pos.html |
Parts Of Speech
|
|
| /CoreNLP/lemma.html |
Lemmatization
|
|
| /CoreNLP/ner.html |
Named Entity Recognition
|
|
| /CoreNLP/depparse.html |
Dependency Parsing
|
|
| /CoreNLP/parse.html |
Constituency Parsing
|
|
| /CoreNLP/coref.html |
Coreference Resolution
|
|
| /CoreNLP/openie.html |
OpenIE
|
|
| /CoreNLP/kbp.html |
KBP
|
|
| /CoreNLP/entitylink.html |
Entity Linking
|
|
| /CoreNLP/quote.html |
Quote Extraction And Attribution
|
|
| /CoreNLP/sentiment.html |
Sentiment
|
|
| /CoreNLP/additional.html |
Additional Tools
|
|
| /CoreNLP/patterns.html |
Bootstrapped surface patterns
|
|
| /CoreNLP/extensions.html |
Extensions and Packages and Models by others extending CoreNLP
|
|
| /CoreNLP/sutime.html |
SUTime
|
|
| /CoreNLP/tokensregex.html |
TokensRegex
|
|
| /CoreNLP/pytorch-depparse.html |
PyTorch Dependency Parser
|
|
| /CoreNLP/tools_tregex.html |
Tregex, Tsurgeon, Semgrex, and Ssurgeon
|
|
| /CoreNLP/tools_tregex_faq.html |
Tregex and Tsurgeon FAQ
|
|
| /CoreNLP/tools_classifier.html |
Classifier
|
|
| /CoreNLP/tools_crf_ner.html |
Named Entity Recognizer
|
|
| /CoreNLP/tools_crf_faq.html |
NER FAQ
|
|
| /CoreNLP/tools_scenegraph.html |
Scenegraph Parser
|
|
| /CoreNLP/tools_lex_parser.html |
Lexicalized Parser
|
|
| /CoreNLP/tools_parser_faq.html |
Parser FAQ
|
|
| /CoreNLP/tools_parser_arabic_faq.html |
Arabic Parser FAQ
|
|
| /CoreNLP/tools_srparser.html |
Shift Reduce Parser
|
|
| /CoreNLP/tools_segmenter.html |
Chinese and Arabic Segmenter
|
|
| /CoreNLP/tools_segmenter_faq.html |
Chinese and Arabic Segmenter FAQ
|
|
| /CoreNLP/tools_pos_tagger.html |
POS Tagger
|
|
| /CoreNLP/tools_pos_tagger_faq.html |
POS Tagger FAQ
|
|
| /CoreNLP/tools_nndep.html |
Dependency Parser
|
|
| /CoreNLP/resources.html |
Resources
|
|
| /CoreNLP/model-zoo.html |
Model Zoo
|
|
| /CoreNLP/faq.html |
FAQ
|
|
| /CoreNLP/tutorials.html |
Tutorials
|
|
| /CoreNLP/memory-time.html |
Understanding memory and time usage
|
|
| /CoreNLP/pipelines.html |
CoreNLP Pipelines
|
|
| /CoreNLP/history.html |
Release History
|
|
| /CoreNLP/contact.html |
Contact
|
|
| /CoreNLP/standalone.html |
Standalone Distributions
|
|
| /CoreNLP/parser-standalone.html |
Parser
|
|
| /CoreNLP/history.html |
<strong>What’s new:</strong> The v4.5.3 release adds an Ssurgeon interface
|
|
| /cmdline.html |
command-line
|
|
| /api.html |
programmatic API
|
|
| /CoreNLP/simple.html |
simple API
|
|
| /other-languages.html |
third party APIs
|
|
| /corenlp-server.html |
web service
|
|
Внешние ссылки
Кол-во: 56
Ссылки на сторонние сайты
?
Исходящие внешние ссылки передают часть ссылочного веса на чужие сайты. Ссылки на авторитетные ресурсы безопасны; ссылки на мусорные сайты могут навредить репутации страницы.
Внешних ссылок на странице 56 слишком много. Спрячьте лишние ссылки в тег noindex или атрибут rel='nofollow'!
Показать внешние ссылки
| Url | Анкор |
|---|---|
| github.com |
<i class="fab fa-github"></i>
|
| twitter.com |
<i class="fab fa-twitter"></i>
|
| nlp.stanford.edu |
Stanford NLP Group
|
| github.com |
Just the Docs
|
| nlp.stanford.edu |
<i class="fab fa-java"></i> Download CoreNLP 4.5.10
|
| github.com |
<i class="fab fa-github"></i> CoreNLP on GitHub
|
| huggingface.co |
CoreNLP on 🤗
|
| search.maven.org |
<i class="fab fa-sonatype"></i> CoreNLP on Maven
|
| github.com |
file an issue on github
|
| nlp.stanford.edu |
CoreNLP 4.5.10
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| search.maven.org |
download
|
| nlp.stanford.edu |
(mirror)
|
| huggingface.co |
(HF Hub)
|
| huggingface.co |
HuggingFace
|
| gnu.org |
GNU General Public License
|
| gnu.org |
proprietary software
|
| gnu.org |
proprietary software
|
| techfinder.stanford.edu |
commercial licensing
|
| giving.stanford.edu |
this form
|
| nlp.stanford.edu |
The Stanford CoreNLP Natural Language Processing Toolkit
|
| nlp.stanford.edu |
pdf
|
| nlp.stanford.edu |
bib
|
| nlp.stanford.edu |
POS tagging
|
| nlp.stanford.edu |
NER
|
| nlp.stanford.edu |
constituency parsing
|
| nlp.stanford.edu |
dependency parsing
|
| nlp.stanford.edu |
coreference resolution
|
| nlp.stanford.edu |
sentiment
|
| nlp.stanford.edu |
Open IE
|
| nlp.stanford.edu |
software pages
|
| nlp.stanford.edu |
publications page
|
Конкуренты Готовность: 0%
Конкуренты в Яндексе
Кол-во: 0
Топ сайтов-конкурентов в Яндексе
?
Сайты, чаще всего появляющиеся в ТОПе Яндекса по запросам из семантического ядра этой страницы.
Мы не нашли у вас конкурентов в Яндексе. Сайт или очень молодой или плохо продвигается.
Конкурентов в ТОП-10 Яндекса не нашлось.
Конкуренты в Google
Кол-во: 0
Топ сайтов-конкурентов в Google
?
Сайты, чаще всего появляющиеся в ТОПе Google по запросам из семантического ядра этой страницы.
Конкуренты в Google тоже не найдены. Займитесь продвижением сайта!
Конкурентов в ТОП-10 Google не нашлось.
ЗоЗПП: права потребителей Готовность: 100%
Нарушения
Не выявлены
Признаков дистанционной продажи товаров (интернет-магазина) не обнаружено — требования ЗоЗПП о раскрытии информации продавца к сайту не применяются. Нарушений нет.
ФЗ-149: рекомендательные технологии Готовность: 100%
Нарушения
Не выявлены
Рекомендательные блоки («с этим покупают», «похожие товары» и т.п.) на сайте не обнаружены — требования ст. 10.7 ФЗ-149 к сайту не применяются. Нарушений нет.
ФЗ-38: реклама Готовность: 100%
Нарушения
Не выявлены
Рекламных тематик с обязательными оговорками (медицина, БАД, кредиты и займы, новостройки) на сайте не обнаружено. Нарушений нет.
ФЗ-436: защита детей Готовность: 100%
Нарушения
Не выявлены
Признаков информационной продукции (новости, видео, книги, игры, курсы) не обнаружено — обязательная возрастная маркировка по ФЗ-436 сайту не требуется. Нарушений нет.
Вердикт
Страница https://stanfordnlp.github.io/CoreNLP готова к продвижению на 48%. Чтобы еще улучшить страницу и попасть на первые места поисковой выдачи необходимо:
Исправьте ошибки в мета-тегах.
Исправьте ошибки оптимизации.
Исправьте ошибки индексации.
Поделитесь с друзьями: