Анализ страницы https://murawaki.org/publications.html
Основное Готовность: 100%
Домен
murawaki.org
Состояние доменного имени
?
Проверяем корректность доменного имени и наличие технических проблем на уровне домена.
Домен второго уровня идеален для продвижения.
Отличный запоминающийся домен.
Ответ сервера
200 Успешный ответ
HTTP-код ответа и цепочка редиректов
?
Код 200 — страница доступна. Коды 3xx — редиректы (цепочки замедляют загрузку и размывают ссылочный вес). Коды 4xx/5xx — ошибки, поисковик не сможет проиндексировать страницу.
Сервер настроен корректно.
Безопасность
Сайт безопасен
Использование HTTPS и SSL-сертификат
?
HTTPS — обязательный стандарт. Google и Яндекс отдают предпочтение защищённым сайтам. Отсутствие SSL или просроченный сертификат ведут к предупреждениям в браузере и снижению позиций.
Не настроен HSTS (Strict-Transport-Security) — рекомендуется включить.
На сайте работает защищенный протокол ssl и сайт открывается по https.
Ssl-сертификат действителен до 04.10.2026 22:45:22.
Поздравляем! Сайт не содержится в реестре РКН.
Кодировка
utf-8
Кодировка символов страницы
?
Стандарт — UTF-8. Неправильная кодировка вызывает нечитаемые символы и мешает поисковику корректно распознать текст страницы.
Указана кодировка на странице utf-8.
Язык
ja
Атрибут lang в HTML-теге
?
Атрибут lang (<html lang="ru">) сообщает поисковикам и браузерам, на каком языке написана страница. Помогает при ранжировании в региональном поиске.
Язык документа указан явно: ja.
Скорость загрузки
~1,69сек
Время отклика сервера (TTFB)
?
Time To First Byte — время до получения первого байта от сервера. Норма до 200 мс. Медленный отклик ухудшает пользовательский опыт и ранжирование: Яндекс и Google учитывают скорость страниц.
Скорость загрузки сайта 1,69сек превышает 1 секунду. Желательно улучшить работу сайта!
Объем документа
83Кб
Размер HTML-кода страницы
?
Слишком большой HTML замедляет парсинг браузером и сканирование поисковым роботом. Рекомендуется не более 200 Кб.
Объем html-документа 83Кб оптимален.
Структура html-документа корректна.
Ресурсы
Ресурсы: 2
Внешние ресурсы страницы (CSS, JS, изображения)
?
Количество и тип подключённых ресурсов влияют на скорость загрузки. Большое число запросов увеличивает время рендеринга страницы.
Кол-во файлов ресурсов 2 достаточно.
Показать полный список ресурсов
| Тип | Название | Значение |
|---|---|---|
| stylesheet | css/bootstrap.min.css | |
| js | https://www.googletagmanager.com/gtag/js?id=G-03Z61JFMY5 |
Серверные заголовки
Кол-во: 4
HTTP-заголовки ответа сервера
?
Заголовки сервера передают браузеру и поисковику служебную информацию: кеширование, безопасность (CSP, HSTS), сжатие (gzip). Правильная настройка ускоряет загрузку и повышает защищённость.
Найдены серверные заголовки 4шт. Подробнее про серверные заголовки.
Показать полный список серверных заголовков
| Ключ | Значение |
|---|---|
| Server | nginx |
| Date | Mon, 24 Aug 2026 16:16:16 GMT |
| ETag | "1aadc-659a2ff0ed4c0" |
| Accept-Ranges | bytes |
CMS
Система управления сайтом (движок)
?
CMS — это движок, на котором работает сайт (WordPress, 1C-Bitrix, Tilda и др.). Знание CMS помогает понять возможности SEO-оптимизации и подобрать подходящие инструменты. «Не определена» — вероятно, самописный сайт или нестандартная сборка.
Сайт работает на CMS Diafan.CMS.
Веб-сервер
Программное обеспечение сервера
?
Веб-сервер — это ПО, которое отдаёт страницы посетителям (nginx, Apache, IIS, LiteSpeed и др.). Определяется по серверным заголовкам ответа (Server, X-Powered-By и т.п.). «Не определён» — сервер намеренно скрывает эти заголовки, это нормальная практика безопасности.
Сайт работает на веб-сервере nginx.
Мета-теги Готовность: 32%
Title
Publications
Заголовок страницы в браузере и поисковой выдаче
?
Title — главный SEO-заголовок страницы. Влияет на CTR в поиске и ранжирование. Оптимальная длина: 50–70 символов. Ключевые слова — ближе к началу.
Необходимо увеличить число символов в title (текущее значение мало: 12, минимум: 25, оптимально: от 40 до 45)
Дублей словоформ в title не найдено.
Description
Описание страницы в поисковой выдаче (сниппет)
?
Meta Description — текст под заголовком в выдаче. Напрямую на позиции не влияет, но влияет на CTR. Оптимальная длина: 120–160 символов.
Установите мета-тег description!
Keywords
Список ключевых слов страницы (устаревший тег)
?
Meta Keywords не учитывается Яндексом и Google для ранжирования с 2009–2012 годов. Заполнение не обязательно, но не вредит. Конкурент может использовать содержимое для анализа.
Установите мета-тег keywords!
Канонический Url
Указывает поисковику основную версию страницы
?
Canonical (rel=canonical) предотвращает проблему дублей страниц. Должен точно совпадать с URL проверяемой страницы. Неправильный canonical может передать ссылочный вес на другую страницу.
Рекомендуем прописать канонический Url.
Robots
Ошибок нет
Директивы для поисковых роботов на уровне страницы
?
Meta Robots управляет индексацией конкретной страницы: index/noindex — индексировать ли, follow/nofollow — следовать ли по ссылкам. Noindex полностью исключает страницу из поиска.
Meta-тег robots не указан. Страница свободна для индексации.
Адаптивность
width=device-width, initial-scale=1
Настройка масштабирования на мобильных устройствах
?
Тег viewport (<meta name="viewport">) сообщает браузеру, как масштабировать страницу на мобильных. Стандарт: width=device-width, initial-scale=1. Отсутствие — признак отсутствия мобильной версии.
Meta-тег viewport со значением-константой width=device-width задаёт ширину страницы в соответствии с размером экрана.
Meta-тег viewport со значением initial-scale=1.0 определяет масштаб 1:1, т.е. «не масштабировать».
Разметка OpenGraph
Не найдено
Мета-теги для красивых превью в соцсетях
?
OpenGraph (og:title, og:description, og:image) управляет тем, как страница выглядит при репосте в социальных сетях и мессенджерах. Отсутствие OG-тегов — невзрачный превью при шеринге.
Разметка OpenGraph не задана. Страница не оптимизирована под социальные сети. Мета-теги с разметкой Og помогают социальным роботам лучше структурировать Ваш сайт.
Все мета-теги
Кол-во: 1
Полный список мета-тегов страницы
?
Таблица всех meta-тегов, включая нестандартные. Позволяет найти опечатки, дубли и лишние теги.
Найдены мета-теги 1шт. Мета-теги не видимы для человека и предназначены для обмена информацией между веб-страницей и поисковыми системами, браузерами и другими веб-службами. С ними роботы 🤖 и устройства ведут себя более ожидаемо.
Показать полный список мета-тегов
| Тип | Название | Значение |
|---|---|---|
| name | viewport | width=device-width, initial-scale=1 |
Оптимизация Готовность: 60%
Структура
Ошибок нет
Семантические HTML-элементы страницы
?
Проверяет наличие основных структурных элементов: nav, header, footer, main. Корректная семантическая структура помогает поисковику понять архитектуру страницы.
Структура документа корректна (теги <html> и <body> присутствуют в единственном экземпляре).
Контент
Есть ошибки
Объём и качество текстового содержимого
?
Анализирует объём полезного текста на странице. Слишком мало — страница может считаться малополезной. Слишком много — ухудшается читаемость и восприятие.
Слова из title 1 встречаются в тексте редко. Добавьте в контент страницы слова из тега <title>!
Абзацев с текстом 0 слишком мало. Добавьте больше абзацев с текстом (тег <p>)!
Среднее число слов в абзаце 0 слишком мало. Сделайте контент более читаемым!
Кол-во знаков контента 42733 на странице оптимально.
Кол-во слов 5729 на странице оптимально.
Заголовки
Ошибок нет
Иерархия заголовков H1–H6
?
H1 должен быть один и содержать ключевой запрос. H2–H6 описывают подразделы. Пропуск уровней (H1 → H3) и несколько H1 — типичные ошибки, снижающие понятность страницы для поисковика.
На странице присутствуют заголовки <h1> 1. Это прекрасно.
На странице присутствуют заголовки <h2> 12. Это хорошо.
Тошнота
8,19
Насколько одно слово доминирует в тексте
?
Классическая тошнота = √(частота самого повторяющегося слова). Норма до 7–8: текст воспринимается естественно. Выше — поисковик может счесть страницу переспамленной.
Тошнота превышает норму 5. Измените текст страницы!
Академич. тошнота
10,26%
Насколько текст перенасыщен ключевыми словами
?
Академическая тошнота = (частота слова / общее количество слов) × 100%. Показывает долю конкретного слова в тексте. Норма 5–15%.
Академическая тошнота страницы в пределах нормы.
Семантическое ядро
20
Наиболее часто встречающиеся слова на странице
?
Топ слов по частоте использования. Показывает, какие слова доминируют в тексте с точки зрения поисковика.
Контент страницы содержит осмысленный текст и слова.
Показать список слов
| Слово | Кол-во | Частота |
|---|---|---|
| murawaki | 67 | 1,17% |
| language | 61 | 1,06% |
| 言語処理学会 | 46 | 0,80% |
| slides | 44 | 0,77% |
| conference | 37 | 0,65% |
| proceedings | 36 | 0,63% |
| kurohashi | 25 | 0,44% |
| manuscript | 23 | 0,40% |
| computational | 22 | 0,38% |
| author | 21 | 0,37% |
| processing | 20 | 0,35% |
| japanese | 17 | 0,30% |
| chenhui | 17 | 0,30% |
| international | 17 | 0,30% |
| poster | 17 | 0,30% |
| workshop | 17 | 0,30% |
| online | 17 | 0,30% |
| linguistics: | 16 | 0,28% |
| 京都大学工学部電気電子工学科 | 15 | 0,26% |
| evaluation | 13 | 0,23% |
Индексация Готовность: 0%
Индексирование
Есть ошибки
Разрешено ли индексирование страницы
?
Проверяет, не закрыта ли страница от индексации через robots.txt, meta robots или X-Robots-Tag. Страница, закрытая от индексации, не появится в поисковой выдаче.
Анкоров на странице 318 слишком много. Проведите ревизию и оптимизацию ссылок сайта.
Robots.txt
Не найден
Файл управления сканированием сайта роботами
?
Robots.txt указывает поисковым роботам, какие страницы сканировать, а какие — нет. Ошибки в файле могут случайно закрыть важные разделы от индексации.
Файл robots.txt не найден (ошибка 404). Крайне рекомендуем добавить файл robots.txt, это правило хорошего тона для поисковых роботов.
Sitemap
Кол-во: 0
XML-карта сайта для поисковиков
?
Sitemap.xml помогает поисковику быстрее находить и индексировать страницы. Особенно важен для крупных сайтов и новых страниц, на которые ещё нет входящих ссылок.
Robots.txt не содержит ссылку на карту сайта. Рекомендуется добавить карту сайта и указать ссылку на нее в robots.txt.
Внутренние ссылки
Кол-во: 94
Ссылки на другие страницы своего сайта
?
Внутренние ссылки распределяют ссылочный вес между страницами и помогают поисковику обходить сайт. Пустые анкоры и ссылки на запрещённые robots.txt страницы — типичные ошибки.
Внутренних ссылок на странице 94 оптимально.
Показать внутренние ссылки
| Url | Анкор | Состояние |
|---|---|---|
| /index.html |
murawaki.org
|
|
| /publications.html |
Publications
|
|
| /research/index.html |
Research Projects
|
|
| /misc/index.html |
Miscellaneous
|
|
| /pubdb/JoLE2018/paper.pdf |
accepted manuscript
|
|
| /pubdb/JoLE2018/supplement.pdf |
supplementary material
|
|
| /pubdb/LREC-COLING2024mt/slides.pdf |
slides
|
|
| /pubdb/LREC-COLING2024/poster.pdf |
poster
|
|
| /pubdb/LREC-COLING2024/video.mp4 |
pre-recorded video
|
|
| /pubdb/AACL2022nozaki.pdf |
author manuscript
|
|
| /pubdb/EMNLP2020/slides.pdf |
slides
|
|
| /pubdb/EMNLP2018/slides.pdf |
slides
|
|
| /pubdb/IJCNLP2017/slides.pdf |
slides
|
|
| /pubdb/COLING2016/errata |
errata
|
|
| /pubdb/NAACL2016/slides.pdf |
slides
|
|
| /pubdb/LREC2016/errata |
errata
|
|
| /pubdb/LREC2016/poster.pdf |
poster
|
|
| /research/wikify-data.html |
corpora
|
|
| /pubdb/NAACL2015/errata |
errata
|
|
| /pubdb/NAACL2015/poster.pdf |
poster
|
|
| /pubdb/IJCNLP2013/slides.pdf |
slides
|
|
| /pubdb/COLING2012/slides_split.pdf |
slides
|
|
| /pubdb/EMNLP2011/errata |
errata
|
|
| /pubdb/EMNLP2011/slide_split.pdf |
slides
|
|
| /pubdb/COLING2010/poster.pdf |
poster
|
|
| /pubdb/EMNLP2008/errata |
errata
|
|
| /pubdb/EMNLP2008/poster.pdf |
poster
|
|
| /pubdb/NL260/paper.pdf |
author manuscript
|
|
| /pubdb/NL253ueda.pdf |
author manuscript
|
|
| /pubdb/NLP2022umakoshi.pdf |
author manuscript
|
|
| /pubdb/NLP2022wada.pdf |
author manuscript
|
|
| /pubdb/NLP2021tanaka.pdf |
author manuscript
|
|
| /pubdb/NLP2021ozaki.pdf |
author manuscript
|
|
| /pubdb/NLP2021tanaka.pdf |
author manuscript
|
|
| /pubdb/NLP2019kiyomaru.pdf |
author manuscript
|
|
| /pubdb/NLP2019kameko.pdf |
author manuscript
|
|
| /pubdb/NLP2019nakagawa.pdf |
author manuscript
|
|
| /pubdb/NLP2018drr/NLP_kishimoto.pdf |
author manuscript
|
|
| /pubdb/NLP2018bwo/NLP.pdf |
author manuscript
|
|
| /pubdb/NLP2017ibp/NLP.pdf |
author manuscript
|
|
| /pubdb/NLP2017ibp/slides.pdf |
slides
|
|
| /pubdb/NLP2017kishimoto.pdf |
author manuscript
|
|
| /pubdb/NLP2016creole/NLP.pdf |
author manuscript
|
|
| /pubdb/NLP2016creole/errata |
errata
|
|
| /pubdb/NLP2016creole/slides.pdf |
slides
|
|
| /pubdb/NLP2015/NLP.pdf |
author manuscript
|
|
| /pubdb/NLP2015/slides.pdf |
slides
|
|
| /pubdb/YANS2014/paper.pdf |
author manuscript
|
|
| /pubdb/YANS2014/slides.pdf |
slides
|
|
| /pubdb/NLP2014/errata |
errata
|
|
| /pubdb/NLP2014/slides.pdf |
slides
|
|
| /pubdb/NL214/slides.pdf |
slides
|
|
| /pubdb/NLP2013/slides.pdf |
slides
|
|
| /pubdb/NLP2012/errata |
errata
|
|
| /pubdb/NLP2012/slides.pdf |
slides
|
|
| /pubdb/NLP_Mining01/paper.pdf |
author manuscript
|
|
| /pubdb/NLC_Mining01/slide.pdf |
slides
|
|
| /pubdb/NLP2011/slide.pdf |
slides
|
|
| /pubdb/NLP2010o/errata |
errata
|
|
| /pubdb/NLP2010o/slide.pdf |
slides
|
|
| /pubdb/NLP2010p/poster.pdf |
poster
|
|
| /pubdb/NLP2009/errata |
errata
|
|
| /pubdb/NLP2009/slide.pdf |
slides
|
|
| /pubdb/NLP2008/slide.pdf |
slides
|
|
| /pubdb/TL2021/paper.pdf |
author manuscript
|
|
| /pubdb/TL2021/slides.pdf |
slides
|
|
| /pubdb/jshl20171209.pdf |
slides
|
|
| /pubdb/NLP2016tutorial/slides.pdf |
slides
|
|
| /pubdb/NL220/slides.pdf |
slides
|
|
| /pubdb/susemi202003/finaldraft.pdf |
final draft
|
|
| /pubdb/JSAI31_6/finaldraft.pdf |
author manuscript
|
|
| /pubdb/JSAI31_6/errata |
errata
|
|
| /pubdb/nlp_colloquium20251217.pdf |
slides
|
|
| /pubdb/meiwa202507.pdf |
slides
|
|
| /pubdb/spatiotemporal20250429.pdf |
slides
|
|
| /pubdb/fijigis2024fiji.pdf |
slides
|
|
| /pubdb/meiwa202308.pdf |
slides
|
|
| /pubdb/informatics20230222.pdf |
slides
|
|
| /pubdb/LRW2019.pdf |
slides
|
|
| /pubdb/yaponesian201902/abstract.pdf |
abstract
|
|
| /pubdb/yaponesian201902/slides.pdf |
slides
|
|
| /pubdb/ICT2019poster.pdf |
poster
|
|
| /pubdb/uzh20180320.pdf |
slides
|
|
| /pubdb/statling20180202.pdf |
slides
|
|
| /pubdb/im2017.pdf |
lightning talk slides
|
|
| /pubdb/ninjal20171205.pdf |
slides
|
|
| /pubdb/YANS2017/booster.pdf |
booster
|
|
| /pubdb/YANS2017/poster.pdf |
poster
|
|
| /pubdb/ud_meeting20170626.pdf |
slides
|
|
| /pubdb/STATLING2015/slides.pdf |
slides
|
|
| /pubdb/ict2010.pdf |
poster
|
|
| /pubdb/IME2009/slide.pdf |
slides
|
|
| /pubdb/colloquium200812.pdf |
slides
|
|
| /pubdb/intrigger_workshop2008.pdf |
slides
|
|
Внешние ссылки
Кол-во: 224
Ссылки на сторонние сайты
?
Исходящие внешние ссылки передают часть ссылочного веса на чужие сайты. Ссылки на авторитетные ресурсы безопасны; ссылки на мусорные сайты могут навредить репутации страницы.
Внешних ссылок на странице 224 слишком много. Спрячьте лишние ссылки в тег noindex или атрибут rel='nofollow'!
Показать первые 100 внешних ссылок
| Url | Анкор |
|---|---|
| github.com |
code
|
| arxiv.org |
arXiv
|
| arxiv.org |
arXiv
|
| arxiv.org |
arXiv
|
| jstage.jst.go.jp |
J-STAGE
|
| ieeexplore.ieee.org |
paper
|
| jstage.jst.go.jp |
J-STAGE
|
| jstage.jst.go.jp |
J-STAGE
|
| jstage.jst.go.jp |
J-STAGE
|
| jstage.jst.go.jp |
J-STAGE
|
| mitpressjournals.org |
abstract
|
| mitpressjournals.org |
full text
|
| github.com |
code
|
| anlp.jp |
言語処理学会30周年記念論文賞
|
| jstage.jst.go.jp |
J-STAGE
|
| doi.org |
article
|
| github.com |
code
|
| journals.plos.org |
full text
|
| github.com |
code
|
| jstage.jst.go.jp |
J-STAGE
|
| jstage.jst.go.jp |
J-STAGE
|
| github.com |
code
|
| researchgate.net |
ResearchGate
|
| arxiv.org |
arXiv
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| lrec.elra.info |
paper
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| underline.io |
video
|
| github.com |
code
|
| aclanthology.org |
paper
|
| github.com |
code
|
| arxiv.org |
arXiv
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| aclanthology.org |
paper
|
| arxiv.org |
earlier arXiv version
|
| aclanthology.org |
paper
|
| nlp.ist.i.kyoto-u.ac.jp |
dataset
|
| aclanthology.org |
paper
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| aclanthology.org |
paper
|
| github.com |
code
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| github.com |
code
|
| aclanthology.org |
paper
|
| aclanthology.org |
paper
|
| underline.io |
video
|
| github.com |
code
|
| arxiv.org |
arXiv
|
| aclanthology.org |
paper
|
| underline.io |
video
|
| aclanthology.org |
paper
|
| openreview.net |
OpenReview
|
| shyyhs.github.io |
ACL2020 workshop poster
|
| shyyhs.github.io |
ACL2020 workshop video
|
| lotus.kuee.kyoto-u.ac.jp |
website
|
| aclanthology.org |
paper
|
| github.com |
code
|
| aclanthology.org |
paper
|
| nlp.ist.i.kyoto-u.ac.jp |
dataset
|
| lrec-conf.org |
paper
|
| aclanthology.org |
paper
|
| arxiv.org |
arXiv
|
| aclanthology.org |
paper
|
| github.com |
code
|
| link.springer.com |
paper
|
| easychair.org |
EasyChair preprint
|
| aclweb.org |
paper
|
| aclanthology.org |
supplementary material
|
| github.com |
code
|
| coling2018.org |
Area Chair Favorite
|
| aclweb.org |
paper
|
| lrec-conf.org |
paper
|
| lrec-conf.org |
paper
|
| lsta.media.kyoto-u.ac.jp |
corpus
|
| lrec-conf.org |
paper
|
| aclweb.org |
paper
|
| aclanthology.org |
supplementary material
|
| github.com |
code
|
| aclweb.org |
paper
|
| github.com |
code
|
| aclweb.org |
paper
|
Конкуренты Готовность: 0%
Конкуренты в Яндексе
Кол-во: 0
Топ сайтов-конкурентов в Яндексе
?
Сайты, чаще всего появляющиеся в ТОПе Яндекса по запросам из семантического ядра этой страницы.
Мы не нашли у вас конкурентов в Яндексе. Сайт или очень молодой или плохо продвигается.
Конкурентов в ТОП-10 Яндекса не нашлось.
Конкуренты в Google
Кол-во: 0
Топ сайтов-конкурентов в Google
?
Сайты, чаще всего появляющиеся в ТОПе Google по запросам из семантического ядра этой страницы.
Конкуренты в Google тоже не найдены. Займитесь продвижением сайта!
Конкурентов в ТОП-10 Google не нашлось.
ЗоЗПП: права потребителей Готовность: 100%
Нарушения
Не выявлены
Признаков дистанционной продажи товаров (интернет-магазина) не обнаружено — требования ЗоЗПП о раскрытии информации продавца к сайту не применяются. Нарушений нет.
ФЗ-149: рекомендательные технологии Готовность: 100%
Нарушения
Не выявлены
Рекомендательные блоки («с этим покупают», «похожие товары» и т.п.) на сайте не обнаружены — требования ст. 10.7 ФЗ-149 к сайту не применяются. Нарушений нет.
ФЗ-38: реклама Готовность: 100%
Нарушения
Не выявлены
Рекламных тематик с обязательными оговорками (медицина, БАД, кредиты и займы, новостройки) на сайте не обнаружено. Нарушений нет.
ФЗ-436: защита детей Готовность: 100%
Нарушения
Не выявлены
Признаков информационной продукции (новости, видео, книги, игры, курсы) не обнаружено — обязательная возрастная маркировка по ФЗ-436 сайту не требуется. Нарушений нет.
Вердикт
Страница https://murawaki.org/publications.html готова к продвижению на 48%. Чтобы еще улучшить страницу и попасть на первые места поисковой выдачи необходимо:
Исправьте ошибки в мета-тегах.
Исправьте ошибки оптимизации.
Исправьте ошибки индексации.
Поделитесь с друзьями: