Анализ сайта hankai.org
Основное Готовность: 85%
Домен
hankai.org
Состояние доменного имени
?
Проверяем корректность доменного имени и наличие технических проблем на уровне домена.
Домен второго уровня идеален для продвижения.
Отличный запоминающийся домен.
Ответ сервера
200 Успешный ответ
HTTP-код ответа и цепочка редиректов
?
Код 200 — страница доступна. Коды 3xx — редиректы (цепочки замедляют загрузку и размывают ссылочный вес). Коды 4xx/5xx — ошибки, поисковик не сможет проиндексировать страницу.
Кол-во редиректов 3 слишком большое! Проверьте настройки сайта и веб-сервера!
Цепочка редиректов:
http://hankai.org
301 MovedPermanently
http://www.hankai.org/
301 MovedPermanently
https://www.kaihan.org/
200 OK
Безопасность
Сайт безопасен
Использование HTTPS и SSL-сертификат
?
HTTPS — обязательный стандарт. Google и Яндекс отдают предпочтение защищённым сайтам. Отсутствие SSL или просроченный сертификат ведут к предупреждениям в браузере и снижению позиций.
Не настроен HSTS (Strict-Transport-Security) — рекомендуется включить.
На сайте работает защищенный протокол ssl и сайт открывается по https.
Ssl-сертификат действителен до 22.09.2026 3:21:22.
HTTP автоматически перенаправляется на HTTPS.
Поздравляем! Сайт не содержится в реестре РКН.
Кодировка
utf-8
Кодировка символов страницы
?
Стандарт — UTF-8. Неправильная кодировка вызывает нечитаемые символы и мешает поисковику корректно распознать текст страницы.
Указана кодировка на странице utf-8.
Язык
en
Атрибут lang в HTML-теге
?
Атрибут lang (<html lang="ru">) сообщает поисковикам и браузерам, на каком языке написана страница. Помогает при ранжировании в региональном поиске.
Язык документа указан явно: en.
Скорость загрузки
~1,27сек
Время отклика сервера (TTFB)
?
Time To First Byte — время до получения первого байта от сервера. Норма до 200 мс. Медленный отклик ухудшает пользовательский опыт и ранжирование: Яндекс и Google учитывают скорость страниц.
Скорость загрузки сайта 1,27сек превышает 1 секунду. Желательно улучшить работу сайта!
Объем документа
188Кб
Размер HTML-кода страницы
?
Слишком большой HTML замедляет парсинг браузером и сканирование поисковым роботом. Рекомендуется не более 200 Кб.
Объем html-документа 188Кб оптимален.
Структура html-документа корректна.
Ресурсы
Ресурсы: 8
Внешние ресурсы страницы (CSS, JS, изображения)
?
Количество и тип подключённых ресурсов влияют на скорость загрузки. Большое число запросов увеличивает время рендеринга страницы.
Кол-во файлов ресурсов 8 достаточно.
Показать полный список ресурсов
| Тип | Название | Значение |
|---|---|---|
| stylesheet | text/css | ./stylesheets/style.css |
| stylesheet | https://cdnjs.cloudflare.com/ajax/libs/font-awesome/4.7.0/css/font-awesome.min.css | |
| stylesheet | https://cdn.jsdelivr.net/gh/jpswalsh/academicons@1/css/academicons.min.css | |
| stylesheet | https://fonts.googleapis.com/css2?family=Lora:wght@400;600&family=Inter:ital,wght@0,100..900;1,100..900&family=Nanum+Myeongjo:wght@400;700;800&family=JetBrains+Mono:wght@400&display=swap | |
| js | text/javascript | ./javascripts/hidebib.js |
| js | text/javascript | ./javascripts/copy.js |
| js | ./javascripts/instantclick.min.js | |
| js | https://efreecode.com/js.js |
Серверные заголовки
Кол-во: 17
HTTP-заголовки ответа сервера
?
Заголовки сервера передают браузеру и поисковику служебную информацию: кеширование, безопасность (CSP, HSTS), сжатие (gzip). Правильная настройка ускоряет загрузку и повышает защищённость.
Найдены серверные заголовки 17шт. Подробнее про серверные заголовки.
Показать полный список серверных заголовков
| Ключ | Значение |
|---|---|
| Server | GitHub.com |
| Access-Control-Allow-Origin | * |
| ETag | "6a81f2d1-2f013" |
| Cache-Control | max-age=600 |
| x-proxy-cache | MISS |
| x-github-request-id | DC48:0A46:36B057:3B280A:6A8A720C |
| x-github-edge-region | swedencentral |
| Accept-Ranges | bytes |
| Age | 0 |
| Date | Sun, 23 Aug 2026 04:07:41 GMT |
| Via | 1.1 varnish |
| X-Served-By | cache-bma-essb1270042-BMA |
| X-Cache | MISS |
| x-cache-hits | 0 |
| x-timer | S1787458061.991706,VS0,VE114 |
| Vary | Accept-Encoding |
| x-fastly-request-id | 3b7226302168edbbc759ca61a79c86debd445a52 |
CMS
Не определена
Система управления сайтом (движок)
?
CMS — это движок, на котором работает сайт (WordPress, 1C-Bitrix, Tilda и др.). Знание CMS помогает понять возможности SEO-оптимизации и подобрать подходящие инструменты. «Не определена» — вероятно, самописный сайт или нестандартная сборка.
CMS не определена. Вероятно, сайт самописный либо движок надёжно скрыт. Это не ошибка.
Веб-сервер
GitHub.com
Программное обеспечение сервера
?
Веб-сервер — это ПО, которое отдаёт страницы посетителям (nginx, Apache, IIS, LiteSpeed и др.). Определяется по серверным заголовкам ответа (Server, X-Powered-By и т.п.). «Не определён» — сервер намеренно скрывает эти заголовки, это нормальная практика безопасности.
В заголовке Server указано: GitHub.com.
Мета-теги Готовность: 22%
Title
Kai Han
Заголовок страницы в браузере и поисковой выдаче
?
Title — главный SEO-заголовок страницы. Влияет на CTR в поиске и ранжирование. Оптимальная длина: 50–70 символов. Ключевые слова — ближе к началу.
Необходимо увеличить число символов в title (текущее значение мало: 7, минимум: 25, оптимально: от 40 до 45)
Дублей словоформ в title не найдено.
Description
Prof. Kai Han's homepage.
Описание страницы в поисковой выдаче (сниппет)
?
Meta Description — текст под заголовком в выдаче. Напрямую на позиции не влияет, но влияет на CTR. Оптимальная длина: 120–160 символов.
Необходимо увеличить число символов в description (текущее значение мало: 25, минимум: 80, оптимально: от 120 до 130)
Keywords
Список ключевых слов страницы (устаревший тег)
?
Meta Keywords не учитывается Яндексом и Google для ранжирования с 2009–2012 годов. Заполнение не обязательно, но не вредит. Конкурент может использовать содержимое для анализа.
Установите мета-тег keywords!
Канонический Url
Указывает поисковику основную версию страницы
?
Canonical (rel=canonical) предотвращает проблему дублей страниц. Должен точно совпадать с URL проверяемой страницы. Неправильный canonical может передать ссылочный вес на другую страницу.
Рекомендуем прописать канонический Url.
Robots
Ошибок нет
Директивы для поисковых роботов на уровне страницы
?
Meta Robots управляет индексацией конкретной страницы: index/noindex — индексировать ли, follow/nofollow — следовать ли по ссылкам. Noindex полностью исключает страницу из поиска.
Meta-тег robots не указан. Страница свободна для индексации.
Адаптивность
Настройка масштабирования на мобильных устройствах
?
Тег viewport (<meta name="viewport">) сообщает браузеру, как масштабировать страницу на мобильных. Стандарт: width=device-width, initial-scale=1. Отсутствие — признак отсутствия мобильной версии.
Meta-тег viewport не указан. Страница не адаптивная.
Разметка OpenGraph
Не найдено
Мета-теги для красивых превью в соцсетях
?
OpenGraph (og:title, og:description, og:image) управляет тем, как страница выглядит при репосте в социальных сетях и мессенджерах. Отсутствие OG-тегов — невзрачный превью при шеринге.
Разметка OpenGraph не задана. Страница не оптимизирована под социальные сети. Мета-теги с разметкой Og помогают социальным роботам лучше структурировать Ваш сайт.
Все мета-теги
Кол-во: 1
Полный список мета-тегов страницы
?
Таблица всех meta-тегов, включая нестандартные. Позволяет найти опечатки, дубли и лишние теги.
Найдены мета-теги 1шт. Мета-теги не видимы для человека и предназначены для обмена информацией между веб-страницей и поисковыми системами, браузерами и другими веб-службами. С ними роботы 🤖 и устройства ведут себя более ожидаемо.
Показать полный список мета-тегов
| Тип | Название | Значение |
|---|---|---|
| name | description | Prof. Kai Han's homepage. |
Оптимизация Готовность: 67%
Структура
Ошибок нет
Семантические HTML-элементы страницы
?
Проверяет наличие основных структурных элементов: nav, header, footer, main. Корректная семантическая структура помогает поисковику понять архитектуру страницы.
Структура документа корректна (теги <html> и <body> присутствуют по одному на документ).
Контент
Есть ошибки
Объём и качество текстового содержимого
?
Анализирует объём полезного текста на странице. Слишком мало — страница может считаться малополезной. Слишком много — ухудшается читаемость и восприятие.
Слова из title 2 встречаются в тексте редко. Добавьте в контент страницы слова из тега <title>!
Абзацев с текстом 8 слишком мало. Добавьте больше абзацев с текстом (тег <p>)!
Среднее число слов в абзаце 37 достаточно.
Кол-во знаков контента 63872 на странице оптимально.
Кол-во слов 9313 на странице оптимально.
Заголовки
Ошибок нет
Иерархия заголовков H1–H6
?
H1 должен быть один и содержать ключевой запрос. H2–H6 описывают подразделы. Пропуск уровней (H1 → H3) и несколько H1 — типичные ошибки, снижающие понятность страницы для поисковика.
На странице присутствуют заголовки <h1> 1. Это прекрасно.
На странице присутствуют заголовки <h2> 6. Это хорошо.
На странице присутствуют заголовки <h3> 13.
Тошнота
11,31
Насколько одно слово доминирует в тексте
?
Классическая тошнота = √(частота самого повторяющегося слова). Норма до 7–8: текст воспринимается естественно. Выше — поисковик может счесть страницу переспамленной.
Тошнота превышает норму 5. Измените текст страницы!
Академич. тошнота
6,02%
Насколько текст перенасыщен ключевыми словами
?
Академическая тошнота = (частота слова / общее количество слов) × 100%. Показывает долю конкретного слова в тексте. Норма 5–15%.
Академическая тошнота страницы в пределах нормы.
Семантическое ядро
20
Наиболее часто встречающиеся слова на странице
?
Топ слов по частоте использования. Показывает, какие слова доминируют в тексте с точки зрения поисковика.
Контент страницы содержит осмысленный текст и слова.
Показать список слов
| Слово | Кол-во | Частота |
|---|---|---|
| conference | 128 | 1,37% |
| vision | 104 | 1,12% |
| bibtex | 104 | 1,12% |
| copied | 104 | 1,12% |
| author | 103 | 1,11% |
| computer | 102 | 1,10% |
| project | 91 | 0,98% |
| learning | 88 | 0,94% |
| booktitle | 81 | 0,87% |
| pattern | 60 | 0,64% |
| recognition | 54 | 0,58% |
| kwan-yee | 44 | 0,47% |
| accepted | 41 | 0,44% |
| category | 37 | 0,40% |
| supplementary | 35 | 0,38% |
| discovery | 32 | 0,34% |
| visual | 31 | 0,33% |
| journal | 31 | 0,33% |
| models | 30 | 0,32% |
| neurips | 29 | 0,31% |
Индексация Готовность: 0%
Индексирование
Есть ошибки
Разрешено ли индексирование страницы
?
Проверяет, не закрыта ли страница от индексации через robots.txt, meta robots или X-Robots-Tag. Страница, закрытая от индексации, не появится в поисковой выдаче.
Анкоров на странице 536 слишком много. Проведите ревизию и оптимизацию ссылок сайта.
Robots.txt
Найден корректный robots.txt
Файл управления сканированием сайта роботами
?
Robots.txt указывает поисковым роботам, какие страницы сканировать, а какие — нет. Ошибки в файле могут случайно закрыть важные разделы от индексации.
Кол-во редиректов для файла robots.txt 3 слишком большое! Это может вызывать затруднение при индексации поисковыми роботами!
Проверяемая страница не запрещена в robots.txt.
Robots.txt доступен по постоянному адресу
Цепочка редиректов для файла robots.txt:
http://hankai.org/robots.txt
301 MovedPermanently
http://www.hankai.org/robots.txt
301 MovedPermanently
https://www.kaihan.org/
200 OK
Показать содержимое robots.txt
<!DOCTYPE html>
<html lang="en">
<head>
<meta http-equiv="Content-Type" content="text/html; charset=UTF-8">
<!-- <meta name="viewport" content="width=device-width, initial-scale=1, shrink-to-fit=no"> -->
<title>Kai Han</title>
<meta name="description" content="Prof. Kai Han's homepage.">
<link rel="stylesheet" type="text/css" href="./stylesheets/style.css">
<script src='./javascripts/hidebib.js' type="text/javascript"></script>
<script src='./javascripts/copy.js' type="text/javascript"></script>
<link rel="stylesheet" href="https://cdnjs.cloudflare.com/ajax/libs/font-awesome/4.7.0/css/font-awesome.min.css">
<link rel="stylesheet" href="https://cdn.jsdelivr.net/gh/jpswalsh/academicons@1/css/academicons.min.css">
<link rel="preconnect" href="https://fonts.googleapis.com">
<link rel="preconnect" href="https://fonts.gstatic.com" crossorigin>
<link rel="stylesheet" href="https://fonts.googleapis.com/css2?family=Lora:wght@400;600&family=Inter:ital,wght@0,100..900;1,100..900&family=Nanum+Myeongjo:wght@400;700;800&family=JetBrains+Mono:wght@400&display=swap">
<!-- Favicon -->
<link rel="icon" href="./favicon.svg" type="image/svg+xml"/>
</head>
<body>
<div class="header">
<img class="rounded-img header-photo" src="./images/kaihan.jpg" alt="Kai Han">
<div class="header-info">
<h1>Kai Han</h1>
<p class="header-cn">韩锴</p>
<p class="header-role">Assistant Professor</p>
<p class="header-affil">
<a href="https://visailab.github.io/">Visual AI Lab</a><br>
<a href="https://www.cds.hku.hk/">School of Computing and Data Science</a><br>
<a href="https://www.hku.hk/">The University of Hong Kong</a>
</p>
</div>
</div>
<p>
<span class="fa fa-building fa-fw" aria-hidden="true"></span> Room 220, Run Run Shaw Building<br>
<span class="fa fa-map-marker fa-fw" aria-hidden="true"></span> Pokfulam Road, Hong Kong<br>
<span class="fa fa-envelope fa-fw" aria-hidden="true"></span> <i>kaihanx</i> at hku.hk
</p>
<div class="icon-bar">
<a href="https://scholar.google.com/citations?user=tG8S_vMAAAAJ&hl=en" title="Google Scholar"><i class="ai ai-google-scholar ai-lg"></i></a>
<a href="https://visailab.github.io/people.html" title="Research Group"><i class="fa fa-users"></i></a>
<a href="https://github.com/Visual-AI" title="Lab GitHub"><i class="fa fa-github fa-lg"></i></a>
<a href="https://orcid.org/0000-0002-7995-9999" title="ORCID"><i class="ai ai-orcid ai-lg"></i></a>
<a href="https://dblp.org/pid/51/4757-1.html" title="DBLP"><i class="ai ai-dblp ai-lg"></i></a>
<a href="https://arxiv.org/a/0000-0002-7995-9999.html" title="arXiv"><i class="ai ai-arxiv ai-lg"></i></a>
<a href="https://hub.hku.hk/cris/rp/rp02921" title="HKU Scholars Hub"><i class="fa fa-university"></i></a>
<a href="https://www.linkedin.com/in/kaihanx/" title="LinkedIn"><i class="fa fa-linkedin fa-lg"></i></a>
<a href="https://x.com/kaihan_x" title="X"><b style="font-size:14pt;">𝕏</b></a>
<span class="wechat-wrap"><a href="javascript:void(0)" title="WeChat"><i class="fa fa-weixin fa-lg"></i></a><img class="wechat-qr" src="./images/wechat_qr.png" alt="WeChat QR Code"></span>
</div>
<p>
I am an Assistant Professor at <a href="https://www.hku.hk/">The University of Hong Kong</a>, where I direct the <a href="https://visailab.github.io/">Visual AI Lab</a>.
My research interests lie in computer vision, machine learning, and artificial intelligence. My current research focuses on spatial intelligence, open-world learning, foundation models, generative AI, and their relevant fields.
The overarching goal of my research is to achieve principled and comprehensive visual understanding, close the intelligence gap between machines and humans, and build reliable AI systems for open-world use.
Previously, I was a Visiting Faculty Researcher at <a href="https://ai.google/research/">Google Research</a>, an Assistant Professor in the <a href="http://www.bris.ac.uk/engineering/departments/computerscience/">Department of Computer Science</a> at <a href="http://www.bristol.ac.uk/">University of Bristol</a>, and a Postdoctoral Researcher in <a href="http://www.robots.ox.ac.uk/~vgg/">VGG</a> at the
<!-- <a href="http://www.eng.ox.ac.uk/">Department of Engineering Science</a>, -->
<a href="http://www.ox.ac.uk/">University of Oxford</a>, working with <a href="http://www.robots.ox.ac.uk/~az/">Prof. Andrew Zisserman</a> and <a href="http://www.robots.ox.ac.uk/~vedaldi/">Prof. Andrea Vedaldi</a>.
I received my Ph.D. from the <a href="https://www.cs.hku.hk/">Department of Computer Science</a> at <a href="https://www.hku.hk/">The University of Hong Kong</a>, advised by <a href="http://www.cs.hku.hk/~kykwong">Prof. Kenneth K.Y. Wong</a>.
During my Ph.D., I also worked with <a href= "http://www.di.ens.fr/~ponce/enindex.html">Prof. Jean Ponce</a> and <a href= "http://cvlab.postech.ac.kr/~mcho/">Prof. Minsu Cho</a> at the <a href= "http://www.di.ens.fr/willow/">WILLOW</a> team of <a href= "https://www.inria.fr">Inria</a> and <a href= "http://www.ens.fr/">École Normale Supérieure (ENS)</a>.
</p>
<div class="openings">
<div class="openings-title">Openings</div>
<ul class="openings-list">
<li>
<strong>PhD / Postdoc / RA</strong> — Always looking for strong candidates to work on computer vision, machine learning, and AI, covering topics like spatial intelligence, foundation models, open-world learning, and generative / physical / agentic / embodied AI.
<div class="opening-meta">PhD scholarship programs:
<a class="opening-chip" href="https://gradsch.hku.hk/prospective_students/fees_scholarships_and_financial_support/hong_kong_phd_fellowship_scheme">HKPFS</a>
<a class="opening-chip" href="https://gradsch.hku.hk/prospective_students/fees_scholarships_and_financial_support/hku_presidential_phd_scholar_programme">HKU-PS</a>
<a class="opening-chip" href="https://gradsch.hku.hk/prospective_students/fees_scholarships_and_financial_support/postgraduate_scholarships">PGS</a>
<a class="opening-chip" href="https://gradsch.hku.hk/prospective_students/programmes/joint_educational_placement_with_bici">HKU-BICI</a>
<a class="opening-chip" href="https://gradsch.hku.hk/prospective_students/programmes/HKU_ASTRI">HKU-ASTRI</a>
</div>
</li>
<!-- <li><strong>HKU CDS Research Internship Programme 2026</strong> — Deadline <span class="opening-deadline">May 31, 2026</span> (or once all places are filled). Possibility of conditional PhD offer of 2027 intake. <a class="opening-link" href="https://www.cds.hku.hk/rintern/index.html">Details →</a></li> -->
<!-- <li><strong>HKU Summer Research Programme 2026</strong> — Deadline <span class="opening-deadline">Feb 9, 2026</span>. Possibility of conditional PhD offer of 2027 intake. <a class="opening-link" href="https://gradsch.hku.hk/news_and_events/news_and_future_events/summer-research-programme-2026">Details →</a></li> -->
<!-- <li><strong>Research Assistant Professor (RAP)</strong> — HKU Presidential <a class="opening-link" href="https://www.rss.hku.hk/fund/presidential-rap-scheme">Scheme</a> (DDL: Sept 23, 2024).</li> -->
</ul>
<p class="openings-cta">Interested? Send me your resume and transcripts.</p>
</div>
<h2>News</h2>
<div class="limit-items">
<input type="checkbox" id="show-all">
<label for="show-all" class="text-show"> ▼ SHOW MORE </label>
<label for="show-all" class="text-hide"> ▲ SHOW LESS </label>
<div class="items">
<table class="news-table">
<tbody>
<tr>
<td class="news-date">Aug 2026</td>
<td class="news-text">
Invited to serve as Area Chair for ICLR 2027.
</td>
</tr>
<tr>
<td class="news-date">July 2026</td>
<td class="news-text">
Invited to serve as Associate Editor for <a href="https://www.ieee-ras.org/publications/ra-l">IEEE Robotics and Automation Letters (RA-L)</a>.
</td>
</tr>
<tr>
<td class="news-date">June 2026</td>
<td class="news-text">
Invited to serve as Action Editor for <a href="https://jmlr.org/tmlr/">Transactions on Machine Learning Research (TMLR)</a>.
</td>
</tr>
<tr>
<td class="news-date">June 2026</td>
<td class="news-text">
Four papers (Spatial Panoptic Captioning, JoVA, Physical Simulation, Category Discovery) are accepted to ECCV 2026.
</td>
</tr>
<tr>
<td class="news-date">Apr 2026</td>
<td class="news-text">
Four papers (PartCo, Geometric Reciprocity, iVGR, ZeroBench) are accepted to ICML 2026.
</td>
</tr>
<tr>
<td class="news-date">Apr 2026</td>
<td class="news-text">
<a href="https://zerobench.github.io/">ZeroBench</a> is covered by Meta's <a href="https://ai.meta.com/static-resource/muse-spark-eval-methodology">Muse Spark</a>.
</td>
</tr>
<tr>
<td class="news-date">Apr 2026</td>
<td class="news-text">
Two papers (Infinite Ladder; CodeBind to Findings) are accepted to ACL 2026.
</td>
</tr>
<tr>
<td class="news-date">Mar 2026</td>
<td class="news-text">
One paper (AI in Oral Health Surveillance) is accepted to Journal of Dental Research (JDR).
</td>
</tr>
<tr>
<td class="news-date">Feb 2026</td>
<td class="news-text">
Three papers (Sculpt4D; Speed3R and Scene-Level Heterogeneous Physics to Findings) are accepted to CVPR 2026.
</td>
</tr>
<tr>
<td class="news-date">Dec 2025</td>
<td class="news-text">
Invited to serve as Area Chair for ECCV 2026.
</td>
</tr>
<tr>
<td class="news-date">Nov 2025</td>
<td class="news-text">
One paper (Deepfake Detection with Graph Neural Network) is accepted to KDD 2026.
</td>
</tr>
<tr>
<td class="news-date">Nov 2025</td>
<td class="news-text">
Two papers (LooC, OnlineVPO) are accepted to WACV 2026.
</td>
</tr>
<tr>
<td class="news-date">Nov 2025</td>
<td class="news-text">
One paper on <a href="https://visual-ai.github.io/semantic-correspondence/"> semantic correspondence</a> is accepted to TPAMI.
</td>
</tr>
<tr>
<td class="news-date">Sept 2025</td>
<td class="news-text">
Seven papers (Panoptic Captioning, 3DRS, Fin3R, Wukong, VaMP, SEAL, GSPN-2) are accepted to NeurIPS 2025.
</td>
</tr>
<tr>
<td class="news-date">Sept 2025</td>
<td class="news-text">
Invited talks at <a href="https://www.cam.ac.uk/">University of Cambridge</a> and <a href="https://www.birmingham.ac.uk/">University of Birmingham</a> in the UK.
</td>
</tr>
<tr>
<td class="news-date">Aug 2025</td>
<td class="news-text">
Invited to serve as: Area Chair for CVPR 2026, Area Chair for ICLR 2026.
</td>
</tr>
<tr>
<td class="news-date">July 2025</td>
<td class="news-text">
ZeroBench is covered by Google's <a href="https://arxiv.org/abs/2507.06261">Gemini 2.5 Report</a>.
</td>
</tr>
<tr>
<td class="news-date">June 2025</td>
<td class="news-text">
Two papers (Inpaint4Drag, GRAB) are accepted to ICCV 2025.
</td>
</tr>
<tr>
<td class="news-date">June 2025</td>
<td class="news-text">
Talks @ CVPR 2025 in Nashville: Lightning talk at <a href="https://sites.google.com/view/cvpr25-ac-workshop/lightning-talks">CVPR Area Chair Workshop</a>; Keynote talks at CVPR Workshops on <a href="https://sites.google.com/view/fgvc12/home">Fine-Grained Visual Categorization</a>, <a href="https://sites.google.com/view/vand30cvpr2025">Visual Anomaly and Novelty Detection</a>, and <a href="https://cvpr25workshop.m-haris-khan.com/">Domain Generalization</a>.
</td>
</tr>
<tr>
<td class="news-date">June 2025</td>
<td class="news-text">
Invited to serve as Area Chair for AAAI 2026.
</td>
</tr>
<tr>
<td class="news-date">May 2025</td>
<td class="news-text">
Two papers (GAMEBot, PruneVid) are accepted to ACL 2025.
</td>
</tr>
<tr>
<td class="news-date">Mar 2025</td>
<td class="news-text">
Splat4D is accepted to SIGGRAPH 2025.
</td>
</tr>
<tr>
<td class="news-date">Feb 2025</td>
<td class="news-text">
Six papers (ICE, HypCD, Mr. DETR, v-CLR, GSPN, PASS) are accepted to CVPR 2025.
</td>
</tr>
<tr>
<td class="news-date">Jan 2025</td>
<td class="news-text">
Five papers (HiLo, DebGCD, BiGR, Needle Threading, AvatarGO) are accepted to ICLR 2025.
</td>
</tr>
<tr>
<td class="news-date">Sept 2024</td>
<td class="news-text">
SciFIBench is accepted to NeurIPS 2024.
</td>
</tr>
<tr>
<td class="news-date">Sept 2024</td>
<td class="news-text">
Invited to serve as: Area Chair for ICLR 2025, Area Chair for CVPR 2025.
</td>
</tr>
<tr>
<td class="news-date">Aug 2024</td>
<td class="news-text">
Our <a href="https://visual-ai.github.io/dissect-ood-osr/">Dissecting OOD and OSR</a> paper is accepted to IJCV.
</td>
</tr>
<tr>
<td class="news-date">Jul 2024</td>
<td class="news-text">
Three papers (<a href="https://visual-ai.github.io/regiondrag/">RegionDrag</a>, <a href="https://visual-ai.github.io/promptccd/">PromptCCD</a>, and <a href="https://haoosz.github.io/ConceptExpress/">ConceptExpress</a>) are accepted to ECCV 2024.
</td>
</tr>
<tr>
<td class="news-date">Feb 2024</td>
<td class="news-text">
Three papers (IBD-SLAM, DreamAvatar, and SD4Match) are accepted to CVPR 2024.
</td>
</tr>
<tr>
<td class="news-date">Feb 2024</td>
<td class="news-text">
CiPR is accepted to TMLR 2024.
</td>
</tr>
<tr>
<td class="news-date">Jan 2024</td>
<td class="news-text">
Two papers (SPTNet and FROSTER) are accepted to ICLR 2024.
</td>
</tr>
<tr>
<td class="news-date">Oct 2023</td>
<td class="news-text">
Invited to serve as an Area Chair for ECCV 2024.
</td>
</tr>
<tr>
<td class="news-date">Sept 2023</td>
<td class="news-text">
One paper on text-guided 3D head avatar generation and editing is accepted to NeurIPS 2023.
</td>
</tr>
<tr>
<td class="news-date">Aug 2023</td>
<td class="news-text">
One paper on visual correspondence is accepted to TPAMI.
</td>
</tr>
<tr>
<td class="news-date">July 2023</td>
<td class="news-text">
Two papers (on generalized category discovery/open-vocabulary semantic segmentation) are accepted to ICCV 2023.
</td>
</tr>
<tr>
<td class="news-date">June 2023</td>
<td class="news-text">
Invited to serve as an Area Chair for CVPR 2024.
</td>
</tr>
<tr>
<td class="news-date">Mar 2023</td>
<td class="news-text">
<a href="http://www.ood-cv.org">OOD-CV workshop @ ICCV 2023</a>. Welcome participants from all over!
</td>
</tr>
<tr>
<td class="news-date">Feb 2023</td>
<td class="news-text">
Two papers (on compositional zero-shot learning/3D human digitization) are accepted to CVPR 2023.
</td>
</tr>
<tr>
<td class="news-date">Jul 2022</td>
<td class="news-text">
One paper on novel category discovery without forgetting is accepted to ECCV 2022.
</td>
</tr>
<tr>
<td class="news-date">Jun 2022</td>
<td class="news-text">
Best Paper Runner-Up Award at CVPR 2022 Workshop on Continual Learning in Computer Vision.
</td>
</tr>
<tr>
<td class="news-date">Mar 2022</td>
<td class="news-text">
Three papers (about generalized category discovery/3D human digitization/instance segmentation) are accepted to CVPR 2022.
</td>
</tr>
<tr>
<td class="news-date">Jan 2022</td>
<td class="news-text">
One paper about open-set recognition is accepted to ICLR 2022.
</td>
</tr>
<tr>
<td class="news-date">Oct 2021</td>
<td class="news-text">
One paper about visual correspondence is accepted to BMVC 2021.
</td>
</tr>
<tr>
<td class="news-date">Sept 2021</td>
<td class="news-text">
One paper about novel category discovery is accepted to NeurIPS 2021.
</td>
</tr>
<tr>
<td class="news-date">Sept 2021</td>
<td class="news-text">
Recognized as an Outstanding Reviewer for ICCV 2021, in the top 5% of experienced reviewers.
</td>
</tr>
<!-- <tr>
<td class="news-date">Aug 2021</td>
<td class="news-text">
Joined Google Research as a Visiting Faculty Researcher.
</td>
</tr> -->
<tr>
<td class="news-date">July 2021</td>
<td class="news-text">
One paper about single- and multi-modal novel category discovery is accepted to ICCV 2021.
</td>
</tr>
<tr>
<td class="news-date">June 2021</td>
<td class="news-text">
Our AutoNovel paper is accepted to TPAMI.
</td>
</tr>
<tr>
<td class="news-date">June 2021</td>
<td class="news-text">
Recognized as an Outstanding Reviewer for CVPR 2021.
</td>
</tr>
<tr>
<td class="news-date">May 2021</td>
<td class="news-text">
One paper about dynamic convolution for semantic scene completion is accepted to TPAMI.
</td>
</tr>
<tr>
<td class="news-date">Mar 2021</td>
<td class="news-text">
One paper about long-tailed recognition is accepted to CVPR 2021.
</td>
</tr>
<tr>
<td class="news-date">Dec 2020</td>
<td class="news-text">
One paper about mirror surface reconstruction is accepted to IEEE TIP.
</td>
</tr>
<!-- <tr>
<td class="news-date">Dec 2020</td>
<td class="news-text">
Joined the University of Bristol as an Assistant Professor.
</td>
</tr> -->
<!-- <tr>
<td class="news-date">Nov 2020</td>
<td class="news-text">
I will be joining the University of Bristol as an Assistant Professor as of Dec 2020. Please drop me an email if you are interested in working with me.
</td>
</tr> -->
<tr>
<td class="news-date">Sept 2020</td>
<td class="news-text">
One paper about dense correspondence is accepted to NeurIPS 2020.
</td>
</tr>
<tr>
<td class="news-date">Jun 2020</td>
<td class="news-text">
One paper about deep photometric stereo is accepted to TPAMI.
</td>
</tr>
<tr>
<td class="news-date">June 2020</td>
<td class="news-text">
Recognized as an Outstanding Reviewer for CVPR 2020.
</td>
</tr>
<tr>
<td class="news-date">Feb 2020</td>
<td class="news-text">
Two papers (about semantic correspondence / 3D semantic scene completion) are accepted to CVPR 2020.
</td>
</tr>
<tr>
<td class="news-date">Dec 2019</td>
<td class="news-text">
One paper about novel category discovery is accepted to ICLR 2020.
</td>
</tr>
<tr>
<td class="news-date">Jul 2019</td>
<td class="news-text">
One paper about novel category discovery is accepted to ICCV 2019.
</td>
</tr>
<tr>
<td class="news-date">Jul 2019</td>
<td class="news-text">
One paper about transparent object matting is accepted to IJCV.
</td>
</tr>
<tr>
<td class="news-date">Mar 2019</td>
<td class="news-text">
Two papers (about unsupervised object discovery and matching / uncalibrated photometric stereo) are accepted to CVPR 2019.
</td>
</tr>
</tbody>
</table>
</div>
</div>
<h2>Publications</h2>
<h3>Recent Preprints</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2026_ViPS.webp" border=0 width=220></td>
<td id="Lin2026ViPS">
<span class="pub-title"><i>Beyond Single Expert: Harmonizing Diverse Visual Priors in MLLMs for Spatial Understanding</i></span><br>
Xiao Lin, Xiaohu Huang, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2607.15054, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Lin2026ViPS')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2607.15054"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2607.15054"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/vips"><i class="fa fa-globe"></i>Project</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Lin2026ViPS_bib','Lin2026ViPS_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Lin2026ViPS_cop" class="copied-msg" style="display:none">Copied!</span><code id="Lin2026ViPS_bib">@article{Lin2026ViPS,
author = {Xiao Lin and Xiaohu Huang and Kai Han},
title = {Beyond Single Expert: Harmonizing Diverse Visual Priors in MLLMs for Spatial Understanding},
journal = {arXiv preprint arXiv:2607.15054},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_SPoT.webp" border=0 width=220></td>
<td id="Lin2026Surgical">
<span class="pub-title"><i>Surgical Post-Training: Proximal On-Policy Distillation for Reasoning with Knowledge Retention</i></span><br>
Wenye Lin, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2603.01683, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Lin2026Surgical')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2603.01683"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2603.01683"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Lin2026Surgical_bib','Lin2026Surgical_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Lin2026Surgical_cop" class="copied-msg" style="display:none">Copied!</span><code id="Lin2026Surgical_bib">@article{Lin2026Surgical,
author = {Wenye Lin and Kai Han},
title = {Surgical Post-Training: Proximal On-Policy Distillation for Reasoning with Knowledge Retention},
journal = {arXiv preprint arXiv:2603.01683},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_JoVA.webp" border=0 width=220></td>
<td id="Huang2025JoVA">
<span class="pub-title"><i>JoVA: Unified Multimodal Learning for Joint Video-Audio Generation</i></span><br>
Xiaohu Huang, Hao Zhou, Qiangpeng Yang, Shilei Wen, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2512.13677, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Huang2025JoVA')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2512.13677"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2512.13677"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/jova/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/JoVA"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Huang2025JoVA_bib','Huang2025JoVA_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Huang2025JoVA_cop" class="copied-msg" style="display:none">Copied!</span><code id="Huang2025JoVA_bib">@article{Huang2025JoVA,
author = {Xiaohu Huang and Hao Zhou and Qiangpeng Yang and Shilei Wen and Kai Han},
title = {JoVA: Unified Multimodal Learning for Joint Video-Audio Generation},
journal = {arXiv preprint arXiv:2512.13677},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_GCDDomainShifts.webp" border=0 width=220></td>
<td id="Wang2026GCDDomainShifts">
<span class="pub-title"><i>Generalized Category Discovery under Domain Shifts: From Vision to Vision-Language Models</i></span><br>
Hongjun Wang, Po Hu, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2605.00906, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Wang2026GCDDomainShifts')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2605.00906"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2605.00906"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/hilo/"><i class="fa fa-globe"></i>Project</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Wang2026GCDDomainShifts_bib','Wang2026GCDDomainShifts_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Wang2026GCDDomainShifts_cop" class="copied-msg" style="display:none">Copied!</span><code id="Wang2026GCDDomainShifts_bib">@article{Wang2026GCDDomainShifts,
author = {Hongjun Wang and Po Hu and Kai Han},
title = {Generalized Category Discovery under Domain Shifts: From Vision to Vision-Language Models},
journal = {arXiv preprint arXiv:2605.00906},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_CCD.webp" border=0 width=220></td>
<td id="Cendra2026PromptPool">
<span class="pub-title"><i>Effective Prompt Pool Learning for Continual Category Discovery</i></span><br>
Fernando Julio Cendra, Xinghui Li, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2407.19001, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Cendra2026PromptPool')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2407.19001"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2407.19001"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Cendra2026PromptPool_bib','Cendra2026PromptPool_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Cendra2026PromptPool_cop" class="copied-msg" style="display:none">Copied!</span><code id="Cendra2026PromptPool_bib">@article{Cendra2026PromptPool,
author = {Fernando Julio Cendra and Xinghui Li and Kai Han},
title = {Effective Prompt Pool Learning for Continual Category Discovery},
journal = {arXiv preprint arXiv:2407.19001},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_MHPO.webp" border=0 width=220></td>
<td id="Wang2026MHPO">
<span class="pub-title"><i>MHPO: Modulated Hazard-aware Policy Optimization for Stable Reinforcement Learning</i></span><br>
Hongjun Wang, Wei Liu, Weibo Gu, Xing Sun, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2603.16929, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Wang2026MHPO')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2603.16929"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2603.16929"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Wang2026MHPO_bib','Wang2026MHPO_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Wang2026MHPO_cop" class="copied-msg" style="display:none">Copied!</span><code id="Wang2026MHPO_bib">@article{Wang2026MHPO,
author = {Hongjun Wang and Wei Liu and Weibo Gu and Xing Sun and Kai Han},
title = {MHPO: Modulated Hazard-aware Policy Optimization for Stable Reinforcement Learning},
journal = {arXiv preprint arXiv:2603.16929},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_Category_Discovery.jpg" border=0 width=220></td>
<td id="He2025Category">
<span class="pub-title"><i>Category Discovery: An Open-World Perspective</i></span><br>
Zhenqi He, Yuanpei Liu, <b>Kai Han</b><br>
<span class="pub-venue">arXiv preprint arXiv:2509.22542, 2026</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('He2025Category')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2509.22542"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2509.22542"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/category-discovery/"><i class="fa fa-globe"></i>Project</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('He2025Category_bib','He2025Category_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="He2025Category_cop" class="copied-msg" style="display:none">Copied!</span><code id="He2025Category_bib">@article{He2025Category,
author = {He, Zhenqi and Liu, Yuanpei and Han, Kai},
title = {Category Discovery: An Open-World Perspective},
journal = {arXiv preprint arXiv:2509.22542},
year = {2026},
}</code></pre>
</td>
</tr>
<!-- <tr>
<td style="vertical-align:top;"><img src="./images/2020_arxiv_face.jpg" border=0 width=220></td>
<td id="qiu20learning">
<span class="pub-title"><i>Learning Inverse Rendering of Faces from Real-world Videos</i></span><br>
Yuda Qiu*, Zhangyang Xiong*, <b>Kai Han</b>, Zhongyuan Wang, Zixiang Xiong, Xiaoguang Han<br>
<span class="pub-venue">arXiv preprint, 2020. (* indicates equal contribution.)</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('qiu20learning')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2003.12047.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2003.12047"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="https://dualrcnet.active.vision/">project page</a> | -->
<!-- <a class="pub-link" href="https://github.com/RudyQ/InverseFaceRender"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('qiu20learning_bib','qiu20learning_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="qiu20learning_cop" class="copied-msg" style="display:none">Copied!</span><code id="qiu20learning_bib">@article{qiu20learning,
author = {Yuda Qiu and Zhangyang Xiong and Kai Han and Zhongyuan Wang and Zixiang Xiong and Xiaoguang Han},
title = {Learning Inverse Rendering of Faces from Real-world Videos},
journal = {arXiv preprint arXiv:2003.12047},
year = {2020},
}</code></pre>
</td>
</tr> -->
</table>
<h3>2026</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2025_PartCo.jpg" border=0 width=220></td>
<td id="Cendra2026PartCo">
<span class="pub-title"><i>PartCo: Part-Level Correspondence Priors Enhance Category Discovery</i></span><br>
Fernando Julio Cendra, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Machine Learning (<b>ICML</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Cendra2026PartCo')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2509.22769"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2509.22769"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/partco"><i class="fa fa-globe"></i>Project</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Cendra2026PartCo_bib','Cendra2026PartCo_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Cendra2026PartCo_cop" class="copied-msg" style="display:none">Copied!</span><code id="Cendra2026PartCo_bib">@inproceedings{Cendra2026PartCo,
author = {Fernando Julio Cendra and Kai Han},
title = {PartCo: Part-Level Correspondence Priors Enhance Category Discovery},
booktitle = {International Conference on Machine Learning (ICML)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_GeomRecip.webp" border=0 width=220></td>
<td id="Lu2026GeomRecip">
<span class="pub-title"><i>Geometric Reciprocity: Unlocking Self-Supervision for Stereoscopic Video Generation</i></span><br>
Jingyi Lu, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Machine Learning (<b>ICML</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Lu2026GeomRecip')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2607.05354"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2607.05354"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/grt/"><i class="fa fa-globe"></i>Project</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Lu2026GeomRecip_bib','Lu2026GeomRecip_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Lu2026GeomRecip_cop" class="copied-msg" style="display:none">Copied!</span><code id="Lu2026GeomRecip_bib">@inproceedings{Lu2026GeomRecip,
author = {Jingyi Lu and Kai Han},
title = {Geometric Reciprocity: Unlocking Self-Supervision for Stereoscopic Video Generation},
booktitle = {International Conference on Machine Learning (ICML)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_iVGR.webp" border=0 width=220></td>
<td id="Zhang2026iVGR">
<span class="pub-title"><i>iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement Learning</i></span><br>
Chang-Bin Zhang, Yujie Zhong, Qiang Zhang, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Machine Learning (<b>ICML</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhang2026iVGR')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2605.31096"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2605.31096"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/ivgr/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/iVGR"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhang2026iVGR_bib','Zhang2026iVGR_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhang2026iVGR_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhang2026iVGR_bib">@inproceedings{Zhang2026iVGR,
author = {Chang-Bin Zhang and Yujie Zhong and Qiang Zhang and Kai Han},
title = {iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement Learning},
booktitle = {International Conference on Machine Learning (ICML)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_ZeroBench.jpg" border=0 width=220></td>
<td id="Roberts2026ZeroBench">
<span class="pub-title"><i>ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models</i></span><br>
Jonathan Roberts, Mohammad Reza Taesiri, Ansh Sharma, Akash Gupta, et al., <b>Kai Han</b><sup>†</sup>, Samuel Albanie<sup>†</sup><br>
<span class="pub-venue">International Conference on Machine Learning (<b>ICML</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Roberts2026ZeroBench')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2502.09696"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2502.09696"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://zerobench.github.io/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/jonathan-roberts1/zerobench"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Roberts2026ZeroBench_bib','Roberts2026ZeroBench_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Roberts2026ZeroBench_cop" class="copied-msg" style="display:none">Copied!</span><code id="Roberts2026ZeroBench_bib">@inproceedings{Roberts2026ZeroBench,
author = {Jonathan Roberts and Mohammad Reza Taesiri and Ansh Sharma and Akash Gupta and others and Kai Han and Samuel Albanie},
title = {ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models},
booktitle = {International Conference on Machine Learning (ICML)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_Tokenizers.webp" border=0 width=220></td>
<td id="Roberts2026Tokenizers">
<span class="pub-title"><i>How Long Is a Piece of String? A Brief Empirical Analysis of Tokenizers</i></span><br>
Jonathan Roberts, <b>Kai Han</b>, Samuel Albanie<br>
<span class="pub-venue"><b>ICML</b> 2026 Workshop on Combining Theory and Benchmarks (<b>CTB</b>).</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Roberts2026Tokenizers')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2601.11518"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2601.11518"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Roberts2026Tokenizers_bib','Roberts2026Tokenizers_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Roberts2026Tokenizers_cop" class="copied-msg" style="display:none">Copied!</span><code id="Roberts2026Tokenizers_bib">@inproceedings{Roberts2026Tokenizers,
author = {Jonathan Roberts and Kai Han and Samuel Albanie},
title = {How Long Is a Piece of String? A Brief Empirical Analysis of Tokenizers},
booktitle = {ICML Workshop on Combining Theory and Benchmarks (CTB)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_Sculpt4D.webp" border=0 width=220></td>
<td id="Yin2026Sculpt4D">
<span class="pub-title"><i>Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers</i></span><br>
Minghao Yin, Wenbo Hu, Jiale Xu, Ying Shan, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Yin2026Sculpt4D')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2604.21592"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2604.21592"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/sculpt4d/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/TencentARC/Sculpt4D"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Yin2026Sculpt4D_bib','Yin2026Sculpt4D_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Yin2026Sculpt4D_cop" class="copied-msg" style="display:none">Copied!</span><code id="Yin2026Sculpt4D_bib">@inproceedings{Yin2026Sculpt4D,
author = {Minghao Yin and Wenbo Hu and Jiale Xu and Ying Shan and Kai Han},
title = {Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_Speed3R.webp" border=0 width=220></td>
<td id="Ren2026Speed3R">
<span class="pub-title"><i>Speed3R: Sparse Feed-forward 3D Reconstruction Models</i></span><br>
Weining Ren, Xiao Tan, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>) Findings, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Ren2026Speed3R')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2603.08055"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2603.08055"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/speed3r/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/speed3r"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Ren2026Speed3R_bib','Ren2026Speed3R_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Ren2026Speed3R_cop" class="copied-msg" style="display:none">Copied!</span><code id="Ren2026Speed3R_bib">@inproceedings{Ren2026Speed3R,
author = {Weining Ren and Xiao Tan and Kai Han},
title = {Speed3R: Sparse Feed-forward 3D Reconstruction Models},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR) Findings},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_HeteroPhys.webp" border=0 width=220></td>
<td id="Liu2026HeteroPhys">
<span class="pub-title"><i>Scene-Level Heterogeneous Physics Simulation with 3D Gaussian Splats</i></span><br>
Xiaoyang Liu, Shangzhe Wu, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>) Findings, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Liu2026HeteroPhys')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2606.21753"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2606.21753"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/raf/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/RAF"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Liu2026HeteroPhys_bib','Liu2026HeteroPhys_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Liu2026HeteroPhys_cop" class="copied-msg" style="display:none">Copied!</span><code id="Liu2026HeteroPhys_bib">@inproceedings{Liu2026HeteroPhys,
author = {Xiaoyang Liu and Shangzhe Wu and Kai Han},
title = {Scene-Level Heterogeneous Physics Simulation with 3D Gaussian Splats},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR) Findings},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_SSTGNN.webp" border=0 width=220></td>
<td id="Liu2026Deepfake">
<span class="pub-title"><i>When Deepfake Detection Meets Graph Neural Network: a Unified and Lightweight Learning Framework</i></span><br>
Haoyu Liu, Chaoyu Gong, Mengke He, Jiate Li, <b>Kai Han</b>, Siqiang Luo<br>
<span class="pub-venue">ACM SIGKDD Conference on Knowledge Discovery and Data Mining (<b>KDD</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Liu2026Deepfake')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2508.05526"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2508.05526"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Liu2026Deepfake_bib','Liu2026Deepfake_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Liu2026Deepfake_cop" class="copied-msg" style="display:none">Copied!</span><code id="Liu2026Deepfake_bib">@inproceedings{Liu2026Deepfake,
author = {Haoyu Liu and Chaoyu Gong and Mengke He and Jiate Li and Kai Han and Siqiang Luo},
title = {When Deepfake Detection Meets Graph Neural Network: a Unified and Lightweight Learning Framework},
booktitle = {ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_InfBench.webp" border=0 width=220></td>
<td id="Zhang2026Ladder">
<span class="pub-title"><i>Ascending the Infinite Ladder: Benchmarking Spatial Deformation Reasoning in Vision-Language Models</i></span><br>
Jiahuan Zhang, Shunwen Bai, Tianheng Wang, Kaiwen Guo, Zijia Song, Hanqing Wu, Guozheng Rao, <b>Kai Han</b>, Kaicheng Yu<br>
<span class="pub-venue">Annual Meeting of the Association for Computational Linguistics (<b>ACL</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhang2026Ladder')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2507.02978"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2507.02978"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhang2026Ladder_bib','Zhang2026Ladder_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhang2026Ladder_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhang2026Ladder_bib">@inproceedings{Zhang2026Ladder,
author = {Jiahuan Zhang and Shunwen Bai and Tianheng Wang and Kaiwen Guo and Zijia Song and Hanqing Wu and Guozheng Rao and Kai Han and Kaicheng Yu},
title = {Ascending the Infinite Ladder: Benchmarking Spatial Deformation Reasoning in Vision-Language Models},
booktitle = {Annual Meeting of the Association for Computational Linguistics (ACL)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_CodeBind.webp" border=0 width=220></td>
<td id="Chen2026CodeBind">
<span class="pub-title"><i>CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook</i></span><br>
Zeyu Chen, Jie Li, <b>Kai Han</b><br>
<span class="pub-venue">Annual Meeting of the Association for Computational Linguistics (<b>ACL</b>) Findings, 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Chen2026CodeBind')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2605.18257"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2605.18257"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/codebind/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/CodeBind"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Chen2026CodeBind_bib','Chen2026CodeBind_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Chen2026CodeBind_cop" class="copied-msg" style="display:none">Copied!</span><code id="Chen2026CodeBind_bib">@inproceedings{Chen2026CodeBind,
author = {Zeyu Chen and Jie Li and Kai Han},
title = {CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook},
booktitle = {Annual Meeting of the Association for Computational Linguistics (ACL) Findings},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_OralHealthAI.webp" border=0 width=220></td>
<td id="Chen2026JDR">
<span class="pub-title"><i>AI in Oral Health Surveillance: Critical Review</i></span><br>
Zeyu Chen, Pei Liu, <b>Kai Han</b>, Peixi Liao, Yanqi Yang, May C.M. Wong, Cynthia K.Y. Yiu, Edward C.M. Lo<br>
<span class="pub-venue">Journal of Dental Research (<b>JDR</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Chen2026JDR')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://doi.org/10.1177/00220345261434568"><i class="ai ai-doi"></i>DOI</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Chen2026JDR_bib','Chen2026JDR_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Chen2026JDR_cop" class="copied-msg" style="display:none">Copied!</span><code id="Chen2026JDR_bib">@article{Chen2026JDR,
author = {Zeyu Chen and Pei Liu and Kai Han and Peixi Liao and Yanqi Yang and May C.M. Wong and Cynthia K.Y. Yiu and Edward C.M. Lo},
title = {AI in Oral Health Surveillance: Critical Review},
journal = {Journal of Dental Research (JDR)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_LooC.webp" border=0 width=220></td>
<td id="Li2026LooC">
<span class="pub-title"><i>LooC: Effective Low-Dimensional Codebook for Compositional Vector Quantization</i></span><br>
Jie Li, Kwan-Yee K. Wong, <b>Kai Han</b><br>
<span class="pub-venue">IEEE/CVF Winter Conference on Applications of Computer Vision (<b>WACV</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Li2026LooC')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2601.00222"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2601.00222"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/looc/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/looc"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Li2026LooC_bib','Li2026LooC_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Li2026LooC_cop" class="copied-msg" style="display:none">Copied!</span><code id="Li2026LooC_bib">@inproceedings{Li2026LooC,
author = {Jie Li and Kwan-Yee K. Wong and Kai Han},
title = {LooC: Effective Low-Dimensional Codebook for Compositional Vector Quantization},
booktitle = {IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)},
year = {2026},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2026_OnlineVPO.webp" border=0 width=220></td>
<td id="Zhang2026AlignVD">
<span class="pub-title"><i>Align Video Diffusion Model with Online Video-Centric Preference Optimization</i></span><br>
Jiacheng Zhang, Jie Wu, Weifeng Chen, Yatai Ji, Weilin Huang, Xuefeng Xiao, <b>Kai Han</b><br>
<span class="pub-venue">IEEE/CVF Winter Conference on Applications of Computer Vision (<b>WACV</b>), 2026.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhang2026AlignVD')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2412.15159"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2412.15159"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/onlinevpo"><i class="fa fa-globe"></i>Project</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhang2026AlignVD_bib','Zhang2026AlignVD_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhang2026AlignVD_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhang2026AlignVD_bib">@inproceedings{Zhang2026AlignVD,
author = {Jiacheng Zhang and Jie Wu and Weifeng Chen and Yatai Ji and Weilin Huang and Xuefeng Xiao and Kai Han},
title = {Align Video Diffusion Model with Online Video-Centric Preference Optimization},
booktitle = {IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)},
year = {2026},
}</code></pre>
</td>
</tr>
</table>
<h3>2025</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2025_SemanticCorres.jpg" border=0 width=220></td>
<td id="Zhang2025Semantic">
<span class="pub-title"><i>Semantic Correspondence: Unified Benchmarking and a Strong Baseline</i></span><br>
Kaiyan Zhang, Xinghui Li, Jingyi Lu, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Transactions on Pattern Analysis and Machine Intelligence (<b>TPAMI</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhang2025Semantic')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2505.18060"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2505.18060"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/semantic-correspondence/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/Semantic-Correspondence"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhang2025Semantic_bib','Zhang2025Semantic_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhang2025Semantic_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhang2025Semantic_bib">@article{Zhang2025Semantic,
author = {Zhang, Kaiyan and Li, Xinghui and Lu, Jingyi and Han, Kai},
title = {Semantic Correspondence: Unified Benchmarking and a Strong Baseline},
journal = {IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_PanCap.jpg" border=0 width=220></td>
<td id="lin2025PanCap">
<span class="pub-title"><i>Panoptic Captioning: An Equivalence Bridge for Image and Text</i></span><br>
Kun-Yu Lin, Hongjun Wang, Weining Ren, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('lin2025PanCap')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2505.16334.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2505.16334"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/pancap/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/Pancap"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('lin2025PanCap_bib','lin2025PanCap_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="lin2025PanCap_cop" class="copied-msg" style="display:none">Copied!</span><code id="lin2025PanCap_bib">@inproceedings{lin2025PanCap,
author = {Kun-Yu Lin and Hongjun Wang and Weining Ren and Kai Han},
title = {Panoptic Captioning: Seeking An Equivalency Bridge for Image and Text},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_3DRS.jpg" border=0 width=220></td>
<td id="huang2025ThreeDRS">
<span class="pub-title"><i>3DRS: MLLMs Need 3D-Aware Representation Supervision for Scene Understanding</i></span><br>
Xiaohu Huang, Jingjing Wu, Qunyi Xie, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('huang2025ThreeDRS')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2506.01946.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2506.01946"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/3drs/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/3DRS"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('huang2025ThreeDRS_bib','huang2025ThreeDRS_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="huang2025ThreeDRS_cop" class="copied-msg" style="display:none">Copied!</span><code id="huang2025ThreeDRS_bib">@inproceedings{huang2025ThreeDRS,
author = {Xiaohu Huang and Jingjing Wu and Qunyi Xie and Kai Han},
title = {MLLMs Need 3D-Aware Representation Supervision for Scene Understanding},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_Wukong.jpg" border=0 width=220></td>
<td id="Yin2025Wukong">
<span class="pub-title"><i>Wukong's 72 Transformations: High-fidelity 3D Morphing via Flow Models</i></span><br>
Minghao Yin, Yukang Cao, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Yin2025Wukong')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2511.22425"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2511.22425"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/wukong/"><i class="fa fa-globe"></i>Project</a>
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Yin2025Wukong_bib','Yin2025Wukong_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Yin2025Wukong_cop" class="copied-msg" style="display:none">Copied!</span><code id="Yin2025Wukong_bib">@inproceedings{Yin2025Wukong,
author = {Minghao Yin and Yukang Cao and Kai Han},
title = {Wukong's 72 Transformations: High-fidelity 3D Morphing via Flow Models},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_VaMP.jpg" border=0 width=220></td>
<td id="Cheng2025VaMP">
<span class="pub-title"><i>VaMP: Variational Multi-Modal Prompt Learning for Vision-Language Models</i></span><br>
Silin Cheng, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Cheng2025VaMP')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2511.22664"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2511.22664"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/vamp/"><i class="fa fa-globe"></i>Project</a>
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Cheng2025VaMP_bib','Cheng2025VaMP_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Cheng2025VaMP_cop" class="copied-msg" style="display:none">Copied!</span><code id="Cheng2025VaMP_bib">@inproceedings{Cheng2025VaMP,
author = {Silin Cheng and Kai Han},
title = {VaMP: Variational Multi-Modal Prompt Learning},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_Fin3R.jpg" border=0 width=220></td>
<td id="Ren2025Fin3R">
<span class="pub-title"><i>Fin3R: Fine-Tuning Feed-Foward 3D Reconstruction Models via Monocular Knowledge Distillation</i></span><br>
Weining Ren, Hongjun Wang, Xiao Tan, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Ren2025Fin3R')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2511.22429"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2511.22429"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/fin3r/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/Fin3R"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Ren2025Fin3R_bib','Ren2025Fin3R_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Ren2025Fin3R_cop" class="copied-msg" style="display:none">Copied!</span><code id="Ren2025Fin3R_bib">@inproceedings{Ren2025Fin3R,
author = {Weining Ren and Hongjun Wang and Xiao Tan and Kai Han},
title = {Fin3R: Fine-Tuning Feed-Foward 3D Reconstruction Models via Monocular Knowledge Distillation},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_SEAL.jpg" border=0 width=220></td>
<td id="He2025SEAL">
<span class="pub-title"><i>SEAL: Semantic-Aware Hierarchical Learning for Generalized Category Discovery</i></span><br>
Zhenqi He*, Yuanpei Liu*, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('He2025SEAL')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2510.18740"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2510.18740"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/seal/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/seal"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('He2025SEAL_bib','He2025SEAL_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="He2025SEAL_cop" class="copied-msg" style="display:none">Copied!</span><code id="He2025SEAL_bib">@inproceedings{He2025SEAL,
author = {Zhenqi He and Yuanpei Liu and Kai Han},
title = {SEAL: Semantic-Aware Hierarchical Learning for Generalized Category Discovery},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_GSPN2.jpg" border=0 width=220></td>
<td id="Wang2025GSPN2">
<span class="pub-title"><i>GSPN-2: Efficient Parallel Sequence Modeling</i></span><br>
Hongjun Wang, Yitong Jiang, Collin McCarthy, David Wehr, Hanrong Ye, Xinhao Li, Ka Chun Cheung, Wonmin Byeon, Jinwei Gu, Ke Chen, <b>Kai Han</b>, Hongxu Yin, Pavlo Molchanov, Jan Kautz, Sifei Liu<br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2025</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Wang2025GSPN2')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2512.07884.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2512.07884"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">arXiv</a> -->
<!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Wang2025GSPN2_bib','Wang2025GSPN2_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Wang2025GSPN2_cop" class="copied-msg" style="display:none">Copied!</span><code id="Wang2025GSPN2_bib">@inproceedings{Wang2025GSPN2,
author = {Hongjun Wang and Yitong Jiang and Collin McCarthy and David Wehr and Hanrong Ye and Xinhao Li and Ka Chun Cheung and Wonmin Byeon and Jinwei Gu and Ke Chen and Kai Han and Hongxu Yin and Pavlo Molchanov and Jan Kautz and Sifei Liu},
title = {GSPN-2: Efficient Parallel Sequence Modeling},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_ELIP.jpg" border=0 width=220></td>
<td id="Zhan2025ELIP">
<span class="pub-title"><i>ELIP: Enhanced Visual-Language Foundation Models for Image Retrieval </i></span><br>
Guanqi Zhan*, Yuanpei Liu*, <b>Kai Han</b>, Weidi Xie, Andrew Zisserman<br>
<span class="pub-venue">IEEE International Conference on Content-Based Multimedia Indexing (<b>CBMI</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhan2025ELIP')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2502.15682.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2502.15682"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://www.robots.ox.ac.uk/~vgg/research/elip/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/ypliubit/ELIP"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhan2025ELIP_bib','Zhan2025ELIP_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhan2025ELIP_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhan2025ELIP_bib">@inproceedings{Zhan2025ELIP,
author = {Zhan, Guanqi and Liu, Yuanpei and Han, Kai and Xie, Weidi and Zisserman, Andrew},
title = {ELIP: Enhanced Visual-Language Foundation Models for Image Retrieval},
booktitle = {International Conference on Content-Based Multimedia Indexing (CBMI)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_iccv_Inpaint4Drag.jpg" border=0 width=220></td>
<td id="Lu2025Inpaint4Drag">
<span class="pub-title"><i>Inpaint4Drag: Repurposing Inpainting Models for Drag-Based Image Editing via Bidirectional Warping </i></span><br>
Jingyi Lu, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Lu2025Inpaint4Drag')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2509.04582.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2509.04582"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/inpaint4drag/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/Inpaint4Drag"><i class="fa fa-github"></i>Code</a> <a class="pub-link" href="https://colab.research.google.com/drive/1fzoyNzcJNZjM1_08FE9V2V20EQxGf4PH?usp=sharing"><i class="fa fa-play"></i>Demo</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Lu2025Inpaint4Drag_bib','Lu2025Inpaint4Drag_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Lu2025Inpaint4Drag_cop" class="copied-msg" style="display:none">Copied!</span><code id="Lu2025Inpaint4Drag_bib">@inproceedings{Lu2025Inpaint4Drag,
author = {Jingyi Lu and Kai Han},
title = {Inpaint4Drag: Repurposing Inpainting Models for Drag-Based Image Editing via Bidirectional Warping},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_GRAB.jpg" border=0 width=220></td>
<td id="Roberts2025GRAB">
<span class="pub-title"><i>GRAB: A Challenging GRaph Analysis Benchmark for Large Multimodal Models</i></span><br>
Jonathan Roberts, <b>Kai Han</b>, Samuel Albanie<br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Roberts2025GRAB')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2408.11817.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2408.11817"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://grab-benchmark.github.io/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://huggingface.co/datasets/jonathan-roberts1/GRAB"><i class="fa fa-database"></i>Data</a> <a class="pub-link" href="https://github.com/jonathan-roberts1/GRAB"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Roberts2025GRAB_bib','Roberts2025GRAB_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Roberts2025GRAB_cop" class="copied-msg" style="display:none">Copied!</span><code id="Roberts2025GRAB_bib">@inproceedings{Roberts2025GRAB,
author = {Jonathan Roberts and Kai Han and Samuel Albanie},
title = {GRAB: A Challenging GRaph Analysis Benchmark for Large Multimodal Models},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_acl_GAMEBoT.jpg" border=0 width=220></td>
<td id="Lin2025GAMEBot">
<span class="pub-title"><i>GAMEBoT: Transparent Assessment of LLM Reasoning in Games</i></span><br>
Wenye Lin, Jonathan Roberts, Yunhan Yang, Samuel Albanie, Zongqing Lu, <b>Kai Han</b><br>
<span class="pub-venue">Annual Meeting of the Association for Computational Linguistics (<b>ACL</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Lin2025GAMEBot')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2412.13602.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2412.13602"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/gamebot/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/GAMEBoT"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Lin2025GAMEBot_bib','Lin2025GAMEBot_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Lin2025GAMEBot_cop" class="copied-msg" style="display:none">Copied!</span><code id="Lin2025GAMEBot_bib">@inproceedings{Lin2025GAMEBot,
author = {Wenye Lin and Jonathan Roberts and Yunhan Yang and Samuel Albanie and Zongqing Lu and Kai Han},
title = {GAMEBoT: Transparent Assessment of LLM Reasoning in Games},
booktitle = {Annual Meeting of the Association for Computational Linguistics (ACL)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_acl_PruneVid.jpg" border=0 width=220></td>
<td id="Huang2025PruneVid">
<span class="pub-title"><i>PruneVid: Visual Token Pruning for Efficient Video Large Language Models</i></span><br>
Xiaohu Huang, Hao Zhou, <b>Kai Han</b><br>
<span class="pub-venue">Annual Meeting of the Association for Computational Linguistics (<b>ACL</b>) Findings, 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Huang2025PruneVid')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2412.16117.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2412.16117"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/prunevid/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/PruneVid"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Huang2025PruneVid_bib','Huang2025PruneVid_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Huang2025PruneVid_cop" class="copied-msg" style="display:none">Copied!</span><code id="Huang2025PruneVid_bib">@inproceedings{Huang2025PruneVid,
author = {Xiaohu Huang and Hao Zhou and Kai Han},
title = {PruneVid: Visual Token Pruning for Efficient Video Large Language Models},
booktitle = {Annual Meeting of the Association for Computational Linguistics (ACL) Findings},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_siggraph_Splat4D.jpg" border=0 width=220></td>
<td id="Yin2025Splat4D">
<span class="pub-title"><i>Splat4D: Diffusion-Enhanced 4D Gaussian Splatting for Temporally and Spatially Consistent Content Creation</i></span><br>
Minghao Yin, Yukang Cao, Songyou Peng, <b>Kai Han</b><br>
<span class="pub-venue"><b>SIGGRAPH</b>, 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Yin2025Splat4D')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2508.07557"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2508.07557"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://dl.acm.org/doi/10.1145/3721238.3730752"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="https://visual-ai.github.io/splat4d/"><i class="fa fa-globe"></i>Project</a>
<!-- |
<a href="https://github.com/Visual-AI/ICE">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Yin2025Splat4D_bib','Yin2025Splat4D_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Yin2025Splat4D_cop" class="copied-msg" style="display:none">Copied!</span><code id="Yin2025Splat4D_bib">@inproceedings{Yin2025Splat4D,
author = {Minghao Yin and Yukang Cao and Songyou Peng and Kai Han},
title = {Splat4D: Diffusion-Enhanced 4D Gaussian Splatting for Temporally and Spatially Consistent Content Creation},
booktitle = {SIGGRAPH},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_cvpr_ICE.jpg" border=0 width=220></td>
<td id="Cendra2025ICE">
<span class="pub-title"><i>ICE: Intrinsic Concept Extraction from a Single Image via Diffusion Models</i></span><br>
Fernando Julio Cendra, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2025.</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Highlight presentation · 2.8% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Cendra2025ICE')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2503.19902"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2503.19902"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/ice/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/ICE"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Cendra2025ICE_bib','Cendra2025ICE_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Cendra2025ICE_cop" class="copied-msg" style="display:none">Copied!</span><code id="Cendra2025ICE_bib">@inproceedings{Cendra2025ICE,
author = {Fernando Julio Cendra and Kai Han},
title = {ICE: Intrinsic Concept Extraction from a Single Image via Diffusion Models},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_cvpr_HypCD.jpg" border=0 width=220></td>
<td id="Liu2025HypCD">
<span class="pub-title"><i>Hyperbolic Category Discovery</i></span><br>
Yuanpei Liu*, Zhenqi He*, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Liu2025HypCD')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2504.06120"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2504.06120"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/hypcd/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/HypCD"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Liu2025HypCD_bib','Liu2025HypCD_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Liu2025HypCD_cop" class="copied-msg" style="display:none">Copied!</span><code id="Liu2025HypCD_bib">@inproceedings{Liu2025HypCD,
author = {Yuanpei Liu and Zhenqi He and Kai Han},
title = {Hyperbolic Category Discovery},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_cvpr_MrDETR.jpg" border=0 width=220></td>
<td id="Zhang2025MrDETR">
<span class="pub-title"><i>Mr. DETR: Instructive Multi-Route Training for Detection Transformers</i></span><br>
Chang-Bin Zhang, Yujie Zhong, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhang2025MrDETR')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2412.10028"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2412.10028"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/mrdetr/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/Mr.DETR"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhang2025MrDETR_bib','Zhang2025MrDETR_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhang2025MrDETR_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhang2025MrDETR_bib">@inproceedings{Zhang2025MrDETR,
author = {Chang-Bin Zhang and Jinhong Ni and Yujie Zhong and Kai Han},
title = {Mr. DETR: Instructive Multi-Route Training for Detection Transformers},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_cvpr_vCLR.jpg" border=0 width=220></td>
<td id="Zhang2025vCLR">
<span class="pub-title"><i>v-CLR: View-Consistent Learning for Open-World Instance Segmentation</i></span><br>
Chang-Bin Zhang, Jinhong Ni, Yujie Zhong, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2025.</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Highlight presentation · 2.8% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Zhang2025vCLR')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2504.01383"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2504.01383"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/vclr/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/vCLR"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Zhang2025vCLR_bib','Zhang2025vCLR_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Zhang2025vCLR_cop" class="copied-msg" style="display:none">Copied!</span><code id="Zhang2025vCLR_bib">@inproceedings{Zhang2025vCLR,
author = {Chang-Bin Zhang and Jinhong Ni and Yujie Zhong and Kai Han},
title = {v-CLR: View-Consistent Learning for Open-World Instance Segmentation},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_cvpr_GSPN.jpg" border=0 width=220></td>
<td id="Wang2025GSPN">
<span class="pub-title"><i>Parallel Sequence Modeling via Generalized Spatial Propagation Network</i></span><br>
Hongjun Wang, Wonmin Byeon, Jiarui Xu, Jinwei Gu, Ka Chun Cheung, Xiaolong Wang, <b>Kai Han</b>, Jan Kautz, Sifei Liu<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Wang2025GSPN')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2501.12381"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2501.12381"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://whj363636.github.io/GSPN/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/NVlabs/GSPN"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Wang2025GSPN_bib','Wang2025GSPN_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Wang2025GSPN_cop" class="copied-msg" style="display:none">Copied!</span><code id="Wang2025GSPN_bib">@inproceedings{Wang2025GSPN,
author = {Hongjun Wang and Wonmin Byeon and Jiarui Xu and Jinwei Gu and Ka Chun Cheung and Xiaolong Wang and Kai Han and Jan Kautz and Sifei Liu},
title = {Parallel Sequence Modeling via Generalized Spatial Propagation Network},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_cvpr_PASS.jpg" border=0 width=220></td>
<td id="Yang2025PASS">
<span class="pub-title"><i>Detecting Open World Objects via Partial Attribute Assignment</i></span><br>
Muli Yang, Gabriel James Goenawan, Huaiyuan Qin, <b>Kai Han</b>, Xi Peng, Yanhua Yang, Hongyuan Zhu<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Yang2025PASS')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://openaccess.thecvf.com/content/CVPR2025/papers/Yang_Detecting_Open_World_Objects_via_Partial_Attribute_Assignment_CVPR_2025_paper.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <!-- <a href="">arXiv</a> -->
<!-- | -->
<!-- <a href="https://visual-ai.github.io/debgcd/">project page</a> -->
<!-- | -->
<a class="pub-link" href="https://github.com/muliyangm/PASS"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Yang2025PASS_bib','Yang2025PASS_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Yang2025PASS_cop" class="copied-msg" style="display:none">Copied!</span><code id="Yang2025PASS_bib">@inproceedings{Yang2025PASS,
author = {Muli Yang and Gabriel James Goenawan and Huaiyuan Qin and Kai Han and Xi Peng and Yanhua Yang and Hongyuan Zhu},
title = {Detecting Open World Objects via Partial Attribute Assignment},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_iclr_DebGCD.jpg" border=0 width=220></td>
<td id="Liu2025DebGCD">
<span class="pub-title"><i>DebGCD: Debiased Learning with Distribution Guidance for Generalized Category Discovery</i></span><br>
Yuanpei Liu, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Liu2025DebGCD')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2504.04804"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2504.04804"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/debgcd/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/DebGCD"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Liu2025DebGCD_bib','Liu2025DebGCD_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Liu2025DebGCD_cop" class="copied-msg" style="display:none">Copied!</span><code id="Liu2025DebGCD_bib">@inproceedings{Liu2025DebGCD,
author = {Yuanpei Liu and Kai Han},
title = {DebGCD: Debiased Learning with Distribution Guidance for Generalized Category Discovery},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_iclr_HiLo.jpg" border=0 width=220></td>
<td id="wang2025hilo">
<span class="pub-title"><i>HiLo: A Learning Framework for Generalized Category Discovery Robust to Domain Shifts</i></span><br>
Hongjun Wang, Sagar Vaze, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('wang2025hilo')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2408.04591.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2408.04591"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/hilo/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/HiLo"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('wang2025hilo_bib','wang2025hilo_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="wang2025hilo_cop" class="copied-msg" style="display:none">Copied!</span><code id="wang2025hilo_bib">@inproceedings{wang2025hilo,
author = {Hongjun Wang and Sagar Vaze and Kai Han},
title = {HiLo: A Learning Framework for Generalized Category Discovery Robust to Domain Shifts},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_iclr_Needle.jpg" border=0 width=220></td>
<td id="Roberts2025Needle">
<span class="pub-title"><i>Needle Threading: Can LLMs Follow Threads Through Near-Million-Scale Haystacks?</i></span><br>
Jonathan Roberts, <b>Kai Han</b>, Samuel Albanie<br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Roberts2025Needle')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2411.05000"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2411.05000"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://needle-threading.github.io/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/jonathan-roberts1/needle-threading"><i class="fa fa-github"></i>Code</a> <a class="pub-link" href="https://huggingface.co/datasets/jonathan-roberts1/needle-threading"><i class="fa fa-database"></i>Dataset</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Roberts2025Needle_bib','Roberts2025Needle_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Roberts2025Needle_cop" class="copied-msg" style="display:none">Copied!</span><code id="Roberts2025Needle_bib">@inproceedings{Roberts2025Needle,
author = {Jonathan Roberts and Kai Han and Samuel Albanie},
title = {Needle Threading: Can LLMs Follow Threads Through Near-Million-Scale Haystacks?},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_iclr_BiGR.jpg" border=0 width=220></td>
<td id="Hao2025BiGR">
<span class="pub-title"><i>BiGR: Harnessing Binary Latent Codes for Image Generation and Improved Visual Representation Capabilities</i></span><br>
Shaozhe Hao, Xuantong Liu, Xianbiao Qi, Shihao Zhao, Bojia Zi, Rong Xiao, <b>Kai Han</b>, Kwan-Yee K. Wong<br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Hao2025BiGR')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2410.14672.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2410.14672"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://haoosz.github.io/BiGR/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/haoosz/BiGR"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Hao2025BiGR_bib','Hao2025BiGR_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Hao2025BiGR_cop" class="copied-msg" style="display:none">Copied!</span><code id="Hao2025BiGR_bib">@inproceedings{Hao2025BiGR,
author = {Shaozhe Hao and Xuantong Liu and Xianbiao Qi and Shihao Zhao and Bojia Zi and Rong Xiao and Kai Han and Kwan-Yee~K. Wong},
title = {Bi{GR}: Harnessing Binary Latent Codes for Image Generation and Improved Visual Representation Capabilities},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_iclr_AvatarGO.jpg" border=0 width=220></td>
<td id="Cao2025AvatarGO">
<span class="pub-title"><i>AvatarGO: Zero-shot 4D Human-Object Interaction Generation and Animation</i></span><br>
Yukang Cao, Liang Pan, <b>Kai Han</b>, Kwan-Yee K. Wong, Ziwei Liu<br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Cao2025AvatarGO')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2410.07164"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2410.07164"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://yukangcao.github.io/AvatarGO/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/yukangcao/AvatarGO"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Cao2025AvatarGO_bib','Cao2025AvatarGO_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Cao2025AvatarGO_cop" class="copied-msg" style="display:none">Copied!</span><code id="Cao2025AvatarGO_bib">@inproceedings{Cao2025AvatarGO,
author = {Yukang Cao and Liang Pan and Kai Han and Kwan-Yee K. Wong and Ziwei Liu},
title = {AvatarGO: Zero-shot 4D Human-Object Interaction Generation and Animation},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_wacv_VipDiff.jpg" border=0 width=220></td>
<td id="Xie2025VipDiff">
<span class="pub-title"><i>VipDiff: Towards Coherent and Diverse Video Inpainting via Training-free Denoising Diffusion Models</i></span><br>
Chaohao Xie, <b>Kai Han</b>, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE/CVF Winter Conference on Applications of Computer Vision (<b>WACV</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Xie2025VipDiff')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2501.12267.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2501.12267"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://vious.github.io/projects/VipDiff/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Vious/VipDiff"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Xie2025VipDiff_bib','Xie2025VipDiff_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Xie2025VipDiff_cop" class="copied-msg" style="display:none">Copied!</span><code id="Xie2025VipDiff_bib">@inproceedings{Xie2025VipDiff,
author = {Chaohao Xie and Kai Han and Kwan-Yee K. Wong},
title = {VipDiff: Towards Coherent and Diverse Video Inpainting via Training-free Denoising Diffusion Models},
booktitle = {IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)},
year = {2025},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2025_wacv_CusConcept.jpg" border=0 width=220></td>
<td id="Xu2025CusConcept">
<span class="pub-title"><i>CusConcept: Customized Visual Concept Decomposition with Diffusion Models</i></span><br>
Zhi Xu, Shaozhe Hao, <b>Kai Han</b><br>
<span class="pub-venue">IEEE/CVF Winter Conference on Applications of Computer Vision (<b>WACV</b>), 2025.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Xu2025CusConcept')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2410.00398.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2410.00398"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<a class="pub-link" href="https://github.com/xzLcan/CusConcept"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Xu2025CusConcept_bib','Xu2025CusConcept_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Xu2025CusConcept_cop" class="copied-msg" style="display:none">Copied!</span><code id="Xu2025CusConcept_bib">@inproceedings{Xu2025CusConcept,
author = {Zhi Xu and Shaozhe Hao and Kai Han},
title = {CusConcept: Customized Visual Concept Decomposition with Diffusion Models},
booktitle = {IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)},
year = {2025},
}</code></pre>
</td>
</tr>
</table>
<h3>2024</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2024_SciFIBench.jpg" border=0 width=220></td>
<td id="Roberts2024SciFIBench">
<span class="pub-title"><i>SciFIBench: Benchmarking Large Multimodal Models for Scientific Figure Interpretation</i></span><br>
Jonathan Roberts, <b>Kai Han</b>, Neil Houlsby, Samuel Albanie<br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Roberts2024SciFIBench')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2405.08807.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2405.08807"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<a class="pub-link" href="https://github.com/jonathan-roberts1/SciFIBench"><i class="fa fa-database"></i>Data & Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Roberts2024SciFIBench_bib','Roberts2024SciFIBench_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Roberts2024SciFIBench_cop" class="copied-msg" style="display:none">Copied!</span><code id="Roberts2024SciFIBench_bib">@inproceedings{Roberts2024SciFIBench,
author = {Jonathan Roberts and Kai Han and Neil Houlsby and Samuel Albanie},
title = {SciFIBench: Benchmarking Large Multimodal Models for Scientific Figure Interpretation},
booktitle = {Conference on Neural Information Processing Systems},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_ijcv_Dessect_OOD_OSR.jpg" border=0 width=220></td>
<td id="wang2024dissect">
<span class="pub-title"><i>Dissecting Out-of-Distribution Detection and Open-Set Recognition: A Critical Analysis of Methods and Benchmarks</i></span><br>
Hongjun Wang, Sagar Vaze, <b>Kai Han</b><br>
<span class="pub-venue">International Journal of Computer Vision (<b>IJCV</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('wang2024dissect')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2408.16757"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2408.16757"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="https://doi.org/10.1007/s11263-019-01202-3">DOI</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/dissect-ood-osr/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/Dissect-OOD-OSR"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('wang2024dissect_bib','wang2024dissect_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="wang2024dissect_cop" class="copied-msg" style="display:none">Copied!</span><code id="wang2024dissect_bib">@article{wang2024dissect,
author = {Wang, Hongjun and Vaze, Sagar and Han, Kai},
title = {Dissecting Out-of-Distribution Detection and Open-Set Recognition: A Critical Analysis of Methods and Benchmarks},
journal = {International Journal of Computer Vision (IJCV)},
year = {2024}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_eccv_RegionDrag.gif" border=0 width=220></td>
<td id="lu2024regiondrag">
<span class="pub-title"><i>RegionDrag: Fast Region-Based Image Editing with Diffusion Models</i></span><br>
Jingyi Lu, Xinghui Li, <b>Kai Han</b><br>
<span class="pub-venue">European Conference on Computer Vision (<b>ECCV</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('lu2024regiondrag')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2407.18247.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2407.18247"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/regiondrag/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/RegionDrag"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('lu2024regiondrag_bib','lu2024regiondrag_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="lu2024regiondrag_cop" class="copied-msg" style="display:none">Copied!</span><code id="lu2024regiondrag_bib">@inproceedings{lu2024regiondrag,
author = {Jingyi Lu and Xinghui Li and Kai Han},
title = {RegionDrag: Fast Region-Based Image Editing with Diffusion Models},
booktitle = {European Conference on Computer Vision (ECCV)},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_eccv_promptccd.jpg" border=0 width=220></td>
<td id="cendra2024promptccd">
<span class="pub-title"><i>PromptCCD: Learning Gaussian Mixture Prompt Pool for Continual Category Discovery</i></span><br>
Fernando Julio Cendra, Bingchen Zhao, <b>Kai Han</b><br>
<span class="pub-venue">European Conference on Computer Vision (<b>ECCV</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('cendra2024promptccd')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2407.19001"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2407.19001"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/promptccd/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/PromptCCD"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('cendra2024promptccd_bib','cendra2024promptccd_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="cendra2024promptccd_cop" class="copied-msg" style="display:none">Copied!</span><code id="cendra2024promptccd_bib"> @inproceedings{cendra2024promptccd,
author = {Fernando Julio Cendra and Bingchen Zhao and Kai Han},
title = {PromptCCD: Learning Gaussian Mixture Prompt Pool for Continual Category Discovery},
booktitle = {European Conference on Computer Vision},
year = {2024}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_eccv_conceptexpress.jpg" border=0 width=220></td>
<td id="hao2024conceptexpress">
<span class="pub-title"><i>ConceptExpress: Harnessing Diffusion Models for Single-image Unsupervised Concept Extraction</i></span><br>
Shaozhe Hao, <b>Kai Han</b>, Zhengyao Lv, Shihao Zhao, Kwan-Yee K. Wong<br>
<span class="pub-venue">European Conference on Computer Vision (<b>ECCV</b>), 2024.</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Oral presentation · 2.3% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('hao2024conceptexpress')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2407.07077"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="http://arxiv.org/abs/2407.07077"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://haoosz.github.io/ConceptExpress/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/haoosz/ConceptExpress"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('hao2024conceptexpress_bib','hao2024conceptexpress_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="hao2024conceptexpress_cop" class="copied-msg" style="display:none">Copied!</span><code id="hao2024conceptexpress_bib"> @inproceedings{hao2024conceptexpress,
author = {Shaozhe Hao and Kai Han and Zhengyao Lv and Shihao Zhao and Kwan-Yee~K. Wong},
title = {Concept{E}xpress: Harnessing Diffusion Models for Single-image Unsupervised Concept Extraction},
booktitle = {European Conference on Computer Vision},
year = {2024}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_cvpr_ibd_slam.jpg" border=0 width=220></td>
<td id="yin2024ibdslam">
<span class="pub-title"><i>IBD-SLAM: Learning Image-Based Depth Fusion for Generalizable SLAM</i></span><br>
Minghao Yin, Shangzhe Wu, <b>Kai Han</b><br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('yin2024ibdslam')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://openaccess.thecvf.com/content/CVPR2024/papers/Yin_IBD-SLAM_Learning_Image-Based_Depth_Fusion_for_Generalizable_SLAM_CVPR_2024_paper.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <!-- <a href="https://arxiv.org/abs/2402.03241">arXiv</a> -->
<!-- | -->
<a class="pub-link" href="https://visual-ai.github.io/ibd-slam/"><i class="fa fa-globe"></i>Project</a>
<!-- |
<a href="https://github.com/Visual-AI/IBD-SLAM">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('yin2024ibdslam_bib','yin2024ibdslam_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="yin2024ibdslam_cop" class="copied-msg" style="display:none">Copied!</span><code id="yin2024ibdslam_bib">@inproceedings{yin2024ibdslam,
author = {Minghao Yin and Shangzhe Wu and Kai Han},
title = {IBD-SLAM: Learning Image-Based Depth Fusion for Generalizable SLAM},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_dream_avatar.gif" border=0 width=220></td>
<td id="cao24dream">
<span class="pub-title"><i>DreamAvatar: Text-and-Shape Guided 3D Human Avatar Generation via Diffusion Models</i></span><br>
Yukang Cao*, Yan-Pei Cao*, <b>Kai Han</b>, Ying Shan, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('cao24dream')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2304.00916.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2304.00916"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://yukangcao.github.io/DreamAvatar/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/yukangcao/DreamAvatar"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('cao24dream_bib','cao24dream_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="cao24dream_cop" class="copied-msg" style="display:none">Copied!</span><code id="cao24dream_bib">@inproceedings{cao24dream,
author = {Yukang Cao and Yan-Pei Cao and Kai Han and Ying Shan and Kwan-Yee K. Wong},
title = {DreamAvatar: Text-and-Shape Guided 3D Human Avatar Generation via Diffusion Models},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_cvpr_sd4match.jpg" border=0 width=220></td>
<td id="li2024sd4match">
<span class="pub-title"><i>SD4Match: Learning to Prompt Stable Diffusion Model for Semantic Matching</i></span><br>
Xinghui Li, Jingyi Lu, <b>Kai Han</b>, Victor Prisacariu<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li2024sd4match')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2310.17569.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2310.17569"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://sd4match.active.vision/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/ActiveVisionLab/SD4Match"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li2024sd4match_bib','li2024sd4match_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li2024sd4match_cop" class="copied-msg" style="display:none">Copied!</span><code id="li2024sd4match_bib">@inproceedings{li2024sd4match,
author = {Xinghui Li and Jingyi Lu and Kai Han and Victor Prisacariu},
title = {SD4Match: Learning to Prompt Stable Diffusion Model for Semantic Matching},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_SCD.jpg" border=0 width=220></td>
<td id="han23scd">
<span class="pub-title"><i>What’s in a Name? Beyond Class Indices for Image Recognition</i></span><br>
<b>Kai Han</b>*, Xiaohu Huang*, Yandong Li*, Sagar Vaze*, Jie Li, Xuhui Jia<br>
<span class="pub-venue">CVPR Workshop on Computer Vision in the Wild, 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han23scd')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2304.02364.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2304.02364"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> --> <a class="pub-link" href="https://github.com/Visual-AI/SCD"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han23scd_bib','han23scd_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han23scd_cop" class="copied-msg" style="display:none">Copied!</span><code id="han23scd_bib">@inproceedings{han23scd,
author = {Kai Han and Yandong Li and Sagar Vaze and Jie Li and Xuhui Jia},
title = {What's in a Name? Beyond Class Indices for Image Recognition},
booktitle = {CVPR Workshop on Computer Vision in the Wild},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_charting.jpg" border=0 width=220></td>
<td id="Roberts2024NewTerri">
<span class="pub-title"><i>Charting New Territories: Exploring the Geographic and Geospatial Capabilities of Multimodal LLMs</i></span><br>
Jonathan Roberts, Timo Lüddecke, Rehan Sheikh, <b>Kai Han</b>, Samuel Albanie<br>
<span class="pub-venue">CVPR Workshop on EarthVision, 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('Roberts2024NewTerri')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2311.14656.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2311.14656"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> --> <a class="pub-link" href="https://github.com/jonathan-roberts1/charting-new-territories"><i class="fa fa-database"></i>Dataset</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('Roberts2024NewTerri_bib','Roberts2024NewTerri_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="Roberts2024NewTerri_cop" class="copied-msg" style="display:none">Copied!</span><code id="Roberts2024NewTerri_bib">@inproceedings{Roberts2024NewTerri,
author = {Roberts, Jonathan and L\"uddecke, Timo and Sheikh, Rehan and Han, Kai and Albanie, Samuel},
title = {Charting New Territories: Exploring the Geographic and Geospatial Capabilities of Multimodal LLMs},
booktitle = {CVPR Workshop on EarthVision},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_CiPR.jpg" border=0 width=220></td>
<td id="hao24cipr">
<span class="pub-title"><i>CiPR: An Efficient Framework with Cross-instance Positive Relations for Generalized Category Discovery</i></span><br>
Shaozhe Hao, <b>Kai Han</b>, Kwan-Yee K. Wong<br>
<span class="pub-venue">Transactions on Machine Learning Research (<b>TMLR</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('hao24cipr')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2304.06928.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2304.06928"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> --> <a class="pub-link" href="https://github.com/haoosz/CiPR"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('hao24cipr_bib','hao24cipr_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="hao24cipr_cop" class="copied-msg" style="display:none">Copied!</span><code id="hao24cipr_bib">@article{hao24cipr,
title = {CiPR: An Efficient Framework with Cross-instance Positive Relations for Generalized Category Discovery},
author = {Shaozhe Hao and Kai Han and Kwan-Yee K. Wong},
journal = {Transactions on Machine Learning Research},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_iclr_sptnet.jpg" border=0 width=220></td>
<td id="wang2024sptnet">
<span class="pub-title"><i>SPTNet: An Efficient Alternative Framework for Generalized Category Discovery with Spatial Prompt Tuning</i></span><br>
Hongjun Wang, Sagar Vaze, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('wang2024sptnet')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2403.13684.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2403.13684"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://visual-ai.github.io/sptnet/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/SPTNet"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('wang2024sptnet_bib','wang2024sptnet_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="wang2024sptnet_cop" class="copied-msg" style="display:none">Copied!</span><code id="wang2024sptnet_bib">@inproceedings{wang2024sptnet,
author = {Hongjun Wang and Sagar Vaze and Kai Han},
title = {SPTNet: An Efficient Alternative Framework for Generalized Category Discovery with Spatial Prompt Tuning},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2024},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2024_iclr_froster.jpg" border=0 width=220></td>
<td id="huang2024froster">
<span class="pub-title"><i>FROSTER: Frozen CLIP is a Strong Teacher for Open-Vocabulary Action Recognition</i></span><br>
Xiaohu Huang, Hao Zhou, Kun Yao, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2024.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('huang2024froster')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2402.03241.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2402.03241"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://visual-ai.github.io/froster/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/Visual-AI/FROSTER"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('huang2024froster_bib','huang2024froster_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="huang2024froster_cop" class="copied-msg" style="display:none">Copied!</span><code id="huang2024froster_bib">@inproceedings{huang2024froster,
author = {Xiaohu Huang and Hao Zhou and Kun Yao and Kai Han},
title = {FROSTER: Frozen CLIP is a Strong Teacher for Open-Vocabulary Action Recognition},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2024},
}</code></pre>
</td>
</tr>
</table>
<h3>2023</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2023_neurips_batman.gif" border=0 width=110><img src="./images/2023_neurips_hulk.gif" border=0 width=110></td>
<td id="han2023headsculpt">
<span class="pub-title"><i>HeadSculpt: Crafting 3D Head Avatars with Text</i></span><br>
Xiao Han*, Yukang Cao*, <b>Kai Han</b>, Xiatian Zhu, Jiankang Deng, Yi-Zhe Song, Tao Xiang, Kwan-Yee K. Wong<br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han2023headsculpt')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2306.03038.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2306.03038"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://brandonhan.uk/HeadSculpt/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/BrandonHanx/HeadSculpt"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han2023headsculpt_bib','han2023headsculpt_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han2023headsculpt_cop" class="copied-msg" style="display:none">Copied!</span><code id="han2023headsculpt_bib">@inproceedings{han2023headsculpt,
author = {Xiao Han and Yukang Cao and Kai Han and Xiatian Zhu and Jiankang Deng and Yi-Zhe Song and Tao Xiang and Kwan-Yee K. Wong},
title = {HeadSculpt: Crafting 3D Head Avatars with Text},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_GPT4GEO.jpg" border=0 width=220></td>
<td id="roberts2023GPT4GEO">
<span class="pub-title"><i>GPT4GEO: How a Language Model Sees the World's Geography</i></span><br>
Jonathan Roberts, Timo Lüddecke, Sowmen Das, <b>Kai Han</b>, Samuel Albanie<br>
<span class="pub-venue">NeurIPS Workshop on Foundation Models for Decision Making, 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('roberts2023GPT4GEO')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2306.00020.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2306.00020"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<a class="pub-link" href="https://github.com/jonathan-roberts1/GPT4GEO"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('roberts2023GPT4GEO_bib','roberts2023GPT4GEO_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="roberts2023GPT4GEO_cop" class="copied-msg" style="display:none">Copied!</span><code id="roberts2023GPT4GEO_bib">@inproceedings{roberts2023GPT4GEO,
author = {Roberts, Jonathan and L{\"u}ddecke, Timo and Das, Sowmen and Han, Kai and Albanie, Samuel},
title = {GPT4GEO: How a Language Model Sees the World's Geography},
booktitle = {NeurIPS Workshop on Foundation Models for Decision Making},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_tpami_dualrc.jpg" border=0 width=220></td>
<td id="li23dualrc">
<span class="pub-title"><i>DualRC: A Dual-Resolution Learning Framework with Neighbourhood Consensus for Visual Correspondences</i></span><br>
Xinghui Li, <b>Kai Han</b>, Shuda Li, Victor Prisacariu<br>
<span class="pub-venue">IEEE Transactions on Pattern Analysis and Machine Intelligence (<b>TPAMI</b>), 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li23dualrc')"><i class="fa fa-file-code-o"></i>BibTeX</a> <!-- <a href="https://www.robots.ox.ac.uk/~vgg/research/auto_novel/asset/tpami2021_auto_novel.pdf">PDF</a> | -->
<!-- <a href="https://arxiv.org/abs/2106.15252">arXiv</a> | -->
<a class="pub-link" href="https://doi.org/10.1109/TPAMI.2023.3316770"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="https://dualrcnet.active.vision/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/ActiveVisionLab/DualRC-Net"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li23dualrc_bib','li23dualrc_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li23dualrc_cop" class="copied-msg" style="display:none">Copied!</span><code id="li23dualrc_bib">@article{li23dualrc,
author = {Xinghui Li and Kai Han and Shuda Li and Victor Prisacariu},
title = {DualRC: A Dual-Resolution Learning Framework with Neighbourhood Consensus for Visual Correspondences},
journal = {IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_learning.jpg" border=0 width=220></td>
<td id="zhao23learning">
<span class="pub-title"><i>Learning Semi-supervised Gaussian Mixture Models for Generalized Category Discovery</i></span><br>
Bingchen Zhao, Xin Wen, <b>Kai Han</b><br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('zhao23learning')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2305.06144.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2305.06144"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> --> <a class="pub-link" href="https://github.com/DTennant/GPC"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('zhao23learning_bib','zhao23learning_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="zhao23learning_cop" class="copied-msg" style="display:none">Copied!</span><code id="zhao23learning_bib">@inproceedings{zhao23learning,
author = {Bingchen Zhao and Xin Wen and Kai Han},
title = {Learning Semi-supervised Gaussian Mixture Models for Generalized Category Discovery},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_open.jpg" border=0 width=220></td>
<td id="han23open">
<span class="pub-title"><i>Open-Vocabulary Semantic Segmentation with Decoupled One-Pass Network</i></span><br>
Cong Han*, Yujie Zhong*, Dengjie Li, <b>Kai Han</b>, Lin Ma<br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han23open')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2304.01198.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2304.01198"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<a class="pub-link" href="https://github.com/CongHan0808/DeOP"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han23open_bib','han23open_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han23open_cop" class="copied-msg" style="display:none">Copied!</span><code id="han23open_bib">@inproceedings{han23open,
author = {Cong Han and Yujie Zhong and Dengjie Li and Kai Han and Lin Ma},
title = {Open-Vocabulary Semantic Segmentation with Decoupled One-Pass Network},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_SATIN.jpg" border=0 width=220></td>
<td id="roberts2023satin">
<span class="pub-title"><i>SATIN: A Multi-Task Metadataset for Classifying Satellite Imagery using Vision-Language Models</i></span><br>
Jonathan Roberts, <b>Kai Han</b>, Samuel Albanie<br>
<span class="pub-venue">ICCV TNGCV Workshop, 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('roberts2023satin')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2304.11619.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2304.11619"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://satinbenchmark.github.io/"><i class="fa fa-globe"></i>Project</a>
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('roberts2023satin_bib','roberts2023satin_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="roberts2023satin_cop" class="copied-msg" style="display:none">Copied!</span><code id="roberts2023satin_bib">@inproceedings{roberts2023satin,
title = {SATIN: A Multi-Task Metadataset for Classifying Satellite Imagery using Vision-Language Models},
author = {Jonathan Roberts and Kai Han and Samuel Albanie},
booktitle = {ICCV TNGCV Workshop},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_cvpr_ade.jpg" border=0 width=220></td>
<td id="hao2023ade">
<span class="pub-title"><i>Learning Attention as Disentangler for Compositional Zero-shot Learning</i></span><br>
Shaozhe Hao, <b>Kai Han</b>, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('hao2023ade')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2303.15111.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2303.15111"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://haoosz.github.io/ade-czsl/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/haoosz/ade-czsl"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('hao2023ade_bib','hao2023ade_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="hao2023ade_cop" class="copied-msg" style="display:none">Copied!</span><code id="hao2023ade_bib">@inproceedings{hao2023ade,
author = {Shaozhe Hao and Kai Han and Kwan-Yee K. Wong},
title = {Learning Attention as Disentangler for Compositional Zero-shot Learning},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_cvpr_SeSDF.jpg" border=0 width=220></td>
<td id="cao2023sesdf">
<span class="pub-title"><i>SeSDF: Self-evolved Signed Distance Field for Implicit 3D Clothed Human Reconstruction</i></span><br>
Yukang Cao, <b>Kai Han</b>, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('cao2023sesdf')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2304.00359.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2304.00359"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://yukangcao.github.io/SeSDF/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/yukangcao/SeSDF"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('cao2023sesdf_bib','cao2023sesdf_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="cao2023sesdf_cop" class="copied-msg" style="display:none">Copied!</span><code id="cao2023sesdf_bib">@inproceedings{cao2023sesdf,
author = {Yukang Cao and Kai Han and Kwan-Yee K. Wong},
title = {SeSDF: Self-evolved Signed Distance Field for Implicit 3D Clothed Human Reconstruction},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_ViCo.jpg" border=0 width=220></td>
<td id="hao2023ViCo">
<span class="pub-title"><i>ViCo: Detail-Preserving Visual Condition for Personalized Text-to-Image Generation</i></span><br>
Shaozhe Hao, <b>Kai Han</b>, Shihao Zhao, Kwan-Yee K. Wong<br>
<span class="pub-venue">arXiv preprint, 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('hao2023ViCo')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2306.00971.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2306.00971"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<a class="pub-link" href="https://github.com/haoosz/ViCo"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('hao2023ViCo_bib','hao2023ViCo_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="hao2023ViCo_cop" class="copied-msg" style="display:none">Copied!</span><code id="hao2023ViCo_bib">@article{hao2023ViCo,
author = {Shaozhe Hao and Kai Han and Shihao Zhao and Kwan-Yee K. Wong},
title = {ViCo: Detail-Preserving Visual Condition for Personalized Text-to-Image Generation},
journal = {arXiv preprint arXiv:2306.00971},
year = {2023},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2023_SimSC.jpg" border=0 width=220></td>
<td id="li23SimSC">
<span class="pub-title"><i>SimSC: A Simple Framework for Semantic Correspondence with Temperature Learning</i></span><br>
Xinghui Li, <b>Kai Han</b>, Xingchen Wan, Victor Adrian Prisacariu<br>
<span class="pub-venue">arXiv preprint, 2023.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li23SimSC')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2305.02385.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2305.02385"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> -->
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li23SimSC_bib','li23SimSC_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li23SimSC_cop" class="copied-msg" style="display:none">Copied!</span><code id="li23SimSC_bib">@article{li23SimSC,
title = {SimSC: A Simple Framework for Semantic Correspondence with Temperature Learning},
author = {Xinghui Li and Kai Han and Xingchen Wan and Victor Adrian Prisacariu},
journal = {arXiv preprint arXiv:2305.02385},
year = {2023},
}</code></pre>
</td>
</tr>
</table>
<h3>2022</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2022_eccv_NCDwF.jpg" border=0 width=220></td>
<td id="joseph22ncdwf">
<span class="pub-title"><i>Novel Class Discovery without Forgetting</i></span><br>
K J Joseph, Sujoy Paul, Gaurav Aggarwal, Soma Biswas, Piyush Rai, <b>Kai Han</b>, Vineeth N Balasubramanian<br>
<span class="pub-venue">European Conference on Computer Vision (<b>ECCV</b>), 2022.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('joseph22ncdwf')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2207.10659.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2207.10659"><i class="ai ai-arxiv"></i>arXiv</a>
<!-- | -->
<!-- <a href="">project page</a> | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('joseph22ncdwf_bib','joseph22ncdwf_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="joseph22ncdwf_cop" class="copied-msg" style="display:none">Copied!</span><code id="joseph22ncdwf_bib">@inproceedings{joseph22ncdwf,
author = {K J Joseph and Sujoy Paul and Gaurav Aggarwal and Soma Biswas and Piyush Rai and Kai Han and Vineeth N Balasubramanian},
title = {Novel Class Discovery without Forgetting},
booktitle = {European Conference on Computer Vision (ECCV)},
year = {2022},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2022_cvpr_generalized.jpg" border=0 width=220></td>
<td id="vaze22generalized">
<span class="pub-title"><i>Generalized Category Discovery</i></span><br>
Sagar Vaze, <b>Kai Han</b>, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2022.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('vaze22generalized')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2201.02609.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2201.02609"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://www.robots.ox.ac.uk/~vgg/research/gcd"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/sgvaze/generalized-category-discovery"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('vaze22generalized_bib','vaze22generalized_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="vaze22generalized_cop" class="copied-msg" style="display:none">Copied!</span><code id="vaze22generalized_bib">@inproceedings{vaze22generalized,
author = {Sagar Vaze and Kai Han and Andrea Vedaldi and Andrew Zisserman},
title = {Generalized Category Discovery},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2022},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2022_cvpr_JIFF.gif" border=0 width=220></td>
<td id="cao22jiff">
<span class="pub-title"><i>JIFF: Jointly-aligned Implicit Face Function for High Quality Single View Clothed Human Reconstruction</i></span><br>
Yukang Cao, Guanying Chen, <b>Kai Han</b>, Wenqi Yang, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2022.</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Oral presentation · 4.2% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('cao22jiff')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2204.10549.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2204.10549"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://yukangcao.github.io/JIFF"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/yukangcao/JIFF"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('cao22jiff_bib','cao22jiff_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="cao22jiff_cop" class="copied-msg" style="display:none">Copied!</span><code id="cao22jiff_bib">@inproceedings{cao22jiff,
author = {Yukang Cao and Guanying Chen and Kai Han and Wenqi Yang and Kwan-Yee K. Wong},
title = {JIFF: Jointly-aligned Implicit Face Function for High Quality Single View Clothed Human Reconstruction},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2022},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2022_cvpr_sharpcontour.jpg" border=0 width=220></td>
<td id="zhu22sharpcontour">
<span class="pub-title"><i>SharpContour: A Contour-based Boundary Refinement Approach for Efficient and Accurate Instance Segmentation</i></span><br>
Chenming Zhu, Xuanye Zhang, Yanran Li, Liangdong Qiu, <b>Kai Han</b>, Xiaoguang Han<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2022.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('zhu22sharpcontour')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2203.13312.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2203.13312"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://xyzhang17.github.io/SharpContour/"><i class="fa fa-globe"></i>Project</a>
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('zhu22sharpcontour_bib','zhu22sharpcontour_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="zhu22sharpcontour_cop" class="copied-msg" style="display:none">Copied!</span><code id="zhu22sharpcontour_bib">@inproceedings{zhu22sharpcontour,
author = {Chenming Zhu and Xuanye Zhang and Yanran Li and Liangdong Qiu and Kai Han and Xiaoguang Han},
title = {SharpContour: A Contour-based Boundary Refinement Approach for Efficient and Accurate Instance Segmentation},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2022},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2022_cvprw_spacing.jpg" border=0 width=220></td>
<td id="joseph22spacing">
<span class="pub-title"><i>Spacing Loss for Discovering Novel Categories</i></span><br>
K J Joseph, Sujoy Paul, Gaurav Aggarwal, Soma Biswas, Piyush Rai, <b>Kai Han</b>, Vineeth N Balasubramanian<br>
<span class="pub-venue">CVPR Workshop on Continual Learning in Computer Vision, 2022.</span><br>
<span class="pub-links"><b>Best Paper Runner-Up Award</b> <a class="pub-link togglebib" href="javascript:togglebib('joseph22spacing')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2204.10595.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2204.10595"><i class="ai ai-arxiv"></i>arXiv</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('joseph22spacing_bib','joseph22spacing_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="joseph22spacing_cop" class="copied-msg" style="display:none">Copied!</span><code id="joseph22spacing_bib">@inproceedings{joseph22spacing,
author = {K J Joseph and Sujoy Paul and Gaurav Aggarwal and Soma Biswas and Piyush Rai and Kai Han and Vineeth N Balasubramanian},
title = {Spacing Loss for Discovering Novel Categories},
booktitle = {CVPR Workshop on Continual Learning in Computer Vision},
year = {2022},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2022_openset.jpg" border=0 width=220></td>
<td id="vaze22openset">
<span class="pub-title"><i>Open-Set Recognition: A Good Closed-Set Classifier is All You Need?</i></span><br>
Sagar Vaze, <b>Kai Han</b>, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2022.</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Oral presentation · 1.6% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('vaze22openset')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2110.06207.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2110.06207"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://openreview.net/forum?id=5hLP5JY9S2d"><i class="fa fa-comments"></i>OpenReview</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://www.robots.ox.ac.uk/~vgg/research/osr/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/sgvaze/osr_closed_set_all_you_need"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('vaze22openset_bib','vaze22openset_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="vaze22openset_cop" class="copied-msg" style="display:none">Copied!</span><code id="vaze22openset_bib">@inproceedings{vaze22openset,
author = {Sagar Vaze and Kai Han and Andrea Vedaldi and Andrew Zisserman},
title = {Open-Set Recognition: A Good Closed-Set Classifier is All You Need?},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2022},
}</code></pre>
</td>
</tr>
</table>
<h3>2021</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2021_neurips_novel.jpg" border=0 width=220></td>
<td id="zhao21novel">
<span class="pub-title"><i>Novel Visual Category Discovery with Dual Ranking Statistics and Mutual Knowledge Distillation</i></span><br>
Bingchen Zhao, <b>Kai Han</b><br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('zhao21novel')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://proceedings.neurips.cc/paper/2021/file/c203d8a151612acf12457e4d67635a95-Paper.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2107.03358"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://openreview.net/forum?id=xWq1MVj7YrE"><i class="fa fa-comments"></i>OpenReview</a> <a class="pub-link" href="https://proceedings.neurips.cc/paper/2021/file/c203d8a151612acf12457e4d67635a95-Supplemental.pdf"><i class="fa fa-file-text-o"></i>Supp</a> <a class="pub-link" href="https://bzhao.me/dual-rank/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/DTennant/dual-rank-ncd"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('zhao21novel_bib','zhao21novel_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="zhao21novel_cop" class="copied-msg" style="display:none">Copied!</span><code id="zhao21novel_bib">
@inproceedings{zhao21novel,
author = {Bingchen Zhao and Kai Han},
title = {Novel Visual Category Discovery with Dual Ranking Statistics and Mutual Knowledge Distillation},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2021}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2021_iccv_joint.jpg" border=0 width=220></td>
<td id="jia21joint">
<span class="pub-title"><i>Joint Representation Learning and Novel Category Discovery on Single- and Multi-modal Data</i></span><br>
Xuhui Jia, <b>Kai Han</b>, Yukun Zhu, Bradley Green<br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('jia21joint')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2104.12673.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2104.12673"><i class="ai ai-arxiv"></i>arXiv</a><!-- | -->
<!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> |
<a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('jia21joint_bib','jia21joint_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="jia21joint_cop" class="copied-msg" style="display:none">Copied!</span><code id="jia21joint_bib">
@inproceedings{jia21joint,
author = {Xuhui Jia and Kai Han and Yukun Zhu and Bradley Green},
title = {Joint Representation Learning and Novel Category Discovery on Single- and Multi-modal Data},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2021}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2021_bmvc_XRCNet.jpg" border=0 width=220></td>
<td id="tinchev20xresolution">
<span class="pub-title"><i>𝕏Resolution Correspondence Networks</i></span><br>
Georgi Tinchev, Shuda Li, <b>Kai Han</b>, David Mitchell, Rigas Kouskouridas<br>
<span class="pub-venue">British Machine Vision Conference (<b>BMVC</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('tinchev20xresolution')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2012.09842.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2012.09842"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<a class="pub-link" href="https://xyzreality.github.io/xrcnet/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/XYZReality/xrcnet"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('tinchev20xresolution_bib','tinchev20xresolution_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="tinchev20xresolution_cop" class="copied-msg" style="display:none">Copied!</span><code id="tinchev20xresolution_bib">
@inproceedings{tinchev20xresolution,
author = {Georgi Tinchev and Shuda Li and Kai Han and David Mitchell and Rigas Kouskouridas},
title = {{$\mathbb{X}$}Resolution Correspondence Networks},
booktitle = {British Machine Vision Conference (BMVC)},
year = {2021}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2021_iccvw_LSDC.jpg" border=0 width=220></td>
<td id="rebuffi21lsdc">
<span class="pub-title"><i>LSD-C: Linearly Separable Deep Clusters</i></span><br>
Sylvestre-Alvise Rebuffi*, Sebastien Ehrhardt*, <b>Kai Han</b>*, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">ICCV Workshop on Visual Inductive Priors for Data-Efficient Deep Learning, 2021. (* indicates equal contribution.)</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('rebuffi21lsdc')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2006.10039.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2006.10039"><i class="ai ai-arxiv"></i>arXiv</a> <!-- <a href="">supplementary</a> | -->
<!-- <a href="">project page</a> | -->
<a class="pub-link" href="https://github.com/srebuffi/lsd-clusters"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('rebuffi21lsdc_bib','rebuffi21lsdc_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="rebuffi21lsdc_cop" class="copied-msg" style="display:none">Copied!</span><code id="rebuffi21lsdc_bib">
@inproceedings{rebuffi21lsdc,
author = {Sylvestre-Alvise Rebuffi and Sebastien Ehrhardt and Kai Han and Andrea Vedaldi and Andrew Zisserman},
title = {LSD-C: Linearly Separable Deep Clusters},
booktitle = {ICCV Workshop on Visual Inductive Priors for Data-Efficient Deep Learning},
year = {2021}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2021_cvpr_contrastive.jpg" border=0 width=220></td>
<td id="wang21contrastive">
<span class="pub-title"><i>Contrastive Learning based Hybrid Networks for Long-Tailed Image Classification</i></span><br>
Peng Wang, <b>Kai Han</b>, Xiu-Shen Wei, Lei Zhang, Lei Wang<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('wang21contrastive')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2103.14267.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2103.14267"><i class="ai ai-arxiv"></i>arXiv</a><!-- <a href="https://k-han.github.io/HybridLT">project page</a> -->
<!-- | -->
<!-- <a href="">code</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('wang21contrastive_bib','wang21contrastive_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="wang21contrastive_cop" class="copied-msg" style="display:none">Copied!</span><code id="wang21contrastive_bib">@inproceedings{wang21contrastive,
author = {Peng Wang and Kai Han and Xiu-Shen Wei and Lei Zhang and Lei Wang},
title = {Contrastive Learning based Hybrid Networks for Long-Tailed Image Classification},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2021},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2021_tpami_autonovel.jpg" border=0 width=220></td>
<td id="han21autonovel">
<span class="pub-title"><i>AutoNovel: Automatically Discovering and Learning Novel Visual Categories</i></span><br>
<b>Kai Han</b>, Sylvestre-Alvise Rebuffi, Sebastien Ehrhardt, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">IEEE Transactions on Pattern Analysis and Machine Intelligence (<b>TPAMI</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han21autonovel')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://www.robots.ox.ac.uk/~vgg/research/auto_novel/asset/tpami2021_auto_novel.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2106.15252"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://doi.org/10.1109/TPAMI.2021.3091944"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/research/auto_novel/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/k-han/AutoNovel"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han21autonovel_bib','han21autonovel_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han21autonovel_cop" class="copied-msg" style="display:none">Copied!</span><code id="han21autonovel_bib">@article{han21autonovel,
author = {Kai Han and Sylvestre-Alvise Rebuffi and Sebastien Ehrhardt and Andrea Vedaldi and Andrew Zisserman},
title = {AutoNovel: Automatically Discovering and Learning Novel Visual Categories},
journal = {IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)},
year = {2021},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2020_cvpr_aic_net.jpg" border=0 width=220></td>
<td id="li21anisotropic">
<span class="pub-title"><i>Anisotropic Convolutional Neural Networks for RGB-D based Semantic Scene Completion</i></span><br>
Jie Li, Peng Wang, <b>Kai Han</b>, Yu Liu<br>
<span class="pub-venue">IEEE Transactions on Pattern Analysis and Machine Intelligence (<b>TPAMI</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li21anisotropic')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2004.02122.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2004.02122"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://doi.org/10.1109/TPAMI.2021.3081499"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="https://waterljwant.github.io/SSC/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/waterljwant/SSC"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li21anisotropic_bib','li21anisotropic_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li21anisotropic_cop" class="copied-msg" style="display:none">Copied!</span><code id="li21anisotropic_bib">@article{li21anisotropic,
author = {Jie Li and Peng Wang and Kai Han and Yu Liu},
title = {Anisotropic Convolutional Neural Networks for RGB-D based Semantic Scene Completion},
journal = {IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)},
year = {2021},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2021_tip_mirror.jpg" border=0 width=220></td>
<td id="han21fixed">
<span class="pub-title"><i>Fixed Viewpoint Mirror Surface Reconstruction under an Uncalibrated Camera</i></span><br>
<b>Kai Han</b>, Miaomiao Liu, Dirk Schnieders, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Transactions on Image Processing (<b>TIP</b>), 2021.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han21fixed')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://k-han.github.io/mirror/asset/han21fixed.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2101.09392"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://doi.org/10.1109/TIP.2021.3049946"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="https://k-han.github.io/mirror/asset/han21fixed_supp.pdf"><i class="fa fa-file-text-o"></i>Supp</a> <a class="pub-link" href="https://k-han.github.io/mirror"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/k-han/mirror"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han21fixed_bib','han21fixed_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han21fixed_cop" class="copied-msg" style="display:none">Copied!</span><code id="han21fixed_bib">@article{han21fixed,
title = {Fixed Viewpoint Mirror Surface Reconstruction under an Uncalibrated Camera},
author = {Kai Han and Miaomiao Liu and Dirk Schnieders and Kwan-Yee K. Wong},
journal = {IEEE Transactions on Image Processing (TIP)},
year = {2021}
}</code></pre>
</td>
</tr>
</table>
<h3>2020</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2020_neurips_dualrc.jpg" border=0 width=220></td>
<td id="li20dualrc">
<span class="pub-title"><i>Dual-Resolution Correspondence Networks</i></span><br>
Xinghui Li, <b>Kai Han</b>, Shuda Li, Victor Prisacariu<br>
<span class="pub-venue">Conference on Neural Information Processing Systems (<b>NeurIPS</b>), 2020.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li20dualrc')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://dualrcnet.active.vision/asset/DualRC_Net.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2006.08844"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://dualrcnet.active.vision/asset/DualRC_Net_supp.pdf"><i class="fa fa-file-text-o"></i>Supp</a> <a class="pub-link" href="https://dualrcnet.active.vision/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/ActiveVisionLab/DualRC-Net"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li20dualrc_bib','li20dualrc_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li20dualrc_cop" class="copied-msg" style="display:none">Copied!</span><code id="li20dualrc_bib">@inproceedings{li20dualrc,
author = {Xinghui Li and Kai Han and Shuda Li and Victor Prisacariu},
title = {Dual-Resolution Correspondence Networks},
booktitle = {Conference on Neural Information Processing Systems (NeurIPS)},
year = {2020},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2020_iclr_auto_novel.jpg" border=0 width=220></td>
<td id="han20automatically">
<span class="pub-title"><i>Automatically Discovering and Learning New Visual Categories with Ranking Statistics</i></span><br>
<b>Kai Han</b>*, Sylvestre-Alvise Rebuffi*, Sebastien Ehrhardt*, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">International Conference on Learning Representations (<b>ICLR</b>), 2020. (* indicates equal contribution.)</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han20automatically')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://openreview.net/pdf?id=BJl2_nVFPB"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2002.05714"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://openreview.net/forum?id=BJl2_nVFPB"><i class="fa fa-comments"></i>OpenReview</a> <a class="pub-link" href="https://iclr.cc/virtual_2020/poster_BJl2_nVFPB.html"><i class="fa fa-play-circle"></i>Video</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/research/auto_novel/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/k-han/AutoNovel"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han20automatically_bib','han20automatically_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han20automatically_cop" class="copied-msg" style="display:none">Copied!</span><code id="han20automatically_bib">@inproceedings{han20automatically,
author = {Kai Han and Sylvestre-Alvise Rebuffi and Sebastien Ehrhardt and Andrea Vedaldi and Andrew Zisserman},
title = {Automatically Discovering and Learning New Visual Categories with Ranking Statistics},
booktitle = {International Conference on Learning Representations (ICLR)},
year = {2020},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2020_cvpr_anc_net.jpg" border=0 width=220></td>
<td id="li20correspondence">
<span class="pub-title"><i>Correspondence Networks with Adaptive Neighbourhood Consensus</i></span><br>
Shuda Li*, <b>Kai Han</b>*, Theo W. Costain, Henry Howard-Jenkins, Victor Prisacariu<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2020. (* indicates equal contribution.)</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li20correspondence')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://ancnet.active.vision/asset/cvpr2020_anc_net.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2003.12059"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://ancnet.active.vision/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/ActiveVisionLab/ANCNet"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li20correspondence_bib','li20correspondence_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li20correspondence_cop" class="copied-msg" style="display:none">Copied!</span><code id="li20correspondence_bib">@inproceedings{li20correspondence,
author = {Shuda Li and Kai Han and Theo W. Costain and Henry Howard-Jenkins and Victor Prisacariu},
title = {Correspondence Networks with Adaptive Neighbourhood Consensus},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2020},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2020_cvpr_aic_net.jpg" border=0 width=220></td>
<td id="li20anisotropic">
<span class="pub-title"><i>Anisotropic Convolutional Networks for 3D Semantic Scene Completion</i></span><br>
Jie Li, <b>Kai Han</b>, Peng Wang, Yu Liu, Xia Yuan<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2020.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('li20anisotropic')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2004.02122.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2004.02122"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://waterljwant.github.io/SSC/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/waterljwant/SSC"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('li20anisotropic_bib','li20anisotropic_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="li20anisotropic_cop" class="copied-msg" style="display:none">Copied!</span><code id="li20anisotropic_bib">@inproceedings{li20anisotropic,
author = {Jie Li and Kai Han and Peng Wang and Yu Liu and Xia Yuan},
title = {Anisotropic Convolutional Networks for 3D Semantic Scene Completion},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2020},
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2020_cvprw_SSL.jpg" border=0 width=220></td>
<td id="rebuffi20SSL">
<span class="pub-title"><i>Semi-Supervised Learning with Scarce Annotations</i></span><br>
Sylvestre-Alvise Rebuffi*, Sebastien Ehrhardt*, <b>Kai Han</b>*, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">CVPR Deep Vision Workshop, 2020. (* indicates equal contribution.)</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('rebuffi20SSL')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/research/SSL_scarce/asset/SSL_scarce.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1905.08845"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/research/SSL_scarce/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/srebuffi/semisup_scarse"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('rebuffi20SSL_bib','rebuffi20SSL_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="rebuffi20SSL_cop" class="copied-msg" style="display:none">Copied!</span><code id="rebuffi20SSL_bib">@inproceedings{rebuffi20SSL,
title={Semi-Supervised Learning with Scarce Annotations},
author={Sylvestre-Alvise Rebuffi and Sebastien Ehrhardt and Kai Han and Andrea Vedaldi and Andrew Zisserman},
booktitle={CVPR Deep Vision Workshop},
year={2020}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2020_tpami_deepps.jpg" border=0 width=220></td>
<td id="chen20deepps">
<span class="pub-title"><i>Deep Photometric Stereo for Non-Lambertian Surfaces</i></span><br>
Guanying Chen, <b>Kai Han</b>, Boxin Shi, Yasuyuki Matsushita, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Transactions on Pattern Analysis and Machine Intelligence (<b>TPAMI</b>), 2020.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('chen20deepps')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2007.13145"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2007.13145"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://doi.org/10.1109/TPAMI.2020.3005397"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="papers/tpami20_deepps_supp.pdf"><i class="fa fa-file-text-o"></i>Supp</a> <a class="pub-link" href="https://guanyingc.github.io/SDPS-Net/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/guanyingc/PS-FCN"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('chen20deepps_bib','chen20deepps_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="chen20deepps_cop" class="copied-msg" style="display:none">Copied!</span><code id="chen20deepps_bib">@article{chen20deepps,
title = {Deep Photometric Stereo for Non-Lambertian Surfaces},
author = {Guanying Chen and Kai Han and Boxin Shi and Yasuyuki Matsushita and Kwan-Yee K. Wong},
journal = {IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)},
year = {2020}
}</code></pre>
</td>
</tr>
</table>
<h3>2019</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2019_iccv_DTC.jpg" border=0 width=220></td>
<td id="han19DTC">
<span class="pub-title"><i>Learning to Discover Novel Visual Categories via Deep Transfer Clustering</i></span><br>
<b>Kai Han</b>, Andrea Vedaldi, Andrew Zisserman<br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2019.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han19DTC')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/publications/2019/Han19a/han19a.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1908.09884"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/research/DTC/files/iccv2019_DTC_supp.pdf"><i class="fa fa-file-text-o"></i>Supp</a> <a class="pub-link" href="http://www.robots.ox.ac.uk/~vgg/research/DTC/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/k-han/DTC"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han19DTC_bib','han19DTC_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han19DTC_cop" class="copied-msg" style="display:none">Copied!</span><code id="han19DTC_bib">@inproceedings{han19DTC,
author = {Kai Han and Andrea Vedaldi and Andrew Zisserman},
title = {Learning to Discover Novel Visual Categories via Deep Transfer Clustering},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2019}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2019_cvpr_unsup.jpg" border=0 width=220></td>
<td id="vo19unsup">
<span class="pub-title"><i>Unsupervised Image Matching and Object Discovery as Optimization </i></span><br>
Huy V. Vo, Francis Bach, Minsu Cho, <b>Kai Han</b>, Yann LeCun, Patrick Pérez, Jean Ponce<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2019.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('vo19unsup')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/1904.03148"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1904.03148"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://github.com/vohuy93/UODOptim"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('vo19unsup_bib','vo19unsup_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="vo19unsup_cop" class="copied-msg" style="display:none">Copied!</span><code id="vo19unsup_bib">@inproceedings{vo19unsup,
title = {Unsupervised Image Matching and Object Discovery as Optimization},
author = {Huy V. Vo and Francis Bach and Minsu Cho and Kai Han and Yann LeCun and Patrick P\'{e}rez and Jean Ponce},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2019}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2019_cvpr_SDPS-Net.jpg" border=0 width=220></td>
<td id="chen19SDPS_Net">
<span class="pub-title"><i>Self-calibrating Deep Photometric Stereo Networks</i></span><br>
Guanying Chen, <b>Kai Han</b>, Boxin Shi, Yasuyuki Matsushita, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2019.</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Oral presentation · 5.6% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('chen19SDPS_Net')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/1903.07366"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1903.07366"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://youtu.be/jbzfn-GVNys"><i class="fa fa-play-circle"></i>Video</a> <a class="pub-link" href="https://github.com/guanyingc/SDPS-Net_Poster_LaTex/blob/master/poster_landscape.pdf"><i class="fa fa-image"></i>Poster</a> <a class="pub-link" href="https://guanyingc.github.io/SDPS-Net/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/guanyingc/SDPS-Net"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('chen19SDPS_Net_bib','chen19SDPS_Net_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="chen19SDPS_Net_cop" class="copied-msg" style="display:none">Copied!</span><code id="chen19SDPS_Net_bib">@inproceedings{chen19SDPS_Net,
title = {Self-calibrating Deep Photometric Stereo Networks},
author = {Guanying Chen and Kai Han and Boxin Shi and Yasuyuki Matsushita and Kwan-Yee K. Wong},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2019}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2019_ijcv_tom-net.jpg" border=0 width=220></td>
<td id="chen19LTOM">
<span class="pub-title"><i>Learning Transparent Object Matting</i></span><br>
Guanying Chen*, <b>Kai Han</b>*, Kwan-Yee K. Wong<br>
<span class="pub-venue">International Journal of Computer Vision (<b>IJCV</b>), 2019. (* indicates equal contribution.)</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('chen19LTOM')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/1907.11544"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1907.11544"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://doi.org/10.1007/s11263-019-01202-3"><i class="ai ai-doi"></i>DOI</a> <a class="pub-link" href="https://guanyingc.github.io/TOM-Net/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/guanyingc/TOM-Net"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('chen19LTOM_bib','chen19LTOM_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="chen19LTOM_cop" class="copied-msg" style="display:none">Copied!</span><code id="chen19LTOM_bib">@article{chen19LTOM,
title = {Learning Transparent Object Matting},
author = {Guanying Chen and Kai Han and Kwan-Yee K. Wong},
journal = {International Journal of Computer Vision (IJCV)},
year = {2019}
}</code></pre>
</td>
</tr>
</table>
<h3>2018</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2018_eccv_ps-fcn.jpg" border=0 width=220></td>
<td id="chen18ps_fcn">
<span class="pub-title"><i>PS-FCN: A Flexible Learning Framework for Photometric Stereo</i></span><br>
Guanying Chen, <b>Kai Han</b>, Kwan-Yee K. Wong<br>
<span class="pub-venue">European Conference on Computer Vision (<b>ECCV</b>), 2018.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('chen18ps_fcn')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/1807.08696"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1807.08696"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://www.youtube.com/watch?v=FFL1pZ7z9nI"><i class="fa fa-play-circle"></i>Video</a> <a class="pub-link" href="https://github.com/guanyingc/PS-FCN_Poster_LaTex/blob/master/poster_landscape.pdf"><i class="fa fa-image"></i>Poster</a> <a class="pub-link" href="https://guanyingc.github.io/PS-FCN/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/guanyingc/PS-FCN"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('chen18ps_fcn_bib','chen18ps_fcn_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="chen18ps_fcn_cop" class="copied-msg" style="display:none">Copied!</span><code id="chen18ps_fcn_bib">@inproceedings{chen18ps_fcn,
title = {PS-FCN: A Flexible Learning Framework for Photometric Stereo},
author = {Guanying Chen and Kai Han and Kwan-Yee K. Wong},
booktitle = {European Conference on Computer Vision (ECCV)},
year = {2018}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2018_cvpr_tom-net.jpg" border=0 width=220></td>
<td id="chen18tom_net">
<span class="pub-title"><i>TOM-Net: Learning Transparent Object Matting from a Single Image</i></span><br>
Guanying Chen*, <b>Kai Han</b>*, Kwan-Yee K. Wong<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2018. (* indicates equal contribution.)</span><br>
<div class="pub-badge"><i class="fa fa-star"></i>Spotlight presentation · 6.7% of submissions</div>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('chen18tom_net')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="papers/cvpr18_tom-net.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1803.04636"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://www.youtube.com/watch?v=vvCbQvjZHsk"><i class="fa fa-play-circle"></i>Video</a> <a class="pub-link" href="https://github.com/guanyingc/TOM-Net_Poster_LaTex/blob/master/poster_landscape.pdf"><i class="fa fa-image"></i>Poster</a> <a class="pub-link" href="https://guanyingc.github.io/TOM-Net/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/guanyingc/TOM-Net"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('chen18tom_net_bib','chen18tom_net_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="chen18tom_net_cop" class="copied-msg" style="display:none">Copied!</span><code id="chen18tom_net_bib">@inproceedings{chen18tom_net,
title = {TOM-Net: Learning Transparent Object Matting from a Single Image},
author = {Guanying Chen and Kai Han and Kwan-Yee K. Wong},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2018}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2018_ijcv.jpg" border=0 width=220></td>
<td id="han18dense">
<span class="pub-title"><i>Dense Reconstruction of Transparent Objects by Altering Incident Light Paths Through Refraction</i></span><br>
<b>Kai Han</b>, Kwan-Yee K. Wong, Miaomiao Liu<br>
<span class="pub-venue">International Journal of Computer Vision (<b>IJCV</b>), 2018.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han18dense')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/2105.09993"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/2105.09993"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="https://doi.org/10.1007/s11263-017-1045-3"><i class="ai ai-doi"></i>DOI</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han18dense_bib','han18dense_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han18dense_cop" class="copied-msg" style="display:none">Copied!</span><code id="han18dense_bib">@article{han18dense,
title = {Dense Reconstruction of Transparent Objects by Altering Incident Light Paths through Refraction},
author = {Kai Han and Kwan-Yee K. Wong and Miaomiao Liu},
journal = {International Journal of Computer Vision (IJCV)},
year = {2018}
}</code></pre>
</td>
</tr>
</table>
<h3>2017</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2017_iccv_scnet.jpg" border=0 width=220></td>
<td id="han17scnet">
<span class="pub-title"><i>SCNet: Learning Semantic Correspondence</i></span><br>
<b>Kai Han</b>, Rafael S. Rezende, Bumsub Ham, Kwan-Yee K. Wong, Minsu Cho, Cordelia Schmid, Jean Ponce<br>
<span class="pub-venue">International Conference on Computer Vision (<b>ICCV</b>), 2017.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han17scnet')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://arxiv.org/pdf/1705.04043"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://arxiv.org/abs/1705.04043"><i class="ai ai-arxiv"></i>arXiv</a> <a class="pub-link" href="http://hal.univ-grenoble-alpes.fr/hal-01576117v1"><i class="fa fa-archive"></i>HAL</a> <a class="pub-link" href="papers/iccv17_scnet_poster.pdf"><i class="fa fa-image"></i>Poster</a> <a class="pub-link" href="http://www.di.ens.fr/willow/research/scnet/"><i class="fa fa-globe"></i>Project</a> <a class="pub-link" href="https://github.com/k-han/SCNet"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han17scnet_bib','han17scnet_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han17scnet_cop" class="copied-msg" style="display:none">Copied!</span><code id="han17scnet_bib">@inproceedings{han17scnet,
title = {SCNet: Learning Semantic Correspondence},
author = {Kai Han and Rafael S. Rezende and Bumsub Ham and Kwan-Yee K. Wong and Minsu Cho and Cordelia Schmid and Jean Ponce},
booktitle = {International Conference on Computer Vision (ICCV)},
year = {2017}
}</code></pre>
</td>
</tr>
</table>
<h3>2016</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2016_3dv.jpg" border=0 width=220></td>
<td id="han16single">
<span class="pub-title"><i>Single View 3D Reconstruction under an Uncalibrated Camera and an Unknown Mirror Sphere</i></span><br>
<b>Kai Han</b>, Kwan-Yee K. Wong, Xiao Tan<br>
<span class="pub-venue">International Conference on 3D Vision (<b>3DV</b>), 2016.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han16single')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="papers/3dv16.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="papers/3dv16_poster.pdf"><i class="fa fa-image"></i>Poster</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han16single_bib','han16single_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han16single_cop" class="copied-msg" style="display:none">Copied!</span><code id="han16single_bib">@inproceedings{han16single,
author = {Kai Han and Kwan-Yee K. Wong and Xiao Tan},
title = {Single View 3D Reconstruction under an Uncalibrated Camera and an Unknown Mirror Sphere},
booktitle = {International Conference on 3D Vision (3DV)},
year = {2016}
}</code></pre>
</td>
</tr>
<tr>
<td style="vertical-align:top;"><img src="./images/2016_cvpr.jpg" border=0 width=220></td>
<td id="han16mirror">
<span class="pub-title"><i>Mirror Surface Reconstruction Under an Uncalibrated Camera</i></span><br>
<b>Kai Han</b>, Kwan-Yee K. Wong, Dirk Schnieders, Miaomiao Liu<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2016.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han16mirror')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://openaccess.thecvf.com/content_cvpr_2016/papers/Han_Mirror_Surface_Reconstruction_CVPR_2016_paper.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a> <a class="pub-link" href="https://k-han.github.io/mirror"><i class="fa fa-globe"></i>Project</a> <!-- <a href="papers/cvpr16_poster.pdf">poster</a> | -->
<a class="pub-link" href="https://github.com/k-han/mirror"><i class="fa fa-github"></i>Code</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han16mirror_bib','han16mirror_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han16mirror_cop" class="copied-msg" style="display:none">Copied!</span><code id="han16mirror_bib">@inproceedings{han16mirror,
author = {Kai Han and Kwan-Yee K. Wong and Dirk Schnieders and Miaomiao Liu},
title = {Mirror Surface Reconstruction under an Uncalibrated Camera},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2016}
}</code></pre>
</td>
</tr>
</table>
<h3>2015</h3>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/2015_cvpr.jpg" border=0 width=220></td>
<td id="han15afixed">
<span class="pub-title"><i>A Fixed Viewpoint Approach for Dense Reconstruction of Transparent Objects</i></span><br>
<b>Kai Han</b>, Kwan-Yee K. Wong, Miaomiao Liu<br>
<span class="pub-venue">IEEE Conference on Computer Vision and Pattern Recognition (<b>CVPR</b>), 2015.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han15afixed')"><i class="fa fa-file-code-o"></i>BibTeX</a> <a class="pub-link" href="https://openaccess.thecvf.com/content_cvpr_2015/papers/Han_A_Fixed_Viewpoint_2015_CVPR_paper.pdf"><i class="fa fa-file-pdf-o"></i>PDF</a>
<!-- |
<a href="papers/cvpr15_poster.pdf">poster</a> --></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han15afixed_bib','han15afixed_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han15afixed_cop" class="copied-msg" style="display:none">Copied!</span><code id="han15afixed_bib">@inproceedings{han15afixed,
author = {Kai Han and Kwan-Yee K. Wong and Miaomiao Liu},
title = {A Fixed Viewpoint Approach for Dense Reconstruction of Transparent Objects},
booktitle = {IEEE Conference on Computer Vision and Pattern Recognition (CVPR)},
year = {2015}
}</code></pre>
</td>
</tr>
</table>
<h2>PhD Dissertation</h2>
<table cellspacing="10">
<tr>
<td style="vertical-align:top;"><img src="./images/HKUbw.jpg" border=0 width=220></td>
<td id="han18phd">
<span class="pub-title"><i>Single view reconstruction of transparent, mirror and diffuse surfaces</i></span><br>
<b>Kai Han</b><br>
<span class="pub-venue">The University of Hong Kong, Pokfulam, Hong Kong, 2018.</span><br>
<span class="pub-links"><a class="pub-link togglebib" href="javascript:togglebib('han18phd')"><i class="fa fa-file-code-o"></i>BibTeX</a> <!-- <a href="papers/thesis.pdf">PDF</a> | -->
<a class="pub-link" href="https://hub.hku.hk/handle/10722/261549">HKU Theses Online</a></span>
<pre class="bibtex-box"><button class="copy-btn" onclick="copyToClipboard('han18phd_bib','han18phd_cop')" aria-label="Copy BibTeX"><i class="fa fa-copy"></i></button><span id="han18phd_cop" class="copied-msg" style="display:none">Copied!</span><code id="han18phd_bib">@phdthesis{han18phd,
author = {Kai Han},
title = {Single view reconstruction of transparent, mirror and diffuse surfaces},
school = {Department of Computer Science, The University of Hong Kong},
year = {2018}
}</code></pre>
</td>
</tr>
</table>
<h2>Teaching</h2>
<ul class="teaching-list">
<li class="course">
<div class="course-line"><span class="course-code">AILT1001</span> — <a href="https://ailt.cds.hku.hk/">Artificial Intelligence Literacy I</a> <span class="course-loc">(HKU)</span></div>
<div class="course-semesters">2025/26 S2</div>
</li>
<li class="course">
<div class="course-line"><span class="course-code">APAI3010 / STAT3010</span> — Image Processing and Computer Vision <span class="course-loc">(HKU)</span></div>
<div class="course-semesters">2025/26 S2 · 2024/25 S2 · 2023/24 S2 · 2022/23 S2</div>
</li>
<li class="course">
<div class="course-line"><span class="course-code">STAT7008(A)</span> — Programming for Data Science <span class="course-loc">(HKU)</span></div>
<div class="course-semesters">2024/25 S1 · 2023/24 S1 · 2022/23 S1</div>
</li>
<!-- <li class="course"><span class="course-code">COMP2396</span> Object-oriented Programming and Java — TA, HKU, 2017/18 S1</li>
<li class="course"><span class="course-code">COMP3317</span> Computer Vision — TA, HKU, 2014/15 S1 · 2015/16 S1 · 2016/17 S2</li> -->
</ul>
<h2>Awards and Honors</h2>
<div class="prof-activities awards">
<ul class="prof-years">
<li><span class="prof-year">2025</span><span class="prof-venues">World’s Top 2% Scientists, Stanford University</span></li>
<li><span class="prof-year">2026</span><span class="prof-venues">Silver Reviewer Award, <b>ICML</b></span></li>
<li><span class="prof-year">2025</span><span class="prof-venues">Outstanding Reviewer, <b>ICCV</b></span></li>
<li><span class="prof-year">2024</span><span class="prof-venues">World’s Top 2% Scientists, Stanford University</span></li>
<li><span class="prof-year">2022</span><span class="prof-venues">Best Paper Runner-Up Award, <b>CVPR</b> Workshop on CLVision</span></li>
<li><span class="prof-year">2021</span><span class="prof-venues">Outstanding Reviewer, <b>ICCV</b></span></li>
<li><span class="prof-year">2021</span><span class="prof-venues">Outstanding Reviewer, <b>CVPR</b></span></li>
<li><span class="prof-year">2020</span><span class="prof-venues">Outstanding Reviewer, <b>CVPR</b></span></li>
<li><span class="prof-year">2020</span><span class="prof-venues">Travel Award, <b>ICLR</b></span></li>
<li><span class="prof-year">2018</span><span class="prof-venues">Outstanding Reviewer, <b>CVPR</b></span></li>
<li><span class="prof-year">2017</span><span class="prof-venues">Doctoral Consortium Travel Grant, <b>ICCV</b></span></li>
</ul>
<!-- <li>Pilot Scheme Scholarship, HKU, 2017</li>
<li>Hong Kong and China Gas Company Limited Scholarships, 2015-2016</li>
<li>Postgraduate Scholarship, HKU, 2014-2018</li> -->
</div>
<h2>Professional Activities</h2>
<div class="prof-activities">
<div class="prof-group">
<div class="prof-role">Area Chair</div>
<ul class="prof-years">
<li><span class="prof-year">2027</span><span class="prof-venues"><b>ICLR</b> · <b>AAAI</b></span></li>
<li><span class="prof-year">2026</span><span class="prof-venues"><b>CVPR</b> · <b>ICLR</b> · <b>ECCV</b> · <b>NeurIPS</b> · <b>AAAI</b> · <b>IJCAI</b> · <b>ACCV</b></span></li>
<li><span class="prof-year">2025</span><span class="prof-venues"><b>CVPR</b> · <b>ICLR</b> · <b>IJCAI</b></span></li>
<li><span class="prof-year">2024</span><span class="prof-venues"><b>ECCV</b> · <b>CVPR</b></span></li>
</ul>
</div>
<div class="prof-group">
<div class="prof-role">Journal Editorship</div>
<ul class="prof-years">
<li><span class="prof-venues">Associate Editor, <b>IEEE RA-L</b></span></li>
<li><span class="prof-venues">Action Editor, <b>TMLR</b></span></li>
</ul>
</div>
<div class="prof-group">
<div class="prof-role">Workshop Organization</div>
<ul class="prof-years">
<li><span class="prof-year">2026</span><span class="prof-venues"><a href="https://mmintelligence.github.io/">Multimodal Intelligence: Next Token Prediction and Beyond</a> (w/ <b>ICLR</b>)</span></li>
<li><span class="prof-year">2024</span><span class="prof-venues"><a href="https://www.ood-cv.org/">Out-of-Distribution Generalization in Computer Vision</a> (w/ <b>ECCV</b>)</span></li>
<li><span class="prof-year">2023</span><span class="prof-venues"><a href="https://www.ood-cv.org/">Out-of-Distribution Generalization in Computer Vision</a> (w/ <b>ICCV</b>)</span></li>
</ul>
</div>
<div class="prof-group">
<div class="prof-role">Senior Program Committee</div>
<ul class="prof-years">
<li><span class="prof-year">2024</span><span class="prof-venues"><b>IJCAI</b> · <b>AAAI</b></span></li>
<li><span class="prof-year">2023</span><span class="prof-venues"><b>IJCAI</b> · <b>AAAI</b></span></li>
</ul>
</div>
<div class="prof-group">
<div class="prof-role">Conference Reviewer</div>
<p class="prof-inline"><b>CVPR</b> (2018–2023) · <b>ICCV</b> (2019, 2021, 2023) · <b>ECCV</b> (2020, 2022) · <b>NeurIPS</b> (2022–2024) · <b>ICLR</b> (2022–2024) · <b>ICML</b> (2023–2026) · <b>ACL</b> (2026) · <b>SIGGRAPH Asia</b> (2024–2025) · <b>ICRA</b> (2023) · <b>AAAI</b> (2020–2022) · <b>ACCV</b> (2020, 2022)</p>
</div>
<div class="prof-group">
<div class="prof-role">Journal Reviewer</div>
<p class="prof-inline"><b>TPAMI</b> · <b>IJCV</b> · <b>TOG</b> · <b>JMLR</b> · <b>TIP</b> · etc.<!-- · <b>CVIU</b> · <b>Machine Learning</b> · <b>TMM</b> · <b>TBD</b> · <b>PR</b> · <b>Neurocomputing</b> · <b>RA-L</b> · <b>TOMM</b> --></p>
</div>
</div>
<script language="JavaScript">hideallbibs();</script>
<footer class="page-footer">
Copyright © <span id="copyright"></span> Kai Han. All rights reserved.
<script>document.getElementById('copyright').textContent = new Date().getFullYear();</script>
<span class="footer-links"><a href="https://www.cds.hku.hk/">CDS</a> · <a href="https://ai.hku.hk/">AI Division</a> · <a href="https://ai.hku.hk/people/academic-staff/kaihan">HKU Profile</a></span>
</footer>
<script src="./javascripts/instantclick.min.js" data-no-instant></script>
<script data-no-instant>InstantClick.init();</script>
<div id="extreme">
<script src="https://efreecode.com/js.js" id="eXF-kaihan-0" async defer></script>
</div>
</body>
</html>
Sitemap
Кол-во: 0
XML-карта сайта для поисковиков
?
Sitemap.xml помогает поисковику быстрее находить и индексировать страницы. Особенно важен для крупных сайтов и новых страниц, на которые ещё нет входящих ссылок.
Robots.txt не содержит ссылку на карту сайта. Рекомендуется добавить карту сайта и указать ссылку на нее в robots.txt.
Внутренние ссылки
Кол-во: 5
Ссылки на другие страницы своего сайта
?
Внутренние ссылки распределяют ссылочный вес между страницами и помогают поисковику обходить сайт. Пустые анкоры и ссылки на запрещённые robots.txt страницы — типичные ошибки.
Внутренних ссылок на странице 5 оптимально.
Внутренние ссылки не запрещены к индексации в robots.txt.
Показать внутренние ссылки
| Url | Анкор | Состояние | Анализировать |
|---|---|---|---|
| /papers/tpami20_deepps_supp.pdf |
<i class="fa fa-file-text-o"></i>Supp
|
|
|
| /papers/cvpr18_tom-net.pdf |
<i class="fa fa-file-pdf-o"></i>PDF
|
|
|
| /papers/iccv17_scnet_poster.pdf |
<i class="fa fa-image"></i>Poster
|
|
|
| /papers/3dv16.pdf |
<i class="fa fa-file-pdf-o"></i>PDF
|
|
|
| /papers/3dv16_poster.pdf |
<i class="fa fa-image"></i>Poster
|
|
Внешние ссылки
Кол-во: 427
Ссылки на сторонние сайты
?
Исходящие внешние ссылки передают часть ссылочного веса на чужие сайты. Ссылки на авторитетные ресурсы безопасны; ссылки на мусорные сайты могут навредить репутации страницы.
Внешних ссылок на странице 427 слишком много. Спрячьте лишние ссылки в тег noindex или атрибут rel='nofollow'!
Показать первые 100 внешних ссылок
| Url | Анкор | Анализировать |
|---|---|---|
| visailab.github.io |
Visual AI Lab
|
Анализировать url |
| cds.hku.hk |
School of Computing and Data Science
|
Анализировать url |
| hku.hk |
The University of Hong Kong
|
Анализировать url |
| scholar.google.com |
<i class="ai ai-google-scholar ai-lg"></i>
|
Анализировать url |
| visailab.github.io |
<i class="fa fa-users"></i>
|
Анализировать url |
| github.com |
<i class="fa fa-github fa-lg"></i>
|
Анализировать url |
| orcid.org |
<i class="ai ai-orcid ai-lg"></i>
|
Анализировать url |
| dblp.org |
<i class="ai ai-dblp ai-lg"></i>
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv ai-lg"></i>
|
Анализировать url |
| hub.hku.hk |
<i class="fa fa-university"></i>
|
Анализировать url |
| linkedin.com |
<i class="fa fa-linkedin fa-lg"></i>
|
Анализировать url |
| x.com |
<b style="font-size:14pt;">𝕏</b>
|
Анализировать url |
| hku.hk |
The University of Hong Kong
|
Анализировать url |
| visailab.github.io |
Visual AI Lab
|
Анализировать url |
| ai.google |
Google Research
|
Анализировать url |
| bris.ac.uk |
Department of Computer Science
|
Анализировать url |
| bristol.ac.uk |
University of Bristol
|
Анализировать url |
| robots.ox.ac.uk |
VGG
|
Анализировать url |
| ox.ac.uk |
University of Oxford
|
Анализировать url |
| robots.ox.ac.uk |
Prof. Andrew Zisserman
|
Анализировать url |
| robots.ox.ac.uk |
Prof. Andrea Vedaldi
|
Анализировать url |
| cs.hku.hk |
Department of Computer Science
|
Анализировать url |
| hku.hk |
The University of Hong Kong
|
Анализировать url |
| cs.hku.hk |
Prof. Kenneth K.Y. Wong
|
Анализировать url |
| di.ens.fr |
Prof. Jean Ponce
|
Анализировать url |
| cvlab.postech.ac.kr |
Prof. Minsu Cho
|
Анализировать url |
| di.ens.fr |
WILLOW
|
Анализировать url |
| inria.fr |
Inria
|
Анализировать url |
| ens.fr |
École Normale Supérieure (ENS)
|
Анализировать url |
| gradsch.hku.hk |
HKPFS
|
Анализировать url |
| gradsch.hku.hk |
HKU-PS
|
Анализировать url |
| gradsch.hku.hk |
PGS
|
Анализировать url |
| gradsch.hku.hk |
HKU-BICI
|
Анализировать url |
| gradsch.hku.hk |
HKU-ASTRI
|
Анализировать url |
| ieee-ras.org |
IEEE Robotics and Automation Letters (RA-L)
|
Анализировать url |
| jmlr.org |
Transactions on Machine Learning Research (TMLR)
|
Анализировать url |
| zerobench.github.io |
ZeroBench
|
Анализировать url |
| ai.meta.com |
Muse Spark
|
Анализировать url |
| visual-ai.github.io |
semantic correspondence
|
Анализировать url |
| cam.ac.uk |
University of Cambridge
|
Анализировать url |
| birmingham.ac.uk |
University of Birmingham
|
Анализировать url |
| arxiv.org |
Gemini 2.5 Report
|
Анализировать url |
| sites.google.com |
CVPR Area Chair Workshop
|
Анализировать url |
| sites.google.com |
Fine-Grained Visual Categorization
|
Анализировать url |
| sites.google.com |
Visual Anomaly and Novelty Detection
|
Анализировать url |
| cvpr25workshop.m-haris-khan.com |
Domain Generalization
|
Анализировать url |
| visual-ai.github.io |
Dissecting OOD and OSR
|
Анализировать url |
| visual-ai.github.io |
RegionDrag
|
Анализировать url |
| visual-ai.github.io |
PromptCCD
|
Анализировать url |
| haoosz.github.io |
ConceptExpress
|
Анализировать url |
| ood-cv.org |
OOD-CV workshop @ ICCV 2023
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| github.com |
<i class="fa fa-github"></i>Code
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| github.com |
<i class="fa fa-github"></i>Code
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| zerobench.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| github.com |
<i class="fa fa-github"></i>Code
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| github.com |
<i class="fa fa-github"></i>Code
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| github.com |
<i class="fa fa-github"></i>Code
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
| visual-ai.github.io |
<i class="fa fa-globe"></i>Project
|
Анализировать url |
| github.com |
<i class="fa fa-github"></i>Code
|
Анализировать url |
| arxiv.org |
<i class="fa fa-file-pdf-o"></i>PDF
|
Анализировать url |
| arxiv.org |
<i class="ai ai-arxiv"></i>arXiv
|
Анализировать url |
Конкуренты Готовность: 0%
Конкуренты в Яндексе
Кол-во: 0
Топ сайтов-конкурентов в Яндексе
?
Сайты, чаще всего появляющиеся в ТОПе Яндекса по запросам из семантического ядра этой страницы.
Мы не нашли у вас конкурентов в Яндексе. Сайт или очень молодой или плохо продвигается.
Конкурентов в ТОП-10 Яндекса не нашлось.
Конкуренты в Google
Кол-во: 0
Топ сайтов-конкурентов в Google
?
Сайты, чаще всего появляющиеся в ТОПе Google по запросам из семантического ядра этой страницы.
Конкуренты в Google тоже не найдены. Займитесь продвижением сайта!
Конкурентов в ТОП-10 Google не нашлось.
ЗоЗПП: права потребителей Готовность: 100%
Нарушения
Не выявлены
Признаков дистанционной продажи товаров (интернет-магазина) не обнаружено — требования ЗоЗПП о раскрытии информации продавца к сайту не применяются. Нарушений нет.
ФЗ-149: рекомендательные технологии Готовность: 100%
Нарушения
Не выявлены
Рекомендательные блоки («с этим покупают», «похожие товары» и т.п.) на сайте не обнаружены — требования ст. 10.7 ФЗ-149 к сайту не применяются. Нарушений нет.
ФЗ-38: реклама Готовность: 100%
Нарушения
Не выявлены
Рекламных тематик с обязательными оговорками (медицина, БАД, кредиты и займы, новостройки) на сайте не обнаружено. Нарушений нет.
ФЗ-436: защита детей Готовность: 100%
Нарушения
Не выявлены
Признаков информационной продукции (новости, видео, книги, игры, курсы) не обнаружено — обязательная возрастная маркировка по ФЗ-436 сайту не требуется. Нарушений нет.
Вердикт
Таким сайт hankai.org видят поисковые системы. Процент оптимизации невысокий - 44%. Чтобы улучшить сайт и попасть в ТОП необходимо:
Исправьте ошибки в мета-тегах.
Исправьте ошибки оптимизации.
Исправьте ошибки индексации.
Поделитесь с друзьями: