Publications

* co-first, † corresponding author.

Mind the Rarities: Can Rare Skin Diseases Be Reliably Diagnosed via Diagnostic Reasoning?
Yang Liu*, Jiyao Yang*, Hongjin Zhao, Xiaoyong Li, Yanzhe Ji, Xingjian Li, Runmin Jiang, Tianyang Wang, Saeed Anwar, Dongwoo Kim, Yue Yao, Zhenyue Qin, Min Xu
arXiv Paper
A 6,354-case clinical benchmark with 26,030 multimodal image-text pairs. SFT improves final-diagnosis accuracy by 52.8%–151.6% relative across InternVL2.5-4B, MedGemma-4B, and MedGemma-27B; DPO adds only marginal gains.
Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space?
Quoc-Huy Trinh*, Xi Ding*, Yang Liu*, Zhenyue Qin, Xingjian Li, Gorkem Durak, Halil Ertugrul Aktas, Elif Keles, Ulas Bagci, Min Xu
arXiv Paper
SpatialMed — a CT-based benchmark with 31,253 QA pairs across 2,375 CT scans, 117 anatomical structures, and 7 tumor types. Benchmarks 24 SoTA MLLMs and reveals major limitations in numerical estimation and reasoning faithfulness on volumetric data.
Representation-Centric Survey of Skeletal Action Recognition and the ANUBIS Benchmark
Yang Liu*, Jiyao Yang*, Madhawa Perera, Pan Ji, Dongwoo Kim, Min Xu, Tianyang Wang, Saeed Anwar, Tom Gedeon, Lei Wang†, Zhenyue Qin†
Pattern Recognition (Major Revision)
LMOD+: A Comprehensive Multimodal Dataset and Benchmark for Developing and Evaluating Multimodal Large Language Models in Ophthalmology
Zhenyue Qin*, Yang Liu*, Yu Yin, Jinyu Ding, Haoran Zhang, Anran Li, Dylan Campbell, Xuansheng Wu, Ke Zou, Tiarnan D. L. Keenan, Emily Y. Chew, Zhiyong Lu, Yih-Chung Tham, Ninghao Liu, Xiuzhen Zhang, Qingyu Chen†
ACM HEALTH 2026
DermEVAL: A Dermatologist-Reviewed Benchmark for Multimodal Large Language Models
Hongjin Zhao, Weihao Li, Zhenyue Qin, Ge-Peng Ji, Yang Liu, Tom Gedeon, Nick Barnes
WACV 2026
GeoDANO: Geometric VLM with Domain Agnostic Vision Encoder
Seunghyuk Cho, Zhenyue Qin, Yang Liu, Youngbin Choi, Seungbeom Lee, Dongwoo Kim†
EMNLP Findings 2025
HandCraft: Anatomically Correct Restoration of Malformed Hands in Diffusion Generated Images
Zhenyue Qin*, Yiqun Zhang*, Yang Liu, Dylan Campbell
WACV 2025
A plug-and-play, training-free pipeline for restoring malformed hands in Stable Diffusion outputs. Hand-pose confidence 0.79 vs 0.54 baseline; PSNR 23.40 vs 12.93.
Anonymization for Skeleton Action Recognition
Saemi Moon*, Myeonghyeon Kim*, Zhenyue Qin, Yang Liu, Dongwoo Kim
AAAI 2023
Fusing Higher-Order Features in Graph Neural Networks for Skeleton-Based Action Recognition
Zhenyue Qin†, Yang Liu†, Pan Ji, Dongwoo Kim, Lei Wang, Bob McKay, Saeed Anwar, Tom Gedeon
IEEE TNNLS 2022
Invertible Denoising Network: A Light Solution for Real Noise Removal
Yang Liu†, Zhenyue Qin†, Saeed Anwar, Pan Ji, Dongwoo Kim, Sabrina Caldwell, Tom Gedeon
CVPR 2021