Publications

Equal contribution
Corresponding author
Project Leader

ALL (151 papers)

SPOTLIGHTNeurIPS
Fei Lin
, 
Tengchao Zhang
, 
Ziyang Gong
, 
Xiaotong Yu
, 
Bohan Zhang
, 
Yifan Zhou
, 
Qihao Yang
, 
Ji Dai
, 
Dong Li
, 
Yining Jiang
, 
Qinghua Ni
, 
Jun Huang
, 
Qiang Zhang
, 
Yue Zhou
, 
Yonglin Tian
, 
Zhihang Zhong
, 
Xue Yang
, 
Fei-Yue Wang
. 
【BEAKER】An Expert-Curated Benchmark for Embodied Brains in Self-Driving Chemical Laboratories. 
Advances in Neural Information Processing Systems, 
Sydney & Atlanta & Paris, 
2026. 
NeurIPS
Jiarui Guo
, 
Haojia Wei
, 
Yiming Zhang
, 
Yifei Liu
, 
Yuning Gong
, 
Hongjie Zhang
, 
Xue Yang
, 
Zhihang Zhong
. 
【PhotoFlow】Agentic 3D Virtual Photography Missions. 
Advances in Neural Information Processing Systems, 
Sydney & Atlanta & Paris, 
2026. 
SPOTLIGHTNeurIPS
Xiaoxing Hu
, 
Kaicheng Yang
, 
Ziqi Ye
, 
Ziyang Gong
, 
Qi Ming
, 
Zonghao Guo
, 
Yu Tian
, 
Xiang An
, 
Ziyong Feng
, 
Xue Yang
. 
【ProCLIP】Progressive Vision-Language Alignment via LLM-based Embedder. 
Advances in Neural Information Processing Systems, 
Sydney & Atlanta & Paris, 
2026. 
NeurIPS
Mingxin Liu
, 
Shuran Ma
, 
Shibei Meng
, 
Xiangyu Zhao
, 
Zicheng Zhang
, 
Shaofeng Zhang
, 
Zhihang Zhong
, 
Peixian Chen
, 
Haoyu Cao
, 
Xing Sun
, 
Haodong Duan
, 
Xue Yang
. 
【RISE-Video】Can Video Generators Decode Implicit World Rules. 
Advances in Neural Information Processing Systems, ED Track, 
Sydney & Atlanta & Paris, 
2026. 
NeurIPS
Zisu Huang
, 
Jingwen Xu
, 
Yifan Yang
, 
Ziyang Gong
, 
Qihao Yang
, 
Muzhao Tian
, 
Xiaohua Wang
, 
Changze Lv
, 
Xuemei Gao
, 
Qi Dai
, 
Bei Liu
, 
Kai Qiu
, 
Xue Yang
, 
Dongdong Chen
, 
Xiaoqing Zheng
, 
Chong Luo
. 
【SkillLens】From Raw Experience to Skill Consumption A Systematic Study of Model-Generated Agent Skills. 
Advances in Neural Information Processing Systems, 
Sydney & Atlanta & Paris, 
2026. 
SPOTLIGHTNeurIPS
Yifan Yang
, 
Ziyang Gong
, 
Weiquan Huang
, 
Qihao Yang
, 
Ziwei Zhou
, 
Zisu Huang
, 
Yan Li
, 
Xuemei Gao
, 
Qi Dai
, 
Bei Liu
, 
Kai Qiu
, 
Yuqing Yang
, 
Dongdong Chen
, 
Xue Yang
, 
Chong Luo
. 
【SkillOpt】Executive Strategy for Self-Evolving Agent Skills. 
Advances in Neural Information Processing Systems, 
Sydney & Atlanta & Paris, 
2026. 
NeurIPS
Boming Tan
, 
Xiangdong Zhang
, 
Ning Liao
, 
Jingtao Zhang
, 
Yuqing Zhang
, 
Xiaoqiu Zhong
, 
Xiaosong Jia
, 
Xue Yang
, 
Shaofeng Zhang
, 
Yanyong Zhang
. 
【WorldForge】Forging Unified World Modeling into Video Generation. 
Advances in Neural Information Processing Systems, 
Sydney & Atlanta & Paris, 
2026. 
arXiv
Xuanyi Liu
, 
Haofeng Wang
, 
Ruiqi Li
, 
Danni Yu
, 
Rui Wan
, 
Ruixu Zhang
, 
Siyu Tao
, 
Xue Yang
, 
Shaofeng Zhang
, 
Zicheng Zhang
, 
Jiaqi Zhang
, 
Siwei Ma
. 
【TriWorldBench】A Tri-View Consistency Perspective on Embodied World Models. 
arXiv, 
2609.26314, 
2026. 
TGRS
Yaoyong Liu
, 
Yue Zhou
, 
Xue Yang
. 
【RSTalker】Beyond Text Bridging Speech and Satellite Imagery for Efficient Visual Grounding. 
IEEE Transactions on Geoscience and Remote Sensing, 
2024. 
arXiv
Zhenjie Yang
, 
Yideng Zhang
, 
Dongjie Zhang
, 
Chenyu Jiang
, 
Xianshuai Liu
, 
Yufeng Li
, 
Zuhao Ge
, 
Xingyu Jiao
, 
Zheng Zhang
, 
Kaiyu He
, 
He Wang
, 
Yuwen Zhong
, 
Yi Deng
, 
Muyun Jiang
, 
Xianliang Huang
, 
Haisheng Su
, 
Donghang Zhang
, 
Jian Zhang
, 
Xue Yang
, 
Hongyang Li
, 
Zuxuan Wu
, 
Yu-Gang Jiang
, 
Xiaosong Jia
, 
Junchi Yan
. 
【Bench2Dex】Benchmarking Visuo-Tactile Bimanual Dexterous Manipulation Across Dexterous Hands. 
arXiv, 
2609.15726, 
2026. 
arXiv
Ziqian Fan
, 
Shibo Xu
, 
Junjie Li
, 
Xiangyu Zhao
, 
Shengyuan Ding
, 
Yifan Yang
, 
Zhenjie Yang
, 
Haodong Duan
, 
Yue Zhou
, 
Zhihang Zhong
, 
Xue Yang
. 
【V-ICAL Bench】Evaluating Video In-Context Learning for Multimodal Agents in Interactive Environments. 
arXiv, 
2609.15683, 
2026. 
PhoR
Yue Zhou
, 
Zhihang Zhong
, 
Litong Feng
, 
Wayne Zhang,
, 
Xue Jiang
, 
Junchi Yan
, 
Xue Yang
. 
Towards Vision-Language Geo-Foundation Model A Survey. 
The Photogrammetric Record, 
2026. 
arXiv
Wei Zhang
, 
Hongji Li
, 
Song Sun
, 
Peng Yu
, 
Xue Yang
, 
Lei Zhao
, 
Peng Jiang
. 
【DMRL】Document-Mediated Reinforcement Learning for Skill Optimization in Advertising Recommendation. 
arXiv, 
2609.0217, 
2026. 
arXiv
Peiyuan Zhang
, 
Xiangyu Zhao
, 
Hongbo Liu
, 
Xiaoxing Hu
, 
Mingxin Liu
, 
Shuran Ma
, 
Yunhang Shen
, 
Jian Hu
, 
Haihan Gao
, 
Haoyu Cao
, 
Xue Yang
. 
【FIRM-Video】Check Before You Score for Reliable Text-to-Video Reward Modeling. 
arXiv, 
2608.21839, 
2026. 
EMNLP
Xudong Lu
, 
Xueying Li
, 
Annan Wang
, 
Yang Bo
, 
Jinpeng Chen
, 
Zengliang Li
, 
Nianzu Yang
, 
Rui Liu
, 
Xue Yang
, 
Jingwen Hou
, 
Hongsheng Li
. 
【OmniInteract】Benchmarking Real-World Streaming Interaction for Real-Time Omnimodal Assistants. 
Empirical Methods in Natural Language Processing, 
Budapest, Hungary, 
2026. 
arXiv
Linlin Wang
, 
Xue Yang
, 
Zhihuang Zhou
, 
Zhenyu Zhong
, 
Ruiyuan Zhang
, 
Yansheng Li
. 
【T-STAR】A Large-Scale Benchmark for Spatio-Temporal Panoptic Scene Graph Generation in Satellite Video. 
arXiv, 
2607.21228, 
2026. 
PRCV
Botao Ren
, 
Botian Xu
, 
Xue Yang
, 
Yifan Pu
, 
Jingyi Wang
, 
Zhidong Deng
. 
Context-Aware Aerial Object Detection Leveraging Inter-Object and Background Relationships. 
The 9th Chinese Conference on Pattern Recognition and Computer Vision, 
Harbin Asian Winter Games Hall, 
2026. 
arXiv
Yifan Zhou
, 
Qihao Yang
, 
Yan Li
, 
Donggang Li
, 
Xiru Hu
, 
Hokin Deng
, 
Ziyang Gong
, 
Xuanyi Zhou
, 
Huacan Wang
, 
Xiangchao Yan
, 
Wanghan Xu
, 
Wenlong Zhang
, 
Shaofeng Zhang
, 
Yue Zhou
, 
Yifan Yang
, 
Zhihang Zhong
, 
Xue Yang
. 
【IG-Bench】Ideas Have Genomes Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation. 
arXiv, 
2607.08758, 
2026. 
Tech. Report
Ziyang Gong
, 
Haoming Gu
, 
Zehang Luo
, 
Tianyi Zhang
, 
Tao Tao
, 
Yixiao Chi
, 
Zhe Liu
, 
Lingsi Zhu
, 
Jingyuan Liu
, 
Anke Tang
, 
Songze Li
, 
Yilun Kong
, 
Ningjing Liu
, 
Tianyu Zhu
, 
Yunpeng Qing
, 
Shuang Luo
, 
Xiang Liu
, 
Shi Fu
, 
Dawei Nie
, 
Sixiang Liu
, 
Zhexi Wen
, 
Feng Pan
, 
Xiaofeng Wang
, 
Zhi Hou
, 
Chunxiao Liu
, 
Xue Yang
, 
Junchi Yan
, 
Hengshuang Zhao
, 
Dacheng Tao
, 
Xiaogang Wang
. 
【ACE-Brain-0.5】A Unified Embodied Foundational Model for Physical Agentic AI. 
arXiv, 
2607.04426, 
2026. 
ORALISPRS-C
Jue Chen
, 
Penghui Huang
, 
Ran Ding
, 
Zhentao Zou
, 
Xue Yang
, 
Xue Jiang
, 
Yue Zhou
, 
Hongxin Yang
, 
Jonathan Li
. 
【Beyond Vision】How Language affects Visual Grounding in UAV Imagery. 
The International Archives of the Photogrammetry, 
49, 651-656, 
2026. 
arXiv
Zhaokai Wang
, 
Mingxin Liu
, 
Zirun Zhu
, 
Ziqian Fan
, 
Yiguo He
, 
Mohan Zhang
, 
Leyao Gu
, 
Xiangyu Zhao
, 
Ning Liao
, 
Shaofeng Zhang
, 
Xuanhe Zhou
, 
Zhihang Zhong
, 
Junchi Yan
, 
Xue Yang
. 
【DisciplineGen-1M】A Large-Scale Dataset for Multidisciplinary Visual Generation and Editing. 
arXiv, 
2607.0229, 
2026. 
arXiv
Ning Liao
, 
Zihao Long
, 
Xiaoxing Wang
, 
Xue Yang
, 
Yaoming Wang
, 
Ziyuan Zhuang
, 
Xunliang Cai
, 
Rongxiang Weng
, 
Junchi Yan
. 
【ACE】Pluggable Adaptive Context Elasticizer across Agents. 
arXiv, 
2606.31564, 
2026. 
ECCV
Yan Li
, 
Ning Liao
, 
Xiangyu Zhao
, 
Shaofeng Zhang
, 
Xiaoxing Wang
, 
Yifan Yang
, 
Junchi Yan
, 
Xue Yang
. 
【EvoTok】A Unified Image Tokenizer via Residual Latent Evolution for Visual Understanding and Generation. 
European Conference on Computer Vision, 
Malmö, Sweden, 
2026. 
ORALECCV
Mingxin Liu
, 
Ziqian Fan
, 
Zhaokai Wang
, 
Leyao Gu
, 
Zirun Zhu
, 
Yiguo He
, 
Yuchen Yang
, 
Changyao Tian
, 
Xiangyu Zhao
, 
Ning Liao
, 
Shaofeng Zhang
, 
Qibing Ren
, 
Zhihang Zhong
, 
Xuanhe Zhou
, 
Junchi Yan
, 
Xue Yang
. 
【GRADE】Benchmarking Discipline-Informed Reasoning in Image Editing. 
European Conference on Computer Vision, 
Malmö, Sweden, 
2026. 
ECCV
Tianyi Zhao
, 
Jiawen Xi
, 
Linhui Xiao
, 
Junnan Li
, 
Xue Yang
, 
Maoxun Yuan
, 
Xingxing Wei
. 
【RGBT-Ground】Visual Grounding Beyond RGB in Complex Real-World Scenarios. 
European Conference on Computer Vision, 
Malmö, Sweden, 
2026. 
ECCV
Ruilin Li
, 
Heming Zou
, 
Xiufeng Yan
, 
Zheming Liang
, 
Jie Yang
, 
Chenliang Li
, 
Xue Yang
. 
【SCL-MGSM】Enhancing Pretrained Model-based Continual Representation Learning via Guided Random Projection. 
European Conference on Computer Vision, 
Malmö, Sweden, 
2026. 
GRSM
Yue Zhou
, 
Shujun Zhao
, 
Xue Yang
, 
Ruigang Li
, 
Tianwen Zhang
, 
Mengcheng Lan
, 
Chaofeng Chen
, 
Lingfei Ma
, 
Hongjie He
, 
Jonathan Li
. 
Data-Driven Vision-Language Models for Remote Sensing A survey. 
IEEE Geoscience and Remote Sensing Magazine, 
2026. 
arXiv
Xiaolin Liu
, 
Yilun Zhu
, 
Xiangyu Zhao
, 
Xuehui Wang
, 
Yan Li
, 
Xin Li
, 
Haoyu Cao
, 
Xing Sun
, 
Shaofeng Zhang
, 
Xu Yang
, 
Zhihang Zhong
, 
Xue Yang
. 
【Moment-Video】Diagnosing Temporal Fidelity of Video MLLMs on Momentary Visual Events. 
arXiv, 
2606.02522, 
2026. 
arXiv
InternDiscovery Team
. 
【ResearchClawBench】A benchmark for end-to-end autonomous scientific research. 
arXiv, 
2606.07591, 
2026. 
arXiv
Xiaolong Zhou
, 
Yifei Liu
, 
Ziyang Gong
, 
Jiarui Li
, 
Qiyue Zhao
, 
Muyao Niu
, 
Yuanyuan Gao
, 
Le Ma
, 
Xue Yang
, 
Hongjie Zhang
, 
Zhihang Zhong
. 
【SpaceDG】Benchmarking Spatial Intelligence under Visual Degradation. 
arXiv, 
2605.22536, 
2026. 
ORALKDD
Fei Lin
, 
Ziyang Gong
, 
Cong Wang
, 
Yonglin Tian
, 
Tengchao Zhang
, 
Yonglin Tian
, 
Yining Jiang
, 
Ji Dai
, 
Chao Guo
, 
Xiaotong Yu
, 
Xue Yang
, 
Gen Luo
, 
Fei-Yue Wang
. 
【ToxiMol】Breaking Bad Molecules Are MLLMs Ready for Structure-Level Molecular Detoxification?. 
32nd SIGKDD Conference on Knowledge Discovery and Data Mining - AI for Sciences Track, 
Jeju, Korea, 
2026. 
ACL-F
Xinyi Zeng
, 
Xue Yang
, 
Jingyuan Zhang
, 
Huanqian Yan
, 
Xiang Chen
, 
Kaiwen Wei
, 
Hankun Kang
, 
Yu Tian
. 
【SafeSteer】A Decoding-level Defense Mechanism for Multimodal Large Language Models. 
Association for Computational Linguistics, 
San Diego, California, 
2026. 
TCSVT
Mingjing Yong
, 
Nanqing Liu
, 
Sen Lei
, 
Jie Pan
, 
Xue Yang
, 
Heng-Chao Li
. 
【CTAOD-RS】Continual Test-Time Adaptive Object Detection in Remote Sensing Images via Spectral Routing and Historical Reconstruction. 
IEEE Transactions on Circuits and Systems for Video Technology, 
2026. 
ORALICML
Yuanyuan Gao
, 
Hao Li
, 
Yifei Liu
, 
Xinhao Ji
, 
Yuning Gong
, 
Yuanjun Liao
, 
Fangfu Liu
, 
Manyuan Zhang
, 
Yuchen Yang
, 
Dan Xu
, 
Xue Yang
, 
Huaxi Huang
, 
Hongjie Zhang
, 
Ziwei Liu
, 
Xiao Sun
, 
Dingwen Zhang
, 
Zhihang Zhong
. 
【Holi-Spatial】Evolving Video Streams into Holistic 3D Spatial Intelligence. 
International Conference on Machine Learning, 
Seoul, South Korea, 
2026. 
ICML
Xudong Lu
, 
Huankang Guan
, 
Yang Bo
, 
Jinpeng Chen
, 
Xintong Guo
, 
Shuhan Li
, 
Fang Liu
, 
Peiwen Sun
, 
Xueying Li
, 
Wei Zhang
, 
Xue Yang
, 
Rui Liu
, 
Hongsheng Li
. 
【PhoStream】Benchmarking Real-World Streaming for Omnimodal Assistants in Mobile Scenarios. 
International Conference on Machine Learning, 
Seoul, South Korea, 
2026. 
ACL-F
Lifan Zheng
, 
Xue Yang
, 
Jiawei Chen
, 
Chenyan Wu
, 
Jingyuan Zhang
, 
Fanheng Kong
, 
Xinyi Zeng
, 
Xiang Chen
, 
Yu Tian
. 
【DPN-LE】Dual Personality Neuron Localization and Editing for Large Language Models. 
Association for Computational Linguistics, 
San Diego, California, 
2026. 
arXiv
Yan Li
, 
Zezi Zeng
, 
Yifan Yang
, 
Yuqing Yang
, 
Ning Liao
, 
Weiwei Guo
, 
Lili Qiu
, 
Mingxi Cheng
, 
Qi Dai
, 
Zhendong Wang
, 
Zhengyuan Yang
, 
Xue Yang
, 
Ji Li
, 
Lijuan Wang
, 
Chong Luo
. 
【MM-WebAgent】A Hierarchical Multimodal Web Agent for Webpage Generation. 
arXiv, 
2604.15309, 
2026. 
arXiv
Jianlin Xiang
, 
Linhui Dai
, 
Xue Yang
, 
Chaolei Yang
, 
Yanshan Li
. 
【HiProto】Hierarchical Prototype Learning for Interpretable Object Detection Under Low-quality Conditions. 
arXiv, 
2604.13981, 
2026. 
Tech. Report
Chaoyou Fu
, 
Haozhi Yuan
, 
Yuhao Dong
, 
Yi-Fan Zhang
, 
Yunhang Shen
, 
Xiaoxing Hu
, 
Xueying Li
, 
Jinsen Su
, 
Chengwu Long
, 
Xiaoyao Xie
, 
Yongkang Xie
, 
Xiawu Zheng
, 
Xue Yang
, 
Haoyu Cao
, 
Yunsheng Wu
, 
Ziwei Liu
, 
Xing Sun
, 
Caifeng Shan
, 
Ran He
. 
【Video-MME-v2】Towards the Next Stage in Benchmarks for Comprehensive Video Understanding. 
arXiv, 
2604.05015, 
2026. 
ACL
Jiawei Chen
, 
Yang Yang
, 
Chao Yu
, 
Yu Tian
, 
Zhi Cao
, 
Xue Yang
, 
Linghao Li
, 
Hang Su
, 
Zhaoxia Yin
. 
【Rt-LRM】Red Teaming Large Reasoning Models. 
Association for Computational Linguistics, 
San Diego, California, 
2026. 
ACL
Mingxiang Tao
, 
Yu Tian
, 
Wenxuan Tu
, 
Yue Yang
, 
Xue Yang
, 
Xiangyan Tang
. 
【Safe-FedLLM】Delving into the Safety of Federated Large Language Models. 
Association for Computational Linguistics, 
San Diego, California, 
2026. 
ACL-F
Shaokai He
, 
Kaiwen Wei
, 
Xinyi Zeng
, 
Xiang Chen
, 
Xue Yang
, 
Zhenyang Li
, 
Jiang Zhong
, 
Yu Tian
. 
【DiffER】Diffusion Entity-Relation Modeling for Reversal Curse in Diffusion Large Language Models. 
Association for Computational Linguistics, 
San Diego, California, 
2026. 
arXiv
Yan Li
, 
Zezi Zeng
, 
Ziwei Zhou
, 
Xin Gao
, 
Muzhao Tian
, 
Yifan Yang
, 
Mingxi Cheng
, 
Qi Dai
, 
Yuqing Yang
, 
Lili Qiu
, 
Zhendong Wang
, 
Zhengyuan Yang
, 
Xue Yang
, 
Lijuan Wang
, 
Ji Li
, 
Chong Luo
. 
【BizGenEval】A Systematic Benchmark for Commercial Visual Content Generation. 
arXiv, 
2603.25732, 
2026. 
arXiv
Ziqi Ye
, 
Ziyang Gong
, 
Ning Liao
, 
Xiaoxing Hu
, 
Di Wang
, 
Hongruixuan Chen
, 
Chen Huang
, 
Yiguo He
, 
Yuru Jia
, 
Xiaoxing Wang
, 
Haipeng Wang
, 
Xue Yang
, 
Junchi Yan
. 
【CrossEarth-SAR】A SAR-Centric and Billion-Scale Geospatial Foundation Model for Domain Generalizable Semantic Segmentation. 
arXiv, 
2603.12008, 
2026. 
arXiv
Xiangyu Zhao
, 
Peiyuan Zhang
, 
Junming Lin
, 
Tianhao Liang
, 
Yuchen Duan
, 
Shengyuan Ding
, 
Changyao Tian
, 
Yuhang Zang
, 
Junchi Yan
, 
Xue Yang
. 
【FIRM】Trust Your Critic Robust Reward Modeling and Reinforcement Learning for Faithful Image Editing and Generation. 
arXiv, 
2603.12247, 
2026. 
arXiv
Yuchen Yang
, 
Yuqing Shao
, 
Duxiu Huang
, 
Linfeng Dong
, 
Yifei Liu
, 
Suixin Tang
, 
Xiang Zhou
, 
Yuanyuan Gao
, 
Wei Wang
, 
Yue Zhou
, 
Xue Yang
, 
Yanfeng Wang
, 
Xiao Sun
, 
Zhihang Zhong
. 
【CourtSI】Stepping VLMs onto the Court Benchmarking Spatial Intelligence in Sports. 
arXiv, 
2603.09896, 
2026. 
Tech. Report
Changyao Tian
, 
Danni Yang
, 
Guanzhou Chen
, 
Erfei Cui
, 
Zhaokai Wang
, 
Yuchen Duan
, 
Penghao Yin
, 
Sitao Chen
, 
Ganlin Yang
, 
Mingxin Liu
, 
Zirun Zhu
, 
Ziqian Fan
, 
Leyao Gu
, 
Haomin Wang
, 
Qi Wei
, 
Jinhui Yin
, 
Xue Yang
, 
Zhihang Zhong
, 
Qi Qin
, 
Yi Xin
, 
Bin Fu
, 
Yihao Liu
, 
Jiaye Ge
, 
Qipeng Guo
, 
Gen Luo
, 
Hongsheng Li
, 
Yu Qiao
, 
Kai Chen
, 
Hongjie Zhang
. 
【InternVL-U】Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing. 
arXiv, 
2603.09877, 
2026. 
Tech. Report
Ziyang Gong
, 
Zehang Luo
, 
Anke Tang
, 
Zhe Liu
, 
Shi Fu
, 
Zhi Hou
, 
Ganlin Yang
, 
Weiyun Wang
, 
Xiaofeng Wang
, 
Jianbo Liu
, 
Gen Luo
, 
Haolan Kang
, 
Shuang Luo
, 
Yue Zhou
, 
Yong Luo
, 
Li Shen
, 
Xiaosong Jia
, 
Yao Mu
, 
Xue Yang
, 
Chunxiao Liu
, 
Junchi Yan
, 
Hengshuang Zhao
, 
Dacheng Tao
, 
Xiaogang Wang
. 
【ACE-Brain-0】Spatial Intelligence as a Shared Scaffold for Universal Embodiments. 
arXiv, 
2603.03198, 
2026. 
CVPR
Yan Li
, 
Changyao Tian
, 
Renqiu Xia
, 
Ning Liao
, 
Weiwei Guo
, 
Hongsheng Li
, 
Jifeng Dai
, 
Hao Li
, 
Xue Yang
. 
【AdapTok】Learning Adaptive and Temporally Causal Video Tokenization in a 1D Latent Space. 
Computer Vision and Pattern Recognition, 
Denver Colorado, 
2026. 
CVPR
Shilei Cao
, 
Ziyang Gong
, 
Hehai Lin
, 
Yang Liu
, 
Jiashun Cheng
, 
Xiaoxing Hu
, 
Haoyuan Liang
, 
Guowen Li
, 
Chengwei Qin
, 
Hong Cheng
, 
Xue Yang
, 
Juepeng Zheng
, 
Haohuan Fu
. 
【CrossEarth-Gate】Fisher-Guided Adaptive Tuning Engine for Efficient Adaptation of Cross-Domain Remote Sensing Semantic Segmentation. 
Computer Vision and Pattern Recognition, 
Denver Colorado, 
2026. 
FINALISTCVPR
Peirong Zhang
, 
Yidan Zhang
, 
Luxiao Xu
, 
Jinliang Lin
, 
Zonghao Guo
, 
Fengxiang Wang
, 
Xue Yang
, 
Kaiwen Wei
, 
Lei Wang
. 
【GeoViS】Geospatially Rewarded Visual Search for Remote Sensing Visual Grounding. 
Computer Vision and Pattern Recognition, 
Denver Colorado, 
2026. 
CVPR
Mingxin Liu
, 
Peiyuan Zhang
, 
Yuan Liu
, 
Wei Zhang
, 
Yue Zhou
, 
Ning Liao
, 
Ziyang Gong
, 
Junwei Luo
, 
Zhirui Wang
, 
Yi Yu
, 
Xue Yang
. 
【PWOOD】Partial Weakly-Supervised Oriented Object Detection. 
Computer Vision and Pattern Recognition, 
Denver Colorado, 
2026. 
CVPR
Xiaosong Jia
, 
Chenhe Zhang
, 
Yule Jiang
, 
Songbur Wong
, 
Zhiyuan Zhang
, 
Chen Chen
, 
Shaofeng Zhang
, 
Xuanhe Zhou
, 
Xue Yang
, 
Junchi Yan
, 
Yu-Gang Jiang
. 
【SpatialRetrievalAD】Spatial Retrieval Augmented Autonomous Driving. 
Computer Vision and Pattern Recognition, 
Denver Colorado, 
2026. 
CVPR-F
Haitian Yang
, 
Juan Fang
, 
Yiren Zhu
, 
Xudong Zhao
, 
Yufei Guo
, 
Xiaohan Zhang
, 
Xiaoxing Hu
, 
Xue Yang
, 
Qi Ming
. 
【CrossWeaver】Towards Efficient Cross-Modal Interweaving and Decoupling for Weakly-Aligned Multispectral Object Detection. 
Computer Vision and Pattern Recognition, 
Denver Colorado, 
2026. 
arXiv
Fengxiang Wang
, 
Mingshuo Chen
, 
Yueying Li
, 
Yajie Yang
, 
Yifan Zhang
, 
Long Lan
, 
Xue Yang
, 
Hongda Sun
, 
Yulin Wang
, 
Di Wang
, 
Jun Song
, 
Jing Zhang
, 
Bo Du
. 
【GeoEyes】On-Demand Visual Focusing for Evidence-Grounded Understanding of Ultra-High-Resolution Remote Sensing Imagery. 
arXiv, 
2602.14201, 
2026. 
TPAMI
Zhaoyang Wei
, 
Xumeng Han
, 
Xuehui Yu
, 
Xue Yang
, 
Guorong Li
, 
Zhenjun Han
, 
Jianbin Jiao
. 
【SAPNet++】Evolving Point-Prompted Instance Segmentation with Semantic and Spatial Awareness. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
2026. 
arXiv
Dongshuo Yin
, 
Xue Yang
, 
Deng-Ping Fan
, 
Shi-Min Hu
. 
【CoLin】1%>100% High-Efficiency Visual Adapter with Complex Linear Projection Optimization. 
arXiv, 
2602.10513, 
2026. 
ICLR
Cunxin Fan
, 
Xiaosong Jia
, 
Yihang Sun
, 
Yixiao Wang
, 
Jianglan Wei
, 
Ziyang Gong
, 
Xiangyu Zhao
, 
Masayoshi Tomizuka
, 
Xue Yang
, 
Junchi Yan
, 
Mingyu Ding
. 
【Interleave-VLA】Enhancing Robot Manipulation with Interleaved Image-Text Instructions. 
International Conference on Learning Representations, 
Rio de Janeiro, Brazil, 
2026. 
ICLR
Xiangyu Zhao
, 
Junming Lin
, 
Tianhao Liang
, 
Yifan Zhou
, 
Wenhao Chai
, 
Yuzhe Gu
, 
Weiyun Wang
, 
Kai Chen
, 
Gen Luo
, 
Wenwei Zhang
, 
Junchi Yan
, 
Hua Yang
, 
Haodong Duan
, 
Xue Yang
. 
【MM-HELIX】Boosting Multimodal Long-Chain Reflective Reasoning with Holistic Platform and Adaptive Hybrid Policy Optimization. 
International Conference on Learning Representations, 
Rio de Janeiro, Brazil, 
2026. 
ICLR
Ziqi Ye
, 
Shuran Ma
, 
Jie Yang
, 
Xiaoyi Yang
, 
Ziyang Gong
, 
Xue Yang
, 
Haipeng Wang
. 
【OF-Diff】Object Fidelity Diffusion for Remote Sensing Image Generation. 
International Conference on Learning Representations, 
Rio de Janeiro, Brazil, 
2026. 
ICLR
Teng Zhang
, 
Ziqian Fan
, 
Mingxin Liu
, 
Xin Zhang
, 
Xudong Lu
, 
Wentong Li
, 
Yue Zhou
, 
Yi Yu
, 
Xiang Li
, 
Junchi Yan
, 
Xue Yang
. 
【Point2RBox-v3】Self-Bootstrapping from Point Annotations via Integrated Pseudo-Label Refinement and Utilization. 
International Conference on Learning Representations, 
Rio de Janeiro, Brazil, 
2026. 
ICLR
Ziyang Gong
, 
Wenhao Li
, 
Oliver Ma
, 
Songyuan Li
, 
Jiayi Ji
, 
Xue Yang
, 
Gen Luo
, 
Junchi Yan
, 
Rongrong Ji
. 
【SpaCE-10】A Comprehensive Benchmark for Multimodal Large Language Models in Compositional Spatial Intelligence. 
International Conference on Learning Representations, 
Rio de Janeiro, Brazil, 
2026. 
ICLR
Wei Zhang
, 
Xiang Liu
, 
Ningjing Liu
, 
Mingxin Liu
, 
Wei Liao
, 
Chunyan Xu
, 
Xue Yang
. 
【SPWOOD】Sparse Partial Weakly-Supervised Oriented Object Detection. 
International Conference on Learning Representations, 
Rio de Janeiro, Brazil, 
2026. 
RS
Qingyun Li
, 
Shuran Ma
, 
Junwei Luo
, 
Yi Yu
, 
Yue Zhou
, 
Fengxiang Wang
, 
Xudong Lu
, 
Xiaoxing Wang
, 
Xin He
, 
Yushi Chen
, 
Xue Yang
. 
【RSCoVLM】Co-Training Vision Language Models for Remote Sensing Multi-task Learning. 
Remote Sensing, 
2026. 
ISPRS
Yue Zhou
, 
Jue Chen
, 
Zilun Zhang
, 
Penghui Huang
, 
Ran Ding
, 
Zhentao Zou
, 
PengFei Gao
, 
Yuchen Wei
, 
Ke Li
, 
Xue Yang
, 
Xue Jiang
, 
Hongxin Yang
, 
Jonathan Li
. 
【DVGBench】Implicit-to-Explicit Visual Grounding Benchmark in UAV Imagery with Large Vision-Language Models. 
ISPRS Journal of Photogrammetry and Remote Sensing, 
2026. 
IJCV
Yan Li
, 
Weiwei Guo
, 
Xue Yang
, 
Ning Liao
, 
Shaofeng Zhang
, 
Yi Yu
, 
Wenxian Yu
, 
Junchi Yan
. 
【CastDet】Exploiting Unlabeled Data with Multiple Expert Teachers for Open Vocabulary Aerial Object Detection and Its Orientation Adaptation. 
International Journal of Computer Vision, 
2026. 
ESI🔥TPAMI
Ziyang Gong
, 
Zhixiang Wei
, 
Di Wang
, 
Xiaoxing Hu
, 
Xianzheng Ma
, 
Hongruixuan Chen
, 
Yuru Jia
, 
Yupeng Deng
, 
Zhenming Ji
, 
Xiangwei Zhu
, 
Xue Yang
, 
Naoto Yokoya
, 
Jing Zhang
, 
Bo Du
, 
Junchi Yan
, 
Liangpei Zhang
. 
【CrossEarth】Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
2025. 
Tech. Report
InternScience Team
. 
【SGI-Bench】Probing Scientific General Intelligence of LLMs with Scientist-Aligned Workflows. 
arXiv, 
2512.16969, 
2025. 
Tech. Report
Yuning Gong
, 
Yifei Liu
, 
Yifan Zhan
, 
Muyao Niu
, 
Xueying Li
, 
Yuanjun Liao
, 
Jiaming Chen
, 
Yuanyuan Gao
, 
Jiaqi Chen
, 
Minming Chen
, 
Li Zhou
, 
Yuning Zhang
, 
Wei Wang
, 
Xiaoqing Hou
, 
Huaxi Huang
, 
Shixiang Tang
, 
Le Ma
, 
Dingwen Zhang
, 
Xue Yang
, 
Junchi Yan
, 
Yanchi Zhang
, 
Yinqiang Zheng
, 
Xiao Sun
, 
Zhihang Zhong
. 
【Visionary】The World Model Carrier Built on WebGPU-Powered Gaussian Splatting Platform. 
arXiv, 
2512.08478, 
2025. 
SCIS
Zicheng Zhang
, 
Junying Wang
, 
Farong Wen
, 
Yijin Guo
, 
Xiangyu Zhao
, 
Xinyu Fang
, 
Shengyuan Ding
, 
Ziheng Jia
, 
Jiahao Xiao
, 
Ye Shen
, 
Yushuo Zheng
, 
Xiaorong Zhu
, 
Yalun Wu
, 
Ziheng Jiao
, 
Wei Sun
, 
Zijian Chen
, 
Kaiwei Zhang
, 
Kang Fu
, 
Yuqin Cao
, 
Ming Hu
, 
Yue Zhou
, 
Xuemei Zhou
, 
Juntai Cao
, 
Wei Zhou
, 
Jinyu Cao
, 
Ronghui Li
, 
Donghao Zhou
, 
Yuan Tian
, 
Xiangyang Zhu
, 
Chunyi Li
, 
Haoning Wu
, 
Xiaohong Liu
, 
Junjun He
, 
Yu Zhou
, 
Hui Liu
, 
Lin Zhang
, 
Zesheng Wang
, 
Huiyu Duan
, 
Yingjie Zhou
, 
Xiongkuo Min
, 
Qi Jia
, 
Dongzhan Zhou
, 
Wenlong Zhang
, 
Jiezhang Cao
, 
Xue Yang
, 
Junzhi Yu
, 
Songyang Zhang
, 
Haodong Duan
, 
Guangtao Zhai
. 
Large Multimodal Models Evaluation A Survey. 
SCIENCE CHINA Information Sciences, 
2025. 
AAAI
Xiaoxing Hu
, 
Ziyang Gong
, 
Yupei Wang
, 
Yuru Jia
, 
Gen Luo
, 
Xue Yang
. 
【Earth-Adapter】Bridge the Geospatial Domain Gaps with Mixture of Frequency Adaptation. 
Fortieth AAAI Conference on Artificial Intelligence, 
Singapore, 
2025. 
ORALAAAI
Wei Lu
, 
Xue Yang
, 
Si-Bao Chen
. 
【LWGANet】A Lightweight Group Attention Backbone for Remote Sensing Visual Tasks. 
Fortieth AAAI Conference on Artificial Intelligence, 
Singapore, 
2025. 
Survey
Zirui Tang
, 
Weizheng Wang
, 
Zihang Zhou
, 
Yang Jiao
, 
Bangrui Xu
, 
Boyu Niu
, 
Dayou Zhou
, 
Xuanhe Zhou
, 
Guoliang Li
, 
Yeye He
, 
Wei Zhou
, 
Yitong Song
, 
Cheng Tan
, 
Xue Yang
, 
Chunwei Liu
, 
Bin Wang
, 
Conghui He
, 
Xiaoyang Wang
, 
Fan Wu
. 
LLM/Agent-as-Data-Analyst A Survey. 
arXiv, 
2509.23988, 
2025. 
NeurIPS
Yijie Zheng
, 
Weijie Wu
, 
Qingyun Li
, 
Xuehui Wang
, 
Xu Zhou
, 
Aiai Ren
, 
Jun Shen
, 
Long Zhao
, 
Guoqing Li
, 
Xue Yang
. 
【InstructSAM】A Training-Free Framework for Instruction-Oriented Remote Sensing Object Recognition. 
Advances in Neural Information Processing Systems, 
San Diego & Mexico City, 
2025. 
NeurIPS
Xuehui Wang
, 
Congjie Si
, 
Xue Yang
, 
Yuzhi Zhao
, 
Wenhai Wang
, 
Xiaokang Yang
, 
Wei Shen
. 
【OPMapper】nhancing Open-Vocabulary Semantic Segmentation with Multi-Guidance Information. 
Advances in Neural Information Processing Systems, 
San Diego & Mexico City, 
2025. 
NeurIPS
Wentao Wang
, 
Hang Ye
, 
Fangzhou Hong
, 
Xue Yang
, 
Jianfu Zhang
, 
Yizhou Wang
, 
Ziwei Liu
, 
Liang Pan
. 
【GeneMAN】Generalizable Single-Image 3D Human Reconstruction from Multi-Source Human Data. 
Advances in Neural Information Processing Systems, 
San Diego & Mexico City, 
2025. 
NeurIPS
Zhenjie Yang
, 
Xiaosong Jia
, 
Qifeng Li
, 
Xue Yang
, 
Maoqing Yao
, 
Junchi Yan
. 
【Raw2Drive】Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2). 
Advances in Neural Information Processing Systems, 
San Diego & Mexico City, 
2025. 
ORALNeurIPS
Xiangyu Zhao
, 
Peiyuan Zhang
, 
Kexian Tang
, 
Xiaorong Zhu
, 
Hao Li
, 
Wenhao Chai
, 
Zicheng Zhang
, 
Renqiu Xia
, 
Guangtao Zhai
, 
Junchi Yan
, 
Hua Yang
, 
Xue Yang
, 
Haodong Duan
. 
【RISEBench】Envisioning Beyond the Pixels Benchmarking Reasoning-Informed Visual Editing. 
Advances in Neural Information Processing Systems, DB Track, 
San Diego & Mexico City, 
2025. 
arXiv
Xudong Lu
, 
Zhi Zheng
, 
Yi Wan
, 
Yongxiang Yao
, 
Annan Wang
, 
Renrui Zhang
, 
Panwang Xia
, 
Qiong Wu
, 
Qingyun Li
, 
Weifeng Lin
, 
Xiangyu Zhao
, 
Peifeng Ma
, 
Xue Yang
, 
Hongsheng Li
. 
【GLEAM】Learning to Match and Explain in Cross-View Geo-Localization. 
arXiv, 
2509.0745, 
2025. 
ISPRS
Yue Zhou
, 
Litong Feng
, 
Mengcheng Lan
, 
Xue Yang
, 
Qingyun Li
, 
Yiping Ke
. 
【AVI-Math】Multimodal mathematical reasoning embedded in aerial vehicle imagery:Benchmarking, analysis, and exploration. 
ISPRS Journal of Photogrammetry and Remote Sensing, 
230, 289-303, 
2025. 
TPAMI
Zhaokai Wang
, 
Xizhou Zhu
, 
Xue Yang
, 
Gen Luo
, 
Hao Li
, 
Changyao Tian
, 
Wenhan Dou
, 
Junqi Ge
, 
Lewei Lu
, 
Yu Qiao
, 
Jifeng Dai
. 
【PIIP】Parameter-Inverted Image Pyramid Networks for Visual Perception and Multimodal Understanding. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
47(11), 10142-10159, 
2025. 
arXiv
Gen Luo
, 
Wenhan Dou
, 
Wenhao Li
, 
Zhaokai Wang
, 
Xue Yang
, 
Changyao Tian
, 
Hao Li
, 
Weiyun Wang
, 
Wenhai Wang
, 
Xizhou Zhu
, 
Yu Qiao
, 
Jifeng Dai
. 
【Mono-InternVL-1.5】Towards Cheaper and Faster Monolithic Multimodal Large Language Models. 
arXiv, 
2507.12566, 
2025. 
ACM MM
Maoxun Yuan
, 
Bo Cui
, 
Tianyi Zhao
, 
Jiayi Wang
, 
Shan Fu
, 
Xue Yang
, 
Xingxing Wei
. 
【UniRGB-IR】A Unified Framework for Visible-Infrared Semantic Tasks via Adapter Tuning. 
33rd ACM International Conference on Multimedia, 
Dublin, Ireland, 
2025. 
JIG
Chen Shiqi
, 
Yang Xue
, 
Zhu Rongqiang
, 
Liao Ning
, 
Zhao Weiwei
. 
【R3DetGauss】Parameter-efficient fine-tuning for remote sensing image interpretation a survey. 
Journal of Image and Graphics, 
31(1), 0212-0242, 
2023. 
ICCV
Wufei Xie
, 
Yalin Wang
, 
Chenliang Liu
, 
Zhaohui Jiang
, 
Xue Yang
. 
【Flexi-FSCIL】Adaptive Knowledge Retention for Breaking the Stability-Plasticity Dilemma in Few-Shot Class-Incremental Learning. 
International Conference on Computer Vision, 
Honolulu, Hawai'i, 
2025. 
ICCV
Xudong Lu
, 
Yinghao Chen
, 
Renshou Wu
, 
Haohao Gao
, 
Xi Chen
, 
Xue Yang
, 
Xiangyu Zhao
, 
Aojun Zhou
, 
Fangyuan Li
, 
Yafei Wen
, 
Xiaoxin Chen
, 
Shuai Ren
, 
Hongsheng Li
. 
【GenieBlue】Integrating both Linguistic and Multimodal Capabilities for Large Language Models on Mobile Devices. 
International Conference on Computer Vision, 
Honolulu, Hawai'i, 
2025. 
ICCV
Junwei Luo
, 
Yingying Zhang
, 
Xue Yang
, 
Kang Wu
, 
Qi Zhu
, 
Lei Liang
, 
Jingdong Chen
, 
Yansheng Li
. 
【LRS-VQA】When Large Vision-Language Model Meets Large Remote Sensing Imagery Coarse-to-Fine Text-Guided Token Pruning. 
International Conference on Computer Vision, 
Honolulu, Hawai'i, 
2025. 
ICCV
Chen Chen
, 
Zhirui Wang
, 
Taowei Sheng
, 
Yi Jiang
, 
Yundu Li
, 
Peirui Cheng
, 
Luning Zhang
, 
Kaiqiang Chen
, 
Yanfeng Hu
, 
Xue Yang
, 
Xian Sun
. 
【SA-Occ】Satellite-Assisted 3D Occupancy Prediction in Real World. 
International Conference on Computer Vision, 
Honolulu, Hawai'i, 
2025. 
ICCV
Yuru Jia
, 
Valerio Marsocci
, 
Ziyang Gong
, 
Xue Yang
, 
Maarten Vergauwen
, 
Andrea Nascetti
. 
【SatDiFuser】Can Generative Geospatial Diffusion Models Excel as Discriminative Geospatial Foundation Models?. 
International Conference on Computer Vision, 
Honolulu, Hawai'i, 
2025. 
TGRS
Yue Zhou
, 
Ran Ding
, 
Xue Yang
, 
Xue Jiang
, 
Xingzhao Liu
. 
【AirSpatialBot】A Spatially-Aware Aerial Agent for Fine-Grained Vehicle Attribute Recognization and Retrieval. 
IEEE Transactions on Geoscience and Remote Sensing, 
2025. 
IJCV
Peiyuan Zhang
, 
Junwei Luo
, 
Xue Yang
, 
Yi Yu
, 
Qingyun Li
, 
Yue Zhou
, 
Xiaosong Jia
, 
Xudong Lu
, 
Jingdong Chen
, 
Xiang Li
, 
Junchi Yan
, 
Yansheng Li
. 
【PointOBB-v3】Expanding Performance Boundaries of Single Point-Supervised Oriented Object Detection. 
International Journal of Computer Vision, 
133, 6108–6128, 
2025. 
ORALIGARSS
Qingyun Li
, 
Xin He
, 
Xinya Shu
, 
Yi Yu
, 
Dong Chen
, 
Yushi Chen
, 
Xue Yang
. 
【LMMRotate】A Simple Aerial Detection Baseline of Multimodal Language Models. 
International Geoscience and Remote Sensing Symposium, 
Brisbane, Australia, 
2025. 
CVPR
Dongshuo Yin
, 
Leiyi Hu
, 
Bin Li
, 
Youqun Zhang
, 
Xue Yang
. 
【Mona】5%>100% Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks. 
Computer Vision and Pattern Recognition, 
Music City Center, Nashville TN, 
2025. 
CVPR
Gen Luo
, 
Xue Yang
, 
Wenhan Dou
, 
Zhaokai Wang
, 
Jifeng Dai
, 
Yu Qiao
, 
Xizhou Zhu
. 
【Mono-InternVL】Pushing the Boundaries of Monolithic Multimodal Large Language Models with Endogenous Visual Pre-training. 
Computer Vision and Pattern Recognition, 
Music City Center, Nashville TN, 
2025. 
CVPR
Yi Yu
, 
Botao Ren
, 
Peiyuan Zhang
, 
Mingxin Liu
, 
Junwei Luo
, 
Shaofeng Zhang
, 
Feipeng Da
, 
Junchi Yan
, 
Xue Yang
. 
【Point2RBox-v2】Rethinking Point-supervised Oriented Object Detection with Spatial Layout Among Instances. 
Computer Vision and Pattern Recognition, 
Music City Center, Nashville TN, 
2025. 
CVPR
Xin Zhang
, 
Xue Yang
, 
Yuxuan Li
, 
Jian Yang
, 
Ming-Ming Cheng
, 
Xiang Li
. 
【RSAR】Restricted State Angle Resolver and Rotated SAR Benchmark. 
Computer Vision and Pattern Recognition, 
Music City Center, Nashville TN, 
2025. 
TPAMI
Yi Yu
, 
Xue Yang
, 
Yansheng Li
, 
Zhenjun Han
, 
Feipeng Da
, 
Junchi Yan
. 
【Wholly-WOOD】Wholly Leveraging Diversified-quality Labels for Weakly-supervised Oriented Object Detection. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
47(6), 4438-4454, 
2025. 
ICLR
Chongjie Si
, 
Xuehui Wang
, 
Xue Yang
, 
Zhengqin Xu
, 
Qingyun Li
, 
Jifeng Dai
, 
Yu Qiao
, 
Xiaokang Yang
, 
Wei Shen
. 
【FLoRA】Maintaining Structural Integrity in Parameter Spaces for Parameter Efficient Fine-tuning. 
International Conference on Learning Representations, 
Singapore, 
2025. 
ICLR
Botao Ren
, 
Xue Yang
, 
Yi Yu
, 
Junwei Luo
, 
Zhida Deng
. 
【PointOBB-v2】Towards Simpler, Faster, and Stronger Single Point Supervised Oriented Object Detection. 
International Conference on Learning Representations, 
Singapore, 
2025. 
TGRS
Pengju Tian
, 
Zhirui Wang
, 
Peirui Cheng
, 
Yuchao Wang
, 
Zhechao Wang
, 
Liangjin Zhao
, 
Menglong Yan
, 
Xue Yang
, 
Xian Sun
. 
【UCDNet】Multi-UAV Collaborative 3D Object Detection Network by Reliable Feature Mapping. 
IEEE Transactions on Geoscience and Remote Sensing, 
63, 
2024. 
AAAI
Jiaqing Zhang
, 
Mingxiang Cao
, 
Xue Yang
, 
Kai Jiang
, 
Yunsong Li
. 
【DiffCLIP】Few-shot Language-driven Multimodal Classifier. 
Thirty-Ninth AAAI Conference on Artificial Intelligence, 
Philadelphia, Pennsylvania, USA, 
2025. 
ESI🔥TPAMI
Yansheng Li
, 
Linlin Wang
, 
Tingzhu Wang
, 
Xue Yang
, 
Junwei Luo
, 
Qi Wang
, 
Youming Deng
, 
Wenbin Wang
, 
Xian Sun
, 
Haifeng Li
, 
Bo Dang
, 
Yongjun Zhang
, 
Yi Yu
, 
Junchi Yan
. 
【STAR】A First-Ever Dataset and A Large-Scale Benchmark for Scene Graph Generation in Large-Size Satellite Imagery. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
47(3), 1832-1849, 
2024. 
arXiv
Yue Zhou
, 
Mengcheng Lan
, 
Xiang Li
, 
Litong Feng
, 
Yiping Ke
, 
Xue Jiang
, 
Qingyun Li
, 
Xue Yang
, 
Wayne Zhang
. 
【GeoGround】A Unified Large Vision-Language Model for Remote Sensing Visual Grounding. 
arXiv, 
2411.11904, 
2024. 
NeurIPS
Zhechao Wang
, 
Peirui Cheng
, 
Mingxin Chen
, 
Pengju Tian
, 
Zhirui Wang
, 
Xinming Li
, 
Xue Yang
, 
Xian Sun
. 
【Drones Help Drones】A Collaborative Framework for Multi-Drone Object Trajectory Prediction and Beyond. 
Advances in Neural Information Processing Systems, 
Vancouver, Canada, 
2024. 
ORALNeurIPS
Jiaqing Zhang
, 
Mingxiang Cao
, 
Jie Lei
, 
Weiying Xie
, 
Daixun Li
, 
Wenbo Huang
, 
Yunsong Li
, 
Xue Yang
. 
【E2E-MFD】Towards End-to-End Synchronous Multimodal Fusion Detection. 
Advances in Neural Information Processing Systems, 
Vancouver, Canada, 
2024. 
SPOTLIGHTNeurIPS
Xizhou Zhu
, 
Xue Yang
, 
Zhaokai Wang
, 
Hao Li
, 
Wenhan Dou
, 
Junqi Ge
, 
Lewei Lu
, 
Yu Qiao
, 
Jifeng Dai
. 
【PIIP】Parameter-Inverted Image Pyramid Networks. 
Advances in Neural Information Processing Systems, 
Vancouver, Canada, 
2024. 
ECCV
Yan Li
, 
Weiwei Guo
, 
Xue Yang
, 
Ning Liao
, 
Dunyun He
, 
Jiaqi Zhou
, 
Wenxian Yu
. 
【CastDet】Toward Open Vocabulary Aerial Object Detection with CLIP-Activated Student-Teacher Learning. 
European Conference on Computer Vision, 
MiCo Milano, Italy, 
2024. 
ECCV
Tongkun Guan
, 
Wei Shen
, 
Xue Yang
, 
Xuehui Wang
, 
Xiaokang Yang
. 
【FreeReal】Bridging Synthetic and Real Worlds for Pre-training Scene Text Detectors. 
European Conference on Computer Vision, 
MiCo Milano, Italy, 
2024. 
arXiv
Xudong Lu
, 
Aojun Zhou
, 
Ziyi Lin
, 
Qi Liu
, 
Yuhui Xu
, 
Renrui Zhang
, 
Xue Yang
, 
Junchi Yan
, 
Peng Gao
, 
Hongsheng Li
. 
【TerDiT】Ternary Diffusion Models with Transformers. 
arXiv, 
2405.14854, 
2024. 
CVPR
Hao Li
, 
Xue Yang
, 
Zhaokai Wang
, 
Xizhou Zhu
, 
Jie Zhou
, 
Yu Qiao
, 
Xiaogang Wang
, 
Hongsheng Li
, 
Lewei Lu
, 
Jifeng Dai
. 
【Auto MC-Reward】Automated Dense Reward Design with Large Language Models for Minecraft. 
Computer Vision and Pattern Recognition, 
Seattle WA, USA, 
2024. 
CVPR
Zikai Xiao
, 
Guoye Yang
, 
Xue Yang
, 
Taijiang Mu
, 
Junchi Yan
, 
Shimin Hu
. 
【COBB】Theoretically Achieving Continuous Representation of Oriented Bounding Boxes. 
Computer Vision and Pattern Recognition, 
Seattle WA, USA, 
2024. 
CVPR
Yi Yu
, 
Xue Yang
, 
Qingyun Li
, 
Feipeng Da
, 
Jifeng Dai
, 
Yu Qiao
, 
Junchi Yan
. 
【Point2RBox】Combine Knowledge from Synthetic Visual Patterns for End-to-end Oriented Object Detection with Single Point Supervision. 
Computer Vision and Pattern Recognition, 
Seattle WA, USA, 
2024. 
CVPR
Junwei Luo
, 
Xue Yang
, 
Yu Yi
, 
Qingyun Li
, 
Junchi Yan
, 
Yansheng Li
. 
【PointOBB】Learning Oriented Object Detection via Single Point Supervision. 
Computer Vision and Pattern Recognition, 
Seattle WA, USA, 
2024. 
ESI🔥TGRS
Ying Zeng
, 
Yushi Chen
, 
Xue Yang
, 
Qingyun Li
, 
Junchi Yan
. 
【ARS-DETR】Aspect Ratio-Sensitive Detection Transformer for Aerial Oriented Object Detection. 
IEEE Transactions on Geoscience and Remote Sensing, 
62, 1-15, 
2024. 
ICASSP
Xue Yang
, 
Yue Zhou
, 
Wenlong Liao
, 
Tao He
, 
Junchi Yan
. 
【AlphaRotate】A Rotation Detection Benchmark using TensorFlow. 
International Conference on Acoustics, Speech and Signal Processing, 
Seoul, Korea, 
2024. 
arXiv
Guangming Cao
, 
Xuehui Yu
, 
Wenwen Yu
, 
Xumeng Han
, 
Xue Yang
, 
Guorong Li
, 
Jianbin Jiao
, 
Zhenjun Han
. 
【P2RBox】Point Prompt Oriented Object Detection with SAM. 
arXiv, 
2311.13128, 
2023. 
SCIS
Xue Yang
, 
Junchi Yan
. 
【R3DetGauss】Visual Oriented Object Detection via Feature Alignment and Gaussian Parameterization. 
SCIENCE CHINA Information Sciences, 
53(11), 2250-2265, 
2023. 
NeurIPS
Yi Yu
, 
Xue Yang
, 
Qingyun Li
, 
Yue Zhou
, 
Gefan Zhang
, 
Feipeng Da
, 
Junchi Yan
. 
【H2RBox-v2】Incorporating Symmetry for Boosting Horizontal Box Supervised Oriented Object Detection. 
Advances in Neural Information Processing Systems, 
New Orleans, Louisiana, USA, 
2023. 
ICCV
Tongkun Guan
, 
Wei Shen
, 
Xue Yang
, 
Xuehui Wang
, 
Qi Feng
, 
Zekun Jiang
, 
Xiaokang Yang
. 
【CCD】Self-supervised Character-to-Character Distillation for Text Recognition. 
International Conference on Computer Vision, 
Paris, France, 
2023. 
arXiv
Zhaoyang Liu
, 
Yinan He
, 
Wenhai Wang
, 
Weiyun Wang
, 
Yi Wang
, 
Shoufa Chen
, 
Qinglong Zhang
, 
Yang Yang
, 
Qingyun Li
, 
Jiashuo Yu
, 
Kunchang Li
, 
Zhe Chen
, 
Xue Yang
, 
Xizhou Zhu
, 
Yali Wang
, 
Limin Wang
, 
Ping Luo
, 
Jifeng Dai
, 
Yu Qiao
. 
【InternGPT】Solving Vision-Centric Tasks by Interacting with ChatGPT Beyond Language. 
arXiv, 
2305.05662, 
2023. 
CVPR
Tongkun Guan
, 
Chaochen Gu
, 
Jingzheng Tu
, 
Xue Yang
, 
Qi Feng
, 
Yudi Zhao
, 
Wei Shen
. 
【SIGA】Self-supervised Implicit Glyph Attention for Text Recognition. 
Computer Vision and Pattern Recognition, 
Vancouver, Canada, 
2023. 
ESI🔥/BPRS
Liping Hou
, 
Ke Lu
, 
Xue Yang
, 
Yuqiu Li
, 
Jian Xue
. 
【G-Rep】Gaussian Representation for Arbitrary-Oriented Object Detection. 
Remote Sensing (2023 Best Paper Awards), 
15(3), 757, 
2023. 
ICLR
Xue Yang
, 
Gefan Zhang
, 
Wentong Li
, 
Xuehui Wang
, 
Yue Zhou
, 
Junchi Yan
. 
【H2RBox】Horizontal Box Annotation is All You Need for Oriented Object Detection. 
International Conference on Learning Representations, 
Kigali, Rwanda, 
2023. 
ICLR
Xue Yang
, 
Yue Zhou
, 
Gefan Zhang
, 
Jirui Yang
, 
Wentao Wang
, 
Junchi Yan
, 
Xiaopeng Zhang
, 
Qi Tian
. 
【KFIoU】The KFIoU Loss for Rotated Object Detection. 
International Conference on Learning Representations, 
Kigali, Rwanda, 
2023. 
ICLR
Qinrou Wen
, 
Jirui Yang
, 
Xue Yang
, 
Kewei Liang
. 
【PatchDCT】Patch Refinement for High Quality Instance Segmentation. 
International Conference on Learning Representations, 
Kigali, Rwanda, 
2023. 
ESI🔥ISPRS
Qi Ming
, 
Lingjuan Miao
, 
Zhiqiang Zhou
, 
Junjie Song
, 
Yunpeng Dong
, 
Xue Yang
. 
【TIOE】Task Interleaving and Orientation Estimation for High-Precision Oriented Object Detection in Aerial Images. 
ISPRS Journal of Photogrammetry and Remote Sensing, 
196, 241-255, 
2023. 
JSTARS
Yue Zhou
, 
Xue Jiang
, 
Guozheng Xu
, 
Xue Yang
, 
Xingzhao Liu
. 
【PVT-SAR】An Arbitrarily Oriented SAR Ship Detector with Pyramid Vision Transformer. 
IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 
16, 291-305, 
2022. 
ORALACM MM
Yue Zhou
, 
Xue Yang
, 
Gefan Zhang
, 
Jiabao Wang
, 
Yanyi Liu
, 
Liping Hou
, 
Xue Jiang
, 
Xingzhao Liu
, 
Junchi Yan
, 
Chengqi Lyu
, 
Wenwei Zhang
, 
Kai Chen
. 
【MMRotate】A Rotated Object Detection Benchmark using PyTorch. 
30th ACM International Conference on Multimedia, OS Track, 
Lisboa, Portugal, 
2022. 
ESI🔥TPAMI
Xue Yang
, 
Gefan Zhang
, 
Xiaojiang Yang
, 
Yue Zhou
, 
Wentao Wang
, 
Jin Tang
, 
Tao He
, 
Junchi Yan
. 
Detecting Rotated Objects as Gaussian Distributions and Its 3-D Generalization. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
45(4), 4335-4354, 
2022. 
TCSVT
Wen Qian
, 
Xue Yang
, 
Silong Peng
, 
Junchi Yan
, 
Xiujuan Zhang
. 
【RSDet++】Point-based Modulated Loss for More Accurate Rotated Object Detection. 
IEEE Transactions on Circuits and Systems for Video Technology, 
32(11), 7869-7879, 
2022. 
ESI🔥TPAMI
Xue Yang
, 
Junchi Yan
, 
Wenlong Liao
, 
Xiaokang Yang
, 
Jin Tang
, 
Tao He
. 
【SCRDet++】Detecting Small, Cluttered and Rotated Objects via Instance-Level Feature Denoising and Rotation Loss Smoothing. 
IEEE Transactions on Pattern Analysis and Machine Intelligence, 
45(2), 2384-2399, 
2022. 
CVPR
Wentao Wang
, 
Li Niu
, 
Jianfu Zhang
, 
Xue Yang
, 
Liqing Zhang
. 
Dual-path Image Inpainting with Auxiliary GAN Inversion. 
Computer Vision and Pattern Recognition, 
New Orleans, Louisiana, 
2022. 
ESI🔥IJCV
Xue Yang
, 
Junchi Yan
. 
On the Arbitrary-Oriented Object Detection Classification based Approaches Revisited. 
International Journal of Computer Vision, 
130, 1340-1365, 
2022. 
NeurIPS
Xue Yang
, 
Xiaojiang Yang
, 
Jirui Yang
, 
Qi Ming
, 
Wentao Wang
, 
Qi Tian
, 
Junchi Yan
. 
【KLD】Learning High-Precision Bounding Box for Rotated Object Detection via Kullback-Leibler Divergence. 
Advances in Neural Information Processing Systems, 
Virtual, 
2021. 
GRSL
Qi Ming
, 
Lingjuan Miao
, 
Zhiqiang Zhou
, 
Xue Yang
, 
Yunpeng Dong
. 
【RIDet】Optimization for Arbitrary-Oriented Object Detection via Representation Invariance Loss. 
IEEE Geoscience and Remote Sensing Letters, 
19, 1-5, 
2021. 
ICCV
Wentao Wang
, 
Jianfu Zhang
, 
Li Niu
, 
Haoyu Ling
, 
Xue Yang
, 
Liqing Zhang
. 
Parallel Multi-Resolution Fusion Network for Image Inpainting. 
International Conference on Computer Vision, 
Virtual, 
2021. 
RS
Qi Ming
, 
Lingjuan Miao
, 
Zhiqiang Zhou
, 
Junjie Song
, 
Xue Yang
. 
【SLA】Sparse Label Assignment for Oriented Object Detection in Aerial Images. 
Remote Sensing, 
13(14), 2664, 
2021. 
ICML
Xue Yang
, 
Junchi Yan
, 
Qi Ming
, 
Wentao Wang
, 
Xiaopeng Zhang
, 
Qi Tian
. 
【GWD】Rethinking Rotated Object Detection with Gaussian Wasserstein Distance Loss. 
International Conference on Machine Learning, 
Virtual, 
2021. 
CVPR
Xue Yang
, 
Liping Hou
, 
Yue Zhou
, 
Wentao Wang
, 
Junchi Yan
. 
【DCL】Dense Label Encoding for Boundary Discontinuity Free Rotation Detection. 
Computer Vision and Pattern Recognition, 
Virtual, 
2021. 
TOP1🔥AAAI
Xue Yang
, 
Junchi Yan
, 
Ziming Feng
, 
Tao He
. 
【R3Det】Refined Single-Stage Detector with Feature Refinement for Rotating Object. 
Thirty-Fifth AAAI Conference on Artificial Intelligence, 
Vancouver, Canada, 
2021. 
TOP10🔥AAAI
Wen Qian
, 
Xue Yang
, 
Silong Peng
, 
Junchi Yan
, 
Yue Guo
. 
【RSDet】Learning Modulated Loss for Rotated Object Detection. 
Thirty-Fifth AAAI Conference on Artificial Intelligence, 
Vancouver, Canada, 
2021. 
FBB
Siqiong Yao
, 
Junchi Yan
, 
Mingyu Wu
, 
Xue Yang
, 
Weituo Zhang
, 
Hui Lu
, 
Biyun Qian
. 
Texture Synthesis Based Thyroid Nodule Detection from Medical Ultrasound Images Interpreting and Suppressing the Adversarial Effect of In-place Manual Annotation. 
Frontiers in Bioengineering and Biotechnology, 
8, 599, 
2019. 
ECCV
Xue Yang
, 
Junchi Yan
. 
【CSL】Arbitrary-Oriented Object Detection with Circular Smooth Label. 
European Conference on Computer Vision, 
Glasgow, Scotland, UK, 
2020. 
BMVC
Ang Li
, 
Xue Yang
, 
Chongyang Zhang
. 
【FSCascade】Rethinking Classification and Localization for Cascade R-CNN. 
30th British Machine Vision Conference, 
Cardiff, Wales, UK, 
2019. 
ICCV
Xue Yang
, 
Jirui Yang
, 
Junchi Yan
, 
Yue Zhang
, 
Tengfei Zhang
, 
Zhi Guo
, 
Sun Xian
, 
Kun Fu
. 
【SCRDet】Towards More Robust Detection for Small, Cluttered and Rotated Objects. 
International Conference on Computer Vision, 
Seoul, Korea, 
2019. 
RS
Kun Fu
, 
Yang Li
, 
Hao Sun
, 
Xue Yang
, 
Guangluan Xu
, 
Yuting Li
, 
Xian Sun
. 
【FFPN-RL】A Ship Rotation Detection Model in Remote Sensing Images Based on Feature Fusion Pyramid Network and Deep Reinforcement Learning. 
Remote Sensing, 
10(12), 1922, 
2018. 
IJRS
Jirui Yang
, 
Luyan Ji
, 
Xiurui Geng
, 
Xue Yang
, 
Yongchao Zhao
. 
【RFast-RCNN】Building Detection in High Spatial Resolution Remote Sensing Imagery with the U-Rotation Detection Network. 
International Journal of Remote Sensing, 
40(15), 6036-6058, 
2018. 
Access
Xue Yang
, 
Hao Sun
, 
Xian Sun
, 
Menglong Yan
, 
Zhi Guo
, 
Kun Fu
. 
Position Detection and Direction Prediction for Arbitrary-oriented Ships via Multitask Rotation Region Convolutional Neural Network. 
IEEE Access, 
6, 50839-50849, 
2018. 
ESI🔥Access
Jiao Jiao
, 
Yue Zhang
, 
Hao Sun
, 
Xue Yang
, 
Xun Gao
, 
Wen Hong
, 
Kun Fu
, 
Xian Sun
. 
【DCMSNN】A Densely Connected End-to-End Neural Network for Multiscale and Multiscene SAR Ship Detection. 
IEEE Access, 
6, 20881-20892, 
2018. 
IGARSS
Xue Yang
, 
Kun Fu
, 
Hao Sun
, 
Xian Sun
, 
Menglong Yan
, 
Wenhui Diao
, 
Zhi Guo
. 
Object Detection With Head Direction in Remote Sensing Images Based on Rotational Region CNN. 
International Geoscience and Remote Sensing Symposium, 
Valencia, 
2018. 
ESI🔥RS
Xue Yang
, 
Hao Sun
, 
Kun Fu
, 
Jirui Yang
, 
Xian Sun
, 
Menglong Yan
, 
Zhi Guo
. 
【R-DFPN】Automatic Ship Detection in Remote Sensing Images from Google Earth of Complex Scenes Based on Multiscale Rotation Dense Feature Pyramid Networks. 
Remote Sensing, 
10(1), 132, 
2018.