Research

Publications

Published work, public preprints, and current manuscripts. See Google Scholar for citations and updates.

* Equal contribution

2026

ICML 2026

FormalJudge: A Neuro-Symbolic Paradigm for Agentic Oversight

Jiayi Zhou*, Yang Sheng*, Hantao Lou*, Yaodong Yang, Jie Fu

2025

ICML 2025

SAE-V: Interpreting Multimodal Models for Enhanced Alignment

Hantao Lou*, Changye Li*, Jiaming Ji, Yaodong Yang

AAAI 2025

Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction

Hantao Lou, Jiaming Ji, Kaile Wang, Yaodong Yang

ACL 2025 · Best Paper

Language Models Resist Alignment: Evidence From Data Compression

Jiaming Ji*, Kaile Wang*, Tianyi Qiu*, Boyuan Chen*, Jiayi Zhou, Changye Li, Hantao Lou, Josef Dai, Yunhuai Liu, Yaodong Yang

ACM Computing Surveys 2025

AI Alignment: A Contemporary Survey

Jiaming Ji*, Tianyi Qiu*, Boyuan Chen*, Borong Zhang*, Hantao Lou, Kaile Wang, Yawen Duan, Zhonghao He, Jiayi Zhou, Zhaowei Zhang, Fanzhi Zeng, Kwan Yee Ng, Juntao Dai, Xuehai Pan, Aidan O'Gara, Yingshan Lei, Hua Xu, Brian Tse, Jie Fu, Stephen McAleer, Yaodong Yang, Yizhou Wang, Song-Chun Zhu, Yike Guo, Wen Gao

2024

NeurIPS 2024 · Oral

Aligner: Efficient Alignment by Learning to Correct

Jiaming Ji*, Boyuan Chen*, Hantao Lou, Donghai Hong, Borong Zhang, Xuehai Pan, Juntao Dai, Tianyi Qiu, Yaodong Yang

arXiv

Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback

Jiaming Ji*, Jiayi Zhou*, Hantao Lou*, Boyuan Chen*, Donghai Hong*, Xuyao Wang, Wenqi Chen, Kaile Wang, Rui Pan, Jiahao Li, Mohan Wang, Josef Dai, Tianyi Qiu, Hua Xu, Dong Li, Weipeng Chen, Jun Song, Bo Zheng, Yaodong Yang