Kaijie Chen

Ph.D. student in Computer Science at the University of Virginia (2026-present). B.S. in Computer Science (Elite Class), Tongji University (2022-2026). Previous intern at Shanghai AI Laboratory. First first-authored paper: EMNLP Outstanding Paper Award Nomination & Oral (Top 0.55%).

I work on evaluation, self-evolution, and post-training.

Contact Info  /  Google Scholar  /  X  /  Github

Kaijie Chen

Selected Research (* indicates equal contribution)

R2I-Bench overview showing examples across reasoning categories

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Kaijie Chen, Zihao Lin*, Zhiyang Xu*, Ying Shen*, Yuguang Yao, Joy Rimchala, Jiaxin Zhang, Lifu Huang

EMNLP 2025 Outstanding Paper Award Nomination & Oral (Top 0.55%) Evaluation

GUI Agents for Continual Game Generation overview

GUI Agents for Continual Game Generation

Yixu Huang*, Bo Li*, Na Li*, Zhe Wang, Kaijie Chen, Haonan Ge, Qingyi Si, Yuanzhe Shen, Ruihan Yang, Guangjing Wang, Hongcheng Guo

Findings of EMNLP 2026 Self-Evolution

MVI-Bench overview

MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs

Huiyi Chen, Jiawei Peng*, Dehai Min*, Changchang Sun*, Kaijie Chen, Yan Yan, Xu Yang, Lu Cheng

ICML 2026 Evaluation

MemMark overview

MemMark: State-Evolution Attribution Watermarking for Agent Long-Term Memory Systems

Haobo Zhang*, Xutao Mao*, Guangyuan Dong, Ziwei Li, Xuanbo Su, Kaijie Chen, Jing Yang, Zheng Lin

Findings of EMNLP 2026 Self-Evolution

STRIDE overview

STRIDE: Strategic Trajectory Reasoning via Discriminative Estimation for Verifiable Reinforcement Learning

Qinjian Zhao*, Zhihao Dou*, Zhang Dinggeng*, Xiangyu Li, Chaoda Song, Zhongwei Wan, Xinpeng Li, Yanyan Zhang, Kaijie Chen, Qingtao Pan, Chengcheng Feng, Zhiqiang Gao, Xiaoyu Xia

Preprint 2026 Post-Training

Sell More, Play Less overview

Sell More, Play Less: Benchmarking LLM Realistic Selling Skill

Xuanbo Su, Wenhao Hu, Le Zhan, Yuting Xie, Kailin Lyu, Kaijie Chen, Ziwei Li, Yeqiang Wang, Haibo Su, Yunzhang Chen, Ling Huang

EMNLP 2026 (main) Evaluation

EvoFlow overview

EvoFlow: Evolving Diverse Agentic Workflows On The Fly

Guibin Zhang*, Kaijie Chen*, Guancheng Wan, Heng Chang, Hong Cheng, Kun Wang, Shuyue Hu, Lei Bai

Preprint 2025 Self-Evolution

SuperFlow overview

SuperFlow: Training Flow Matching Models with RL on the Fly

Kaijie Chen, Zhiyang Xu, Ying Shen, Zihao Lin, Yuguang Yao, Lifu Huang

Findings of AACL 2026 Post-Training

Academic Service

Conference Reviewer: NeurIPS 2026, EMNLP 2026, C3NLP@ACL 2026, NeurIPS@DiffuLM 2026, COLM@LSEI 2026.

Journal Reviewer: TMLR, TCSVT 2026, JBHI 2026.