Publications

Publications by categories in reversed chronological order. The asterisks(*) mean that authors are equal contribution.

Preprints

  1. zhou2026odyssim.png
    OdysSim: Building Foundation Models for Human Behavior Simulation
    Preprint, 2026
  2. wei2026reinforce.png
    Reinforcing Human Behavior Simulation via Verbal Feedback
    Weiwei Sun*Xuhui Zhou*Jiarui LiuWeihua Du, Haojia Sun, Yiqing XieQianou MaSihao ChenMengting WanLongqi Yang, and 6 more authors
    Preprint, 2026
  3. du2026adaexplore.png
    AdaExplore: Failure-Driven Adaptation and Diversity-Preserving Search for Efficient Kernel Generation
    Weihua DuJingming ZhuoYixin Dong, Andre Wang He, Weiwei SunZeyu Zheng, Manupa Karunaratne, Ivan Fox, Tim DettmersTianqi Chen, and 2 more authors
    Preprint, 2026
  4. du2026swift.png
    Why Search When You Can Transfer? Amortized Agentic Workflow Design from Structural Priors
    Shiyi Du, Jiayuan LiuWeihua DuYue Huang, Jiayi Li, Yingtao LuoXiangliang ZhangVincent Conitzer, and Carl Kingsford
    Preprint, 2026
  5. liu2026consensus.png
    The Consensus Trap: Rescuing Multi-Agent LLMs from Adversarial Majorities via Token-Level Collaboration
    Jiayuan Liu, Shiyi Du, Weihua DuMingyu Guo, and Vincent Conitzer
    Preprint, 2026

Proceedings

2026

  1. zhou2026mindsim2realgapuser.png
    Mind the Sim2Real Gap in User Simulation for Agentic Tasks
    Xuhui Zhou*Weiwei Sun*Qianou MaYiqing XieJiarui LiuWeihua Du, S. Welleck, Yiming YangGraham NeubigSherry Tongshuang Wu, and 1 more author
    COLM 2026, 2026
  2. yang2026gradalign.png
    GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
    Ningyuan Yang*, Weihua Du*Weiwei SunSean Welleck, and Yiming Yang
    COLM 2026, 2026

2025

  1. sun2025personalized.png
    Training Proactive and Personalized LLM Agents
    COLM 2026, 2025
  2. lu2025scaling.png
    Scaling LLM Multi-turn RL with End-to-end Summarization-based Context Management
    Miao LuWeiwei SunWeihua DuZhan Ling, Xuesong Yao, Kang Liu, and Jiecao Chen
    ACL 2026, 2025
  3. du2025codegym.png
    Generalizable End-to-End Tool-Use RL with Synthetic CodeGym
    Weihua Du, Hailei Gong, Zhan Ling, Kang Liu, Lingfeng Shen, Xuesong Yao, Yufei Xu, Dingyuan ShiYiming Yang, and Jiecao Chen
    ICLR 2026, 2025
  4. han2025zerotuning.png
    ZeroTuning: Unlocking the Initial Token’s Power to Enhance Large Language Models Without Training
    ICLR 2026, 2025
  5. du2025agentic.png
    Agentic-R1: Distilled Dual-Strategy Reasoning
    EMNLP 2025, 2025
  6. du2025optimizing.png
    Optimizing Temperature for Language Models with Multi-Sample Inference
    Weihua DuYiming Yang, and Sean Welleck
    ICML 2025, 2025

2024

  1. du2024constrained.png
    Constrained Human-AI Cooperation: An Inclusive Embodied Social Intelligence Challenge
    Weihua Du*Qiushi Lyu*Jiaming ShanZhenting QiHongxin ZhangSunli ChenAndi PengTianmin Shu, Kwonjoon Lee, Behzad Dariush, and 1 more author
    NeurIPS 2024 D&B Track, 2024
  2. chen2023eval.png
    T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
    Zehui Chen*Weihua Du*Wenwei Zhang*, Kuikun Liu, Jiangning Liu, Miao Zheng, Jingming ZhuoSongyang ZhangDahua LinKai Chen, and 1 more author
    ACL 2024, 2024
  3. zhou2023hazard.png
    HAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments
    Qinhong Zhou*Sunli Chen*, Yisong Wang, Haozhe Xu, Weihua DuHongxin ZhangYilun DuJoshua B Tenenbaum, and Chuang Gan
    ICLR 2024, 2024

2023

  1. zhang2023building.png
    Building Cooperative Embodied Agents Modularly with Large Language Models
    ICLR 2024, also NeurIPS 2023 FMDM, 2023
  2. neurips2023peerreview.png
    Iteratively Learn Diverse Strategies with State Distance Information
    Wei FuWeihua Du, Jingwei Li, Sunli ChenJingzhao Zhang, and Yi Wu
    NeurIPS 2023, 2023
  3. ijcai2023p407.png
    Automatic Truss Design with Reinforcement Learning
    Weihua Du*, Jinglun Zhao*, Chao YuXingcheng Yao, Zimeng Song, Siyang Wu, Ruifeng Luo, Zhiyuan Liu, Xianzhong Zhao, and Yi Wu
    IJCAI 2023, 2023