Publications

A complete citation record is available on Google Scholar.

Under Review

Under Review 2026 Multi-agent Benchmark

CRAB-Bench: Evaluating LLM Agents under Complex Task Dependencies and Human-aligned User Simulation

Danqing Wang, Akshay Sivaraman, Lei Li

2026

CoLM 2026 Communication Multi-agent

Learning to Interrupt in Language-based Multi-agent Communication

Danqing Wang, Da Yin, Ruta Mehta, Lei Li, Asli Celikyilmaz, Ansong Ni

ICML 2026 Safety Code Agents Benchmark

Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li

ICLR 2026 Competition Multi-agent

Strategic Planning and Rationalizing on Trees Make LLMs Better Debaters

Danqing Wang*, Zhuorui Ye*, Xinran Zhao*, Fei Fang, Lei Li

2025

ICLR 2025 Reasoning Multi-agent

TypedThinker: Typed Thinking Improves Large Language Model Reasoning

Danqing Wang, Jianxin Ma, Fei Fang, Lei Li

NAACL 2025 Inference

Scaling LLM Inference with Optimized Sample Compute Allocation

Kexun Zhang*, Shang Zhou*, Danqing Wang, William Yang Wang, Lei Li

Nature Communications 2025 AI for Science DNA Benchmark

DNALongBench: A Benchmark Suite for Long-Range DNA Prediction Tasks

Wenduo Cheng, Zhenqiao Song, Yang Zhang, Shike Wang, Danqing Wang, Muyu Yang, Lei Li, Jian Ma

2024

EMNLP 2024 Evaluation Personalization

Learning Personalized Alignment for Evaluating Open-ended Text Generation

Danqing Wang, Kevin Yang, Hanlin Zhu, Xiaomeng Yang, Andrew Cohen, Lei Li, Yuandong Tian

KDD 2024 AI for Science Explainability

Global Human-guided Counterfactual Explanations for Molecular Properties via Reinforcement Learning

Danqing Wang*, Antonis Antoniades*, Kha-Dinh Luong, Edwin Zhang, Mert Kosan, Jiachen Li, William Yang Wang, Ambuj Singh, Lei Li

2023

EMNLP 2023 Collaboration Multi-agent

Learning from Mistakes via Cooperative Study Assistant for Large Language Models

Danqing Wang, Lei Li

EMNLP 2023 Evaluation

InstructScore: Towards Explainable Text Generation Evaluation with Automatic Feedback

Wenda Xu, Danqing Wang, Liangming Pan, Zhenqiao Song, Markus Freitag, William Yang Wang, Lei Li

NeurIPS 2023 Code Generation

ALGO: Synthesizing Algorithmic Programs with Generated Oracle Verifiers

Kexun Zhang, Danqing Wang, Jingtao Xia, William Yang Wang, Lei Li

KDD 2023 AI for Science Peptides

Accelerating Antimicrobial Peptide Discovery with Latent Structure

Danqing Wang, Zeyu Wen, Fei Ye, Lei Li, Hao Zhou

ICLR 2023 AI for Science Antibodies Benchmark

On Pre-training Language Model for Antibody

Danqing Wang, Fei Ye, Hao Zhou

2021

ACL Findings 2021 Summarization Multilingual Benchmark

Contrastive Aligned Joint Learning for Multilingual Summarization

Danqing Wang, Jiaze Chen, Hao Zhou, Xipeng Qiu, Lei Li

NLPCC 2021 Summarization Dataset Benchmark

CNewSum: A Large-scale Chinese News Summarization Dataset with Human-annotated Adequacy and Deducibility Level

Danqing Wang, Jiaze Chen, Xianze Wu, Hao Zhou, Lei Li

2020

ACL 2020 Summarization Graph Neural Networks

Heterogeneous Graph Neural Networks for Extractive Document Summarization

Danqing Wang*, Pengfei Liu*, Yining Zheng, Xipeng Qiu, Xuanjing Huang

ACL 2020 Summarization Text Matching

Extractive Summarization as Text Matching

Ming Zhong*, Pengfei Liu*, Yiran Chen, Danqing Wang, Xipeng Qiu, Xuanjing Huang

2019

ACL 2019 Summarization Model Analysis

Searching for Effective Neural Extractive Summarization: What Works and What's Next

Ming Zhong*, Pengfei Liu*, Danqing Wang*, Xipeng Qiu, Xuanjing Huang

arXiv 2019 Summarization Domain Shift

Exploring Domain Shift in Extractive Text Summarization

Danqing Wang*, Pengfei Liu*, Ming Zhong, Jie Fu, Xipeng Qiu, Xuanjing Huang

Preprints

arXiv 2025 RAG Robustness Benchmark

RARE: Retrieval-Aware Robustness Evaluation for Retrieval-Augmented Generation Systems

Yixiao Zeng, Tianyu Cao, Danqing Wang, Xinran Zhao, Zimeng Qiu, Morteza Ziyadi, Tongshuang Wu, Lei Li

arXiv 2024 Multi-agent Planning

Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models

Danqing Wang, Zhuorui Ye, Fei Fang, Lei Li

* Equal contribution.