Publications by Conference
AAAI
Top ⇈ACL
- » Extractive Summarization as Text Matching (ACL 2020)
- » Heterogeneous Graph Neural Networks for Extractive Document Summarization (ACL 2020)
- » Searching for Effective Neural Extractive Summarization: What Works and What's Next (ACL 2019)
ACL Findings
- » Contrastive Aligned Joint Learning for Multilingual Summarization (ACL Findings 2021)
CoLM
Top ⇈EMNLP
- » Learning Personalized Alignment for Evaluating Open-ended Text Generation (EMNLP 2024)
- » InstructScore: Towards Explainable Text Generation Evaluation with Automatic Feedback (EMNLP 2023)
- » Learning from Mistakes via Cooperative Study Assistant for Large Language Models (EMNLP 2023)
EMNLP Findings
- » CDEvalSumm: An Empirical Study of Cross-dataset Evaluation for Neural Summarization Systems (EMNLP Findings 2020)
ICLR
- » Strategic Planning and Rationalizing on Trees Make LLMs Better Debaters (ICLR 2026)
- » TypedThinker: Typed Thinking Improves Large Language Model Reasoning (ICLR 2025)
- » On Pre-training Language Model for Antibody (ICLR 2023)
ICML
- » Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks (ICML 2026)
KDD
- » Global Human-guided Counterfactual Explanations for Molecular Properties via Reinforcement Learning (KDD 2024)
- » Accelerating Antimicrobial Peptide Discovery with Latent Structure (KDD 2023)
NAACL
Top ⇈NAACL Findings
- » MTG: A Benchmark Suite for Multilingual Text Generation (NAACL Findings 2022)
NLPCC
- » CNewSum: A Large-scale Chinese News Summarization Dataset with Human-annotated Adequacy and Deducibility Level (NLPCC 2021)
Nature Communications
- » DNALongBench: A Benchmark Suite for Long-Range DNA Prediction Tasks (Nature Communications 2025)
NeurIPS
Top ⇈Preprint
- » RARE: Retrieval-Aware Robustness Evaluation for Retrieval-Augmented Generation Systems (arXiv 2025)
- » Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models (arXiv 2024)
- » Exploring Domain Shift in Extractive Text Summarization (arXiv 2019)
Under Review
- » CRAB-Bench: Evaluating LLM Agents under Complex Task Dependencies and Human-aligned User Simulation