Zhenghao Liu (刘正皓), Associate Professor of Northeastern University, is a visiting researcher at Tsinghua University’s Natural Language Processing Laboratory (THUNLP). I obtained my Bachelor’s degree in Engineering from Northeastern University in 2016 and was directly admitted to Tsinghua University’s State Key Laboratory of Intelligent Technology and Systems as a Ph.D. student, under the supervision of Professor Sun Maosong. My main research interests include natural language processing and information retrieval, and I earned my Ph.D. degree from Tsinghua University in 2021 (thesis).

I work with Ge Yu (于戈) and Yu Gu (谷峪). I also collaborate with Zhiyuan Liu (刘知远), Chenyan Xiong (熊辰炎), Shuo Wang (王硕), Yukun Yan (闫宇坤), Shi Yu (于是), Liner Yang (杨麟儿), and Zulong Chen (陈祖龙) from Tsinghua University, Carnegie Mellon University, Beijing Language and Culture University, and Alibaba closely. I have published more than 30 papers at the top international AI conferences with total .

🔥 News

  • 2026.7:   Our group and ModelBest jointly established the Data Intelligence Joint Laboratory to advance collaborative research and innovation in artificial intelligence and data intelligence technologies!
  • 2025.10:   Our paper has been awarded the Best Paper Award at the 2025 International Conference on Advanced Data Mining and Applications (ADMA 2025)! 🏆
  • 2025.06:   Our work (ParamMute) received the Highlight Poster Award 🏆 at YSSNLP 2025! Congratulations! 🎉
  • 2025.01:  🎉🎉 UltraRAG 2.0 (MCP version) has been officially released—a modular RAG framework built on the Model Context Protocol with native pipeline control!
  • 2024.09:  🎉🎉 We are excited to announce the release of the MiniCPM-RAG LoRA Toolkit, which has already garnered over 320,000 downloads!

📖 Educations

  • Aug, 2021 - Now, Dept. of Computer Science and Technology (NEUIR Lab), Northeastern University, Shenyang, China.
  • Aug, 2016 - Jun, 2021, Dept. of Computer Science and Technology (THUNLP Lab), Tsinghua University, Beijing, China. Supervisor: Maosong Sun (孙茂松).
  • Sep, 2012 - Jul, 2016, Dept. of Computer Science and Technology, Northeastern University, Shenyang, China.

💬 Invited Talks

  • 2024.08, “Introduction to Large Language Models”. THUNLP-OpenBMB Summer Course [link].
  • 2023.08, “Semantic Matching based Retrieval for Multimodal Documents”. The 17th China Conference on Knowledge Graph and Semantic Computing (CCKS 2023) [slides].
  • 2021.04, “From Exact Matching to Semantic Matching: Using neural models for ranking”. Hong Kong University of Science and Technology (HKUST) [slides].

🧑‍🎨 Academic Services

  • Session Chair of ACL 2024, MLNLP 2022-2024.
  • Web Chair of CCL 2024.
  • Publication Chair of ACL 2025, CCL 2025.
  • Poster Chair of WISA 2024.
  • Area Chair of NeurIPS, ICML, ACL ARR, ICLR, COLING, ICTIR.
  • Conference Review: WebConf, ECAI, AAAI, EACL, COLM.
  • Journal Review: TPAMI, TKDE, FCS, IEEE Transactions on Big Data, AI Open, TOIS, Science China.

📝 Publications

    * indicates equal contribution.
    # indicates corresponding author.

2026

  • Zhenghao Liu, Pengcheng Huang, Zhipeng Xu, Xinze Li, Shuliang Liu, Chunyi Peng, Haidong Xin, Yukun Yan#, Shuo Wang, Xu Han, Zhiyuan Liu#, Maosong Sun, Yu Gu, Ge Yu. Knowledge intensive agents. AI Open. [pdf].

  • Haidong Xin, Zhenghao Liu#, Sen Mei, Yukun Yan, Shi Yu, Shuo Wang, Yu Chen, Zulong, Gu, Ge Yu, Chenyan Xiong. LISRec: Modeling User Preferences with Learned Item Shortcuts for Sequential Recommendation. KDD 2026. [pdf][codes].

  • Chunyi Peng*, Zhipeng Xu*, Zhenghao Liu#, Yishan Li, Yukun Yan, Shuo Wang, Yu Gu, Minghe Yu, Ge Yu, Maosong Sun. Mixture-of-Retrieval Experts for Reasoning-Guided Multimodal Knowledge Exploitation. SIGIR 2026. [pdf][codes].

  • Hao Yang*, Yifan Ji*, Zhipeng Xu*, Zhenghao Liu#, Yukun Yan, Zulong Chen, Shuo Wang, Yu Gu, Ge Yu. ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment. SIGIR 2026. [pdf][codes].

  • Zhenghao Liu#*, Zhuoyang Wu*, Xinze Li, Yukun Yan, Shuo Wang, Zulong Chen, Yu Gu, Ge Yu, Maosong Sun. LexRel: Benchmarking Legal Relation Extraction for Chinese Civil Cases. ACL 2026. [pdf][codes].

  • Pengcheng Huang, Tianming Liu, Zhenghao Liu#, Yukun Yan, Shuo Wang, Tong Xiao, Zulong Chen, Maosong Sun. Empirical Analysis of Decoding Biases in Masked Diffusion Models. ACL 2026. [pdf][codes].

  • Yifan Ji*, Zhipeng Xu*, Zhenghao Liu#, Zulong Chen, Qian Zhang, Zhibo Yang, Junyang Lin, Yu Gu, Ge Yu, Maosong Sun. UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents. ACL 2026. [pdf][codes].

  • Shaohua Duan*, Pengcheng Huang*, Xinze Li, Zhenghao Liu#, Xiaoyuan Yi, Yukun Yan, Shuo Wang, Yu Gu, Ge Yu, Maosong Sun. Chunks as Arms: Multi-Armed Bandit-Guided Sampling for Long-Context LLM Preference Optimization. ACL 2026. [pdf][codes].

  • Dingling Xu*, Ruobing Wang*, Qingfei Zhao, Yukun Yan#, Zhichun Wang#, Daren Zha, Shi Yu, Zhenghao Liu, Shuo Wang, Xu Han, Maosong Sun. TCheckRLM: Effective Knowledge–Thought Coherence Checking in Retrieval-Augmented Reasoning. ACL 2026. [pdf][codes].

  • Fan Li, Yu Gu#, Zhigang Wang, Fangling Leng, Zhenghao Liu, Ge Yu. Towards Efficient and Effective Diffusion Language Model Inference via Semantic-Aware Adaptive Denoising. ACL 2026. [pdf].

  • Yida Cai, Ranjuexiao Hu, Huiyuan Xie#, Chenyang Li, Yun Liu, Yuxiao Ye, Zhenghao Liu, Weixing Shen, Zhiyuan Liu#. LexRel: Benchmarking Legal Relation Extraction for Chinese Civil Cases. ACL 2026. [pdf][codes].

  • Haidong Xin, Xinze Li, Zhenghao Liu#, Yukun Yan#, Shuo Wang, Cheng Yang, Yu Gu, Ge Yu, Maosong Sun. MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization. ACL 2026: Findings. [pdf][codes].

  • Xin Dai, Pengcheng Huang, Zhenghao Liu#, Shuo Wang#, Yukun Yan, Chaojun Xiao, Yu Gu, Ge Yu, Maosong Sun. Revealing the Attention Floating Mechanism in Masked Diffusion Models. ACL 2026: Findings. [pdf][codes].

  • Yuqi Xiong, Chunyi Peng, Zhipeng Xu, Zhenghao Liu#, Zulong Chen, Yukun Yan, Shuo Wang, Yu Gu, Ge Yu. Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains. ACL 2026: Findings. [pdf][codes].

  • Shuliang Liu, Zhipeng Xu, Zhenghao Liu#, Yukun Yan, Minghe Yu, Yu Gu, Chong Chen, Huiyuan Xie, Ge Yu. Mitigating Judgment Preference Bias in Large Language Models through Group-Based Polling. ACL 2026: Findings. [pdf][codes].

  • Zhuoyang Wu, Xinze Li, Zhenghao Liu#, Yukun Yan, Zhiyuan Liu, Minghe Yu, Cheng Yang, Yu Gu, Ge Yu, Maosong Sun. Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection. ACL 2026: Findings. [pdf][codes].

  • He Wang, Yu Gu, Fangfang Li#, Zhigang Wang, Zhenghao Liu, Ning Wang, Xiaohua Li, Ge Yu. HqeKV: Towards Hybrid Quantization and Eviction for KV Cache in Long-Context LLM Inference. ACL 2026: Findings. [pdf][codes].

  • Hao Chen, Ye He, Yuchun Fan, Yukun Yan#, Zhenghao Liu, Qingfu Zhu, Maosong Sun, Wanxiang Che#. Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models. ICML 2026. [pdf][codes].

  • Heng Rao, Jason Zipeng Zhang, Yu Gu#, Zhenghao Liu, Ge Yu, Jeffrey Su, Yang Cao, Fan Yang, Minghan Chen#. A Regime-Aware Trajectory Prediction Framework for 1000+ Systems Biology Models. ICML 2026. [pdf][codes].

  • Huiyuan Xie*, Chenyang Li*, Huining Zhu, Chubin Zhang, Yuxiao Ye#, Zhenghao Liu, Zhiyuan Liu#. LexChain: Modeling Legal Reasoning Chains for Chinese Tort Case Analysis. AAAI 2026. [pdf][codes].

  • Boyu Chen, Zirui Guo, Zidan Yang, Yuluo Chen, Junze Chen, Zhenghao Liu, Chuan Shi, Cheng Yang#. PathRAG: Pruning Graph-based Retrieval Augmented Generation with Relational Paths. AAAI 2026. [pdf][codes].

  • Haolan Wang, Zhenghao Liu, Xinze Li, Xiaocui Yang, Yu Gu, Yukun Yan, Qi Shi, Fangfang Li#, Chong Chen, Ge Yu. PathRAG: Pruning Graph-based Retrieval Augmented Generation with Relational Paths. AAAI 2026. [pdf][codes].

  • Xin Dai*, Buqiang Xu*, Zhenghao Liu#, Yukun Yan, Huiyuan Xie, Xiaoyuan Yi. Legal∆: Enhancing Legal Reasoning in LLMS via Reinforcement Learning with Chain-Of-Thought Guided Information Gain. ICASSP 2026. [pdf][codes].

  • Yuqing Lan, Zhenghao Liu#, Yu Gu#, Ge Yu. EDITMEM: Enhancing Multi-Hop Fact Verification Via Editable Memory. ICASSP 2026. [pdf][codes].

  • Qing Yang, Zhenghao Liu#, Junxin Wang, Yangfan Du, Pengcheng Huang, Tong Xiao#. RLAIF-SPA: Optimizing LLM-based Emotional Speech Synthesis via RLAIF. IJCNN 2026. [pdf][codes].

  • Zhipeng Xu, Zhenghao Liu#, Yukun Yan, Shuo Wang, Shi Yu, Zheni Zeng, Chaojun Xiao, Zhiyuan Liu, Ge Yu, Chenyan Xiong. ThinkNote: Enhancing Knowledge Integration and Utilization of Large Language Models via Constructivist Cognition Modeling. EACL 2026: Findings. [pdf][codes].

2025

  • Mingyan Wu, Zhenghao Liu#, Yukun Yan#, Xinze Li, Shi Yu, Zheni Zeng, Yu Gu, Ge Yu. RankCoT: Refining Knowledge for Retrieval-Augmented Generation through Ranking Chain-of-Thoughts. ACL 2025. [pdf][codes].

  • Shuliang Liu, Xinze Li, Zhenghao Liu#, Yukun Yan, Cheng Yang, Zheni Zeng, Zhiyuan Liu, Maosong Sun, Ge Yu. Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models. ACL 2025: Findings. [pdf][codes].

  • Kunlun Zhu, Yifan Luo, Dingling Xu, Yukun Yan, Zhenghao Liu, Shi Yu, Ruobing Wang, Shuo Wang, Yishan Li, Nan Zhang, Xu Han, Zhiyuan Liu, Maosong Sun. RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework. ACL 2025. [pdf][codes].

  • Qiushi Xiong, Zhipeng Xu, Zhenghao Liu#, Mengjia Wang, Zulong Chen, Yue Sun, Yu Gu, Xiaohua Li, Ge Yu. Enhancing the Patent Matching Capability of Large Language Models via the Memory Graph. SIGIR 2025. [pdf][codes].

  • Pengcheng Huang, Zhenghao Liu#, Yukun Yan, Haiyan Zhao, Xiaoyuan Yi, Hao Chen, Zhiyuan Liu, Maosong Sun, Tong Xiao, Ge Yu, Chenyan Xiong. ParamMute: Suppressing Knowledge-Critical FFNs for Faithful Retrieval-Augmented Generation. NeurIPS 2025. [pdf][codes].

  • Xiaoang Xu, Shuo Wang, Xu Han, Zhenghao Liu, Huijia Wu, Peipei Li, Zhiyuan Liu, Maosong Sun, Zhaofeng He. A*-Thought: Efficient Reasoning via Bidirectional Compression for Low-Resource Settings. NeurIPS 2025. [pdf][codes].

  • Xinze Li*, Sen Mei*, Zhenghao Liu#, Yukun Yan#, Shuo Wang, Shi Yu, Zheni Zeng, Hao Chen, Ge Yu, Zhiyuan Liu, Maosong Sun, Chenyan Xiong. RAG-DDR: Optimizing Retrieval-Augmented Generation Using Differentiable Data Rewards. ICLR 2025. [pdf][codes].

  • Shi Yu, Chaoyue Tang, Bokai Xu, Junbo Cui, Junhao Ran, Yukun Yan, Zhenghao Liu, Shuo Wang, Xu Han, Zhiyuan Liu, Maosong Sun. VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents. ICLR 2025. [pdf][codes].

  • Lifan Yuan, Ganqu Cui, Hanbin Wang, Ning Ding, Xingyao Wang, Jia Deng, Boji Shan, Huimin Chen, Ruobing Xie, Yankai Lin, Zhenghao Liu, Bowen Zhou, Hao Peng, Zhiyuan Liu, Maosong Sun. Advancing llm reasoning generalists with preference trees. ICLR 2025. [pdf][codes].

  • Zhenghao Liu, Xingsheng Zhu, Tianshuo Zhou, Xinyi Zhang, Xiaoyuan Yi, Yukun Yan, Ge Yu, Maosong Sun. Benchmarking Retrieval-Augmented Generation in Multi-Modal Contexts. MM 2025. [pdf][codes].

  • Sijia Yao*, Pengcheng Huang*, Zhenghao Liu#, Yu Gu, Yukun Yan, Shi Yu, Ge Yu. ExpandR: Teaching Dense Retrievers Beyond Queries with LLM Guidance. EMNLP 2025. [pdf][codes].

  • Hao Chen*, Yukun Yan*, Sen Mei, Wanxiang Che#, Zhenghao Liu#, Qi Shi, Xinze Li, Yuchun Fan, Pengcheng Huang, Qiushi Xiong, Zhiyuan Liu, Maosong Sun. ClueAnchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation. EMNLP 2025: Findings. [pdf][codes].

  • Zhensheng Jin*, Xinze Li*, Yifan Ji, Chunyi Peng, Zhenghao Liu#, Qi Shi, Yukun Yan, Shuo Wang, Furong Peng, Ge Yu. ReCUT: Balancing Reasoning Length and Accuracy in LLMs via Stepwise Trails and Preference Optimization. EMNLP 2025: Findings. [pdf][codes].

  • Zheni Zeng, Jiayi Chen, Huimin Chen, Yukun Yan, Yuxuan Chen, Zhenghao Liu, Zhiyuan Liu, Maosong Sun. PersLLM: A Personified Training Approach for Large Language Models. EMNLP 2025: Findings. [pdf][codes].

  • Ruobing Wang, Qingfei Zhao, Yukun Yan, Daren Zha, Yuxuan Chen, Shi Yu, Zhenghao Liu, Yixuan Wang, Shuo Wang, Xu Han, Zhiyuan Liu, Maosong Sun. DeepNote: Note-Centric Deep Retrieval-Augmented Generation. EMNLP 2025: Findings. [pdf][codes].

  • Zheni Zeng*, Yuxuan Chen*, Shi Yu, Ruobing Wang, Yukun Yan, Zhenghao Liu, Shuo Wang, Xu Han, Zhiyuan Liu, Maosong Sun. KBAlign: Efficient Self Adaptation on Specific Textual Knowledge Bases. EMNLP 2025: Findings. [pdf][codes].

  • Weiqing Yang, Hanbin Wang, Zhenghao Liu#, Xinze Li, Yukun Yan, Shuo Wang, Yu Gu, Minghe Yu, Zhiyuan Liu, Ge Yu. COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis. NAACL 2025: Findings. [pdf][codes].

  • Mingxing Shao, Tiancheng Zhang, Minghe Yu, Zhenghao Liu, Yifang Yin, Hengyu Liu, Ge Yu. Leveraging Student Profiles and the Mamba Framework to Enhance Knowledge Tracing. ECML-PKDD 2025. [pdf][codes].

  • Yifan Ji*, Zhipeng Xu*, Zhenghao Liu#, Yukun Yan, Shi Yu, Yishan Li, Zhiyuan Liu, Yu Gu, Ge Yu, Maosong Sun. Learning Refined Document Representations for Dense Retrieval via Deliberate Thinking. SIGIR-AP 2025. [pdf][codes].

  • Buqiang Xu*, Xin Dai*, Zhenghao Liu#, Huiyuan Xie, Xiaoyuan Yi, Shuo Wang, Yukun Yan, Liner Yang, Yu Gu, Ge Yu. Learning Refined Document Representations for Dense Retrieval via Deliberate Thinking. ADMA 2025. [pdf][codes].

2024

  • Zhipeng Xu, Zhenghao Liu#, Yukun Yan, Zhiyuan Liu, Ge Yu, Chenyan Xiong. Cleaner Pretraining Corpus Curation with Neural Web Scraping. ACL 2024. [pdf][codes].

  • Tianshuo Zhou, Sen Mei, Xinze Li, Zhenghao Liu#, Chenyan Xiong, Zhiyuan Liu, Yu Gu, Ge Yu. MARVEL: Unlocking the Multi-Modal Capability of Dense Retrieval via Visual Module Plugin. ACL 2024. [pdf][codes].

  • Hanbin Wang, Zhenghao Liu#, Shuo Wang, Ganqu Cui, Ning Ding, Zhiyuan Liu, Ge Yu. INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair. ACL 2024: Findings. [pdf][codes].

  • Haoyu Wang, Shuo Wang, Yukun Yan, Xujia Wang, Zhiyu Yang, Yuzhuang Xu, Zhenghao Liu, Liner Yang, Ning Ding, Xu Han, Zhiyuan Liu, Maosong Sun. UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset. ACL 2024. [pdf][codes].

  • Zhiyu Yang, Zihan Zhou, Shuo Wang, Xin Cong, Xu Han, Yukun Yan, Zhenghao Liu, Zhixing Tan, Pengyuan Liu, Dong Yu, Zhiyuan Liu, Xiaodong Shi, Maosong Sun. MatPlotAgent: Method and Evaluation for LLM-Based Agentic Scientific Data Visualization. ACL 2024: Findings. [pdf][codes].

  • Zhenghao Liu, Zulong Chen*, Moufeng Zhang*, Shaoyang Duan, Hong Wen, Liangyue Li, Nan Li, Yu Gu, Ge Yu. Modeling User Viewing Flow Using Large Language Models for Article Recommendation. WebConf 2024. [pdf].

  • Na Guo, Yaqi Wang, Wenli Sun, Yu Gu, Jianzhong Qi, Zhenghao Liu, Xiufeng Xia, Ge Yu. Chameleon: Towards Update-Efficient Learned Indexing for Locally Skewed Data. ICDE 2024. [pdf].

  • Cheng Gao, Chaojun Xiao, Zhenghao Liu, Huimin Chen, Zhiyuan Liu, Maosong Sun. Enhancing Legal Case Retrieval via Scaling High-quality Synthetic Query-Candidate Pairs. EMNLP 2024. [pdf][codes].

  • Shi Yu, Chenghao Fan, Chenyan Xiong, David Jin, Zhiyuan Liu, Zhenghao Liu#. Fusion-in-T5: Unifying Variant Signals for Simple and Effective Document Ranking with Attention Fusion. COLING 2024. [pdf][codes].

  • Ruining Chong, Luming Lu, Liner Yang, Jinran Nie, Zhenghao Liu, Shuo Wang, Shuhan Zhou, Yaoxin Li, Erhong Yang. MCTS: A Multi-Reference Chinese Text Simplification Dataset. COLING 2024. [pdf][codes].

  • Cheng Qian, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu. Toolink: Linking toolkit creation and using through chain-of-solving on open-source model. NAACL 2024. [pdf][codes].

  • Xinze Li, Hanbin Wang, Zhenghao Liu#, Shi Yu, Shuo Wang, Yukun Yan, Yukai Fu, Yu Gu, Ge Yu. Building A Coding Assistant via the Retrieval-Augmented Language Model. ACM Transactions on Information Systems (TOIS). [pdf][code].

  • Yumeng Song, Yu Gu, Tianyi Li, Jianzhong Qi, Zhenghao Liu, Christian S Jensen, Ge Yu. CHGNN: A Semi-Supervised Contrastive Hypergraph Learning Network. IEEE Transactions on Knowledge and Data Engineering (TKDE). [pdf][code].

  • Yuqing Lan, Zhenghao Liu#, Yu Gu#, Xiaoyuan Yi, Xiaohua Li, Liner Yang, Ge Yu. Multi-Evidence based Fact Verification via A Confidential Graph Neural Network. IEEE Transactions on Big Data (TBD). [pdf][code].

2023

  • Zhenghao Liu, Chenyan Xiong, Yuanhuiyi Lv, Zhiyuan Liu, Ge Yu. Universal Multi-Modal Retrieval: Learning A Unified Representation Space for Vision Language Retrieval. ICLR 2023. [pdf][codes].

  • Zhenghao Liu*#, Sen Mei*, Chenyan Xiong, Xiaohua Li, Shi Yu, Zhiyuan Liu, Yu Gu, Ge Yu. Text Matching Improves Sequential Recommendation by Reducing Popularity Biases. CIKM 2023. [pdf][codes].

  • Shi Yu, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu. OpenMatch-v2: An All-in-one Multi-Modality PLM-based Information Retrieval Toolkit. SIGIR 2023. [pdf][codes].

  • Xinze Li, Zhenghao Liu#, Chenyan Xiong, Shi Yu, Yu Gu, Zhiyuan Liu, Ge Yu. Structure-Aware Language Model Pretraining Improves Dense Retrieval on Structured Data. ACL 2023: Findings. [pdf][codes].

  • Ruining Chong, Cunliang Kong, Liu Wu, Zhenghao Liu, Ziye Jin, Liner Yang, Yange Fan, Hanghang Fan, Erhong Yang. Leveraging Prefix Transfer for Multi-Intent Text Revision. ACL 2023. [pdf].

2022

  • Zhenghao Liu, Han Zhang, Chenyan Xiong, Zhiyuan Liu, Yu Gu, Xiaohua Li. Dimension Reduction for Efficient Dense Retrieval via Conditional Autoencoder. EMNLP 2022. [pdf][codes].

  • Xiaomeng Hu, Shi Yu, Chenyan Xiong, Zhenghao Liu#, Zhiyuan Liu, Ge Yu. P3 Ranker: Mitigating the Gaps between Pre-training and Ranking Fine-tuning with Prompt-based Learning and Pre-finetuning. SIGIR 2022. [pdf][codes].

2021

  • Zhenghao Liu, Xiaoyuan Yi, Maosong Sun, Liner Yang, Tat-Seng Chua. Neural Quality Estimation with Multiple Hypotheses for Grammatical Error Correction. NAACL 2021. [pdf][codes].

  • Zhenghao Liu*, Kaitao Zhang*, Chenyan Xiong, Zhiyuan Liu, Maosong Sun. OpenMatch: An Open Source Library for Neu-IR Research. SIGIR 2021. [pdf][codes].

  • Shi Yu*, Zhenghao Liu*, Chenyan Xiong, Tao Feng, Zhiyuan Liu. Few-Shot Conversational Dense Retrieval. SIGIR 2021. [pdf][codes].

  • Yizhi Li*, Zhenghao Liu*, Chenyan Xiong, Zhiyuan Liu. More Robust Dense Retrieval with Contrastive Dual Learning. The 2021 ACM SIGIR International Conference on the Theory of Information Retrieval (ICTIR 2021). [pdf][codes].

  • Si Sun*, Zhenghao Liu*, Chenyan Xiong, Zhiyuan Liu and Jie Bao. Capturing Global Informativeness in Open Domain Keyphrase Extraction. The CCF Conference on Natural Language Processing and Chinese Computing (NLPCC 2021). [pdf][codes].

  • Si Sun, Yingzhuo Qian, Zhenghao Liu, Chenyan Xiong, Kaitao Zhang, Jie Bao, Zhiyuan Liu, Paul Bennett. Few-Shot Text Ranking with Meta Adapted Synthetic Weak Supervision. ACL 2021. [pdf][codes].

  • Huiyuan Xie, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu and Ann Copestake . TIAGE: A Benchmark for Topic-Shift Aware Dialog Modeling. EMNLP 2021: Findings. [pdf][codes]

2020

  • Zhenghao Liu, Chenyan Xiong, Maosong Sun, Zhiyuan Liu. Fine-grained Fact Verification with Kernel Graph Attention Network. ACL 2020. [pdf][codes].

  • Zhenghao Liu, Chenyan Xiong, Zhuyun Dai, Si Sun, Maosong Sun, Zhiyuan Liu. Adapting Open Domain Fact Extraction and Verification to COVID-FACT through In-Domain Language Modeling. EMNLP 2020: Findings. [pdf][codes].

  • Houyu Zhang*, Zhenghao Liu*, Chenyan Xiong, Zhiyuan Liu. Grounded Conversation Generation as Guided Traverses in Commonsense Knowledge Graphs. ACL 2020. [pdf][codes].

  • Chenyan Xiong*, Zhenghao Liu*, Si Sun*, Zhuyun Dai*, Kaitao Zhang*, Shi Yu*, Zhiyuan Liu, Hoifung Poon, Jianfeng Gao, Paul Bennett. CMT in TREC-COVID Round 2: Mitigating the Generalization Gaps from Web to Special Domain Search. [pdf][codes].

  • Xiaoyuan Yi, Zhenghao Liu, Wenhao Li, Maosong Sun. 2020. Text Style Transfer via Learning Style Instance Supported Latent Space. IJCAI 2019. [pdf].

  • Kaitao Zhang, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu. Selective Weak Supervision for Neural Information Retrieval. WebConf 2020. [pdf][codes].

  • Deming Ye, Yankai Lin, Jiaju Du, Zhenghao Liu, Peng Li, Maosong Sun, Zhiyuan Liu. Coreferential Reasoning Learning for Language Representation. EMNLP 2020. [pdf][codes].

2019

  • Zhenghao Liu, Chenyan Xiong, Maosong Sun, Zhiyuan Liu. Explore Entity Embedding Effectiveness in Entity Retrieval. Proceedings of Chinese National Conference on Computational Linguistics (CCL 2019).[pdf][codes].

  • Yifan Qiao, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu. Understanding the Behaviors of BERT in Ranking. [pdf].

  • Yuan Yao, Deming Ye, Peng Li, Xu Han, Yankai Lin, Zhenghao Liu, Zhiyuan Liu, Lixin Huang, Jie Zhou, Maosong Sun. DocRED: A Large-Scale Document-Level Relation Extraction Dataset. ACL 2019.[pdf][codes].

2018

  • Zhenghao Liu, Chenyan Xiong, Maosong Sun, Zhiyuan Liu. Entity-Duet Neural Ranking: Understanding the Role of Knowledge Graph Semantics in Neural Information Retrieval. ACL 2018.[pdf][codes].

2017

  • Liner Yang, Maosong Sun, Jiacheng Zhang, Zhenghao Liu, Huanbo Luan, Yang Liu. Neural Parse Combination. Journal of Computer Science and Technology (JCST).[pdf].