Publications

You can also find my articles on my Google Scholar profile.
Publications in NLP, LLM alignment, reward modeling, reasoning, and applied machine learning.

Conference Papers


Adaptive Boundaries: Context-Aware Detection for Synthetic Text
H. Li, R. Ni, Haihui Yang, Shiping Gao, Y. Liu, Xiaojun Quan
The 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP 2026), 2026
Unleashing Implicit Rewards: Prefix-Value Learning for Distribution-Level Optimization
Shiping Gao, Hongzhan Chen, Xiaojun Quan, Qifan Wang, Lifu Huang
43rd International Conference on Machine Learning (ICML 2026), 2026
Discriminative Policy Optimization for Token-Level Reward Models
Hongzhan Chen, Tao Yang, Shiping Gao, Ruijun Chen, Xiaojun Quan, Hongtao Tian, Ting Yao
42nd International Conference on Machine Learning (ICML 2025), 2025
Advantage-Guided Distillation for Preference Alignment in Small Language Models
Shiping Gao, Fanqi Wan, Jiajian Guo, Xiaojun Quan, Qifan Wang
13th International Conference on Learning Representations (ICLR 2025), 2025 Spotlight, top 5.1%
Edit-Wise Preference Optimization for Grammatical Error Correction
Jiehao Liang, Haihui Yang, Shiping Gao, Xiaojun Quan
31st International Conference on Computational Linguistics (COLING 2025), 2025
Self-Evolution Fine-Tuning for Policy Optimization
Ruijun Chen, Jiehao Liang, Shiping Gao, Fanqi Wan, Xiaojun Quan
Findings of the Association for Computational Linguistics: EMNLP 2024, 2024

Preprints


Stabilizing Policy Optimization via Logits Convexity
Hongzhan Chen, Tao Yang, Yuhua Zhu, Shiping Gao, Xiaojun Quan, Ting Yao
arXiv preprint arXiv:2603.00963, 2026 Under review at NeurIPS 2026

Journal Articles


A Novel Dynamic Interpolation Method Based on Temporal and Spatial Correlations
Shiping Gao, Dongjie He, Zhouzhuo Zhang, Xiaoqian Tang, Zhili Zhao
Applied Intelligence, 2022