Publications
You can also find my articles on my Google Scholar profile.
Publications in NLP, LLM alignment, reward modeling, reasoning, and applied machine learning. Conference Papers
Adaptive Boundaries: Context-Aware Detection for Synthetic Text
The 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP 2026), 2026
Unleashing Implicit Rewards: Prefix-Value Learning for Distribution-Level Optimization
43rd International Conference on Machine Learning (ICML 2026), 2026
Discriminative Policy Optimization for Token-Level Reward Models
42nd International Conference on Machine Learning (ICML 2025), 2025
Advantage-Guided Distillation for Preference Alignment in Small Language Models
13th International Conference on Learning Representations (ICLR 2025), 2025 Spotlight, top 5.1%
Edit-Wise Preference Optimization for Grammatical Error Correction
31st International Conference on Computational Linguistics (COLING 2025), 2025
Self-Evolution Fine-Tuning for Policy Optimization
Findings of the Association for Computational Linguistics: EMNLP 2024, 2024
Preprints
Stabilizing Policy Optimization via Logits Convexity
arXiv preprint arXiv:2603.00963, 2026 Under review at NeurIPS 2026
Journal Articles
A Novel Dynamic Interpolation Method Based on Temporal and Spatial Correlations
Applied Intelligence, 2022
