Sitemap
A list of public pages and collection entries on this site. An XML version is available at sitemap.xml.
Pages
Publications
Adaptive Boundaries: Context-Aware Detection for Synthetic Text
Accepted at The 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP 2026), 2026
Context-aware detection of machine-generated text with adaptive decision boundaries.
Unleashing Implicit Rewards: Prefix-Value Learning for Distribution-Level Optimization
Accepted at 43rd International Conference on Machine Learning (ICML 2026), 2026
Prefix-value learning for distribution-level optimization and fine-grained reward modeling.
Stabilizing Policy Optimization via Logits Convexity
Preprint, arXiv preprint arXiv:2603.00963, 2026
Stabilizing reinforcement learning for language models by exploiting the convexity of policy logits.
Discriminative Policy Optimization for Token-Level Reward Models
Accepted at 42nd International Conference on Machine Learning (ICML 2025), 2025
Token-level reward modeling without fine-grained annotations via discriminative policies.
Advantage-Guided Distillation for Preference Alignment in Small Language Models
Accepted at 13th International Conference on Learning Representations (ICLR 2025), 2025
Preference-alignment distillation for small language models using advantage-guided distribution-level signals.
Edit-Wise Preference Optimization for Grammatical Error Correction
Published in 31st International Conference on Computational Linguistics (COLING 2025), 2025
Edit-aware preference optimization for English and Chinese grammatical error correction.
Self-Evolution Fine-Tuning for Policy Optimization
Published in Findings of the Association for Computational Linguistics: EMNLP 2024, 2024
Self-evolution fine-tuning methods for policy optimization.
A Novel Dynamic Interpolation Method Based on Temporal and Spatial Correlations
Published in Applied Intelligence, 2022
Dynamic spatiotemporal interpolation for environmental and meteorological monitoring.
Teaching
Artificial Neural Networks and Mathematical Principles of Reinforcement Learning
Teaching Assistant, Sun Yat-Sen University, 2025
Teaching assistant at Sun Yat-Sen University, Apr 2025 - Present.
