Publications
Currently, my research focuses on LLM, Reasoning, Agent, RL and Efficiency.
2026
COLM'26 Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling
Paper / Code / HuggingFace / Project
arXiv MathGen: Revealing the Illusion of Mathematical Competence through Text-to-Image Generation
arXiv CM2: Reinforcement Learning with Checklist Rewards for Multi-Turn and Multi-Step Agentic Tool Use
Paper / Code / HuggingFace
arXiv MMFormalizer: Multimodal Autoformalization in the Wild
Paper / HuggingFace / Project
2025
arXiv Presenting a Paper is an Art: Self-Improvement Aesthetic Agents for Academic Presentations
Paper / Code / HuggingFace / Project
EMNLP'25 MAZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
2024
2023
2022
NeurIPS'22 Sparse Structure Search for Parameter-Efficient Tuning