Posts by Collection

portfolio

publications

Data Preparation for Large Language Models

Published in Journal of Computer Science and Technology (JCST), 2026

Recommended citation: H Liang, ZH Wong, R Liu, Y Wang, M Qiang, Z Zhao, C Shen, C He, et al. (2026). "Data Preparation for Large Language Models." Journal of Computer Science and Technology.

Let’s Verify Math Questions Step by Step

Published in KDD 2026, 2026

Recommended citation: C Shen*, ZH Wong*, R He*, H Liang*, M Qiang, Z Meng, Z Zhao, B Zeng, et al. (2026). "Let's Verify Math Questions Step by Step." KDD 2026. (Project Leader)

DataFlex-RL: An Evaluation Platform for RLVR Data Policies

Published in arXiv preprint arXiv:2609.06107 (Hugging Face Daily Papers #1), 2026

DataFlex-RL introduces an evaluation platform for comparing reinforcement learning with verifiable rewards (RLVR) data policies under a common GRPO recipe.

Recommended citation: Hao Liang, Mingrui Chen, Hengyi Feng, Meiyi Qiang, Wentao Zhang. (2026). "DataFlex-RL: An Evaluation Platform for RLVR Data Policies." arXiv preprint arXiv:2609.06107.
Download Paper

talks

teaching

Teaching experience 1

Undergraduate course, University 1, Department, 2014

This is a description of a teaching experience. You can use markdown like any other post.

Teaching experience 2

Workshop, University 1, Department, 2015

This is a description of a teaching experience. You can use markdown like any other post.