Chenyan Xiong
- DATE-LM: Benchmarking Data Attribution Evaluation for Large Language Models
- Fairshare Data Pricing via Data Valuation for Large Language Models
- Group-Level Data Selection for Efficient Pretraining
- ORBIT - Open Recommendation Benchmark for Reproducible Research with Hidden Tests
- ParamMute: Suppressing Knowledge-Critical FFNs for Faithful Retrieval-Augmented Generation