@article{cello1trainingllmstosolvesinglecell, title = {Cell-o1: Training LLMs to Solve Single-Cell Reasoning Puzzles with Reinforcement Learning}, author = {Yin Fang and Qiao Jin and Guangzhi Xiong and Bowen Jin and Xianrui Zhong and Siru Ouyang and Aidong Zhang and Jiawei Han and Zhiyong Lu}, year = {2025}, eprint = {2506.02911}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2506.02911v1}, }