@article{baziqabenchmarkevaluatingsymbolicandtemp, title = {BaziQA-Benchmark: Evaluating Symbolic and Temporally Compositional Reasoning in Large Language Models}, author = {Jiangxi Chen and Qian Liu}, year = {2026}, eprint = {2602.12889}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2602.12889}, }