@article{memorybasedadvantageshapingforllmguidedr, title = {Memory-Based Advantage Shaping for LLM-Guided Reinforcement Learning}, author = {Narjes Nourzad and Carlee Joe-Wong}, year = {2026}, eprint = {2602.17931}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2602.17931}, }