@article{visualscratchpadinferencetimevisualconce, title = {VisualScratchpad: Inference-time Visual Concepts Analysis in Vision Language Models}, author = {Hyesu Lim and Jinho Choi and Taekyung Kim and Byeongho Heo and Jaegul Choo and Dongyoon Han}, year = {2026}, eprint = {2603.07335}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2603.07335}, }