@article{howdolargelanguagemodelsnavigate, title = {How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?}, author = {Ryan Liu and Theodore R. Sumers and Ishita Dasgupta and Thomas L. Griffiths}, year = {2024}, eprint = {2402.07282}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2402.07282v2}, }