Trust Me, I'm an Expert: Decoding and Steering Authority Bias in Large Language Models
arXiv:2601.13433v3 Announce Type: replace Abstract: Prior research demonstrates that performance of language models on reasoning tasks can be influenced by suggestions, hints and endorsements. However