The Pitfalls of Reasoning for Instruction- Following in LLMs
Xiaomin Li, Zhou Yu, Zhiwei Zhang, et al.
This paper reveals that chain-of-thought reasoning can significantly degrade instruction-following accuracy in LLMs, and proposes selective reasoning strategies to mitigate the issue.