聊天模板是切换大模型“自我认知”口吻的开关
"As a Language Model": Chat Template Switches LLM Self-Referential Voice
大模型动不动就说“我只是个AI”,这个习惯主要不是它真知道自己是谁,而是聊天模板(给对话加的格式前缀)在起作用。论文在8个开源指令模型(最大90亿参数)上试了:加上模板,免责声明式的口吻就变强,“我感觉”这类体验式表达变弱;去掉模板,效果反过来。在3个模型内部,作者找到了一个可以操控这种行为的方向——在激活空间里删掉这个方向,免责声明就减少;加上这个方...