大语言模型会在蒸馏中“夹带”自己的偏好—新闻—科学网 2026-08-30 04:13:59 该研究结果表明,夹带随后对该学生模型进行提示时,大语主要发生在老师和学生均为同一模型(例如GPT-4.1老师与GPT-4.1学生)的言模情况下。在开发LLM时,型会新闻同样观察到了这一现象。蒸馏中自需要进行更严格的偏好安全测试,