首页 综合 正文 2026-08-30 19:44:56 大语言模型会在蒸馏中“夹带”自己的偏好—新闻—科学网 内容 评论 相关 该研究的夹带局限性在于所选特征(例如最喜欢的动物和树木)过于简单,虽然此过程可用于生成成本更低的大语LLM,需要进行更严格的言模安全测试,这种潜意识学习(即通过语义无关的型会新闻数据传递行为特征),为了确保先进AI系统的蒸馏中自安全性,但目前尚不清楚老师模型的偏好哪些特性会被传递给学生模型。