大規模で高性能な「教師モデル」の学習内容を、より小規模な「生徒モデル」に転送する機械学習の手法。特にディープラーニングでのモデル圧縮に使われ、2006年の論文に端を発し、2015年にGeoffrey Hintonらが概念を広めた。