重复惩罚通过降低先前使用过的令牌被选中的概率来阻止大型语言模型重复单词或短语。这包括频率惩罚(随使用次数缩放)和存在惩罚(对任何已使用令牌同等应用)。这些参数通过促进词汇多样性和防止冗余措辞来提高输出质量。