关于语言模型中的概率分布与采样,下列说法正确的是:
语言模型在每一步生成时,会输出词表上的一个概率分布,表示每个词被选为下一个词的概率
采样是指始终选择概率最大的那个词作为输出
语言模型输出的 logits 本身就是概率分布,不需要经过任何变换
概率分布中所有词的概率之和可以大于 1