基础题库
探索各种基础编程概念和问题解决技巧
请登录后使用状态筛选
简单单选题
当一个学习任务需要同时预测多个相互关联的类别标签时(例如,在一张图片中同时识别出“人”和“狗”),这属于哪种类型的学习任务?
当一个学习任务需要同时预测多个相互关联的类别标签时(例如,在一张图片中同时识别出“人”和“狗”),这属于哪种类型的学习任务?
正确率: 100%已完成: 3人LMCC大模型认证预训练技术回归分析
简单单选题
自监督学习中的“掩码预测”(Masked Prediction)任务,例如 BERT 的 Masked Language Model (MLM),其核心思想是:
自监督学习中的“掩码预测”(Masked Prediction)任务,例如 BERT 的 Masked Language Model (MLM),其核心思想是:
正确率: 100%已完成: 3人LMCC大模型认证预训练技术自监督学习
中等单选题
在自监督学习中,针对自然语言(如文本)的掩码预测任务(如 MLM)与针对图像的掩码预测任务(如 MAE - Masked Autoencoders)相比,主要区别在于:
在自监督学习中,针对自然语言(如文本)的掩码预测任务(如 MLM)与针对图像的掩码预测任务(如 MAE - Masked Autoencoders)相比,主要区别在于:
正确率: 100%已完成: 3人LMCC大模型认证预训练技术自监督学习
简单单选题
在预训练技术中,下一个词元预测任务(Next Token Prediction)主要基于以下哪种核心思想?
在预训练技术中,下一个词元预测任务(Next Token Prediction)主要基于以下哪种核心思想?
正确率: 100%已完成: 3人LMCC大模型认证预训练技术
简单单选题
如果一个预训练模型在训练时,除了预测下一个词元,还被要求完成例如情感分析、问答等多个下游任务(并在训练时共享参数),这种训练方式更接近于:______
如果一个预训练模型在训练时,除了预测下一个词元,还被要求完成例如情感分析、问答等多个下游任务(并在训练时共享参数),这种训练方式更接近于:______
正确率: 100%已完成: 3人LMCC大模型认证预训练技术
中等单选题
关于批量大小(Batch Size)对模型训练的影响,以下说法错误的是:
关于批量大小(Batch Size)对模型训练的影响,以下说法错误的是:
正确率: 75%已完成: 3人LMCC大模型认证预训练技术优化设置
中等单选题
某预训练任务初始批次大小(Batch Size)为256,采用梯度累积(Gradient Accumulation)策略每4步更新一次,实际等效批次大小是多少?若改为动态调整策略,在训练中期将批次大小增至512,请计算梯度累积步数应如何调整以保持等效批次大小不变?
某预训练任务初始批次大小(Batch Size)为256,采用梯度累积(Gradient Accumulation)策略每4步更新一次,实际等效批次大小是多少?若改为动态调整策略,在训练中期将批次大小增至512,请计算梯度累积步数应如何调整以保持等效批次大小不变?
正确率: 67%已完成: 2人LMCC大模型认证预训练技术优化设置
简单单选题
在深度学习模型训练中,学习率预热(Learning Rate Warm-up)策略主要用于解决以下哪个问题?
在深度学习模型训练中,学习率预热(Learning Rate Warm-up)策略主要用于解决以下哪个问题?
正确率: 100%已完成: 3人LMCC大模型认证预训练技术优化设置
简单单选题
Cosine 学习率衰减(Cosine Learning Rate Decay)策略相较于步进式衰减(Step Decay),其主要优点是:
Cosine 学习率衰减(Cosine Learning Rate Decay)策略相较于步进式衰减(Step Decay),其主要优点是:
正确率: 100%已完成: 3人LMCC大模型认证预训练技术优化设置
简单单选题
随机梯度下降(SGD)优化器与 Adam 优化器相比,通常的特点是:
随机梯度下降(SGD)优化器与 Adam 优化器相比,通常的特点是:
正确率: 67%已完成: 2人LMCC大模型认证预训练技术优化设置