LMCC例题C

您的姓名:

一、单选题(20题 × 3分 = 60分)

1、关于模型泛化能力的理论保证,以下哪项描述最准确?
2、在以下场景中,哪项最适合应用提示学习方法?
3、在筛选高质量指令数据时,以下哪项标准最能有效识别低质量数据?
4、关于大语言模型的代表性模型,以下哪项描述最准确?
5、关于模型评测中的公平性问题,以下哪项描述最准确?
6、关于基于Transformer的三种主流模型架构(Encoder-only、Decoder-only、Encoder-Decoder),以下描述正确的是:
7、关于批量大小(Batch Size)对模型训练的影响,以下说法错误的是:
8、指令微调(Instruction Tuning)的核心目标是:
9、在大语言模型的训练中,监督学习(Supervised Learning)的主要特征是什么?
10、关于DeepSeek-R1的特点,以下哪项描述最准确?
11、以下哪一项是精确率(Precision)的计算公式?注:TP(True Positive,真阳性)、FP(False Positive,假阳性)、TN(True Negative,真阴性)、FN(False Negative,假阴性)。
12、在预训练技术中,下一个词元预测任务(Next Token Prediction)主要基于以下哪种核心思想?
13、关于自注意力机制,以下哪项描述是正确的?
14、关于大语言模型的优势与局限性,以下描述正确的是?
15、关于大语言模型的训练流程,以下哪项分阶段描述最准确?
16、除了无害性、有用性和诚实性,人类对齐还可能包含哪些重要标准?
17、下列哪个项是大语言模型产生偏见的主要来源?
18、按照语言模型的发展历程,以下四代模型的正确时间顺序是:
19、关于贪心搜索(Greedy Search)和束搜索(Beam Search)这两种解码策略,以下描述正确的是:
20、关于过拟合(Overfitting)现象,以下描述正确的是?

二、程序题(10题 × 4分 = 40分)

21、【编程题1·第[1]空】Qwen2.5-VL模型依赖自定义多模态处理逻辑,需启用remote code。请选择一种能正确加载该模型处理器的方式:
22、【编程题1·第[2]空】输入图像应以PIL.Image对象的RGB格式提供给processor。请选择正确的实现方式:
23、【编程题1·第[3]空】对于对话式多模态模型,需要使用chat template格式化输入。请选择正确的实现方式:
24、【编程题1·第[4]空】推理时应使用专用上下文管理器以禁用梯度计算并优化性能。请选择最适合推理的方式:
25、【编程题1·第[5]空】模型输出包含输入和生成部分,需要提取仅新生成的token。请选择正确的实现方式:
26、【编程题2·第[1]空】Qwen2.5模型需要加载支持自定义代码的分词器。请选择正确的加载方式:
27、【编程题2·第[2]空】为优化推理效率,需要自动分配GPU设备并使用半精度格式以节省显存。请选择正确的模型加载方式:
28、【编程题2·第[3]空】推理前需要将模型移至目标设备并切换到评估模式以禁用Dropout等训练行为。请选择正确的实现方式:
29、【编程题2·第[4]空】需要对logits应用温度缩放并通过softmax转换为概率分布以控制生成多样性。请选择正确的实现方式:
30、【编程题2·第[5]空】生成完成后需要将新增的token序列解码为可读文本。请选择正确的解码方式:
更多问卷 复制此问卷