2025年11月 LMCC大模型认证 青少年组 第一轮真题
剩余时间 --:--:--
单选题 共 30 题
1.
关于模型泛化能⼒的理论保证,以下哪项描述最准确?
2.
在以下场景中,哪项最适合应⽤提⽰学习⽅法?
3.
在筛选⾼质量指令数据时,以下哪项标准最能有效识别低质量数据?
4.
关于⼤语⾔模型的代表性模型,以下哪项描述最准确?
5.
关于模型评测中的公平性问题,以下哪项描述最准确?
6.
关于基于 Transformer 的三种主流模型架构(Encoder-only、Decoder-only、Encoder‒ Decoder),以下描述正确的是:
7.
关于批量⼤⼩(Batch Size)对模型训练的影响,以下说法错误的是:
8.
指令微调(Instruction Tuning)的核⼼⽬标是:
9.
在⼤语⾔模型的训练中,监督学习(Supervised Learning)的主要特征是什么?
10.

关于 DeepSeek-R1 的特点 ,以下哪项描述最准确?

11.

以下哪⼀项是精确率( Precision)的计算公式? 注:TP(True Positive ,真阳性)、 FP(False Positive ,假阳性)、TN(True Negative ,真阴性)、 FN( False Negative ,假阴性);

12.
在预训练技术中,下⼀个词元预测任务(Next Token Prediction)主要基于以下哪种核⼼思想?
13.
关于⾃注意⼒机制,以下哪项描述是正确的?
14.
关于⼤语⾔模型的优势与局限性,以下描述正确的是?
15.
关于⼤语⾔模型的训练流程,以下哪项分阶段描述最准确?
16.
除了⽆害性、有⽤性和诚实性,⼈类对⻬还可能包含哪些重要标准?
17.
下列哪个项是⼤语⾔模型产⽣偏⻅的主要来源?
18.
按照语⾔模型的发展历程,以下四代模型的正确时间顺序是:
19.
关于贪⼼搜索(Greedy Search)和束搜索(Beam Search)这两种解码策略,以下描述正确的是:
20.
关于过拟合(Overfitting)现象,以下描述正确的是?
21.
Qwen2.5-VL 模型依赖⾃定义多模态处理逻辑,需启⽤ remote code。请选择⼀种能正确加载该 模型处理器的⽅式:
22.
输⼊图像应以 PIL.Image 对象的 RGB 格式提供给 processor。请选择正确的实现⽅式:
23.
对于对话式多模态模型,需要使⽤ chat template 格式化输⼊。请选择正确的实现⽅式:
24.
推理时应使⽤专⽤上下⽂管理器以禁⽤梯度计算并优化性能。请选择最适合推理的⽅式:
25.
模型输出包含输⼊和⽣成部分,需要提取仅新⽣成的 token。请选择正确的实现⽅式:
26.
Qwen2.5 模型需要加载⽀持⾃定义代码的分词器。请选择正确的加载⽅式:
27.
为优化推理效率,需要⾃动分配 GPU 设备并使⽤半精度格式以节省显存。请选择正确的模型加载 ⽅式:
28.
推理前需要将模型移⾄⽬标设备并切换到评估模式以禁⽤ Dropout 等训练⾏为。请选择正确的实现⽅式:
29.
需要对 logits 应⽤温度缩放并通过 softmax 转换为概率分布以控制⽣成多样性。请选择正确的实 现⽅式:
30.
⽣成完成后需要将新增的 token 序列解码为可读⽂本。请选择正确的解码⽅式: