LMCC大模型认证 青少年组 第一轮模拟样题
剩余时间 --:--:--
单选题 共 30 题
1.

在掩码语言模型预训练中,核心任务“掩码预测”的主要目的是什么

2.

小明和小华在学习大语言模型时,尝试让它写太空探险的故事。

小明的提示词是:“写一个关于太空探险的故事。” 小华的提示词是:“请你扮演一位经验丰富的科幻小说家,为中学生写一个大约 500 字 的短篇故事。故事的主角是一位名叫‘星尘’的年轻宇航员,他在探索一颗未知行星时, 意外发现了一个古老外星文明的遗迹。故事风格要紧张刺激,结局要留下悬念。” 结果小华生成的故事比小明更好。从提示词工程的角度分析,为什么小华能获得远比 小明更好的结果?

3.
Transformer 架构中,使大语言模型能够有效处理长距离依赖关系的关键组件是: 
4.
指令微调的主要目的是什么?
5.
大语言模型中存在的社会偏见,其主要根源最可能是:
6.
目前主流的生成式大语言模型(如 GPT 系列)的核心架构通常基于:
7.
用于指令微调的数据通常具有什么典型特征?
8.
关于“贪心搜索”和“束搜索”这两种解码策略,以下哪种说法是最准确的?
9.
大模型“人类对齐”的核心目标是使得模型的行为:
10.
大语言模型在解决一道复杂的数学应用题时,生成了一段非常长的思考过程,其中包含了将问题分解为多个子步骤、对每个步骤进行详细解释、并逐步推导出中间结 果。这种推理模式的主要优势是什么?
11.
关于 AI 智能体的角色配置文件设置,下列哪个说法是最准确的?
12.

在评估一个代码生成智能体时,我们常使用 Pass@K 指标。假设我们有一个包含 n=100 个编程问题的测试集。对于每个问题,让智能体独立生成 k=5 个不同的代码解 决方案。如果对于某个问题,生成的 5 个方案中有任意一个能够通过单元测试,该问 题就被视为“已解决”。最终,在 100 个问题中,有 60 个问题被成功解决。 

根据上述描述,以下关于 Pass@K 的计算和解释,哪一项是正确的?

13.
下列哪一项通常不属于对大语言模型进行系统评测的核心内容?
14.
在 Transformer 的自注意力机制中,关于 Query、Key 和 Value 的来源,以下哪一 项描述是最准确的?
15.
下列哪一项不属于测试时间拓展(Test Time Scaling,TTS)技术?
16.
为了保障社会群体的“公平安全”,避免模型输出产生歧视性内容,最关键的缓解方法是在哪个阶段介入?
17.
当前意义上的“大语言模型”最显著的特征不包括以下哪一项?
18.
基于强化学习的推理能力优化方法面临的主要挑战是什么?
19.
关于语言模型的困惑度,以下描述正确的是:
20.
关于监督学习和无监督学习的区别,以下说法正确的是:
21.
在方法 _text_to_vector 中第一步是将输入的文本批次 text_batch 转换为模型 可以理解的格式,以下代码正确的是:
22.
此处需要进行前向计算获取隐藏向量,以下代码正确的是:
23.
此处需要池化得到句向量,以下代码正确的是:
24.
此处需要进行检索得到对应文档,以下代码正确的是:
25.
此处需要对模型输出进行处理,以下代码正确的是:
26.
Qwen2.5 可能包含自定义分词器/处理逻辑,要求与模型端一致的 remote code。 请选择一种能正确加载该模型分词器的方式:
27.
请参考题目描述的计算资源,在尽量保持训练稳定和速度的前提下,选择常见且 相对节省显存的 LoRA 配置:
28.
为了配置 LoRA 权重的注入位置,以下代码更合理的是:
29.
显存限制和内存溢出(Out Of Memory, OOM)风险下,以下配置最稳妥的是:
30.
为了配置训练的数据类型,以下代码更合理的是: