PROBLEM SET
题库
按难度与知识点筛选,找到适合的练习题。
题目列表
共 67434 题
A53067
在深度学习模型训练过程中,梯度裁剪(Gradient Clipping)技术的主要作⽤是什么?
2025年
--
--
A53066
关于知识利⽤能⼒评测中时效性要求的理解,以下哪项描述最准确?
2025年
--
--
A53065
在评估⼤语⾔模型的逐步推理能⼒时,以下哪种情况最能体现模型的真实推理⽔平?
2025年
--
--
A53064
已知标准注意⼒的计算复杂度为 ,其中序列⻓度为 O(L2d),特征维度为 L。设
2025年
--
--
A53063
在深度学习模型训练中,混合精度训练(Mixed Precision Training)技术的主要作⽤是什么?
2025年
--
--
A53062
在提⽰学习中,以下哪项不属于⼈⼯提⽰设计的基本原则?
2025年
--
--
A53061
某预训练任务初始批次⼤⼩(Batch Size)为256,采⽤梯度累积(Gradient Accumulation)策 略每4步更新⼀次,实际等效批次⼤⼩是多少?若改为动态调整策略,在训练中期将批次⼤⼩增⾄ 512,请计算梯度累积步数应如何调整以保持等效批次⼤⼩不变?
2025年
--
--
A53060
多头注意⼒(Multi-Head Attention, MHA) 是 Transformer 架构的核⼼组件,在⼤语⾔模型中扮演 着⾄关重要的⻆⾊。MHA 通过并⾏计算多个注意⼒头,能够让模型同时关注序列中不同位置的不同表 ⽰⼦空间,从⽽捕获更丰富的语义信息和位置关系。在标准 MHA 中,每个注意⼒头都维护独⽴的 Key (K) 和 Value (V) 缓存(KV Cache),这在推理阶段会带…
2025年
--
--
A53059
在掩码语言模型预训练中,核心任务“掩码预测”的主要目的是什么?
2025年
--
--
A53058
小明和小华在学习大语言模型时,尝试让它写太空探险的故事。小明的提示词是:“写一个关于太空探险的故事。”小华的提示词是:“请你扮演一位经验丰富的科幻小说家,为中学生写一个大约 500 字的短篇故事。故事的主角是一位名叫‘星尘’的年轻宇航员,他在探索一颗未知行星时,意外发现了一个古老外星文明的遗迹。故事风格要紧张刺激,结局要留下悬念。”结果小华生成的故事比小明更好。从提示词工程的角度分析,为什么小华…
2025年
--
--
A59729
据有关资料,山东大学于1972年研制成功DJL-1计算机,并于1973年投入运行,其综合性能居当时全国第三 位。DJL-1计算机运算控制部分所使用的磁心存储元件由磁心颗粒组成,设计存贮周期为2μs(微秒)。那么该磁心 存储元件相当于现代计算机的( )。
2024年-选择题
--
--
A59728
Python语句 print(f"6%2={6%2}") 执行后的输出是( )。
2024年-选择题
--
--
A59727
执行下面的Python代码,先后从键盘上输入5回车和2回车,输出是( )。 a = input()
2024年-选择题
--
--
A59726
下面Python代码执行后,相关说法错误的是( )。 N = input()
2024年-选择题
--
--
A59725
下面Python代码执行后输出是( )。 Sum = 0
2024年-选择题
--
--
A59724
下面Python代码执行后输出的是( )。 N = 0
2024年-选择题
--
--
A59723
为在Python Turtle中输出如下图形,代码横线处应填入( )。 import turtle
2024年-选择题
--
--
A60569
已知列表st=['a','b','c','d','e','f'],请问len(st)的值为?( )
2025年
--
--
A59722
下面Python执行后,有关说法,正确的是( )。import turtle
2024年-选择题
--
--
A60568
运行以下代码后,输出的最小整数和最大整数分别是?( )num= range(5)
2025年
--
--