分类题库
人工智能大模型
按题型、年份与知识点筛选,快速定位练习题。
题目列表
共 69 题
A53072
Qwen2.5-VL 是多模态⼤语⾔模型(Vision-Language Model, VLM),能够同时处理图像与⽂本输 ⼊,实现图⽂问答与视觉描述等任务。以下代码演⽰了使⽤ Qwen2.5-VL-7B-Instruct 模型,对输⼊图 像进⾏分析并⽣成⽂本回答。请阅读以下代码,并根据描述完成空缺部分。import torch
2025年
编程题
A53071
在⼤语⾔模型的实际部署中,推理阶段通常需要在保证稳定性、时延与显存效率之间取得平衡。常⻅策略包括: • 将模型切换⾄推理模式以禁⽤ Dropout; • 在推理时关闭梯度计算以减少显存占⽤; • 通过温度采样(Temperature Sampling)或核采样(Top-p Sampling)控制⽣成的多样性。 以下⽰例基于 Qwen2.5-7B 模型,实现了推理函数 deploy_generat…
2025年
编程题
A53070
直接偏好优化(Direct Preference Optimization, DPO)的核⼼思想是什么?
2025年
单选
A53069
关于前缀微调(Prefix Tuning)与提⽰微调(Prompt Tuning)的异同点,以下哪种说法最准确?
2025年
单选
A53068
关于AdamW优化器的改进,以下说法正确的是?
2025年
单选
A53067
在深度学习模型训练过程中,梯度裁剪(Gradient Clipping)技术的主要作⽤是什么?
2025年
单选
A53066
关于知识利⽤能⼒评测中时效性要求的理解,以下哪项描述最准确?
2025年
单选
A53065
在评估⼤语⾔模型的逐步推理能⼒时,以下哪种情况最能体现模型的真实推理⽔平?
2025年
单选
A53064
已知标准注意⼒的计算复杂度为 ,其中序列⻓度为 O(L2d),特征维度为 L。设
2025年
单选
A53063
在深度学习模型训练中,混合精度训练(Mixed Precision Training)技术的主要作⽤是什么?
2025年
单选
A53062
在提⽰学习中,以下哪项不属于⼈⼯提⽰设计的基本原则?
2025年
单选
A53061
某预训练任务初始批次⼤⼩(Batch Size)为256,采⽤梯度累积(Gradient Accumulation)策 略每4步更新⼀次,实际等效批次⼤⼩是多少?若改为动态调整策略,在训练中期将批次⼤⼩增⾄ 512,请计算梯度累积步数应如何调整以保持等效批次⼤⼩不变?
2025年
单选
A53060
多头注意⼒(Multi-Head Attention, MHA) 是 Transformer 架构的核⼼组件,在⼤语⾔模型中扮演 着⾄关重要的⻆⾊。MHA 通过并⾏计算多个注意⼒头,能够让模型同时关注序列中不同位置的不同表 ⽰⼦空间,从⽽捕获更丰富的语义信息和位置关系。在标准 MHA 中,每个注意⼒头都维护独⽴的 Key (K) 和 Value (V) 缓存(KV Cache),这在推理阶段会带…
2025年
编程题
A53059
在掩码语言模型预训练中,核心任务“掩码预测”的主要目的是什么?
2025年
单选
A53058
小明和小华在学习大语言模型时,尝试让它写太空探险的故事。小明的提示词是:“写一个关于太空探险的故事。”小华的提示词是:“请你扮演一位经验丰富的科幻小说家,为中学生写一个大约 500 字的短篇故事。故事的主角是一位名叫‘星尘’的年轻宇航员,他在探索一颗未知行星时,意外发现了一个古老外星文明的遗迹。故事风格要紧张刺激,结局要留下悬念。”结果小华生成的故事比小明更好。从提示词工程的角度分析,为什么小华…
2025年
单选
A53057
在掩码语言模型预训练中,核心任务“掩码预测”的主要目的是什么
2025年
单选
A53056
小明和小华在学习大语言模型时,尝试让它写太空探险的故事。小明的提示词是:“写一个关于太空探险的故事。” 小华的提示词是:“请你扮演一位经验丰富的科幻小说家,为中学生写一个大约 500 字 的短篇故事。故事的主角是一位名叫‘星尘’的年轻宇航员,他在探索一颗未知行星时, 意外发现了一个古老外星文明的遗迹。故事风格要紧张刺激,结局要留下悬念。” 结果小华生成的故事比小明更好。从提示词工程的角度分析,为…
2025年
单选
A53055
Transformer 架构中,使大语言模型能够有效处理长距离依赖关系的关键组件是:
2025年
单选
A53054
指令微调的主要目的是什么?
2025年
单选
A53053
大语言模型中存在的社会偏见,其主要根源最可能是:
2025年
单选