GESP 1-4级
--
GESP 5-8级
--
CSP-J/S
--
✦
测评会员优惠活动进行中 · 开通 VIP,有效期内测评不限次
VIP 优惠中 · 测评不限次
立即查看
×
打开菜单
GESP考级
GESP考级
首页
题库
题单
排行榜
试卷
真题
文库
备赛
站长推荐
竞赛
CSP-J/S
信息学奥赛入门门户
蓝桥杯
青少年组备赛专题
考级认证
GESP 测评
热门
赛制 · 倒计时 · 真题
CPA
青少年编程能力等级
电子学会考级
中国电子学会等级考试
学习入口
学习路径
必看
通往信奥的知识点路线
GESP 教程
C++ 一至八级样章
每日一题
每天一道精选练习
天梯
闯关
竞赛
资讯
会员
开通
会员中心
登 录
注 册
首页
/
题库
/
人工智能大模型
分类题库
人工智能大模型
按题型、年份与知识点筛选,快速定位练习题。
共 2 题
2025年
搜索
分类
Scratch题库
Python题库
信息学奥赛题库
蓝桥杯青少组题库
信息技术题库
机器人技术题库
C++编程题库
NOC大赛题库
信息素养大赛题库
人工智能大模型
题型
全部
单选
编程题
年份
全部
2025年
知识点
全部
大语言模型
人工智能伦理
人工智能
注意力机制
监督学习
强化学习
自注意力机制
数据偏见
人类对齐
指令微调
Transformer架构
提示词工程
约束条件
张量维度变换
注意力掩码
低秩分解
参数高效微调
推理能力优化
语言模型
直接偏好优化
困惑度
大语言模型评测
模型能力评估
大语言模型推理
模型公平性
模型评估
贪心搜索
束搜索
解码策略
掩码语言模型
预训练任务
自监督学习
深度学习
模型训练
机器学习基础
提示学习
题目列表
共 2 题
题号
标题
知识点
题型
A53065
在评估⼤语⾔模型的逐步推理能⼒时,以下哪种情况最能体现模型的真实推理⽔平?
2025年
大语言模型
模型评估
逐步推理
单选
→
A53032
在评估一个代码生成智能体时,我们常使用 Pass@K 指标。假设我们有一个包含 n=100 个编程问题的测试集。对于每个问题,让智能体独立生成 k=5 个不同的代码解决方案。 如果对于某个问题,生成的 5 个方案中有任意一个能够通过单元测试,该问题就被视为“已解 决”。最终,在 100 个问题中,有 60 个问题被成功解决。 根据上述描述,以下关于 Pass@K 的计算和解释,哪一项是正确的?
2025年
Pass@K指标
概率统计
模型评估
单选
→
提交反馈
发现问题或有功能建议,告诉我们即可。
0/2000
提交