普通会员
登录
首页
文库
真题
课件
教程
题库
Scratch真题
Python真题
信息学奥赛
蓝桥杯竞赛
机器人技术
信息素养大赛
试卷
Scratch试卷
蓝桥杯青少组考试
Python试卷
机器人技术考试
信息技术试卷
GESP试卷
信息学奥赛
信息素养大赛
资讯
软件下载
动态资讯
赛事动态
官方公告
白名单赛事
题库
人工智能大模型
题目列表
大模型推理加速工具 vLLM 之所以能够极大地提升大型语...
单选题
大模型推理加速工具 vLLM 之所以能够极大地提升大型语言模型的高吞吐量服务性能, 其最核心的架构创新在于什么?
A.
采用更快的 GPU 计算库(如 FlashAttention)来优化注意力计算。
B.
引入了名为 PagedAttention 的内存管理机制,有效解决了 KV Cache 的内存碎片化问题。
C.
使用模型量化技术,降低模型权重占用的显存空间。
D.
实现了更高效的调度算法,总是优先处理序列长度最短的请求。
上一题
[单选题] 学习率预热是大模型训练中一项非常重要的技术。它的主要目的是什么?
下一题
[单选题] 下列哪一项是混合专家模型(Mixture of Experts,MoE)面临的主要挑战?
纠错
题目信息
成人组
样题/模拟题
2025年
选择题
100%
正确率
0
评论
324
点击
收藏
已收藏
错题本
已加入错题本
我的笔记
登录添加笔记