AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
小米集团面试题
如何管理 LLM 推理中的 KV Cache?
小米集团面试题
更新 2026-08-05
如何管理 LLM 推理中的 KV Cache?
小米集团
人工智能
电子/半导体
性能优化
技术原理
vLLM
考察说明
考察 KV Cache 的组织、内存优化与长上下文处理能力
回答思路
说明 KV Cache 的作用与存储结构
覆盖 PagedAttention、GQA/量化等常见优化手段
讨论缓存淘汰或长上下文下的内存策略
换一题
上一题
请分享一次你在实习中遇到的较大困难,并说明你是如何应对的。
下一题
KV-Cache如何加速推理?
本题还出现在
电子/半导体行业面试题
人工智能面试题