AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
后端岗位面试题
请描述大语言模型推理中 KV Cache 的管理…
后端岗位面试题
更新 2026-08-05
请描述大语言模型推理中 KV Cache 的管理机制,包括其作用、内存占用与优化策略。
中科曙光
后端开发
电子/半导体
性能优化
技术原理
Transformer
考察说明
考察对 Transformer 推理中 KV Cache 原理、内存管理与优化方法的理解
回答思路
准确说明 KV Cache 的缓存内容与降低计算冗余的作用
分析其内存占用随序列长度增长的原因
列出常见优化手段如 PagedAttention、KV 量化、滑动窗口等
讨论与推理吞吐、延迟的权衡
换一题
上一题
当需要新增业务需求或扩展业务逻辑时,有哪些设计模式可以在不修改现有代码的情况下实现?请举例说明。
下一题
Redis 中热 Key 过期会有什么影响?如何避免和解决?
本题还出现在
电子/半导体行业面试题
中科曙光面试题