AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
电子/半导体行业面试题
请描述大语言模型推理中 KV Cache 的管理…
电子/半导体行业面试题
更新 2026-08-05
请描述大语言模型推理中 KV Cache 的管理机制,包括其作用、内存占用与优化策略。
中科曙光
后端开发
电子/半导体
性能优化
技术原理
Transformer
考察说明
考察对 Transformer 推理中 KV Cache 原理、内存管理与优化方法的理解
回答思路
准确说明 KV Cache 的缓存内容与降低计算冗余的作用
分析其内存占用随序列长度增长的原因
列出常见优化手段如 PagedAttention、KV 量化、滑动窗口等
讨论与推理吞吐、延迟的权衡
换一题
上一题
请对比OSPF和RIP协议的主要区别。
下一题
请介绍拦截器在 Web 应用中的主要使用方法和典型应用场景。
本题还出现在
后端岗位面试题
中科曙光面试题