AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
中科曙光面试题
请描述大语言模型推理中 KV Cache 的管理…
中科曙光面试题
更新 2026-08-05
请描述大语言模型推理中 KV Cache 的管理机制,包括其作用、内存占用与优化策略。
中科曙光
后端开发
电子/半导体
性能优化
技术原理
Transformer
考察说明
考察对 Transformer 推理中 KV Cache 原理、内存管理与优化方法的理解
回答思路
准确说明 KV Cache 的缓存内容与降低计算冗余的作用
分析其内存占用随序列长度增长的原因
列出常见优化手段如 PagedAttention、KV 量化、滑动窗口等
讨论与推理吞吐、延迟的权衡
换一题
上一题
如何使用Java连接数据库并查询表中的数据?
下一题
请介绍你在项目中是如何实现LRU缓存的?
本题还出现在
后端岗位面试题
电子/半导体行业面试题