AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
京东面试题
请介绍MLA(Multi-head Latent…
京东面试题
更新 2026-08-05
请介绍MLA(Multi-head Latent Attention)及其与KV Cache的关系。
京东
人工智能
电商
技术原理
技术选型
方案权衡
LLM
考察说明
考察对大模型注意力机制优化和推理缓存机制的理解
回答思路
解释MLA的核心思想:对Key和Value进行低秩压缩以共享缓存
说明KV Cache的作用:存储历史token的KV以减少重复计算
阐述MLA如何降低KV Cache内存占用和提升推理效率
对比GQA、MQA等其他注意力变体,体现方案权衡理解
换一题
上一题
请介绍一次你对某个系统进行性能优化的完整过程。
下一题
请结合你的简历和实际项目经验,介绍你使用过哪些调试和抓包工具,以及它们在你解决问题中的具体应用。
本题还出现在
电商行业面试题
人工智能面试题