AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
字节跳动面试题
如何估算一个7B模型在batch=1、seqle…
字节跳动面试题
更新 2026-08-05
如何估算一个7B模型在batch=1、seqlen=2048下的KV Cache显存占用?
字节跳动
人工智能
互联网/IT
性能优化
问题拆解
技术原理
考察说明
考察根据模型架构进行量化显存估算的能力
回答思路
明确需要7B模型的层数和隐藏维度
说明每个token每层K和V各占多少字节(如float16为2字节)
正确代入公式计算,得出数值
区分KV Cache显存与模型参数显存
说明采用GQA/MQA时计算方法的调整
换一题
上一题
lodash.get() 是如何实现的?它的核心逻辑和可能的风险点是什么?
下一题
HTTPS 中的 S 代表什么?
本题还出现在
互联网/IT行业面试题
人工智能面试题