腾讯面试题 · tech:pytorch
腾讯相关面试题,按最终去重题目聚合。
共 3056 道真题 · 当前筛选命中 7 道 · 更新 2026-08-05
筛选题目已选:tech:pytorch
考察点
技术栈
第 1 题请比较分布式训练中 DP 与 DDP 的区别。 考察对分布式训练并行策略的理解,包括通信、同步与适用场景第 2 题请写出 InfoNCE 损失函数的数学表达式,并解释其含义。 考察对对比学习核心损失函数的理解与表达能力第 3 题请手写实现一个Casual Self-Attention模块,说明其输入输出维度与计算流程。 考察注意力机制的实现细节与因果掩码处理能力第 4 题请实现多头自注意力机制(Multi-Head Self-Attention),并说明其计算过程。 考察对多头自注意力机制的理解与动手实现能力第 5 题请实现一个多头自注意力机制(Multi-Head Self-Attention)。 考察对Transformer核心组件的理解及编码实现能力第 6 题如何使用 PyTorch 实现 Grouped Query Attention(GQA)? 考察对多头注意力机制的变体理解及 PyTorch 编码实现能力第 7 题在使用 PyTorch 处理大规模数据集时,如果内存不足以一次性加载全部数据,通常使用哪个类或接口来按需读取数据? 考察对 PyTorch 数据加载机制的理解与实操能力