北京智谱华章科技面试题 · 方案权衡
北京智谱华章科技相关面试题,按最终去重题目聚合。
共 192 道真题 · 当前筛选命中 47 道 · 更新 2026-08-05
筛选题目已选:方案权衡
考察点
技术栈
第 1 题请描述建立RAG系统的整体流程,并重点说明知识库构建中的分片策略、嵌入模型选择以及向量存储方案。 考察对RAG全流程的理解、知识库构建的关键决策及技术选型能力第 2 题在 WebServer 相关的场景下,epoll 有什么优势?为什么要使用它? 考察对 epoll 机制的理解及其在高并发 I/O 场景下的适用性第 3 题请解释大模型与小模型之间的 scaling law,并比较它们在实际应用中的表现差异。 考察对 scaling law 核心概念的理解及其在不同规模模型上的应用和影响第 4 题在实习项目中,你是如何决定将不同类型的数据存储在 ClickHouse、Hive、Redis 或其他数据库中的? 考察数据存储选型的依据与业务理解第 5 题LoRA和p-tuning v2的区别,以及初始化方式 考察对两类参数高效微调方法在机制和初始化上的异同理解第 6 题DPO解决什么问题,正负样本对很相似会带来提升吗? 考察对DPO算法本质及其对比学习样本构造的理解第 7 题在3D并行(数据并行、张量并行、流水线并行)中,ZeRO优化器的并行策略最多能开到什么程度?如果只开启部分ZeRO级别(如ZeRO-2),会带来哪些影响? 考察对ZeRO优化器与3D并行组合的理解,包括显存节省、通信开销和训练稳定性第 8 题如何为QQ短视频设计推荐系统,给出整体思路? 考察对短视频推荐系统的整体架构和核心策略的设计能力第 9 题TP和DP应用在哪个权重计算的位置,并且两者是如何进行协同的? 考察模型并行策略中张量并行与数据并行的角色定位及协同机制第 10 题多机多卡和单机多卡在实现上的不同 考察分布式训练中通信架构、同步机制与故障处理的区别第 11 题TCP和UDP有什么区别? 考察对传输层协议核心特性的理解与对比能力第 12 题为什么大模型对齐时选择 DPO 而非直接进行 SFT?核心差异是什么? 考察对监督微调与偏好优化在对齐目标、数据需求和效果差异上的理解第 13 题如何解决大模型生成SQL存在假字段的问题? 考察对大模型生成SQL幻觉问题的理解与工程化处理能力第 14 题如果在QQ负责业务,你会选择什么方向? 考察业务理解、分析框架与创新思维第 15 题讲一讲设计数据库表的思路 考察数据库表设计的方法论与工程实践第 16 题请解释PPO、DPO、GRPO这三种强化学习微调方法的核心计算逻辑和各自特点。 考察对强化学习微调算法原理的理解深度与对比能力第 17 题为什么要把PDF解析成文本文档后再导入知识库,而不是直接知识库中导入PDF? 考察对文档解析、LLM检索与知识库管线的理解第 18 题请介绍单例模式,并说明其应用场景与可能的问题。 考察对单例模式的理解、适用场景及边界风险第 19 题请手写实现一个经典的三列布局,左右两列宽度固定,中间列自适应,并说明你采用的方案及其优缺点。 考察CSS布局实现能力与方案权衡意识第 20 题请比较 DeepSpeed 和 Megatron 在大模型训练中的技术特点与应用场景。 考察对主流大模型训练框架的核心技术与适用场景的理解