百度面试题更新 2026-08-05
在强化学习(RL)训练中,上下文窗口大概多长?面对样本长度不同导致的负载不均衡,你们如何考虑和解决?
百度人工智能专业服务性能优化问题拆解方案权衡
考察说明
考察对RL训练中序列长度、批处理负载均衡的理解与工程化处理
回答思路
- 能说明RL常见上下文窗口量级及对显存/算力的影响
- 能分析样本长度差异带来的负载不均问题(如最短最长样本比率)
- 能提出具体的负载均衡方案,如长度分桶、padding策略、动态批处理
- 能结合工程实践说明实现细节或取舍
本题附完整参考答案与评分标准
登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。