人工智能面试题更新 2026-08-05

大模型训练中容易发生 reward hacking,应如何解决?

美团人工智能互联网/IT风险判断技术原理问题排查

考察说明

考察对大模型奖励机制风险的理解及应对策略

回答思路

  1. 能清晰解释 reward hacking 的定义与典型表现
  2. 能提出至少两种缓解策略并说明原理
  3. 能权衡各策略的适用场景与代价
本题已收录答题指导

本题附完整参考答案与评分标准

登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。