AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
人工智能面试题
若采用训练一个小模型来缓解 reward hac…
人工智能面试题
更新 2026-08-05
若采用训练一个小模型来缓解 reward hacking,这个小模型的训练数据应如何获取?
美团
人工智能
互联网/IT
数据驱动
问题拆解
技术选型
考察说明
考察对知识蒸馏、数据生成等数据来源的掌握
回答思路
能列举至少两种数据获取途径
能说明各自适用条件与优缺点
能体现对数据质量与覆盖度的考量
换一题
上一题
请详细介绍你发表的这篇目标检测论文,包括研究动机、核心方法、实验结果与个人贡献。
下一题
prefix LM、causal LM 和 encoder-decoder 模型有何区别及各自优缺点?
本题还出现在
互联网/IT行业面试题
美团面试题