AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
人工智能面试题
项目用 DPO 缓解幻觉时,如果反而引入了新的幻…
人工智能面试题
更新 2026-08-05
项目用 DPO 缓解幻觉时,如果反而引入了新的幻觉,可能是什么原因?
滴滴
人工智能
技术原理
问题排查
考察说明
考察对 DPO 训练机制、幻觉成因和失败模式的理解
回答思路
分析 DPO 偏好数据构造问题,如错误或冲突偏好
讨论训练分布与推理分布不一致导致过拟合
识别奖励模型或参照模型偏移带来的风险
说明原有幻觉未消除但新幻觉被强化的机制
换一题
上一题
为什么要去这个公司(小公司)实习?
下一题
请说明 YOLOv5 相比之前的 YOLO 版本在网络结构和训练策略上的主要改进,并概述其整体网络结构。
本题还出现在
滴滴面试题