AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
字节跳动面试题
在 DPO 训练多轮对话数据时,你认为数据分布应…
字节跳动面试题
更新 2026-08-05
在 DPO 训练多轮对话数据时,你认为数据分布应该是什么样的?
字节跳动
人工智能
互联网/IT
问题拆解
技术原理
考察说明
考察对多轮对话数据分布设计的原则性理解
回答思路
说明多轮数据应覆盖不同轮次长度和话题多样性
强调需平衡常见交互模式与长尾场景
讨论避免分布偏斜导致模型行为失控
换一题
上一题
如果要将 DPO 应用在第一轮对话(单轮)场景,你会如何构造训练数据集?
下一题
写出 sigmoid 函数的公式,并说明其性质。
本题还出现在
互联网/IT行业面试题
人工智能面试题