AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
人工智能面试题
请介绍 GRPO(Group Relative …
人工智能面试题
更新 2026-08-05
请介绍 GRPO(Group Relative Policy Optimization)的基本原理。
科大讯飞
人工智能
专业服务
技术原理
技术选型
方案权衡
考察说明
考察对 GRPO 算法核心思想与关键机制的理解
回答思路
说明 GRPO 与 PPO 的关键区别
解释组内相对优势估计的计算方式
说明优势归一化和基线的作用
能提到参考模型或 KL 约束相关机制
换一题
上一题
为什么大语言模型的规模越大,通常能力会越强?请从模型架构、训练数据和计算资源等角度解释。
下一题
在你的项目中,数据是如何构建和组织的?请说明具体的数据来源、处理流程和使用的技术工具。
本题还出现在
专业服务行业面试题
科大讯飞面试题