AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
人工智能面试题
请比较 Qwen3 与 DeepSeek-R1 …
人工智能面试题
更新 2026-08-05
请比较 Qwen3 与 DeepSeek-R1 在架构设计上的主要差异,例如注意力机制、混合专家(MoE)结构等方面。
腾讯
人工智能
互联网/IT
技术原理
技术选型
考察说明
考察对主流大模型架构差异的理解与对比分析能力
回答思路
能清晰指出注意力机制的区别(如 GQA 与 MLA)
能解释 MoE 的实现差异及对推理性能的影响
能结合模型发布背景说明架构演进的动机
能诚实说明知识更新的局限性
换一题
上一题
在Transformer架构中,编码器(Encoder)和自注意力机制分别起到什么作用?
下一题
请介绍你了解哪些正则化方法,以及各自的作用原理和适用场景。
本题还出现在
互联网/IT行业面试题
腾讯面试题