AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
登录
登录
AI 简历
简历模板
简历范文
模拟面试
校招
求职攻略
关于我们
我要招人
首页
面试题库
科大讯飞面试题
在大规模模型推理服务场景下,如何选择或使用分布式…
科大讯飞面试题
更新 2026-08-05
在大规模模型推理服务场景下,如何选择或使用分布式框架来提升吞吐和降低延迟?
科大讯飞
人工智能
专业服务
性能优化
系统设计
方案权衡
vLLM
考察说明
考察对LLM推理扩展与框架选型的综合能力
回答思路
提出模型并行或分片策略
说明PagedAttention、Continuous Batching等优化手段
给出吞吐与延迟的权衡思路
本题已收录答题指导
本题附完整参考答案与评分标准
登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。
开始模拟面试
登录查看答题指导
换一题
上一题
怎么用Redis实现分布式锁?
下一题
请解释Nagle算法的工作原理及其对网络性能的影响。
本题还出现在
专业服务行业面试题
人工智能面试题