人工智能面试题更新 2026-08-05

请阐述图像分割、目标检测和图像识别这三项计算机视觉任务在定义和输出结果上的区别。

人工智能技术原理

考察说明

考查对计算机视觉三大基本任务的区分能力,理解各自的任务目标和输出形式。

回答思路

  1. 【回答框架 1】图像识别(分类)的任务是判断整张图像属于哪个类别,输出是类别标签或类别概率,例如判断一张图是猫还是狗。
  2. 【回答框架 2】目标检测的任务是找出图像中感兴趣的目标物体,并给出每个目标的类别和位置,输出通常是边框坐标加类别标签,例如用矩形框标记出猫和狗的位置。
  3. 【回答框架 3】图像分割的任务是对图像中的每个像素进行分类,输出是与原图同尺寸的分割图,每个像素被赋予一个类别,从而实现像素级的目标区域划分。
  4. 【回答框架 4】三者的区别在于输出粒度不同:识别是图像级,检测是物体级(边框+类别),分割是像素级。分割比检测更精细,能给出目标的精确边界。
  5. 【关键点 1】图像识别输出类别标签,不关心位置。
  6. 【关键点 2】目标检测输出边框和类别,定位到物体级。
  7. 【关键点 3】图像分割输出像素级标签,精确到边界。
  8. 【易错点 1】不要混淆图像识别与目标检测,识别不定位,检测需定位。
  9. 【易错点 2】分割结果不是简单的边框,而是像素级掩膜。