7 月 2017 | 第2页共2页 | David 9的博客 --- 不怕"过拟合"

机器视觉目标检测补习贴之SSD实时检测, Multibox Single Shot Detector

机器视觉是一场科学家与像素之间的游戏 — David 9

上一期，理解了YOLO这样的实时检测是如何”看一眼“进行检测的, 即让各个卷积特征图(通道)蕴含检测位置和分类置信度的信息(即下图的Multiway Classification和Box Regression):

对于卷积的本质, David 9需要总结下面两点:

1. 单纯的卷积不会造成信息损失. 只是经过了层层卷积, 计算机看到了“更深”的图片, 输入图片被编码到最后一层的输出特征图(通道)

2. 较大的卷积窗口可以卷积得到的输出特征图能够看到较大的物体, 反之只能看到较小的图片. 想象用1*1的最小卷积窗口, 最后卷积的图片粒度和输入图片粒度一模一样. 但是如果用图片长*宽的卷积窗口, 只能编码出一个大粒度的输出特征. 即, 输出特征图越小, 把原始图片压缩成的粒度就越大. 继续阅读机器视觉目标检测补习贴之SSD实时检测, Multibox Single Shot Detector

机器视觉目标检测补习贴之YOLO实时检测, You only look once

机器视觉是一场科学家与像素之间的游戏 — David 9

上一期，我们已经介绍了R-CNN系列目标检测方法（R-CNN, Fast R-CNN, Faster R-CNN）。事实上，R-CNN系列算法看图片做目标检测，都是需要“看两眼”的. 即，第一眼 做 “region proposals”获得所有候选目标框，第二眼 对所有候选框做“Box Classifier候选框分类”才能完成目标检测：

事实上“第一眼”是挺费时间的，可否看一眼就能得到最后的目标检测结果？达到实时检测的可能? 答案是肯定的，这也是我们要讲YOLO的由来 — You only look once ！

YOLO能够做到在输出中同时包含图片bounding box(检测框)的分类信息和位置信息: 继续阅读机器视觉目标检测补习贴之YOLO实时检测, You only look once

机器视觉目标检测补习贴之R-CNN系列 — R-CNN, Fast R-CNN, Faster R-CNN

CVPR 2017在即，David 9最近补习了目标检测的趋势研究。深度学习无疑在近年来使机器视觉和目标检测上了一个新台阶。初识目标检测领域，当然先要了解下面这些框架：

RCNN
Fast RCNN
Faster RCNN
Yolo
SSD

附一张发表RCNN并开启目标检测深度学习浪潮的Ross B. Girshick（rbg）男神：

无论如何，目标检测属于应用范畴，有些机器学习基础上手还是很快的，所以让我们马上来补习一下！

首先什么是目标检测？目标检测对人类是如此简单：

把存在的目标从图片中找出来，就是那么简单！继续阅读机器视觉目标检测补习贴之R-CNN系列 — R-CNN, Fast R-CNN, Faster R-CNN

一	二	三	四	五	六	日
					1	2
3	4	5	6	7	8	9
10	11	12	13	14	15	16
17	18	19	20	21	22	23
24	25	26	27	28	29	30
31