2019-07-22 目标检测10行Python代码实现

目标检测必须要OpenCV？10行Python代码也能实现，亲测好用！

大数据文摘

发布时间：18-07-0212:59

大数据文摘出品

编译：朱一辉、雪清、小鱼

短短10行代码就可以实现目标检测？！

本文作者和他的团队构建了一个名为ImageAI 的Python库，集成了现今流行的深度学习框架和计算机视觉库。本文将手把手教你构建自己的第一个目标检测应用，而且文摘菌已经帮你踩过坑了，亲测有效！

无人超市、人脸识别、无人驾驶，众多的使用场景及案例，使得【目标检测】正成为计算机视觉最有前景的方向。

听起来似乎是个很难实现的技术，需要大量训练数据和算法才能完成。事实上，本文作者开发了一个基于Python的函数库，可以用十行代码高效实现目标检测。

还不熟悉的读者，我们先来看看，目标检测到底是什么，以及软件开发人员面临的挑战。

目标检测是借助于计算机和软件系统在图像/场景中，定位目标并识别出每个目标的类别的技术。目前已广泛用于人脸检测、车辆检测、行人计数、网络图像、安全系统和无人驾驶汽车等领域。随着计算机技术不断发展和软件开发人员的不懈努力，未来目标检测技术将更广泛的普及开来。

在应用程序和系统中使用先进的目标检测方法，以及基于这些方法构建新的应用程序并不容易。早期目标检测是基于经典算法而实现的，如 OpenCV（广受欢迎的计算机视觉库）所支持的一些算法。然而，这些经典算法的性能会因条件而受到限制。

2012年，深度学习领域取得众多突破，学者们提出了一系列全新、高精度的目标检测算法和方法，比如R-CNN, Fast-RCNN, Faster-RCNN, RetinaNet，以及既快又准的SSD和YOLO等。要使用这些基于深度学习的方法和算法（当然深度学习也是基于机器学习），需要对数学和深度学习框架有很深的理解。数百万的软件开发人员致力于整合目标检测技术进行新产品的开发。但是想要理解这项技术并加以使用，对非深度学习领域的程序员来说并不容易。

一位自学了计算机的开发者Moses Olafenwa在几个月前意识到了这个问题，并与同伴一起开发了一个名叫ImageAI的Python函数库。

ImageAI可以让程序员和软件开发者只用几行代码，就能轻易地把最先进的计算机视觉技术整合到他们现有的以及新的应用程序里面。

用ImageAI实现目标检测，你只需要以下步骤：

1. 安装Python

2. 安装ImageAI和相关函数库

3. 下载目标检测模型文件

4. 运行示例代码（只有10行）

准备工作

文摘菌测试环境为Windows 64位系统，Python版本为3.6。关注大数据文摘微信公众号，在后台回复“检测”可获取代码和模型文件~

1) 从Python官网下载并安装Python 3，并安装pip。

下载地址：

https://python.org

https://pip.pypa.io/en/stable/installing/

2）用pip安装下列依赖

找到Pyhthon安装目录下的Scripts文件夹，如C:\XXX \Python\Python36\Scripts，打开cmd命令窗口，依次输入下列安装命令即可。

1. Tensorflow：

pip install tensorflow

no => --let it run after 9 then yes

2.Numpy：

pip install numpy

3.SciPy

pip install scipy

4.OpenCV

pip install opencv-python

5.Pillow

pip install pillow

6.Matplotlib

pip install matplotlib

7. H5py

pip install h5py

8. Keras

pip install keras

9. ImageAI

pip install https://github.com/OlafenwaMoses/ImageAI/releases/download/2.0.1/imageai-2.0.1-py3-none-any.whl

注：在安装ImageAI时如果出现异常，可先下载.whl文件，并放在Scripts文件夹下，用下列命令进行安装：

pip install imageai-2.0.1-py3-none-any.whl

3) 下载用于目标检测的RetinaNet模型文件：

下载地址：

https://github.com/OlafenwaMoses/ImageAI/releases/download/1.0/resnet50_coco_best_v2.0.1.h5

准备工作到此结束，你可以写自己的第一个目标检测代码了。新建一个Python文件并命名（如FirstDetection.py），然后将下述代码写入此文件。接着将RetinaNet模型文件、FirstDetection.py和你想检测的图片放在同一路径下，并将图片命名为“image.jpg”。

下面是FirstDetection.py中的10行代码：

from imageai.Detection import ObjectDetection

import os

execution_path = os.getcwd()

detector = ObjectDetection()

detector.setModelTypeAsRetinaNet()

detector.setModelPath( os.path.join(execution_path , "resnet50_coco_best_v2.0.1.h5"))

detector.loadModel()

detections = detector.detectObjectsFromImage(input_image=os.path.join(execution_path , "image.jpg"), output_image_path=os.path.join(execution_path , "imagenew.jpg"))

for eachObject in detections:

print(eachObject["name"] + " : " + eachObject["percentage_probability"] )

然后，双击FirstDetection.py运行代码，并稍等片刻，识别结果就会在控制台打印出来。一旦结果在控制台输出，在包含FirstDetection.py的文件夹里，你会发现一张新保存的图片，文件名为“imagenew.jpg”。

注：如果运行代码时出现下列异常：

则需要安装Numpy+MKL依赖，下载对应的.whl文件并放在Scripts文件夹下，用pip安装.whl文件即可。

下载地址：

https://www.lfd.uci.edu/~gohlke/pythonlibs/#numpy

检测结果

来看看下面这2张示例图片以及经过检测后保存的新图片。

检测前：

检测后：

检测结果：

person : 55.8402955532074

person : 53.21805477142334

person : 69.25139427185059

person : 76.41745209693909

bicycle : 80.30363917350769

person : 83.58567953109741

person : 89.06581997871399

truck : 63.10953497886658

person : 69.82483863830566

person : 77.11606621742249

bus : 98.00949096679688

truck : 84.02870297431946

car : 71.98476791381836

检测结果：

person : 71.10445499420166

person : 59.28672552108765

person : 59.61582064628601

person : 75.86382627487183

motorcycle : 60.1050078868866

bus : 99.39600229263306

car : 74.05484318733215

person : 67.31776595115662

person : 63.53200078010559

person : 78.2265305519104

person : 62.880998849868774

person : 72.93365597724915

person : 60.01397967338562

person : 81.05944991111755

motorcycle : 50.591760873794556

motorcycle : 58.719027042388916

person : 71.69321775436401

bicycle : 91.86570048332214

motorcycle : 85.38855314254761

文摘菌测试了另外几张图片，结果如下：

检测前：

检测后：

检测结果：

car : 59.04694199562073

car : 50.62631368637085

car : 71.59191966056824

car : 52.60368585586548

person : 76.51243805885315

car : 56.73831105232239

car : 50.02853870391846

car : 94.18612122535706

car : 70.23521065711975

car : 75.06842017173767

car : 87.21032738685608

car : 89.46954607963562

person : 73.89532923698425

bicycle : 90.31689763069153

bus : 65.3587281703949

竟然可以检测出牛……

检测结果：

person : 55.15214800834656

person : 62.79672980308533

person : 69.01599168777466

person : 67.26776957511902

person : 75.51649808883667

person : 52.9820442199707

person : 67.23594665527344

person : 69.77047920227051

person : 83.80664587020874

person : 61.785924434661865

person : 82.354336977005

person : 93.08169484138489

cow : 84.69656705856323

检测结果：

person : 65.07909297943115

person : 65.68368077278137

person : 68.6377465724945

person : 83.80006551742554

person : 85.69389581680298

person : 55.40691018104553

person : 56.62997364997864

person : 58.07020664215088

person : 70.90385556221008

person : 95.06895542144775

代码解释

下面我们来解释一下这10行代码的含义。

from imageai.Detection import ObjectDetectionimport osexecution_path = os.getcwd()

上面3行代码中，第一行导入ImageAI的目标检测类，第二行导入Python的os类，第三行定义一个变量，用来保存Python文件、RetianNet模型文件和图片所在文件夹的路径。

detector = ObjectDetection()detector.setModelTypeAsRetinaNet()detector.setModelPath( os.path.join(execution_path , "resnet50_coco_best_v2.0.1.h5"))detector.loadModel()detections = detector.detectObjectsFromImage(input_image=os.path.join(execution_path , "image.jpg"), output_image_path=os.path.join(execution_path , "imagenew.jpg"))

上面5行代码中，第一行定义目标检测类，第二行将模型类型设置为RetinaNet，第三行将模型的路径设为RetinaNet模型文件所在路径，第四行将模型载入目标检测类，然后第五行调用检测函数，并解析输入图片和输出图片的路径。

for eachObject in detections:print(eachObject["name"] + " : " + eachObject["percentage_probability"] )

上面2行代码中，第一行迭代所有detector.detectObjectsFromImage函数返回的结果，然后，第二行打印出模型检测出的图片中每个目标的类型和概率。

ImageAI还支持配置目标检测过程中的其他功能。例如，将检测到的每个目标的图片单独提取出来。通过简单地把extract_detected_objects=True写入detectObjectsFromImage函数，目标检测类就会为图片对象集新建一个文件夹，然后提取出每个图片，将它们存入这个文件夹，并返回一个数组用来保存每个图片的路径，如下所示：

detections, extracted_images = detector.detectObjectsFromImage(input_image=os.path.join(execution_path , "image.jpg"), output_image_path=os.path.join(execution_path , "imagenew.jpg"), extract_detected_objects=True)

我们用第一个示例图片提取出来的检测结果如图所示：

参数配置

为了满足目标检测的生产需求，ImageAI提供了一些可配置的参数，包括：

Adjusting Minimum Probability（可调整最小概率阈值）

默认阈值为50%，如果检测结果的概率值低于50%，则不显示检测结果。你可以根据具体需求对该阈值进行修改。

Custom Objects Detection（自定义目标检测）

使用提供的CustomObject类，你可以让检测结果只显示特定类型的目标。

Detection Speeds（检测速度）

可以将检测速度设置为“fast”、“ faster”和“fastest”，以减少检测图片所需的时间。

Input Types（输入类型）

你可以解析并修改图像的文件路径，其中，Numpy数组，或是图片文件流都可以作为输入类型。

Output Types（输出类型）

你可以修改detectObjectsFromImage 函数的返回结果，例如返回图片文件或Numpy数组。

详细的说明文档在GitHub上，GitHub链接：

https://github.com/OlafenwaMoses/ImageAI

关注大数据文摘微信公众号，在后台回复“检测”可获取代码和模型文件~

动手试试吧，欢迎在留言区分享~

作者最新文章

赛博朋克！灵感来自枫树种子荚的多翼滑翔机，空中可分体

北京电影学院发了满是数学公式的计算机顶会论文，并开源了其代码

入职一年后，一位算法工程师给初学者的一封信

java网络编程之基础知识点总结

一行 Python 代码能实现什么丧心病狂的功能？｜CSDN博文精选

深度学习赋能视频编码

想要了解图或图神经网络？没有比看论文更好的方式

初学者如何入门编程语言

京公网安备11000002000001号

人面猴
序言：七十年代末，一起剥皮案震惊了整个滨河市，随后出现的几起案子，更是在滨河造成了极大的恐慌，老刑警刘岩，带你破解...
沈念sama阅读 211,817评论 6赞 492
死咒
序言：滨河连续发生了三起死亡事件，死亡现场离奇诡异，居然都是意外死亡，警方通过查阅死者的电脑和手机，发现死者居然都...
沈念sama阅读 90,329评论 3赞 385
救了他两次的神仙让他今天三更去死
文/潘晓璐我一进店门，熙熙楼的掌柜王于贵愁眉苦脸地迎上来，“玉大人，你说我怎么就摊上这事。” “怎么了？”我有些...
开封第一讲书人阅读 157,354评论 0赞 348
道士缉凶录：失踪的卖姜人
文/不坏的土叔我叫张陵，是天一观的道长。经常有香客问我，道长，这世上最难降的妖魔是什么？我笑而不...
开封第一讲书人阅读 56,498评论 1赞 284
港岛之恋（遗憾婚礼）
正文为了忘掉前任，我火速办了婚礼，结果婚礼上，老公的妹妹穿的比我还像新娘。我一直安慰自己，他们只是感情好，可当我...
茶点故事阅读 65,600评论 6赞 386
恶毒庶女顶嫁案：这布局不是一般人想出来的
文/花漫我一把揭开白布。她就那样静静地躺着，像睡着了一般。火红的嫁衣衬着肌肤如雪。梳的纹丝不乱的头发上，一...
开封第一讲书人阅读 49,829评论 1赞 290
城市分裂传说
那天，我揣着相机与录音，去河边找鬼。笑死，一个胖子当着我的面吹牛，可吹牛的内容都是我干的。我是一名探鬼主播，决...
沈念sama阅读 38,979评论 3赞 408
双鸳鸯连环套：你想象不到人心有多黑
文/苍兰香墨我猛地睁开眼，长吁一口气：“原来是场噩梦啊……” “哼！你这毒妇竟也来了？” 一声冷哼从身侧响起，我...
开封第一讲书人阅读 37,722评论 0赞 266
万荣杀人案实录
序言：老挝万荣一对情侣失踪，失踪者是张志新（化名）和其女友刘颖，没想到半个月后，有当地人在树林里发现了一具尸体，经...
沈念sama阅读 44,189评论 1赞 303
护林员之死
正文独居荒郊野岭守林人离奇死亡，尸身上长有42处带血的脓包…… 初始之章·张勋以下内容为张勋视角年9月15日...
茶点故事阅读 36,519评论 2赞 327
白月光启示录
正文我和宋清朗相恋三年，在试婚纱的时候发现自己被绿了。大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
茶点故事阅读 38,654评论 1赞 340
活死人
序言：一个原本活蹦乱跳的男人离奇死亡，死状恐怖，灵堂内的尸体忽然破棺而出，到底是诈尸还是另有隐情，我是刑警宁泽，带...
沈念sama阅读 34,329评论 4赞 330
日本核电站爆炸内幕
正文年R本政府宣布，位于F岛的核电站，受9级特大地震影响，放射性物质发生泄漏。R本人自食恶果不足惜，却给世界环境...
茶点故事阅读 39,940评论 3赞 313
男人毒药：我在死后第九天来索命
文/蒙蒙一、第九天我趴在偏房一处隐蔽的房顶上张望。院中可真热闹，春花似锦、人声如沸。这庄子的主人今日做“春日...
开封第一讲书人阅读 30,762评论 0赞 21
一桩弑父案，背后竟有这般阴谋
文/苍兰香墨我抬头看了看天上的太阳。三九已至，却和暖如春，着一层夹袄步出监牢的瞬间，已是汗流浃背。一阵脚步声响...
开封第一讲书人阅读 31,993评论 1赞 266
情欲美人皮
我被黑心中介骗来泰国打工，没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留，地道东北人。一个月前我还...
沈念sama阅读 46,382评论 2赞 360
代替公主和亲
正文我出身青楼，却偏偏与公主长得像，于是被迫代替她去往敌国和亲。传闻我的和亲对象是个残疾皇子，可洞房花烛夜当晚...
茶点故事阅读 43,543评论 2赞 349

2019-07-22 目标检测10行Python代码实现

推荐阅读更多精彩内容