如何用10行代码完成目标检测

PP研究思考

2020-02-28

导语

人工智能的一个重要领域是计算机视觉。计算机视觉是计算机和软件系统能够识别和理解图像和场景的科学。计算机视觉还包括图像识别、目标检测、图像生成、图像超分辨率等多个方面。由于大量的实际用例，对象检测可能是计算机视觉最深刻的方面。

目标检测是指计算机和软件系统在图像/场景中定位目标并识别每个目标的能力。目标检测已经广泛应用于人脸检测、车辆检测、行人计数、网络图像、安全系统和无人驾驶汽车。在许多领域的实践中，对象检测也有许多方法可以使用。像其他的计算机技术一样，对象检测的广泛的创造性和惊人的用途肯定会来自计算机程序员和软件开发人员的努力。

这次要介绍的一个叫做ImageAI的项目，它一个python库，让程序员和软件开发人员只需几行代码就可以轻松地将最先进的计算机视觉技术集成到他们现有的和新的应用程序中。

ImageAI安装工作

要使用ImageAI执行对象检测，您需要做的就是：

在计算机系统上安装Python
安装ImageAI及其依赖项
下载对象检测模型文件
运行示例代码(只有10行)

那么我们现在开始：

从官方Python语言网站下载并安装Python 3。
通过pip安装：TensorFlow，OpenCV, Keras, ImageAI

pip3 install tensorflow 
pip3 install opencv-python 
pip3 install keras 
pip3 install imageai --upgrade

3)通过此文章中的链接下载用于对象检测的RetinaNet模型文件：

https://towardsdatascience.com/object-detection-with-10-lines-of-code-d6cb4d86f606

运行程序

太好了。我们现在已经安装了依赖项，可以编写第一个对象检测代码了。创建一个Python文件并给它起一个名字(例如，FirstDetection.py)，然后将下面的代码写进去。将要检测的RetinaNet模型文件图像复制到包含python文件的文件夹中。

from imageai.Detection import ObjectDetection  

import os 

 execution_path =os.getcwd()  


detector = ObjectDetection()  


detector.setModelTypeAsRetinaNet()  


detector.setModelPath( os.path.join(execution_path , "resnet50_coco_best_v2.0.1.h5"))  


detector.loadModel()  

detections = detector.detectObjectsFromImage( input_image=os.path.join(execution_path , "image.jpg"), output_image_path=os.path.join(execution_path , "imagenew.jpg")) 

 for eachObject in detections:  


print(eachObject["name"] , " : " ,  

eachObject["percentage_probability"] )

需要注意的是，如果你在运行遇到这个错误：

ValueError: Unable to import backend : theano python mymodel.py

那么你可以尝试：

import osos.environ['KERAS_BACKEND'] = 'tensorflow'from  
imageai.Detection import ObjectDetection

然后运行代码并等待结果打印在控制台中。一旦结果打印到控制台中，转到您的FirstDetection.py所在的文件夹，您将发现保存了一个新图像。看看下面的两个图像样本和检测后保存的新图像。

检测前:

检测后：

数据结果

我们可以看到程序会打印输出一些各个物体的概率数据：

person : 55.8402955532074
person : 53.21805477142334
person : 69.25139427185059
person : 76.41745209693909
bicycle : 80.30363917350769
person : 83.58567953109741
person : 89.06581997871399
truck : 63.10953497886658
person : 69.82483863830566
person : 77.11606621742249
bus : 98.00949096679688
truck : 84.02870297431946
car : 71.98476791381836

可以看出来程序可以对图片中的以下目标进行检测：

人，自行车，卡车，汽车，公交车。

大家可以直接将自己希望检测的照片放到程序里面运行看看效果。

原理解释

现在让我们解释一下10行代码是如何工作的。

from imageai.Detection import ObjectDetectionimport osexecution_path  
= os.getcwd()

在上面的3行代码中，我们在第一行导入了ImageAI对象检测类，在第二行导入了python os类，并定义了一个变量来保存python文件、RetinaNet模型文件和图像所在的文件夹的路径。

detector = ObjectDetection()detector.setModelTypeAsRetinaNet()detector.setModelP 
ath( os.path.join(execution_path , "resnet50_coco_best_v2.0.1.h5"))detector.loadModel()detections =  
detector.detectObjectsFromImage(input_image=os.path.join(execution_pa 
th , "image.jpg"), output_image_path=os.path.join(execution_path ,  
"imagenew.jpg"))

在上面的代码中,我们定义对象检测类在第一线,将模型类型设置为RetinaNet在第二行,设置模型路径的路径在第三行RetinaNet模型,该模型加载到对象检测类在第四行,然后我们称为检测函数,解析输入图像的路径和输出图像路径在第五行。

计算机视觉电脑 python

安科网

如何用10行代码完成目标检测

PP研究思考

PP研究思考

相关推荐

5个优秀的计算机视觉应用与相关数据集

计算机视觉如何给企业带来不同？

计算机视觉岗常见面试题

TensorFlow2020:如何使用Tensorflow.js执行计算机视觉应用程序？

三个可能会被计算机视觉技术改变的行业

图像也能做情感迁移？罗切斯特大学团队提出计算机视觉新任务

4个计算机视觉领域用作迁移学习的模型

AI创业哪家强？6大选择给你方向

NLP/CV模型跨界，视觉Transformer赶超CNN?

可以提高你的图像识别模型准确率的7个技巧

以国家战略科学家身份，顶级AI学者朱松纯回国，筹建北京通用AI研究院

五种图像标注的简介

没有足够多的数据怎么办？计算机视觉数据增强方法总结

人工智能和物联网：智慧城市的交通管理

PG&E使用AI来降低野火风险

为什么AI感知与人类感知无法直接比较？

[ Datawhale ] 计算机视觉下 —— HOG特征描述算子

Deep Learning for Image Super-resolution: A Survey

知乎热议：未来3到5年内，哪个方向机器学习人才最稀缺？

人工智能的三大领域及其工业应用

PP研究思考