热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

用40行Python代码实践高大上的人脸识别

前言很多人都认为人脸识别是一项非常难以实现的工作,看到名字就害怕,然后心怀忐忑到网上一搜,看到网上N页的教程立马就放弃了。这些人里包括曾经


前言

很多人都认为人脸识别是一项非常难以实现的工作,看到名字就害怕,然后心怀忐忑到网上一搜,看到网上N页的教程立马就放弃了。这些人里包括曾经的我自己。其实如果如果你不是非要深究其中的原理,只是要实现这一工作的话,人脸识别也没那么难。今天我们就来看看如何在40行代码以内简单地实现人脸识别。

一点区分

对于大部分人来说,区分人脸检测和人脸识别完全不是问题。但是网上有很多教程有意无意地把人脸检测说成是人脸识别,误导群众,造成一些人认为二者是相同的。其实,人脸检测解决的问题是确定一张图上有木有人脸,而人脸识别解决的问题是这个脸是谁的。可以说人脸检测是是人识别的前期工作。

今天我们要做的是人脸识别。

所用工具

  • Anaconda 2 —— Python 2

  • Dlib

  • scikit-image

Dlib

对于今天要用到的主要工具,还是有必要多说几句的。Dlib是基于现代C++的一个跨平台通用的框架,作者非常勤奋,一直在保持更新。Dlib内容涵盖机器学习、图像处理、数值算法、数据压缩等等,涉猎甚广。更重要的是,Dlib的文档非常完善,例子非常丰富。就像很多库一样,Dlib也提供了Python的接口,安装非常简单,用pip只需要一句即可:

  1. pip install dlib

上面需要用到的 scikit-image同样只是需要这么一句:

  1. pip install scikit-image

  • 注:如果用 pip install dlib 安装失败的话,那安装起来就比较麻烦了。错误提示很详细,按照错误提示一步步走就行了。

人脸识别

之所以用 Dlib 来实现人脸识别,是因为它已经替我们做好了绝大部分的工作,我们只需要去调用就行了。Dlib里面有人脸检测器,有训练好的人脸关键点检测器,也有训练好的人脸识别模型。今天我们主要目的是实现,而不是深究原理。感兴趣的同学可以到官网查看源码以及实现的参考文献。

今天的例子既然代码不超过40行,其实是没啥难度的。有难度的东西都在源码和论文里。

首先先通过文件树看一下今天需要用到的东西:

准备了六个候选人的图片放在 candidate-faces 文件夹中,然后需要识别的人脸图片 test.jpg 。我们的工作就是要检测到 test.jpg 中的人脸,然后判断她到底是候选人中的谁。

另外的 girl-face-rec.py 是我们的python脚本。 shape_predictor_68_face_landmarks.dat是已经训练好的人脸关键点检测器。 dlib_face_recognition_resnet_model_v1.dat 是训练好的ResNet人脸识别模型。ResNet是何凯明在微软的时候提出的深度残差网络,获得了 ImageNet 2015 冠军,通过让网络对残差进行学习,在深度和精度上做到了比 CNN 更加强大。

1. 前期准备

shape_predictor_68_face_landmarks.dat和 dlib_face_recognition_resnet_model_v1.dat都可以在这里找到。不能点击超链接的可以直接输入以下网址:http://dlib.net/files/。

然后准备几个人的人脸图片作为候选人脸,最好是正脸。放到 candidate-faces 文件夹中。

本文这里准备的是六张图片,如下:

她们分别是

然后准备四张需要识别的人脸图像,其实一张就够了,这里只是要看看不同的情况:

可以看到前两张和候选文件中的本人看起来还是差别不小的,第三张是候选人中的原图,第四张图片微微侧脸,而且右侧有阴影。

2.识别流程

数据准备完毕,接下来就是代码了。识别的大致流程是这样的:

  • 先对候选人进行人脸检测、关键点提取、描述子生成后,把候选人描述子保存起来。

  • 然后对测试人脸进行人脸检测、关键点提取、描述子生成。

  • 最后求测试图像人脸描述子和候选人脸描述子之间的欧氏距离,距离最小者判定为同一个人。

3.代码

代码不做过多解释,因为已经注释的非常完善了。以下是 girl-face-rec.py

  1. # -*- coding: UTF-8 -*-

  2. import sys,os,dlib,glob,numpy

  3. from skimage import io

  4. if len(sys.argv) != 5:

  5.     print "请检查参数是否正确"

  6.     exit()

  7. # 1.人脸关键点检测器

  8. predictor_path = sys.argv[1]

  9. # 2.人脸识别模型

  10. face_rec_model_path = sys.argv[2]

  11. # 3.候选人脸文件夹

  12. faces_folder_path = sys.argv[3]

  13. # 4.需识别的人脸

  14. img_path = sys.argv[4]

  15. # 1.加载正脸检测器

  16. detector = dlib.get_frontal_face_detector()

  17. # 2.加载人脸关键点检测器

  18. sp = dlib.shape_predictor(predictor_path)

  19. # 3. 加载人脸识别模型

  20. facerec = dlib.face_recognition_model_v1(face_rec_model_path)

  21. # win = dlib.image_window()

  22. # 候选人脸描述子list

  23. descriptors = []

  24. # 对文件夹下的每一个人脸进行:

  25. # 1.人脸检测

  26. # 2.关键点检测

  27. # 3.描述子提取

  28. for f in glob.glob(os.path.join(faces_folder_path, "*.jpg")):

  29.    print("Processing file: {}".format(f))

  30.    img = io.imread(f)

  31.    #win.clear_overlay()

  32.    #win.set_image(img)

  33.    # 1.人脸检测

  34.    dets = detector(img, 1)

  35.    print("Number of faces detected: {}".format(len(dets)))

  36.    for k, d in enumerate(dets):  

  37.    # 2.关键点检测

  38.    shape = sp(img, d)

  39.    # 画出人脸区域和和关键点

  40.    # win.clear_overlay()

  41.    # win.add_overlay(d)

  42.    # win.add_overlay(shape)

  43.    # 3.描述子提取,128D向量

  44.    face_descriptor = facerec.compute_face_descriptor(img, shape)

  45.    # 转换为numpy array

  46.    v = numpy.array(face_descriptor)  

  47.    descriptors.append(v)

  48. # 对需识别人脸进行同样处理

  49. # 提取描述子,不再注释

  50. img = io.imread(img_path)

  51. dets = detector(img, 1)

  52. dist = []

  53. for k, d in enumerate(dets):

  54.    shape = sp(img, d)

  55.    face_descriptor = facerec.compute_face_descriptor(img, shape)

  56.    d_test = numpy.array(face_descriptor)

  57.    # 计算欧式距离

  58.    for i in descriptors:

  59.    dist_ = numpy.linalg.norm(i-d_test)

  60.    dist.append(dist_)

  61. # 候选人名单

  62. candidate = ['Unknown1','Unknown2','Shishi','Unknown4','Bingbing','Feifei']

  63. # 候选人和距离组成一个dict

  64. c_d = dict(zip(candidate,dist))

  65. cd_sorted = sorted(c_d.iteritems(), key=lambda d:d[1])

  66. print " The person is: ",cd_sorted[0][0]  

  67. dlib.hit_enter_to_continue()

4.运行结果

我们在 .py所在的文件夹下打开命令行,运行如下命令

python girl-face-rec.py 1.dat 2.dat ./candidate-faecs test1.jpg

由于 shape_predictor_68_face_landmarks.dat 和 dlib_face_recognition_resnet_model_v1.dat 名字实在太长,所以我把它们重命名为 1.dat 和 2.dat 。

运行结果如下:

  1. The person is Bingbing

记忆力不好的同学可以翻上去看看 test1.jpg 是谁的图片。有兴趣的话可以把四张测试图片都运行下试试。

这里需要说明的是,前三张图输出结果都是非常理想的。但是第四张测试图片的输出结果是候选人4。对比一下两张图片可以很容易发现混淆的原因。

机器毕竟不是人,机器的智能还需要人来提升。

有兴趣的同学可以继续深入研究如何提升识别的准确率。比如每个人的候选图片用多张,然后对比和每个人距离的平均值之类的。全凭自己了。


∞∞∞



IT派 - {技术青年圈}持续关注互联网、区块链、人工智能领域



公众号回复“Python”,

邀你加入{ IT派Python技术群 } 



推荐阅读
  • Python已成为全球最受欢迎的编程语言之一,然而Python程序的安全运行存在一定的风险。本文介绍了Python程序安全运行需要满足的三个条件,即系统路径上的每个条目都处于安全的位置、"主脚本"所在的目录始终位于系统路径中、若python命令使用-c和-m选项,调用程序的目录也必须是安全的。同时,文章还提出了一些预防措施,如避免将下载文件夹作为当前工作目录、使用pip所在路径而不是直接使用python命令等。对于初学Python的读者来说,这些内容将有所帮助。 ... [详细]
  • sklearn数据集库中的常用数据集类型介绍
    本文介绍了sklearn数据集库中常用的数据集类型,包括玩具数据集和样本生成器。其中详细介绍了波士顿房价数据集,包含了波士顿506处房屋的13种不同特征以及房屋价格,适用于回归任务。 ... [详细]
  • Linux重启网络命令实例及关机和重启示例教程
    本文介绍了Linux系统中重启网络命令的实例,以及使用不同方式关机和重启系统的示例教程。包括使用图形界面和控制台访问系统的方法,以及使用shutdown命令进行系统关机和重启的句法和用法。 ... [详细]
  • 开发笔记:加密&json&StringIO模块&BytesIO模块
    篇首语:本文由编程笔记#小编为大家整理,主要介绍了加密&json&StringIO模块&BytesIO模块相关的知识,希望对你有一定的参考价值。一、加密加密 ... [详细]
  • 本文讨论了clone的fork与pthread_create创建线程的不同之处。进程是一个指令执行流及其执行环境,其执行环境是一个系统资源的集合。在调用系统调用fork创建一个进程时,子进程只是完全复制父进程的资源,这样得到的子进程独立于父进程,具有良好的并发性。但是二者之间的通讯需要通过专门的通讯机制,另外通过fork创建子进程系统开销很大。因此,在某些情况下,使用clone或pthread_create创建线程可能更加高效。 ... [详细]
  • 本文介绍了机器学习手册中关于日期和时区操作的重要性以及其在实际应用中的作用。文章以一个故事为背景,描述了学童们面对老先生的教导时的反应,以及上官如在这个过程中的表现。同时,文章也提到了顾慎为对上官如的恨意以及他们之间的矛盾源于早年的结局。最后,文章强调了日期和时区操作在机器学习中的重要性,并指出了其在实际应用中的作用和意义。 ... [详细]
  • Python操作MySQL(pymysql模块)详解及示例代码
    本文介绍了使用Python操作MySQL数据库的方法,详细讲解了pymysql模块的安装和连接MySQL数据库的步骤,并提供了示例代码。内容涵盖了创建表、插入数据、查询数据等操作,帮助读者快速掌握Python操作MySQL的技巧。 ... [详细]
  • 开源Keras Faster RCNN模型介绍及代码结构解析
    本文介绍了开源Keras Faster RCNN模型的环境需求和代码结构,包括FasterRCNN源码解析、RPN与classifier定义、data_generators.py文件的功能以及损失计算。同时提供了该模型的开源地址和安装所需的库。 ... [详细]
  • 超级简单加解密工具的方案和功能
    本文介绍了一个超级简单的加解密工具的方案和功能。该工具可以读取文件头,并根据特定长度进行加密,加密后将加密部分写入源文件。同时,该工具也支持解密操作。加密和解密过程是可逆的。本文还提到了一些相关的功能和使用方法,并给出了Python代码示例。 ... [详细]
  • VScode格式化文档换行或不换行的设置方法
    本文介绍了在VScode中设置格式化文档换行或不换行的方法,包括使用插件和修改settings.json文件的内容。详细步骤为:找到settings.json文件,将其中的代码替换为指定的代码。 ... [详细]
  • 本文讨论了一个关于cuowu类的问题,作者在使用cuowu类时遇到了错误提示和使用AdjustmentListener的问题。文章提供了16个解决方案,并给出了两个可能导致错误的原因。 ... [详细]
  • 怀疑是每次都在新建文件,具体代码如下 ... [详细]
  • 本文介绍了操作系统的定义和功能,包括操作系统的本质、用户界面以及系统调用的分类。同时还介绍了进程和线程的区别,包括进程和线程的定义和作用。 ... [详细]
  • java drools5_Java Drools5.1 规则流基础【示例】(中)
    五、规则文件及规则流EduInfoRule.drl:packagemyrules;importsample.Employ;ruleBachelorruleflow-group ... [详细]
  • 本文讨论了如何使用GStreamer来删除H264格式视频文件中的中间部分,而不需要进行重编码。作者提出了使用gst_element_seek(...)函数来实现这个目标的思路,并提到遇到了一个解决不了的BUG。文章还列举了8个解决方案,希望能够得到更好的思路。 ... [详细]
author-avatar
zj
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有