当前位置: 开发笔记 > 编程语言 > 正文

python计算机视觉基于(BOW)的图像检索与识别

作者：ll66068ll你 | 来源：互联网 | 2023-08-20 18:53

目录前言一、基本原理1.1图像分类简介1.2Bag-of-words模型1.3Bag-of-features模型1.4Bag-of-features算法1.5Bag-

前言

一、基本原理

1.1 图像分类简介

1.2 Bag-of-words模型

1.3 Bag-of-features模型

1.4 Bag-of-features算法

1.5 Bag-of-features过程

1.6 TF-IDF

二、代码实现

2.1 数据集

2.2 创建词汇

2.3 建立数据库

2.4 在数据库中搜素图像

2.5 遇到的问题

参考文章

前言
本次实验将参照Bag-of-words模型实现简单的图像检索操作。
环境&＃xff1a;Pycharm&＃xff0c;python3.8.5

一、基本原理

1.1 图像分类简介

图像分类&＃xff0c;即通过图像内容的不同将图像划分为不同的类别&＃xff0c;基于内容的图像分类技术不需要对图像的语义信息进行人工标注&＃xff0c;而是通过计算机提取图像中所包含的特征&＃xff0c;并对特征进行处理和分析&＃xff0c;得出分类结果。

常用的图像特征有色彩、纹理、灰度等信息。而图像分类过程中&＃xff0c;提取的特征要求不容易受随机因素干扰&＃xff0c;特征的有效提取可提高图像分类的精度。特征提取完成后&＃xff0c;选择合适的算法创建图像类型与视觉特征之间的关联度&＃xff0c;对图像进行类别划分。

图像分类领域中&＃xff0c;根据图像分类要求&＃xff0c;一般可以分为 场景分类和 目标分类两类问题。
场景分类指的是从多幅图像中区分出具有相似场景特征的图像。
目标分类指的是对图像中出现的目标 (物体)进行识别或分类。

1.2 Bag-of-words模型

Bow起始可以理解为一种直方图统计&＃xff0c;开始是用于自然语言处理和信息检索中的一种简单的文档表示方法。BoW也只是统计频率信息&＃xff0c;并没有序列信息。Bow是选择words字典&＃xff0c;然后统计字典中每个单词出现的次数。

BoW(Bag of Words)词袋模型最初被用在文本分类中&＃xff0c;将文档表示成特征矢量。它的基本思想是假定对于一个文本&＃xff0c;忽略其词序和语法、句法&＃xff0c;仅仅将其看做是一些词汇的集合&＃xff0c;而文本中的每个词汇都是独立的。简单说就是将每篇文档都看成一个袋子&＃xff08;因为里面装的都是词汇&＃xff0c;所以称为词袋&＃xff0c;Bag of words即因此而来&＃xff09;&＃xff0c;然后看这个袋子里装的都是些什么词汇&＃xff0c;将其分类。如果一篇文档中猪、马、牛、羊、山谷、土地、拖拉机这样的词汇多些&＃xff0c;而银行、大厦、汽车、公园这样的词汇少些&＃xff0c;我们就倾向于判断它是一篇描绘乡村的文档&＃xff0c;而不是描述城镇的。

1.3 Bag-of-features模型

Bag of Feature 也是借鉴了这种思路&＃xff0c;只不过在图像中&＃xff0c;我们抽出的不再是一个个word&＃xff0c;而是图像的关键特征Feature&＃xff0c;所以研究人员将它更名为Bag of Feature。
Bag of Feature在检索中的算法流程和分类几乎完全一样&＃xff0c;唯一的区别在于&＃xff0c;对于原始的 BOF 特征&＃xff0c;也就是直方图向量&＃xff0c;我们引入TF-IDF 权值。

1.4 Bag-of-features算法

Bag of Feature的本质是提出一种图像的特征表示方法

按照Bag of Feature算法的思想&＃xff0c;首先我们要找到图像中的关键特征&＃xff0c;而且这些关键特征必须具备较高的区分度。实际过程中&＃xff0c;通常会采用SIFT特征。

有了特征之后&＃xff0c;我们会将这些特征通过聚类算法得出很多聚类中心。这些聚类中心通常具有较高的代表性&＃xff0c;比如&＃xff0c;对于人脸来说&＃xff0c;虽然不同人的眼睛、鼻子等特征都不尽相同&＃xff0c;但它们往往具有共性&＃xff0c;而这些聚类中心就代表了这类共性。我们将这些聚类中心组合在一起&＃xff0c;形成一部视觉词典&＃xff08;visual vocabulary&＃xff09;。

对于图像中的每个SIFT特征&＃xff0c;我们能够在字典中找到最相似的聚类中心&＃xff0c;统计这些聚类中心出现的次数&＃xff0c;可以得到一个向量表示&＃xff08;有些文章称之为直方图&＃xff09;这些向量就是所谓的Bag。这样&＃xff0c;对于不同类别的图片&＃xff0c;这个向量应该具有较大的区分度&＃xff0c;基于此&＃xff0c;我们可以训练出一些分类模型&＃xff08;SVM等&＃xff09;&＃xff0c;并用其对图片进行分类。

1.5 Bag-of-features过程

算法流程&＃xff1a;

提取图像特征
对特征进行聚类&＃xff0c;得到一部视觉字典( visual vocabulary )
针对输入特征集&＃xff0c;根据视觉词典进行量化
把输入图像根据TF-IDF转化成视觉单词的频率直方图
构造特征到图像的倒排表&＃xff0c;通过倒排表快速索引相关图像
根据索引结果进行直方图匹配

&＃xff08;1&＃xff09;提取图像特征

特征提取及描述主要是将一些 具有代表性且 区分性较强的 全局或局部特征从图像中进行抽取&＃xff0c;并对这些特征进行描述。
这些特征一般是类别之间差距比较明显的特征&＃xff0c;可以将其与其他类别区分开&＃xff0c;其次&＃xff0c;这些特征还要求具有 较好的稳定性&＃xff0c;能够最大限度的在光照、视角、尺度、噪声以及各种外在因素变化的情况下保持稳定&＃xff0c;不受其影响。这样即使在非常复杂的情况下&＃xff0c;计算机也能通过这些稳定的特征很好的检测与识别出这个物体。

特征提取最简单且有效的方法就是 规则网格方法&＃xff0c;
该方法采用均匀网格对图像进行划分&＃xff0c;从而得到图像的局部区域特征。

兴趣点检测方法是另一个有效的特征提取方法&＃xff0c;兴趣点检测的基本思想是:
在人为判断一幅图像的类别时&＃xff0c;首先捕捉到物体的整体轮廓特征&＃xff0c;然后聚焦于物体与其他物体具有显著特征区别的地方&＃xff0c;最后判断出图像的类别。即通过该物体与其他物体区别开的显著特征&＃xff0c;进而判断图像的类别。

在提取完图像的特征后&＃xff0c;下一步就要应用特征描述子来对抽取的图像特征进行描述&＃xff0c;特征描述子所表示的特征向量一般在处理算法时会作为输入数据,因此&＃xff0c;如果描述子具有一定的判别性及可区分性&＃xff0c;则该描述子会在后期的图像处理过程中起着很大的作用。

SIFT描述子是近年比较经典且被广泛应用的一种描述子。
SIFT会从图片上提取出很多特征点&＃xff0c;每个特征点都是128维的向量&＃xff0c;因此&＃xff0c;如果图片足够多的话,我们会提取出一个巨大的特征向量库。

&＃xff08;2&＃xff09; 学习视觉词典&＃xff08;visual vocabulary&＃xff09;

提取完特征后&＃xff0c;我们会采用一些聚类算法对这些特征向量进行聚类。

最常用的聚类算法是 &＃xff1a;k-means。

K-means算法是度量样本间相似性的一种方法&＃xff0c;该算法设置参数为K&＃xff0c;把N个对象分成K个簇&＃xff0c;簇内之间的相似度较高&＃xff0c;而簇间的相似度较低。

至于 K-means 中的 K如何取&＃xff0c;要根据具体情况来确定。另外&＃xff0c;由于特征的数量可能非常庞大&＃xff0c;这个聚类的过程也会非常漫长。聚类完成后得到K个聚类中心&＃xff0c;每个聚类中心称为“视觉单词”&＃xff0c;而将所有视觉单词组成的集合称为视觉词典/码本&＃xff08;codebook&＃xff09;。构建视觉单词的过程如图所示&＃xff1a;

关于码本的大小&＃xff1a;

&＃xff08;1&＃xff09;如果码本规模太小&＃xff0c;我们的视觉词典不能包括所有可能的情况&＃xff1b;

&＃xff08;2&＃xff09;如果码本过大&＃xff0c;会使得计算量增加&＃xff0c;且有过拟合现象出现。

&＃xff08;3&＃xff09;图片直方图表示

利用视觉词典中的词汇表示待分类图像。计算每幅图像中的SIFT特征到这K个视觉单词的距离&＃xff0c;
其中 距离最近的视觉单词为该SIFT特征对应的视觉单词。
通过统计每个单词在图像中出现的次数&＃xff0c;将图像表示成一个K维数值向量&＃xff0c;
如图所示&＃xff0c;其中K&＃61;4&＃xff0c;每幅图像用直方图进行描述:

&＃xff08;4&＃xff09;量化

这一步骤通过对图像特征提取&＃xff0c;然后将提取出来的特征点&＃xff0c;根据第三步&＃xff0c;转换为频率直方图。

这里在转换为频率直方图时候&＃xff0c;有使用到TF-IDF&＃xff0c;即词频(Term Frequency&＃xff0c;TF)与逆文档频率(Inverse Document Frequency&＃xff0c;IDF)乘积作为权值。引入这个权值的目的是为了降低一些重复特征所带来的影响。比如在BOW中&＃xff0c;一些常用词汇譬如the&＃xff0c;it&＃xff0c;do等等词汇&＃xff0c;不能体现文本内容特征&＃xff0c;但是出现频率却很高&＃xff0c;利用tf-idf可以降低这种不必要词汇的影响。同理&＃xff0c;在BOF图像搜索中&＃xff0c;图像之间也会有这样的无意义的特征出现&＃xff0c;所以需要降低这类特征的权值。

&＃xff08;5&＃xff09;构造倒排表

倒排表是一种逆向的查找方式&＃xff0c;在BOW中大体的思路是通过已经提取出来的词汇&＃xff0c;反向查找出现过这个词汇的文章。如图&＃xff0c;查找多个词汇&＃xff0c;就形成了一个倒排表。

BOF中倒排表也是同理。通过对视觉词汇的反向查找&＃xff0c;就会得到拥有同一视觉词汇的图像集合&＃xff0c;反复多次就能得到一张倒排表。倒排表可以快速的得到新的图像与数据库里相似的图像。

&＃xff08;6&＃xff09;匹配直方图

当我们做完上面的步骤&＃xff0c;就需要对直方图进行匹配。直方图的匹配给出输入图像的频率直方图&＃xff0c;在数据库中查找K个最近邻的图像&＃xff0c;根据这K个近邻来投票图像的分类结果。

1.6 TF-IDF

TF-IDF(Term frequency-Inverse document frequency)是一种统计方法&＃xff0c;用来评估特征词的重要程度。根据TF-IDF公式&＃xff0c;特征词的权重与在 语料库中出现的频率有关&＃xff0c;也与在文档里出现的频率有关。传统的TF-IDF公式如下:

TF-IDF用以评估一字词对于一个文件集或一个语料库中的其中一份文件的重要程度。字词的重要性随着它在文件中出现的次数成正比增加&＃xff0c;但同时会随着它在语料库中出现的频率成反比下降。就目前来说&＃xff0c;如果一个 关键词只在很少的网页中出现&＃xff0c;我们通过它就容易锁定搜索目标&＃xff0c;它的权重也就应该大。反之如果一个词在大量网页中出现&＃xff0c;我们看到它仍然不是很清楚要找什么内容&＃xff0c;因此它的权重应该小。

TF-IDF公式详细介绍&＃xff1a;CSDN编程社区 (smartapps.cn)

二、代码实现

2.1 数据集

通过爬虫在百度爬取三类图片各60张&＃xff0c;并利用批处理工具将所有数据图像裁剪成一致大小&＃xff0c;统一裁剪为640*480

A场景&＃xff1a;60张汽车图片

B场景&＃xff1a;60张猫的图像

C场景&＃xff1a;60张小狗的图像

2.2 创建词汇

createSift.py

# -*- coding: utf-8 -*- """ &＃64;author: RRJ &＃64;software: PyCharm &＃64;file: createSift.py &＃64;time: 2022/6/12 22:44 """ import pickle from newPCV.imagesearch import vocabulary from newPCV.tools.imtools import get_imlist from newPCV.Localdescriptors import sift# 获取图像列表 imlist &＃61; get_imlist(&＃39;D:\\python\\RRJ\\pycharmproject\\Bag_of_words\\Imgtrain\\BOW_train\\&＃39;) nbr_images &＃61; len(imlist) # 获取特征列表 featlist &＃61; [imlist[i][:-3] &＃43; &＃39;sift&＃39; for i in range(nbr_images)]# 提取文件夹下图像的sift特征 for i in range(nbr_images):sift.process_image(imlist[i], featlist[i])# 生成词汇 voc &＃61; vocabulary.Vocabulary(&＃39;training&＃39;) voc.train(featlist, 180, 10)# 保存词汇 # saving vocabulary with open(&＃39;D:\\python\\RRJ\\pycharmproject\\Bag_of_words\\BOW\\vocabulary.pkl&＃39;, &＃39;wb&＃39;) as f:pickle.dump(voc, f) print(&＃39;vocabulary is:&＃39;, voc.name, voc.nbr_words)

训练函数&＃xff1a;train

def train(self,featurefiles,k&＃61;100,subsampling&＃61;10):""" 用含有k个单词的 K-means 列出在 featurefiles 中的特征文件训练出一个词汇。对训练数据下采样可以加快训练速度 """nbr_images &＃61; len(featurefiles)# 从文件中读取特征descr &＃61; []descr.append(sift.read_features_from_file(featurefiles[0])[1])# 将所有的特征并在一起&＃xff0c;以便后面进行 K-means 聚类descriptors &＃61; descr[0]for i in arange(1,nbr_images):descr.append(sift.read_features_from_file(featurefiles[i])[1])descriptors &＃61; vstack((descriptors,descr[i]))#K-means: 最后一个参数决定运行次数self.voc,distortion &＃61; kmeans(descriptors[::subsampling,:],k,1)self.nbr_words &＃61; self.voc.shape[0]# 遍历所有的训练图像&＃xff0c;并投影到词汇上imwords &＃61; zeros((nbr_images,self.nbr_words))for i in range( nbr_images ):imwords[i] &＃61; self.project(descr[i])nbr_occurences &＃61; sum( (imwords > 0)*1 ,axis&＃61;0)self.idf &＃61; log( (1.0*nbr_images) / (1.0*nbr_occurences&＃43;1) )self.trainingdata &＃61; featurefilesdef project(self,descriptors):""" 将描述子投影到词汇上&＃xff0c;以创建单词直方图 """# 图像单词直方图imhist &＃61; zeros((self.nbr_words))words,distance &＃61; vq(descriptors,self.voc)for w in words:imhist[w] &＃43;&＃61; 1return imhist

部分结果&＃xff1a;

同时生成了数据模型vocabulary.pkl&＃xff0c;如果数据模型为空&＃xff0c;在后面存入数据库会出现报错&＃xff0c;读入数据为空。判断.pkl是否为空可根据查看它的大小&＃xff0c;如下图所示&＃xff0c;这里pkl为196KB&＃xff0c;故不为空。

2.3 建立数据库

将上面得到的数据模型存放数据库testImaAdd.db中&＃xff0c;即运行下面代码会生成一个testImaAdd.db数据库文件。

createDatabase.py

# -*- coding: utf-8 -*- """ &＃64;author: RRJ &＃64;software: PyCharm &＃64;file: createDatabase.py &＃64;time: 2022/6/12 23:20 """ import pickle from newPCV.imagesearch import imagesearch from newPCV.Localdescriptors import sift import sqlite3 from newPCV.tools.imtools import get_imlist# 获取图像列表 # imlist &＃61; get_imlist(&＃39;E:/Python37_course/test7/first1000/&＃39;) imlist &＃61; get_imlist(&＃39;D:\\python\\RRJ\\pycharmproject\\Bag_of_words\\Imgtrain\\BOW_train\\&＃39;) nbr_images &＃61; len(imlist) # 获取特征列表 featlist &＃61; [imlist[i][:-3] &＃43; &＃39;sift&＃39; for i in range(nbr_images)]# load vocabulary # 载入词汇 with open(&＃39;../BOW/vocabulary.pkl&＃39;, &＃39;rb&＃39;) as f:voc &＃61; pickle.load(f) # 创建索引 indx &＃61; imagesearch.Indexer(&＃39;testImaAdd.db&＃39;, voc) indx.create_tables()# go through all images, project features on vocabulary and insert # 遍历所有的图像&＃xff0c;并将它们的特征投影到词汇上(比如我的是180张图片) for i in range(nbr_images)[:179]:locs, descr &＃61; sift.read_features_from_file(featlist[i])indx.add_to_index(imlist[i], descr) # commit to database # 提交到数据库 indx.db_commit()con &＃61; sqlite3.connect(&＃39;testImaAdd.db&＃39;) print(con.execute(&＃39;select count (filename) from imlist&＃39;).fetchone()) print(con.execute(&＃39;select * from imlist&＃39;).fetchone())

运行结果&＃xff1a;

2.4 在数据库中搜素图像

利用索引获取候选图像 &＃43; 用一幅图像进行查询 &＃43; 确定对比基准并绘制结果
建立好图像的索引&＃xff0c;就可以在数据库中搜索相似的图像了。这里&＃xff0c;使用BOW&＃xff08;词袋模型&＃xff09;来表示整个图像&＃xff0c;这是通用的&＃xff0c;可以应用于寻找相似的物体、相似的脸、相似的颜色等&＃xff0c;它完全取决于图像及所用的描述子。为了实现搜索&＃xff0c;在Imagesearch.py中有Searcher类:

Searcher 类: class Searcher(object):def __init__(self,db,voc):""" Initialize with the name of the database. """self.con &＃61; sqlite3.connect(db)self.voc &＃61; vocdef __del__(self):self.con.close()def get_imhistogram(self,imname):""" Return the word histogram for an image. """im_id &＃61; self.con.execute("select rowid from imlist where filename&＃61;&＃39;%s&＃39;" % imname).fetchone()s &＃61; self.con.execute("select histogram from imhistograms where rowid&＃61;&＃39;%d&＃39;" % im_id).fetchone()# use pickle to decode NumPy arrays from stringreturn pickle.loads(s[0])def candidates_from_word(self,imword):""" Get list of images containing imword. """im_ids &＃61; self.con.execute("select distinct imid from imwords where wordid&＃61;%d" % imword).fetchall()return [i[0] for i in im_ids]def candidates_from_histogram(self,imwords):""" Get list of images with similar words. """# get the word idswords &＃61; imwords.nonzero()[0]# find candidatescandidates &＃61; []for word in words:c &＃61; self.candidates_from_word(word)candidates&＃43;&＃61;c# take all unique words and reverse sort on occurrencetmp &＃61; [(w,candidates.count(w)) for w in set(candidates)]tmp.sort(key&＃61;cmp_to_key(lambda x,y:operator.gt(x[1],y[1])))tmp.reverse()# return sorted list, best matches first return [w[0] for w in tmp]def query(self,imname):""" Find a list of matching images for imname. """h &＃61; self.get_imhistogram(imname)candidates &＃61; self.candidates_from_histogram(h)matchscores &＃61; []for imid in candidates:# get the namecand_name &＃61; self.con.execute("select filename from imlist where rowid&＃61;%d" % imid).fetchone()cand_h &＃61; self.get_imhistogram(cand_name)cand_dist &＃61; sqrt( sum( self.voc.idf*(h-cand_h)**2 ) )matchscores.append( (cand_dist,imid) )# return a sorted list of distances and database idsmatchscores.sort()return matchscoresdef get_filename(self,imid):""" Return the filename for an image id. """s &＃61; self.con.execute("select filename from imlist where rowid&＃61;&＃39;%d&＃39;" % imid).fetchone()return s[0]def tf_idf_dist(voc,v1,v2):v1 /&＃61; sum(v1)v2 /&＃61; sum(v2)return sqrt( sum( voc.idf*(v1-v2)**2 ) )def compute_ukbench_score(src,imlist):""" Returns the average number of correctimages on the top four results of queries. """nbr_images &＃61; len(imlist)pos &＃61; zeros((nbr_images,4))# get first four results for each imagefor i in range(nbr_images):pos[i] &＃61; [w[1]-1 for w in src.query(imlist[i])[:4]]# compute score and return averagescore &＃61; array([ (pos[i]//4)&＃61;&＃61;(i//4) for i in range(nbr_images)])*1.0return sum(score) / (nbr_images)

使用几何特性对结果排序
这是一种是常用BOW模型改进检索结果的常用方法。BOW模型的一个主要缺点是在用视觉单词表示图像时不包含图像特征的位置信息&＃xff0c;这是为了 获取速度和可伸缩性而付出的代价。最常用的方法是在查询图像与靠前图像的特征位置间拟合单应性。

# -*- coding: utf-8 -*- """ &＃64;author: RRJ &＃64;software: PyCharm &＃64;file: searchImg.py &＃64;time: 2022/6/13 0:43 """import pickle from newPCV.Localdescriptors import sift from newPCV.imagesearch import imagesearch from newPCV.geometry import homography from newPCV.tools.imtools import get_imlist# load image list and vocabulary # 载入图像列表 imlist &＃61; get_imlist(&＃39;D:\\python\\RRJ\\pycharmproject\\Bag_of_words\\Imgtrain\\BOW_train\\&＃39;) # 存放数据集的路径 nbr_images &＃61; len(imlist) # 载入特征列表 featlist &＃61; [imlist[i][:-3] &＃43; &＃39;sift&＃39; for i in range(nbr_images)]# 载入词汇 with open(&＃39;../BOW/vocabulary.pkl&＃39;, &＃39;rb&＃39;) as f: # 存放模型的路径voc &＃61; pickle.load(f) src &＃61; imagesearch.Searcher(&＃39;testImaAdd.db&＃39;, voc)# index of query image and number of results to return # 查询图像索引和查询返回的图像数 q_ind &＃61; 18 nbr_results &＃61; 5# regular query # 常规查询(按欧式距离对结果排序) res_reg &＃61; [w[1] for w in src.query(imlist[q_ind])[:nbr_results]] print(&＃39;top matches (regular):&＃39;, res_reg)# load image features for query image # 载入查询图像特征 q_locs, q_descr &＃61; sift.read_features_from_file(featlist[q_ind]) fp &＃61; homography.make_homog(q_locs[:, :2].T)# RANSAC model for homography fitting # 用单应性进行拟合建立RANSAC模型 model &＃61; homography.RansacModel() rank &＃61; {}# load image features for result # 载入候选图像的特征 for ndx in res_reg[1:]:locs, descr &＃61; sift.read_features_from_file(featlist[ndx]) # because &＃39;ndx&＃39; is a rowid of the DB that starts at 1# get matches# 获取匹配数 # get matches执行完后会出现两张图片matches &＃61; sift.match(q_descr, descr)ind &＃61; matches.nonzero()[0]ind2 &＃61; matches[ind]tp &＃61; homography.make_homog(locs[:, :2].T)# compute homography, count inliers. if not enough matches return empty list# 计算单应性&＃xff0c;对内点技术。如果没有足够的匹配书则返回空列表try:H, inliers &＃61; homography.H_from_ransac(fp[:, ind], tp[:, ind2], model, match_theshold&＃61;4)except:inliers &＃61; []# store inlier countrank[ndx] &＃61; len(inliers)# 将字典排序&＃xff0c;以首先获取最内层的内点数 sorted_rank &＃61; sorted(rank.items(), key&＃61;lambda t: t[1], reverse&＃61;True) res_geom &＃61; [res_reg[0]] &＃43; [s[0] for s in sorted_rank] print(&＃39;top matches (homography):&＃39;, res_geom)# 显示查询结果 imagesearch.plot_results(src, res_reg[:8]) # 常规查询 imagesearch.plot_results(src, res_geom[:8]) # 重排后的结果

查询索引为18的图像&＃xff0c;运行结果&＃xff1a;

查询图像在最左边&＃xff0c;后面都是按图像列表检索的前5幅图像。
对输出的结果&＃xff0c;首先是载入图像列表、特征列表及词汇。然后创建一个Searcher对象&＃xff0c;执行定期查询&＃xff0c;并将结果保存在res_reg列表中&＃xff0c;然后载入res_reg列表中每一幅图像特征&＃xff0c;并和查询的图像进行匹配。通过计算匹配数和计数内点数得到&＃xff0c;最终可通过减少内点数目对包含图像索引和内点数的字典进行排序。最后可视化检索靠前的匹配图像结果。

查询索引为100的图像&＃xff0c;运行结果&＃xff1a;

可见在此处搜素出现了错误图像&＃xff0c;而且明显发现两类图像差别明显&＃xff0c;猜测错误原因是数据集太小或者K太大的缘故。

2.5 遇到的问题

&＃xff08;1&＃xff09;ModuleNotFoundError: No module named &＃39;pysqlite2&＃39;

解决方法&＃xff1a;网上查阅&＃xff0c;python3已经不支持pysqlite2这个库了&＃xff0c;找自己 imagesearch.py 文件的所在的路径&＃xff0c;把红线区域的修改为如图示&＃xff0c;并且保证自己的python已经成功安装了 pysqlite3 包。

&＃xff08;2&＃xff09;TypeError: &＃39;cmp&＃39; is an invalid keyword argument for sort()

解决方法&＃xff1a;找到目标文件按下图修改

&＃xff08;3&＃xff09;TypeError: a bytes-like object is required, not &＃39;str&＃39;

解决方法&＃xff1a;

参考文章
&＃xff08;1&＃xff09;计算机视觉——图像检索与识别_Nikki_du的博客-CSDN博客_图像识别和图像检索
&＃xff08;2&＃xff09;python计算机视觉-图像检索和识别_我超爱Debug的博客-CSDN博客_python视觉识别

推荐阅读

文件
如何实现织梦DedeCms全站伪静态

本文介绍了如何通过修改织梦DedeCms源代码来实现全站伪静态，以提高管理和SEO效果。全站伪静态可以避免重复URL的问题，同时通过使用mod_rewrite伪静态模块和.htaccess正则表达式，可以更好地适应搜索引擎的需求。文章还提到了一些相关的技术和工具，如Ubuntu、qt编程、tomcat端口、爬虫、php request根目录等。 ... [详细]

蜡笔小新 2023-12-14 19:45:47
install
如何通过conda安装Selenium的wheel文件

本文介绍了如何通过conda安装Selenium的wheel文件，包括查看环境、卸载旧版本、下载新版本的wheel文件以及安装操作的步骤。同时提供了使用清华源的方法。 ... [详细]

蜡笔小新 2023-12-12 21:09:47
main
Python爬虫技术基础篇面向对象高级编程（中）的多重继承

本文介绍了Python爬虫技术基础篇面向对象高级编程（中）中的多重继承概念。通过继承，子类可以扩展父类的功能。文章以动物类层次的设计为例，讨论了按照不同分类方式设计类层次的复杂性和多重继承的优势。最后给出了哺乳动物和鸟类的设计示例，以及能跑、能飞、宠物类和非宠物类的增加对类数量的影响。 ... [详细]

蜡笔小新 2023-12-12 16:19:02
utf-8
Python基础篇：315道题目及答案整理，帮助你检验学习成果

本文整理了315道Python基础题目及答案，帮助读者检验学习成果。文章介绍了学习Python的途径、Python与其他编程语言的对比、解释型和编译型编程语言的简述、Python解释器的种类和特点、位和字节的关系、以及至少5个PEP8规范。对于想要检验自己学习成果的读者，这些题目将是一个不错的选择。请注意，答案在视频中，本文不提供答案。 ... [详细]

蜡笔小新 2023-12-10 14:33:46
js
【爬虫】关于企业信用信息公示系统加速乐最新反爬虫机制

(￣▽￣)~又得半夜修仙了，作为一个爬虫小白，花了3天时间写好的程序，才跑了一个月目标网站就更新了，是有点悲催，还是要只有一天的时间重构。升级后网站的层次结构并没有太多变化，表面上 ... [详细]

蜡笔小新 2023-10-17 19:24:48
js
SQL日志收缩及截断方法详解

本文详细介绍了SQL日志收缩的方法，包括截断日志和删除不需要的旧日志记录。通过备份日志和使用DBCC SHRINKFILE命令可以实现日志的收缩。同时，还介绍了截断日志的原理和注意事项，包括不能截断事务日志的活动部分和MinLSN的确定方法。通过本文的方法，可以有效减小逻辑日志的大小，提高数据库的性能。 ... [详细]

蜡笔小新 2023-12-14 18:23:25
utf-8
Python3中选择文件对话框的格式打开和保存图片

本文介绍了在Python3中如何使用选择文件对话框的格式打开和保存图片的方法。通过使用tkinter库中的filedialog模块的asksaveasfilename和askopenfilename函数，可以方便地选择要打开或保存的图片文件，并进行相关操作。具体的代码示例和操作步骤也被提供。 ... [详细]

蜡笔小新 2023-12-14 17:46:55
utf-8
C#学习教程：在Console中工作但在Windows窗体中不工作的异步代码分享

本文分享了一个关于在C#中使用异步代码的问题，作者在控制台中运行时代码正常工作，但在Windows窗体中却无法正常工作。作者尝试搜索局域网上的主机，但在窗体中计数器没有减少。文章提供了相关的代码和解决思路。 ... [详细]

蜡笔小新 2023-12-14 15:56:00
utf-8
Metasploit攻击渗透实践

本文介绍了Metasploit攻击渗透实践的内容和要求，包括主动攻击、针对浏览器和客户端的攻击，以及成功应用辅助模块的实践过程。其中涉及使用Hydra在不知道密码的情况下攻击metsploit2靶机获取密码，以及攻击浏览器中的tomcat服务的具体步骤。同时还讲解了爆破密码的方法和设置攻击目标主机的相关参数。 ... [详细]

蜡笔小新 2023-12-14 12:14:09
email
解决Cydia数据库错误：could not open file /var/lib/dpkg/status 的方法

本文介绍了解决iOS系统中Cydia数据库错误的方法。通过使用苹果电脑上的Impactor工具和NewTerm软件，以及ifunbox工具和终端命令，可以解决该问题。具体步骤包括下载所需工具、连接手机到电脑、安装NewTerm、下载ifunbox并注册Dropbox账号、下载并解压lib.zip文件、将lib文件夹拖入Books文件夹中，并将lib文件夹拷贝到/var/目录下。以上方法适用于已经越狱且出现Cydia数据库错误的iPhone手机。 ... [详细]

蜡笔小新 2023-12-13 19:02:44
email
计算机存储系统的层次结构及其优势

本文介绍了计算机存储系统的层次结构，包括高速缓存、主存储器和辅助存储器三个层次。通过分层存储数据可以提高程序的执行效率。计算机存储系统的层次结构将各种不同存储容量、存取速度和价格的存储器有机组合成整体，形成可寻址存储空间比主存储器空间大得多的存储整体。由于辅助存储器容量大、价格低，使得整体存储系统的平均价格降低。同时，高速缓存的存取速度可以和CPU的工作速度相匹配，进一步提高程序执行效率。 ... [详细]

蜡笔小新 2023-12-13 17:32:41
utf-8
Python爬虫中使用正则表达式的方法和注意事项

本文介绍了在Python爬虫中使用正则表达式的方法和注意事项。首先解释了爬虫的四个主要步骤，并强调了正则表达式在数据处理中的重要性。然后详细介绍了正则表达式的概念和用法，包括检索、替换和过滤文本的功能。同时提到了re模块是Python内置的用于处理正则表达式的模块，并给出了使用正则表达式时需要注意的特殊字符转义和原始字符串的用法。通过本文的学习，读者可以掌握在Python爬虫中使用正则表达式的技巧和方法。 ... [详细]

蜡笔小新 2023-12-12 11:51:07
utf-8
分享css中提升优先级属性!important的用法总结

web前端|css教程css!importantweb前端-css教程本文分享css中提升优先级属性!important的用法总结微信门店展示源码,vscode如何管理站点,ubu ... [详细]

蜡笔小新 2023-12-11 11:25:16
js
mui框架offcanvas侧滑超出部分隐藏无法滚动如何解决

web前端|js教程off-canvas,部分,超出web前端-js教程mui框架中off-canvas侧滑的一个缺点就是无法出现滚动条，因为它主要用途是设置类似于qq界面的那种格 ... [详细]

蜡笔小新 2023-10-17 20:40:03
main
七月在线爬虫班学习笔记（七）——高级内容-并发编程

第七课主要内容：多进程多线程FIFO,LIFO,优先队列线程局部变量进程与线程的选择线程池异步IO概念及twisted案例股票数据抓取 ... [详细]

蜡笔小新 2023-10-17 20:16:36