热门标签 | HotTags
当前位置:  开发笔记 > 前端 > 正文

关于“网页相似度”相关问题的全面讲解

站长在进行网站建设的时候,有时候会遇到一个问题,那就是网页相似度的问题。什么是网页相似度呢?所谓网页相似度,简单的说就是两个网页的相似程度。这两个网页可以是同一个网

 

  站长在进行网站建设的时候,有时候会遇到一个问题,那就是网页相似度的问题。什么是网页相似度呢?所谓网页相似度,简单的说就是两个网页的相似程度。这两个网页可以是同一个网站上的网页,也可以不是同一个网站上的网页,也既是其他网站上的网页。搜索引擎在收录网页的时候,通常会对两个网页进行比较,看看两个网页是否相似。所谓相似,就是说两个网页在页面内容的大部分都是相同的,这时候就可以认为两个网页是相似的。搜索引擎在比较两个网页的时候,是采用一定的算法来进行比较,搜索引擎通常会采用两种方法来进行比较:一种是根据网页摘要来比较,如果多个网页摘要的 md5 值一样,证明这些网页具有很高的相似度。另一种是根据网页出现的关键词,按照词频排序,可以取N个词频高的,如果其 md5 值一样,则可以认为这些网页有很高的相似度。谷歌搜索引擎给网页相似度设定的比例是60%,也就是说如果两个网页的相似度超过60%,那么被比较的网页不再被收录,如果相似度接近60%,那么被比较的网页可能也会被收录,但是搜索引擎给予的权重则比较低。这就是搜索引擎对待网页相似度的态度。由此可见,网页相似度对我们的网站的影响主要在于被比较的网页是否能够被收录,对其他方面则基本没什么影响。

  造成网页相似度问题产生的原因主要有两点:①在同一个网站内部,拿旧的网页复制做新的网页,造成网页里面的标题、关键词、描述信息、内容等改动的比较少,结果被搜索引擎判定为相似度高。②在不同网站之间,将原来已经被收录的网页的内容拿来,并进行稍微改动或者伪原创,结果造成里面的内容改动较少,或者仅仅进行段落调整,里面的内容没怎么变动,这与照抄差不多,被搜索引擎判定为相似度高。搜索引擎在判断网页的相似度的时候,是挺智能的,并不是我们想象的简单的从头到尾进行比较一下,而是进行智能的分析和比较,我们对此不要抱着侥幸心理,以为把别人网页的内容照抄过来,简单的修改了一下就可以蒙混过关。

  有了问题,我们就需要进行改正,下次避免再犯同样的错误。对于网页相似度的问题,我们知道了造成的原因,就可以对症下药。解决网页相似度的最有效的方法是对你的网页做到真正的原创,如果你的网页内容是原创出来的,只要内容质量高,就肯定不会因为网页相似度的问题而不收录,一般的都能被收录的。如果作为站长的你没有过多的时间去写原创文章,或者限于水平问题写不出来高质量的原创文章,那么你也可以进行伪原创,但是我们建议你为了避免缠身该网页相似度问题,你需要对原来的文章进行大幅度的修改,修改的幅度起码也要在50%以上,这样才可能被搜索引擎收录。另外我们建议各位站长,在做网页的时候,为了节省时间,如果需要复制原来的网页,那么我们也建议您对网页标题、关键词、描述信息以及内容也同样进行大幅度的修改,否则你的网页很难被收录的。在修改的时候可以用一些不同的代码替换掉原来的代码,比如使用iFrame框架取代以前的部分内容等等。笔者从事网站建设领域做了很长时间了,遇见到的因为网页相似度问题不被收录的情况不在少数,在谷歌站长管理平台上也有个html文档工具,如果两个网页的标题和描述信息差不多,站长工具会提示你哪两个网页的相似度高了,这时候我们就可以对之进行修改。建议站长们多多进入搜索引擎的管理平台里,使用里面提供的功能,有时候会对网站建设很有好处的。

 


推荐阅读
  • 使用Numpy实现无外部库依赖的双线性插值图像缩放
    本文介绍如何仅使用Numpy库,通过双线性插值方法实现图像的高效缩放,避免了对OpenCV等图像处理库的依赖。文中详细解释了算法原理,并提供了完整的代码示例。 ... [详细]
  • 深入理解OAuth认证机制
    本文介绍了OAuth认证协议的核心概念及其工作原理。OAuth是一种开放标准,旨在为第三方应用提供安全的用户资源访问授权,同时确保用户的账户信息(如用户名和密码)不会暴露给第三方。 ... [详细]
  • 本文详细介绍了 BERT 模型中 Transformer 的 Attention 机制,包括其原理、实现代码以及在自然语言处理中的应用。通过结合多个权威资源,帮助读者全面理解这一关键技术。 ... [详细]
  • QUIC协议:快速UDP互联网连接
    QUIC(Quick UDP Internet Connections)是谷歌开发的一种旨在提高网络性能和安全性的传输层协议。它基于UDP,并结合了TLS级别的安全性,提供了更高效、更可靠的互联网通信方式。 ... [详细]
  • 本文介绍如何在 Android 中通过代码模拟用户的点击和滑动操作,包括参数说明、事件生成及处理逻辑。详细解析了视图(View)对象、坐标偏移量以及不同类型的滑动方式。 ... [详细]
  • 2023 ARM嵌入式系统全国技术巡讲旨在分享ARM公司在半导体知识产权(IP)领域的最新进展。作为全球领先的IP提供商,ARM在嵌入式处理器市场占据主导地位,其产品广泛应用于90%以上的嵌入式设备中。此次巡讲将邀请来自ARM、飞思卡尔以及华清远见教育集团的行业专家,共同探讨当前嵌入式系统的前沿技术和应用。 ... [详细]
  • 深入解析Android自定义View面试题
    本文探讨了Android Launcher开发中自定义View的重要性,并通过一道经典的面试题,帮助开发者更好地理解自定义View的实现细节。文章不仅涵盖了基础知识,还提供了实际操作建议。 ... [详细]
  • 程序员妻子吐槽:丈夫北漂8年终薪3万,存款情况令人意外
    一位程序员的妻子在网上分享了她丈夫在北京工作八年的经历,月薪仅3万元,存款情况却出乎意料。本文探讨了高学历人才在大城市的职场现状及生活压力。 ... [详细]
  • 国内BI工具迎战国际巨头Tableau,稳步崛起
    尽管商业智能(BI)工具在中国的普及程度尚不及国际市场,但近年来,随着本土企业的持续创新和市场推广,国内主流BI工具正逐渐崭露头角。面对国际品牌如Tableau的强大竞争,国内BI工具通过不断优化产品和技术,赢得了越来越多用户的认可。 ... [详细]
  • 本文详细分析了JSP(JavaServer Pages)技术的主要优点和缺点,帮助开发者更好地理解其适用场景及潜在挑战。JSP作为一种服务器端技术,广泛应用于Web开发中。 ... [详细]
  • QBlog开源博客系统:Page_Load生命周期与参数传递优化(第四部分)
    本教程将深入探讨QBlog开源博客系统的Page_Load生命周期,并介绍一种简洁的参数传递重构方法。通过视频演示和详细讲解,帮助开发者更好地理解和应用这些技术。 ... [详细]
  • 深入理解 Oracle 存储函数:计算员工年收入
    本文介绍如何使用 Oracle 存储函数查询特定员工的年收入。我们将详细解释存储函数的创建过程,并提供完整的代码示例。 ... [详细]
  • PyCharm下载与安装指南
    本文详细介绍如何从官方渠道下载并安装PyCharm集成开发环境(IDE),涵盖Windows、macOS和Linux系统,同时提供详细的安装步骤及配置建议。 ... [详细]
  • 在 Windows 10 中,F1 至 F12 键默认设置为快捷功能键。本文将介绍几种有效方法来禁用这些快捷键,并恢复其标准功能键的作用。请注意,部分笔记本电脑的快捷键可能无法完全关闭。 ... [详细]
  • 本文总结了2018年的关键成就,包括职业变动、购车、考取驾照等重要事件,并分享了读书、工作、家庭和朋友方面的感悟。同时,展望2019年,制定了健康、软实力提升和技术学习的具体目标。 ... [详细]
author-avatar
mobiledu2502909447
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有