python基于BeautifulSoup实现抓取网页指定内容的方法

作者：学生联盟v | 来源：互联网 | 2018-07-18 09:43

这篇文章主要介绍了python基于BeautifulSoup实现抓取网页指定内容的方法,涉及Python使用BeautifulSoup模块解析html网页的相关技巧,具有一定参考借鉴价值,需要的朋友可以参考下

本文实例讲述了python基于BeautifulSoup实现抓取网页指定内容的方法。分享给大家供大家参考。具体实现方法如下：

# _*_ coding:utf-8 _*_
#xiaohei.python.seo.call.me:)
#win+python2.7.x
import urllib2
from bs4 import BeautifulSoup
def jd(url):
  page = urllib2.urlopen(url)
  html_doc = page.read()
  soup = BeautifulSoup(html_doc.decode('gb2312','ignore'))
  for i in soup.find_all('p', id="sortlist"):
    One= i.find_all('a')
    two = i.find_all('li')
    print ("%s %s" % (one,two))
jd("http://channel.jd.com/computer.html")

希望本文所述对大家的Python程序设计有所帮助。

python
html

推荐阅读

io
CSS高级技巧：动态高亮当前页面导航

本文介绍了如何使用CSS实现网站导航栏中当前页面的高亮显示，提升用户体验。通过为每个页面的body元素添加特定ID，并结合导航项的类名，可以轻松实现这一功能。 ... [详细]

蜡笔小新 2024-12-21 17:42:25
jsp
嵌入式开发环境搭建与文件传输指南

本文详细介绍了如何为嵌入式应用开发搭建必要的软硬件环境，并提供了通过串口和网线两种方式将文件传输到开发板的具体步骤。适合Linux开发初学者参考。 ... [详细]

蜡笔小新 2024-12-22 13:38:48
fetch
使用Fetch进行HTTP请求的基本示例

本文介绍了如何使用JavaScript的Fetch API与Express服务器进行交互，涵盖了GET、POST、PUT和DELETE请求的实现，并展示了如何处理JSON响应。 ... [详细]

蜡笔小新 2024-12-22 12:55:37
buffer
深入理解sed的G、H、g、h命令及其高级应用

本文详细介绍了流编辑器sed中的G、H、g、h命令，探讨了它们的工作原理及应用场景。通过实例解析和图解分析，帮助读者掌握这些高级命令的使用方法。 ... [详细]

蜡笔小新 2024-12-22 12:24:49
io
F# Interactive 中的数据格式化技巧：使用 AddPrinter 和 AddPrintTransformer 自定义输出

本文探讨了如何在 F# Interactive (FSI) 中通过 AddPrinter 和 AddPrintTransformer 方法自定义类型（尤其是集合类型）的输出格式，提供了详细的指南和示例代码。 ... [详细]

蜡笔小新 2024-12-22 12:09:23
io
简化报表生成：EasyReport工具的全面解析

本文详细介绍了EasyReport，一个易于使用的开源Web报表工具。该工具支持Hadoop、HBase及多种关系型数据库，能够将SQL查询结果转换为HTML表格，并提供Excel导出、图表显示和表头冻结等功能。 ... [详细]

蜡笔小新 2024-12-22 11:11:28
nodejs
深入理解Vue.js：从入门到精通

本文详细介绍了Vue.js的基础知识、安装方法、核心概念及实战案例，帮助开发者全面掌握这一流行的前端框架。 ... [详细]

蜡笔小新 2024-12-22 11:07:54
nodejs
如何在Python中使用中文注释

本文介绍如何通过设置文件编码声明，确保Python代码能够正确解析和显示中文注释。我们将探讨不同的编码方式及其适用场景，并提供最佳实践建议。 ... [详细]

蜡笔小新 2024-12-22 11:05:42
jsp
探索新一代API文档工具，告别Swagger的繁琐

对于后端开发者而言，编写和维护API文档既繁琐又不可或缺。本文将介绍一款全新的API文档工具，帮助团队更高效地协作，简化API文档生成流程。 ... [详细]

蜡笔小新 2024-12-22 11:02:41
nodejs
Node.js 中可写流的默认编码设置方法

本文介绍了如何在 Node.js 中使用 `setDefaultEncoding` 方法为可写流设置默认编码，并提供了详细的语法说明和示例代码。 ... [详细]

蜡笔小新 2024-12-22 10:44:58
jsp
优化App数据结构设计

本文探讨了在构建应用程序时，如何对不同类型的数据进行结构化设计。主要分为三类：全局配置、用户个人设置和用户关系链。每种类型的数据都有其独特的用途和应用场景，合理规划这些数据结构有助于提升用户体验和系统的可维护性。 ... [详细]

蜡笔小新 2024-12-22 09:42:30
io
深入解析Serverless架构模式

本文将详细介绍Serverless架构模式的核心概念、工作原理及其优势。通过对比传统架构，探讨Serverless如何简化应用开发与运维流程，并介绍当前主流的Serverless平台。 ... [详细]

蜡笔小新 2024-12-22 09:08:56
jsp
Linux中的yum安装软件

yum俗称大黄狗作用：解决安装软件包的依赖关系当安装依赖关系的软件包时，会将依赖的软件包一起安装。本地yum：需要yum源，光驱挂载。yum源：（刚开始查看yum源中的内容就是上图 ... [详细]

蜡笔小新 2024-12-22 07:41:00
jsp
解决PHP文件写入权限问题及HTML代码无效的方法

本文探讨了如何解决PHP文件无法写入本地文件的问题，并解释了PHP文件中HTML代码无效的原因，提供了一系列实用的解决方案和最佳实践。 ... [详细]

蜡笔小新 2024-12-22 07:18:12
jsp
解决 SmartUpload 上传路径问题

本文详细介绍了在使用 SmartUpload 组件进行文件上传时，如何正确配置和查找文件保存路径。通过具体的代码示例和步骤说明，帮助开发者快速解决上传路径配置的问题。 ... [详细]

蜡笔小新 2024-12-22 06:44:25

学生联盟v

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章