抓取并下载CSS中所有图片文件的php代码

作者：minimiai_559 | 来源：互联网 | 2023-10-10 19:31

php教程|php手册CSS,图片文件php教程-php手册dnf过非法源码,vscode怎么后退,苹果M1ubuntu,打开tomcat端口,群晖搭建sqlite,公众号对接网站

php教程|php手册抓取并下载CSS中所有图片文件的php代码

CSS,图片文件

php教程-php手册

dnf过非法源码,vscode怎么后退,苹果 M1 ubuntu,打开tomcat端口,群晖搭建sqlite,公众号对接网站插件,web前端框架如何选择,爬虫鳄鱼的翻译,php 文件保存,网站更换域名seo,蓝色资讯文章类网站织梦模板,网页蒙层,ppt模板源码营,网站维护页面源码 asp,网上购物后台管理系统主页,最新红鸟棋牌游戏程序lzw

今天就让 PHP 用正则式把 CSS 文件中的所有图片文件，都从 CSS 原来的位置下载来吧。

173个android项目源码,vscode不联网怎么改中文,ubuntu查看文件内容,web容器tomcat编码文件,sqlite-dll,网页设计图片滚动代码,万网服务器租用,签到日历插件特效,web前端html框架,网络爬虫python实例,php开源crm,高端seo优化公司,springboot三方依赖,java企业门户网站,网页设计源代码格式,wordpress模板汉化,dede后台用户名修改,js页面输入框,java web教室管理系统课程设计,时时彩源码程序下载lzw

demux 源码,vscode显示终端,正向域名解析ubuntu配置,关于tomcat jmx,sqlite外键怎么,日历日志插件,前端框架解决的问题,成都爬虫获客,php 变量初始化,seo必学100条seo教程,手机游戏源码网站,html5网页设计教程,方维蘑菇街模板,仓库管理系统用什么数据库好,砍价拼团秒杀的小程序lzw

这篇文章的亮点是，正则式更加复杂鸟，╮(-_-)╭，再就是 Copy 函数的灰常强大的一个用法。
> 话说刚才听 NsYta 说小邪的主题太白了，杯具。最近太忙，没有空，不然就自己搞一个新主题。

一. 抓取 CSS 中的图片：
> 1. 首先做好准备工作：
> 第一步，先把 CSS 原本的路径存到 $url 变量里，然后把 CSS 的内容保存在 abc.css 中。
> 因为考虑到经常碰到多个 CSS 文件的状况，所以小邪没有直接填一个 CSS 路径。
> 而是把几个 CSS 文件的内容合并到一起，全部塞到 abc.css 文件里面即可，嘎嘎嘎。

$data = file_get_contents(‘abc.css’);

> 接着读取 CSS 文件的内容到 $data 变量中，然后用正则式把域名给取出来。
> 因为这里考虑到很多图片文件用到了相对根路径，比方说 /img/1.jpg 和 img/1.jpg。
> 然后 CSS 原地址在 http://www.liuzhongwei.com/css/ 那么上面的两个文件位置是不同的。

> 第一个文件在 /upload/201109/20110926143903807.jpg，因为它的路径用到了相对根路径。
> 而第二个在 /upload/201109/20110926143903169.jpg，它的路径只是普通的相对路径。
代码如下:
$url = ‘http://www.liuzhongwei.com/css/’; preg_match(‘/(.*\/\/.*?)\//’,$url,$host);
//这里用正则式把 http://www.liuzhongwei.com/ 给取出来，后端不要忘记加斜杠喔。
//.*? 是懒惰匹配，也就是能匹配得越少就匹配越少的内容，这样就不会取过头了。
$host = $host[1];

2. 把图片存储文件夹建好：
> 小邪这里用了 is_dir 来确定文件夹是否存在，存在的话，就不用再建立第二遍了。
> 呵呵，顺便说下，is_file 函数可以确定此文件是否为正常文件，也可以确定是否存在。
> 但 file_exists() 优越一点，因为某次看到有人在 Webmasterworld.com 上面讨论过。

if (!is_dir(‘img’)) { mkdir(‘img’); }

> 3. 用正则式把图片相对地址取出来：

$regex = ‘/url$\'{0,1}\”{0,1}(.*?)\'{0,1}\”{0,1}$/’;
//这里用正则式匹配出图片地址，要考虑三种情况，即 url(1.jpg) url(‘1.jpg’) url(“1.jpg”)。
//这三种写法都是可以使用的，所以咱们就用上面的正则把里面的 1.jpg 取出来。
//\'{0,1} 表示单引号可能出现1次或0次，\” 则表示双引号可能出现1次或0次。
//中间必须使用懒惰匹配，不然取出来的就是 1.jpg” 而不是 1.jpg 鸟，O(∩_∩)P。
preg_match_all($regex,$data,$result);

> 4. 处理这些图片：

> 首先使用一个循环，把上面是用正则提取出来的第一分支内容数组给处理一下。
> 额，这里的第一分支表示正则式里面的第一个括号来着，呵呵，以此类推。

foreach ($result[1] as $val) { }

> 然后是用正则式判定，因为还要考虑到这样 /upload/201109/20110926143903807.jpg。
> 这样是使用了完整的路径了，而不是想其他的一样是 /img/1.jpg 或者 img/1.jpg。
> 所以单独判断一下，然后接着判断这两个，看看是 /img/1.jpg 还是 img/1.jpg。
代码如下:
if (preg_match(‘/^http.*/’,$val)) { $target = $val; }
else if (preg_match(‘/^\/.*/’,$val)) { $target=$host.$val; }
else { $target=$url.$val; }
echo $target.”
\r\n”;

> 最后把文件名取出来，即 /img/1.jpg 中的 1.jpg，用于保存文件。
代码如下:
preg_match(‘/.*\/(.*\.\D+)$/’,$val,$name);

> 然后咱们就可以开始下载了，这里要介绍一个强大的 Copy 函数用法。
代码如下:
if (!is_file(‘./img/’.$name[1])) {
$imgc = file_get_contents($target);
$handle = fopen(‘./img/’.$name[1],’w+’);
fwrite($handle,$imgc);
fclose($handle);
}

> 上面那个是咱们的老方法了，嘎嘎，很麻烦。某次，小邪突然发现 Copy 的强大。
> Copy 居然也可以下载，所以可以轻松使用下面的代码来处理，上面的可以退休鸟。
代码如下:
if (!is_file(‘./img/’.$name[1])) {
copy($target,’./img/’.$name[1]);
}

> 5. 完整源代码：

> 使用的时候把 $url 填好即可，然后把所有 CSS 内容存到 abc.css 中即可。
代码如下:
$url = ‘http://www.liuzhongwei.com/css/’;
$data = file_get_contents(‘abc.css’);
preg_match(‘/(.*\/\/.*?)\//’,$url,$host);
$host = $host[1];
if (!is_dir(‘img’)) { mkdir(‘img’); }
$regex = ‘/url$\'{0,1}\”{0,1}(.*?)\'{0,1}\”{0,1}$/’;
preg_match_all($regex,$data,$result);
foreach ($result[1] as $val) {
if (preg_match(‘/^http.*/’,$val)) { $target = $val; }
else if (preg_match(‘/^\/.*/’,$val)) { $target=$host.$val; }
else { $target=$url.$val; }
echo $target.”
\r\n”;
preg_match(‘/.*\/(.*\.\D+)$/’,$val,$name);
if (!is_file(‘./img/’.$name[1])) {
copy($target,’./img/’.$name[1]);
}
}?>

推荐阅读

post
帝国cms各数据表有什么用

CMS教程|帝国CMS帝国cmsCMS教程-帝国CMS精易编程助手源码,ubuntu桥接设置,500错误是tomcat吗,爬虫c原理,php会话包括什么,营销seo关键词优化一般多 ... [详细]

蜡笔小新 2024-11-26 18:27:32
post
Windows环境下Oracle数据库迁移实践

本文详细记录了一次在Windows操作系统下将Oracle数据库的控制文件、数据文件及在线日志文件迁移至外部存储的过程，旨在为后续的集群环境部署做好准备。 ... [详细]

蜡笔小新 2024-11-23 19:57:51
post
从CodeIgniter中提取图像处理组件

本指南旨在帮助开发者在未使用CodeIgniter框架的情况下，如何独立使用其强大的图像处理功能，包括图像尺寸调整、创建缩略图、裁剪、旋转及添加水印等。 ... [详细]

蜡笔小新 2024-11-20 19:57:35
post
提升工作效率：掌握15个键盘快捷键

在日常工作中，熟练掌握计算机操作技巧能够显著提升工作效率。本文将介绍15个常用的键盘快捷键，帮助用户更加高效地完成工作任务。 ... [详细]

蜡笔小新 2024-11-19 15:20:10
post
PHP 图形函数中实现汉字显示的方法

本文详细介绍了如何在 PHP 的图形函数中正确显示汉字，包括具体的步骤和注意事项，适合初学者和有一定基础的开发者阅读。 ... [详细]

蜡笔小新 2024-11-24 10:58:45
post
PHP中Smarty模板引擎自定义函数详解

本文详细介绍了如何在PHP的Smarty模板引擎中自定义函数，并通过具体示例演示了这些函数的使用方法和应用场景。适合PHP后端开发者学习。 ... [详细]

蜡笔小新 2024-11-23 15:39:25
select
解决ADODB连接Access时出现80004005错误的方法

本文详细介绍了如何解决在使用ADODB连接Access数据库时遇到的80004005错误，包括错误原因分析和具体的解决步骤。 ... [详细]

蜡笔小新 2024-11-22 19:27:04
io
H5技术实现经典游戏《贪吃蛇》

本文将分享一个使用HTML5技术实现的经典小游戏——《贪吃蛇》。通过H5技术，我们将探讨如何构建这款游戏的两种主要玩法：积分闯关和无尽模式。 ... [详细]

蜡笔小新 2024-11-21 20:16:59
io
解决PHP项目在服务器无法抓取远程网页内容的问题

本文探讨了在使用PHP进行后端开发时，遇到的一个常见问题：即在本地环境中能够正常通过CURL获取远程网页内容，但在服务器上却无法实现。我们将分析可能的原因并提供解决方案。 ... [详细]

蜡笔小新 2024-11-21 10:31:32
io
HTML前端开发：UINavigationController与页面间数据传递详解

本文详细介绍了如何在HTML前端开发中利用UINavigationController进行页面管理和数据传递，适合初学者和有一定基础的开发者学习。 ... [详细]

蜡笔小新 2024-11-20 09:46:39
select
MySQL Administrator: 监控与管理工具

本文介绍了 MySQL Administrator 的主要功能，包括图形化监控 MySQL 服务器的实时状态、连接健康度、内存健康度以及如何创建自定义的健康图表。此外，还详细解释了状态变量和系统变量的管理。 ... [详细]

蜡笔小新 2024-11-18 08:20:16
io
精选Eclipse插件概览

本文介绍了多种Eclipse插件，包括XML Schema Infoset Model (XSD)、Graphical Editing Framework (GEF)、Eclipse Modeling Framework (EMF)等，涵盖了从Web开发到图形界面编辑的多个方面。 ... [详细]

蜡笔小新 2024-11-26 16:20:20
io
最适合初学者的编程语言

本文探讨了适合编程新手的最佳语言选择，包括Python、JavaScript等易于上手且功能强大的语言，以及如何通过有效的学习方法提高编程技能。 ... [详细]

蜡笔小新 2024-11-22 16:17:04
io
Bootstrap Paginator 分页插件详解与应用

本文深入探讨了Bootstrap Paginator这款流行的JavaScript分页插件，提供了详细的使用指南和示例代码，旨在帮助开发者更好地理解和利用该工具进行高效的数据展示。 ... [详细]

蜡笔小新 2024-11-20 13:39:53
io
Java中的引用类型详解

本文详细介绍了Java中的引用类型，包括强引用、软引用、弱引用和虚引用的特点和应用场景。 ... [详细]

蜡笔小新 2024-11-18 10:12:58

minimiai_559

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章