热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

PHP正则表达式实例

这个条件语句来判断开始的标记跟闭合的标记是否相等,不相等就说明没闭合。最后用in_array($start_tags[1][$i],

1 使用正则表达式来检测HTML 是否关闭
代码片段
 

PHP代码
  1. function check_html($html) {   
  2. preg_match_all("/<([a-zA-Z0-9]+)\\s*[^\\/>]*>/",$html,$start_tags);   
  3. preg_match_all("/<\\/([a-zA-Z0-9]+)>/", $html, $end_tags);   
  4. if(count($start_tags[1]) != count($end_tags[1])) return false;   
  5. for($i = 0; $i < count($start_tags[1]); $i++) {   
  6. if(!in_array($start_tags[1][$i], $end_tags[1])) return false;   
  7. }   
  8. return true;   
  9. }   

解释:
/<([a-zA-Z0-9]+)\\s*[^\\/>]*>/这个模式是用来匹配HTML 的标记(如:、

等等,但是除了
这种)的,并且在$start_tags 保持着标签
的名字(如:head、div 等)。而/<\\/([a-zA-Z0-9]+)>/这个模式是用来匹配闭合的HTML
标记(如:,
等)的。并且在$end_tags 中保持这闭合的标签名。然后我们用
count($start_tags[1]) != count($end_tags[1])这个条件语句来判断开始的标记跟闭合的
标记是否相等,不相等就说明没闭合。最后用in_array($start_tags[1][$i], $end_tags[1])
来判断开始标跟闭合的标记是否相等。至此,我们就完成了HTML 的匹配了!
2 匹配E-mail 格式
代码片段
 

PHP代码
  1. function check_email($email) {   
  2. if(preg_match("/^[\w\d!#$%&'*+-\/=?^`{|}~]+(\.[\w\d!#$%&'*+-\/=?^`{|}~]+)*@([a-z\d][-a-z\  
  3. d]*[a-z\d]\.)+[a-z][-a-z\d]*[a-z]$/", $eamil)) return true;   
  4. return false;   
  5. }   

解释:
不要被
/^[\w\d!#$%&'*+-\/=?^`{|}~]+(\.[\w\d!#$%&'*+-\/=?^`{|}~]+)*@([a-z\d][-a-z\d]*[az\
d]\.)+[a-z][-a-z\d]*[a-z]$/
这条模式给吓跑了, 其实也很简单的。前部分
[\w\d!#$%&'*+-\/=?^`{|}~]+(\.[\w\d!#$%&'*+-\/=?^`{|}~]+)*只是匹配符合RFC-2882 标
准的E-mail 地址允许出现的字符,就是英文字母,数字跟一些符号,有兴趣可以查询
RFC-2882 手册,而([a-z\d][-a-z\d]*[a-z\d]\.)+就是匹配HOST 的。最后[a-z][-a-z\d]*[a-z]
就是匹配顶级域名的(如:.com、.org)。
3 非贪心模式
有时候使用正则表达式的时候,你会发现有以下的问题:
代码片段
 

PHP代码
  1. preg_match('/".*"/', 'Tony say:"hello", Jack say: "Hi"', $matches);   
  2. print_r($matches);  


很惊奇的你会发现匹配的是这样的内容"hello", Jack say: "Hi",而不是"hello"和
"Hi"。这就是贪心匹配引起的。在贪心匹配中,正则表达式会尽可能的匹配最多的字
符,所以出现了第一种情况,但是我们想要的是第二种情况,那我们要怎么做呢?
我们可以使用非贪心匹配,将刚才的模式改为/".*?"/这样就可以看见我们想要的
结果了。*?这个就是非贪心匹配模式。还有另外一种就是+?。
? *?:前面的字符可以出现任意多次,但是遇到*?后的一个字符即停止匹配。
? +?:前面的字符可以出现一次或者多次,但是遇到+?后的一个字符即停止匹
配。
4 检测一个用户密码是否安全
代码片段
 

PHP代码
  1. function is_good_pw($pw) {   
  2. if(preg_match('/(?=.*[0-9])(?=.*[a-z])(?=.*[A-Z]).{8,16}/', $pw)) {   
  3. return true;   
  4. }   
  5. return false;   
  6. }  


解释:
在本例中,我们使用了/(?=.*[0-9])(?=.*[a-z])(?=.*[A-Z]).{8,16}/模式来匹配我们的
密码。在这个模式中,我们使用了正则表达式中的前瞻模式(?=)。(?=.*[0-9])这个是匹
配密码中有数字,而(?=.*[a-z])是匹配密码中有小写字母,最后(?=.*[A-Z])就是匹配密
码中有大写字母。而.{8,16}这个就是匹配密码是由8 至16 个字符组成的。那么我们
的密码就需要有数字,大写字母和小写字母组成的就属于安全的密码了~
5 匹配一个网站中的所有链接
代码片段
 

PHP代码
  1. function get_links($link) {   
  2. $html = file_get_contents($link);   
  3. $html = str_replace("\n", "", $html);   
  4. $html = preg_replace('/
  5. $html = preg_replace('/<\/a>/', "\n", $html);   
  6. preg_match_all('/.*?<\/a>/', $html, $matches);   
  7. return($matches);   
  8. }  


在这个例子中,我们想用file_get_contents 来取得一个网页的内容。然后用
str_replace("\n", "", $html)把所有的换行去掉。再用preg_replace('/ preg_replace('/<\/a>/', "\n", $html)来把所有的.....模式另起一行。
最后就用preg_match_all('/.*?<\/a>/', $html, $matches) 匹配链接模式。
/.*?<\/a>/就是匹配.....这种模式的正则表达式。那我们为什
么要把.....链接另起一行呢??因为在/.*?<\/a>/模式中,.*
是不能匹配换行的,所以就如不在同一行就不能匹配了!!所以我们要这样
做!



推荐阅读
  • 本题来自WC2014,题目编号为BZOJ3435、洛谷P3920和UOJ55。该问题描述了一棵不断生长的带权树及其节点上小精灵之间的友谊关系,要求实时计算每次新增节点后树上所有可能的朋友对数。 ... [详细]
  • 嵌入式开发环境搭建与文件传输指南
    本文详细介绍了如何为嵌入式应用开发搭建必要的软硬件环境,并提供了通过串口和网线两种方式将文件传输到开发板的具体步骤。适合Linux开发初学者参考。 ... [详细]
  • 解决TensorFlow CPU版本安装中的依赖问题
    本文记录了在安装CPU版本的TensorFlow过程中遇到的依赖问题及解决方案,特别是numpy版本不匹配和动态链接库(DLL)错误。通过详细的步骤说明和专业建议,帮助读者顺利安装并使用TensorFlow。 ... [详细]
  • 深入解析Serverless架构模式
    本文将详细介绍Serverless架构模式的核心概念、工作原理及其优势。通过对比传统架构,探讨Serverless如何简化应用开发与运维流程,并介绍当前主流的Serverless平台。 ... [详细]
  • 本文探讨了如何解决PHP文件无法写入本地文件的问题,并解释了PHP文件中HTML代码无效的原因,提供了一系列实用的解决方案和最佳实践。 ... [详细]
  • 本文详细介绍了一种通过MySQL弱口令漏洞在Windows操作系统上获取SYSTEM权限的方法。该方法涉及使用自定义UDF DLL文件来执行任意命令,从而实现对远程服务器的完全控制。 ... [详细]
  • 利用Selenium与ChromeDriver实现豆瓣网页全屏截图
    本文介绍了一种使用Selenium和ChromeDriver结合Python代码,轻松实现对豆瓣网站进行完整页面截图的方法。该方法不仅简单易行,而且解决了新版Selenium不再支持PhantomJS的问题。 ... [详细]
  • 本文介绍如何使用PHP在WordPress中根据分类类别ID或名称获取所有相关文章,提供详细的方法和代码示例。 ... [详细]
  • 本文详细介绍了在不同操作系统中查找和设置网卡的方法,涵盖了Windows系统的具体步骤,并提供了关于网卡位置、无线网络设置及常见问题的解答。 ... [详细]
  • #print(34or4 ... [详细]
  • 使用PHP实现网站访客计数器的完整指南
    本文详细介绍了如何利用PHP构建一个简易的网站访客统计系统。通过具体的代码示例和详细的解释,帮助开发者理解和实现这一功能,适用于初学者和有一定经验的开发人员。 ... [详细]
  • CSS高级技巧:动态高亮当前页面导航
    本文介绍了如何使用CSS实现网站导航栏中当前页面的高亮显示,提升用户体验。通过为每个页面的body元素添加特定ID,并结合导航项的类名,可以轻松实现这一功能。 ... [详细]
  • 本文介绍下,在php编程中,用正则表达式判断某一字符串是否为域名的方法,有需要的朋友参考下吧。通常匹配域名的格式要求:1、域 ... [详细]
  • 版本控制工具——Git常用操作(下)
    本文由云+社区发表作者:工程师小熊摘要:上一集我们一起入门学习了git的基本概念和git常用的操作,包括提交和同步代码、使用分支、出现代码冲突的解决办法、紧急保存现场和恢复 ... [详细]
  • 本章详细介绍SP框架中的数据操作方法,包括数据查找、记录查询、新增、删除、更新、计数及字段增减等核心功能。通过具体示例和详细解析,帮助开发者更好地理解和使用这些方法。 ... [详细]
author-avatar
姚威阳_489
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有