0

0

PHP preg_match 匹配多行内容:解决 . 无法匹配换行符的问题

霞舞

霞舞

发布时间:2025-11-06 13:24:01

|

709人浏览过

|

来源于php中文网

原创

PHP preg_match 匹配多行内容:解决 . 无法匹配换行符的问题

本教程旨在解决 php 中 `preg_match` 函数在使用 `file_get_contents` 读取多行文本时匹配失败的问题。核心在于正则表达式中的点号 `.` 默认不匹配换行符。我们将详细介绍如何通过添加 `s` (dotall) 修饰符来改变这一行为,确保正则表达式能够正确捕获跨越多行的内容,并提供实用的代码示例和注意事项。

理解 preg_match 与正则表达式中的点号 .

在 PHP 中,preg_match 函数用于执行正则表达式匹配。它的强大之处在于能够灵活地从字符串中提取所需的数据。然而,在使用过程中,开发者常会遇到一个常见但容易被忽视的问题:当目标字符串包含换行符时,正则表达式中的点号 .(匹配任意字符)默认情况下并不会匹配换行符。

考虑以下两种情况:

1. 单行字符串匹配(成功示例)

当目标字符串是单行时,preg_match 能够如预期般工作。

立即学习PHP免费学习笔记(深入)”;

<?php
$HTML   = '#a#TEXT#a#';
$REGEX  = '/#a#(.*?)#a/';

preg_match($REGEX, $HTML, $MATCH);

print_r($MATCH);
// 输出:Array ( [0] => #a#TEXT#a# [1] => TEXT )
var_dump($MATCH);
// 输出:array(2) { [0]=> string(12) "#a#TEXT#a#" [1]=> string(4) "TEXT" }
?>

在这个例子中,$HTML 是一个不含换行符的字符串,.* 能够成功匹配 TEXT。

2. 多行文件内容匹配(失败示例)

当内容从文件中读取,并且文件包含多行(即包含换行符)时,问题就出现了。假设 file.php 文件内容如下:

#a#

TEXT

#a#

使用 file_get_contents 读取后,$HTML 变量将包含这些换行符。此时,相同的正则表达式将无法匹配。

<?php
// file.php 文件的内容:
// #a#
//
// TEXT
//
// #a#

$HTML   = file_get_contents("file.php"); // 假设文件内容如上所示
$REGEX  = '/#a#(.*?)#a/';

preg_match($REGEX, $HTML, $MATCH);

print_r($MATCH);
// 输出:Array ( )
var_dump($MATCH);
// 输出:array(0) { }
?>

由于 . 默认不匹配换行符,正则表达式 / #a#(.*?)#a#/ 无法跨越 #a# 和 TEXT 之间的换行符以及 TEXT 和 #a# 之间的换行符,导致匹配失败,$MATCH 数组为空。

OpenJobs AI
OpenJobs AI

AI驱动的职位搜索推荐平台

下载

解决方案:使用 s (DOTALL) 修饰符

解决此问题的关键在于使用正则表达式的 s (DOTALL) 修饰符。当 s 修饰符被添加到正则表达式的末尾时,它会改变点号 . 的默认行为,使其能够匹配包括换行符在内的所有字符(除了 null 字符)。

通过在正则表达式的结束分隔符后添加 s,我们可以确保 .* 能够正确匹配跨越多行的内容。

修正后的代码示例:

<?php
// file.php 文件的内容:
// #a#
//
// TEXT
//
// #a#

$HTML   = file_get_contents("file.php");
// 检查文件是否成功读取,这是良好的编程习惯
if ($HTML === false) {
    echo "错误:无法读取文件 'file.php'。\n";
    exit; // 或其他错误处理
}

$REGEX  = '/#a#(.*?)#a#/s'; // 注意这里添加了 's' 修饰符

preg_match($REGEX, $HTML, $MATCH);

print_r($MATCH);
// 预期输出:Array ( [0] => #a# TEXT #a# [1] => TEXT )
// 实际输出可能包含换行符:Array ( [0] => #a#\n\nTEXT\n\n#a# [1] => \n\nTEXT\n\n )
var_dump($MATCH);
// 预期输出:array(2) { [0]=> string(19) "#a#\n\nTEXT\n\n#a#" [1]=> string(8) "\n\nTEXT\n\n" }
?>

通过添加 s 修饰符,正则表达式 / #a#(.*?)#a#/s 现在能够将 #a# 和 TEXT 之间的换行符视为普通字符进行匹配,从而成功提取到完整的内容。

确保文件内容正确读取

虽然 s 修饰符是解决多行匹配问题的核心,但在进行文件操作时,始终建议检查 file_get_contents 的返回值。如果文件不存在、权限不足或路径错误,file_get_contents 会返回 false。

<?php
$HTML = file_get_contents("file.php");

// 调试文件读取:
var_dump($HTML); // 检查 $HTML 的内容,确认文件是否被正确读取,以及其内部是否包含换行符

if ($HTML === false) {
    echo "错误:无法读取文件 'file.php'。请检查文件路径和权限。\n";
    // 在实际应用中,这里应该有更健壮的错误处理机制
    exit;
}

// ... 之后再进行 preg_match 操作 ...
?>

通过 var_dump($HTML),你可以直观地看到 file_get_contents 到底读取了什么内容,这对于调试文件读取问题非常有帮助。

其他常用正则表达式修饰符

除了 s (DOTALL) 修饰符,PHP 的 preg_match 还支持其他一些常用的修饰符,它们可以极大地增强正则表达式的灵活性:

  • i (CASE-INSENSITIVE):使匹配不区分大小写。例如,/text/i 会匹配 "text", "Text", "TEXT" 等。
  • m (MULTILINE):使 ^ 和 $ 锚点匹配行的开始和结束,而不仅仅是整个字符串的开始和结束。在没有 m 修饰符时,^ 只匹配字符串的开头,$ 只匹配字符串的结尾。有了 m,它们会匹配每一行的开头和结尾(由换行符定义)。
  • U (UNGREEDY):使量词(如 *, +, ?)默认变为非贪婪模式。通常,量词是贪婪的,会尽可能多地匹配字符。添加 U 后,它们会尽可能少地匹配。或者,你也可以在量词后直接加 ? 来使其变为非贪婪,例如 .*?。

总结

当在 PHP 中使用 preg_match 配合 file_get_contents 处理包含换行符的多行文本时,核心问题在于正则表达式中的点号 . 默认不匹配换行符。通过在正则表达式中添加 s (DOTALL) 修饰符,可以轻松解决这一问题,使 . 能够匹配所有字符,包括换行符。同时,为了确保程序的健壮性,始终建议在文件操作后检查 file_get_contents 的返回值,以避免因文件读取失败而导致的后续错误。理解并合理运用正则表达式修饰符,将大大提升文本处理的效率和准确性。

相关文章

PHP速学教程(入门到精通)
PHP速学教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
js正则表达式
js正则表达式

php中文网为大家提供各种js正则表达式语法大全以及各种js正则表达式使用的方法,还有更多js正则表达式的相关文章、相关下载、相关课程,供大家免费下载体验。

531

2023.06.20

正则表达式不包含
正则表达式不包含

正则表达式,又称规则表达式,,是一种文本模式,包括普通字符和特殊字符,是计算机科学的一个概念。正则表达式使用单个字符串来描述、匹配一系列匹配某个句法规则的字符串,通常被用来检索、替换那些符合某个模式的文本。php中文网给大家带来了有关正则表达式的相关教程以及文章,希望对大家能有所帮助。

258

2023.07.05

java正则表达式语法
java正则表达式语法

java正则表达式语法是一种模式匹配工具,它非常有用,可以在处理文本和字符串时快速地查找、替换、验证和提取特定的模式和数据。本专题提供java正则表达式语法的相关文章、下载和专题,供大家免费下载体验。

767

2023.07.05

java正则表达式匹配字符串
java正则表达式匹配字符串

在Java中,我们可以使用正则表达式来匹配字符串。本专题为大家带来java正则表达式匹配字符串的相关内容,帮助大家解决问题。

219

2023.08.11

正则表达式空格
正则表达式空格

正则表达式空格可以用“s”来表示,它是一个特殊的元字符,用于匹配任意空白字符,包括空格、制表符、换行符等。本专题为大家提供正则表达式相关的文章、下载、课程内容,供大家免费下载体验。

357

2023.08.31

Python爬虫获取数据的方法
Python爬虫获取数据的方法

Python爬虫可以通过请求库发送HTTP请求、解析库解析HTML、正则表达式提取数据,或使用数据抓取框架来获取数据。更多关于Python爬虫相关知识。详情阅读本专题下面的文章。php中文网欢迎大家前来学习。

293

2023.11.13

正则表达式空格如何表示
正则表达式空格如何表示

正则表达式空格可以用“s”来表示,它是一个特殊的元字符,用于匹配任意空白字符,包括空格、制表符、换行符等。想了解更多正则表达式空格怎么表示的内容,可以访问下面的文章。

245

2023.11.17

正则表达式中如何匹配数字
正则表达式中如何匹配数字

正则表达式中可以通过匹配单个数字、匹配多个数字、匹配固定长度的数字、匹配整数和小数、匹配负数和匹配科学计数法表示的数字的方法匹配数字。更多关于正则表达式的相关知识详情请看本专题下面的文章。php中文网欢迎大家前来学习。

549

2023.12.06

C++多线程并发控制与线程安全设计实践
C++多线程并发控制与线程安全设计实践

本专题围绕 C++ 在高性能系统开发中的并发控制技术展开,系统讲解多线程编程模型与线程安全设计方法。内容包括互斥锁、读写锁、条件变量、原子操作以及线程池实现机制,同时结合实际案例分析并发竞争、死锁避免与性能优化策略。通过实践讲解,帮助开发者掌握构建稳定高效并发系统的关键技术。

2

2026.03.16

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PHP课程
PHP课程

共137课时 | 13.7万人学习

JavaScript ES5基础线上课程教学
JavaScript ES5基础线上课程教学

共6课时 | 11.3万人学习

PHP新手语法线上课程教学
PHP新手语法线上课程教学

共13课时 | 1.0万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号