[分享]Regex分析/提取XML/XHTML標籤屬性
直接看代碼吧, 有什麼不足請各位大神指教..
PHP code
(?>\w+)) #標籤名 (?P #單個屬性子組 (?>\s+) #前置空白 (?P\w+) #屬性名稱 = #賦值符號 (?P(?P')|(?P")) #讀取包裹屬性值的引號 (?P #值處理子組 (?: #將值分解處理: 分解為1) 偶數個逸出字元的部分; 2) 單個逸出字元+引號或非當前使用引號的字元 (?P(?>(?:\\\\\\\\)*)*) #消耗掉當前位置起偶數個逸出字元 (?P #非逸出字元自身的處理 \\\\(?P=quote)|(?(5)[^']|[^"]) #這裡用了分支, 一邊是逸出字元+引號, 另一邊是條件匹配的非當前引號字元 ) )* #對值進行的分組進行0次或多次處理 ) (?P=quote) #引號閉合 )* #屬性的重複 \s* #後置空白\/?> #標籤閉合處理(這裡的焦點在於對屬性值的處理, 所以沒有對的方式進行處理)/xeot;#樣本輸入$content1 = <<< eot戰神啊共和國'>eot;$content2 = <<< eot戰神啊共和國">eot;echo $pattern . chr(10);preg_match($pattern, $content1, $matches);print_r($matches);preg_match($pattern, $content2, $matches);print_r($matches);
------解決方案--------------------
沒人甩你,我來支援一下。
------解決方案--------------------
嗯,一般lgg201上的都是乾貨....
待會有空測一下,非找個bug出來....
------解決方案--------------------
yeah!
$content1 = <<< eot
eot;
這個沒出來
------解決方案--------------------
Warning: preg_match() [function.preg-match]: Unknown modifier 't' in ....
------解決方案--------------------
占樓分割線
------解決方案--------------------
嗯,這下突破不了了....
坦白說,這正則還沒看懂,有空的時候學習下~~
------解決方案--------------------
to lgg201,請教
能否簡單說明,大概什麼場合你需要這種匹配呢?