Skip to content

Mga Token sa Regex ipinaliwanag

Lahat ng pangunahing token ng regex: mga anchor, character class, quantifier, group, at flag. Ang ibig sabihin ng bawat isa, na may konkretong tugma. Ang mabilisang-sangguniang kasama ng Regex Tester tool.

Nagkakasama ang mga token ng regex: i-stack ang isang anchor, isang character class, at isang quantifier para makabuo ng pattern. Nagaangkla ang ^ sa simula, tumutugma ang \d sa isang digit, at itinatakda ng {2,4} kung ilang beses. Pagsamahin sila bilang ^\d{2,4}$ para tumugma sa buong string na may dalawa hanggang apat na digit. Basahin ang pattern mula kaliwa pakanan, isang token bawat pagkakataon. Pinapayagan ka ng kasamang Regex Tester tool na subukan ang alinman sa mga token na ito nang live laban sa sarili mong teksto.

Talaan ng sanggunian · 55 mga entryBuksan ang tool na regex-tester →
55 of 55 rows
Mga Anchor
Tumutugma sa posisyon sa simula ng string, o sa simula ng linya kapag naka-on ang m flag.^He → He
Tumutugma sa posisyon sa dulo ng string, o sa dulo ng linya kapag naka-on ang m flag.lo$ → lo
Tumutugma sa word boundary, ang posisyon sa pagitan ng isang word character at isang hindi word character.\bcat\b → cat
Tumutugma sa non-word boundary, ang posisyon sa pagitan ng dalawang word character o dalawang hindi word character.\Bar → ar
Mga Character class
Tumutugma sa anumang isang karakter maliban sa line break, maliban kung naka-set ang s flag.a.c → abc
Tumutugma sa anumang digit, 0 hanggang 9.\d → 7
Tumutugma sa anumang karakter na hindi digit.\D → a
Tumutugma sa anumang word character: isang letra, isang digit, o isang underscore.\w → _
Tumutugma sa anumang karakter na hindi word character.\W → !
Tumutugma sa anumang whitespace character: isang espasyo, isang tab, o isang line break.a\sb → a b
Tumutugma sa anumang karakter na hindi whitespace.\S → a
Tumutugma sa alinman sa mga karakter na nakalista sa loob ng mga bracket.[aeiou] → e
Tumutugma sa anumang karakter na hindi kabilang sa mga nakalista sa loob ng mga bracket.[^aeiou] → s
Tumutugma sa anumang isang karakter sa ibinigay na saklaw, mula a hanggang z.[a-z] → m
Tumutugma sa anumang isang karakter kasama na ang line break, ang karaniwang idyoma para sa isang dot na bumabagtas sa mga linya.[\s\S] → \n
Tumutugma sa anumang unicode na letra mula sa anumang script, kapag naka-set ang u flag.\p{L} → é
Tumutugma sa anumang unicode na number character mula sa anumang script, kapag naka-set ang u flag.\p{N} → ٣
Escape: tumutugma sa isang line feed character.\n → line feed
Escape: tumutugma sa isang tab character.\t → tab
Escape: tumutugma sa isang carriage return character.\r → carriage return
Tumutugma sa isang karakter na may ibinigay na two-digit na hexadecimal code.\x41 → A
Tumutugma sa isang karakter na may ibinigay na hexadecimal code point, kapag naka-set ang u flag.\u{1F600} → 😀
Class intersection, gamit ang v flag: tumutugma sa mga karakter na nasa parehong set nang sabay.[[a-z]&&[^aeiou]] → t
Mga Quantifier
Tumutugma sa nakaraang token nang zero o higit pang beses.ab* → abbb
Tumutugma sa nakaraang token nang isa o higit pang beses.a+ → aaa
Tumutugma sa nakaraang token nang zero o isang beses, na ginagawang optional.colou?r → color
Tumutugma sa nakaraang token nang eksaktong n beses.a{3} → aaa
Tumutugma sa nakaraang token nang n o higit pang beses.a{2,} → aaaa
Tumutugma sa nakaraang token nang pagitan ng n at m beses, kasama ang dalawang hangganan.a{2,4} → aaa
Lazy quantifier: tumutugma sa nakaraang token nang zero o higit pang beses, kinukuha ang pinakakaunti hangga't maaari.<.*?> on <a><b> → <a>
Lazy quantifier: tumutugma sa nakaraang token nang isa o higit pang beses, kinukuha ang pinakakaunti hangga't maaari.\d+? on 123 → 1
Lazy quantifier: tumutugma sa nakaraang token nang zero o isang beses, mas gusto ang zero.ab?? on ab → a
Lazy quantifier: tumutugma sa nakaraang token nang pagitan ng n at m beses, kinukuha ang pinakakaunti hangga't maaari.a{1,3}? on aaa → a
Possessive quantifier (PCRE): tumutugma sa nakaraang token nang zero o higit pang beses at pinapanatili ito, hindi kailanman nagba-backtrack para subukan ang ibang paghahati..*+a on aaa → no match
Mga Group at alternation
Capturing group: tumutugma sa sequence at naaalala ito para sa mga backreference.(ab)+ → abab
Non-capturing group: tumutugma sa sequence nang hindi ito naaalala.(?:ab)+ → abab
Positive lookahead: tumutugma kung ang susunod na mga karakter ay abc, nang hindi kinukonsumo ang mga ito.a(?=b) → a
Negative lookahead: tumutugma kung ang susunod na mga karakter ay hindi abc, nang hindi kinukonsumo ang mga ito.a(?!b) → a
Backreference: tumutugma sa eksaktong teksto na nakuha ng capturing group 1.(a)\1 → aa
Alternation: tumutugma sa alinman sa expression bago ang bar o pagkatapos nito.cat|dog → dog
Pinangalanang capturing group: tumutugma sa sequence at naaalala ito sa ilalim ng ibinigay na pangalan.(?<year>\d{4}) → year = 2026
Positive lookbehind: tumutugma kung ang mga naunang karakter ay abc, nang hindi kinukonsumo ang mga ito.(?<=a)b → b
Negative lookbehind: tumutugma kung ang mga naunang karakter ay hindi abc, nang hindi kinukonsumo ang mga ito.(?<!a)b → b
Pinangalanang backreference: tumutugma sa eksaktong teksto na nakuha ng pinangalanang group.(?<w>\w+) \k<w> → the the
Atomic group (PCRE): tumutugma sa sequence nang isang beses at hindi kailanman nagba-backtrack papasok dito.(?>a+)ab on aab → no match
Branch reset (PCRE): alternation kung saan ginagamit muli ng bawat branch ang parehong mga group number.(?|(cat)|(dog)) → \1 = dog
Mga Flag
Global flag: hanapin ang bawat tugma sa string, hindi lang ang una./a/g on aaa → a, a, a
Case-insensitive flag: balewalain ang letter case kapag nagtutugma./Hi/i → hi
Multiline flag: ituring ang ^ at $ bilang simula at dulo ng bawat linya./^a/m matches at the start of each line
Dotall flag: payagan din ang dot na tumugma sa line break./a.b/s → a\nb
Unicode flag: ituring ang pattern at input bilang mga unicode code point./\u{1F600}/u → 😀
Sticky flag: tumutugma lamang sa eksaktong posisyong itinakda ng lastIndex./ab/y matches only at lastIndex
Indices flag: nagdaragdag ng simula at dulong posisyon ng bawat tugma sa resulta./b/d on abc → indices [1, 2]
Unicode sets flag: mas striktong u na nagpapahintulot din ng mga set operation sa loob ng class./[a-z&&[^aeiou]]/v → t
Extended flag (PCRE): binabalewala ang mga hindi naka-escape na whitespace at # comment sa loob ng pattern./a b/x → ab