Skip to content

Regex Tokenleri açıklaması

Temel regex tokenlerinin tamamı: çapalar, karakter sınıfları, niceleyiciler, gruplar ve bayraklar. Her birinin anlamı, somut bir eşleşmeyle birlikte. Regex Tester aracının hızlı başvuru yoldaşı.

Regex tokenleri birleşir: bir çapa, bir karakter sınıfı ve bir niceleyiciyi üst üste koyarak desen kurarsınız. ^ başlangıca sabitler, \d bir rakamla eşleşir, {2,4} ise kaç kez olduğunu belirler. Bunları ^\d{2,4}$ olarak birleştirin; iki ile dört rakamdan oluşan tümlüğü eşleştirir. Deseni soldan sağa, bir seferde bir token okuyun. Yoldaş Regex Tester aracı, bu tokenleri kendi metniniz üzerinde canlı denemenizi sağlar.

Referans tablosu · 55 kayıtregex-tester aracını aç →
55 of 55 rows
Çapalar
Dizenin başındaki konumla eşleşir; m bayrağıyla satır başındaki konumla.^He → He
Dizenin sonundaki konumla eşleşir; m bayrağıyla satır sonundaki konumla.lo$ → lo
Kelime sınırıyla eşleşir: kelime karakteri ile kelime olmayan karakter arasındaki konum.\bcat\b → cat
Kelime olmayan sınırıyla eşleşir: iki kelime karakteri veya iki kelime dışı karakter arasındaki konum.\Bar → ar
Karakter sınıfları
s bayrağı ayarlanmadıkça satır sonu dışındaki herhangi bir tek karakterle eşleşir.a.c → abc
Herhangi bir rakamla eşleşir: 0 ile 9 arası.\d → 7
Rakam olmayan herhangi bir karakterle eşleşir.\D → a
Herhangi bir kelime karakteriyle eşleşir: harf, rakam veya alt çizgi.\w → _
Kelime karakteri olmayan herhangi bir karakterle eşleşir.\W → !
Herhangi bir boşluk karakteriyle eşleşir: düz boşluk, sekme veya satır sonu.a\sb → a b
Boşluk olmayan herhangi bir karakterle eşleşir.\S → a
Köşeli parantez içinde listelenen karakterlerden herhangi biriyle eşleşir.[aeiou] → e
Parantez içinde listelenenlerin dışındaki herhangi bir karakterle eşleşir.[^aeiou] → s
Verilen aralıktaki, a'dan z'ye herhangi bir tek karakterle eşleşir.[a-z] → m
Satır sonu dahil herhangi bir tek karakterle eşleşir; satırlar arası nokta için yaygın deyim.[\s\S] → \n
u bayrağı ayarlıyken herhangi bir yazı sisteminden unicode harfle eşleşir.\p{L} → é
u bayrağı ayarlıyken herhangi bir yazı sisteminden unicode sayı karakteriyle eşleşir.\p{N} → ٣
Kaçış dizisi: tek bir satır besleme (line feed) karakteriyle eşleşir.\n → line feed
Kaçış dizisi: tek bir sekme karakteriyle eşleşir.\t → tab
Kaçış dizisi: tek bir satır başı (carriage return) karakteriyle eşleşir.\r → carriage return
Verilen iki haneli onaltılık koda sahip tek karakterle eşleşir.\x41 → A
u bayrağı ayarlıyken verilen onaltılık kod noktasındaki tek karakterle eşleşir.\u{1F600} → 😀
v bayrağıyla sınıf kesişimi: aynı anda iki kümenin de içinde olan karakterlerle eşleşir.[[a-z]&&[^aeiou]] → t
Niceleyiciler
Önceki token ile sıfır veya daha fazla kez eşleşir.ab* → abbb
Önceki token ile bir veya daha fazla kez eşleşir.a+ → aaa
Önceki token ile sıfır veya bir kez eşleşir; opsiyonel yapar.colou?r → color
Önceki token ile tam n kez eşleşir.a{3} → aaa
Önceki token ile n veya daha fazla kez eşleşir.a{2,} → aaaa
Önceki token ile n ile m kez, sınırlar dahil eşleşir.a{2,4} → aaa
Tembel niceleyici: önceki token ile sıfır veya daha fazla kez, mümkün olduğunca az alarak eşleşir.<.*?> on <a><b> → <a>
Tembel niceleyici: önceki token ile bir veya daha fazla kez, mümkün olduğunca az alarak eşleşir.\d+? on 123 → 1
Tembel niceleyici: önceki token ile sıfır veya bir kez eşleşir, sıfırı tercih eder.ab?? on ab → a
Tembel niceleyici: önceki token ile n ile m kez, mümkün olduğunca az alarak eşleşir.a{1,3}? on aaa → a
Possessive niceleyici (PCRE): önceki token ile sıfır veya daha fazla kez eşleşir ve aldığını tutar; başka bölmeler denemek için geri adım atmaz..*+a on aaa → no match
Gruplar ve alternasyon
Yakalama grubu: diziyle eşleşir ve geri referanslar için hatırlar.(ab)+ → abab
Yakalamayan grup: diziyle eşleşir ama hatırlamaz.(?:ab)+ → abab
Pozitif ileri bakış (lookahead): sıradaki karakterler abc ise eşleşir, onları tüketmez.a(?=b) → a
Negatif ileri bakış: sıradaki karakterler abc değilse eşleşir, onları tüketmez.a(?!b) → a
Geri referans: 1 numaralı yakalama grubunun yakaladığı metinle birebir eşleşir.(a)\1 → aa
Alternasyon: çubuğun önceindeki ya da sonrasındaki ifadeyle eşleşir.cat|dog → dog
Adlandırılmış yakalama grubu: diziyle eşleşir ve verilen ad altında hatırlar.(?<year>\d{4}) → year = 2026
Pozitif geri bakış (lookbehind): önceki karakterler abc ise eşleşir, onları tüketmez.(?<=a)b → b
Negatif geri bakış: önceki karakterler abc değilse eşleşir, onları tüketmez.(?<!a)b → b
Adlandırılmış geri referans: adlı grubun yakaladığı metinle birebir eşleşir.(?<w>\w+) \k<w> → the the
Atomik grup (PCRE): diziyle bir kez eşleşir ve asla içine geri adım atmaz.(?>a+)ab on aab → no match
Dal sıfırlama (branch reset, PCRE): her dalın aynı grup numaralarını yeniden kullandığı alternasyon.(?|(cat)|(dog)) → \1 = dog
Bayraklar
Global bayrak: dizede yalnızca ilkini değil her eşleşmeyi bulur./a/g on aaa → a, a, a
Büyük-küçük harf duyarsız bayrak: eşleşirken harf boyutunu yok sayar./Hi/i → hi
Çok satırlı bayrak: ^ ve $ işaretlerini her satırın başı ve sonu olarak ele alır./^a/m matches at the start of each line
Dotall bayrak: noktanın satır sonuyla da eşleşmesine izin verir./a.b/s → a\nb
Unicode bayrak: deseni ve girdiyi unicode kod noktaları olarak ele alır./\u{1F600}/u → 😀
Yapışkan bayrak (sticky): yalnızca lastIndex ile belirlenen tam konumda eşleşir./ab/y matches only at lastIndex
Indeks bayrağı: her eşleşmenin başlangıç ve bitiş konumunu sonuca ekler./b/d on abc → indices [1, 2]
Unicode kümeler bayrağı: sınıf içinde küme işlemlerine de izin veren, daha katı bir u./[a-z&&[^aeiou]]/v → t
Genişletilmiş bayrak (PCRE): desen içinde kaçışsız boşlukları ve # yorumlarını yok sayar./a b/x → ab