İçeriğe atla
TextLib

Unicode Karakter Arama 🔣

Yapıştırdığınız metni kod noktalarına ayırır ve her karakter için U+ değerini, HTML sayısal kodunu ve CSS kaçış dizisini verir.

Results
Karakteri çözümle

Bu araç yapıştırdığınız metni kod noktası kod noktası ayırır ve her biri için dört bilgi yazar: karakterin kendisi, U+ ile başlayan onaltılık kod noktası, HTML'de kullanabileceğiniz sayısal karakter kodu ve CSS içeriğinde kullanılan ters bölü kaçış dizisi. Çıktı çok satırlıdır, yani üç karakter yapıştırdığınızda üç satır alırsınız. Sonuç satırında yalnızca ilk satırın kısaltılmış hâli görünür; listenin tamamını almak için satıra tıklayıp panoya kopyalamanız gerekir.

Türkçe metinlerde en sık işe yaradığı yer büyük-küçük harf karışıklığıdır. Alfabemizin dört farklı i harfi vardır ve dördü ayrı kod noktalarıdır: küçük noktalı i U+0069, büyük noktalı İ U+0130, küçük noktasız ı U+0131, büyük noktasız I U+0049. Bir form alanı, bir veri tabanı sorgusu ya da bir dosya adı beklenmedik davrandığında metni buraya yapıştırmak hangi i harfinin kullanıldığını saniyeler içinde gösterir. Aynı şey Ş ile Ș için de geçerlidir: Türkçe Ş harfi U+015E, Rumence'deki alttan virgüllü Ș ise U+0218'dir ve ekranda neredeyse aynı görünürler.

İkinci yaygın kullanım görünmez karakter avıdır. Bir metni başka bir siteden kopyaladığınızda araya sıfır genişlikli boşluk, sıfır genişlikli birleştirici, bayt sırası işareti ya da kırılmaz boşluk karışmış olabilir. Bunlar ekranda hiçbir iz bırakmaz ama form doğrulamasını, arama eşleşmesini ve elektronik tablo sütun hizasını bozar. Araç bu karakterleri de ayrı satır olarak listeler; ilk sütunda boşluk, kod noktası sütununda ise U+200B, U+200D, U+FEFF veya U+00A0 görürsünüz.

Birleşik yazılmış harfler de ortaya çıkar. Bazı kaynaklar — özellikle bazı PDF çıktıları ve macOS dosya adları — ş harfini tek karakter olarak değil, s harfi artı alttan çengel işareti olarak saklar. Böyle bir metni buraya yapıştırdığınızda tek harf için iki satır çıkar ve karakter sayınızın neden beklediğinizden fazla olduğunu anlarsınız.

Emojide çıktı hızla uzar, çünkü çoğu emoji tek kod noktası değildir. Ten rengi eklenmiş bir emoji temel emoji artı değiştirici olarak iki satır, aile emojileri ise araya giren sıfır genişlikli birleştiricilerle beş ve daha fazla satır üretir. Bayraklar iki bölge göstergesine ayrılır. Bir emojinin neden bazı uygulamalarda parçalanarak göründüğünü anlamanın en hızlı yolu budur.

İki sınırlamayı bilerek kullanın. Birincisi, araç karakterin resmî Unicode adını ve ait olduğu bloğu göstermez; yalnızca kod noktasını ve kodlama biçimlerini verir. İkincisi, CSS kaçış dizilerinde bir tuzak vardır: CSS bir ters bölüden sonra en fazla altı onaltılık basamak okur, bu yüzden kaçış dizisinin ardından harf ya da rakam geliyorsa araya bir boşluk koymanız gerekir. HTML sütunundaki sayısal kod ise böyle bir sorun taşımaz; noktalı virgülle kapandığı için her yerde güvenle kullanılır.

Karakter kodu nasıl bulunur

1

Metni kutuya yapıştırın

Tek karakter de olur, şüphelendiğiniz bir kelimenin tamamı da.

2

Satıra tıklayıp listeyi kopyalayın

Önizleme tek satır gösterir; panoya bütün kod noktası listesi gider.

3

Kodu ihtiyacınız olan biçimde kullanın

HTML için sayısal kodu, CSS içeriği için ters bölülü kaçış dizisini alın.

Unicode arama hakkında sık sorulanlar

Hayır. Araç kod noktasını, HTML sayısal kodunu ve CSS kaçış dizisini verir; karakterin resmî Unicode adını ve ait olduğu bloğu göstermez. Adı öğrenmek isterseniz kod noktasını Unicode karakter veri tabanında aratmanız gerekir.

Evet, bunun için ideal. Küçük noktalı i U+0069, büyük noktalı İ U+0130, küçük noktasız ı U+0131 ve büyük noktasız I U+0049 olarak listelenir; bir form alanının neden eşleşmediğini anlamanın en hızlı yolu budur.

Evet. Sıfır genişlikli boşluk U+200B, sıfır genişlikli birleştirici U+200D, bayt sırası işareti U+FEFF ve kırılmaz boşluk U+00A0 ayrı satır olarak listelenir. İlk sütun boş görünür ama kod noktası sütunu karakteri ele verir.

Metin ayrıştırılmış biçimde saklanıyor demektir: ş harfi tek karakter yerine s harfi artı alttan çengel işareti olarak tutulmuştur. Bu durum bazı PDF çıktılarında ve macOS dosya adlarında sık görülür ve karakter sayısını beklenmedik biçimde artırır.

Çoğu emoji tek kod noktası değildir. Ten rengi eklenen emojiler temel emoji artı değiştirici olarak iki satır, aile emojileri araya giren sıfır genişlikli birleştiricilerle beş ve daha fazla satır, bayraklar ise iki bölge göstergesi olarak listelenir.

CSS bir ters bölüden sonra en fazla altı onaltılık basamak okur. Kaçış dizisinin ardından harf veya rakam geliyorsa araya bir boşluk koyun, yoksa tarayıcı sonraki karakteri kodun parçası sanar ve bambaşka bir işaret çizer.

Evet. Ondalık biçimde yazılan ve noktalı virgülle kapanan sayısal kod bütün tarayıcılarda geçerlidir ve adlandırılmış kısaltmalara göre daha güvenlidir, çünkü her karakterin adlandırılmış bir karşılığı yoktur.

Hayır, çözümleme tamamen tarayıcınızda yapılır ve yapıştırdığınız metin cihazdan çıkmaz. Bu yüzden gizli kalması gereken kayıtları ve kişisel verileri de güvenle inceleyebilirsiniz.

Kopyalandı!