Skip to content

Unicode Kodlama Dönüştürücü

Unicode kaçış dizilerini metne, metni Unicode'a çevirin. \u4e2d kaçışları, ES6 süslü parantezleri, U+ kod noktaları ve UTF-8 baytları yapıştırınca tanınır; tüm gösterimler tek seferde listelenir. Her şey tarayıcınızda kalır.

Takip Yok Tarayıcıda Çalışır Ücretsiz

Her şey tarayıcınızda çalışır — girdiniz asla yüklenmez, günlüğe yazılmaz ya da saklanmaz.

0 karakter
Okunabilir metin
Sonuç burada görünür
Normalleştir
Bütün gösterimler tek seferde
JavaScript / Java / JSON uXXXX
ES6 u{XXXXX}
Python uXXXX / UXXXXXXXX
Go uXXXX / UXXXXXXXX
Rust u{XXXXX}
Kod noktası U+XXXX
HTML ondalık &#NNNNN;
HTML hex &#xXXXX;
URL kodlu %XX
CSS XXXXXX
UTF-8 baytları hex
UTF-16 birimleri hex
UTF-32 hex
Sekizlik baytlar NNN
Ondalık kod noktaları NNNNN
Karakter karakter
Karakter Kod noktası UTF-8 UTF-16 Yazı sistemi Kategori Ad
Sonuç burada görünür

Hızlı başvuru

Karakter Kod noktası JavaScript / Java / JSON UTF-8 baytları URL kodlu HTML ondalık
中文 U+4E2D U+6587 \u4E2D\u6587 E4 B8 AD E6 96 87 %E4%B8%AD%E6%96%87 中文
😀 U+1F600 \uD83D\uDE00 F0 9F 98 80 %F0%9F%98%80 😀
A U+0041 A 41 A A
U+3000 U+3000 \u3000 E3 80 80 %E3%80%80  
Başvuru tablosundaki her dönüşüm, yayımlanmadan önce birbirinden bağımsız iki uygulama arasında karşılıklı kontrol edildi. — Go Tools Mühendislik Ekibi · Aug 27, 2026

Davranış, belgelere bakılarak varsayılmadı; Node, Python, Java, Go ve gerçek bir tarayıcı motoru üzerinde doğrulandı.

Unicode kaçış dizisi nedir?

Bir Unicode kaçış dizisi, karakteri yalnızca ASCII kullanarak yazar; böylece karakterin kendisini taşıyamayan sistemlerden sağ çıkar. Aynı karakterin kaçışı neredeyse her dilde farklıdır: JavaScript ve JSON her UTF-16 kod birimi için dört on altılık basamak kullanır, ES6 ve Rust süslü parantez içinde tam kod noktasını alır, Python ve Go sekiz basamaklı geniş bir biçim ekler, CSS çıplak bir ters eğik çizgiyle yetinir, HTML'in ise kendi sayısal ve adlı referansları vardır. Hepsi aynı kod noktasını anlatır. Tek bir dizenin size yarım düzine farklı kılıkta ulaşmasının nedeni de budur.

中文
  U+4E2D U+6587         code point
  \u4E2D\u6587          JavaScript / Java / JSON
  \u{4E2D}\u{6587}      ES6 / Rust
  E4 B8 AD E6 96 87     UTF-8
  %E4%B8%AD%E6%96%87    URL
  中文      HTML

Bu dönüştürücü ne yapar

Biçimi sizin yerinize tanır

Kaçış dizileri, süslü parantezler, geniş kaçışlar, kod noktaları, varlıklar, yüzde kodlaması ve bayt dizileri mod değiştirmeden algılanır.

Karışık girdiyi bozmaz

Yalnızca kodlanmış bölümler değişir. JSON noktalaması, Windows yolları ve önceden kaçış karakteriyle korunmuş ters eğik çizgiler oldukları gibi kalır.

Bütün gösterimler tek seferde

Tek bir yapıştırma tablonun tamamını üretir; bir dilden diğerine geçmek için iki kez dönüştürmeniz gerekmez.

Dil başına doğruluk

Temel Çok Dilli Düzlem dışındaki karakterler, vekil çiftin işe yaramayacağı Python ve Go için geniş kaçış olarak yazılır.

Karakter düzeyinde inceleme

Her karakter için kod noktası, UTF-8 ve UTF-16 baytları, yazı sistemi ve kategori; adı tanımlı olan karakterlerde Unicode adı da listelenir.

Görünmez karakterleri ortaya çıkarır

Bayt sırası işaretleri, sıfır genişlikli birleştiriciler ve bölünmez boşluklar görünür bir karşılık alır.

Örnekler

Bir günlük satırını, geri kalanına dokunmadan çözün

{"msg":"\u4e2d\u6587 failed","code":500}
{"msg":"中文 failed","code":500}

Yalnızca kaçış dizileri değişir. Tırnaklar, anahtarlar ve sayılar oldukları gibi kalır; yani kaçışları tek tek ayıklamak yerine günlük satırının tamamını yapıştırabilirsiniz.

Tek yapıştırmada karışık gösterimler

U+4E2D  \u{1F600}  中  \ud83d\ude00
中  😀  中  😀

Bir kod noktası, bir ES6 süslü parantez kaçışı, bir HTML varlığı ve bir vekil çift; hepsi tek geçişte çözüldü. Önceden bir şey seçmek ya da ayarlamak gerekmedi.

Tek karakter, bütün gösterimleri

\u4E2D        JavaScript / Java / JSON
\u{4E2D}      ES6 / Rust
U+4E2D        code point
E4 B8 AD      UTF-8
\344\270\255  octal

Aynı karakterin, her dilin beklediği biçimde yazılışı. Temel Çok Dilli Düzlem dışındaki karakterler için Python ve Go geniş biçimi ister: vekil çift Go'da derlenmez, Python'da UnicodeEncodeError verir.

Nasıl kullanılır

  1. 1

    Yapıştırın

    Kaçış dizilerini, kod noktalarını, varlıkları, kodlanmış baytları ya da düz metni bırakın. Hangisi olduğunu söylemeniz gerekmez.

  2. 2

    Sonucu okuyun

    Okunabilir metin anında belirir; yanında hangi gösterimlerin tanındığı yazar.

  3. 3

    İhtiyacınız olan biçimi kopyalayın

    Bütün gösterimler sonucun altında listelenir ve her birinin kendi kopyalama düğmesi vardır.

  4. 4

    Bir şey ters görünüyorsa inceleyin

    Kod noktalarını, baytları, yazı sistemini ve karakter adlarını görmek için karakter tablosunu açın; görünmez karakterleri ortaya çıkarmak için Göster seçeneğini kullanın.

Bilmeye değer hatalar

Dilin geniş kaçış istediği yere vekil çift yazmak

JSON'da çalışan bir çift, Python'da iki bozuk yarıya döner ve Go'da derlenmez. U+FFFF üzerindeki karakterler için geniş biçimi kullanın.

✗ Yanlış
\ud83d\ude00
✓ Doğru
\U0001F600

HTML sayısal referanslarını düz kod noktası saymak

128 ile 159 arasındaki referanslar windows-1252 üzerinden okunmalıdır. Saf bir uygulama sağ tek tırnak işaretini görünmez bir denetim karakterine çevirir; eski bir dışa aktarmada o noktalarda hiçbir şeyin görünmemesinin nedeni de budur.

✗ Yanlış
’  ->  U+0092
✓ Doğru
’  ->  U+2019

On altılık bir karakterden önce kısa CSS kaçışı kullanmak

Ayrıştırıcı on altılık basamakları yemeyi sürdürür, böylece kaçış ile sonraki karakter birleşip yanlış tek bir kod noktası olur. Altı basamağa tamamlayın.

✗ Yanlış
\4E2Da
✓ Doğru
\004E2Da

Ne zaman işinize yarar

Günlükleri okumak
Sunucu günlükleri ve API yanıtları ASCII dışı karakterleri çoğu zaman kaçış dizisi olarak taşır. Satırı yapıştırın ve önce elle düzenlemeden okuyun.
Dizeleri diller arasında taşımak
Vekil çiftlerle geniş kaçışlar arasında elle dönüşüm yapmak yerine, hedef dilin kabul ettiği biçimi doğrudan kopyalayın.
Bir kodlama hatasının peşine düşmek
Bir karşılaştırma başarısız olduğunda ya da veritabanı bir değeri reddettiğinde, karakter tablosu tam olarak hangi kod noktalarının ve baytların işin içinde olduğunu gösterir.
Yapıştırılan içeriği temizlemek
Bir web sayfasından ya da belgeden kopyalanan metin sık sık görünmez karakter taşır. Onları üretime ulaşmadan önce bulun.

Teknik ayrıntılar

Karakter değil, UTF-16 kod birimi
JavaScript, Java ve JSON karakterleri değil UTF-16 kod birimlerini kaçış dizisine çevirir; bu yüzden U+FFFF üzerindeki bir karakter iki kaçış ister. Python ve Go bunun yerine kod noktasını doğrudan alan sekiz basamaklı bir biçim sunar.
HTML sayısal referansları yeniden eşlenir
HTML belirtimi, 128 ile 159 arasındaki sayısal referansların kod noktası olarak değil windows-1252 üzerinden okunmasını ister. Yani 146 gibi bir referans, görünmez bir denetim karakteri değil, sağ tek tırnak işaretidir.
CSS kaçışları dolgu ister
Bir CSS kaçışı en fazla altı on altılık basamak yutar; kısa bir kaçışın ardından on altılık bir karakter gelirse ikisi birleşip yanlış tek bir kod noktasına dönüşür. Altı basamağa tamamlamak belirsizliği kaldırır, hemen sonrasındaki boşluk da sonlandırıcı olarak yutulur.
Eşi olmayan vekiller her yerde başka türlü davranır
Eşi olmayan bir vekili JSON serileştirmesi korur, TextEncoder sessizce değiştirir, yüzde kodlaması reddeder, Java soru işareti olarak yazar, Python ise hata fırlatır.

En iyi uygulamalar

Karşılaştırmadan önce normalleştirin
Karşılaştırmadan ya da yinelenenleri ayıklamadan önce iki tarafı da aynı normalleştirme biçimine katlayın; özellikle adlarda ve tanımlayıcılarda.
Python ve Go için geniş biçimi tercih edin
Vekil çift JSON'da geçerlidir ama her iki dilde de bozulur. Hedef Python ya da Go kaynağıysa sekiz basamaklı kaçışı kullanın.
Görünmez karakterleri erkenden kontrol edin
Yapıştırılan girdiyi, sonradan bir uyuşmazlığı ayıklamak yerine sınırda doğrulayın.
Özgün değeri elinizde tutun
Yerine koyma karakterleri bir kez ortaya çıktığında çözme her zaman kayıpsız geri alınabilir olmaz. Emin olana kadar ham değeri saklayın.

Sıkça sorulan sorular

\u4e2d\u6587 ne demek, bunu nasıl okurum?
Her \uXXXX, on altılık yazılmış tek bir UTF-16 kod birimidir. \u4e2d U+4E2D, \u6587 ise U+6587 demektir; ikisi birlikte 中文 sözcüğünü yazar. Dizenin tamamını yukarıdaki kutuya yapıştırın, okunabilir metin geri gelir. Çevresindeki JSON ya da günlük metni olduğu gibi korunur.
Ters eğik çizgiler silinmiş, elimde yalnızca u4e2d kaldı. Bu yine de çözülür mü?
Evet. Terminaller ve günlük boru hatları ters eğik çizgiyi sık sık yutar. Çıplak u4e2du6587 tanınır ve çözülür; içinde u geçen sıradan sözcüklere ise dokunulmaz.
Bir emoji neden iki \u kaçışıyla yazılıyor?
U+FFFF üzerindeki karakterler tek bir UTF-16 kod birimine sığmaz; bu yüzden JavaScript, Java ve JSON onları vekil çift olarak yazar. Sırıtan yüz emojisi bir kod noktası, iki UTF-16 kod birimi ve dört UTF-8 baytıdır. Karakter tablosu bu üç sayıyı da gösterir.
Ters yöne gidip metni kaçış dizilerine nasıl çeviririm?
Düz metni yazın ya da yapıştırın, sonra sonucun altındaki tabloyu okuyun. Bütün gösterimler aynı anda üretilir; iki kez dönüştürmek yerine dilinizin beklediği biçimi doğrudan kopyalarsınız.
İki dize aynı görünüyor ama kodum farklı olduklarını söylüyor. Neden?
Büyük olasılıkla farklı normalleştirilmişlerdir. Aksanlı bir harf tek kod noktası olabilir (é için U+00E9) ya da temel harf artı birleştirici işaret olabilir (e ile U+0301). İkisi de aynı görünür, eşit değildir. Onları aynı biçime katlamak için NFC düğmesini kullanın. Normalleştirmenin CJK için etkisiz bir işlem olduğunu da sanmayın: uyumluluk ideogramı U+F900, düz NFC altında U+8C48 olur.
Dizemdeki görünmez bir şey kodumu bozuyor. Onu nasıl bulurum?
Görünmez karakterleri göster seçeneğini açın. Bayt sırası işaretleri, sıfır genişlikli boşluklar, bölünmez boşluklar ve varyasyon seçicileri görünür bir karşılık alır; karakter tablosu her birinin adını ve baytlarını verir.
Verilerim bir yere yükleniyor mu?
Hayır. Dönüşüm tarayıcınızda, tek bir ağ isteği olmadan gerçekleşir. Hiçbir şey yüklenmez, günlüğe yazılmaz ya da saklanmaz; üretim günlüklerini buraya yapıştırmak güvenlidir.