Unicode Kodlama Dönüştürücü
Unicode kaçış dizilerini metne, metni Unicode'a çevirin. \u4e2d kaçışları, ES6 süslü parantezleri, U+ kod noktaları ve UTF-8 baytları yapıştırınca tanınır; tüm gösterimler tek seferde listelenir. Her şey tarayıcınızda kalır.
Her şey tarayıcınızda çalışır — girdiniz asla yüklenmez, günlüğe yazılmaz ya da saklanmaz.
Sonuç burada görünür Bütün gösterimler tek seferde
| JavaScript / Java / JSON uXXXX | — | |
|---|---|---|
| ES6 u{XXXXX} | — | |
| Python uXXXX / UXXXXXXXX | — | |
| Go uXXXX / UXXXXXXXX | — | |
| Rust u{XXXXX} | — | |
| Kod noktası U+XXXX | — | |
| HTML ondalık &#NNNNN; | — | |
| HTML hex &#xXXXX; | — | |
| URL kodlu %XX | — | |
| CSS XXXXXX | — | |
| UTF-8 baytları hex | — | |
| UTF-16 birimleri hex | — | |
| UTF-32 hex | — | |
| Sekizlik baytlar NNN | — | |
| Ondalık kod noktaları NNNNN | — |
Karakter karakter
| Karakter | Kod noktası | UTF-8 | UTF-16 | Yazı sistemi | Kategori | Ad |
|---|---|---|---|---|---|---|
| Sonuç burada görünür | ||||||
Hızlı başvuru
| Karakter | Kod noktası | JavaScript / Java / JSON | UTF-8 baytları | URL kodlu | HTML ondalık |
|---|---|---|---|---|---|
| 中文 | U+4E2D U+6587 | \u4E2D\u6587 | E4 B8 AD E6 96 87 | %E4%B8%AD%E6%96%87 | 中文 |
| 😀 | U+1F600 | \uD83D\uDE00 | F0 9F 98 80 | %F0%9F%98%80 | 😀 |
| A | U+0041 | A | 41 | A | A |
| ␣ U+3000 | U+3000 | \u3000 | E3 80 80 | %E3%80%80 |   |
Davranış, belgelere bakılarak varsayılmadı; Node, Python, Java, Go ve gerçek bir tarayıcı motoru üzerinde doğrulandı.
Unicode kaçış dizisi nedir?
Bir Unicode kaçış dizisi, karakteri yalnızca ASCII kullanarak yazar; böylece karakterin kendisini taşıyamayan sistemlerden sağ çıkar. Aynı karakterin kaçışı neredeyse her dilde farklıdır: JavaScript ve JSON her UTF-16 kod birimi için dört on altılık basamak kullanır, ES6 ve Rust süslü parantez içinde tam kod noktasını alır, Python ve Go sekiz basamaklı geniş bir biçim ekler, CSS çıplak bir ters eğik çizgiyle yetinir, HTML'in ise kendi sayısal ve adlı referansları vardır. Hepsi aynı kod noktasını anlatır. Tek bir dizenin size yarım düzine farklı kılıkta ulaşmasının nedeni de budur.
中文
U+4E2D U+6587 code point
\u4E2D\u6587 JavaScript / Java / JSON
\u{4E2D}\u{6587} ES6 / Rust
E4 B8 AD E6 96 87 UTF-8
%E4%B8%AD%E6%96%87 URL
中文 HTML Bu dönüştürücü ne yapar
Biçimi sizin yerinize tanır
Kaçış dizileri, süslü parantezler, geniş kaçışlar, kod noktaları, varlıklar, yüzde kodlaması ve bayt dizileri mod değiştirmeden algılanır.
Karışık girdiyi bozmaz
Yalnızca kodlanmış bölümler değişir. JSON noktalaması, Windows yolları ve önceden kaçış karakteriyle korunmuş ters eğik çizgiler oldukları gibi kalır.
Bütün gösterimler tek seferde
Tek bir yapıştırma tablonun tamamını üretir; bir dilden diğerine geçmek için iki kez dönüştürmeniz gerekmez.
Dil başına doğruluk
Temel Çok Dilli Düzlem dışındaki karakterler, vekil çiftin işe yaramayacağı Python ve Go için geniş kaçış olarak yazılır.
Karakter düzeyinde inceleme
Her karakter için kod noktası, UTF-8 ve UTF-16 baytları, yazı sistemi ve kategori; adı tanımlı olan karakterlerde Unicode adı da listelenir.
Görünmez karakterleri ortaya çıkarır
Bayt sırası işaretleri, sıfır genişlikli birleştiriciler ve bölünmez boşluklar görünür bir karşılık alır.
Örnekler
Bir günlük satırını, geri kalanına dokunmadan çözün
{"msg":"\u4e2d\u6587 failed","code":500} {"msg":"中文 failed","code":500} Yalnızca kaçış dizileri değişir. Tırnaklar, anahtarlar ve sayılar oldukları gibi kalır; yani kaçışları tek tek ayıklamak yerine günlük satırının tamamını yapıştırabilirsiniz.
Tek yapıştırmada karışık gösterimler
U+4E2D \u{1F600} 中 \ud83d\ude00 中 😀 中 😀
Bir kod noktası, bir ES6 süslü parantez kaçışı, bir HTML varlığı ve bir vekil çift; hepsi tek geçişte çözüldü. Önceden bir şey seçmek ya da ayarlamak gerekmedi.
Tek karakter, bütün gösterimleri
中
\u4E2D JavaScript / Java / JSON
\u{4E2D} ES6 / Rust
U+4E2D code point
E4 B8 AD UTF-8
\344\270\255 octal Aynı karakterin, her dilin beklediği biçimde yazılışı. Temel Çok Dilli Düzlem dışındaki karakterler için Python ve Go geniş biçimi ister: vekil çift Go'da derlenmez, Python'da UnicodeEncodeError verir.
Nasıl kullanılır
- 1
Yapıştırın
Kaçış dizilerini, kod noktalarını, varlıkları, kodlanmış baytları ya da düz metni bırakın. Hangisi olduğunu söylemeniz gerekmez.
- 2
Sonucu okuyun
Okunabilir metin anında belirir; yanında hangi gösterimlerin tanındığı yazar.
- 3
İhtiyacınız olan biçimi kopyalayın
Bütün gösterimler sonucun altında listelenir ve her birinin kendi kopyalama düğmesi vardır.
- 4
Bir şey ters görünüyorsa inceleyin
Kod noktalarını, baytları, yazı sistemini ve karakter adlarını görmek için karakter tablosunu açın; görünmez karakterleri ortaya çıkarmak için Göster seçeneğini kullanın.
Bilmeye değer hatalar
Dilin geniş kaçış istediği yere vekil çift yazmak
JSON'da çalışan bir çift, Python'da iki bozuk yarıya döner ve Go'da derlenmez. U+FFFF üzerindeki karakterler için geniş biçimi kullanın.
\ud83d\ude00
\U0001F600
HTML sayısal referanslarını düz kod noktası saymak
128 ile 159 arasındaki referanslar windows-1252 üzerinden okunmalıdır. Saf bir uygulama sağ tek tırnak işaretini görünmez bir denetim karakterine çevirir; eski bir dışa aktarmada o noktalarda hiçbir şeyin görünmemesinin nedeni de budur.
’ -> U+0092
’ -> U+2019
On altılık bir karakterden önce kısa CSS kaçışı kullanmak
Ayrıştırıcı on altılık basamakları yemeyi sürdürür, böylece kaçış ile sonraki karakter birleşip yanlış tek bir kod noktası olur. Altı basamağa tamamlayın.
\4E2Da
\004E2Da
Ne zaman işinize yarar
- Günlükleri okumak
- Sunucu günlükleri ve API yanıtları ASCII dışı karakterleri çoğu zaman kaçış dizisi olarak taşır. Satırı yapıştırın ve önce elle düzenlemeden okuyun.
- Dizeleri diller arasında taşımak
- Vekil çiftlerle geniş kaçışlar arasında elle dönüşüm yapmak yerine, hedef dilin kabul ettiği biçimi doğrudan kopyalayın.
- Bir kodlama hatasının peşine düşmek
- Bir karşılaştırma başarısız olduğunda ya da veritabanı bir değeri reddettiğinde, karakter tablosu tam olarak hangi kod noktalarının ve baytların işin içinde olduğunu gösterir.
- Yapıştırılan içeriği temizlemek
- Bir web sayfasından ya da belgeden kopyalanan metin sık sık görünmez karakter taşır. Onları üretime ulaşmadan önce bulun.
Teknik ayrıntılar
- Karakter değil, UTF-16 kod birimi
- JavaScript, Java ve JSON karakterleri değil UTF-16 kod birimlerini kaçış dizisine çevirir; bu yüzden U+FFFF üzerindeki bir karakter iki kaçış ister. Python ve Go bunun yerine kod noktasını doğrudan alan sekiz basamaklı bir biçim sunar.
- HTML sayısal referansları yeniden eşlenir
- HTML belirtimi, 128 ile 159 arasındaki sayısal referansların kod noktası olarak değil windows-1252 üzerinden okunmasını ister. Yani 146 gibi bir referans, görünmez bir denetim karakteri değil, sağ tek tırnak işaretidir.
- CSS kaçışları dolgu ister
- Bir CSS kaçışı en fazla altı on altılık basamak yutar; kısa bir kaçışın ardından on altılık bir karakter gelirse ikisi birleşip yanlış tek bir kod noktasına dönüşür. Altı basamağa tamamlamak belirsizliği kaldırır, hemen sonrasındaki boşluk da sonlandırıcı olarak yutulur.
- Eşi olmayan vekiller her yerde başka türlü davranır
- Eşi olmayan bir vekili JSON serileştirmesi korur, TextEncoder sessizce değiştirir, yüzde kodlaması reddeder, Java soru işareti olarak yazar, Python ise hata fırlatır.
En iyi uygulamalar
- Karşılaştırmadan önce normalleştirin
- Karşılaştırmadan ya da yinelenenleri ayıklamadan önce iki tarafı da aynı normalleştirme biçimine katlayın; özellikle adlarda ve tanımlayıcılarda.
- Python ve Go için geniş biçimi tercih edin
- Vekil çift JSON'da geçerlidir ama her iki dilde de bozulur. Hedef Python ya da Go kaynağıysa sekiz basamaklı kaçışı kullanın.
- Görünmez karakterleri erkenden kontrol edin
- Yapıştırılan girdiyi, sonradan bir uyuşmazlığı ayıklamak yerine sınırda doğrulayın.
- Özgün değeri elinizde tutun
- Yerine koyma karakterleri bir kez ortaya çıktığında çözme her zaman kayıpsız geri alınabilir olmaz. Emin olana kadar ham değeri saklayın.
Sıkça sorulan sorular
\u4e2d\u6587 ne demek, bunu nasıl okurum?
Ters eğik çizgiler silinmiş, elimde yalnızca u4e2d kaldı. Bu yine de çözülür mü?
Bir emoji neden iki \u kaçışıyla yazılıyor?
Ters yöne gidip metni kaçış dizilerine nasıl çeviririm?
İki dize aynı görünüyor ama kodum farklı olduklarını söylüyor. Neden?
Dizemdeki görünmez bir şey kodumu bozuyor. Onu nasıl bulurum?
Verilerim bir yere yükleniyor mu?
İlgili Araçlar
Tüm araçları görüntüleyin →Base64 Çözücü ve Kodlayıcı
Kodlama ve Biçimlendirme
Base64'ü ücretsiz çevrimiçi kodlayın ve çözün. Tam UTF-8 ve emoji desteğiyle gerçek zamanlı dönüştürme. %100 tarayıcıda — kayıt gerekmez.
Base64'ü Görsele Çevirme Aracı
Kodlama ve Biçimlendirme
Bir Base64 dizesini ya da data URI'yi tarayıcınızda görsele geri çözün. Önizleyin, boyutları ve MIME'ı okuyun, ardından PNG, JPG, GIF, SVG olarak indirin. Yükleme yok.
CSV'den JSON'a Dönüştürücü
Kodlama ve Biçimlendirme
CSV'yi tarayıcınızda JSON'a dönüştürün. RFC 4180, tür çıkarımı, başlık satırı, büyük tam sayı güvenli. %100 gizli, yükleme yok.
.env'den JSON'a Dönüştürücü
Kodlama ve Biçimlendirme
Bir .env dosyası yapıştırın, anında JSON alın. Sırlarınız tarayıcınızdan asla çıkmaz — %100 gizli, yükleme yok, ücretsiz dotenv ayrıştırıcı.
Ücretsiz HTML Varlık Çözücü — HTML Unescape
Kodlama ve Biçimlendirme
HTML varlıklarını çözün ve HTML'i çevrimiçi unescape edin — ücretsiz, kayıt yok, %100 tarayıcınızda. Adlı, ondalık & hex referansları tekrar karaktere çevirir; asla yüklenmez.
Ücretsiz HTML Varlık Kodlayıcı — HTML Escape
Kodlama ve Biçimlendirme
HTML varlıklarını kodlayın ve özel karakterleri (< > & " ') çevrimiçi escape edin — ücretsiz, kayıt yok, %100 tarayıcınızda. Adlı, ondalık veya hex çıktı; asla yüklenmez.