Metin - ASCII/Unicode Kod Çevirici

Metni ondalık karakter kodu listesine çevirin ve geri çevirin — yalnızca 7-bit ASCII değil, tüm Unicode aralığını kapsar.

1.072 görüntülenme

Nasıl Çalışır

Yazdığınız her karakter tek tek işlenir ve Unicode kod noktasına çevrilir — bu numaralandırma sisteminin ilk 128 değeri (0-127) klasik ASCII tablosunu oluşturur. Bu aralıkta 32-126 arası kodlar yazdırılabilir bloktur: harfler, rakamlar, noktalama işaretleri ve boşluk karakteri. 0-31 arası kodlar ise kontrol karakterleridir — teleks ve daktilo makinelerinden kalma tarihsel bir katman olup bir harf basmak yerine yazı kafasını veya kağıdı hareket ettirmek için kullanılırdı: 13 numaralı kod (satır başı/carriage return) yazı kafasını satırın başına gönderir, 10 numaralı kod (satır besleme/line feed) kağıdı bir satır ilerletirdi — Windows, Unix ve eski Mac sistemlerinin satır sonunu hâlâ farklı şekilde saklamasının kökeni de tam olarak bu ayrımdır.

Örnek: "Hi!" yazınca 72, 105, 33 kod listesi çıkar — büyük H 72, küçük i 105, ünlem işareti 33'tür, hepsi yazdırılabilir 32-126 aralığındadır. Bu listeyi çözücüye yapıştırdığınızda "Hi!" karakter karakter aynen geri kurulur.

Bu aracın ders kitabı ASCII tablosunun ötesine geçtiği yer, 128 ve üzeri kodlardır. "Genişletilmiş ASCII" denen bu üst aralık hiçbir zaman standartlaştırılmamıştır: farklı üreticiler ve bölgeler farklı 256 değerlik code page'ler oluşturmuş, aynı byte değerine farklı karakterler atamıştır. Bir Türkçe code page'de "ğ" anlamına gelen byte, başka bir sistemde bambaşka bir karaktere — hatta hiç yazdırılamayan bir şeye — denk gelebilirdi. UTF-8 ve tam Unicode kod noktalarının çözmeye çalıştığı sorun tam olarak budur: byte başına bir karakter ve code page'e bağlı anlam yerine, her karaktere her yerde aynı anlama gelen sabit bir sayısal kimlik verilir. Bu araç da her karakteri tek byte'a kısaltmak yerine tam Unicode kod noktası olarak kodladığı için ğ, ş, ı, ö, ü, ç gibi Türkçe harfler ve emoji güvenilir şekilde çevrilir.

Bilinmesi Gerekenler

  • Yazdırılabilir aralık: 32-126 arası kodlar her sistemde görünür bir karaktere karşılık gelir; bunun dışındakiler doğru yorumlanmak için bağlam (bir font, code page veya tam Unicode) gerektirir.
  • Kontrol kodlarının glifi yoktur: 0-31 arası (veya 127, DEL) bir değeri metne çözmek yazdırılabilir bir karakter göstermez — bu bir hata değil, beklenen bir durumdur, çünkü bu kodlar hiçbir zaman ekranda gösterilmek üzere tasarlanmamıştır.
  • 255 byte'ının ötesi: Unicode kod noktaları eski 256 değerlik tavanın çok ötesine geçer — örneğin emoji yüz binler mertebesindeki kod noktalarında yaşar — ve bu araç tek bir byte'ın değil, tüm bu aralığın tamamını işler.
  • Kayıpsız gidiş-dönüş: kodlama ve ardından çözme, her kod noktası tam olarak bir karaktere karşılık geldiği için orijinal metninizi hiçbir yaklaştırma veya sıkıştırma olmadan aynen geri verir.
  • Tamamen tarayıcınızda çalışır: hiçbir metin hiçbir yere gönderilmez, bu yüzden hassas dizeleri, token'ları veya parolaları hata ayıklama amacıyla çevirmek güvenlidir.

Sıkça Sorulan Sorular

Bu gerçekten ASCII mi, yoksa daha fazlası mı?

Gerçek 7-bit ASCII yalnızca 0-127 kodlarını kapsar (İngilizce harfler, rakamlar, temel noktalama). Bu araç aynı fikri kullanır ama tam Unicode kod noktalarına genişletir, bu yüzden Türkçe harfler (ç, ğ, ş, ı), aksanlı harfler ve emoji bozulmadan veya soru işaretine dönüşmeden doğru çevrilir.

Kod listesi hangi ayracı kullanıyor?

Varsayılan olarak her kodun ardından boşluklu virgül — ama çözücü, düz boşluk veya satır sonuyla ayrılmış kodları da kabul eder, böylece başka bir araçtan kopyalanan liste genelde yeniden biçimlendirmeden çalışır.

10 ile 13 numaralı kodlar arasındaki fark nedir?

İkisi de tarihsel satır sonu kontrol karakterleridir: 10 numara "satır besleme"dir (bir satır aşağı iner), 13 numara "satır başı"dır (satırın başına döner). Unix yalnız LF kullanır, eski Mac yalnız CR kullanırdı, Windows ise ikisini birlikte kullanır (CRLF) — bu ayrım doğrudan fiziksel teleks donanımına dayanır.

127'nin üzerindeki kodlar neden başka araçlarda farklı görünüyor?

Çünkü bu aralık hiçbir zaman standartlaştırılmadı. Her üreticinin "genişletilmiş ASCII" code page'i, 128-255 arası byte'lara kendi gliflerini atadı, bu yüzden aynı byte değeri farklı sistemlerde farklı karakterlere çözülebilir. Bu araç, sabit 256 değerlik bir tablo yerine tam Unicode ile çalışarak bu sorunu tamamen ortadan kaldırır.

Emoji ve çok baytlı karakterleri işleyebilir mi?

Evet — emoji ve birçok diğer sembol 255'in çok ötesindeki kod noktalarında yaşar, bu araç her birini tam ondalık Unicode değerine çevirir (bayrak emojileri gibi bazıları aslında iki kod noktasından oluşur; liste bunları iki ayrı sayı olarak gösterir).

Yorumlar

Henüz yorum yok — ilk yorumu siz yazın!

Benzer Araçlar