Karakter Kodlaması Hakkında
Karakter kodlaması nedir?
Karakter kodlaması, bir sayfadaki baytların harflere nasıl dönüştürüleceği konusunda sunucunuz ile tarayıcı arasındaki anlaşmadır. Kodlamayı belirtirseniz herkes aynı metni okur; tahmin işini tarayıcıya bırakırsanız tarayıcı seçim yapar ve bazen yanlış seçim yapar.
Yanlış tahminler, bir sayfada é yerine é veya bir adın olması gereken yerde bir dizi soru işareti görünmesinin nedenidir. İçerik bozulmamıştır; yalnızca yorumlama hatalıdır.
Bu araç, sayfanızın bildirdiği karakter kodlamasını bildirir.
UTF-8 ve diğerleri
Neredeyse her site için yanıt UTF-8’dir. Tüm dilleri kapsar; para birimi sembollerini, kısa ve uzun tireleri, tırnak işaretlerini ve emojileri destekler ve web’in standart olarak benimsediği kodlamadır.
ISO-8859-1 veya Windows-1252 gibi daha eski kodlamalara eski sistemlerde ve dışa aktarılan dosyalarda hâlâ rastlanır. Bunlar yalnızca dar bir karakter aralığında çalışır ve içerik bu aralığın dışındaki herhangi bir şeyi içerdiğinde başarısız olur; günümüzde bu genellikle bir kelime işlemciden yapıştırılmış akıllı tırnak işareti anlamına gelir.
Bir sayfa UTF-8 dışında bir kodlama tanımlıyorsa, sayfa şu anda düzgün görünüyor olsa bile bunu bilmek önemlidir.
Bozuk metinlerin yaygın nedenleri
- Karakter kodlaması belirtilmemiş; tarayıcı kodlamayı tahmin etmek zorunda kalıyor.
- Dosyanın gerçekte kaydedilme biçimiyle uyuşmayan bir bildirim.
- Farklı kodlamaları belirten bir HTTP başlığı ve meta etiketi.
- Sayfadan farklı bir kodlama kullanan bir veritabanı veya bağlantı.
- Kendi karakterlerini taşıyan bir kelime işlemciden yapıştırılmış içerik.
Bildirim, belgenin ilk kilobaytı içinde yer almalıdır; çünkü tahmin etmeye başlamış bir tarayıcı geri dönmeyecektir.
2026 yılında kodlama hâlâ önemli mi?
Büyük ölçüde çözülmüş bir sorun; tam da bu yüzden hızlıca göz atmaya değer: şu anda bunu yanlış yapan siteler genellikle yıllardır kimsenin kontrol etmediği sitelerdir.
Bir şeyler ters gittiğinde bunun bedelini güven öder. Bir başlıkta veya ürün adında bozuk karakterler ihmal edilmişlik izlenimi yaratır; ayrıca bunlar sayfanın yanı sıra arama sonuçlarında ve paylaşılan önizlemelerde de görünür.
Sayfanızı metin olarak okuyan herhangi bir sistem için — ister bir arama tarayıcısı ister bir yapay zekâ asistanı olsun — bozulmuş karakterler bozulmuş içerik demektir. Doğru harfleri geri getirecek bir kurtarma adımı yoktur.
Bu aracın kontrol ettikleri
Girdiğiniz sayfa için bildirilen karakter kodlamasını raporlar.
Dosyanın bu kodlamayla eşleştiğini doğrulamak yerine bildirimi okur; bu nedenle bir sayfa UTF-8 olarak bildirildiği hâlde farklı bir kodlamayla kaydedilmiş olabilir. Doğru bir bildirim olmasına rağmen karakterler hatalı görünüyorsa, bakmanız gereken yer bu uyumsuzluktur.
Sonraki adımlar
Kodlama, bir sayfanın kendisi hakkında yaptığı bildirimlerden biridir.
HTML lang özelliğinin doğru dili belirttiğini kontrol edin, birden fazla dilde yayın yapıyorsanız
hreflang etiketlerinizi inceleyin ve
web sunucusu yanıt başlıklarının sayfayla uyumlu olduğunu doğrulayın.