Kürtçenin Sorani lehçesi, dijital dünyada önemli bir eşiği daha aştı. Dünya dillerinin dijital ortamlarda desteklenmesi için kullanılan Unicode Ortak Yerel Veri Deposu’nda (CLDR) Sorani Kürtçesi temel destek seviyesine ulaştı.
ABD merkezli kâr amacı gütmeyen Unicode Konsorsiyumu tarafından geliştirilen CLDR, teknoloji şirketleri ve yazılım sistemlerinin farklı diller için tarih, saat, sayı, para birimi, ülke ve dil adları gibi yerelleştirme verilerini kullanmasını sağlayan temel altyapılardan biri. Unicode’un tanımına göre “Basic” seviye; bir dilin karakterlerinin bilgisayar ve telefonlarda kullanılabilmesi, doğru görüntülenmesi ve klavye aracılığıyla yazılıp düzenlenebilmesini kapsıyor.
CLDR’nin güncel verilerinde Sorani, Central Kurdish (ckb) adı ve koduyla yer alıyor. Unicode kaynaklarında Sorani Kürtçesi bu dilin varyantlarından biri olarak da gösteriliyor.
“Sorani’yi temel düzeye ulaştırmayı başardık”
Rûdaw’a konuşan Irak Google Crowdsource Topluluğu Kurucusu Bokan Caf, Sorani Kürtçesinin CLDR’deki verilerinin geliştirilmesi için uzun süredir çalışma yürüttüklerini söyledi.
Caf, “Uzun zamandır Kürtçe dil verilerinin CLDR (Ortak Yerel Veri Deposu) sisteminde toplanması ve hazırlanması üzerine çalışıyoruz. Ne mutlu ki Sorani lehçesini temel düzeye ulaştırmayı ve sıralamadaki konumunu dünyadaki yaklaşık 15 dilin üzerine çıkarmayı başardık” dedi.
Unicode’un dil destek sisteminde farklı seviyeler bulunuyor. Basic seviye, bir dilin dijital ortamlarda temel yazı ve giriş desteğine sahip olmasını ifade ederken daha üst seviyelerde tarih, saat, sayı, para birimi, sıralama ve diğer yerelleştirme özellikleri devreye giriyor.
Kürtçe için ne değişecek?
CLDR verileri, farklı platformların ve yazılım altyapılarının dilleri doğru biçimde işlemesinde kullanılıyor. Unicode, Basic seviyesindeki desteğin bir dilin karakterlerinin cihazlar arasında aktarılabilmesi, doğru görüntülenmesi ve kullanıcı tarafından yazılıp düzenlenebilmesini kapsadığını belirtiyor.
Bokan Caf, bu nedenle atılan adımın Kürtçe konuşan kullanıcılar açısından önem taşıdığını belirterek şunları söyledi:
“Dünyadaki dev şirketlerin çoğu dil hizmetlerini sunmak için Unicode verilerine güveniyor. Kürtçenin bu seviyeye gelmesi; tarih, takvim, saat, sayılar, ülke ve dil isimleri, arama motorları ve klavye gibi tüm temel ayarların küresel sistemler tarafından resmi ve standart bir şekilde Kürtçe olarak tanınması ve desteklenmesi anlamına geliyor.”
Unicode’un güncel CLDR tablolarında Central Kurdish (ckb) için temel kapsam düzeyi yer alıyor. Aynı veri setinde Kurmancî için kullanılan Kürtçe kodu ku da Basic seviyesinde listeleniyor.
Cihan Üniversitesi akademik destek sağladı
Çalışmanın ilerleyen aşamalarında Unicode tarafından verilerin bireysel bir girişim olmaktan çıkarılarak akademik bir kurumun desteğiyle yürütülmesinin istendiğini belirten Caf, bu noktada Cihan Üniversitesi’nin sürece dahil olduğunu söyledi.
Caf, üniversitenin projeyi denetleme ve süreç boyunca akademik destek sunma konusunda hazır olduğunu belirterek, dil verilerinin bilimsel ve dilbilimsel açıdan incelenmesinin ardından CLDR çalışmasının sürdürüldüğünü aktardı.
Hedef daha kapsamlı dijital destek
Unicode’un dil destek sisteminde Basic seviyenin üzerinde Moderate, Modern ve daha ileri destek seviyeleri bulunuyor. Moderate düzeyde tarih, saat, sayı, para birimi ve ölçü birimleri gibi temel yerelleştirme işlevleri genişlerken, Modern seviyede daha kapsamlı uluslararasılaştırma desteği sağlanıyor.
Bokan Caf, mevcut seviyenin ardından Kürtçe verilerin toplanmasına ve zenginleştirilmesine devam edeceklerini belirterek, Sorani Kürtçesini küresel teknoloji sistemlerinde daha üst seviyelere taşımayı hedeflediklerini söyledi.