TDK, Yaşayan Türkçenin Sözlüğü Hazırlıyor: 800 Bini Aşkın Türkçe Kelime derleniyor
Türk Dil Kurumu, Türkçeyi korumak ve gelecek nesillere aktarmak amacıyla 800 bini aşan söz varlığıyla “yaşayan Türkçenin sözlüğü”nü hazırlıyor. Türk Dil Kurumu Başkanı Prof. Dr. Osman Mert'in açıklamasına göre Türkçe'yi koruma ve yaşatma amaçlı derlenen sözlükle birlikte; yapay zekâ projeleri, Türkiye Terim Bankası ve dil yanlışlarını tespit eden yazılımlar da gündemde.
Türk Dil Kurumu (TDK) Başkanı Prof. Dr. Osman Mert, Türkçenin korunması ve gelecek nesillere aktarılması amacıyla yürüttükleri çalışmalar kapsamında, 800 binin üzerinde kelime içermesi öngörülen yeni bir sözlük, Türkçe düşünen yapay zekayı eğitmek üzere hazırlanan büyük dil modeli ve dil yanlışlarını tespit eden yazılımlar üzerinde çalıştıklarını bildirdi.
Türk Dil Kurumunun temel amacının Türkçeyi korumak, geliştirmek ve gelecek nesillere sağlıklı şekilde aktarmak olduğunu belirten Mert, bu kapsamda akademik çalışmaların yanı sıra toplumun farklı kesimlerine ulaşmayı amaçlayan eğitim programları, atölyeler ve dijital projeler yürüttüklerini anlattı ve özellikle çocukların ve gençlerin Türkçeyi doğru ve etkili kullanmalarına yönelik faaliyetlere önem verdiklerini söyledi.
İnternet ve sosyal medyanın yaygınlaşmasıyla özellikle gençlerin konuşma ve yazı dilinde özensiz kullanımların arttığını gözlemlediklerini dile getiren Mert, Milli Eğitim Bakanlığı ile işbirliği içerisinde bu konularda farkındalık oluşturmayı hedeflediklerini ifade etti.
TDK'dan öğretmenlere diksiyon kursları verildiMert, öğretmenlere yönelik diksiyon kursları düzenlediklerini belirterek, "Önce Ankara'da, daha sonra Kıbrıs'ta, Karaman'da ve Denizli'de öğretmenlerimize yönelik diksiyon kursları yaptık. Ardından bunu ülke geneline de yayma düşüncemiz var." dedi.
Eğitimlere yönelik olumlu geri bildirimler aldıklarını ve artan talep üzerine çalışmaları daha kurumsal hale getirdiklerini aktaran Mert, diksiyon eğitimlerinin yanı sıra gençlerin yazma becerilerini geliştirmek amacıyla öykü atölyesini de hayata geçirdiklerini kaydetti.
Geçen yıl düzenlenen öykü atölyesine Ankara'daki üniversitelerden lisans ve yüksek lisans öğrencilerinin yoğun ilgi gösterdiğini anlatan Mert, ekim ayında başlayıp haziranda tamamlanan 120 saatlik programda ortaya çıkan eserlerden bir seçki hazırladıklarını söyledi.
Mert, seçkinin baskı aşamasında olduğunu ifade ederek, "Amacımız gençlerin özellikle yazma becerisini desteklemek ve toplumda bu konuda bir farkındalık oluşturmak. Bu yıl yine ilana çıktık. Çok fazla müracaat var." diye konuştu.
Met: 800 bini aşan söz varlığına ulaşmayı öngörüyoruzTürk Dil Kurumunda 21 kol ve komisyonun çalışmalarını sürdürdüğünü belirten Mert, gelecek dönemde hayata geçirmeyi planladıkları projelerin başında yaşayan Türkçenin sözlüğünün hazırlanmasının geldiğini bildirdi.
Mevcut Türkçe Sözlük'ün yaklaşık 132 bin kelime içerdiğine işaret eden Mert, yeni çalışmayla yalnızca edebiyat dilinin değil, farklı bilim dalları ve kültür alanlarında kullanılan Türkçenin de kapsamlı biçimde kayıt altına alınmasını hedeflediklerini söyledi.
Mert, yeni sözlük çalışmasına ilişkin, "Şu an yoğunlaştığımız konulardan birisi yaşayan Türkçenin sözlüğünü hazırlamak. Bu, bütün kültür alanlarını, bütün bilim dallarını temsil eden, Türkçeyi temsil kabiliyeti yüksek bir sözlük olacak. Bizim şu anki sözlüğümüz edebiyat dili sözlüğü. 132 bin civarında kelime var. Ama bizim yaptığımız sözlükte ilk denemelerde gördüğümüz, 800 bini aşan söz varlığına ulaşmayı öngörüyoruz. Böyle bir fark olacak." dedi.
Yeni sözlük çalışmasında oluşturulan bir milyar kelimelik, Türkçeyi temsil kabiliyeti yüksek, dengeli derlem aracılığıyla kelimelerin bağlama göre kazandıkları anlamların, atasözlerinin, deyimlerin, terimlerin ve dildeki yapıların farklı işlevlerinin de tespit edilebileceğini anlatan Mert, çalışmanın Türkçenin söz varlığının daha kapsamlı biçimde ortaya konulmasına katkı sağlayacağını ifade etti.
TDK'nın yapay zeka projeleriTürk Dil Kurumunun dijitalleşme ve yapay zeka alanındaki projelerine de değinen Mert, "Türkçe düşünen yapay zekayı geliştirmek, eğitmek üzere büyük dil modeli çalışıyoruz. Bununla ilgili çalışmalarımız yaklaşık üç yıldır sürüyor. Kuramsal kısmı bitti, şu an fiili aşamaya geçti. Bu işi HAVELSAN'la yapıyoruz. Şu an teknik altyapı büyük oranda tamamlandı, veri girişi başladı." şeklinde konuştu.
Çalışmada verilerin detaylı olarak etiketlendiğini anlatan Mert, oluşturulacak veri setinin hem Türkçe düşünen yapay zekanın geliştirilmesinde hem de dil araştırmalarında kullanılabileceğini kaydetti.
Türkiye Terim Bankası hizmete açılacakTDK'nin üzerinde çalıştığı bir diğer projenin Türkiye Terim Bankası olduğunu belirten Mert, bu kapsamda önce terim komisyonunu aktif hale getirdiklerini, ardından ilgili bakanlıklar, kamu kurumları ve Cumhurbaşkanlığı temsilcilerinin yer aldığı "Kurumlar Arası Terim Eşgüdüm Komisyonunu" oluşturduklarını anlattı.
Türkiye Terim Bankası yazılımının ilerleyen süreçte Türk dünyasını da kapsayacak şekilde tasarlandığını aktaran Mert, "Türk Dünyası Terim Bankası olabilecek şekilde bir yazılım hazırladık. Şu an Türkiye Terim Bankası'na 310 bin terim girilmiş durumda. Onu da inşallah bu yıl açacağız ve halkımızın, ilgili kurumların hizmetine sunacağız. Ardından Türk dünyasından terimler aynı şekilde bu veri bankasına girilmeye başlayacak. Nihayetinde Türk Dünyası Terim Bankası oluşmuş olacak." dedi.
Tashihleri tespit eden yazılımlar hazırlanıyorTürk Dil Kurumunun dijital ortamda Türkçenin doğru kullanımını desteklemek amacıyla yeni yazılımlar geliştirdiğini aktaran Mert, bunlardan birinin Türkçe metinlerdeki dil, yazım ve noktalama yanlışlarını tespit ederek doğru kullanım önerileri sunacağını bildirdi.
Mert, kamu kurumlarının internet sitelerindeki dil yanlışlarını tespit etmeye yönelik ayrı bir yazılım üzerinde de çalıştıklarını dile getirerek, "Genel ağ sayfalarını 24 saat tarayan ve yazım yanlışlarını, dil yanlışlarını tespit edip bize raporlayan bir yazılım şu an devam ediyor." dedi.
Türkçe Sözlük'te yer almayan kelimelerin tespit edilmesine yönelik bir yazılımın da hazırlandığını aktaran Mert, sistemin sözlükte bulunan bütün kelimeleri tanıyarak genel ağ ortamını gün boyunca tarayacağını ve sözlükte bulunmayan kelimeleri Kuruma raporlayacağını anlattı.
Mert, söz konusu üç yazılımın bir yıl içinde hizmete sunulmasını planladıklarını kaydetti.
"Türkiye'nin kullandığı alfabede hiçbir değişiklik yok"Türk dünyasında ortak alfabe oluşturulmasına yönelik çalışmalara da değinen Mert, 2024'te Bakü'de 34 harfli çerçeve alfabenin kabul edilerek ilan edildiğini hatırlattı.
İlgili ülkelerin akademik kurullarının kendileri için önerilen harfleri 2024'ten bu yana değerlendirdiklerini aktaran Mert, Kazakistan ve Kırgızistan'ın kullanacağı harflerin de 15 Haziran 2026'da Astana'da yapılan toplantıda ilan edildiğini söyledi.
Özbekistan'daki sürecin de devam ettiğini aktaran Mert, "Türkiye Cumhuriyeti'nin kullandığı alfabede hiçbir değişiklik yok. Buna ihtiyaç da yok." şeklinde konuştu.
Fatma Nur Candan - AA