Türk Dil Kurumu (TDK) Başkanı Prof. Dr. Osman Mert, kurumun dijitalleşme ve yapay zeka projelerine ilişkin yaptığı açıklamada, Türkçe düşünen ve Türkçe üzerinden eğitilebilen bir büyük dil modeli geliştirmek üzere çalışmalar yürüttüklerini söyledi.
Başkan Mert, yaklaşık üç yıldır devam eden çalışmanın artık uygulama aşamasına geçtiğini belirterek, projenin HAVELSAN ile birlikte yürütüldüğünü belirtti.
Teknik altyapının büyük ölçüde tamamlandığını ifade eden Mert, “Türkçe düşünen yapay zekâyı geliştirmek, eğitmek üzere büyük dil modeli çalışıyoruz” dedi. Projede veri girişinin de başladığını belirten Mert, verilerin ayrıntılı şekilde etiketlendiğini kaydetti.
Büyük Bir Dil Modeli Geliştirmek Amaçlanıyor
Projenin dikkat çeken tarafı yalnızca Türkçe konuşabilen bir yapay zeka geliştirme hedefi değil. TDK'nin açıklamasına göre amaç, Türkçenin dil yapısını, kelime ilişkilerini ve kullanım özelliklerini dikkate alan bir veri altyapısı oluşturarak bu altyapı üzerinde bir büyük dil modeli geliştirmek.
Bu nokta, Türkiye açısından yapay zeka çalışmalarında önemli bir başlık oluşturuyor. Çünkü büyük dil modellerinin performansı yalnızca modelin büyüklüğüne değil, eğitildiği verinin niteliğine ve temsil gücüne de bağlı.
TDK tarafından hazırlanan etiketli veri seti bu nedenle projenin en kritik unsurlarından biri olabilir. Kurum, oluşturulacak veri setinin yapay zekânın eğitilmesinin yanı sıra Türk dili araştırmalarında da kullanılabileceğini belirtiyor.
Başka bir ifadeyle TDK, yalnızca bir yapay zeka modeli için veri üretmeyi değil, Türkçenin makine tarafından daha ayrıntılı anlaşılabileceği bir dil veri altyapısı oluşturmayı da hedefliyor.
Türkiye Terim Bankası’nın Bu Yıl Hizmete Açılması Planlanıyor
TDK'nin yapay zeka projesini, kurumun son yıllarda yürüttüğü dijital dil çalışmalarıyla birlikte değerlendirmek gerekiyor.
Sözlükler, derlemler, dil araştırmaları ve terim çalışmaları, bir yapay zeka modelinin Türkçeyi doğru anlaması açısından önemli veri kaynakları oluşturabilir.
Bu çerçevede TDK Başkanı Mert, kurumun üzerinde çalıştığı Türkiye Terim Bankası hakkında da bilgi verdi. Mert'in açıklamasına göre bankaya şu anda 310 bin terim girilmiş durumda.
Türkiye Terim Bankası'nın bu yıl hizmete açılması planlanıyor. Yazılımın ilerleyen aşamada Türk dünyasındaki terimleri de kapsayacak şekilde genişletilmesi hedefleniyor.
Türk Dünyasından Terimler de Sisteme Eklenecek
TDK'nin planına göre ilk aşamada Türkiye'deki terimler ortak bir dijital altyapıda toplanacak. Daha sonra Türk dünyasından terimlerin de sisteme eklenmesiyle veri tabanının kapsamının genişletilmesi amaçlanıyor.
Bu yapı, özellikle bilim ve teknoloji alanlarında Türkçe terminolojinin dijital ortamda daha düzenli biçimde kullanılmasına katkı sağlayabilir.
Yapay zeka açısından bakıldığında ise terim bankasının farklı uzmanlık alanlarına ait Türkçe kavramların makine tarafından işlenebilecek bir veri kaynağına dönüşmesi mümkün.
Çalışmalar Türkçe Yapay Zeka Ekosistemi için de Önemli
TDK'nin yürüttüğü çalışma, Türkiye'de Türkçe odaklı yapay zeka geliştirilmesinin önünü açabilecek önemli bir dil ve veri altyapısı oluşturma potansiyeline sahip.
Ancak bunun gerçek bir teknolojik avantaja dönüşmesi, yalnızca veri toplanmasına bağlı değil. Verinin kalitesi ve çeşitliliği, modelin mimarisi, eğitim için kullanılacak hesaplama gücü, modelin test edilmesi ve geliştiricilerin bu altyapıya erişebilmesi de sonucu belirleyecek.
Bu nedenle TDK'nin projesini bugünden tamamlanmış bir yapay zeka ürünü olarak değil, Türkçe yapay zeka ekosisteminin temelini oluşturabilecek bir altyapı yatırımı olarak değerlendirmek daha doğru bir yaklaşım olabilir.




