İskender Öksüz: Bir an önce Türkçe'nin kültür birikimini Büyük Dil Modelleri'ne yüklemeliyiz

Okura not

Günün 11’i, Türkiye medyasındaki görüş ve yorum çeşitliliğini yansıtmak amacıyla hazırlanmaktadır. Aşağıda özetini bulacağınız yazıya yer vermemiz, içeriğini onayladığımız ve/veya desteklediğimiz anlamına gelmez.

Yapay zekâ da tıpkı insan gibi. Uzun bir eğitim sürecinden geçiyor. Ona, onu yaratan kültürün dili ve o dille oluşturulmuş kültürü öğretiliyor. Milyarlarca kelime dijital formatta yapay zekâya giriliyor. O milyarlarca kelimelik birikime o dilin gövdesi, “corpus” deniyor. GPT gibi, Claude vs. gibi Yapay zekâlara da LLM ~Large Lanugage Model ~ Büyük Dil Modeli deniyor.

Alarm yüksek sesle çalıyor: Bir an önce Türkçe’nin kültür birikimini dijital hâle getirip Büyük Dil Modelleri’ne yüklemeliyiz. Bu toplumumuz için bir ölüm kalım meselesi. 16. asırdan sonra matbaa ne idiyse 21. asırda da yapay zekâ o. Aslında ondan da fazla. Kendi BDM’miz mi? Evet ama kendi BDM’miz mevcut BDM’lerle birlikte kullanılabilir. Sıfırdan başlamak zorunda değiliz ama bir an önce başlamak zorundayız.

Türkçenin “corpus”u, yazılı kültürümüz bin küsur yıllık bir geçmişe sahip. Yapay zekâlarda bugün %2 civarındaki Türk kültür katkısını hızla katlayabiliriz. Bu tarihi derinliğe ve edebî zenginliğe sahip olmayan dillerin işi çok daha zor tabii. Tek yapacağımız, ağlaşmayı bırakıp işe koyulmak. Elimizi çabuk tutmazsak gelecek nesiller asla Türkçe düşünemeyecek.

İskender Öksüz’ün yazısı