
Türkiye’nin yapay zekâ alanındaki girişimlerinden biri hayata geçti.
Yerli teknoloji şirketi VNGRS, tamamen Türkçe verilerle eğitilen ilk büyük dil modeli Kumru LLM’i tanıttı. 7,4 milyar parametreye sahip model, Türkçe doğal dil işleme (NLP) alanında yerli ekosistemin gelişimini hedefliyor.
Tamamen Türkçe Eğitilen İlk Büyük Dil Modeli
Kumru, 300 milyar token ve yaklaşık 500 GB’lık Türkçe veri setiyle eğitildi.
Modelin amacı, küresel yapay zekâ sistemleriyle rekabet etmekten ziyade, Türkçe’nin dil yapısına uygun, açık kaynaklı ve geliştirilebilir bir temel oluşturmak.
VNGRS tarafından yapılan açıklamada, “Kumru, ChatGPT’ye rakip bir sistem değil; Türkçe NLP ekosisteminin büyümesine katkı sunan yerli bir yapıtaşıdır.” ifadeleri yer aldı.
Kumru’nun Yetkinlik Alanları
Kumru, doğal dil işleme alanında geniş bir yelpazede görev yapabiliyor:
- Metin özetleme ve yeniden yazım
- Soru-cevap sistemleri
- Doküman ve rapor analizi
- Duygu ve bağlam analizi
- Sosyal medya içerik önerileri
- Kurumsal metin üretimi
Modelin bu yetenekleri, hem araştırma ortamlarında hem de kurumsal otomasyon uygulamalarında kullanılabiliyor. Ayrıca üniversiteler ve geliştiriciler için açık erişim sağlanarak, Türkiye’deki yapay zekâ araştırmalarına doğrudan katkı hedefleniyor.
7,4 Milyar Parametre, 500 GB Eğitim Verisi
Kumru LLM, 7,4 milyar parametreye sahip mimarisiyle orta ölçekli dil modelleri arasında yer alıyor.
Modelin eğitimi, yüksek performanslı NVIDIA A100 GPU altyapısı üzerinde gerçekleştirildi. Eğitim süreci boyunca tamamen Türkçe kaynaklardan derlenen veri seti kullanıldı.
VNGRS ekibi, modelin gelecekte daha büyük parametreli sürümlerinin geliştirilebileceğini, özellikle kurumsal uygulamalara özel ince ayar (fine-tuning) süreçlerinin de planlandığını duyurdu.
Açık Kaynak Ekosisteme Katkı
Kumru’nun en dikkat çekici yönlerinden biri, açık kaynak olarak paylaşılması.
Model, araştırmacılar, üniversiteler ve geliştiriciler tarafından indirilebiliyor ve farklı Türkçe uygulamalara entegre edilebiliyor. Bu yaklaşım, Türkiye’nin yapay zekâ alanında bağımsız bilgi birikimi oluşturma hedefini güçlendiriyor.
VNGRS, ayrıca Türkçe dil işleme için oluşturduğu veri setlerini, model ağırlıklarını ve test metriklerini kamuya açacağını açıkladı.
“Kumru, Türkçe’nin Sesini Teknolojiye Taşıyor”
Proje ekibi, Kumru ismini Türk kültüründeki iletişim, barış ve dil birliği sembolü olarak seçtiklerini belirtti.
Proje yöneticilerinden yapılan açıklamada şu ifadelere yer verildi:
“Kumru, Türkçe’nin dijital dünyada daha iyi anlaşılması için geliştirildi.
Amacımız, kendi dilimizin yapay zekâ çağında hak ettiği teknik altyapıya kavuşmasını sağlamak.”Kumru LLM, yerli yapay zekâ tarihinde bir kilometre taşı olarak değerlendiriliyor.
Modelin açık kaynak doğası, araştırma topluluğuna güç kazandırırken, Türkiye’nin dijital dönüşüm stratejisine de doğrudan katkı sağlıyor.
Kısacası Kumru, ChatGPT’nin rakibi değil — ama Türkçe’nin teknolojiyle konuşan sesi olmaya aday.






