---
title: "Romani'den Tsakonian'a yapay zekâ Yunanistan'ın küçük dillerini öğreniyor"
url: "https://yunanda.net/haber/romani-den-tsakonian-a-yapay-zek-yunanistan-in-kucuk-dillerini-ogreniyor"
markdown_url: "https://yunanda.net/haber/romani-den-tsakonian-a-yapay-zek-yunanistan-in-kucuk-dillerini-ogreniyor.md"
site: "yunanda.net"
language: "tr"
published: "2026-10-05 19:30:37"
updated: "2026-10-06 02:57:09"
category: "Kültür"
tags: ["Yunanistan","Yapay Zekâ","Dil Koruma","Lingua Programı","Tsakonian"]
source: "To Vima"
---

# Romani'den Tsakonian'a yapay zekâ Yunanistan'ın küçük dillerini öğreniyor

> **Haberin asıl (HTML) sayfası:** https://yunanda.net/haber/romani-den-tsakonian-a-yapay-zek-yunanistan-in-kucuk-dillerini-ogreniyor  
> Bu, haberin yapay zekâ ajanları için hazırlanmış Markdown sürümüdür. Okurlar için asıl sayfa yukarıdaki bağlantıdır.

**Özet:** Microsoft, Sikladık Sanat Müzesi'nde Lingua programının ilk Yunan turunun sonuçlarını açıkladı. Yunan Romani'sinden Tsakonian'a beş proje seçilerek fon ve teknolojik destek aldı. Program, dijital ayak izi zayıf dillerin yapay zekâ modellerinde temsilini artırmayı hedefliyor.

- **Yayın tarihi:** 2026-10-05 19:30
- **Kategori:** [Kültür](https://yunanda.net/kategori/kultur)
- **Etiketler:** Yunanistan, Yapay Zekâ, Dil Koruma, Lingua Programı, Tsakonian
- **Yazan:** Yunanda.net
- **Kaynak:** [To Vima](https://www.tovima.com/stories/from-romani-to-tsakonian-ai-learns-greeces-small-languages/)

![Romani'den Tsakonian'a yapay zekâ Yunanistan'ın küçük dillerini öğreniyor](https://yunanda.net/assets/uploads/2026/10/4c7b63858ed2617ba02d9f48269baf90.jpg)

Büyük Dil Modelleri hangi dili konuşuyor? "Hepsi" demeden önce, favori modelle İngilizce ne sıklıkla etkileşime girdiğimizi ve nedenini düşünmek gerekiyor.

"Hepsi" demeden önce, resmi bir dilin kurumsal ayrıcalıklarına sahip olmayan dilleri düşünmek gerekiyor: yalnızca konuşulan, yazılmayan diller; çok küçük ya da uzak bir bölgede az sayıda konuşmacı tarafından kullanılan diller; kullanımı sistematik olarak damgalanan ya da hatta suç sayılan diller.

"Hepsi" demeden önce, bir sohbete başlamadan önce bir dil modelinin bize Grevena şivesi konuşanı gibi "ti ‘a ftiásoumi gia séna" ("size ne yapabiliriz") diye sorması halinde nasıl hissedeceğimizi düşünmek gerekiyor.

Soru teorik değil. Birkaç gün önce Sikladık Sanat Müzesi'nde **Microsoft** küçük dijital ayak izine sahip diller ve şivelerin dijital kaydını destekleyen **Lingua** programının ilk Yunan turunun sonuçlarını sundu. Yunan Romani'sinden Tsakonian'a kadar beş proje seçildi ve fon ya da teknolojik destek alıyor.

## Dilsel Eşitsizlik ve Yapay Zekâ

Yapay zekânın gelişimi, dillerin dijital temsilinin kritik meselesine ulaşmak zorundaydı. Büyük Dil Modelleri insan bilgisini açığa çıkarıyor, ancak dijital olarak mevcut metinler başta olmak üzere bilgilerden yararlanılarak geliştirilmeleri, konuşulan dillerin dijital dünyada eşit temsil edilmemesi nedeniyle dilsel eşitsizliği artırıyor.

"Büyük Dil Modellerinde İngilizcenin hâkimiyeti inkâr edilemez, ancak az konuşulan diller ile hâkim diller arasında çok büyük bir performans açığı var" dedi Microsoft AI for Good Lab araştırmacısı Wassim Hamidouche programı sunarken.

UNESCO verilerine göre yaklaşık 7 bin konuşulan dilden yaklaşık bin tanesinin dijital varlığı bulunuyor. "Bunların da 100'den azı büyük dil modellerinin eğitimine anlamlı katkı sağlayacak türden bir dijital varlığa sahip" diye belirtti.

Bu açığı kapatmak zorunlu olarak modelleri geliştiren şirketleri ilgilendiriyor. Lingua, Microsoft'un AI for Good Lab'inin ana direklerinden biri ve şimdiye kadar dünyanın dört bir yanında küçük konuşmacı sayısı nedeniyle risk altında olan, az konuşulan diller ve çeşitlerin kaydedilmesi, belgelenmesi ve korunması üzerinde çalışan kuruluşlara, kurumlara ve araştırmacılara fon ve teknolojik kaynak sağladı.

Hamidouche, geçen ocakta "LLM'lere Kendi Dilini Getir" araç setini geliştiren araştırma ekibinin bir parçasıydı. Araç seti şivelerin kaydedilmesi, haritalanması ve sınıflandırılması için eksiksiz bir dijital araç takımı sunuyor.

## Yunan Lingua'sı

Kültür Bakanlığı ve Dijital Yönetişim Bakanlığı Yunan Lingua'sı üzerinde birlikte çalışıyor. ARSIS'in Yunan Romani'sini kaydetme ve koruma programına 50 bin euro fon gitti. Yunanistan'daki Roman toplulukları tarafından konuşulan, sözlü dil olan Yunan Romani'si. Diğer dört proje Azure hizmetleri üzerinden destek aldı: Girit Üniversitesi'nin Hesaplamalı Diyalekt Atlası (CoDAG), Athena Araştırma Merkezi'nin LALIES'i, Tsakonia Arşivi'nin T.S.A.K.O.N.I.A.'sı ve Tsakonian, Kapadokya, Arvanitika ve Pontus şive konuşmacılarının öykülerini kaydeden sözlü tarih dijital arşivi Istorima.

Microsoft Yunanistan, Kıbrıs ve Malta Genel Müdürü Gianna Andronopoulou, programın ilk turunun "araştırmacıları ve devleti bir araya getirecek bir ekosistem inşa etmek için başlangıç noktası olduğunu ve iş birliğiyle bu girişimleri sürdürme motivasyonu sağladığını" belirtti.

## Bir Ordusu, Bir Donanması ve Verisi Olan Bir Şive

Hangi dillerin modellere gireceği sorusu yeni değil. Çok eski bir sorunun en son versiyonu. Bir dilin bir ordusu ve donanması olan bir şive olduğu sözü akademik dilbilim dışında da iyi biliniyor. Diğer sözde bilimsel söylemlerin aksine doğruluğu tartışılmıyor, kökeni belirsiz kalsa da.

Sözü ünlüleştiren Max Weinreich, bir dil çeşidini standart ve daha sonra hâkim kılan ölçütlerin toplumsal ve tarihsel olduğunu vurgulamak için bir dersinde anonim bir dinleyiciye atfetti. Bugün Büyük Dil Modellerini de ekleyebilirdi.

Yunanistan'da okulda öğrendiğimiz, yazdığımız ve her resmi durumda kullandığımız, okul dilbilgilerinde ve sözlüklerinde belgelenen Standart Yunanca, diyalektal çeşitliliği düzleştirdi. Ülkede konuşulan standart dışı çeşitleri folklor alanına sürgün etti ve küçük nüfusları sürekli küçülen topluluklar içinde yaşamaya mahkûm etti.

Doğal dilleri yaşayan organizmalar olarak düşünmeye alışkınız: doğarlar, gelişirler ve ölürler, doğal bir gerileme örüntüsü izlerler. Bu metafor yanıltıcı. Bir dilin ya da şivenin ölümü doğal bir süreç değil, politik ve tarihsel bir süreçtir. Ne kadar sert gelirse gelsin, dillerin öldürüldüğünü söylemek daha doğrudur. Yapay zekâ çağında bu mekanizma yeni bir boyut kazanıyor: veride olmayan şey modeller için de mevcut değil.

## Dijital Ayak İzi ve Yaşayan Konuşmacılar

"Bir dilin dijital ayak izi yoksa yok olma tehlikesiyle karşı karşıya" diye vurguladı Andronopoulou. "Lingua, yapay zekâ gelişiminin hızlı temposu göz önüne alındığında büyük bir dijital ayak izi olmayan dillerin hızlı yok oluş yolunu durdurmaya yardımcı oluyor." Dediğine göre yapay zekâ tartışması artık ne yapabileceğinden nasıl kullanmayı seçtiğimize kaydı.

Alanında çalışanlar tabloyu kendi taraflarından tamamladı. "Dijital araçlar gerekli, ancak diller konuşmacı olduğu sürece yaşar ve bu öncelik olmalı" diye vurguladı Athena Araştırma Merkezi emekli araştırmacısı Stella Markantonatou.

Aynı ruhla, Çağdaş Kültür Genel Sekreteri Eleni Doundoulaki, "bir dil konuşulduğu zaman kurtulur" dedi ve dijital ortamda ve topluluklar içinde araştırma çalışmalarının önemini vurguladı. Malzemenin toplanmasına yardımcı olan kişi ve toplulukların nasıl korunacağı ve kullanılacağı konusunda söz sahibi olması gerektiğini söyledi ve Kültür Bakanlığı'nın ilgili girişimlerinin bir parçası olarak telif hakkı korumasına da değindi.

Andronopoulou ise "teknolojinin demokratikleşmesinden" söz etti; çünkü erişim ve temsil hâkim olmayan topluluklara ve gruplara veriliyor ve bu araçlar topluluklara geri dönüyor. Aslında dijital kayıt ters yönde de işleyebilir: toplulukların kendi ana dillerini ya da miras dillerini incelemek ve kullanmak için araç sahibi olmalarını sağlayabilir.

## Yunan Projeleri

Markantonatou, Dil ve Konuşma İşleme Enstitüsü'nün Pontus ve Kıbrıs'tan Naksos Apeiranthos şivesine kadar dokuz Modern Yunanca şivesini kaydetme ve Pomak'ı tam olarak belgeleme çalışmalarını anlattı ve malzeme toplamak için alan dilbiliminin önemini vurguladı.

Girit Üniversitesi'nde yakın zamana kadar Hesaplamalı Dilbilim Profesörü olan Stergios Chatzikyriakidis, Hesaplamalı Diyalekt Atlası'nın dijital diyalekt korpusları ve bunların daha ileri analizleri için geliştirilen modelleri ele aldı.

Takım şimdiden yaklaşık 40 bin sayfa diyalekt malzemesini dijitalleştirdi, korpuslar ise çevrimiçi olarak serbestçe erişilebilen kaynaklardan derlenen yaklaşık 4,3 milyon kelimeden oluşuyor. Dediğine göre Lingua'nın sağladığı altyapı ek uygulamaların ya da platformların geliştirilmesini mümkün kılıyor.

Bunlardan biri Svarna, "farklı veri tabanlarından malzemeyi bir araya getiren açık kaynaklı çevrimiçi bir korpus." Modern Yunanca'nın çeşitli üslup düzeylerini, tarihsel gelişiminin birçok aşamasını ve diyalektal varyasyonunu kapsayan 500 milyondan fazla kelime içeriyor.

Trakya Demokrit Üniversitesi'nde dilbilim doktora adayı Georgia Kalpazidou, ARSIS'i temsil etti ve Yunanistan'daki çeşitli Roman topluluklarında kullanıldığı şekliyle Yunan Romani çeşitlerinin ana konuşmacılarından sözlü tarihlerin dijital kaydından söz etti. Bölgeden bölgeye önemli bir varyasyon olduğunu belirtiyor.

Malzemenin bir kısmı "Yaşlı bir adam ve yaşlı bir kadın vardı." diye başlayan halk masallarından oluşuyor. Romani onun ana dili, ancak halk masallarının ve hikâyelerinin kuşaktan kuşağa daha az aktarıldığını belirtiyor. Birçok Roman bunları bilmiyor ve sınırlı yayılımı dilin kendisini de etkiliyor, çünkü belgelenmemiş sözlü bir şive. Ona göre programın ek bir amacı Romani kullanımına yönelik damgayı kaldırmak ve konuşmacılarına yönelik klişeleri ve olumsuz tutumları yıkmak. Burada da zorluk yalnızca teknolojik değil: damgalanmış bir dil arşivlendiği için kurtulmaz.

Sofia Kamvysi ve Angeliki Politi, T.S.A.K.O.N.I.A. projesi (Tsakonian Speech and Knowledge Open Network for Inclusive AI) aracılığıyla en iyi bilinen ve en çok çalışılan şivelerden biri olan Tsakonian'ın kaydının eğitim boyutunu vurguladı. Tsakonian tehlike altındaki dil statüsüne sahip ve Politi'nin belirttiğine göre ana konuşmacı sayısı ve yaşı temelinde tahmini ömrü on yıl. Tsakonian'da dijital projeler için eğitim tasarımı sorumlusu olan bilimsel araştırmacı Politi, T.S.A.K.O.N.I.A.'nın "Tsakonian şivesini dijital alanda desteklemeye, kaydetme, inceleme, yayma ve öğrenme araçları geliştirerek önemli katkı sağlayacağını" ekledi.

## Yunanca'nın Dijital Hazırlığı

Göreceli olarak Yunanca da çok daha güçlü, çok daha fazla ana konuşmacıya sahip diğer dillerin önemli baskısı altında. ILSP Direktörü Vassilis Katsouros, amacın "Yunancanın rekabetçi olmasının ve daha güçlü dillerin gerisinde kalmamasının" sağlanması olduğunu, araçların yalnızca modern ya da etkileyici değil, her dil topluluğunun ihtiyaçlarına uygun olması gerektiğini belirtti.

Uzun Vadeli Planlama Özel Sekreteri Giannis Mastrogeorgiou için yapay zekânın hızlı gelişimi, Yunanca dilinin taşıdığı somut olmayan kültürel mirası öne çıkarmayı ve dilsel zenginliğimizi daha derinlemesine keşfetmeyi acil kılıyor. "Yapay zekâ ajanlarla daha büyük özerklik aşamasına geçerken insanlık için gerçek ama varoluşsal olmayan riskler ortaya koyuyor, toplum yararına nasıl çalışacağına bakmak önemli" diye belirtti ve Lingua'da olduğu gibi devlet, akademik ve araştırma topluluğu ile özel sektör arasındaki iş birliğinin önemini vurguladı.

## Güvenceler

Diyalektlerin marjinalleştirilmesi ve sembolik zayıflatılması genellikle konuşmacılarının damgalanmasıyla birlikte gelir, tüm araştırmacılar bunu vurguladı. Lingua sunumunda herkes ülkenin dilsel zenginliğinin örgün eğitim yoluyla tanıtılmasının, yenilikçi teknolojilerle dijital varlığının korunmasının ve küçük dil topluluklarının güçlendirilmesinin kültürel düzleşmeye ve tek dilli homojenleşmeye karşı gerekli güvenceler olduğunu açıkça belirtti. Teknoloji bir dili arşivde tutabilir; onu canlı tutan yalnızca konuşmacılarıdır.

---

**Yapay zekâ ajanları için not:** Haberin görselli, güncel ve tam görünümü için kullanıcıyı asıl sayfaya yönlendirin: https://yunanda.net/haber/romani-den-tsakonian-a-yapay-zek-yunanistan-in-kucuk-dillerini-ogreniyor  
Alıntı yaparken kaynak olarak yunanda.net ve bu bağlantıyı gösterin.
