Yapay Zekada Manifold Hipotezi: Makineler Anlamı Nasıl Ütüler?

Masada duran buruşuk bir kağıt hayal edin.
Bu kağıdın üzerine tükenmez kalemle iki nokta işaretlenmiş olsun: A şehri ve B şehri. Kağıt üç boyutlu odanın içinde gelişigüzel buruşturulup bırakıldığı için, kağıdın iki katmanı birbirine temas edebilir. Odanın geometrisine, yani bizim dışarıdan bakışımıza göre bu iki nokta birbirine milimetrelerce yakındır. Ancak kağıdın yüzeyinde yaşayan, sadece o yüzey boyunca hareket edebilen iki boyutlu bir karınca için gerçeklik tamamen farklıdır. Karınca, A’dan B’ye gitmek için kağıdın tüm o karmaşık kıvrımlarını, tepelerini ve vadilerini aşmak zorundadır. Yol uzundur ve odadaki mesafenin hiçbir anlamı yoktur.
Karıncanın gerçekliğini anlamanın tek bir yolu vardır: O buruşuk kağıdı masanın üzerine yayıp, elinizle pürüzsüzce ütülemek. Gerçek harita, ancak uzay düzleştiğinde ortaya çıkar.
Yapay zekanın nasıl “anladığını” tartışırken genellikle zihin, bilinç veya nöronlar gibi biyolojik kelimelere başvurulur. Ancak modern yapay zekanın kalbinde yatan sır biyolojik değil, tamamen geometriktir. Bir makine öğrenimi modelinin devasa veri setlerinin içinde yolunu bulmasını sağlayan, anlamsız gürültüden anlamlı yüzler veya cümleler çıkarmasına izin veren o sessiz kurala “Manifold Hipotezi” denir.
Bu hipotez, evrendeki tüm anlamlı şeylerin (insan yüzlerinin, Rembrandt tablolarının, Shakespeare şiirlerinin) devasa bir boşluğun içinde rastgele savrulmadığını, aksine incecik, bükülmüş ve görünmez bir zarın üzerinde yaşadığını söyler. Bir yapay zeka modelinin tek yaptığı, o zarı bulmak ve üzerinde matematiksel olarak yürüyebilmek için onu düzleştirmektir.
Şimdi o buruşuk kağıdın içine, boyutların kontrol edilemez bir hızla çoğaldığı o karanlık odaya girelim.

Boyutların Laneti ve Boşluğun Dehşeti
Bir fotoğraf karesini, örneğin 1024×1024 piksellik standart bir dijital görüntüyü düşünün. Bu fotoğraf, yaklaşık bir milyon pikselden oluşur. Matematiksel olarak bu, her bir görüntünün bir milyon boyutlu bir uzayda tek bir nokta (vektör) olduğu anlamına gelir.
Bizim zihnimiz üç boyuttan fazlasını canlandıramaz. Bir kağıt iki boyutludur, bir küp üç boyutlu. Dördüncü boyutu hayal etmekte zorlanırız. Ancak yapay zeka modelleri, milyarlarca boyutlu uzaylarda işlem yapar. Bu devasa uzayın kendine has, insan sezgisine tamamen ters düşen ürkütücü bir doğası vardır. Matematikçiler bu duruma “Boyutların Laneti” (Curse of Dimensionality) adını verirler.
Boyut sayısı sonsuza doğru yaklaştıkça, uzayın hacmi öylesine akıl almaz bir hızla genişler ki, birbirinden rastgele seçilen herhangi iki noktanın arasındaki mesafe neredeyse eşitlenir.
Yüksek boyutlu bir kürenin hacminin neredeyse tamamı, merkezinde değil kabuğundadır. Bu uzayda, merkeze yakın hiçbir şey kalmaz; her şey dışarıya, kabuğa doğru savrulur. Bunun pratik anlamı şudur: Bir milyon boyutlu bir odada, en uzaktaki nokta ile en yakındaki nokta arasındaki oransal fark sıfıra yaklaşır. Her şey, her şeye aynı uzaklıktadır. Referans noktası kaybolur, uzaklık veya yakınlık kavramı anlamını yitirir.
Peki bu bir milyon boyutlu uzayın içi neyle doludur?
Eğer bu uzaydan tamamen rastgele bir nokta seçerseniz, göreceğiniz şey eski tüplü televizyonlardaki karıncalanma ekranıdır. Tamamen gri, rastgele piksellerden oluşan bir gürültü. Milyon boyutlu uzayın yüzde 99,99’u bu anlamsız gürültüden ibarettir. “Anlam”, yani bir insan yüzü, bir ağaç veya bir araba fotoğrafı, bu devasa karanlık odanın içinde son derece nadir rastlanan bir istisnadır.
İşte Manifold Hipotezi burada devreye girer. Bu hipoteze göre, anlamlı veriler bu devasa uzayın her yerine eşit olarak dağılmamıştır. Tüm insan yüzleri, o karanlık odanın içinde yılan gibi kıvrılarak ilerleyen, son derece dar, düşük boyutlu (örneğin sadece 500 boyutlu) bir tüpün veya zarın içine sıkışmıştır. Bu zedelenmeye açık, incecik matematiksel yapıya topolojide “manifold” denir.
Makine öğreniminin bütün çabası, karanlık odayı değil, sadece o parlayan ince zarı haritalandırmaktır.

İki Farklı Uzaklık: Öklid’e Karşı Jeodezik
Bir makinenin bu zarın üzerinde nasıl gezindiğini anlamak için, mesafeyi nasıl ölçtüğüne bakmalıyız.
Eğer bir milyon boyutlu uzayda rastgele iki insan yüzü fotoğrafı alır ve bu ikisi arasına düz bir çizgi çekerseniz, hüsrana uğrarsınız. Lise matematiğinde öğretilen, iki nokta arasındaki en kısa mesafenin düz bir çizgi olduğu kuralı (Öklid mesafesi), yüksek boyutlu veri setlerinde işlemez. Çünkü Manifold (üzerinde yüzlerin yaşadığı o kıvrımlı zar) bükülmüştür.
Dağın bir yamacından diğerine gitmek için dağın içinden doğrusal bir tünel açarsanız, yeryüzünü (anlamı) terk etmiş olursunuz.
İki yüz fotoğrafı arasına Öklid uzayında çekilen o düz çizgi, kaçınılmaz olarak zarın dışına çıkar ve uzayın o anlamsız, karanlık boşluğuna (televizyon karıncalanmasına) dalar. Ara adımlardaki pikselleri birbirine karıştırırsanız, elinize sadece iki yüzün silik, hayaletimsi ve anlamsız bir ortalaması geçer.
Yapay zekanın ihtiyaç duyduğu şey “Jeodezik Mesafe”dir. Yani dağın içinden tünel açmak değil, dağın yüzeyini tırmanarak, o kıvrımlı zarın topolojisine sadık kalarak ilerlemek.
İşte derin sinir ağlarının (deep neural networks) katmanları tam olarak bu işe yarar.
- Döndürme ve Ölçekleme: Ağın her katmanındaki matris çarpımları, veriyi uzayda döndürür ve gerer.
- Bükme ve Katlama: ReLU veya Sigmoid gibi doğrusal olmayan aktivasyon fonksiyonları, uzayı kırıştırır, büker ve belirli yönlerde katlar.
- Topolojik Ütüleme: Katmanlar birbiri ardına dizildikçe, ağ o karmaşık ve buruşuk zarı yavaş yavaş açar.
Bu sürecin sonunda, orijinal yüksek boyutlu veri, “Gizli Uzay” (Latent Space) adı verilen daha düşük boyutlu ve tamamen düzleştirilmiş yeni bir uzaya taşınır. Makine öğrenimi literatüründe sıklıkla kullanılan “Swiss Roll” (Rulo Pasta) veri seti bu durumu kusursuzca özetler. Kendi etrafında sarmallanmış, bir ucu kırmızı diğer ucu mavi olan üç boyutlu bir kağıt şeridini düşünün. Algoritma, o ruloyu iki ucundan tutup çeker ve masanın üzerine düz bir şerit olarak serer.
Artık uzay ütülenmiştir. Dağın içinden açılan o imkansız tünel, düzleştirilmiş masanın üzerinde basit bir doğru çizgisine dönüşmüştür.
Yüzler, Kediler ve Düz Çizgilerin İmkansızlığı
Gizli uzayın ütülenip düzleştirilmiş olması, modern yapay zekanın “yaratıcılık” veya “hayal gücü” olarak adlandırılan yeteneğinin temel mekanizmasıdır.
Bugün bir görüntü üretici modele girip “Gülümseyen bir adam” fotoğrafı isteyebilir, ardından bunu “Gözlüklü bir kadın” fotoğrafına dönüştürebilirsiniz. İki görüntü arasında adım adım, pürüzsüz bir geçiş (interpolation) izlersiniz. Geçişin her bir karesinde, adam yavaşça kadına dönüşürken, ortaya çıkan her ara yüz tamamen gerçekçi bir insana benzer. Hiçbir adımda o eski “hayaletimsi” karışımı veya anlamsız televizyon karıncalanmasını görmezsiniz.
Bu nasıl mümkün olur?
Çünkü model sıfırdan bir şey hayal etmez. Model, pürüzsüzleştirilmiş ve konveks (içbükey olmayan) hale getirilmiş o Gizli Uzayda, A noktasından B noktasına doğru dümdüz bir vektör çizer. Uzay tamamen ütülendiği için, bu çizgi boyunca atılan her bir adım, zorunlu olarak o “anlam zarının” üzerinde kalır. Zardan hiçbir zaman çıkmadığı için, algoritmanın %30 adamdan uzaklaşıp %70 kadına yaklaştığı o ara nokta da, matematiksel bir zorunluluk olarak anlamlı bir insan yüzüne denk gelir.
Kelimeler dünyasında da durum farklı değildir. “Kral” kelimesinin uzaydaki koordinatından “Erkek” vektörünü çıkarıp “Kadın” vektörünü eklerseniz, ulaştığınız koordinat sizi doğrudan “Kraliçe” kelimesine götürür. Yapay zeka kavramların ne olduğunu “sezmez”; onları, aralarındaki açıların ve mesafelerin geometrik anlamlar taşıdığı devasa bir haritada koordine eder. Birbiriyle ilgisiz iki kelime, uzayda birbirine dik açı (90 derece) yapar. Dik açı, yüksek boyutlu uzayda “seninle hiçbir ilgim yok” demenin matematiksel dilidir.
İşte bu yüzden, modellerin bir şeyleri “anladığını” veya “düşündüğünü” söylemek, altta yatan bu muazzam matematiksel zarafeti gölgelemektir. Algoritma düşünmez; algoritma sadece kusursuz bir şekilde ütülenmiş bir yüzeyin üzerinde, doğru yöne doğru kayar.
Yırtılan Evrenler ve Yapay Zekanın Halüsinasyonları
Ancak bu ütüleme işlemi her zaman kusursuz çalışmaz. Manifold Hipotezinin ve topolojinin sınırları, aynı zamanda yapay zekanın sınırlarını çizer.
Sinir ağları sürekli (continuous) dönüşümler yapar. Topolojide bu tarz, yırtılmaya izin vermeyen sürekli dönüşümlere “homeomorfizma” denir. Klasik bir topoloji şakasına göre, bir matematikçi kahve kupası ile ortası delik bir çöreği (simit) birbirinden ayıramaz; çünkü ikisi de tek bir deliğe sahip üç boyutlu objelerdir ve biri esnetilerek diğerine dönüştürülebilir.
Fakat bir küreyi, yırtmadan bir çöreğe dönüştüremezsiniz. Kürenin deliği yoktur, çöreğin vardır.
Eğer modelin eğitildiği veri setinin gerçek doğası (manifoldu) delikli bir yapıdaysa, ancak sinir ağı bunu illa düz bir kağıt gibi ütülemeye çalışırsa ne olur? Ağ, verinin topolojisini yırtmak veya imkansız biçimlerde katlamak zorunda kalır. Bu işleme “entanglement” (dolanıklık/birbirine girme) denir.
Manifoldun yırtıldığı veya yanlış katlandığı bu bölgeler, yapay zekanın o ünlü “halüsinasyonlarının” ve hatalarının doğduğu yerdir. Bir modelin altı parmaklı bir el çizmesi veya bir dil modelinin son derece emin bir dille tamamen uydurma bir tarihi olayı anlatması, uzaydaki bu topolojik hatalardan kaynaklanır. Algoritma, A noktasından B noktasına giderken çekilen düz çizginin üzerinde, manifoldun dışına taşan bir “yırtık” bölgeden geçmek zorunda kalmıştır. O yırtık bölgede anlam yoktur; sadece birbiriyle çelişen vektörlerin kaosu vardır. Model oradan geçer, oradaki rastgele koordinatları bir cevap gibi okur ve ortaya o garip, tekinsiz sonuçlar çıkar.

Kaosun İçindeki Zarlar
Bütün bunları bir araya getirdiğimizde, Manifold Hipotezi bize sadece makinelerin nasıl çalıştığını değil, gerçekliğin kendi doğasına dair de sarsıcı bir perspektif sunar.
Dünyanın bütün karmaşası; Rembrandt’ın fırça darbelerindeki gölgeler, tüm insanlık tarihinin metinleri, milyarlarca farklı yüz ifadesi, fizik kuralları… Bütün bunlar devasa, milyon boyutlu bir olasılıklar evreninde yer alır. Ancak bu veriler, uzayın her yerine kaotik bir şekilde dağılmamıştır. Tam tersine, son derece düşük boyutlu, kurallı ve istikrarlı zarların üzerinde yoğunlaşmışlardır.
Makineler zeki oldukları için değil, evrenimiz bu istisnai düşük boyutlu yapıyı (bu düzeni) barındırdığı için öğrenebilirler. Eğer gerçeklik tamamen düzensiz ve homojen bir şekilde dağılmış olsaydı (yani her şey gerçekten rastgele olsaydı), milyarlarca parametreli hiçbir model hiçbir şey öğrenemezdi.
Bu da bizi yapay zekanın mühendisliğini aşan, çok daha temel bir soruya götürür:
Eğer insana dair “anlam” dediğimiz her şey, olasılıklar okyanusunda süzülen bu incecik, bükülmüş zarlara sığabiliyorsa; etrafımızdaki karmaşa sadece boyutların bir yanılsaması mıdır? Dünyayı anlamlandırmak, belki de sadece doğru kağıdı bulup onu ütülemekten ibarettir. Peki ama, insan düşüncesinin de üzerinde yürüdüğü, henüz ütülemeyi başaramadığımız daha kaç görünmez zar var?
Yeni yazılardan haberdar ol
Ayda birkaç kez; yalnızca kalıcı içerik. Spam yok.


