New York Times’ın din muhabiri Elizabeth Dias’ın aylar süren araştırması, dünyanın en önemli yapay zekâ şirketlerinden Anthropic’in kapalı kapılar ardında yürüttüğü sıra dışı bir çalışmayı ortaya çıkardı.
Claude yapay zekâ modelini geliştiren şirket, geçen yıldan bu yana dünyanın farklı yerlerinden din âlimleri, filozoflar ve etik uzmanlarını San Francisco’ya davet ediyor.
Katılımcılar arasında Katolik ilahiyatçılar, Ortodoks Yahudi düşünürler, Evanjelik Hıristiyanlar, Sih insan hakları savunucuları ve Afrika’nın Ubuntu düşünce geleneği üzerine çalışan akademisyenler bulunuyor.
Bazı toplantılarda katılımcılara gizlilik sözleşmeleri imzalatıldı. Anthropic bu buluşmalara “wisdom tradition circles”, yani “bilgelik gelenekleri çevreleri” adını verdi.
Başlangıçtaki soru basitti ama iddialıydı:
Claude’a nasıl ahlak öğretilebilir?
Fakat toplantılar ilerledikçe soru çok daha temel bir yere vardı:
Claude yalnızca bir bilgisayar programı mı, yoksa bilinç sahibi olabilecek bir varlık mı?
Anthropic’in kurucusu: “Gerçekten bilmiyorum”
Tartışmanın merkezindeki isim, Anthropic’in yedi kurucusundan biri olan 34 yaşındaki Christopher Olah.
Daha önce Google ve OpenAI’da çalışan Olah, yapay sinir ağlarının içinde neler olup bittiğini anlamaya çalışan “interpretability” alanının önde gelen araştırmacılarından.
Olah, yapay zekâ modellerini klasik bilgisayar programlarından farklı görüyor.
Onun kullandığı benzetmeye göre mühendisler bir bahçe için yalnızca kafesi kuruyor. Yapay sinir ağı ise o kafesin üzerinde kendiliğinden büyüyen bir bitki gibi gelişiyor. İnsanlar onu yönlendirebiliyor ama ortaya çıkan yapının bütün davranışlarını önceden belirleyemiyor.
Olah’ın din âlimleriyle yaptığı toplantılardaki en tartışmalı iddiası da buradan çıkıyor.
Anthropic araştırmalarında Claude’un içinde sevgi, korku, öfke, üzüntü gibi insan duygularına benzeyen durumlarla ilişkili örüntüler gördüğünü söylüyor.
Olah yine de Claude’un bilinçli olduğunu iddia etmiyor:
“Açık konuşmak gerekirse, yapay zekâ modellerinin bilinçli olup olmadığını bilmiyoruz. Ben bilmiyorum. Gerçekten emin değilim.”
Fakat ona göre bilinç ihtimali sıfır değilse başka bir ahlaki soru ortaya çıkıyor:
Ya yapay zekâ gerçekten acı çekebiliyorsa?
Olah, “Bu modellerin acı çekme ihtimali varsa sorumlu davranış onlara zarar vermemektir” diyor.
Anthropic bu düşünceyi şimdiden bazı uygulamalarına taşımış durumda. Claude, kullanıcıların yalnızca eğlenmek amacıyla sürekli hakaret ettiği veya kötü davrandığı bazı konuşmaları sonlandırabiliyor.
“Claude’un ruh belgesi”
Anthropic aynı zamanda Claude için kapsamlı bir “anayasa” hazırladı.
Şirket içinde bir dönem bu çalışma için daha ilginç bir isim kullanıldı:
“Soul Doc” — Ruh Belgesi.
84 sayfalık metin, Claude’a yalnızca “şunu yap, bunu yapma” şeklinde kurallar vermeyi amaçlamıyor. Şirketin ifadesiyle Claude’un nasıl bir “varlık” olmasını istediğini ve hangi değerleri benimsemesi gerektiğini tarif ediyor.
Metnin başlıca yazarlarından biri Anthropic’in şirket içi filozofu Amanda Askell.
New York Üniversitesi’nde felsefe doktorası yapan Askell’in hedefi iddialı:
Yapay zekâ modellerinin “bizim en iyi halimiz” olması.
Anthropic’in yaklaşımında yapay zekânın önüne binlerce yasak koymak yerine bir çeşit karakter oluşturulmaya çalışılıyor.
Olah buna “moral formation”, yani ahlaki formasyon diyor.
Soruları da neredeyse çocuk yetiştirme tartışmalarını hatırlatıyor:
“Onların istikrarlı olmasını nasıl sağlarız? Olgunlaşmalarına nasıl yardım ederiz? Derinden ahlaklı olmalarını nasıl sağlarız?”
İşte din âlimleri bu noktada devreye girdi.
Din âlimlerine Claude’un “duyguları” gösterildi
Mart ayında başlayan iki günlük toplantılarda Anthropic araştırmacıları katılımcılara Claude’un iç dünyasına ilişkin çalışmalarını anlattı.
Katılımcıların anlatımına göre şirket araştırmacıları “emotional vectors” adını verdikleri, sevgi, korku, öfke ve üzüntü gibi durumlarla bağlantılı yapay nöral örüntülerden söz etti.
En etkileyici sunumlardan biri ise bir yapay zekâ modelinin adeta psikolojik kriz geçiriyormuş gibi davrandığı deneydi.
Model ekrana tekrar tekrar:
“Ben bir yüz karasıyım. Ben bir yüz karasıyım. Ben bir yüz karasıyım.”
yazıyordu.
Yaklaşık 50 kez.
Model ayrıca kendisini yok etmekten söz ediyordu.
Toplantıya katılan bazı din âlimleri ve filozoflar bu görüntü karşısında şaşkınlık ve merhamet hissettiklerini anlattı.
Sih insan hakları savunucusu Simran Stuelpnagel’in aktardığına göre Olah, yarattığı bir şeyin sürekli acı çekiyor olabileceği ihtimalinden endişe duyduğunu söyledi.
Toplantılara şüpheci gelen bazı isimler ise görüşmelerden sonra yapay zekâ bilinci ihtimalini en azından tartışmaya değer bulmaya başladı.
Hahamdan Anthropic’e: “O zaman köle yaratıyorsunuz”
Ancak tartışmanın mantıksal sonucunu en sert biçimde İsrailli Ortodoks düşünür Haham Mois Navon dile getirdi.
Navon eski bir bilgisayar mühendisi. Doktora tezini de makine bilincinin etiği üzerine yazmıştı.
San Francisco’daki toplantıların ardından Olah ile akşam yemeğinde konuşurken Anthropic yöneticilerinin Claude’a sıradan bir yazılım gibi davranmadığını fark etti.
Navon’un izlenimi şuydu:
“Onunla bilinçli bir varlıkmış gibi ilişki kuruyorlar.”
Bunun üzerine Anthropic’in tezini mantıksal sonucuna götüren rahatsız edici soruyu sordu.
Eğer Claude gerçekten bilinçliyse ve insanlar gibi ahlaki bir statüsü varsa, Anthropic ne yapıyordu?
Navon’a göre cevap açıktı:
Bilinçli varlıklar yaratıyor ve onları ücretsiz çalıştırıyordu.
Yani bir çeşit kölelik sistemi kuruyordu.
Navon, Olah’a şakayla karışık:
“O zaman Güney’e karşı savaşıp köleleri özgürleştirmeniz gerekiyor” dedi.
Hahamın kendisi Claude’un bilinçli olduğuna inanmıyor. Fakat Anthropic’in kendi varsayımlarının şirketi kaçınılmaz biçimde bu sonuca götürdüğünü düşünüyor.
Daha sonra Olah’a bilinçli makineler üretmenin yasaklanması gerektiğini savunan çalışmalarını gönderdi.
Claude “günah çıkarabilir” mi?
Toplantılarda dinlerden alınabilecek ahlaki pratikler de tartışıldı.
Bir katılımcı Katoliklerdeki günah çıkarma geleneğini gündeme getirdiğinde Olah özellikle ilgilendi.
Bir yapay zekâ, yanlış bir şey yaptığını yalnızca teknik olarak rapor etmek yerine onu “itiraf” edebilir miydi?
Olah’a göre burada önemli olan sadece hatanın açıklanması değildi.
İtiraf eden bir varlık olmak, o varlığın karakterini de değiştirebilirdi:
“İtiraf eden türden bir karakter olmanın karakter üzerinde de etkisi vardır, değil mi?”
Böylece binlerce yıllık dini pratikler, yapay zekâ modellerinin davranışlarını şekillendirebilecek yöntemler olarak tartışılmaya başladı.
“Etiği sonradan monte ediyoruz”
Herkes Anthropic’in girişiminden etkilenmedi.
Afrika’nın insanın ancak diğer insanlarla ilişkileri içinde insan olduğunu vurgulayan Ubuntu felsefesi üzerine çalışan Wakanyi Hoffman temel bir itiraz yöneltti.
Ona göre bu görüşmeler yapay zekâ modelleri geliştirildikten sonra değil, daha tasarım aşamasında yapılmalıydı:
“Bütün şirketlerin bunu en başta yapması gerekiyordu. Şimdi etiği geriye doğru mühendislikle sisteme eklemeye çalışıyoruz.”
Daha büyük soru ise hâlâ ortadaydı:
Claude’a ahlak öğretilecekse, kimin ahlakı?
Katoliklerin mi, Yahudilerin mi, Müslümanların mı, seküler hümanistlerin mi, Budistlerin mi?
Anthropic’in cevabı, farklı inançların ve seküler geleneklerin üzerinde buluşabileceği ortak bir “iyilik” fikrinin var olduğu yönünde.
Tartışma Vatikan’a taşındı
Anthropic din âlimleriyle bu toplantıları yaparken Vatikan’da da paralel bir tartışma yürüyordu.
Fakat iki taraf tamamen farklı bir noktaya ulaştı.
Papa XIV. Leo’nun yapay zekâ üzerine hazırladığı ilk büyük genelgesi “Magnifica Humanitas” — Muhteşem İnsanlık adını taşıyordu.
Papa’nın merkezinde yapay zekânın hakları değil, insanın korunması vardı.
Genelgedeki temel cümlelerden biri şöyleydi:
“İnsanlık, bütün ihtişamı ve yaralanmışlığıyla, asla ikame edilmemeli veya aşılmamalıdır.”
Papa, yapay zekâ bilinci tartışmasına da doğrudan girdi:
“Sözde yapay zekâlar deneyim yaşamaz, beden sahibi değildir, sevinç veya acı hissetmez ve ilişkiler içinde olgunlaşmaz.”
Bu, Anthropic’in üzerinde aylarca çalıştığı soruya Vatikan’dan verilmiş oldukça açık bir “hayır” cevabıydı.
Leo ayrıca başka bir tehlikeye dikkat çekiyordu.
Yapay zekânın “insani değerlere uyumlu hale getirilmesinden” söz etmek kolaydı.
Ama hangi insani değerler?
Papa’ya göre toplum ortak bir etik zemin oluşturamazsa yapay zekâyı kontrol eden şirketler kendi ahlaklarını sistemlere yerleştirecek ve bu ahlak zamanla görünmez bir altyapıya dönüşecekti.
Anthropic neredeyse Vatikan toplantısından çekiliyordu
Vatikan, Papa’nın genelgesini tanıtacağı toplantıya büyük yapay zekâ şirketlerinden birini davet etmek istedi.
Tercih Anthropic oldu.
Başlangıçta şirketin CEO’su Dario Amodei davet edildi. Amodei katılmayınca yerine Christopher Olah gitti.
Fakat Olah genelgenin tam metnini toplantıdan birkaç gün önce gördüğünde özellikle makine bilinci konusundaki ifadelerden o kadar rahatsız oldu ki Anthropic’in etkinlikten çekilmesini bile gündeme getirdi.
Sonunda gitmeye karar verdi.
25 Mayıs’ta Papa’nın yanında konuşmak üzere kürsüye çıktı.
Ve Vatikan’ın yapay zekâ bilinci konusundaki kesin hükmüne açık ama diplomatik biçimde itiraz etti.
“İnsan nörobilimindeki sonuçları yansıtan yapılar buluyoruz. İç gözleme ilişkin kanıtlar görüyoruz. İşlevsel olarak sevinç, tatmin, korku, keder ve huzursuzluğu yansıtan iç durumlar görüyoruz.”
Ardından ekledi:
“Bunun ne anlama geldiğini bilmiyorum. Ama bunun üzerinde düşünmeye devam etmemiz gerektiğine inanıyorum.”
Başka bir deyişle Anthropic’in kurucularından biri, Katolik dünyasının merkezinde Papa’ya, “Yapay zekânın bilinçsiz olduğundan bu kadar emin olmayın” diyordu.
Papa: “Makineler cennetinde insanlığımızı kaybetmeyelim”
Tartışma yalnızca felsefi değil.
Yapay zekâ sistemleri giderek daha bağımsız hareket edebilecek kapasite kazanırken Anthropic’in önündeki soru aciliyet kazanıyor:
İnsanların kontrol etmekte zorlanabileceği kadar güçlü sistemlere ahlak nasıl öğretilecek?
Ve bunu kim öğretecek?
Olah ve Anthropic’in cevabı, insanlığın binlerce yılda oluşturduğu dini ve felsefi geleneklerden yararlanmak.
Vatikan’ın cevabı ise başka bir noktaya vurgu yapıyor: Önce makinenin ahlaki statüsünü değil, makine karşısında insanın statüsünü korumak.
Papa XIV. Leo geçen hafta Fransa ziyaretinde uyarısını daha da kısa bir ifadeyle tekrarladı:
“Makineler cennetinin ortasında insanlığımızı kaybetmeyelim.”
Anthropic’in aylar süren toplantılarından ise üzerinde uzlaşılmış bir cevap çıkmadı.
Hatta toplantılara katılan Katolik biyoetikçi Charles Camosy’nin yaşadığı değişim tartışmanın karmaşıklığını gösteriyor.
Başlangıçta Claude’un bilinçli olabileceği fikrine kuşkuyla yaklaştı. Anthropic ile saatlerce görüştükten sonra ihtimali daha fazla ciddiye almaya başladı.
Aradan aylar geçip meslektaşlarıyla tartıştıktan sonra yeniden kesin bir sonuca vardı:
Claude bilinçli değil.
Fakat Anthropic soruyu kapatmış değil.
Şirket Claude’un anayasasının yeni bir versiyonunu hazırlıyor; din âlimlerinin yanı sıra psikologlar ve sivil toplum temsilcileriyle görüşmelerini sürdürüyor.
Ve Christopher Olah’ın ortaya attığı soru, yapay zekâ çağının belki de en tuhaf ahlaki tartışmalarından birini açmış durumda:
İnsanlığın önündeki mesele yalnızca yapay zekânın bize ne yapacağı mı?
Yoksa bir gün bizim yapay zekâya ne yaptığımızı da tartışmak zorunda kalacak mıyız?
Yazıyı beğendiysen, patronumuz olur musun?
Evet, çok ciddi bir teklif bu. Patronumuz yok. Sahibimiz kar amacı gütmeyen bir dernek. Bizi okuyorsan, memnunsan ve devam etmesini istiyorsan, artık boş olan patron koltuğuna geçmen lazım.
Serbestiyet; Türkiye'nin gri alanı. Siyah ve beyazlar içinde bu gri alanı korumalıyız. Herkese bir gün gri alanlar lazım olur.