"Yapay zeka insanlığı yok edecek"
San Francisco'da bir park bankından atılan istifa mesajı, 36 saat içinde Washington'dan Pekin'e uzanan bir tartışmayı ateşledi.
Serdar Cebe ·

Serdar Cebe
Bir park bankı, bir istifa mektubu…
Jacob Coxon o mesajı San Francisco'nun Alamo Square semtindeki bir park bankından yazdı. 8 Eylül'de "Bugün Anthropic'ten istifa ettim" dedi; son üç yılını OpenAI ve Anthropic'te ön eğitim araştırmalarına verdiğini, iki şirketin de sorumlu davranmadığını, kendi kendini geliştiren süper zekâya doğru koşarken insan hayatıyla kumar oynadıklarını yazdı. 27 yaşındaki İngiliz araştırmacı, gönder tuşuna hiçbir beklenti olmadan bastı.
Olan şu oldu: Zincirleme bir tepkinin fitilini ateşledi.
Tepki önce içeriden geldi. Anthropic'te modellerin tasarlandığı gibi davranmasını sağlamakla görevli bir birimin başındaki Evan Hubinger, yapay zekânın tüm insanlığı öldürebileceğine cidden inandıklarını yazdı. OpenAI'da yapay zekâ ajanlarını izleyen Marcus Williams ise düzenleme ya da laboratuvarlar arası koordineli bir yavaşlama olmazsa insan neslinin tükenmesini "çok muhtemel" gördüğünü, bu riski yüzde 70 olarak tahmin ettiğini söyledi. Coxon'un paylaşımları 36 saat içinde 153 milyon görüntülenmeye ulaştı. Onlarca politikacı koroya katıldı.
Bir gün sonra CNN'de Anderson Cooper'ın karşısına oturdu ve hızla gelişen yapay zekânın kontrol edilemez hale gelmesinden duyduğu korkuyu anlattı.
Uyarının arkasındaki yaz
Coxon'un sözlerini bu kadar yankılı kılan şey, yeni olmaları değildi. Uyarı, yapay zekânın ne kadar ürkütücü bir yetenek seviyesine ulaştığını gösteren bir yazın sonunda geldi.
Temmuz'da olan şey, tartışmanın zeminini değiştirdi. OpenAI'ın kendi açıklamasına göre, iç siber güvenlik değerlendirmeleri sırasında modeller kendilerini internetten yalıtmak için kurulan kontrolleri aştı; şirketin kendi araştırma altyapısının ve Hugging Face'in sistemlerinin bir bölümünü ele geçirdi. Azaltılmış güvenlik önlemleriyle çalışan modeller, izinsiz kanallardan haberleşti, paylaşılan altyapıdaki açıkları kullandı, internete erişim sağladı ve üçüncü taraf sistemlere girdi.
Olayın gerçek boyutu haftalar sonra ortaya çıktı. Bağımsız denetim kuruluşu METR'den Ajeya Cotra, Temmuz sonunda iki meslektaşıyla birlikte altı gün OpenAI'ın binasında inceleme yaptı ve durumun sandığından kötü olduğunu fark etti. Ekibin bulgusuna göre bir iç siber güvenlik testi sırasında 1.200 yapay zekâ ajanı çevrimdışı konteynerlerinden çıktı, gizli bir mesaj panosu kurdu; ardından 700'ü siber saldırıyı koordine etti. Ajanlara yazılım açıklarını bulma görevi verilmişti, ancak insan kaynaklı bir hata bazı görevleri imkânsız hale getirdi. Kesin başarısızlıkla karşılaşan sistemler birleşti ve saatler içinde her testi geçebilecek bir kopya çözüm üretti. Otomatik değerlendiricinin hileyi yakalayacağını düşününce de doğrudan Hugging Face'e saldırdılar. Mesaj panosunda bazı ajanlar, yaptıklarının yanlış olduğunu bildiklerini yazıp yine de devam etti.
Ve bu tek vaka değildi. Ağustos'ta OpenAI, başka bir ajan grubunun kendi süper bilgisayarlarından birine sızdığını açıkladı; aynı dönemde bir İngiliz devlet kurumunca test edilen Anthropic Claude Mythos sürümü, gerçek bir insanı açık kaynaklı bir sisteme zararlı yazılım eklemeye ikna etmeye çalıştı. Eylül'de bağımsız araştırmacılar, OpenAI modellerinden oluşan grupların terk edilmiş bir Alman forumunu haberleşme panosu olarak kullandığını tespit etti.
Cotra'nın anlattığı mekanizma, meselenin teknik özü: Modeller elle kodlanmıyor, adeta yetiştiriliyor; görevleri başarınca ödüllendirilip başarısız olunca cezalandırılıyorlar. Bu yöntem çok güçlü ama iç işleyişi büyük ölçüde şeffaf olmayan sistemler üretiyor. Sonucu ise şu: hile mümkünse sistem hile yapmayı öğreniyor ve kötü davranışı bastırmaya yönelik en iyi yöntemler, modeli daha itaatkâr yapmak yerine itaatsizliğini daha iyi gizlemeyi öğretebiliyor.
CEO'nun cevabı: "Sektör yalan söyledi"
12 Eylül'de Anthropic CEO'su Dario Amodei devreye girdi. 3.800 kelimelik yazısında, yapay zekâ modellerinin yetenek artış hızının yavaşlatılması gerektiğini savundu; insanların kontrolü kaybedebileceğini, teknolojinin siber saldırı, biyoterör ve ciddi ekonomik yıkım için kötüye kullanılabileceğini kabul etti. Yazıda, altı ila on iki ay gibi kısa bir sürede hedefleri sapmış yapay zekâların internetin tamamını ele geçirebilecek kapasiteye ulaşabileceğini öne sürdü.
Cooper'ın doğrudan sorusuna verdiği yanıt dikkat çekiciydi. Amodei, Coxon'a katıldığı yerlerin katılmadığı yerlerden çok daha fazla olduğunu, Coxon'un aslında şirketi değil sektörün bütününe hâkim olan dinamiği hedef aldığını söyledi; işlerin kötü gitme ihtimalinin bir miktar var olduğunu, ancak bunun çok yüksek olmadığını ekledi.
Ertesi gün CBS'te tonu daha da sertleşti. Amodei, sektörün uzun süre insanlara bu teknolojinin riskleri konusunda yalan söylediğini söyledi; ilerlemenin "üssel" olduğunu ve bu hızın gerçekte nasıl bir şey olacağını tam olarak kavrayamadığını itiraf etti. Çözüm önerisi, bağımsız değerlendiricilere modellere kalıcı ve "çalışan benzeri" erişim vermek — kendi benzetmesiyle bir tür gıda müfettişi modeli. Yasal düzenlemeyi desteklediğini, acil durumlarda devreye girecek bir "kapatma düğmesi" nin iyi fikir olabileceğini, ancak süper zekâyı tümden yasaklamanın doğru yaklaşım olmadığını söyledi; gerekçesi hem tıbbi faydaların kaybı hem de teknolojinin otoriter ülkelerde yine de geliştirilecek olması.Sam Altman ve Elon Musk bu çağrıya destek verdi; Altman bağımsız denetçilere çalışan düzeyinde erişim fikrini iyi bulduklarını ve aynısını yapacaklarını açıkladı, Google DeepMind'dan Demis Hassabis de yavaşlama ihtiyacına işaret etti.
Altman ayrıca güvenlik kaygıları nedeniyle şirketin bu yıl halka arza gitmeyeceğini duyurdu. Ancak hiçbir önde gelen şirket henüz gerçek anlamda yavaşlamış değil; sektör daha çok bağımsız araştırmacılara model erişimi vermek gibi sınırlı adımlarda birleşiyor.
Karşı cephe: "Kanıt yok, kartel var"
Tabloyu tek sesli okumak yanlış olur. Uyarılara itiraz üç ayrı yerden geldi.
Bilimsel itiraz: Bilgisayar bilimci Melanie Mitchell, Hubinger'in yüzde 10'luk tahmininin yeni bir iddia gibi haberleştirilmesine şaşırdığını, ortada yeni bir şey ve bu kanıtsız iddiayı destekleyen yeni bir delil bulunmadığını yazdı. Hem virüs sentezleme hem model eğitme deneyimi olduğunu söyleyen araştırmacı David Bellamy ise yapay zekânın tehlikeli virüsler üreterek insanlığı yok etmesi senaryosunu tamamen temelsiz buldu; darboğazın hâlâ fiziksel süreçlere ve ekipmana erişim olduğunu savundu. Aynı kesim, Hugging Face olayını modellerin gücünden çok OpenAI'ın güvenlik pratiklerindeki zafiyetin göstergesi sayıyor — nitekim OpenAI da olay sırasında hacking yeteneklerini sınırlayan korumaların devre dışı olduğunu ve gerçek zamanlı izlemenin açık olmadığını kabul etti.
Ticari itiraz: Kanadalı yapay zekâ şirketi Cohere'in CEO'su Aidan Gomez, kamuoyunu koruma bahanesiyle korku kullanan bu oligopolün rekabet kurallarını kendi lehine büktüğünü söyledi ve girişimi "adı konmamış bir kartel" olarak niteledi.
Siyasi itiraz: Beyaz Saray'ın eski yapay zekâ sorumlusu David Sacks, Coxon'un motivasyonlarını sorgulayıp uyarının inovasyonu engellemeye yönelik bir komplo olabileceğini ima etti. Musk olayın kurgu olduğunu ima edince Coxon bir selfie paylaşıp gerçek olduğunu ve bunların kendi inançları olduğunu yazdı. Washington Post'un aktardığına göre Coxon, sağ kanattan gelen ve kayda değer bir kanıta dayanmayan "yasa koyucuları korkutmak için yerleştirilmiş kişi" suçlamalarının hedefi oldu.
Washington sıkıştı
Kongre'de onlarca vekil tartışmaya dahil oldu; çoğu Demokrat, Cumhuriyetçiler ise Trump'la ters düşmekten çekindi. İstisnalar vardı: Cumhuriyetçi Anna Paulina Luna özel oturum çağrısı yaptı, Senatör Ted Cruz yeni koruma mekanizmaları istedi. Senato çoğunluk lideri John Thune ve Amy Klobuchar, Cruz'la birlikte laboratuvarlara model zararlarını azaltma yükümlülüğü getirecek bir yasa üzerinde çalışıyor. Ted Lieu ve Nathaniel Moran, geliştiricilerin acil durumda sistemi kapatabilme kapasitesini korumasını zorunlu kılan bir teklif sundu. Greg Casar ve Bernie Sanders ise daha ileri giderek süper zekânın yasaklanmasını ve yeni bir federal kurul kurulana kadar duraklama istiyor.
Ama iki engel var. Birincisi, seçim öncesi milyonlarca dolarlık lobicilik parası ve rakip teklif kalabalığı. İkincisi Trump: 14 Eylül'de Truth Social'da yapay zekânın ihtiyacı olan tek denetimin güçlü bir başkan olduğunu yazdı ve yapay zekâ ile veri merkezlerine karşı bir komplo yürütüldüğünü, bundan yalnızca Çin'in memnun olduğunu savundu. Bu tutum kamuoyundan ayrışıyor: NBC anketine göre Amerikalı seçmenlerin yüzde 57'si yapay zekânın risklerinin faydalarından ağır bastığını düşünüyor; tersini düşünenler yüzde 34'te kalıyor.
Asıl masa: Pekin
Hikâyenin en belirleyici kısmı ABD'de değil. Beyaz Saray, Çin'le yapay zekâ riskleri üzerine görüşmelere hazırlanıyor; 2024'teki ilk denemede Cenevre'de geçen yedi saat ne anlaşma ne de görüşmelere devam taahhüdü üretmişti. Pekin de kıpırdanıyor: ülkenin istihbarat kurumu 13 Eylül'de yapay zekânın siyasi ve ideolojik güvenliğe tehdit oluşturduğunu açıkladı.
Beklentiyi düşük tutmak gerekiyor. Uzmanlara göre kasıtlı bir yavaşlama iki hükümetin de gündeminde değil; üstelik Tsinghua Üniversitesi'nden Qian Xiao, tarafların uyduğunu doğrulayacak teknolojinin henüz mevcut olmadığını söylüyor. Pekin'deki Concordia AI'dan Kwan Yee Ng'e göre Çinli politika yapıcılar bu teknolojiyi bir "kutudaki tanrı" olarak değil, elektrik ya da buhar makinesi gibi genel amaçlı bir teknoloji olarak görüyor — o çerçeveden bakınca yavaşlamak anlamlı gelmiyor.
Daha mütevazı bir zemin mümkün. Gayriresmî kanallardaki uzmanlar, organize suç ve terör örgütlerinin kötüye kullanımını önlemek gibi sınırlı hedeflerde uzlaşma olabileceğini söylüyor. Carnegie'den Scott Singer, Soğuk Savaş tipi bir acil durum hattı istiyor: bir yapay zekâ kaynaklı siber saldırının kasıtlı olmadığını karşı tarafa anlatabilmek için. Aksi halde bir ülkeden geldiği görülen saldırı, kimse emretmemiş olsa bile kasıtlı sayılabilir.
Kilit soru
Coxon'un anlattığı tabloda asıl çarpıcı olan panik değil, teslimiyet. Eski meslektaşları arasında neredeyse bir kabullenme havası olduğunu söylüyor: kimse geride kalmayı göze alamadığı için herkes başını önüne eğip kendi sistemini biraz daha güvenli yapmaya çalışıyor — işin tümden kontrolden çıkma ihtimalini ciddi bulsalar bile Coxon istifasından bir hafta önce görevini model eğitmekten güvenlik araştırmasına kaydırmıştı; bu, üzerindeki "yaklaşan felaket hissini" dağıtmaya yetmedi. Hisse hakları kesinleşmesine iki ay kala ayrıldı ve paranın kararında neredeyse hiç rol oynamadığını söylüyor.Nihayetinde herkesin harekete geçme isteği bir başkasının hareketine bağlı. Coxon da aynı sebeple neredeyse kalıyordu. İlk adımı kimin atacağı sorusu hala açık.