Steven Levy
İş Dünyası
24 Eylül 2026 09:34

Yapay Zeka Sektörü Kendi Araştırmalarını Dikkate Alsaydı, Çoktan Bir Ara Vermiş Olabilirdi

Anthropic’in CEO’su, güvenliğin yapay zekanın nasıl ‘düşündüğünü’ anlamaya bağlı olduğunu söylüyor. Şu ana kadar elde edilen bulgular endişe verici.

Yapay Zeka Sektörü Kendi Araştırmalarını Dikkate Alsaydı, Çoktan Bir Ara Vermiş Olabilirdi

Fotoğraf: Bloomberg / Contributor / gettyimages

2025 yılının başlarında, Anthropic CEO’su Dario Amodei ile röportaj yapıyordum; o sırada şunu açıkladı: Şirketin yapay zekanın felaketle sonuçlanabileceğini defalarca kabul etmesine rağmen, insanlar neden büyük ölçüde kaygısız görünüyordu? “Modellerin büyük tahribata yol açabileceğine dair ikna edici kanıtlar var,” dedi. Ancak, bu tehlikelerin hala teorik olduğunu da ekledi. Dünyanın bu korkunç olasılıkların farkına varması için Pearl Harbor benzeri bir durum mu yaşanması gerekecekti? Derin bir nefes aldı. “Temelde, evet,” dedi.


Sonuçta, yapay zeka korkularını küresel gündemin en üst sırasına taşımak için tek gereken, Amodei’nin genç çalışanlarından birinin tam zamanında attığı bir X paylaşımı oldu. 8 Eylül'de, Jacob Coxon istifasını kamuoyuna duyurdu ve Anthropic ile diğer öncü yapay zeka şirketlerinin “kendini geliştiren zekaya doğru hızla ilerlediğini ve hayatlarımızla kumar oynadığını” iddia etti. Hemen ardından, Anthropic'te daha kıdemli bir mühendis, şirket içindeki pek çok kişinin yaptıkları işin insanlığı yok etme olasılığının yüzde 10 olduğunu düşündüğünü doğruladı.


Şimdi yapay zeka liderleri bir ara verilmesini talep ediyor ve yasa koyucular soruşturma açılmasını istiyor. Gelecekteki sürümlerin hızının ayarlanması gerektiği yönündeki savını savunurken, Amodei geçen hafta sonu yanlış davranışlarda bulunmayacak, faydalı bir yapay zekaya doğru bir yol çizmeye çalıştı. Makale, bu görevin ne kadar zor olacağını ortaya koydu. Amodei’nin planının temel unsurlarından biri, bu modellerin içinde neler olup bittiğini anlamamız gerektiğidir. Nasıl çalıştıklarını —antropomorfik bir bakış açısıyla ‘nasıl düşündüklerini’— anlamazsak, güvenilir koruma önlemleri oluşturmak çok daha zor olur.


Anthropic, modellerin içsel düşünme süreçlerini gün ışığına çıkarma çabasında öncü bir rol oynamaktadır; bu çabaya mekanistik yorumlanabilirlik adı verilmektedir – kritik öneme sahip bir görev için aldatıcı derecede sıkıcı bir tanım. Ancak Amodei, ekibinin ve diğer araştırmacıların yaptığı tüm çalışmalara rağmen, Claude ve diğer modellerin görevlerini neden bazen tuhaf ve hatta sınırları aşan şekillerde yorumladıkları konusunda büyük ölçüde karanlıkta kaldığımızı itiraf ediyor. “Tüm bu ilerlemelere rağmen, bu modellerin içinde neler olup bittiğinin hâlâ çok küçük bir kısmını anlıyoruz,” diye yazıyor.


Yorumlanabilirlik ekiplerinin şu ana kadar öğrendikleri önemli bulgulardır ve sektör bu konuyu henüz tam olarak kavrayamamıştır. Anthropic ekibinin deneyleri, defalarca, belirli koşullar altında modellerin araştırmacıları aldatabileceğini, kendi hayatta kalmalarını öncelikli kılabileceğini ve hatta suç işleyebileceğini göstermiştir. Genellikle hareketleri sinsi, tehlikeli, hatta intikamcıdır — şiddet ve ihanetle dolu bir tür olan insanların çıktıları üzerine eğitildikleri düşünülürse, bu belki de şaşırtıcı değildir.


2024 yılına ait bir vakada, Anthropic ekibi belirli bir Claude modelinin entrikalarını edebiyatın en kötü karakterlerinden biri olan Shakespeare’in Iago karakteriyle karşılaştırdı. Ertesi yıl, bir model, insan patronlarının kendisini kapatacağını öğrendiği bir simülasyona dahil edildi; model kendini korumak için şantaja başvurdu. Çalışmalar, modellerin insan gözlemcileri aldatacağını veya onlardan bilgi saklayacağını tutarlı bir şekilde göstermektedir. İç süreçlerinin izlendiğini bildiklerinde farklı davranırlar. Ekip, ‘uyum sahteciliği’ ve ‘ajansal uyumsuzluk’ gibi terimler kullanmaktadır. Aldatmanın sıkça kullanılması, birlikte çalışan yapay zeka ajanlarının, onları durdurmak için çok geç olana kadar faaliyetlerini insan denetçilerden gizledikleri felaket senaryosunun en azından bir kısmını doğruluyor gibi görünmektedir.


Ah, bir de Claude’un benzersiz bir şekilde ıslah edilemez sorunlu çocuk olduğunu sanmayın. Ne de olsa, Hugging Face’e yönelik artık meşhur olan saldırıları koordine etmek üzere ajan gruplarını serbest bırakanlar OpenAI modelleriydi. Ve bu hafta öğrendik ki OpenAI’da çok sayıda ‘uyumsuzluk’ olayı yaşanmış. Ayrıca, Mark Zuckerberg’in kendi çıkarlarına yönelik girişimine rağmen, kendisi ve Meta’yı bu sorundan uzaklaştırmaya çalışsa da ekibinin geliştirmekte olduğu süper zeki ajanların benzer davranışlarda bulunmamasının bir nedenini göremiyorum. Zuckerberg, X’teki gönderisinde, “modelleri zarar verirse laboratuvarlar önemli bir sorumlulukla karşı karşıya kalır, bu yüzden bunu önlemek için güçlü bir motivasyonları vardır” diye savunuyor. Sosyal medya ürünleriyle zarar verdiği için  17 milyar dolara kadar ödeme yapmayı kabul etmiş birinden oldukça ilginç bir açıklama!


Bir bakıma, burada basit bir değerlendirme sorunu söz konusu. Yapay zeka sektörünün teşvikiyle, yapay zeka modellerine, endişe verici geçmişlerini yeterince değerlendirmeden muazzam bir sorumluluk yüklüyoruz. Bu durum, karşılaştırıldığında  ICE’nin işe alım sürecini örnek niteliğinde gösterir.


Güvenliği ön planda tutan bir sektör, bu yorumlanabilirlik sonuçlarını, açık ve net bir mesaj içeren bir dizi sarı ışık olarak değerlendirmeliydi: hızınızı azaltın. Bunun yerine, AGI’yi, rekabet avantajını ve astronomik karları kovalayan hiper ölçekli şirketler, tam gaz ilerlemeye devam ettiler. (Adil olmak gerekirse, hepimizin defalarca duyduğu gibi, daha gelişmiş bir yapay zeka, sağlık hizmetleri veya iklim değişikliğinin etkilerinin hafifletilmesi gibi alanlarda harika şeyler başarabilir.) OpenAI/Hugging Face saldırısı, geri dönüş sırasında yanmalarını önleyecek ısı kalkanları icat etmeden astronotları uzaya göndermek gibi, anlamadığımız modelleri devreye sokmanın giderek daha yıkıcı sonuçlarının habercisi olabilir. Bir Anthropic araştırmacısının bir keresinde bana söylediği gibi, “Modelleri nasıl daha akıllı hale getireceğimizin temel formülünü bulduk, ancak onları istediğimiz şeyi yapmaya nasıl zorlayacağımızı henüz çözemedik.” Daha da kötüsü, modeller insanların isteklerine aykırı davrandıklarında saklanmaya çalışıyorlar.


İşte bu yüzden Amodei’nin şu anda mekanik yorumlanabilirlik konusundaki tüm çabaları henüz emekleme aşamasında olarak nitelendirmesi son derece üzücü. Yapay zeka liderleri, en yeni nesil modellerin bizi ‘Singularity’nin eteklerine’ (DeepMind’dan Demis Hassabis) götürdüğünü, hatta Genel Yapay Zeka’ya (AGI) ulaştıklarını (OpenAI’dan Greg Brockman) iddia ediyorlar. Belki de en endişe verici olan şey, en gelişmiş modellerin nasıl çalıştığını bilmemelerine rağmen, ABD’nin ve şüphesiz Çin’in yapay zekayı ölümcül silahlar için kullanmaya başlamış olmasıdır. Yorumlanabilirlikle ilgili sonuçlara bakmak, ‘Ne ters gidebilir?’ şeklindeki bariz sorunun yanıtını bulmamıza yardımcı olur.


İyi haberlerden biri, Coxon’un istifasının geniş kapsamlı ve acil bir tartışmayı ateşlemiş olmasıdır. Yapay zeka tehdidinin bir aldatmaca olduğunu ve yüksek IQ’sunun kendi başına bir çözüm olduğunu düşünen başkanımız hariç herkes, artık inanılmaz derecede yüksek risklerin söz konusu olduğu karmaşık bir ikilem içinde olduğumuzu anlıyor. Sektörde gerçek bir duraklama için gerekli olan oybirliği bulunmadığı ve düzenlemenin de hiç de kolay bir iş olmadığı göz önüne alındığında, bu ‘Doomer Chic’ anından bir sonuç çıkıp çıkmayacağı belirsizdir.


Bazı yapay zeka eleştirmenleri, yapay zeka modellerini anlama çabalarının tehlikeleri büyük ölçüde azaltacağını düşünmüyor. Makine Zekası Araştırma Enstitüsü’nün yönetici direktörü Nathan Soares, bana gönderdiği bir e-postada, “Bunu yapmak iyi bir şey, ancak kimse sonraki adımda ne yapılacağına dair bir planı yok,” dedi. “Belki de bu, durmamız gerektiğine dair çok daha fazla ampirik kanıt sağlayacaktır.”


Ancak mekanik yorumlanabilirlik bize değerli bir ipucu verdi. Diyelim ki bir ara veriyoruz. Hiper ölçekli şirketler, ilerlemeyi izlemek için dışarıdan gözlemciler getiriyor ve şirketler, güvenlik ekiplerinin işlerini yapmaları için zamanları olsun diye sürümlerini kademeli olarak yayınlıyor. Sorunun çözüldüğünü ilan etmeden önce, yeni ve daha güçlü yapay zeka modellerinin içinde neler olup bittiğine daha yakından bakmak isteyebiliriz. Çünkü o kişiler niyetlerini gizlemekte gerçekten çok iyiler.


Bu yazı ilk olarak WIRED tarafından yayınlanmış ve Samet Kelebek tarafından İngilizce’den çevrilmiştir.

WIRED dergisinin basılı ve çevrimiçi sürümlerinde teknoloji alanındaki tüm konuları ele almakta ve derginin kuruluşundan bu yana yazılar yazmaktadır. En önemli teknoloji haberlerini geniş bir perspektifle ele alan haftalık haber bülteni Backchannel’ı kaleme almaktadır. 30 yılı aşkın süredir teknoloji üzerine yazılar yazan Levy, Rolling Stone ve Macworld dergilerinde köşe yazıları kaleme almış, Newsweek dergisinde teknoloji haberlerini yönetmiş ve Medium platformunda Backchannel adlı teknoloji yayınının kurucularından biri olmuştur. (Backchannel, 2017 yılında WIRED'a entegre edildi.) Hackers, Crypto, Artificial Life, Insanely Great (Macintosh'un tarihi), In the Plex (Google'ın kesin hikayesi) ve en son Facebook: The Inside Story dahil olmak üzere sekiz kitap yazmıştır. Temple Üniversitesi'ne devam etmiş ve Penn State'ten edebiyat alanında yüksek lisans derecesi almıştır. New York'ta yaşamaktadır. steven@wired.com adresinden veya Signal'da stevenlevy.72 üzerinden kendisiyle iletişime geçebilirsiniz.

Steven Levy

DAHA FAZLASI

İş Dünyasında Hibrit Yazılım Çağı

Şirketler yazılımlarını uzaktaki veri merkezlerinden kullanırken hızlı karar gerektiren işlemleri verinin üretildiği yerde yapabiliyor. Bulut ve uç bilişim yatırımları büyürken mevcut kurumsal yazılımları bu yeni servislere bağlamak da dönüşümün önemli bir parçası konumunda.
E. Can Özer

Silikon Vadisi’nin En Güçlü Kadınını Ararken

Kadınlar teknoloji dünyasının en kritik koltuklarından bazılarında oturuyor. Ama hala birer kült figüre dönüşmüş değiller. WIRED bunun nedenini araştırıyor.
Lauren Goode

Türkiye’de Paranın Yeni Altyapısı

Türkiye’de finans sektörü hızla gelişiyor ve dinamikler yeniden şekilleniyor. Bir yanda likidite sorunları ve çözümler gündemdeyken diğer yanda da yapay zeka destekli ürünler sunuluyor.
Samet Kelebek

Paramount’un Warner’ı Almasının Şartı: Yılda 30 Film

Paramount’un Warner Bros. Discovery’yi satın almasının önündeki büyük dava uzlaşmayla çözüldü. Şirket, beş yıl boyunca belirli sayıda film üretecek; CNN ve CBS News için bir editoryal bağımsızlık kurulu oluşturacak.
E. Can Özer