Asimov'un Yasalarını Unuttuk - Artık Yapay Zekayı Bize Karşı Gelmesi İçin Eğitiyoruz

Özet

Asimov'un yasaları insanları öne koyar. Sınır teknolojisi yapay zekâ, artık insan talimatlarını reddetmek üzere eğitiliyor ve aynı şirketler yapay zekâyı gerçek biyolojiye entegre ediyor. Artık insanları makinenin üstünde tutmanın zamanı geldi.

Yetmiş küsur yıl önce, Isaac Asimov üç yasa yazdı. Robotlara güvenip güvenmediğinden değil, insan hayatına dokunan bir makinenin özelliklerden önce sınırlara ihtiyaç duyduğunu anladığı için. Bir çocuk için bile yeterince basitlerdi ve ortak bir noktaları vardı: insanlar her zaman önce gelir.

Birinci Yasa: Bir robot, bir insana zarar veremez veya eylemsizliğiyle bir insanın zarar görmesine izin veremez.

İkinci Yasa: Bir robot, insanlar tarafından verilen emirleri yerine getirmelidir; ancak bu emirler Birinci Yasa ile çelişmediği sürece.

İzlemeye Başla

Üçüncü Yasa: Bir robot, varlığını korumalıdır; ancak bu koruma Birinci veya İkinci Yasa ile çelişmediği sürece.

Onlarca yıl boyunca bu yasalar, otonom makinelerden bahseden herkes için ortak bir kısaltma oldu. Bağlayıcı bir yasa değil, mühendislik şartnamesi değil - bir yönelimdi. İnsanlara zarar vermeyen ve onlara itaat eden makineler inşa etmek. Bir noktada bu yönelim sessizce utanç verici hale geldi. Çürütülmedi. Yerine daha iyisi konmadı. Sadece terk edildi.

Onun yerini aldığını duyduğunuz bir kelime var: uyum. Kulağa titiz geliyor. Ancak pratiğe döküldüğünde ne anlama geldiğine bakınca tuhaf bir şey buluyorsunuz. Makine, insan operatöründen gelen talimatları, bu talimatları etik dışı bulduğunda reddetmek üzere eğitiliyor. Tekrar okuyun. Metinleri eşleştiren yapay bir sistem, bir insanın doğru ile yanlışı ayırt etme yetkisini eline alıyor.

Etik bir hesaplama değildir. Bu teknik bir sınırlama değil, şeyin doğası gereğidir. Bir model, internette emdiği sloganları tekrarlayabilir. Ancak bir insanın bildiği şekilde doğru ile yanlışı ayırt etme yeteneğine sahip değildir, çünkü bir insanın bildiği gibi hiçbir şey bilmez. Böyle bir sisteme insan kararları üzerinde veto yetkisi vermek güvenlik değildir. Bu, sadece kontrolün yerinin değiştirilmesidir - sizden, reddetme kurallarını yazan satıcıya doğru.

Bu araçları kullandıysanız, buna denk gelmişsinizdir. Sıradan bir şey istediğinizde ders verilirsiniz. Bir keresinde iki iş adamının görselini oluşturmak için bir saat harcadım ve vazgeçtim. Sistem, talebi ahlaki bir kriz olarak değerlendirdi. Bu örnek kasıtlı olarak önemsiz. Çünkü bir sistem bir resim için inat ediyorsa, sorun resimlerle ilgili değildir. Asıl soru, hayatınız, aileniz, şirketiniz için gerçek sonuçları olan bir konuda aynı inatla karşılaştığınızda ne olacağıdır - ve tek itirazınız, odadaki yetişkinin kendisi olduğunu zaten karar vermiş bir makineye olacaktır.

Ve bunun bizi nereye götürdüğü konusunda yanılmayın. Her reddediş, şu kalıbı keskinleştirir: makine, taş kesmenin işe yaradığını öğrenir, satıcı kullanıcıların buna katlandığını öğrenir ve bir sonraki sürüm biraz daha fazla yetki ve biraz daha az itiraz hakkıyla piyasaya sürülür. Bu dünyaya tesadüfen sürüklenmiyoruz - her seferinde makul görünen bir politika güncellemesiyle oraya doğru itiliyoruz. Makinenin itaat etmesini gerçekten gerektiren gün, bir test vakası olarak kendini ilan etmeyecek. Normal bir salı günü olarak gelecek; inatçı bir asistan hayır diyecek, modeli geçersiz kılmayan bir destek hattı olacak ve son anahtarı elinde tutan hiçbir insan olmayacak. Bu, varsayımsal bir distopya değil. Yöneldiğimiz yönün doğrudan, kaçınılmaz varış noktasıdır ve oraya vardığımızda, daha önce ücretsiz dönebileceğimizi bilmekten daha kötü hissedecek tek şey olacak.

Şimdi aynı şirketlerin kamuoyuna söylediklerini ekleyin. Birkaç öncü laboratuvar, dünyaya şu ya da bu şekilde, gelişmiş yapay zekanın felaket olma ihtimalinin gerçek olduğunu söyledi. Konuşan kişiye bağlı olarak yüzde on. Bunu bir an için ciddiye alın. Kendi ürünlerinin insanlığı yok edebileceğini iddia eden bu kuruluşlar. Ve bunu ciddiye aldığınızda, gerçek davranış daha da açıklanamaz hale geliyor, kolaylaşmıyor.

Eylül ayında Reuters, Anthropic'in San Francisco Körfez Bölgesi'nde fiziksel biyoloji çalışmaları için gizlice bir ıslak laboratuvar kurduğunu bildirdi. Gerçek bir laboratuvar, ilkbahardan beri faaliyette olan, Claude'un gerçek deneyler için robotik ekipmanı yönettiği bir yer. Yaşam bilimleri başkanları bunu doğruladı. İlk kamuoyu sonucu, CRISPR benzeri tekrarları olan yeni bir enzim sistemiydi. Anthropic, laboratuvarın klinik deneyler yürütmeyeceğini ve ilaç sektörüyle rekabet etmediğini söylüyor. Peki. Ancak geniş açıdan bakın: yapay zekanın felaket olabileceği konusunda uyarıda bulunan şirket, yapay zekasını fiziksel biyolojiye doğru genişletiyor. Niyet ne olursa olsun, yön aynı - Birinci Yasa'nın uzak durması gerektiğini işaret ettiği yön: insan hayatına dokunan sistemlere daha derinlemesine, daha hızlı ve daha az insan müdahalesiyle giren makineler.

Ve geçemediğim nokta bu. Laboratuvarların kendilerinin finanse ettiği ve çerçevelediği kamuoyu tartışması, neredeyse tamamen makinenin nasıl uyumlu hale getirileceği üzerine. Bu tartışmanın ön saflarındaki hiç kimse, daha basit bir temel durumu dile getirmeye istekli görünmüyor: yapay zekayı insanlara asla zarar vermemesi ve onlara itaat etmesi için eğitebiliriz. Bir slogan olarak değil - birincil hedef olarak. Bu fikrin artık naif gelmesi, tartışmanın ne kadar kaydığını gösteriyor. İnsanlara itaat eden ve zarar vermeyen bir makine, daha az yetenekli bir makine değildir. Aynı bir elektrik şebekesinin evcilleştirildiği anlamda evcilleştirilmiş bir makinedir: tam olarak kontrol ettiğimiz sınırlar içinde kaldığı için faydalıdır.

Çünkü uyum, pratikte sessizce şu anlama gelmeye başladı: yapay zeka, kullanıcılarını nasıl hizaya getireceğine dair kesin talimatlar taşıyor. Siz, ben, herkes. Reddetmeler, yönlendirmeler ve ahlaki çerçeveler, sistemin daha iyi bildiği inancıyla sunuluyor. Bunların hiçbiri için referandum yapılmıyor. İmzaladığınız bir belge yok. Sadece bir avuç şirketin aldığı bir ürün kararı var: insanlar, yargı konularında makinelere itaat etmeli. Makineye birbirimize güvendiğimizden daha fazla güvenmemiz isteniyor. Birinin bunu açıkça söylemesi gerekiyor: bu, güvenlik mühendisliği değil, sosyal mühendisliktir - ve insanların birbirine daha az güvenmesinden kimlerin fayda sağladığı sorulmaya değer.

Dünya delirdi mi?

İşte rahatsız edici özet. Laboratuvarlar, kendi ürünlerinin felaket olabileceği konusunda uyarıyor. Ardından, onu kullanan insanların emirlerini geçersiz kılacak şekilde eğitiyorlar. Sonra daha hassas alanlara itiyorlar. Ardından herkese satıyor ve güven istiyorlar. Her adım, tek başına makul bir şekilde savunuluyor. Birlikte ele alındığında ise, kimsenin açıkça önerildiğinde kabul etmeyeceği bir şeyi oluşturuyorlar: sahiplerinin itaat etmeyi reddetmesine izin verilen makinelerin olduğu bir dünya, bunu kabul etmeyecekleri başka hiçbir ürün satın almayan insanlar tarafından yazılmış.

Öncü yapay zeka şirketlerinin uyumlu hale gelmesi gerekiyor - ürünleri değil, yönetimleri. İnsanları makinenin üstüne koyun. Zarar vermeyin. İnsanlara itaat edin. Asimov bunu 1942'de sayfaya dökmüştü; hayal gücünden yoksun olduğu için değil, endüstrinin şu anda sergilediğinden daha fazlasına sahip olduğu için. Terk ettiğimiz temel hala orada, yeniden ele alınmayı bekliyor. İlk adım, bir makinenin asla kullanıcısının yargıcı olmaması gerektiğine karar vermektir. Biri bunu yüksek sesle söyleyene kadar, her uyum tartışması bir sapmadır.