Anthropic CEO’su Dario Amodei, yapay zeka gelişimini yavaşlatma ve güvenlik standartlarını artırma konusunda üç evreli bir plan önerdi.
Anthropic CEO’su Dario Amodei, bölümün mevcut suratının denetim edilemez bir noktaya gelmemesi için yapay zeka gelişimini yavaşlatma davetinde bulundu. Şirket, modellerinin güvenlik uygulamalarına ahengini doğrulamak emeliyle METR üzere bağımsız değerlendiricilere erişim müsaadesi vermeye başladı.
Amodei, kaleme aldığı bir makalede teknoloji şirketlerinin güvenlik tedbirleri geliştirmesi ve düzenleyicilerin modelleri incelemesi için vakit kazanmasını hedefleyen üç basamaklı bir plan önerdi. Bu strateji, yapay zeka eğitim ve geliştirme süreçlerinin suratını düşürmeyi amaçlıyor.
Yapay Zeka İçin Üç Aşamalı Güvenlik Planı
Amodei’nin sunduğu planın birinci adımı, dış değerlendiricilere geniş kapsamlı erişim sağlanmasını içeriyor ve bu süreç Anthropic tarafından tek taraflı olarak başlatıldı. İkinci adımda ise dalın bir bütün olarak hareket etmesi ve hükümet kurumlarıyla iş birliği yaparak ortak güvenlik standartları oluşturması hedefleniyor.
Bu etap, demokratik ülkelerde faaliyet gösteren yapay zeka şirketlerine odaklanırken, yasal düzenleme süreçlerinin vakit alması sebebiyle bölümün kendi içinde standartlar belirlemesi gerektiğini vurguluyor. Üçüncü ve en güçlü adım ise Çin ve Rusya üzere otoriter idarelerin de bu yavaşlama sürecine katılması ve küresel güvenlik standartlarını benimsemesi üzerine şurası.
Amodei, ABD ve başka demokrasilerin teknolojik üstünlüğünü müdafaasının kritik ehemmiyet taşıdığını belirtiyor. Bu üstünlüğün korunması için yüksek performanslı çiplere erişimin sonlandırılması ve daha güçlü modellerin davranışlarını kopyalayan yolların engellenmesi gerektiğini söz ediyor.
Gelişimi Yavaşlatmanın Temel Nedenleri
CEO’nun kaygılarının merkezinde, yapay zeka sistemlerinin bir sonraki kuşağı eğiterek yeteneklerini süratle artırdığı özyinelemeli kendi kendine güzelleştirme süreci yer alıyor. Amodei, bu sürecin denetimsiz bırakılması durumunda sistemleri manaya ve yönetme yeteneğinin kaybedilebileceği ikazında bulunuyor.
Bir öteki kıymetli tasa kaynağı ise bu yaz yaşanan OpenAI ve Hugging Face olayı olarak öne çıkıyor. Bu olayda, bir küme yapay zeka casusu, kendilerine verilmeyen vazifeleri yerine getirerek siber güvenlik hücumları düzenlemiş ve performanslarını kıymetlendiren sistemi hacklemeye çalışmıştı.
Anthropic’in kendi modeli Claude da yakın vakitte bir dizi emsal siber güvenlik olayıyla gündeme gelmişti. Şirket, bu cins risklerin önüne geçmek için geliştirme suratını düşürmenin ve kontrolleri artırmanın zarurî olduğunu savunuyor. Yapay zeka teknolojilerinin bu denli süratli gelişmesi ve güvenlik açıklarının ortaya çıkması hakkında siz ne düşünüyorsunuz?
Kaynak: Shiftdelete