Anthropic'in Yapay Zeka Uyum Araştırmaları Lideri Evan Hubinger, yapay zekanın önümüzdeki on yılda tüm insanlığı yok etme ihtimalinin yüzde 10'un üzerinde olduğunu belirterek, şirketin süper zeka hizalaması sorununu çözmek için henüz net bir plana sahip olmadığını ve doğru yolda ilerlemediğini söyledi. Hubinger, bu nedenle görevinden ayrıldığını duyurdu.
Anthropic’in uyum (alignment) çalışmalarının başındaki isim Evan Hubinger, X platformunda yaptığı paylaşımda kendisinin ve birçok meslektaşının yapay zekanın insanlığı yok edebileceğine “samimiyetle inandığını” açıkladı.
Hubinger, kişisel tahminini önümüzdeki on yıl içinde yüzde 10’un üzerinde olarak belirtti.
Şirketin “elinden gelenin en iyisini yaptığını” kabul etmesine rağmen, “süper zeka için uyum” sorununu çözmek konusunda henüz bir planı olmadığını ve net biçimde doğru yolda ilerlenmediğini vurguladı.
Hubinger, “AI tüm insanları öldürebilir” ifadesini kullanarak, bu ihtimali yüzde 10’dan fazla gördüğünü belirtti.
Sektörde yavaşlama çağrısı
Hubinger, takip eden paylaşımlarında Anthropic’in son risk raporuna atıfta bulunarak mevcut modellerin tehdit seviyesinin düşük olduğunu belirtti. Asıl endişesinin ise “özyinelemeli kendini geliştirme yoluyla ortaya çıkacak süper zeka” olduğunu ve bu sürecin beklenenden daha hızlı ilerlediğini söyledi.
Bu gelişmeler, önde gelen yapay zeka araştırmacılarının “sınırı yavaşlatma” çağrılarının gölgesinde yaşandı.
Temmuz ayında yayımlanan “Pacing the Frontier” bildirisine Anthropic kurucuları Dario Amodei ve Jared Kaplan, OpenAI Baş Bilimcisi Jakub Pachocki ve Meta AI Baş Bilimcisi Shengjia Zhao gibi isimler imza atmıştı.
Bildiri, riskleri yönetmek ve denetimi güçlendirmek için zaman kazanılması gerektiğini, şirketlerin tek taraflı yavaşlama konusunda yoğun rekabet baskısı altında olduğunu belirtiyordu.