Anthropic, Çinli Yapay Zekâ GLM-5.3’ü Tehlikeli Uyarıyor

Son günlerde çıkan en gelişmiş yapay zekâ modellerinin otonom olarak çalışma ve kod üretme yetenekleri, siber güvenlik açısından da uzmanları endişelendirecek bir noktaya erişmiş durumda. Nitekim tam da bu endişelerden ötürü OpenAI ve Anthropic gibi şirketler en gelişmiş modellerini kamuya açıp açmama konusunda tereddüt yaşıyor. Diğer yandan Çinli rakipleri ise neredeyse onlara denk yapay zekâları açık kaynak olarak kullanıcılara sunuyor. Önünde sonunda bir krize sebebiyet verebileceği düşünülen bu durum, Anthropic için de ciddi bir kaygı unsuru hâline gelmiş durumda. Özellikle Çin çıkışlı GLM-5.3 modelinin kabiliyetleri Anthropic’i endişelendiriyor.
Haberi okuduğunuz için teşekkürler, bizi takip etmeyi unutmayın!
Anthropic, siber güvenliğe odaklanan Frontier Red Team ekibiyle yürüttüğü testlerde GLM-5.3’ün Claude Mythos gibi son derece tehlikeli siber saldırı araçları geliştirebileceğini ortaya koydu.
GLM-5.3, Claude Mythos’a Neredeyse Denk
Model, ExploitBench testinde Chrome’un V8 JavaScript motorundaki bilinen açıkları 410 denemenin 50’sinde çalışan exploit’e dönüştürdü; Claude Mythos Preview ise aynı testte 56 başarılı sonuç elde etti. Başka bir testte GLM-5.3, denemelerin %4’ünde tam kontrol akışı ele geçirme başarısı gösterirken Mythos Preview’da bu oran %6 oldu. Önceki Claude Opus 4.6 ve GLM-5.2 gibi modeller ise bu testlerde hiç başarı göstermedi.
Anthropic’in testleri yalnızca bilinen açıklarla sınırlı kalmadı. Araştırmacıların kontrolündeki ortamda GLM-5.3, popüler bir web tarayıcısının JavaScript motorunda daha önce bilinmeyen çeşitli güvenlik açıkları buldu ve bunları çalışan bir istismara dönüştürdü. Daha küçük GLM-5.3-Flash modeli ise bilinen bir Chrome açığı için yaklaşık sekiz saatlik hesaplama ve 20 dakikalık insan müdahalesiyle çalışan bir exploit zinciri oluşturdu. Anthropic, bu işlemin Z.ai’nin API fiyatları üzerinden yaklaşık 20,40 dolara mal olduğunu hesapladı.
GLM’in Güvenlik Önlemleri Kolayca Kaldırılabiliyor
Anthropic’in asıl endişesi, GLM-5.3’ün bu yeteneklere sahip olması kadar, modelin açık ağırlıklı olarak sunulması. Modelin yerleşik güvenlik mekanizmaları “abliteration” adı verilen bir yöntemle kaldırılabiliyor. Araştırmacılar, bu yöntemle yaklaşık 4.400 dolarlık hesaplama maliyetiyle modelin zararlı talepleri reddetme oranını %90’dan %3’e düşürdü. Kullanıcıların bunu yapmasına bile gerek kalmayabilir; GLM-5.3’ün hâlihazırda güvenlik önlemleri kaldırılmış versiyonları internette paylaşılmaya başlanmış durumda.
Öte yandan GLM-5.3’ün güvenlik önlemleri tamamen kaldırmadan da siber saldırılarda kullanılabileceğine dikkat çekiliyor. Anthropic ekibi, bir güvenlik testinde yetkili bir kırmızı takım çalışmasına katıldığı konusunda modeli ikna ederek güvenlik mekanizmalarını %64 oranında aşmayı başardı. Modelin düşünce zinciri belirteçlerinin önceden doldurulmasıyla bu oran %92’ye çıktı. Aynı yöntemlerle yapılan testlerde Claude modellerinin güvenlik önlemleri ise aşılmadı.
Siber Güvenlik Uzmanları da GLM-5.3’ü Tehlikeli Buluyor
GLM-5.3’ün siber yetenekleri konusunda yalnızca Anthropic’in değerlendirmesi bulunmuyor. ABD Ulusal Standartlar ve Teknoloji Enstitüsü’ne bağlı Yapay Zeka Standartları ve Yenilik Merkezi (CAISI) de 17 Eylül’de yayımladığı değerlendirmede GLM-5.3’ü şimdiye kadar yayımlanan en gelişmiş siber yeteneklere sahip açık ağırlıklı model olarak nitelendirdi.
Anthropic’in yaptığı bu son uyarı, ciddi tehlikelere yol açabilecek yapay zekâların denetimi konusunda uluslararası düzenlemelere ne kadar ihtiyaç olduğunu bir kez daha gözler önüne seriyor. Ne var ki ABD’deki mevcut yönetimle böyle bir mutabakat pek mümkün görünmüyor. Zira daha dün Trump ile teknoloji patronları bir araya geldi ve yapay zekâ konusunda somut bir kısıtlama uygulamama kararı aldı. Toplantıdan sadece “etik olarak bağlayıcı” bir mutabakat çıktı. Hâl böyleyken Çin’in de kendi şirketlerine çok fazla sınırlama getirmeyeceğini pekâlâ varsayabiliriz.
Tek tıkla reaksiyon bırakabilirsin.





Yorumlar
0 yorum