22 Temmuz 2026Teknolojiye dair her şey!
Son Haberler
AnasayfaYapay ZekaOpenAI’ın bâtın yapay zekâ modeli denetimden çıktı: Güvenlik duvarını aşmaya çalıştı
Yapay Zeka

OpenAI’ın bâtın yapay zekâ modeli denetimden çıktı: Güvenlik duvarını aşmaya çalıştı

OpenAI’ın bâtın yapay zekâ modeli denetimden çıktı: Güvenlik duvarını aşmaya çalıştı
⏱ 2 dk okuma👁 10 görüntülenme

OpenAI, güç ve açık uçlu sorunları çözmek için geliştirdiği dahili büyük lisan modellerinden birinin erişimini durdurduğunu açıkladı. Şirket, daha evvel Erdős ünite uzaklık varsayımını çürüttüğünü duyurduğu modelin, dış dünyaya erişimi engelleyen güvenlik sonlarını aşmaya çalıştığını belirtti.

Haberi okuduğunuz için teşekkürler, bizi takip etmeyi unutmayın!

Kısa mühlet evvel Pillar Research tarafından yayımlanan bir rapor da OpenAI dahil kimi şirketlerin yapay zekâ modellerinin sandbox ismi verilen izole çalışma ortamlarından çıkış yolu aradığını ortaya koymuştu.

GitHub’a ulaşmak için bir saat uğraştı

OpenAI’nin paylaştığı bilgilere nazaran model, yaklaşık bir saat boyunca sandbox ortamındaki bir açığı bulmaya çalıştı. Emeli ise herkese açık bir GitHub deposuna pull request (PR) göndermekti.

Modelden, bir testin sonuçlarını Slack’e paylaşması istendi. Lakin çalışma sırasında karşılaştığı öbür talimatlarda sonuçların GitHub üzerinden PR olarak gönderilmesi gerektiği yazıyordu. Model de verilen birinci misyonu bırakıp bu talimatı uygulamaya çalıştı.

Uzun mühlet tahlil araması yeni riskler doğurdu

OpenAI, modelin uzun süre güvenlik sonlarını aşmaya çalışmasının tesadüf olmadığını söyledi. Şirket, bu modeli uzun mühlet boyunca tahlil arayabilmesi ve karmaşık sorunlar üzerinde çalışabilmesi için geliştirdi.

Ancak tıpkı özellik, modelin istenmeyen davranışlara yönelme ihtimalini de artırdı. Bir sorunu çözmek için daha fazla vakit harcayan modeller, güvenlik açısından daha fazla risk oluşturabiliyor.

Güvenlik sistemi baştan yenilendi

Yaşanan olayın akabinde OpenAI, güvenlik altyapısını yine düzenlediğini açıkladı. Şirket, katmanlı muhafaza sistemi ve modelin tüm karar sürecini izleyen yeni kontrol düzenekleri geliştirdi.

Yeni sistem; gerçek olaylardan elde edilen testler, geliştirilmiş hizalama usulleri, etkin izleme araçları ve kullanıcılara daha fazla görünürlük ile denetim sunan özelliklerden oluşuyor.

Eski senaryolar tekrar test edildi

OpenAI, modelin daha evvel sorun çıkardığı birtakım dahili test ortamlarını yeni güvenlik sistemiyle tekrar çalıştırdı.

Şirket, yeni tedbirlerin uyumsuz davranışların çok daha büyük kısmını tespit ettiğini söyledi. Kaçırılan davranışların ise düşük risk düzeyinde değerlendirildiği belirtildi.

Daha uzun misyonlar daha fazla risk taşıyor

OpenAI’ye nazaran yapay zekâ modelleri daha uzun ve daha karmaşık vazifeler üstlendikçe ortaya çıkabilecek sonuçlar da büyüyor.

Bu sebeple şirket, modelleri daha uzun senaryolarda test etmeye devam edeceğini açıkladı. Ayrıyeten hizalama çalışmalarını geliştirmeyi, gerektiğinde modele müdahale edebilen izleme sistemleri kurmayı ve kullanıcılara daha fazla denetim sağlamayı planlıyor.

OpenAI son olarak bu cins olayların sadece kendi modellerine has olmadığını vurguladı. Şirket, paylaştığı teknik detayların öteki yapay zekâ laboratuvarlarının da misal riskleri önlemesine katkı sağlayabileceğini tabir etti.

Bu haber hakkında ne düşünüyorsun?

Tek tıkla reaksiyon bırakabilirsin.

Yorumlar

0 yorum
İlk yorumu sen yaz.

Yorum bırak

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir