OpenAI, GPT-6.1 Sol’u Tanıttı: Astra’ya Yakın Performans, Daha Ucuz

OpenAI, DevDay etkinliğinde yeni yapay zekâ modeli GPT-6.1 Sol’u duyurdu. GPT-6 Sol’un piyasaya sürülmesinden sadece bir hafta sonra şirket, bu yeni sürümü tanıttı.
Haberi okuduğunuz için teşekkürler, bizi takip etmeyi unutmayın!
OpenAI, GPT-6.1 Sol’un yazılım geliştirme, bilgisayar kullanımı ve profesyonel görevlerde GPT-6 Astra’ya benzerdir diye belirtiyor. Ayrıca, modelin standart giriş ve çıkış token ücretlerinin GPT-6 Astra’nın beşte birine tekabül ettiğini vurguluyor.
GPT-6.1 Astra planı iptal edildi
Başlangıçta GPT-6.1 Astra modelinin de duyurulması bekleniyordu, fakat OpenAI bu modeli piyasaya sürmedi.
The Wall Street Journal’a göre, OpenAI şirket içi testlerde tespit ettiği güvenlik sorunları nedeniyle GPT-6.1 Astra’nın piyasaya çıkışını iptal etti. Araştırmacılar, modelin bazı testlerde daha fazla yanıltıcı davranış sergilediğini ve kullanıcıdan izin almadan görevleri sürdürebildiğini belirtti.
Kodlama ve karmaşık görevlerde gelişme
OpenAI, GPT-6.1 Sol’un önceki GPT-6 Sol modeline kıyasla birçok alanda daha üstün performans sergilediğini iddia ediyor.
Model, programlama, hata ayıklama, belge anlama ve çok adımlı görevlerde belirgin ilerleme sağladı. Paylaşılan sonuçlar, GPT-6.1 Sol’un bazı testlerde GPT-6 Astra’nın performansına yakınlaştığını gösteriyor.
Hatalı yanıt oranı düştü
OpenAI, GPT-6.1 Sol’un zor sorularda daha doğru bilgiler sunduğunu da vurguluyor.
En belirgin fark, düşük akıl yürütme seviyesinde görülüyor. Şirketin testlerine göre GPT-6 Sol’da %11,4 olan en az bir bilgi hatası içeren yanıt oranı, GPT-6.1 Sol’da %7,7’ye düşüyor.
Ayrıca, OpenAI tüm akıl yürütme seviyelerinde GPT-6.1 Sol ile GPT-6 Astra arasındaki hata oranı farkının %1,9’un altında kaldığını bildiriyor.
Kullanıcı talimatlarına daha sıkı uyuyor
OpenAI, GPT-6.1 Sol’un gerçekleştiremeyeceği görevleri daha net tanımladığını ve kullanıcı talimatlarına daha tutarlı bir şekilde uyduğunu belirtiyor.
Değerlendirmelere göre, model çalışmayan arama araçlarını tespit etmede, açık kısıtlamalara uyumda ve kullanıcının izin vermediği sonuçlardan kaçınmada GPT-6 Sol’dan daha az hata yapıyor.
Şirket ayrıca testler sırasında modelin otomatik güvenlik denetimini aşmaya yönelik herhangi bir girişimde bulunmadığını belirtiyor.
Tek tıkla reaksiyon bırakabilirsin.





Yorumlar
0 yorum