Google, uzun ve karmaşık görevler için geliştirilen yeni yapay zekâ modeli Gemini 4 Argon’u duyurdu. Model; yazılım geliştirme, finans ve hukuk gibi kurumsal iş akışları ile siber güvenlik alanlarında yüksek performans sunacak şekilde tasarlandı.
Gemini 4 Argon, Şimdilik Yalnızca Seçilmiş Siber Güvenlik Uzmanlarına Sunuluyor
Gemini 4 Argon’un öne çıkan özelliklerinden biri, 1 milyon token’lık çıktı sınırı oldu. Google, önceki 64 bin token seviyesinden önemli ölçüde artırılan bu kapasitenin, modelin yüz binlerce token boyunca kesintisiz şekilde akıl yürütmesine ve daha uzun görevleri tek bir işlem akışı içerisinde tamamlamasına olanak sağladığını belirtiyor. Model, Google’ın kendi bünyesindeki ekipler tarafından da kullanılmaya başlandı. Şirketin verdiği örneklere göre Gemini 4 Argon; hata ayıklama, araştırma, kodlama ve algoritma tasarımı gibi görevlerin yanı sıra büyük ölçekli kod tabanı dönüşümlerinde kullanılıyor.
Kuantum bilgisayar araştırmalarında da kullanılan modelin, bazı algoritmaların kaynak kullanımını optimize ettiği ve belirli bir örnekte yayınlanmış temel performans değerini dakikalar içerisinde yüzde 40 oranında iyileştirdiği ifade edildi. Gemini 4 Argon, ayrıca gerçek dünya yazılım mühendisliği görevlerini değerlendiren DeepSWE v1.1 testinde yüzde 77.9 puan alarak yeni bir seviyeye ulaştı.
Gemini 4 Argon, Güvenlik Açıklarını Bulup Düzeltebiliyor
Google, Gemini 4 Argon’u özellikle savunma amaçlı siber güvenlik görevlerinde yüksek yetenekli olacak şekilde eğittiğini söylüyor. Model, yazılımlardaki kritik güvenlik açıklarını otonom şekilde tespit edebiliyor, doğrulayabiliyor ve bunları giderecek yamalar hazırlayabiliyor. Model, ilk olarak seçilmiş siber güvenlik uzmanları ve Google’ın şirket içindeki ekipleri için siber güvenlik kısıtlamaları olmadan sunuluyor. Modelin geniş çapta kullanıma sunulmasından önce güvenlik önlemleri geliştirilmeye devam ediyor. Google, özellikle kötüye kullanım, prompt injection saldırıları, modelin amaç dışına çıkması ve çalışma ortamlarının güvenliği olmak üzere dört alana odaklanıyor.
Paylaşılan erken test sonuçlarına göre Gemini 4 Argon, hastanelerde kullanılan sağlık yazılımlarında hassas kişisel bilgileri açığa çıkarabilecek kritik bir güvenlik açığını tespit etti. Modelin daha önceki öncü yapay zekâ modellerinin gözden kaçırdığı belirtilen bu açığı belirleyerek riskin giderilmesine yardımcı olduğu öne sürülüyor. Gemini 4 Argon, güvenlik açıklarının giderilmesini ölçen CWE-bench v1 testinde yüzde 68 puanla en yüksek dereceyi paylaşıyor.
Google, ilk aşamada ücretli API müşterileri ve Google AI Ultra abonelerine erişim sağlamayı planlıyor. Gemini 4 Argon için API fiyatlandırması giriş aşamasında 1 milyon giriş token’ı başına 2 dolar, 1 milyon çıkış token’ı başına ise 10 dolar olarak belirlenmiş durumda.
Kaynak: Google
