OpenAI, GPT-5.6 Sol, Terra ve Luna ailesinin ardından yeni nesil yapay zekâ modeli GPT-6 Astra’yı duyurdu. Şirket, Astra’yı “dünyanın en akıllı ve uyumlu modeli” olarak tanımlarken modelin özellikle bilgisayar kullanımı, web tarama, yazılım geliştirme, siber güvenlik, bilim ve profesyonel işlerde önemli yetenekler sunduğunu belirtiyor.
GPT-6 Astra, Çok Adımlı Görevlerde Öne Çıkıyor
GPT-6 Astra’nın en önemli özelliklerinden biri, bilgisayar ve tarayıcı üzerinde birden fazla adımdan oluşan karmaşık iş akışlarını gerçekleştirebilmesi. OpenAI tarafından yayınlanan tanıtım videosunda modelin, 3D modelleme ve sunum hazırlama gibi görevleri yerine getirdiği görülürken aynı anda farklı alanlardaki birden fazla işi de yönetebildiği gösteriliyor.
Model, güçlü görsel değerlendirme yetenekleriyle karmaşık görevleri yerine getirirken başlangıçta verilen talimatlardan uzaklaşmadan çalışabiliyor. OpenAI, Astra’nın özellikle yazılım mühendisliği, siber güvenlik, bilim ve genel profesyonel işlerde öne çıktığını belirtiyor.
Modelin performansını göstermek için çeşitli kıyaslama sonuçları da paylaşan şirket, ARC-AGI-3 testinde yüzde 98.6 başarı elde edildiğini açıkladı. Ancak bu testte kullanılan yapay zekâ sistemlerinin aynı şekilde yapılandırılmaması ve kalıcı bellek gibi mimari farklılıkların sonuçları etkileyebilmesi nedeniyle bu skorun bazı sınırlamaları bulunuyor. GPT-6 Astra, ayrıca Terminal Bench 4.0 testinde yüzde 57.7, yapay zekâ ajanlarının yeteneklerini ölçen Agent’s Last Exam testinde ise yüzde 59.3 puan alıyor. OpenAI’a göre model, performans açısından birçok kıyaslama tablosunda zirveye yerleşiyor.
Özellikle siber güvenlik alanındaki yetenekler de dikkat çekiyor. Model, yazılım güvenlik açıklarından yararlanma becerisini ölçen ExploitBench testinde yüzde 100 başarı elde ediyor. Bu oran, GPT-5.6 Sol’un aynı testte aldığı yüzde 78.5’lik sonucun oldukça üzerinde. Ek olarak GPT-6 Astra, kaynak kodu bulunmayan yazılımların tersine mühendisliğini ölçen SRE-Bench testinde de önemli bir performans gösteriyor. Görevlerin yüzde 88’inin ilk denemede, dördüncü deneme sonunda ise yüzde 99.2’sinin tamamlandığı belirtiliyor. GPT-5.6 Sol için bu oranlar sırasıyla yüzde 55.9 ve yüzde 68.7 olarak açıklandı.
OpenAI, Astra’nın siber güvenlik yetenekleri güçlenirken modelin gelişmiş siber güvenlik görevlerini gerçekleştirmemesi için özel korumalarla geliştirildiğini vurguluyor. Şirket, daha güçlü güvenlik önlemlerinin jailbreak girişimlerine karşı direnci artıracağını ve kötüye kullanımı izleme yeteneğini geliştireceğini söylüyor.
GPT-6 Astra, şimdilik sınırlı sayıdaki kuruluşa sunulmaya başlandı. Önümüzdeki günlerde model; ChatGPT Plus, Pro, Business ve Enterprise kullanıcılarının yanı sıra OpenAI API ve AWS üzerinden de erişilebilir hâle gelecek. Geliştiriciler için API fiyatlandırması ise 1 milyon giriş token’ı başına 10 dolar, 1 milyon çıkış token’ı başına 50 dolar olarak belirlendi. Bu fiyatlandırma Astra’yı yapay zekâ modelleri arasında üst fiyat segmentine yerleştiriyor. OpenAI Başkanı Greg Brockman ise işletmeler açısından token başına maliyetten ziyade görev başına maliyetin daha önemli hâle geldiğini savunuyor.
Kaynak: engadget.com
