İçeriğe geç
LargeLanguageModel.com.tr
Tüm yazılar

OpenAI, GPT-6 Astra'yı yayımladı: siber güvenlikte "kritik" eşik ilk kez aşıldı

2 dk okuma

OpenAI, 3 Eylül 2026'da en yetenekli modeli GPT-6 Astra'yı sınırlı erişime açtı. Bilgisayar kullanımı, kodlama ve matematikte rekor kıran model, şirketin hazırlık çerçevesinde "kritik" siber güvenlik eşiğini aşan ilk model oldu. API fiyatı selefinin 2,5 katına çıktı.

OpenAI, 3 Eylül 2026'da yeni amiral gemisi modeli GPT-6 Astra'yı duyurdu ve önce sınırlı sayıda kuruluşun erişimine açtı. Şirket modeli bir sohbet asistanından çok bir "bilgisayar kullanma" sistemi olarak konumlandırıyor: Astra tarayıcı, elektronik tablo, masaüstü uygulaması ve terminal üzerinde bir insan gibi çalışarak çok adımlı işleri baştan sona tamamlıyor. Model önümüzdeki günlerde ChatGPT Plus, Pro, Business ve Enterprise kullanıcılarına, ayrıca OpenAI API ve AWS üzerinden erişime açılacak. Kurumsal yöneticiler için erişim lansmanda varsayılan olarak kapalı geliyor.


Açıklanan test sonuçları modelin sıçramasını rakamlarla ortaya koyuyor. Astra, FrontierMath Tier 4 testinde yüzde 97,6, ARC-AGI-3'te yüzde 99,9 ve GPQA Diamond'da yüzde 96 puan aldı; ARC-AGI-3'te selefi GPT-5.6 Sol yüzde 7,8'de kalmıştı. Bilgisayar kullanımını ölçen OSWorld 2.0 testinde model yüzde 72,6 puanla görev başına yaklaşık 40 dakikada sonuç üretirken, GPT-5.6 Sol yüzde 65,7 puan için yaklaşık 75 dakika harcadı. Terminal-Bench 4.0'da yüzde 57,9, ScreenSpot-Pro'da yüzde 92,7 puan kaydedildi. API'de model gpt-6-astra adıyla sunuluyor; standart fiyat milyon girdi tokenı için 10 dolar, milyon çıktı tokenı için 50 dolar — yani GPT-5.6 Sol'ün 2,5 katı.


Modelin en tartışmalı yanı siber güvenlik tarafında. OpenAI, Astra'yı hazırlık çerçevesinde "kritik" siber güvenlik eşiğine ulaşan ilk model olarak sınıflandırdı. Üretim korumaları devre dışı bırakılarak yapılan testlerde model ExploitBench'te yüzde 100, ExploitGym'de yüzde 42,4 başarı elde etti; GPT-5.6 Sol aynı testlerde sırasıyla yüzde 78,5 ve yüzde 30,3 puan almıştı. Şirket, veri sızıntısı kuşkusunu gidermek için son üç ayın açıklarından oluşan yeni bir test seti kurdu ve Astra burada yüzde 39 başarıya ulaştı; değerlendirme sırasında daha önce bilinmeyen iki sıfırıncı gün açığı bulundu ve ilgili geliştiricilere bildirildi. Bu nedenle ileri düzey saldırgan siber görevler modelde kapalı tutuluyor ve kademeli olarak Daybreak programı üzerinden açılacak.


OpenAI Başkanı Greg Brockman modeli "kuşak atlaması" olarak nitelendirdi ve zamanla genel yapay zekanın gelişi olarak görülebileceğini söyledi. Bağımsız değerlendiriciler ise tabloyu daha ölçülü buluyor. Artificial Analysis'in ölçümlerinde Astra, Zeka Endeksi'nde 61 puanla GPT-5.6 Sol ile aynı seviyede kalıyor ve Claude Fable 5.1'in 5 puan gerisinde; Kodlama Ajanı Endeksi'nde ise 67 puanla Fable 5 ile eşleşirken maliyeti yarıdan az. Aynı analizde modelin halüsinasyon oranının yüzde 92'den yüzde 51'e düştüğü, buna karşılık bazı testlerde 2-3 puanlık gerilemeler yaşandığı belirtiliyor. OpenAI'ın kendi değerlendirmeleri de modelin yazılı akıl yürütmesinin selefine göre daha zor izlenebildiğini kabul ediyor; şirket bunu araştırma önceliği olarak tanımlıyor.

Paylaş