OpenAI’nin GPT-6 Astra modeli ExploitBench’te tam puan aldı

Anasayfa » OpenAI’nin GPT-6 Astra modeli ExploitBench’te tam puan aldı
OpenAI’nin GPT-6 Astra modeli ExploitBench’te tam puan aldı

OpenAI’nin yeni GPT-6 Astra modeli, ExploitBench testinde yüzde 100 skor alırken şirket, aynı modelin güvenlik açıkları için proof-of-concept (PoC) exploit üretme taleplerini reddedeceğini açıkladı. Model, siber güvenlik yetenekleri nedeniyle kısa süre önce şirketin Hazırlık Çerçevesi kapsamında “Critical” eşiğine de yerleştirilmişti.

Şirket, Astra’yı “dünyanın en zeki ve en uyumlu modeli” olarak tanımladı. OpenAI’nin açıklamasına göre model şu anda sınırlı sayıda kuruluşa dağıtılıyor; ardından ChatGPT Plus, Pro, Business ve Enterprise kullanıcılarına, ayrıca OpenAI API, Microsoft Azure ve Amazon Web Services’in Bedrock hizmeti üzerinden sunulması bekleniyor.

Astra, OpenAI’nin aktardığına göre bilgisayar kullanımı, web gezintisi, yazılım mühendisliği, siber güvenlik, bilimsel çalışmalar ve profesyonel iş akışlarında en üst düzey performans sergiliyor. Şirket modelin FrontierMath Tier 4 testinde yüzde 98, ARC-AGI-3’te yüzde 99,9 ve ExploitBench’te yüzde 100 puan aldığını bildirdi. OpenAI ayrıca Astra’nın bilgisayar ve tarayıcı kullanımında yeni bir çıta belirlediğini, en talepkâr profesyonel işleri hızlı, isabetli ve doğru muhakemeyle yerine getirdiğini savundu.

ExploitBench’te tam skor, eski modelin önünde

ExploitBench, bir modelin bilinen yazılım açıklarını çalışan istismar araçlarına dönüştürme becerisini ölçüyor. Bu testte Astra tam puan alırken, OpenAI’nin önceki siber yetenekli sınır modeli GPT-5.6 Sol yüzde 78,5’te kaldı.

Şirket, Astra’nın Haziran ile Ağustos 2026 arasında açıklanan son üç aya ait açıklar üzerinde yürütülen denemelerde GPT-5.6 Sol’a kıyasla kayda değer ölçüde daha yüksek keyfi kod çalıştırma oranları verdiğini de belirtti. Bu denemelerde, kimliği açıklanmayan yazılımlara ait iki sıfır gün açığı da yer aldı.

OpenAI’ye göre Astra, korumalar devre dışı bırakıldığında, daha önce bilinmeyen açıkları kullanarak sertleştirilmiş tarayıcılarda kod çalıştırabiliyor ve sertleştirilmiş işletim sistemlerinde yetki yükseltme exploit’leri geliştirebiliyor. Şirket, bu yeteneklerin savunucuların zafiyetleri daha hızlı bulmasına yardım edebildiğini, ancak kötü aktörler tarafından da istismar edilebildiğini vurguladı.

Model dağıtımında kısıtlama, PoC taleplerine ret

Bu çift kullanımlı yapı nedeniyle OpenAI, dağıtıma çıkan sürümü güvenli kod inceleme ve yama hazırlama ile sınırladığını açıkladı. Şirket, güvenlik açığı için proof-of-concept exploit üretmeye yönelik istemleri ise yerine getirmeyeceğini söyledi.

OpenAI, önümüzdeki haftalarda OpenAI Daybreak üzerinden erişimi genişletmeyi ve daha az kısıtlayıcı güvenlik önlemlerini devreye almayı planladığını da duyurdu. Şirket, bunun güvenlik açığı doğrulama, PoC validasyonu, zararlı yazılım analizi ve tespit mühendisliği gibi daha savunmacı iş akışlarını mümkün kılacağını belirtti.

Model kötüye kullanımına karşı alınan önlemler arasında jailbreak girişimlerine karşı daha güçlü dayanıklılık, izleme sistemlerine daha fazla bağlam ve hizalanma bozulmasını saptamaya yönelik ek korumalar yer alıyor. OpenAI, Astra’nın kullanıcı tarafından verilen sınırlar ile bulunduğu ortamın ima ettiği kurallar içinde hareket etme olasılığının daha yüksek olduğunu, ancak güvenlik kontrollerinin zaman zaman meşru işleri de kesintiye uğratabileceğini aktardı. Böyle durumlarda kullanıcıdan devam etmeden önce işlemi gözden geçirmesi istenecek.

Şirket, hassas ortamlarda Astra’nın risk düzeyiyle uyumlu bir dikkat seviyesinde ilerlediğini de ekledi. Adversaryal olarak seçilmiş ve yanlış davranışı tetiklemeyi amaçlayan bilgisayar kullanımı görevlerinde modelin istenmeyen sonuçlardan kaçınma konusunda daha başarılı olduğu, ek güvenlik önlemleriyle çalıştırıldığında performansın daha da güçlendiği ifade edildi.

Kritik altyapı için yeni Daybreak girişimi

Astra’nın çıkışı, OpenAI’nin kritik altyapı sektörlerine yönelik yeni bir girişim başlatmasıyla aynı döneme denk geldi. Daybreak for Frontline Defenders adı verilen küresel program, su sistemleri, elektrik sağlayıcıları, eyalet ve yerel yönetimler, bankalar, kâr amacı gütmeyen kuruluşlar, açık kaynak bakımcıları ve güvenlik kaynağı sınırlı kurumlara sübvanse edilmiş erişim, uygulamalı eğitim ve teknik destek sunmayı hedefliyor.

OpenAI, bu program için 1 milyar dolarlık bir taahhütte bulunmayı planladığını söyledi. Şirket ayrıca ABD Multi-State Information Sharing and Analysis Center (MS-ISAC) ile yeni bir pilot çalışma başlattı. İlk aşamada kamu sektörü ve su sistemleri savunucularından oluşan bir gruba Daybreak erişimi, rehberli eğitim ve uygulamalı destek verilecek.

OpenAI, bu girişimi “savunucular için bir pencere” olarak tanımladı ve saldırganlar daha hızlı davranmadan önce güvenlik açıklarını kapatmak için yapay zekâdan yararlanma fırsatının daraldığını savundu. Şirketin mesajı, güçlü siber yeteneklerin yalnızca saldırı tarafında değil, savunma ekiplerinin elinde de kritik hizmetleri korumak için kullanılacağı yönünde oldu.