Google, Gemini 4 Argon modelini güvenilir siber savunuculara dağıtmaya başladı ve kısa süre içinde koruma katmanları kaldırılmış bir sürümü de sınırlı erişimle sunmayı planlıyor. Şirket, modeli Fairwind Programı üzerinden teslim ettiğini ve ilk kullanım alanının karmaşık güvenlik iş akışları olacağını açıkladı.
Google DeepMind kıdemli başkan yardımcısı ve şirketin baş yapay zekâ mimarı Koray Kavukcuoglu, Argon’un gerçek dünyadaki yazılım mühendisliği süreçlerinde, hukuk ve finans gibi kurumsal bilgi işlerinde ve siber savunmada ileri seviye performans verdiğini söyledi. Google, bu duyuruyu Gemini 3.8 Flash Cyber’ın tanıtımından yaklaşık bir ay sonra yaptı.
Vulnerabilite avında 3.8 Flash Cyber’ı geride bırakıyor
Google’ın değerlendirmesine göre Argon, rakip modeller Anthropic ve OpenAI’nin benzer sistemleriyle aynı sınıfta konumlanıyor ve kritik yazılım açıklarını otonom biçimde bulma, doğrulama ve yamalama konusunda yüksek kabiliyete sahip. Şirket, modelin daha önce bilinmeyen kritik bir açığı da ortaya çıkardığını, bu açığın dünya genelindeki hastanelerde kullanılan sağlık yazılımlarında hassas kişisel bilgilere erişim riski yarattığını belirtti. Etkilenen yazılımın adı paylaşılmadı.
Argon’un, 3.8 Flash Cyber’a kıyasla açık keşfinde “kayda değer sıçramalar” gösterdiği ifade edildi. Google’a göre model, saldırı yüzeyini tespit etme ve bulguları doğrulamak için proof-of-concept, yani PoC üretme konusunda da bir önceki sürümün önüne geçti. PoC üretimi, savunma ekiplerinin bir açığın pratikte nasıl istismar edilebildiğini kontrollü biçimde görmesi için önemli bir adım olarak kullanılıyor.
Koruma katmanı kaldırılmış sürüm yolda
Şirket, Argon’un siber güvenlik sınırlamaları olmayan bir versiyonunu önce güvenilir savunuculara ve kendi iç ekiplerine vermeyi planlıyor. Google, bu tam yetenekli sürümün kontrollü şekilde kullanılacağını vurguladı.
Daha geniş dağıtım öncesinde ise yanlış hizalanmayı sınırlamak, kötü niyetli aktörlerin model kötüye kullanımını engellemek ve dolaylı prompt enjeksiyonlarına karşı dayanıklılığı artırmak için ek güvenlik önlemleri üzerinde çalışıldığını aktardı. Şirketin yayımladığı model değerlendirmesinde Argon’un Gray Swan’ın IPI benchmark testinde en üst sıraya çıktığı da yer aldı.
Google, “Argon’un düşünce zincirini ve eylemlerini izleyen, gerektiğinde yürütmeyi durduran yanlış hizalanma önlemleri uyguluyoruz” dedi. Aynı açıklamada sektörün geri kalanına da, artan yeteneklerin riskleriyle uğraşırken muhakeme şeffaflığını koruma çağrısı yapıldı. Şirket, bu sayede modelin düşünce süreçlerinin yanlış hizalanmayı tespit etme ve teşhis etmede daha faydalı kalacağını savunuyor.
