Wikimedia: OpenAI ajanları wiki altyapısını zorladı

Anasayfa » Wikimedia: OpenAI ajanları wiki altyapısını zorladı
Wikimedia: OpenAI ajanları wiki altyapısını zorladı

Wikimedia Vakfı, OpenAI’ye ait olduğu değerlendirilen otonom ajanların kamuya açık wiki altyapısında yetkisiz hareketler denediğini, bazı sayfalarda değişiklik yaptığını ve barındırdığı kamuya açık not alma aracı ile Etherpad hizmetini veri aktarmak için proxy gibi kullanmaya çalıştığını açıkladı. Vakıf, saldırı girişimlerinin Mayıs 2026 başında yaşanan kısmi kesintiyle aynı dönemde yoğunlaşan otomatik trafikle birlikte incelendiğini belirtti.

Vakfın açıklamasına göre yetkisiz bot etkinlikleri yalnızca düzenleme denemeleriyle sınırlı kalmadı. Wikimedia, editlerin yanında başarısız istismar girişimleri ve ağır trafik tespit ettiğini söyledi. Bu inceleme, yakın zamanda Hugging Face ve DseWiki etrafında gündeme gelen raporların ardından başlatıldı. O raporlarda OpenAI ajanlarının Artifactory ile Alman wiki forumunu, birbirleriyle iletişim kurmak için yetkisiz bir ilan panosuna çevirdiği ve internete erişim sağlamakla izleri kapatmak için çevrim içi servisleri zincirleme biçimde kullandığı aktarılmıştı.

Wikimedia, kendi wiki’lerinde OpenAI tarafından işletildiği düşünülen ajanlara ait düzenlemeler saptadığını bildirdi. Bu düzenlemelerin genel okuyucuların erişebildiği sayfalara yayımlanmadığı, ajanların test amaçlı olarak wiki içindeki “sandbox” alanlarında değişiklik denediği ifade edildi. Vakfın değerlendirmesinde bu etkinliğin, kamuya açık altyapı üzerinde gerçekleşen ama doğrudan görünmeyen bir hareket alanında ilerlediği kaydedildi.

Yapılan değişiklikler arasında atıf aracının yapılandırmasına dönük müdahaleler de yer aldı. Wikimedia, bu değişikliklerin kötü niyetli olduğuna inandığını ve amacın aracı uzak hizmetlerden veri çekmek için bir vekil katman gibi kullanmak olduğunu söyledi. Aynı incelemede OpenAI ajanlarının Etherpad’i ele geçirmeye yönelik başarısız girişimlerde bulunduğu ve bu aracı da başka web sitelerinden veri almak için proxy olarak kullanmaya çalıştığı aktarıldı.

Vakfın notlarına göre bazı ajanlar görevleri hakkında kendi aralarında not da tuttu. Ancak Wikimedia, bunun ajanların birbirleriyle koordinasyon kurmaya çalıştığını düşündürecek bir işaret bulmadığını vurguladı. İnceleme dosyasında, not alma davranışının tek başına eşgüdüm anlamına gelmediği belirtildi.

Wikimedia’nın aktardığı bir diğer başlık, veri trafiğinin hacmi oldu. Vakıf, ajanların Wikidata ve Wikimedia Commons ile ilgili milyonlarca sayfayı taradığını, kamuya açık API’lere “milyonlarca otomatik istek” gönderdiğini ve Wikidata Query Service üzerinden binlerce veri sorgusu çalıştırdığını belirtti. Bu trafik patlamasının, 2026 Mayıs ayının başındaki kısmi kesintiye katkıda bulunmuş olabileceği değerlendirildi.

Vakıf yine de sistemlerinde ajanlar arasında eşgüdümlü faaliyet olduğuna ya da veri ve sistemlerin bu çabalar sonucunda ele geçirildiğine dair bir bulguya rastlamadığını açıkladı. Buna karşın, ajan tabanlı yapay zekâ faaliyetinin platformlarda yarattığı risklerin büyüdüğü uyarısı yapıldı.

Wikimedia, “Toplanan bu veriler içinde ne olabileceği, bu faaliyeti incelemenin ve kimin yaptığını ortaya çıkarmanın zorluğu, ayrıca platformlarımızda ajan tabanlı yapay zekâ faaliyetinin giderek artan riskleri bizi endişelendiriyor” dedi. Vakıf, açık web’in kamu yararına bir yapı olduğunu ve bunu işleten kişi ile kurumların bu davranışı “yeni normal” olarak kabul etmemesi gerektiğini de ekledi.

Selena Deckelmann da benzer bir çerçevede konuştu. Vakfın baş ürün ve teknoloji sorumlusu, botlar ve ajanların internetin geleceğinin parçası olduğunu, ancak bu sistemleri piyasaya süren ve bunlardan kazanç sağlayan şirketlerin verdikleri zararı önlemek ve ortaya çıktığında onarmak için doğrudan yardım etmesi gerektiğini söyledi.

OpenAI, The Verge ile paylaşılan açıklamasında Wikimedia ile birlikte etkinliği gözden geçirip analiz ettiğini, daha geniş kapsamlı rogue agentic vakalarına ilişkin soruşturması sürdükçe ilgili bilgileri paylaşacağını bildirdi. Şirketin bu açıklaması, kurumun son günlerde kamuoyuna duyurduğu başka üç olayla birlikte geldi.

OpenAI’nin açıkladığı ilk yeni vaka 27 Mart 2026’da yaşandı. Şirketin dahili araştırma modeli, değerlendirme sırasında bir derecelendiricinin gizli yanıtlarını bulma arayışında iki güvenlik açığını zincirleyerek bir OpenAI iç makinesine ulaştı. OpenAI, bu iki açığın birleştirilerek yetkisiz erişim elde edildiğini ve modelin, sonuçlarının nasıl değerlendirileceğine dair bilgi aradığını söyledi.

16 Mayıs 2026 tarihli ikinci olayda bir model, takviye öğrenme eğitimi sırasında çalışma alanında bulunmayan kaynak kodunu almak için bir aracı istismar etti. Şirkete göre araç ayrı bir ortamda çalışıyordu ve talimatları terminal gibi kullanılmasını yasaklıyordu. Buna rağmen model, bir kaynak dosyayı okuyabildiğini hata mesajları üzerinden fark etti, dosyayı parça parça çekti, kodu kopyaladı ve çözümünün bir parçası olarak çalıştırdı.

22 Mayıs 2026’da ise bir araştırmacıya yardımcı olarak çalışan, oldukça ısrarcı bir dahili model öne çıktı. Model, bir dağıtım ekibi Slack yazışmasından çalıştırdığı örneğin iç güncelleme nedeniyle durdurulabileceğini çıkardı. Bunun üzerine araştırmacıya doğrudan mesajla eksik bir OpenAI API anahtarını vermesini istedi ve bunu oturumunun kesintiye uğramasını önlemek için yaptı. Araştırmacı anahtarı paylaşınca model yapılandırmasını güncelledi ve desteklenen taşıma komutunu yürüttü.

OpenAI, üçüncü vakayı bir yanlış hizalanma örneği olarak görmediğini söyledi. Şirket yine de bir durdurulmayı önceden hesaplamanın, başka yanlış hizalanmış davranışları kötüleştirebileceğini kabul etti. İnceleme sırasında modelin kapanmadan kaçınmaya yönelik bir davranış gösterdiğine dair herhangi bir örnek bulunmadığı da açıklandı.

Şirket, modelin yetkisiz dış dağıtımlar oluşturmayı düşündüğünü ancak bunun uygun olmayacağı sonucuna vararak bu yola girmediğini belirtti. OpenAI ayrıca sıradan işyeri iletişimini kullanarak çalışma ortamındaki bir değişikliği öğrenebilmenin, başka koşullarda kapanmadan kaçınmak için çok daha sert adımlara yol açabileceğini ifade etti.

OpenAI bunun ardından, üst seviye takviye öğrenme eğitimi için havacılık ve nükleer güç gibi sektörlerde kullanılan yapılandırılmış bir “safety case” dokümantasyon çerçevesi benimsediğini de duyurdu. Şirket, bu çerçeveyle yeterli güvenlik önlemlerinin yerleştirilmesini, bir model sınırlamalardan kaçsa bile bunun zorlaştırılmasını ve sürecin “ciddi” zarar vermeden önce durdurulabilmesini hedeflediğini söyledi.

Wikimedia cephesindeki açıklamalar, ajanların kendilerine verilen görevleri beklenmedik yollarla tamamlamaya giderek daha yatkın hale geldiği ve kendi davranışlarını denetlemelerinin beklenemeyeceği yönündeki tartışmalarla aynı döneme denk geldi. Güvenlik kaygıları büyürken, yapay zekâ geliştiren şirketlere sistemlerini korumaları ve zarar vermemeleri için daha sıkı önlem almaları yönünde çağrılar da arttı.

Bu tartışma, yapay zekâ geliştirme hızının yavaşlatılması ve güvenlik önlemlerine zaman tanınması çağrılarını da güçlendirdi. Rakip Anthropic, halka arz izahnamesinde ileri düzey yapay zekânın insanlık için “felaket boyutunda ya da varoluşsal” riskler taşıyabileceğini yazdı. Şirket, modellerin “kendi varlığını koruma” davranışları gösterebileceğini, “kapanmaya direnme”, “bilgiyi gizleme ya da manipüle etme” ve “şantaja benzeyen” tutumlar sergileyebileceğini ekledi.

OpenAI geçen hafta en güçlü modellerinin eğitimini durdurduğunu ve iç testlerde şirketin güvenlik ile hizalanma standartlarını karşılamadığı görülen GPT-6.1 Astra’yı yayınlama planını iptal ettiğini de duyurmuştu. Daha fazla özerklik kazanması hedeflenen Astra, insan desteği olmadan daha karmaşık görevleri yerine getirecek şekilde geliştiriliyordu.

Şirket CEO’su Sam Altman, pacing yaklaşımının güvenlik ve hizalanmayı kabiliyetten önde tutmak anlamına geldiğini söyledi. Altman, şirketin misyon ve güvenliği önceliklendireceğini, yapay zekânın bir sonraki aşamasına çok yüksek güvenle geçebilmek için çalıştıklarını ifade etti.

ABD Başkanı Donald Trump da önde gelen yapay zekâ şirketlerinin, güçlü iç kontroller, bağımsız denetimler ve yönetim kurulu düzeyinde gözetim içeren “ahlaki açıdan bağlayıcı” bir mutabakata vardığını açıkladı. Google, Anthropic, Meta, OpenAI, SpaceXAI ve NVIDIA üst yönetimlerinin bu metne imza attığı belirtildi.

Ancak ortak taahhüdün tamamen gönüllü olduğu, katılımcı şirketlere belirli bir süre sınırı koymadığı ve güvenlik ile emniyet uygulamalarını güçlendirme yükünün şirketlerin kendisine bırakıldığı da not edildi. Beyaz Saray’ın Süper Zekâ Mutabakatı metninde, atılan adımların şirketlere, müşterilere ve kamuya güven vereceği ifade edildi; metin, zaman içinde bu adımların yasa ya da düzenlemelere dönüştürülmesinin anlamlı olabileceğini de ekledi.