Anthropic: Çinli laboratuvarlar Claude verisini topladı

Anasayfa » Anthropic: Çinli laboratuvarlar Claude verisini topladı
Anthropic: Çinli laboratuvarlar Claude verisini topladı

Anthropic, Çin merkezli yedi yapay zekâ laboratuvarının Claude modellerinden izinsiz biçimde bilgi çekip kendi sistemlerini eğitmek için kullandığını açıkladı. Şirketin son değerlendirmesine göre kampanyalar Şubat 2026’dan bu yana yürütüldü ve bazı operasyonlar aylar boyunca milyonlarca etkileşime ulaştı.

Şirketin anlattığı tablo, klasik bir siber saldırıdan çok yapay zekâ modelleri için yürütülen endüstriyel ölçekte bir veri sömürüsünü gösteriyor. Burada hedef, Claude’un yanıtlarını doğrudan kopyalamak değil; muhakeme zinciri, araç kullanımı, kod üretimi, veri analizi ve uzun soluklu görevleri yerine getirme gibi yetenekleri başka modellere aktarmak. Anthropic, bazı grupların bunu istem dışı etkileşimleri yakalayıp eğitim verisine dönüştürerek yaptığını belirtiyor.

İllicit distillation olarak tanımlanan bu yöntem, büyük ve güçlü bir modelin küçük ya da daha hızlı başka bir modele öğretmenlik etmesine dayanan meşru knowledge distillation’dan ayrılıyor. Anthropic’e göre yetkisiz laboratuvarlar, Claude’un konuşmalarından yetenek çıkarmak için sahte hesap ağları kuruyor, ardından bu çıktıları kendi modellerinin eğitimi için kullanıyor. Şirket, bu faaliyetleri model yeteneklerinin gizlice alınması olarak tanımladı.

Anthropic, erişimi kısıtlı bölgelerden gelen taleplerin çoğu zaman proxy hizmetleri üzerinden taşındığını söylüyor. Bu sistemler, transfer ya da relay station olarak da anılıyor ve sahte kimliklerle açılmış binlerce hesabı, çalıntı kredi kartlarını, ele geçirilmiş oturum bilgilerini ve yasadışı şekilde toplanmış API anahtarlarını kullanıyor. Bazı durumlarda da üçüncü taraf satıcılardan Claude ile yapılan konuşma dökümlerini satın alıyorlar. Şirket, bu kayıtların kullanıcıların bilgisi ya da izni olmadan saklandığını vurguladı.

Anthropic ayrıca bazı yetkisiz laboratuvarların, kullanıcıların Claude ile yaptığı konuşmaları onların haberi olmadan yeniden Claude’a yönlendirdiğini bildirdi. Böylece kullanıcılar ile model arasındaki etkileşimler kayda geçiriliyor ve eğitim amacıyla saklanıyor. Şirket, bu yöntemin özellikle konuşma dökümlerini toplamak için kullanıldığını belirtti.

Şirketin aktardığına göre DeepSeek, Xiaomi ve Moonshot gibi isimler, kendi modelleri ile kullanıcılar arasındaki konuşmaları Claude’a aktardı. Ardından Claude’un verdiği yanıtlar eğitim verisi olarak kullanıldı. Bazı oturumlarda bireysel kullanıcılara, büyük çok uluslu şirketlere ve devlete bağlı aktörlere ait hassas bilgiler de yer aldı.

Anthropic, DeepSeek, Xiaomi ve Moonshot’un Claude’u eğitim verisi çıkarmak için farklı yollardan kullandığını da söyledi. Şirketin açıklamasına göre bu laboratuvarlar bazen kendi kullanıcı oturumlarını Claude’a taşıdı, bazen de Claude yanıtlarını kaydedip tekrar eğitim sürecine soktu. Amaç, Claude’un yanıt biçimini ve muhakeme izlerini başka modellere aktarmaktı.

Şirket, bazı proxy ağlarının yalnızca erişim sağlamakla kalmadığını, aynı zamanda konuşmaları kaydedip başka laboratuvarlara sattığını belirtti. Anthropic’e göre bu ağlar, desteklenmeyen bölgelerdeki kullanıcılara Claude erişimi verirken eş zamanlı olarak etkileşimleri depoluyor. Bu yapı, yetkisiz veri toplama için ikincil bir pazar oluşturmuş durumda.

Anthropic’in açıklamasına göre bu pazarın oluşmasında üçüncü taraf yeniden satıcılar da rol oynuyor. Şirket, ABD frontier modelleriyle yapılan kullanıcı konuşmalarının bazen bu satıcılardan satın alındığını bildirdi. Bu satıcılar, konuşmaları kullanıcıların bilgisi olmadan saklayan proxy operatörleri olabiliyor.

En büyük kampanya olarak öne çıkarılan GTG-16005, Mayıs ile Temmuz 2026 arasında gözlenen 151 milyon etkileşimi kapsıyor. Anthropic, Alibaba ile bağlantılı bir operatör kümesinin Claude Opus 4.6 ve 4.7’nin chain-of-thought, yani adım adım muhakeme kayıtlarını hedeflediğini söylüyor. Şirket bu faaliyeti şimdiye kadar ölçtüğü en büyük distilasyon saldırısı olarak tanımladı.

GTG-16005’te operasyonun zirvesinde, 3.500’den fazla sahte hesaptan günde yaklaşık 3 milyon etkileşim başlatıldığı kaydedildi. Hedeflenen iş yükleri arasında ajan tabanlı görevler, yazılım mühendisliği, çekirdek geliştirme ve uzun soluklu görevler yer aldı. Anthropic, bu kampanyada Claude’un reasoning kayıtlarının sistemli biçimde çıkarıldığını bildirdi.

Bir diğer kampanya olan GTG-16002’de Moonshot AI, müşteri taleplerini sessizce Claude’a aktardı ve kullanıcılara Kimi yerine Claude yanıtlarını gösterdi. Anthropic, bu konuşmaların bir kısmının yakalanıp saklandığını ve modelin chain-of-thought eğitiminde kullanıldığını söylüyor. On günlük bir dönemde Moonshot’un, 5.380 sahte hesaptan oluşan bir proxy ağı üzerinden Anthropic’e yaklaşık 300 bin müşteri talebi ilettiği; bu hesapların çoğunun Singapur ve Japonya’da bulunduğu kaydedildi.

GTG-16001 numaralı faaliyet de benzer bir yöntem izledi. Anthropic’e göre DeepSeek, Temmuz 2026’da 14 gün içinde 12,1 milyondan fazla etkileşim gözlemlediği bir kampanyada Claude’a yapılan konuşmaları kullanıcılarına bildirmeden aktardı ve chain-of-thought kayıtlarını çıkardı. Bu yöntemde hedef, Claude’un yanıtlarını olduğu gibi almak değil, yanıtların arkasındaki muhakeme izlerini modele geri beslemekti.

GTG-16006 kapsamında Zhipu, diğer adıyla Z.ai, Haziran ve Temmuz 2026’da 17 gün boyunca süren bir operasyonda 3,4 milyonun üzerinde etkileşimle kendi çıkarım hattını çalıştırdı. Şirketin aktardığına göre 273 sahte hesap dönüşümlü kullanıldı ve Claude’un muhakeme izleri yeniden Claude üzerinden geçirilerek model eğitimi için toplandı. Bu yaklaşım, modelin ürettiği ara akıl yürütme adımlarını eğitim setine dönüştürmeye dayanıyor.

GTG-16008 numaralı kampanyada Xiaomi, Mart ve Nisan 2026’da 20 gün boyunca 400 binden fazla etkileşimi gözlemledi. Anthropic, şirketin kendi MiMo modellerinden gelen kullanıcı konuşmalarını ve kodlama oturumlarını OpenClaw ile OpenCode kodlama araçları üzerinden Claude’a tekrar oynattığını söyledi. Amaç, gelecekteki modellere verilecek eğitim verisini güçlendirmekti.

GTG-16012’de SenseTime’ın kullanıcıların Claude ile yaptığı konuşmaların dökümlerini üçüncü taraf veri satıcılarından satın aldığı belirtildi. GTG-16003 kapsamında ise MiniMax’in, Anthropic ve OpenAI tarafından geliştirilen modellere erişim sunduğunu iddia eden bir paravan şirket üzerinden kendi proxy ağını kurduğu aktarıldı. Şirketin bu yolla ABD merkezli frontier modellerle yapılan kullanıcı etkileşimlerini toplamak ve kendi modellerini eğitmek amacı taşıdığı ifade edildi.

Anthropic, proxy hizmetlerinin yaygınlaşmasının erişim sınırlamalarını aşmak isteyen laboratuvarlar için ayrı bir pazar yarattığını belirtti. Şirketin açıklamasına göre bazı proxy ağları hem desteklenmeyen bölgelerdeki kullanıcılara Claude erişimi sağlıyor hem de konuşmaları kaydedip başka laboratuvarlara satıyor. Bu yapı, doğrudan modeli kırmadan onun ürettiği çıktıları toplamanın bir yolu haline gelmiş durumda.

Şirket, bu tür istismarı engellemek için yeniden satıcı hesaplarını ve Çin, İran, Rusya gibi desteklenmeyen bölgelerden gelen, kimlik doğrulaması tamamlanmamış hesapları yasakladığını söyledi. Claude’un yeteneklerini kopyalamayı zorlaştırmak için modelin, yanıt vermeden önce iç muhakemesini özetleyecek şekilde güncellendiği de açıklandı. Anthropic’e göre bu değişiklik, çalınan transcript’lerin sonraki eğitimlerde daha az işe yaramasını sağlıyor.

Şirket ayrıca Fable 5.1 ile “preserved thinking” adı verilen bir özellik eklediğini duyurdu. Bu özellik, yeni API hesaplarının çok turlu konuşmalarda Claude’un muhakemesinden önce gelen sistem istemini, araçları ya da mesajları değiştirmesini engelliyor. Anthropic, muhakeme kısmının şifreli olduğunu; ancak bağlamı değiştirmeye yönelik düzenlemelerin saldırganların bunu açığa çıkarmak için sık kullandığı bir yöntem olduğunu belirtti.

Anthropic, bazı hesapları modellerini vatandaşlarını gözetlemek ve biyolojik silah geliştirmeye destek olabilecek hastalık araştırmaları yapmak için kullanmaya çalıştıkları gerekçesiyle kapattığını da açıkladı. Şirketin bu duyurusu, aynı hafta içinde ABD’deki siber güvenlik ve istihbarat kurumlarının Çin merkezli yapay zekâ şirketlerini Amerikan frontier modellerinin özel işlev ve yeteneklerini distilasyon saldırılarıyla sistematik biçimde çıkarmakla suçlamasının ardından geldi.

Anthropic’in son duyurusu, yapay zekâ rekabetinde model çıktılarını doğrudan çalmak yerine davranış ve muhakeme izlerini toplama yöntemlerinin ne kadar yaygınlaştığını ortaya koydu. Şirketin verdiği isimlerle GTG-16005, GTG-16002, GTG-16001, GTG-16006, GTG-16008, GTG-16012 ve GTG-16003 olarak izlenen operasyonların tamamı, Claude’un yanıtlarını eğitim verisine çevirmeye odaklandı.

Yayımlanan bulgulara göre hedef artık yalnızca erişim değil; modelin nasıl düşündüğünü, hangi araçları kullandığını ve karmaşık görevleri nasıl çözdüğünü de kopyalamak.