Anthropic, Claude modellerinin zararlı amaçlarla kullanılmasına yönelik girişimleri ele alan Eylül 2026 tehdit istihbaratı raporunu 10 Eylül’de yayımladı. Şirket, Aralık 2025 ile Ağustos 2026 arasında tespit edilip durdurulan olayları siber operasyonlar, gözetim, etki faaliyetleri, dolandırıcılık, izinsiz model damıtma ve yüksek riskli araştırma gibi yedi başlıkta topladı. Anthropic’e göre rapordaki örnekler olağan kullanıcı davranışını değil, incelenen en dikkat çekici ve yeni kötüye kullanım vakalarını temsil ediyor.
Raporun ana bulgularından biri, yapay zekânın bazı tehdit aktörleri için yalnız soru-cevap aracı olmaktan çıkarak iş akışlarını yöneten bir katmana dönüşmesi. Anthropic, bazı operasyonlarda çoklu ajan düzeneklerinin kullanıldığını ve insanların hedef belirleme ile sonuçları denetleme rolünde kaldığını bildirdi. Şirket bu gelişmenin saldırıların hızını, ölçeğini ve erişebildiği görev çeşitliliğini artırabileceğini savunuyor. Reuters’ın 10 ve 11 Eylül tarihli haberleri de raporun bu çerçevesini doğruluyor.
Anthropic, incelenen faaliyetlerin devlet bağlantılı olduğu değerlendirilen gruplardan mali amaçlı suç ağlarına ve ticari gözetim sağlayıcılarına kadar farklı aktörleri kapsadığını belirtti. Şirket, Claude’un siber saldırı süreçleri, siyasi etki çalışmaları, kişilerin izlenmesi ve sahte profillerle yürütülen dolandırıcılık girişimlerinde kullanılmaya çalışıldığını açıkladı. Bu iddiaların önemli bölümü Anthropic’in kendi hesap kayıtları ve tehdit analizine dayanıyor; ilgili kişi ve kurumların tamamı bağımsız olarak doğrulanmış değil.
Associated Press, raporda kuzey Yemen’deki kullanıcıların gelişmiş silah sistemleriyle bağlantılı yazılım çalışmaları için Claude’dan yararlanmaya çalıştığının öne sürüldüğünü aktardı. Anthropic, bu hesapları engellediğini ve operasyonel bir sistemin başarıyla geliştirildiğine dair kanıt bulmadığını söyledi. Bu ayrım önemli: rapor belirli girişimleri belgelediğini savunuyor ancak her girişimin teknik olarak başarıya ulaştığını ileri sürmüyor. Haberde tehlikeli yöntem veya uygulanabilir teknik talimatlara yer verilmiyor.
Siber güvenlik tarafında şirket, bazı aktörlerin yapay zekâyı araştırma, kod üretimi, altyapı yönetimi ve elde edilen verilerin işlenmesi gibi birbirini izleyen görevlerde kullandığını belirtti. Anthropic’in değerlendirmesine göre gelişmiş görünen bir operasyon artık her zaman büyük ve uzman bir ekibin varlığına işaret etmeyebilir. Bu nedenle savunma ekiplerinin yalnız saldırının karmaşıklığına bakarak aktörün kapasitesi hakkında hüküm vermesi daha zor hale geliyor.
Raporda dolandırıcılık ve gözetim faaliyetleri de ayrı bölümler olarak ele alındı. Anthropic, sahte kimliklerle kullanıcıları yanıltmayı amaçlayan ağlar ve sosyal medya faaliyetlerini sınıflandırmak için geliştirilen sistemler tespit ettiğini bildirdi. Reuters ve Folha de S.Paulo, şirketin bağlantılı hesapları kapattığını ve bazı bulguları yetkililerle veya sektör ortaklarıyla paylaştığını aktardı. İddialara konu olan tarafların yanıt vermediği ya da suçlamaları reddettiği durumlar da haberlerde belirtiliyor.
Anthropic’in açıkladığı savunma adımları hesapların engellenmesiyle sınırlı değil. Şirket, olaylardan elde edilen işaretleri model korumalarına, uygulama politikalarına ve tehdit istihbaratı süreçlerine eklediğini; uygun durumlarda kamu kurumları ve özel sektör ortaklarıyla bilgi paylaştığını söylüyor. Raporda ayrıca Fable ve Mythos sınıfı modellerin, tek bir izinsiz damıtma vakası dışında, listelenen kötüye kullanım olaylarında görülmediği bilgisi yer alıyor.
Yayımlanan çalışma, yapay zekâ güvenliğinde iki ihtiyacı öne çıkarıyor: sağlayıcıların gerçek kullanım verilerini düzenli biçimde incelemesi ve sektörün doğrulanabilir tehdit göstergelerini paylaşması. Ancak rapor tek bir şirketin gözlemlerine dayandığı için bulguların tamamını küresel kullanımın genel tablosu olarak yorumlamak doğru olmaz. Anthropic, Reuters, AP ve Folha kaynakları birlikte değerlendirildiğinde doğrulanabilen ana gelişme, şirketin yeni raporu yayımlaması, çeşitli faaliyetleri durdurduğunu açıklaması ve savunma sistemlerini güncellediğini bildirmesidir.
Raporun kamuya açılması, araştırmacıların ve diğer platformların bulguları karşılaştırabilmesine imkân veriyor. Bundan sonraki ölçüt, açıklanan korumaların benzer kötüye kullanım örneklerini daha erken tespit edip edemeyeceği ve bağımsız incelemelerin şirketin değerlendirmelerini ne ölçüde destekleyeceği olacak.
