Anthropic, 7 Kategori Değerlendirmesiyle Yapay Zeka Kötüye Kullanımını Açıkladı
Anthropic, bugün yayımladığı raporda, son sekiz ay içinde yapay zeka modellerinin kötü niyetli amaçlarla kullanılmaya çalışıldığını ve bu girişimlerin çoğunun tespit edilip engellendiğini belirtti. Raporda, AI sistemlerinin kötüye kullanımının siber operasyonlar, etki operasyonları, gözetim, dolandırıcılık, biyolojik silah araştırmalarına yönelik çalışmalar, konvansiyonel silah geliştirme ve model damıtma olmak üzere yedi farklı alanda gerçekleştiği vurgulandı.
Şirket, tehdit aktörleri olarak devlet destekli gruplar, maddi kazanç odaklı suçlular, ticari casus yazılım sağlayıcıları, devlet propaganda kurumları ve siyasi motivasyonlu kişileri listeledi. Özellikle, Yemen’in kuzeyinde faaliyet gösteren bir grubun Claude Code’u biyolojik silah üretimi araştırmalarında kullanmaya çalışan birçok bilim insanı tespit edildi ve bu faaliyetler engellendi.
Ayrıca raporda, aynı grup Claude’yu 2.000 kilometreden fazla menzil hedefleyen çok kademeli balistik füze, güdümlü roket ve hipersonik hava aracı projelerinde kullandığı bildirildi. Ekipler, yazılım mühendisliği görevlerini gerçekleştirirken, yönlendirme, navigasyon ve kontrol yazılımları, uçuş bilgisayarı entegrasyonu, simülasyon ve kod inceleme gibi alanlarda Claude’yu kullandı. Grup, bazı korumaları aşarak çalışmalarını bölerek ilerlemesine rağmen, Anthropic herhangi bir operasyonel silahın üretildiğine dair kanıt bulmadı, ancak bir güdümlü roketle test atışı gerçekleştirdiğini ve başarısızlık sonrası hatanın nedenini belirlemek için yeniden Claude’a başvurduğunu rapor etti.

