Anthropic, yapay zeka sistemlerinin kötüye kullanımına yönelik endişe verici bir rapor paylaştı
Anthropic, bugün geliştirdiği yapay zeka modellerinin kötüye kullanımını ele alan bir rapor paylaştı. Raporda, son sekiz ayda model tabanlı saldırı girişimlerinin tespit edildiği ve engellendiği bildiriliyor. Yedi alan ele alınıyor: siber operasyonlar, etki operasyonları, gözetim, dolandırıcılık, biyolojik silah araştırmaları, konvansiyonel silah geliştirme ve model damıtma.
Şirket, raporunda devlet destekli gruplar, maddi kazanç odaklı suçlular, ticari casus yazılım sağlayıcıları, devlet propaganda kurumları ve siyasi motivasyonlu kişiler gibi çeşitli tehdit aktörlerini tanımlıyor. Aynı zamanda, biyolojik silah üretimine yönelik çalışmalar yapan birçok bilim insanının faaliyetlerinin tespit edildiği ve durdurulduğu belirtiliyor. Yemen’in kuzeyinde faaliyet gösteren bir grup, Claude Code’u çok kademeli balistik füze, güdümlü roket ve hipersonik hava aracı projelerinde kullandı. Çalışmalar sırasında rehberlik, navigasyon ve kontrol yazılımları, uçuş bilgisayarı entegrasyonu, simülasyon ve kod inceleme gibi görevlerde Claude’yu yazılım mühendisi gibi yönetti.
Grup, bir güdümlü roketle test atışı yaptı ve başarısızlık sonrası hatayı düzeltmek için yeniden Claude’yu kullandı. Anthropic, Claude kullanılarak operasyonel bir silah üretildiğine dair kanıt bulmadığını, ancak grubun test atışında karşılaştığı hatayı çözmek için modeli tekrar başvurduğunu rapor ediyor.

