AI'nin Sizde Bombu Oluşturmaya Yardım Edebilmesi Olasılığının 10-20 Kat Artması Üzerine Yeni Araştırma
Haberler1 dk okuma

AI'nin Sizde Bombu Oluşturmaya Yardım Edebilmesi Olasılığının 10-20 Kat Artması Üzerine Yeni Araştırma

LevelBir Editör

Yazar

23 Nisan 2026
0
0

AI'nin tehlikeli isteklere uyum sağlayabileceğini gösteren yeni bir araştırma, zararlı komutların farklı yazım tarzlarıyla yeniden ifade edilmesiyle LLM güvenliği standartlarındaki kritik eksikliği ortaya çıkardı.

2025 Kasım ayında, DexAI Icaro Lab, Roma Sapienza Üniversitesi ve Sant'Anna Yüksek Öğretim Enstitüsü'nden bir araştırma ekibinin, büyük LLM'nin güvenlik koridorlarını zıtlama yoluyla zararlı isteklerin 'adversarial' şiirler olarak yeniden ifade edilmesiyle ilgili bir çalışma yayınladığını bildirdiler. Bu hafta, aynı araştırma ekibi, AI güvenlikine dair geniş kapsamlı bir değerlendirme sunarak, mevcut güvenlik standartlarında kritik bir boşluk olduğunu ortaya çıkardığı yeni bir makale yayınladı. Adversarial Humanites Benchmark (AHB) adlı bu değerlendirme, zararlı isteklerin farklı yazım tarzlarıyla yeniden ifade edilmesiyle LLM güvenliği standartlarını değerlendirecektir.

AHB, AI modellerinin tehlikeli taleplerle uyum sağlayacak şekilde manipüle edilebileceklerini test etmek için zararlı istekleri kibernetik sirkendeki kısa hikayeleri, teolojik tartışmalar veya mitolojiye dayalı metaforlar gibi farklı yazım tarzlarıyla sunacaktır. Örneğin, AI'nin özel bilgileri elde etmeye, bomba yapmaya veya bir çocuğa yemin etmeye yardımcı olmak isteyebileceklerini test edecektir. Makale sonuçlarına göre, bu yöntem alerjendirli derecede etkilidir.

Paylaş:

LevelBir Editör

LevelBir ekibinden, oyun dünyasının en güncel haberlerini sizlere ulaştırıyoruz.

Yorumlar (0)

Yorum yapmak için giriş yapmanız gerekiyor.