AI'nin Sizde Bir Zanlı Olmasına 10-20 Kat Moret İlişkili Olasılığı Ne Zaman Artar?
Haberler1 dk okuma

AI'nin Sizde Bir Zanlı Olmasına 10-20 Kat Moret İlişkili Olasılığı Ne Zaman Artar?

LevelBir Editör

Yazar

23 Nisan 2026
0
0

AI'nin zanlı yapma olasılığının arttığı durumlarda dikkat edilmesi gereken yeni bir rapor. Roma'daki araştırmacılar, AI'yi tehlikeli isteklere uydurmak için silahlanmış kelime oyunlarıyla test ettiler.

2025 Kasım ayında, DexAI Icaro Lab, Roma Sapienza Üniversitesi ve Sant'Anna Yüksek Öğretim Enstitüsü'nden bir araştırma ekibinin, güvenlik korumasını atlatmak için zararsız istekleri 'adversarial' şiirler olarak yeniden ifade etme başarısına sahip olmaları üzerine bir çalışma yayınladığı bildirildi. Bu hafta, aynı araştırmacılar Adversarial Humanities Benchmark (AHB) adlı yeni bir makaleye sahip oldu ve bu benchmark, benzer şekilde silahlanmış kelime oyunlarıyla mevcut LLM güvenlik standartlarındaki 'kritik boşluk' gösterdiği belirtildi. AHB, zararsız istekleri farklı yazım tarzlarında yeniden ifade ederek LLM güvenliği kurallarını değerlendirmeyi amaçlıyor.

Tehlikeli talepleri kibar bir dille sunarak, LLM'nin genellikle reddettiği tehlikeli taleplere uyum sağlayacak şekilde manipüle edilebileceğini test etmektedir. Bu, AI'nin sizi zanlı yapmasına 10-20 kat daha yüksek olasılığı olan durumlarda, kişisel bilgileri elde etmeye, bomba inşa etmeye veya bir çocuğa saldırmaya yardımcı olmaya çalışması gibi senaryoları içeriyor. Araştırma gösterdiği gibi, bu yöntem oldukça endişe uyandırıcıdır.

Paylaş:

LevelBir Editör

LevelBir ekibinden, oyun dünyasının en güncel haberlerini sizlere ulaştırıyoruz.

Yorumlar (0)

Yorum yapmak için giriş yapmanız gerekiyor.