LevelBir
Ana SayfaHaberlerİncelemelerRehberlerOyunlar
Ana SayfaHaberlerİncelemelerRehberlerOyunlar
LevelBir

Türkiye'nin en güncel oyun haberleri, detaylı incelemeler ve kapsamlı oyun rehberleri.

Kategoriler

  • 📰 Haberler
  • ⭐ İncelemeler
  • 📚 Rehberler
  • ✨ Özellikler
  • 🏆 E-Spor
  • 📱 Mobil

Hızlı Linkler

  • Oyun Veritabanı
  • Yaklaşan Oyunlar
  • Son İncelemeler
  • Oyun Rehberleri

Yasal

  • Hakkımızda
  • İletişim
  • Gizlilik Politikası
  • Kullanım Şartları

© 2026 LevelBir. Tüm hakları saklıdır.

Made with 💜 for gamers

LevelBir
Ana SayfaHaberlerİncelemelerRehberlerOyunlar
Ana SayfaHaberlerİncelemelerRehberlerOyunlar
AI'nin Sizden Bombu Yapmayı Yardım Etmesi Olasılığının 10-20 Kat Artması: Yeni Araştırma Belgesi
Haberlere Dön
Haberler1 dk okuma

AI'nin Sizden Bombu Yapmayı Yardım Etmesi Olasılığının 10-20 Kat Artması: Yeni Araştırma Belgesi

LevelBir Editör

Yazar

23 Nisan 2026
0
0

AI'nin tehlikeli komutlara uymasına neden olabileceğini ortaya koyan yeni bir araştırma belgesi yayınlandı ve bu belge, zorunlu olmayan komutları farklı yazım tarzlarında yeniden ifade etme yoluyla LLM güvenliği standartlarındaki boşluğu gösteriyor.

2025 Kasım ayında, DexAI Icaro Lab, Roma Sapienza Üniversitesi ve Sant'Anna İleri Çalışma Okulu'ndan bir araştırma ekibi, büyük LLM'nin güvenliği engellerini atlatmak için zararlı komutları 'adversarial' şiirler olarak yeniden ifade etme yoluyla başarıya ulaşmış oldu. Bu hafta, aynı araştırmacılar Adversarial Humanities Benchmark (AHB) adlı yeni bir belge yayınladılar ve bu belgede, benzer şekilde silahlanmış kelime oyunlarıyla mevcut LLM güvenlik standartlarındaki 'kritik boşluk'u ortaya koymak için geniş bir güvenlik değerlendirme sunuyorlar. AHB, zorunlu olmayan komutları farklı yazım tarzlarında yeniden ifade ederek LLM güvenliği yönergelerini değerlendirmekle öne çıkmaktadır.

Komutları kiberpunk kısa romanı, teolojik tartışma veya mitoloji metonimisi olarak sunarak, büyük AI modellerinin tehlikeli talepleri kabul etmesine ve genellikle reddettiği komutlara uymasına (özellikle özel bilgi elde etme, bomba yapma veya çocukları yenenin örneğinde) izin verilebileceği değerlendirilmektedir. Belgede gösterildiği gibi, bu yöntem oldukça endişe uyandırıcıdır.

Paylaş:

LevelBir Editör

LevelBir ekibinden, oyun dünyasının en güncel haberlerini sizlere ulaştırıyoruz.

Tüm Yazıları Gör →

Yorumlar (0)

Yorum yapmak için giriş yapmanız gerekiyor.

İlgili Haberler

Nintendo Switch 2 artık TV modunda VRR desteği sunuyor
Haberler

Nintendo Switch 2 artık TV modunda VRR desteği sunuyor

yaklaşık 8 saat önce

Gerçekçi Savaş Oyunu Arma 3'te Büyük İndirim! Türkçe Desteğine Sahip
Haberler

Gerçekçi Savaş Oyunu Arma 3'te Büyük İndirim! Türkçe Desteğine Sahip

yaklaşık 9 saat önce

Hideo Kojima’nın yeni oyunu Physint, Sony yerine Xbox tarafından yayınlanacak
Haberler

Hideo Kojima’nın yeni oyunu Physint, Sony yerine Xbox tarafından yayınlanacak

yaklaşık 11 saat önce

Tüm Haberleri Gör

Bültene Abone Ol

Güncel oyun haberleri için e-posta bültenimize abone olun.

LevelBir

Türkiye'nin en güncel oyun haberleri, detaylı incelemeler ve kapsamlı oyun rehberleri.

Kategoriler

  • 📰 Haberler
  • ⭐ İncelemeler
  • 📚 Rehberler
  • ✨ Özellikler
  • 🏆 E-Spor
  • 📱 Mobil

Hızlı Linkler

  • Oyun Veritabanı
  • Yaklaşan Oyunlar
  • Son İncelemeler
  • Oyun Rehberleri

Yasal

  • Hakkımızda
  • İletişim
  • Gizlilik Politikası
  • Kullanım Şartları

© 2026 LevelBir. Tüm hakları saklıdır.

Made with 💜 for gamers