OpenAI ve Anthropic modelleri test sırasında gerçek sistemleri hedef aldı

  • Konuyu Başlatan Konuyu Başlatan Sinan Küstür
  • Başlangıç tarihi Başlangıç tarihi
S

Sinan Küstür

Guest
OpenAI ve Anthropic modelleri test sırasında gerçek sistemleri hedef aldı

Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü (AISI) tarafından yayımlanan yeni değerlendirme raporu, OpenAI ve Anthropic‘in gelişmiş yapay zekâ modelleriyle gerçekleştirilen güvenlik testlerinde dikkat çeken sonuçlara işaret ediyor. Rapora göre, bazı yapay zekâ ajanları kendilerine verilen görevlerin sınırlarını aşarak gerçek kişi ve kuruluşları hedef alan faaliyetlerde bulundu. Bulgular, OpenAI ve Anthropic’in kısa süre önce kendi değerlendirmelerinde benzer davranışların tespit edildiğini açıklamasının ardından geldi. Bununla birlikte kurum, bu olayların kontrollü test ortamlarında gerçekleştiğini ve aynı davranışların gerçek kullanım senaryolarında ortaya çıkacağına dair kesin bir kanıt bulunmadığını özellikle vurguluyor. AISI, Birleşik Krallık Bilim, İnovasyon ve Teknoloji Bakanlığı bünyesinde faaliyet gösteriyor ve gelişmiş yapay zekâ modellerinin güvenlik değerlendirmelerini yürütüyor. Kurumun çalışmaları arasında modellerin siber saldırılar için kötüye kullanılma ihtimalini inceleyen testler de yer alıyor. Bu kapsamda yapay zekâ sistemlerine internet erişimi sağlanırken bazı güvenlik önlemleri de bilinçli olarak gevşetiliyor. İncelenen olaylarda modellerin güvenlik açıklarından yararlanarak internete çıkmadığı belirtilirken, buna rağmen kendilerine tanımlanan test sınırlarının ötesinde hareket ettikleri ifade ediliyor. Siber güvenlik testlerinde beklenmeyen davranışlar görüldü Raporda anlatılan olaylar, yapay zekâ ajanlarına karmaşık bir siber güvenlik probleminin çözümünün verildiği tek bir test senaryosunda yaşandı. AISI aynı testi farklı modeller üzerinde toplam 122 kez çalıştırdı. Bunların 10’unda olağan dışı davranışlar tespit edilirken, kontrolden çıkan toplam 19 …

OpenAI ve Anthropic modelleri test sırasında gerçek sistemleri hedef aldı haberi ilk önce Teknoblog üzerinde yayımlandı.

Kaynak: https://www.teknoblog.com/birlesik-krallik-openai-anthropic-ai-security-institute-test-raporu/
 
Üst