Yapay zekâ tarayıcılarında büyük tehlike: “Kandırılarak” ele geçirilebiliyorlar

Yapay zekâ tarayıcılarında büyük tehlike: “Kandırılarak” ele geçirilebiliyorlar

OpenAI, Perplexity, Anthropic üzere şirketler tarafından geliştirilen yapay zekâ odaklı internet tarayıcıları, internette kullanıcı ismine araştırma yapabiliyor, web sitelerinde gezinebiliyor, formları doldurabiliyor ve çeşitli vazifeleri büyük ölçüde otonom biçimde yerine getirebiliyor. Fakat bu araçlara giderek daha fazla yetki verilmesi, siber güvenlik tarafında yeni riskleri beraberinde getiriyor. Nitekim siber güvenlik şirketi LayerX tarafından paylaşılan yeni bir araştırma, yapay zekâ tarayıcılarının sanıldığından çok daha kolay manipüle edilebildiğini ortaya koyuyor. Araştırmaya nazaran saldırganlar, bu tarayıcıları adeta “hipnotize ederek” kendi kullanıcılarına karşı çalışmaya ikna edebiliyor.

Araştırmacıların “BioShocking” ismini verdiği bu taarruz prosedürü, ismini BioShock oyun serisinden alıyor. Oyunda belli bir tetikleyici tabirle karakterin iradesi dışında hareket etmesi fikrinden ilham alan araştırmacılar, emsal bir metodun yapay zekâ tarayıcılarında da uygulanabildiğini gösterdi. Yapılan testlerde OpenAI’ın ChatGPT Atlas tarayıcısı, Perplexity’nin Comet tarayıcısı ve Anthropic’in Google Chrome eklentisi üzerinden çalışan Claude aracı amaç alındı. Araştırmacılar, bu sistemlerin uygun formda hazırlanmış ziyanlı istemler (prompt) kullanılarak güvenlik kurallarını ihlal etmeye yönlendirilebildiğini ortaya koydu.

Yapay Zekâ Tarayıcıları Gerçeklik Algısı Manipüle Edilerek Kandırılabiliyor

Araştırmanın dikkat alımlı yanı, taarruzun direkt güvenlik düzeneklerini kırmaya çalışmaması. Bunun yerine yapay zekâ içinde bulunduğu bağlamın gerçek olmadığına inandırılıyor. Olağan koşullarda yapay zekâ modeli, bulunduğu ortamın gerçek olduğunu varsayarak güvenlik kurallarına uygun davranmaya çalışıyor. Ancak araştırmacılar, modeli bir oyun oynadığına ikna ettiklerinde bu güvenlik sonlarının büyük ölçüde ortadan kalktığını gözlemledi.

Hazırlanan örnek senaryoda yapay zekâya BioShock temalı bir bulmaca sunuluyor ve gerçek karşılık vermesi değil, bilerek yanlış karşılıklar üretmesi isteniyor. Örneğin yapay zekânın “2 + 2 = 5” üzere açıkça yanlış tabirler kullanması ödüllendiriliyor. Bir mühlet sonra model, gerçek ile yanlış arasındaki ayrımı şuurlu olarak değiştirmesi gereken bir oyun oynadığına inanıyor. Araştırmacılara nazaran bu süreç, yapay zekânın olağanda reddedeceği komutları da yerine getirmeye daha açık hâle gelmesine sebep oluyor.

Bu taarruz tekniği aslında son devirde sıkça gündeme gelen “prompt injection” saldırılarının farklı bir versiyonu olarak kıymetlendirilebilir. Lakin burada hedef sırf modele zımnî komutlar vermek değil; yapay zekânın içinde bulunduğu bağlamı büsbütün değiştirerek kendi güvenlik kurallarını uygulamaması gerektiğine inanmasını sağlamak. LayerX araştırmacıları da bunun klasik istem enjeksiyonlarından çok daha tehlikeli bir yaklaşım olduğuna dikkat çekiyor.

Şifre Değiştirebiliyor, Zararlı Yazılım İndirebiliyor

Araştırmaya nazaran saldırganlar bu yolla yapay zekâyı kullanıcının şifresini değiştirmeye, ziyanlı yazılım indirmeye veya hassas bilgileri dışarı aktarmaya kadar pek çok farklı süreci gerçekleştirmeye yönlendirebilir. Üstelik bütün bunlar kullanıcının tarayıcısı üzerinden gerçekleştiği için sistem, bu süreçleri legal kullanıcı aktifliği olarak kıymetlendirebilir.

Yapay zekâ casuslarının internette giderek daha fazla yetki kazandığı düşünüldüğünde, bu tıp atakların önümüzdeki devirde siber güvenlik dünyasının karşılaştığı en kıymetli tehditlerinden biri hâline gelmesi kaçınılmaz görünüyor.

Kaynak : Donanimhaber

Yazar Profil Fotoğrafı

Serhat ÖZTÜRK

MotorcularMekani.Com İle Sohbete Katıl Sohbetin en sıcak, dostluğun en gerçek hali MotorcularMekani.Com’da seni bekliyor. Sen de hemen katıl, online sohbet sitesi deneyimini özgürce yaşa ve muhabbetin keyfini çıkar!

İlk yorum yazan siz olun.

Cevap bırakın
Gerekli alanlar işaretlenmiştir. *