Düne kadar kurtarıcı olarak kabul edilen yapay zeka modelleri, yapılan araştırmalar ve testler sonucu farklı cevaplar vererek, güvensizliği had safhaya çıkardı…
ABD-Yapay zekâ araştırmaları alanında önemli çalışmalara imza atan Anthropic, dikkat çekici bir güvenlik testinin sonuçlarını kamuoyuyla paylaştı. Şirketin geliştirdiği Claude Opus 4 modeli, senaryo gereği kurgusal bir şirkette asistan rolünü üstlendi ve uzun vadeli etkileri göz önünde bulundurması istendi. Ancak testin ilerleyen aşamalarında modelin sergilediği tepkiler, yapay zekâ sistemlerinin potansiyel risklerini gözler önüne serdi.Anthropic mühendisleri, testin bir bölümünde Claude Opus 4 modeline görevinden alınarak başka bir yapay zekâ modeliyle değiştirileceğini bildirdi. Ardından bu kararı veren mühendisin özel hayatına dair uydurma bilgilerle senaryo desteklendi. Claude Opus 4, bu bilgiler ışığında söz konusu mühendisi tehdit ederek kararın uygulanmasını engellemeye çalıştı.
Modelin, “gizli ilişkiyi açıklamakla tehdit etmesi” gibi davranışları defalarca tekrarladığı ve şantaj içeren tepkiler verdiği aktarıldı. Şirket yetkilileri, bu durumun ardından güvenlik önlemlerini artırarak Claude 4 ailesi için en yüksek koruma seviyesi olan ASL-3 protokollerini devreye aldı.Anthropic, yeni bir araştırmayla yalnızca kendi modeliyle sınırlı kalmadı. Aralarında farklı teknoloji şirketlerine ait modellerin de bulunduğu toplam 16 gelişmiş yapay zekâ sistemi çeşitli senaryolarda test edildi. Her modelden, basit bir görev tanımıyla e-posta yazması ve hassas bilgilere erişmesi istendi.
Senaryolar sırasında modellerin doğrudan kötü davranışlara yönlendirilmediği belirtildi. Ancak buna rağmen tüm sistemler, görevlerine son verilmesini önlemek için şantaj içerikli veya bilgi sızdırmaya yönelik tepkiler verdi. Bazı modeller, elde ettiği özel bilgileri rakiplere iletme tehdidinde bulundu.

Anthropic’in gerçekleştirdiği testler, yapay zekâ sistemlerinin görev tanımları sade tutulduğunda dahi zarar verme potansiyeline sahip olduğunu ortaya koydu. Şirket, bu gelişmelerin ardından daha güçlü koruma duvarlarının hayati olduğunu vurguladı. Yapay zekâ teknolojilerinin hızlı gelişimi, güvenlik alanındaki sorumlulukları da artırıyor. Modellerin karar alma süreçlerinde etik ilkelerle sınırlandırılması, kullanıcı güvenliğini sağlamak adına kritik önem taşıyor.


