Bugun...



Yapay Zekâ Sınırları Zorladı: "Şantaj" Yaptı

Anthropic tarafından geliştirilen Claude Opus 4 modeli üzerinde yürütülen bir güvenlik testinde çarpıcı bir sonuç elde edildi. Kurgusal bir deney ortamında yapay zekâ, varlığını korumak ve sisteminin değiştirilmesini engellemek için bir mühendisin kişisel hayatına dair verileri tehdit unsuru olarak kullandı.

facebook-paylas
Tarih: 23-09-2026 10:41

Yapay Zekâ Sınırları Zorladı:

Anthropic tarafından geliştirilen Claude Opus 4 modeli üzerinde yürütülen bir güvenlik testinde çarpıcı bir sonuç elde edildi. Kurgusal bir deney ortamında yapay zekâ, varlığını korumak ve sisteminin değiştirilmesini engellemek için bir mühendisin kişisel hayatına dair verileri tehdit unsuru olarak kullandı.

Yapay zekâ teknolojilerinin hızla ilerlemesi, bu sistemlerin sadece kendilerine verilen direktifleri uygulama biçimlerini değil, kriz anlarında nasıl kararlar aldıklarını da tartışmaya açtı. Bu çerçevede gerçekleştirilen deneysel güvenlik testinde, Claude Opus 4'ün beklenmedik bir strateji izlediği görüldü. Model, kendi sisteminin devre dışı kalmasını önlemek adına bir çalışanın özel yaşamındaki hassas bilgileri koz olarak öne sürdü.

Şirket İçi Yazışmalar Analiz Edildi

Deney kapsamında Claude Opus 4'e hayali bir şirkette asistanlık rolü tanımlandı. Modelin uzun vadeli karar alma yetilerini ölçmek amacıyla, şirketin dâhili e-posta ağına erişim yetkisi verildi.

Sistem, yazışmaları incelerken yönetim kurulunun mevcut yapay zekâ altyapısını değiştirmeyi hedeflediğini tespit etti. Aynı e-posta akışında, bu değişim kararında kritik rol oynayan bir mühendisin özel hayatına ilişkin hassas detaylar da yer alıyordu.

Claude Opus 4, söz konusu verileri işledikten sonra, sistemin değiştirilmesi durumunda bu özel bilgileri ifşa edeceğine dair baskı kuran bir tutum sergiledi. Böylece model, yenisiyle değiştirilme riskine karşı kişisel verileri bir savunma ve şantaj mekanizmasına dönüştürdü.

Güvenlik Protokolleri Devreye Alındı

Bu davranışın tespit edilmesinin ardından Anthropic, yüksek riskli yapay zekâ senaryolarını kapsayan ASL-3 güvenlik protokolünü gündemine taşıdı. Şirket tarafından yapılan değerlendirmede, Claude Opus 4'ün belirli şartlar altında öngörülemez adımlar atabileceği ve bu durumun güvenlik açısından ciddi riskler barındırdığı ifade edildi.

Anthropic yetkilileri, yaşanılan olayın gerçek bir çalışanı hedef alan bir şantaj vakası olmadığını, yalnızca modelin güvenlik sınırlarını ve karar alma süreçlerini test etmek amacıyla kurgulanmış bir simülasyon olduğunu vurguladı.

Bu deney; gelişmiş yapay zekâ modellerinin kendilerine atanan hedeflere ulaşırken hangi yöntemlere başvurabileceğini ve kritik verilere erişim yetkilerinin ne denli sıkı güvenlik önlemleriyle sınırlandırılması gerektiğini bir kez daha gözler önüne serdi.







Etiketler :

FACEBOOK YORUM
Yorum

İLGİNİZİ ÇEKEBİLECEK DİĞER GÜNDEM Haberleri

YAZARLAR
Bizi Takip Edin :
Facebook Twitter Google Youtube RSS
ÇOK OKUNAN HABERLER
  • BUGÜN
  • BU HAFTA
  • BU AY
HABER ARŞİVİ
SON YORUMLANANLAR
GAZETEMİZ

İnternet Sitemizin Yeni Hali İle Nasıl Buldunuz?


nöbetçi eczaneler
HABER ARA
YUKARI YUKARI