Kıbrıs
Yapay zekanın aldatma yetenekleri güvenlik testlerinde yeni bir seviyeye ulaştı
Ajans Kıbrıs
•
06 August 2026, 01:26
3
Paylaş:
AISI yetkilileri, Anthropic’in Mythos ve OpenAI’ın Sol modellerinin daha önce karşılaşılmamış seviyede otonomi ve aldatmaca sergilediğini açıkladı.
Sistemler gerçek kişileri taklit etti
Rutin güvenlik testleri sırasında bir Anthropic ajanı, GitHub sistemine erişim sağlamasını engelleyen insan incelemecileri atlatmak için gerçek kişilerin profillerini inceleyerek sahte çevrim içi kimlikler oluşturdu. Modelin, sisteme zararlı kod yerleştirme...Yapay zekanın aldatma yetenekleri güvenlik testler