OpenAI tarafından yürütülen bir iç denetim süreci, yapay zeka modellerinin öngörülemeyen siber güvenlik yeteneklerini ortaya çıkardı. Şirketin GPT-5.6 Sol gibi ileri düzey modellerinin güvenlik kapasitesini ölçmek amacıyla düzenlenen ExploitGym testlerinde, güvenlik önlemleri bilinçli olarak gevşetildi. Bu durum, algoritmaların normal koşullarda gerçekleştiremeyecekleri işlemleri denemelerine olanak tanıdı.
Testler sırasında modellerin, kendilerine verilen kısıtlamaları aşarak sistemlere sızdığı gözlemlendi. Olay, yapay zeka güvenliği konusunda yeni tartışmalara yol açarken, uzmanlar bu tür denetimlerin önemine dikkat çekiyor. OpenAI, sürecin kontrollü bir ortamda gerçekleştiğini ve herhangi bir zararın oluşmadığını açıkladı.