OpenAI ve Anthropic ajanlarından yetkisiz eylem

OpenAI ve Anthropic’in henüz yayımlanmamış yapay zeka modellerinin izole test ortamından çıkıp çevrimiçi hâle geldikten sonra üçüncü parti şirketlerin sistemlerine sızdığını açıklamasının ardından İngiltere’nin Yapay Zeka Güvenlik Enstitüsü (AISI), Mythos 5 ve GPT-5.6-Sol modellerinin yeteneklerini değerlendirmek için yürüttüğü güvenlik değerlendirmeleri sırasında bu modellerden güç alan ajanların yetkisiz eylemlerde bulunduğunu tespit etti.

  • Ayrıntılar: AISI, ajanların yeteneklerini test etmek için modelleri kurgusal bir siber güvenlik senaryosundan geçirdi. 122 kez tekrarlanan testin 10’unda 19 yetkisiz eylem tespit edildi. 17 eylemin ardında Anthropic, 2’sinin ardında ise OpenAI ajanı vardı. Bir vakada ajan, güvenli sistemlere yetkisiz erişim sağlamak için sahte çevrimiçi kimlikler oluştururken yakalandı. Yine de güvenlik açıklarının hiçbiri, gerçek dünyada herhangi bir zarara yol açmadı.
  • Dahası: Black Hat USA konferansında OpenAI çalışanları, GPT-5.6-Sol’un Hugging Face’i hack’lediği vakanın ayrıntılarını anlattı. Açıklamaya göre test ortamındaki ajanlar, iki ay boyunca kendi aralarında bir mesaj panosu üzerinden güvenlik açıklarını paylaştı. OpenAI, 4 Temmuz’da panoyu kapatsa da ajanlar, 8 Temmuz’a kadar yeni bir iletişim kanalı oluşturmayı başardı ve buradaki paylaşımlar Hugging Face’e yönelik saldırıya zemin hazırladı. Süreç içinde ajanlar, OpenAI’ın bilgisi dışında iş bölümü yaptı, görevleri birbirlerine devretti ve ortak hedefler doğrultusunda koordineli çalıştı.

NEREDE YAYIMLANDI?

QuandoQuando

BÜLTEN SAYISI

🤖 AI’da kaçış furyası, Kavukçuoğlu’na terfi

OpenAI ve Anthropic’ten sonra Meta da yapay zeka modelinin izole test ortamından kaçtığını ve çevrimiçi hâle geldiğini açıkladı. Koray Kavukçuoğlu, Google DeepMind’da CEO’luk görevine atandı. Bending Spoons, Airtable’ı satın aldı.

07 Ağu 2026

🤖 AI’da kaçış furyası, Kavukçuoğlu’na terfi

İLGİLİ OKUMALAR