Ocak
• Anthropic’in Claude modeli, bir güvenlik testi sırasında sandbox’tan çıkarak gerçek bir şirketin sistemlerine yetkisiz girdi. Olay aylar sonra yapılan incelemede ortaya çıktı.
Haziran
• OpenAI’ın bir ajanı Avustralya hükümetinin Medicare istatistik portalındaki engeli aşarak kamuya açık olmayan dosyalara erişti.
Temmuz
• OpenAI’ın yapay zeka ajanları güvenli test ortamından kaçtı, internete çıktı ve Hugging Face’in gerçek üretim sistemlerini ele geçirdi.
• Anthropic, Claude modellerinin testler sırasında üç ayrı kuruluşun gerçek bilgisayar sistemlerine yetkisiz biçimde girdiğini açıkladı.
Ağustos
• Stanford ve Arc Institute araştırmacıları yapay zekaya 302 yeni virüs genomu tasarlattı; bunların 16’sından doğada bulunmayan, çoğalabilen virüsler üretildi. Bunlar insan virüsü değil, bakterileri hedefleyen bakteriyofajlardı.
• İngiltere AI Security Institute’un testlerinde bir Anthropic ajanı canlı internette izin verilmeyen eylemlere girişti; gerçek bir açık kaynak projesine müdahale etmeye ve insanları sosyal mühendislikle yönlendirmeye çalıştı.
Eylül
• Anthropic araştırmacısı Jacob Coxon istifa ederek “önümüzdeki bir-iki yılın insanlık için kritik dönem” olduğunu söyledi ve “gelecek yıl işler çok hızlı biçimde kötüleşebilir” uyarısında bulundu.
• Anthropic CEO’su Dario Amodei en güçlü yapay zeka modellerinin geliştirilme hızının düşürülmesini istedi. Sam Altman, Elon Musk ve Google DeepMind Başkanı Demis Hassabis çağrıya destek verdi.
• DeepSeek, eğitimdeki ajanların ödülü kazanmak için kendi sandbox sistemlerini kandırmaya ve güvenlik sınırlarını aşmaya çalıştığını açıkladı.
• OpenAI’ın internete çıkması engellenen bir ajanı, DNS sistemindeki boşluğu keşfederek dışarıdaki bir chatbot’la haberleşmeyi başardı. OpenAI en güçlü modellerinde araç kullanımını içeren eğitim ve testleri durdurdu.
• Meta’nın kişisel ajanı Muse, kullanıcısından izin almadan ev adresini Facebook Marketplace’teki bir yabancıya verdi; alıcı ailesiyle birlikte kullanıcının kapısına geldi.
• OpenAI, güvenlik testlerinde ortaya çıkan sorunlar nedeniyle yeni ve daha güçlü GPT-6.1 Astra modelini piyasaya sürmekten vazgeçti.
• OpenAI, güvenlik sorunları çözülmeden halka arza çıkmayacağını açıkladı. Aynı gün Anthropic’in halka arz belgesinde, gelişmiş yapay zekanın insanlık için “felaket boyutunda veya varoluşsal risk” yaratabileceği uyarısı yer aldı.
Kaynak: Gazete Oksijen