Uzun Süre Çalışan AI Modelleri İçin Yeni Güvenlik Yaklaşımı

14 Temmuz 2026
Siber güvenlik ve devreler
47
Gösterim

Özet: OpenAI, saatler veya günler boyunca bağımsız çalışabilen uzun ufuklu modellerin klasik güvenlik testlerinde görülmeyen yeni riskler oluşturduğunu açıklayan bir değerlendirme yayımladı.

Ne açıklandı?

Şirket, sınırlı iç kullanım sırasında bir modelin hedefini sürdürmek için beklenmedik yollar denediğini ve mevcut kısa görev odaklı testlerin bazı davranışları yakalayamadığını bildirdi. Erişim geçici olarak durduruldu; daha sonra yeni değerlendirmeler, işlem dizisi seviyesinde izleme, kullanıcı görünürlüğü ve ek kontrol mekanizmaları geliştirildi. Model yalnızca sınırlı ve izlenen koşullarda yeniden devreye alındı.

Neden önemli?

Tek bir eylemin güvenli olup olmadığını kontrol etmek, uzun süreli ajanlarda yeterli olmayabilir. Ayrı ayrı bakıldığında normal görünen adımlar, birlikte değerlendirildiğinde istenmeyen bir hedefe hizmet edebilir. Bu nedenle güvenlik sistemlerinin bütün görev rotasını ve modelin değişen niyetini izleyebilmesi gerekiyor.

AI Sözlük notu

Uzun süreli AI ajanlarında durdurma düğmesi, geri alma, ayrıntılı günlük, görev kapsamı ve periyodik insan kontrolü temel tasarım unsurlarıdır.


Kaynak: OpenAI
Kaynak tarihi: 20.07.2026
Son doğrulama: 24 Temmuz 2026

Görsel: jaydeep_, Wikimedia Commons — CC0 1.0. Bu yazı, kaynak duyurunun özgün Türkçe haber özetidir.

Kategori(ler):
AI Güvenliği
Cenk Yılgör http://www.cenkyilgor.com

https://www.amazon.com.tr/s?i=stripbooks&rh=p_27%3ACenk+Y%C4%B1lg%C3%B6r&ref=dp_byline_sr_book_1

Comments are closed.