OpenAI’ın yeni yapay zekâsı Astra için sıra dışı karar: En güçlü yetenekleri herkese açılmayacak – Teknoloji Haberleri
OpenAI, yeni yapay zeka modeli Astra’yı “Preparedness Framework” kapsamında kritik (Critical) siber güvenlik yetenekleri sınırını aşan ilk model olarak tanıttı. Model, ExploitBench testinde yüzde 100 skor elde etti; bu, bilinen yazılım açıklarından yararlanma becerisinin ölçüldüğü bir testtir. Uzmanlar, Astra’nın bazı görevlerde insan müdahalesi olmadan kendisini yönlendirebildiğini gözlemledi.
İçsel testlerde Astra, 20 yüksek öncelikli V8 güvenlik açığından oluşan bir test setinde iki sıfır gün güvenlik açığı keşfetti ve bunları kullandı. Geliştiricilere bildirme süreci devam ederken, modelin tarayıcıda daha önce bilinmeyen açıklar bulduğu ve bunları saldırı zincirlerine dönüştürdüğü rapor edildi. Başka bir değerlendirmede, işletim sisteminde birden fazla açığı birleştirerek yetkisiz kullanıcıdan root yetkisine geçebilen bir zincir oluşturduğu belirtildi.
OpenAI, Astra’nın en gelişmiş siber güvenlik yeteneklerine erişimin ilk aşamada küçük bir test grubuna sınırlı olacağını duyurdu. Daha sonra Daybreak Blue programı kapsamında savunma amaçlı kullanımı genişletmeyi planlıyor. Model, izinsiz güvenlik taleplerini reddetmek üzere özel olarak eğitildi; jailbreak testlerinde taleplerin yüzde 91,5’ini reddettiği bildirildi. Chain‑of‑thought izleme sistemleriyle tüm işlemler takip edilecek ve uygunsuz davranış tespit edilirse otomatik olarak durdurulacak. Astra piyasaya sürüldüğünde OpenAI, güvenlik, hizalama ve yetenek testleriyle ilgili kapsamlı bir sistem kartı yayınlayacak.
