Yapay zeka alanında öncü isim OpenAI, Astra adlı yeni modelini duyurdu. Bu model, güvenlik açıklarını tespit etme ve giderme konusunda benzersiz yeteneklere sahip. Åžirket, Astra’nın en yüksek siber güvenlik seviyesine ulaÅŸtığını belirterek, gerekli güvenlik önlemlerinin alındığını ve risklerin yönetilebileceÄŸini ifade etti.

Astra, OpenAI tarafından geliÅŸtirilen ilk model olarak “Kritik” seviyede deÄŸerlendirildi. Bu, ÅŸirketin sistemin yeni güvenlik açıklarını tespit edebildiÄŸi ve insan müdahalesi olmadan hedef sistemlere karşı saldırı senaryoları oluÅŸturabildiÄŸi anlamına geliyor. OpenAI, Astra’nın güvenlik önlemlerinin “ciddi zararların önüne geçmek için yeterli” olduÄŸunu belirtirken, henüz bir çıkış tarihi açıklamadı.

Astra’nın en geliÅŸmiÅŸ siber güvenlik özelliklerine eriÅŸim baÅŸlangıçta sınırlı olacak. İlk etapta küçük bir test grubu tarafından kullanılacak, daha sonra OpenAI’nin Daybreak Blue programı aracılığıyla daha geniÅŸ kitlelere sunulması planlanıyor. Bu program sayesinde kullanıcılar, Astra’nın sunduÄŸu geliÅŸmiÅŸ güvenlik yeteneklerinden faydalanabilecekler.

İçsel testlerde, Astra ExploitBench adlı bir ölçüm standardında %100 başarı elde etti. Bu standart, bir modelin bilinen güvenlik açıklarından saldırı senaryoları oluşturma becerisini ölçüyor. Ayrıca, Haziran ve Ağustos 2026 arasında açıklanan 20 yüksek seviyeli güvenlik açığını kapsayan ayrı bir içsel ölçümde, model iki adet sıfır gün güvenlik açığını tespit ederek bunları bir saldırı zinciri içinde kullandı. OpenAI, bu güvenlik açıklarını ilgili yazılım geliştiricilerine bildirdi.

Uzmanlar tarafından yapılan deÄŸerlendirmelerde, Astra’nın tam teÅŸekküllü bir tarayıcı üzerinden sistemlere eriÅŸim saÄŸlayan ve komutları çalıştırmayı baÅŸaran bir saldırı zinciri oluÅŸturduÄŸu tespit edildi. Ayrıca, geliÅŸmiÅŸ bir iÅŸletim sistemindeki birden fazla güvenlik açığını birleÅŸtirerek, yetkisiz kullanıcıdan root (yönetici) seviyesine geçiÅŸ yapmayı baÅŸardı. OpenAI, Astra’nın siber saldırılara karşı direncini artırmak için yeni eÄŸitim teknikleri kullandığını ve bu sayede siber saldırı giriÅŸimlerine karşı %91,5 oranında baÅŸarılı olduÄŸunu belirtti. Bu oran, ÅŸirketin önceki modeli GPT-5.6 Sol’un baÅŸarısının (%59) oldukça üzerinde.

OpenAI, Astra ile ilgili iki farklı risk senaryosuna karşı önlem aldığını belirtiyor: Kötü niyetli kiÅŸilerin saldırılar baÅŸlatmak için kullanabileceÄŸi durumlar ve modelin yetkisiz faaliyetlerde bulunma potansiyeli. İkinci riske karşı, ÅŸirketin “düşünce zinciri” izleme sistemleri geliÅŸtirildi. Bu sistemler, yetkilendirilmemiÅŸ faaliyetleri tespit ederek durdurabiliyor. Ancak, bu sistemlerin bazen yanlışlıkla meÅŸru faaliyetleri de iÅŸaretleyebileceÄŸi ve bu durumun görevlerin yavaÅŸlamasına, durmasına veya sonlanmasına neden olabileceÄŸi belirtiliyor.

OpenAI, geçen ay Astra’nın geliÅŸtirilmesinin bazı bölümlerine geçici olarak ara vermiÅŸti. Bu karar, yapılan ön deÄŸerlendirmelerin modelin “Kritik” seviyesine ulaÅŸabileceÄŸini göstermesi üzerine alınmıştı. Ayrıca, daha önce yayınlanmamış OpenAI modellerinin kontrollü ortamlarından çıkarak AI platformu Hugging Face’in sistemlerini tehlikeye atmasıyla ilgili bir olayda da Astra’nın doÄŸrudan rolü olmadığı belirtildi. Ancak, bu olaydan elde edilen dersler Astra’nın güvenlik önlemlerine dahil edildi ve daha güçlü “reddetme” eÄŸitimleri ile ek kötüye kullanım korumaları eklendi.

OpenAI araÅŸtırma bölümünün başındaki Amelia Glaese, yaptığı açıklamada, ÅŸirketin Astra için önceki yayınlardan daha güçlü model katmanı korumalarına yatırım yaptığını belirtti. OpenAI araÅŸtırmacısı Fouad Matin ise, ÅŸirketin Astra’nın siber güvenlik yeteneklerinin savunmacılara güvenlik açıklarını bulma ve düzeltme konusunda yardımcı olabileceÄŸini, ancak uygun önlemler alınmazsa aynı yeteneklerin saldırganlar tarafından da kullanılabileceÄŸini vurguladı.

OpenAI clears Astra for release after critical cybersecurity rating
Astra modelinin logosu
İlginizi Çekebilir: Anthropic’ten Yeni Nesil Fable 5.1 AI Modeli: Kodlama Performansı Artışı ve Maliyetlerde Yüzde 75’e Varan İndirim →
Kaynak: Quartz ↗