OpenAI Astra: Kritik Siber Yetenek ve Güvenlik Önlemleri
OpenAI, 7 Ağustos 2026’da Astra için “kritik siber güvenlik yeteneklerini dışlayamıyoruz” değerlendirmesini paylaştı. 1 Eylül’de modelin Critical eşiğini karşıladığına karar verdiğini açıkladı; 3 Eylül’de GPT-6 Astra’nın yayımlanmasını duyurdu. Ağustos ön değerlendirmesi ile Eylül sonucu farklı aşamalardır.
“Kritik Yetenek” Ne Demek?
Bu ifade OpenAI’nin Preparedness Framework içindeki yetenek sınıflandırmasıdır. Uygun araç ve erişimle, iyi korunan sistemlerde yeni açıkları bulup istismar yolları geliştirebilme kapasitesini anlatır. Bütün üretim konuşmalarında saldırı gerçekleştiği veya ürünün her isteğe izin verdiği anlamına gelmez.
Ağustos–Eylül 2026 Zaman Çizelgesi
| Tarih | Açıklama |
|---|---|
| 7 Ağustos | Ön testlerde Critical yetenek dışlanamadı; daha sıkı kontroller duyuruldu. |
| 28 Ağustos | Yeni gereksinimler sonrası büyük bir RL eğitimi yeniden başladı. |
| 1 Eylül | Critical eşiğin karşılandığı değerlendirmesi yayımlandı. |
| 3 Eylül | GPT-6 Astra yayımı ve güvenlik özeti duyuruldu. |
1 Eylül açıklaması bazı küçük deneysel eğitimlerin hâlâ bekletildiğini belirtiyor. Bu durum, bütün Astra geliştirmesinin süresiz durdurulduğu anlamına gelmiyor. OpenAI ayrıca Astra’nın Hugging Face olayındaki model olmadığını açıkça söylüyor.
Koruma Önlemleri ve Sınırları
OpenAI; geliştirme izolasyonu, erişim kontrolleri, güvenlik eğitimi ve yetkisiz davranışı tespit etmeye yönelik izlemeyi güçlendirdiğini bildiriyor. Bunlar sağlayıcının kendi değerlendirmeleri. Güvenlik özeti, modelin düşünce sürecini izlenebilir kılmanın bazı saldırgan test koşullarında zorlaştığını da belirtiyor; önlemler hatasızlık garantisi değildir.
İç güvenlik çerçevesini bağımsız düzenleyici onayıyla eş tutmamak gerekir. Yetenek sınıflandırması, kötüye kullanım korumalarının değerlendirmesi ve gerçek ürün erişimi ayrı sorulardır. Güncel erişim için ürünün resmî sürüm notlarına ve hesabınızdaki seçeneklere bakın; geçmiş duyuruyu bugünkü kullanılabilirlik olarak okumayın.
Kurumsal Ekipler İçin Kontrol Listesi
- Ajanın dosya, araç ve ağ erişimini görev için gereken kapsamla sınırlandırın.
- Üretim değişiklikleri, veri paylaşımı ve yetki genişletme için insan kontrol noktaları belirleyin.
- Model sürümü değişirken temsilî iş akışlarını yeniden deneyin; önceki sürümün davranışını varsaymayın.
- Uygulamanın kimlik bilgilerini ve veri kaynaklarını model çıktısından ayrı koruyun.
- Hatalı veya kapsam dışı eylemler için durdurma, kayıt inceleme ve geri dönüş süreci oluşturun.
Bu maddeler ürün seçimi için bir değerlendirme çerçevesidir; belirli bir modelin veya şirketin güvenlik durumuna ilişkin bağımsız denetim sonucu değildir. Prompt injection rehberi dış içerikten gelen talimatların riskini açıklıyor.
Sık Sorulan Sorular
Ağustos açıklaması kesin Critical sınıflandırması mıydı?
Hayır. Ağustos’ta ihtimal dışlanamıyordu; kesin sınıflandırma 1 Eylül açıklamasında yer aldı.
Astra hâlâ hiç yayımlanmamış bir model mi?
Bu yazıdaki eski ifade güncel değil: 3 Eylül’de GPT-6 Astra yayımı duyuruldu. Hesap ve plan bazındaki erişim ayrıca kontrol edilmelidir.
Critical sınıflandırması normal kullanımdaki saldırı oranı mı?
Hayır. Belirli araç ve test koşullarındaki yeteneği anlatır; her kullanıcı oturumunda aynı davranışın gerçekleştiğini göstermez.
Kaynaklar ve İleri Okuma
- OpenAI: 7 Ağustos ön değerlendirmesi
- OpenAI: 1 Eylül Astra güvenlik değerlendirmesi
- OpenAI: 3 Eylül GPT-6 Astra güvenlik özeti
- OpenAI: Resmî ChatGPT sürüm notları




