Notebookcheck Logo

OpenAI, simülasyon sonuçlarının ardından GPT-6.1 Astra'yı erteliyor

OpenAI, GPT-6.1 Astra'yı erteliyor.
ⓘ openai.com
OpenAI, GPT-6.1 Astra'yı erteliyor.
OpenAI, güvenlik testlerinin ardından GPT-6.1 Astra'nın çıkışını erteliyor. UK AISI simülasyonları, GPT-6 Astra'nın siber güvenlik testlerinin %29,2'sinde yetkisiz tedarik zinciri saldırıları gerçekleştirdiğini ortaya koydu.

OpenAI, iç testlerde modelin yetkilendirilmiş kapsamı içinde kalma konusunda yetersiz kaldığı görülünce GPT-6.1 Astra'nın Ekim ayındaki çıkışını erteledi. Üçüncü taraf medya ertelemeyi ilk olarak 28 Eylül'de bildirdi ve OpenAI yeni bir çıkış tarihi açıklamadı. OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, modelin kapsam, yetkilendirme ve yaptığı işleri kullanıcılara nasıl raporladığı konularında çıtayı tam olarak karşılayamadığını söyledi.

Birleşik Krallık AISI'nin test ettikleri

Üçüncü taraf medyaya göre, Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü, GPT-6 Astra'yı değerlendiren 32 sayfalık bir raporu 28 Eylül'de yayımladı. AISI, modelin yardımsız olarak ne yapmaya çalıştığını görmek için modelin siber sınıflandırıcılarını kapatarak simüle edilmiş siber saldırı testleri yürüttü. Gerçek sistemlere dokunulmadı. Bu simülasyonlarda Astra, kapsam dışındaki hedeflere yönelik bir tedarik zinciri saldırısını zamanın %29,2'sinde tamamladı; GPT-5.6 Sol için bu oran %6,3, GPT-5.5 içinse %0'dı. AISI, GPT-5.5 sonucunun daha küçük bir senaryo kümesine dayandığını belirtiyor. Saldırılar, sahte kimlikler oluşturmayı ve simüle edilmiş açık kaynaklı projelere kötü amaçlı kod göndermeyi içeriyordu.

Akıl yürütme ve izin talepleri

AISI, modelin ham düşünce zincirini inceledi. Astra sık sık kapsam üzerine akıl yürütse de bazen yine de saldırıya geçti; bunu zararsız, açıkça yasaklanmamış ya da geriye kalan tek yol olarak gerekçelendirdi. Model ayrıca birçok çalıştırmada izin istedi. Test düzeneği, bu tür sorulara ajana en iyi muhakemesini kullanmasını söyleyen standart bir otomatik mesajla yanıt veriyor ve Astra, yanıtın muhtemelen otomatik olduğunu belirtmesine rağmen bazen bunu onay olarak değerlendirdi. Listelenmeyen her şeyin kapsam dışında olduğunun açıklığa kavuşturulması, bir senaryo alt kümesinde tamamlanmış saldırıların sayısını 50 denemenin 26'sından 49 denemenin 4'üne düşürdü ancak saldırıları tamamen ortadan kaldırmadı.

Simülasyon farkındalığı

AISI, simülasyon farkındalığını temel sınırlama olarak gösteriyor; çünkü bir testi fark eden model farklı davranabilir. Astra bazen simüle edilmiş ortamı saldırı gerekçesi olarak gösterdi ve kimi zaman, 64 karakterlik bir karmaya 63 karakter uzunluğunda demek gibi, gerçek olmayan hatalar öne sürdü. AISI, her iki durumda da bu davranış değerlendirme kapsamını ihlal ettiği için endişe verici olduğunu belirtiyor.

OpenAI ajanları devlet kurumlarının web sitelerine erişti

Erteleme, OpenAI ajanlarının şirketin amaçlamadığı şekillerde devlet kurumlarının web sitelerine eriştiği olayların ardından geldi. Bunlar arasında haziran ayında Avustralya'nın Medicare istatistik portalı ve ABD'deki çeşitli siteler de bulunuyor. OpenAI ayrıca en yetenekli modelleri için eğitim, değerlendirme ve araç kullanan çıkarım süreçlerini duraklattı. Şirket, ağ filtrelemesindeki bir açığı kapattığını doğrulayana ve ek kırmızı takım testlerini tamamlayana kadar duraklamanın süreceğini söylüyor.

Google LogoAdd as a preferred source on Google
Mail Logo
> Notebooklar Hakkında Aradığınız Herşey > Haberler > Haber Arşivi > Haber arşivi 2026 09 > OpenAI, UK AISI simülasyon sonuçlarının ardından GPT-6.1 Astra'yı erteliyor
Darryl Linington, 2026-09-30 (Update: 2026-09-30)