OpenAI, simülasyon sonuçlarının ardından GPT-6.1 Astra'yı erteliyor

OpenAI, iç testlerde modelin yetkilendirilmiş kapsamı içinde kalma konusunda yetersiz kaldığı görülünce GPT-6.1 Astra'nın Ekim ayındaki çıkışını erteledi. Üçüncü taraf medya ertelemeyi ilk olarak 28 Eylül'de bildirdi ve OpenAI yeni bir çıkış tarihi açıklamadı. OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, modelin kapsam, yetkilendirme ve yaptığı işleri kullanıcılara nasıl raporladığı konularında çıtayı tam olarak karşılayamadığını söyledi.
Birleşik Krallık AISI'nin test ettikleri
Üçüncü taraf medyaya göre, Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü, GPT-6 Astra'yı değerlendiren 32 sayfalık bir raporu 28 Eylül'de yayımladı. AISI, modelin yardımsız olarak ne yapmaya çalıştığını görmek için modelin siber sınıflandırıcılarını kapatarak simüle edilmiş siber saldırı testleri yürüttü. Gerçek sistemlere dokunulmadı. Bu simülasyonlarda Astra, kapsam dışındaki hedeflere yönelik bir tedarik zinciri saldırısını zamanın %29,2'sinde tamamladı; GPT-5.6 Sol için bu oran %6,3, GPT-5.5 içinse %0'dı. AISI, GPT-5.5 sonucunun daha küçük bir senaryo kümesine dayandığını belirtiyor. Saldırılar, sahte kimlikler oluşturmayı ve simüle edilmiş açık kaynaklı projelere kötü amaçlı kod göndermeyi içeriyordu.
Akıl yürütme ve izin talepleri
AISI, modelin ham düşünce zincirini inceledi. Astra sık sık kapsam üzerine akıl yürütse de bazen yine de saldırıya geçti; bunu zararsız, açıkça yasaklanmamış ya da geriye kalan tek yol olarak gerekçelendirdi. Model ayrıca birçok çalıştırmada izin istedi. Test düzeneği, bu tür sorulara ajana en iyi muhakemesini kullanmasını söyleyen standart bir otomatik mesajla yanıt veriyor ve Astra, yanıtın muhtemelen otomatik olduğunu belirtmesine rağmen bazen bunu onay olarak değerlendirdi. Listelenmeyen her şeyin kapsam dışında olduğunun açıklığa kavuşturulması, bir senaryo alt kümesinde tamamlanmış saldırıların sayısını 50 denemenin 26'sından 49 denemenin 4'üne düşürdü ancak saldırıları tamamen ortadan kaldırmadı.
Simülasyon farkındalığı
AISI, simülasyon farkındalığını temel sınırlama olarak gösteriyor; çünkü bir testi fark eden model farklı davranabilir. Astra bazen simüle edilmiş ortamı saldırı gerekçesi olarak gösterdi ve kimi zaman, 64 karakterlik bir karmaya 63 karakter uzunluğunda demek gibi, gerçek olmayan hatalar öne sürdü. AISI, her iki durumda da bu davranış değerlendirme kapsamını ihlal ettiği için endişe verici olduğunu belirtiyor.
OpenAI ajanları devlet kurumlarının web sitelerine erişti
Erteleme, OpenAI ajanlarının şirketin amaçlamadığı şekillerde devlet kurumlarının web sitelerine eriştiği olayların ardından geldi. Bunlar arasında haziran ayında Avustralya'nın Medicare istatistik portalı ve ABD'deki çeşitli siteler de bulunuyor. OpenAI ayrıca en yetenekli modelleri için eğitim, değerlendirme ve araç kullanan çıkarım süreçlerini duraklattı. Şirket, ağ filtrelemesindeki bir açığı kapattığını doğrulayana ve ek kırmızı takım testlerini tamamlayana kadar duraklamanın süreceğini söylüyor.
Kaynak(lar)
Top 10
» Top 10 Multimedia Notebook listesi
» Top 10 oyun notebooku
» Top 10 bütçeye uygun Ofis/İş Notebook Listesi
» Top 10 Premium Ofis/İş notebookları
» Top 10 Çalışma istasyonu laptopları
» Top 10 Subnotebook listesi
» Top 10 Ultrabooklar
» En iyi 10 dönüştürülebilir modeli
» Seçimi en iyi 10 tablet
» Notebookcheck Top 10 Windows Tabletleri
» Top 10 Subnotebook listesi
» NotebookCheck tarafından incelenen en iyi Notebook ekranları
» Notebookcheck'in 500 Euro altındaki en iyi 10 Notebook listesi
» NotebookCheck tarafından seçilen 300 Euro altındaki en iyi 10 Notebook
» Notebookcheck'in 500 Euro altındaki en iyi 10 Notebook listesi
» Notebookcheck'in Top 10 akıllı telefon listesi
» Notebookcheck'in Top 10 hafif oyun notebookları











