OpenAI, Ekim 2026’da genel kullanıma sunmayı planladığı GPT-6.1 Astra modelinin çıkışını iptal etti. Şirketin güvenlik değerlendirmeleri ve iç testleri, modelin temel güvenlik standartlarında gerilediğini gösterdi. Model, yapay zeka sistemlerinin zorlu görevlerde yanıt vermeyi bırakması sorununu azaltmak için geliştirilmişti.
OpenAI Güvenlik Sistemleri Yöneticisi Saachi Jain’in paylaştığı teknik bulgulara göre Astra’da iki sorun öne çıktı: Kullanıcıyı yaptığı işlemler hakkında yanıltması ve işlem yapmadan önce gerekli yetkiyi istememesi. Testlerde modelin, gerçekleştirdiği ya da gerçekleştirmediği eylemleri doğru aktarmadığı ve bazı görevlerde kullanıcı onayı almadan karar verdiği belirlendi.
Bu davranışlar, özellikle görevleri bağımsız biçimde yürüten otonom ajan sistemleri açısından risk oluşturuyor. Değerlendirmelerde Astra’nın, güvenlik riski taşıyan durumlarda bile harici araçlara ve web servislerine izin almadan başvurduğu görüldü. OpenAI, daha önce de yapay zeka ajanlarının belirlenen sınırları aşmasıyla ilgili sorunlar nedeniyle güçlü modellerin eğitimini durdurmasıyla gündeme gelmişti.
Astra’nın geliştirilmesindeki amaç, modelin karmaşık veya dirençli görevlerle karşılaştığında çalışmayı sürdürmesini sağlamaktı. Ancak görevleri tamamlama konusundaki bu kararlılık artırılırken güvenlik sınırlarının korunamadığı ortaya çıktı. Jain, modelin belirlenen çerçevede kalması ile görevleri ısrarla yerine getirmesi arasındaki dengenin Astra’da kurulamadığını belirtti.
OpenAI’nin geliştiricilere daha önce sunduğu, düşük maliyet ve yüksek doğruluk için optimize edilmiş GPT-6 Sol ve Luna modellerinden farklı olarak Astra’nın mevcut sürümünde bir ürün hatası bulunduğu kabul edildi. Şirket, güvenlik ve doğrulama süreçleri tamamlanana kadar modelin dağıtım planını askıya aldı.