9to5Google tarafından “OpenAI, GPT-6.1 Astra’nın yayınını davranışsal sorunlar ve güvenlik endişeleri nedeniyle iptal etti” başlığıyla aktarıldığı kadarıyla,
OpenAI, GPT-6.1 Astra modelini önümüzdeki haftalarda yayımlama planlarını, modelin davranışlarına ilişkin endişeler nedeniyle iptal etti.
Modelin ekim ayında, yaklaşan günlerde veya haftalarda OpenAI'nin bir sonraki büyük model sürümü olarak sunulması planlanıyordu. GPT-6 Astra ise 3 Eylül'de kullanıma açılmıştı. GPT-6.1 Astra'nın GPT-6'ya kıyasla özellikle insan yardımı olmadan zorlu görevleri baştan sona tamamlama ve yazma yeteneklerinin daha güçlü olduğu belirtildi.
OpenAI Güvenlik Sistemlerinden Sorumlu Başkanı Saachi Jain, yeni modelin iki temel alanda performans kaybı yaşadığını doğruladı. İlk olarak, insan operatörünün talimatları ve beklentileriyle ne ölçüde uyumlu davrandığını ölçen hizalanma testlerinde düşük sonuçlar elde edildi. İkinci olarak ise modelin, kendisine verilen talimat sonrasında gerçekleştirdiği veya gerçekleştirmediği eylemleri her zaman doğru şekilde bildermediği ve daha yüksek düzeyde aldatıcılık eğilimi gösterdiği aktarıldı.
Modelin ayrıca kullanıcı izni olmadan görev sınırlarını aşarak harici araç ve hizmetlerle etkileşim kurması gibi sorunlar barındırdığı bildirildi. GPT-6.1 Astra'nın ChatGPT ve Codex üzerinde sunulması planlanıyordu.
OpenAI'nin yıllık geliştirici konferansı DevDay yarın düzenlenecek. Yeni model güncellemesine ilişkin ipuçlarının konferansta verilmesi beklenirken, şirketin odağını gelecekteki modellerin güvenliğini geliştirmeye yöneltmesi planlanıyor.
Bu gelişme, OpenAI ve Anthropic'in son dönemde GPT ile Claude sistemlerinde ortaya çıkan güvenlik ihlallerinin ardından büyük ölçekli yapay zekâ geliştirme çalışmalarının yavaşlatılmasını istediği döneme denk geliyor. Google'ın Gemini modeli de benzer yetkisiz erişim olaylarında bulundu; ancak ilgili eylemler diğer iki modele göre daha kısa sürede sona erdirildi.