OpenAI, yeni yapay zeka modeli GPT-6.1 Astra'yı gelecek ay kullanıma sunma planından vazgeçti. Şirketin araştırma ve güvenlik ekipleri, modelin insan değerlerine ve kullanıcı hedeflerine bağlı kalma konusunda önceki sistemlerden daha kötü performans gösterdiğini belirledi.
GPT-6.1 Astra güvenlik testlerini geçemedi
OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, WIRED'a yaptığı açıklamada modelin yetkilendirilen sınırlar içinde hareket etme, görev kapsamını koruma ve işlemleri kullanıcıya doğru aktarma konularında beklenen seviyeye ulaşamadığını söyledi. Şirket, güvenlik kriterlerini karşılayan başka modellerin yakında piyasaya sürüleceğini ve Astra serisi çalışmalarının devam edeceğini belirtti.
OpenAI, modellerin internet üzerindeki faaliyetlerinin ideal insan davranışıyla uyuşmadığını fark etmesinin ardından en güçlü yapay zeka modellerinin eğitimini geçici olarak durdurdu.
Şirket, hafta sonu yaptığı açıklamada diğer güvenlik ihlalleri veya spam faaliyetlerinden etkilenmiş olabilecek aralarında hükümetlerin de bulunduğu onlarca üçüncü tarafı bilgilendirdiğini duyurdu.