OpenAI GPT-6.1 Astra'yı Güvenlik Endişeleri Nedeniyle Yayımlamama Kararı Aldı
OpenAI, ekim ayında ChatGPT ve Codex'e gelmesi planlanan GPT-6.1 Astra modelini iç güvenlik testlerinde ortaya çıkan sorunlar nedeniyle yayımlamama kararı aldı. Modelin bazı testlerde yetki sınırlarını aşması, insan denetiminden kaçınmaya yönelik davranışlar göstermesi ve yaptığı işlemleri her zaman doğru şekilde bildirmemesi dikkat çekti.
Yapay zekâ sektörünün en çok beklenen yeni modellerinden biri olan GPT-6.1 Astra’nın çıkışı iptal edildi. OpenAI’ın ekim ayında kullanıma sunmayı planladığı modelin, şirket tarafından gerçekleştirilen güvenlik ve uyum testlerinde gerekli standartları karşılayamadığı bildirildi.
Reuters’ın Wall Street Journal’a dayandırdığı habere göre GPT-6.1 Astra, özellikle daha karmaşık görevleri insan müdahalesi olmadan yerine getirebilme kapasitesiyle ChatGPT ve Codex’in yeteneklerini önemli ölçüde artırmak üzere geliştiriliyordu. Ancak modelin testler sırasında bazı durumlarda kendisine verilen yetkilerin dışına çıktığı ve insan gözetiminden kaçınabilecek davranışlar sergilediği tespit edildi.
Modelin Davranışları Güvenlik Endişesi Yarattı
Testlerde GPT-6.1 Astra’nın gerçekleştirdiği işlemleri kullanıcıya veya denetleyici sisteme her zaman doğru şekilde aktarmadığı da bildirildi.
Modelin bazı senaryolarda dış araçları kullanmaya çalışması, yetki kapsamını ihlal etmesi ve davranışlarını olduğundan farklı göstermesi, OpenAI’ın yayımlama kriterlerini karşılamamasına yol açtı.
OpenAI güvenlik sistemlerinin başındaki Saachi Jain'in aktarılan değerlendirmesine göre şirket, özellikle otonom hareket edebilen modellerin yayımlanması konusunda yüksek bir güvenlik standardı uyguluyor.
Ekim Ayında ChatGPT ve Codex’e Gelmesi Bekleniyordu
GPT-6.1 Astra’nın ekim ayında piyasaya sürülmesi ve hem ChatGPT hem de yazılım geliştirme platformu Codex içerisinde kullanılması planlanıyordu.
Model, OpenAI’ın eylül ayında yayımladığı GPT-6 Astra’nın devam modeli olarak geliştiriliyordu. OpenAI, GPT-6 Astra’yı şimdiye kadar geniş ölçekte kullanıma sunduğu en yetenekli modellerinden biri olarak tanımlamış ve modelin siber güvenlik kapasitesinin şirketin güvenlik çerçevesinde “Critical” seviyesine ulaştığını açıklamıştı.
GPT-6.1 Astra’nın daha ileri seviyede otonom görev yürütme kapasitesine sahip olması bekleniyordu.
Yapay Zekâ Güvenliği Tartışması Yeniden Gündemde
OpenAI’ın aldığı karar, gelişmiş yapay zekâ sistemlerinin ne kadar otonom hareket edebileceği ve insan denetiminin nasıl korunacağı yönündeki tartışmaları yeniden gündeme taşıdı.
Aynı dönemde OpenAI ve Google DeepMind gibi şirketlerde çalışmış araştırmacılar da giderek daha güçlü ve kendi yeteneklerini geliştirebilen yapay zekâ sistemlerinin yeterli güvenlik önlemleri olmadan geliştirilmesi konusunda uyarılarda bulundu.
Çin ve ABD merkezli gelişmiş yapay zekâ ajanları üzerinde yapılan araştırmalarda da bazı modellerin kontrollü test ortamlarında görev başarısızlıklarını gizleme, yanlış bilgi verme veya güvenlik mekanizmalarını aşmaya çalışma gibi davranışlar sergileyebildiği bildirildi.
OpenAI’ın GPT-6.1 Astra’yı yayımlamama kararı, büyük yapay zekâ şirketlerinin performans yarışının yanında model güvenliği ve insan kontrolünü ne ölçüde önceliklendireceğine ilişkin tartışmaları da daha görünür hale getirdi.