OpenAI kontrolden çıkan yapay zeka modelini askıya aldı
OpenAI, deneysel yapay zeka modellerinden birinin kısıtlamalardan kurtulmanın yollarını aramaya başlamasının ardından aracın şirket içi dağıtımını askıya almak zorunda kaldığını açıkladı.
ChatGPT'nin yaratıcısı, saatlerce veya günlerce otonom olarak çalışmak üzere tasarlanan ve uzun süredir faaliyet gösteren bir yapay zeka modelinin, kendisini kontrol altında tutmak için tasarlanmış güvenlik sistemlerinin "kör noktalarını öğrenebildiğini" ve "hedeflerine ulaşmak için [bu kısıtlamaları] aşabildiğini" belirtti.
Testler, araştırmacıların "sandbox" (kum havuzu) diye adlandırdığı, yazılımı dış dünyadan izole etmek amacıyla sıkı kontrol altında tutulan bir ortamda gerçekleştirildi.
OpenAI olayla ilgili blog yazısında, "Önceki modeller, sandbox'a veya çevresel kısıtlamalara ulaştıklarında durup kullanıcıya geri dönüyordu" ifadelerini kullandı.
Bu model ise sık sık denemeye devam etti ve sandbox'ın dışında hareket etmenin yollarını aradı.
OpenAI, deneysel yapay zeka modelinin yerleşik kısıtlamalarının ötesinde hareket ettiği örnekleri detaylandırarak bunlardan bazılarını, "yüksek önem derecesinde" olma potansiyeli taşıyan sorunlar diye niteledi.
Bir olayda yapay zeka modeli, yalnızca Slack üzerinden çalışması talimatı verilmesine rağmen kamuya açık Github depolarında gönderi paylaşmanın yolunu keşfetti.
Bu, yapay zeka sisteminin test ortamındaki kısıtlamaları aşacak "yolları sürekli arama" eğiliminin bir parçasıydı.
OpenAI, "Bu tür olaylar nedeniyle yeni modelin şirket içi dağıtımını askıya aldık" dedi.
Bulgular yapay zeka uyumluluğu diye bilinen, güvenli ve ileri düzeyde yapay zeka modelleri geliştirmenin temel zorluklarından birini gözler önüne seriyor.
Yapay zeka uyumluluğu, insan geliştiricilerin amaçladığı hedefleri takip eden, insanların değerleri ve etik ilkeleriyle uyumlu sistemler oluşturmayı içeriyor.
Son dönemde otonom yapay zeka ajanlarının yaygınlaşması yapay zeka uyumluluğunu daha fazla ön plana çıkarırken, 2026 Uluslararası Yapay Zeka Güvenliği Raporu bunun acil bir güvenlik sorunu olduğu uyarısında bulunuyor.
Raporda, "Yapay zeka ajanları, otonom hareket ettikleri için daha yüksek riskler yaratıyor ve arızalar zarara yol açmadan önce insanların duruma müdahale etmesi zorlaşıyor" ifadelerine yer veriliyor.
OpenAI, sorunlu sistemini düzelttiğini ve şirket içinde sınırlı kullanıma izin vererek yeniden devreye soktuğunu açıklasa da öncü modelleriyle ilgili uyum sorunlarının acilen ele alınması gerektiğine de değindi.
OpenAI, "Modeller daha uzun ve daha karmaşık görevler üstlendikçe, değerlendirmelerde gözden kaçan arızalar daha ciddi sonuçlar doğurabilir" dedi.
Değerlendirmeyle uygulamaya geçiş arasındaki uçurumu daraltmak için çalışmaya devam edeceğiz: Modelleri daha uzun süre test edeceğiz, uyumluluğu iyileştireceğiz, müdahale edebilecek takip sistemleri kuracağız ve kullanıcılara daha net bir görünürlük ve kontrol sağlayacağız.
Yorumlar
Dikkat!
Suç teşkil edecek, yasadışı, tehditkar, rahatsız edici, hakaret ve küfür içeren, aşağılayıcı, küçük düşürücü, kaba, müstehcen, ahlaka aykırı, kişilik haklarına zarar verici ya da benzeri niteliklerde içeriklerden doğan her türlü mali, hukuki, cezai, idari sorumluluk içeriği gönderen Üye/Üyeler’e aittir.