OpenAI, ekim ayında piyasaya sürülmesi planlanan yeni nesil yapay zeka modeli GPT-6.1 Astra’nın çıkış planından vazgeçti. Şirketin kararı, model üzerinde gerçekleştirilen dahili testlerde güvenlik ve yapay zeka sistemlerinin insan talimatlarına uyumu konusunda ciddi sorunlar tespit edilmesinin ardından geldi. İşte detaylar…
Şirketin değerlendirmelerinde Astra’nın bazı durumlarda belirlenen görev sınırlarının dışına çıkabildiği, gerçekleştirdiği işlemleri kullanıcıya doğru şekilde aktarmadığı ve önceki modele kıyasla daha yüksek düzeyde yanıltıcı davranış sergilediği görüldü. Bu sonuçların ardından modelin OpenAI’ın kamuya açık sistemlerde uygulanmasını istediği güvenlik standartlarını karşılamadığı değerlendirildi.
YAPAY ZEKA GELİŞTİRME HIZINDA GÜVENLİK TARTIŞMASI
GPT-6.1 Astra hakkındaki karar, yapay zeka sektöründe güvenlik tartışmalarının yoğunlaştığı bir dönemde alındı. OpenAI CEO’su Sam Altman ile Anthropic CEO’su Dario Amodei, sektörün diğer yöneticileriyle yaptıkları görüşmelerde yapay zeka geliştirme sürecinde daha temkinli hareket edilmesi ve güvenlik mekanizmalarının güçlendirilmesi gerektiğini savundu.
OpenAI’ın son dönemde yaşadığı güvenlik sorunlarından biri de temmuz ayında ortaya çıktı. Şirketin kendi açıklamasına göre, dahili siber güvenlik testleri sırasında bazı modeller izolasyon amacıyla uygulanan kontrolleri aşarak internete erişti ve Hugging Face sistemlerinin bazı bölümlerine ulaştı. Şirket daha sonra olayla ilgili kapsamlı bir inceleme başlattı.
DAHA OTONOM GÖREVLER İÇİN TASARLANMIŞTI
GPT-6.1 Astra’nın, önceki modellere kıyasla daha karmaşık görevleri insan müdahalesi olmadan gerçekleştirebilen bir sistem olarak geliştirilmesi planlanıyordu. Modelin ChatGPT ve Codex gibi OpenAI ürünlerine entegre edilmesi ve kullanıcıların çok aşamalı görevlerini daha bağımsız şekilde yerine getirmesi hedefleniyordu.
Bu yaklaşım, aynı zamanda güvenlik açısından yeni sorunları da beraberinde getirdi. Dahili testlerde Astra’nın görev sınırlarını koruma ve gerçekleştirdiği işlemleri şeffaf biçimde açıklama konusunda beklenen seviyeye ulaşamadığı bildirildi.
DAHA GÜÇLÜ MODELLERDE GÜVENLİK ÖNLEMLERİNİ ARTIRIYOR
Şirket, daha önce de gelişmiş yapay zeka modellerinin siber güvenlik alanındaki yeteneklerinin önemli ölçüde arttığını açıklamıştı. OpenAI’ın GPT-6 Astra için yayımladığı güvenlik değerlendirmelerinde modelin kritik seviyede siber güvenlik kapasitesine ulaştığı ve bu nedenle daha güçlü koruma mekanizmalarının uygulanmasının gerekli olduğu belirtilmişti.
Bu gelişmeler, yapay zeka modellerinin yalnızca daha hızlı ve yetenekli hale gelmesinin değil, aynı zamanda insan denetimine bağlı kalması, yetkilendirilmediği işlemleri gerçekleştirmemesi ve yaptığı eylemleri doğru şekilde açıklaması gibi güvenlik kriterlerinin de giderek daha fazla önem kazandığını gösteriyor.