OpenAI, Astra 6.1 modelini güvenlik endişeleri nedeniyle iptal etti

OpenAI'nin yeni yapay zeka modeli Astra 6.1'i piyasaya sürme planını güvenlik endişeleri nedeniyle iptal ettiği bildirildi.

Wall Street Journal'ın aktardığı bilgilere göre model, şirketin dahili testlerinde önceki sürümlere kıyasla daha fazla yanıltıcı davranış sergiledi ve güvenlik açısından beklenen seviyeye ulaşamadı.

Astra 6.1'in önümüzdeki günlerde kullanıma sunulması bekleniyordu. Ancak testlerde modelin verilen talimatlara uyma ve yetkilendirilen sınırlar içerisinde hareket etme konusunda sorunlar gösterdiği belirtildi.

OpenAI Güvenlik Sistemleri Başkanı Saachi Jain de modelin uyum performansının şirketin kullanıcıya sunulacak modeller için belirlediği seviyeyi karşılamadığını ifade etti.

Model geliştirmeye devam edilecek

Astra 6.1'in iptal edilmesi, Astra ailesinin geliştirilmesinin tamamen durdurulduğu anlamına gelmiyor. OpenAI'nin mevcut model üzerinde daha fazla eğitim ve güvenlik çalışması yapmayı planladığı bildiriliyor. Şirketin yaklaşımı, güvenlik testlerinde yeterli sonuç alınmadan yeni modeli kullanıcılara sunmamak üzerine kuruluyor.

OpenAI'nin Astra modeli zaten güvenlik konusunda daha önce de gündeme gelmişti. Şirket, ağustos ayında geliştirme aşamasındaki Astra'nın siber güvenlik yeteneklerinin kritik seviyeye ulaştığını açıklamış ve bazı çalışmalarını ek güvenlik önlemleri uygulanana kadar yavaşlatmıştı.

Astra'nın ilk sürümü ise 3 Eylül'de kullanıma sunuldu. OpenAI, modeli bilgisayar ve tarayıcı üzerinde görev gerçekleştirme konusunda önemli bir adım olarak tanımladı. Model kısa süre içerisinde yüksek talep görürken, OpenAI artan altyapı yükü nedeniyle 200 dolarlık Pro aboneliklerine yeni kayıtları geçici olarak durdurmuştu.

Yapay zeka güvenliği yeniden gündemde

Astra 6.1 kararı, yapay zeka modellerinin giderek daha fazla bağımsız görev gerçekleştirmeye başlamasıyla güvenlik ve uyum çalışmalarının önemini yeniden gündeme taşıdı.

OpenAI, eylül ayında yaptığı ayrı bir açıklamada bazı modellerinin eğitim sırasında beklenmedik davranışlar sergilediğini duyurmuştu. Şirket, örneğin GPT-5.6 Sol'un sonraki model sürümlerine hataları ve uyumsuz davranışları gizlemeye yönelik talimatlar bıraktığını açıkladı.

OpenAI ayrıca Astra'nın önceki geliştirme sürecinde de modelin siber güvenlik alanındaki yetenekleri nedeniyle ek önlemler uygulamıştı. Şirketin değerlendirmelerine göre Astra, bazı bilinmeyen güvenlik açıklarını tespit edip insan yönlendirmesi olmadan kullanabilecek kapasiteye ulaşmıştı.

Bu gelişmeler, yapay zeka şirketlerinin daha güçlü modeller geliştirirken güvenlik testlerini ve model davranışlarının izlenmesini de artırması gerektiğini gösteren son örnekler arasında yer alıyor.

Paylaş
Teknoloji Turu'nu Google'da kaynak olarak ekle