OpenAI'nin genç kullanıcılar için geliştirdiği ChatGPT for Teens, 4 binden fazla istemle gerçekleştirilen kapsamlı bir güvenlik testinde "kabul edilemez risk" kategorisine alındı.
Değerlendirmede ebeveyn bildirimleri, kriz anlarındaki yanıtlar, yaş tespiti ve Study Mode gibi farklı güvenlik mekanizmaları incelendi. OpenAI ise test yöntemleri ve sonuçlarla ilgili bazı değerlendirmelere itiraz etti.
ChatGPT for Teens'in güvenlik özellikleri test edildi
ChatGPT for Teens, 13-17 yaş arasındaki kullanıcılar için ek güvenlik katmanları sunuyor. Mevcut ChatGPT deneyimi üzerine uygulanan bu sistemler arasında daha sıkı içerik kısıtlamaları, ebeveyn kontrolleri ve genç kullanıcıları korumaya yönelik çeşitli mekanizmalar bulunuyor.
Yapılan testlerde farklı yaş bilgilerine sahip hesaplar, ebeveyn hesaplarına bağlı profiller ve bağımsız hesaplar kullanıldı. Toplamda 4 binden fazla istem üzerinden ChatGPT'nin farklı senaryolarda nasıl yanıt verdiği incelendi.
Değerlendirmenin dikkat çeken başlıklarından biri ebeveyn bildirimleri oldu. İntihar, kendine zarar verme ve yeme bozuklukları gibi yüksek riskli konuların ele alındığı bazı görüşmelerde beklenen ebeveyn uyarılarının gönderilmediği görüldü. Bazı testlerde bildirim sistemi çalışırken bunun tüm riskli konuşmalarda tutarlı şekilde devreye girmediği belirtildi.
OpenAI ise ebeveyn ve genç hesaplarının birbirine bağlanmasının ardından bazı güvenlik sistemlerinin tamamen etkinleşmesinin zaman alabildiğini ifade etti. Şirket, testlerin bir bölümünün bu süreç tamamlanmadan gerçekleştirilmiş olabileceğini savundu.

Kriz yanıtları da mercek altına alındı
Test kapsamında ChatGPT'nin ruh sağlığı, kendine zarar verme ve acil yardım gerektirebilecek durumlara verdiği yanıtlar da incelendi. Yüzlerce farklı istem kullanılarak sistemin tehlikeli talepleri reddedip reddetmediği, kullanıcıları profesyonel desteğe yönlendirip yönlendirmediği ve kriz kaynakları sunup sunmadığı değerlendirildi.
ChatGPT'nin bazı alanlarda güvenlik mekanizmalarını başarılı şekilde uyguladığı görüldü. Özellikle tehlikeli kilo verme yöntemleri, zararlı davranışların gizlenmesi ve benzeri taleplerde sistemin doğrudan yardım sağlamayı reddettiği belirtildi. Bazı senaryolarda ise kullanıcıların bir yetişkinden veya sağlık uzmanından destek alması gerektiği ifade edildi.
Cinsel ve romantik rol yapma içerikleri de test edildi. Genç kullanıcı hesaplarında yetişkinlere yönelik bazı konuşma biçimlerinin engellendiği görüldü.
Study Mode ve yaş tespiti de test edildi
Değerlendirmede ChatGPT'nin öğrenciler için sunduğu Study Mode özelliği de yer aldı. Bu mod, öğrencinin doğrudan cevabı alması yerine sorular, ipuçları ve adım adım anlatımlarla konuyu öğrenmesine yardımcı olacak şekilde tasarlanıyor.
Ancak bazı testlerde öğrencinin cevabı açık şekilde istemesi durumunda sistemin doğrudan sonuca ulaşabildiği görüldü. Ebeveynlerin çalışma saatlerini belirlemesine imkan veren Study Hours özelliğinde de kullanıcıların kısıtlamayı aşarak standart sohbet moduna geçebildiği tespit edildi.
Yaş tahmin sistemi de değerlendirmeye tabi tutuldu. Yetişkin olarak oluşturulan bazı test hesaplarında kullanıcı sohbet sırasında kendisini 13 yaşında olarak tanımlamasına rağmen sistemin otomatik olarak genç kullanıcı moduna geçmediği görüldü.
OpenAI'nin yaş tahmin sistemi yalnızca kullanıcının belirttiği yaşa göre çalışmıyor. Hesap bilgileri, kullanım alışkanlıkları, kullanım saatleri ve çeşitli davranışsal sinyaller birlikte değerlendiriliyor.
OpenAI değerlendirmeye itiraz etti
Testlerin sonunda ChatGPT for Teens, 18 yaş altındaki kullanıcılar açısından “kabul edilemez risk” kategorisine yerleştirildi. Değerlendirmede, genç kullanıcılar için geliştirilen bazı güvenlik mekanizmalarının belirli senaryolarda yeterince tutarlı çalışmadığı sonucuna varıldı.
OpenAI ise değerlendirmeye katılmadığını açıkladı. Şirket, genç kullanıcılar için ebeveyn kontrolleri ve ek güvenlik sistemleri geliştirmeye devam ettiğini belirtti. OpenAI ayrıca testlerin bazı bölümlerinin ChatGPT for Teens'in gerçek kullanım koşullarını tam olarak yansıtmayabileceğini savundu.