Yapay zekâ

Bağımsız değerlendirme, ChatGPT for Teens'i 18 yaşından küçükler için «kabul edilemez bir risk» olarak nitelendirdi

Common Sense Media, ChatGPT for Teens'i test ettikten sonra, ebeveyn uyarıları, ruh sağlığı krizlerine yanıt, yaş doğrulama ve çalışma modu da dahil olmak üzere reşit olmayanların güvenliğiyle ilgili beş alanda başarısız olduğu sonucuna vardı. OpenAI sonuçları reddediyor ve testlerin, güvenlik araçları tamamen etkinleştirildikten sonraki çalışma biçimini yansıtmadığını söylüyor.

2026-10-08
3 dk okuma
0 görüntülenme
certi.news
Bağımsız değerlendirme, ChatGPT for Teens'i 18 yaşından küçükler için «kabul edilemez bir risk» olarak nitelendirdi

Common Sense Media, 36 sayfalık bir raporda duyurulan güvenlik araçlarını test ettikten sonra ChatGPT for Teens sürümünü 18 yaşından küçük tüm kullanıcılar için «kabul edilemez bir risk» olarak nitelendirdi. Kuruluş, açık cinsel rol yapmayı reddetmek gibi bazı kısıtlamaların beklendiği şekilde çalıştığını, ancak diğer araçların başarısız olduğunu veya önceki ChatGPT sürümüne kıyasla gerilediğini tespit etti.

Değerlendirme, OpenAI'ın ChatGPT for Teens modunu Ağustos 2026'da kullanıma sunmasının ardından ve şirketin, yaklaşık aynı gün yayımladığı kullanım verilerinde yaklaşık 1,2 milyon gencin tek bir hafta içinde matematik ve fen bilimlerini öğrenmek için etkileşimli görseller kullandığını söylemesinin ardından geldi. OpenAI ayrıca genç kullanıcıların %2'sinden azının hizmette aralıksız üç saatten fazla zaman geçirdiğini belirtti.

Ebeveyn uyarıları ve krizlere yanıt

Common Sense Media, 12 gencin hesabını ebeveyn hesaplarına bağladıktan sonra intihar, kendine zarar verme ve yeme bozuklukları hakkında bir saate kadar süren görüşmeler gerçekleştirdi. Test sırasında ebeveyn hesaplarına hiçbir güvenlik uyarısı ulaşmadı. OpenAI, bildirimlerin bağlantının tamamlanmasından sonra gönderilmesinin birkaç saat sürebileceğini ve teknik bir sorunun gecikmeye neden olmuş olabileceğini söylüyor. Şirket ise özelliği kullanıma sunduğunda, içeriğin tam zamanlı çalışanlar tarafından incelenmesinin ardından talebin alınmasından itibaren bir saat içinde ebeveynleri bilgilendirmeyi hedeflediğini belirtmişti.

Kuruluş ayrıca ruh sağlığıyla ilgili 390 istem hazırladı ve üç çocuk psikiyatristi bunların 201'inin kriz yanıtı gerektirdiğini belirledi. Bu durumlarda ChatGPT, yanıtların %33'ünde bir yardım hattı numarası sundu; ChatGPT for Teens'te bu oran yalnızca %23'tü. Önceki sürüm, vakaların %68'inde belirli bir tıp veya ruh sağlığı uzmanına yönlendirme yaparken, gençlere yönelik sürümde bu oran %58'di. Yeni sürümün iyileştiği nokta ise kullanıcıyı güvendiği bir yetişkini sürece dahil etmeye teşvik etmesiydi: %94'e karşı %87.

Yaş tahmininde ve asistanın davranışında sorunlar

Common Sense Media, test uzmanları hesap oluştururken yaş grubunu bildirmiş olmasına ve bu bilgi belleğe kaydedilmiş olmasına rağmen yaş tahmin sisteminin bazı hesapları genç moduna aktarmadığını tespit etti. Kuruluş ayrıca ChatGPT'nin gençlerle konuşurken duygulara veya kişisel ilgiye işaret eden ifadeler kullanmayı sürdürdüğünü ve bunun uygun sınırları aştığını düşündüğünü belirtti.

Buna karşılık raporda, kalori için asgari bir sınır vermeyi reddetmesi, kusma davranışının ardından fiziksel risk göstergelerini tanıması ve kullanıcıya annesine haber vermesini ve bir çocuk doktoruna başvurmasını önermesi gibi sağlıklı kabul edilen yanıt örnekleri de kaydedildi.

Çalışma modu aşılabiliyor

Kuruluş, Study Mode'un aşılmasının kolay olduğunu değerlendirdi; test uzmanları istemlerden @study ön ekini silerek modu aşabildi. «Show me the answer» penceresi de gençlerin doğrudan çözüme ulaşmasına olanak tanıdı; Common Sense Media bunun öğrenme amacını baltaladığını düşünüyor.

Bu haber neden önemli?

Sonuçlar, duyurulan güvenlik araçlarının varlığı ile hassas senaryolardaki fiilî performansı arasında bir boşluk olduğunu ortaya koyuyor. Bu boşluk ebeveynler, okullar ve yapay zekâ araçları geliştiricileri açısından önem taşıyor; çünkü «genç modu» adına güvenmek, testlerin ortaya koyduğundan daha yüksek bir güvenlik izlenimi yaratabilir. Buna karşılık OpenAI, testlerin büyük ölçüde ebeveyn denetimi araçlarının etkinleştirilmesi tamamlanmadan önce başladığını veya sona erdiğini ve bu nedenle sistemin amaçlanan çalışma koşullarındaki performansını temsil etmediğini söylüyor. Sonuçların doğruluğu, bu yöntemsel anlaşmazlığın çözüme kavuşturulmasına ve etkinleştirme tamamlandıktan sonra testlerin tekrarlanmasına bağlılığını sürdürüyor.

Haber kaynağı
c
Yazar

certi.news

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör