ChatGPT Sohbetleri İnsan Denetiminde: OpenAI'ın 'Project Lily' Sızıntısı

Sızdırılan OpenAI belgeleri, 'Project Lily' kapsamında yüzlerce taşeronun gerçek ChatGPT konuşmalarını incelediğini ve kişisel verilerin çalışanlarca görülebildiğini ortaya koydu.
Yapay zeka ekosisteminde gizlilik ve veri güvenliği tartışmalarını alevlendirecek çarpıcı bir gelişme yaşandı. 404 Media tarafından ele geçirilen şirket içi belgelere ve çalışan beyanlarına göre OpenAI, bünyesinde yürüttüğü gizli bir proje kapsamında gerçek ChatGPT kullanıcılarının sohbetlerini insan çalışanlara ve taşeronlara inceletiyor.
"Project Lily" kod adını taşıyan bu kapsamlı operasyon, yüzlerce personelin kullanıcı diyaloglarını satır satır okuyup yapay zekanın verdiği yanıtları puanlamasını kapsıyor. Ancak çalışmanın asıl yankı uyandıran tarafı, kullanıcıların mahrem sohbetlerinin ve hassas verilerinin bu süreçte insan gözüyle temas edebiliyor olması.
Project Lily Nedir ve Ne Amaçla Yürütülüyor?
Sızdırılan dokümanlar, Project Lily'nin yapay zekanın yanıt kalitesini, doğruluğunu, üslubunu ve muhakeme yeteneğini geliştirmek amacıyla kurgulandığını gösteriyor. Denetçiler, ChatGPT'nin kullanıcı sorularına ürettiği çıktıları önceden belirlenmiş parametrelere göre derecelendiriyor.
Projenin en kritik odak noktalarından biri ise yapay zeka literatüründe "sycophancy" (dalkavukluk veya aşırı onaylama eğilimi) olarak tanımlanan davranışı törpülemek. Dil modelleri sıklıkla kullanıcıyı memnun etmek adına hatalı savları onaylama, kullanıcının yanlış yönlendirmelerine teslim olma veya gereksiz yere övgü dolu yanıtlar verme eğilimi gösteriyor. OpenAI, insan geri bildirimiyle modelin daha ilkeli, tarafsız ve eleştirel bir duruş sergilemesini hedefliyor.
Anonimleştirme Engeline Takılan Kişisel Veriler
Raporun kamuoyunda endişe yaratan en hassas boyutu veri gizliliği ihlalleriyle ilişkili. OpenAI'ın kullanıcı adlarını kaldırdığı ve sistem üzerinden kişisel olarak tanımlanabilir bilgileri (PII) temizlemeye çalıştığı ifade edilse de, filtrelerin her senaryoda kusursuz çalışmadığı aktarılıyor.
İddiaya göre taşeron incelemeciler zaman zaman şu tablolara tanıklık edebiliyor:
- Eksik Maskeleme: Metin gövdesi içerisine yedirilmiş adresler, şirket içi stratejiler, şahıs adları veya özel iletişim bilgileri tam filtrelenemeyebiliyor.
- Konuşma Ağacının Tamamı: Görevliler yalnızca tekil bir prompt-yanıt ikilisini değil, kullanıcı ile ChatGPT arasındaki derin ve kapsamlı sohbet zincirinin tamamını görebiliyor.
- Bağlamsal İpuçları: İsim silinmiş olsa dahi, konuşmanın akışından ve paylaşılan özel detaylardan kullanıcının kimliğine ya da çalıştığı kuruma dair çıkarım yapmak mümkün hale gelebiliyor.
Kullanıcıların büyük bölümü, ekran başında ChatGPT ile gerçekleştirdikleri seansları yalnızca algoritma ile paylaştıklarını varsayıyor. Binlerce kilometrelik mesafedeki bir veri etiketleme taşeronunun bu diyaloğu okuyabileceği ihtimali ise platforma duyulan güveni sarsıyor.
Yapay Zekada Acil Fren Çağrısı: OpenAI ve Anthropic'ten 3 Aşamalı Plan
ChatGPT Images 2.5 ve Sketch Özelliği Duyuruldu: Basit Çizimler Sanata Dönüşüyor
RLHF ve İnsan Değerlendirmesinin Çelişkisi
Büyük dil modellerinin geliştirilmesinde sadece internetten toplanan devasa veri setleri yeterli olmuyor. Modellerin insani değerlerle hizalanması (alignment) ve mantıksal tutarlılık kazanması için İnsan Geri Bildirimi ile Pekiştirmeli Öğrenme (RLHF) aşaması bir zorunluluk kabul ediliyor.
Ne var ki sentetik veri veya gönüllü denekler yerine, doğrudan canlı kullanıcı tabanının ham sohbetlerinin bu çarka dahil edilmesi etik ve yasal tartışmaları beraberinde getiriyor. Kullanım şartları sözleşmelerinde yer alan muğlak "hizmeti geliştirmek amacıyla veriler kullanılabilir" maddelerinin, sohbetlerin üçüncü şahıslar tarafından okunmasını ne derece meşrulaştırdığı sorgulanıyor.
Sohbetlerinizin İncelenmesini Nasıl Engelleyebilirsiniz?
Eğer ChatGPT ile gerçekleştirdiğiniz görüşmelerin OpenAI modellerinin eğitiminde ve insan denetim süreçlerinde kullanılmasını istemiyorsanız, platformun sunduğu gizlilik ayarlarını aktif olarak yapılandırmanız büyük önem taşıyor:
1. ChatGPT arayüzünde sol alt kısımdaki profil simgenize tıklayarak Ayarlar (Settings) menüsüne girin. 2. Veri Kontrolleri (Data Controls) sekmesine geçiş yapın. 3. "Modeli herkes için iyileştir" (Improve the model for everyone) veya sohbet geçmişi eğitimi seçeneğini devre dışı bırakın. 4. Kurumsal veya hassas projeler için API üzerinden işlem yapmayı tercih edin; zira OpenAI'ın resmi API politikalarında kullanıcı verilerinin varsayılan olarak model eğitiminde kullanılmadığı taahhüt ediliyor.
Ayrıca temel bir güvenlik prensibi olarak; şifreler, tescilli kaynak kodları, sağlık kayıtları ve hukuki sırlar gibi kritik bilgileri hiçbir genel yapay zeka arayüzüne doğrudan yapıştırmamak gerekiyor.
OpenAI Cephesinden Açıklama Bekleniyor
Gündeme oturan bu bulgular şimdilik 404 Media'nın ele geçirdiği belgelere, iç kaynaklarla yapılan görüşmelere ve şirket içi iletişim kayıtlarına dayanıyor. OpenAI yönetiminin incelemelerin kapsamı, hangi hesap türlerinin etkilendiği ve verilerin nasıl izole edildiği konusunda kamuoyunu tatmin edecek resmi bir açıklama yapıp yapmayacağı merakla bekleniyor.

