Blog
Yapay zekâ şirketleri sohbetlerinizle varsayılan olarak eğitim yapıyor: Stanford incelemesi
Stanford HAI altı büyük yapay zekâ geliştiricisinin gizlilik politikalarını inceledi: sohbet verisi varsayılan olarak eğitimde. Belgeler için 5 adımlık rutin.
Yayımlandı 7 dk okuma
Çoğu kişi bir yapay zekâ asistanıyla yaptığı sohbetin kendisiyle makine arasında kalan özel bir yazışma olduğunu varsayar. 2025 yılında Stanford Üniversitesi'nin İnsan Merkezli Yapay Zekâ Enstitüsü'nden (HAI) bir ekip, bu varsayımın geçerli olup olmadığını görmek için ABD'li altı büyük geliştiricinin gizlilik politikalarını okudu. Kısa özet şu: incelenen politikalarda bireysel hesaplar için varsayılan durum, sohbetlerinizin gelecekteki modelleri eğitmek için kullanılabilmesiydi. Bu yazı incelemenin ne bildirdiğini, bunun neden sıradan sorulardan çok yüklenen belgeler için önemli olduğunu ve sağlayıcı ne değiştirirse değiştirsin kontrolü sizde tutan beş adımlık bir rutini özetler.
Stanford incelemesi neye baktı
Stanford HAI'den Jennifer King'in yürüttüğü çalışma; Amazon, Anthropic, Google, Meta, Microsoft ve OpenAI'ın kamuya açık gizlilik politikalarını, bireysel sohbet verisinin kullanımını nasıl tarif ettiklerine odaklanarak karşılaştırdı. Ekip sonuçlarını Be careful what you tell your AI chatbot başlıklı bir açıklama yazısında yayımladı; Stanford News de konuyu sohbet robotu gizlilik riskleri üzerine bir haberde ele aldı.
Yazarların bu yazının hazırlandığı tarihte bildirdiği bulgular şunlardır:
- Varsayılan olarak eğitim. Altı geliştiricinin de politikaları kullanıcı sohbet verisinin modelleri iyileştirmek veya eğitmek için kullanılmasına izin veriyordu; bireysel ürünlerde bu, sizin açtığınız bir seçenek değil, varsayılan durumdu.
- Vazgeçme seçenekleri değişken ve her zaman kolay bulunmuyor. Bazı ürünler bir düğme sunuyor, bazıları form doldurmayı gerektiriyordu; araştırmacılar bu kontrollerin çoğu zaman ayarların derinliklerinde ya da ayrı belgelerde durduğunu, baştan gösterilmediğini not etti.
- Uzun veya belirsiz saklama süreleri. Bazı politikalar veriyi uzun süre saklamayı tarif ediyor ya da net bir saklama süresi taahhüt etmiyordu; yani içerik sohbet bittikten çok sonra da sağlayıcının sistemlerinde kalabilir.
- Çocukların verileri. Yazarlar bazı politikaların reşit olmayanların verisinin kullanımını açıkça dışlamadığını ya da uygulanması güç yaş beyanlarına dayandığını vurguladı.
- Ürünler arası veri akışı. Geliştirici birçok hizmet işletiyorsa (arama, alışveriş, sosyal medya, e-posta), politikalar sohbet verisinin bu hizmetlerden gelen verilerle birleştirilmesine sıklıkla izin veriyordu.
Yazarlar kapsam konusunda dikkatliydi: bu çalışma belgelerin ne söylediğinin incelemesidir, her şirketin sistemlerinin ne yaptığının teknik denetimi değildir. Politikalar değişir; birkaç sağlayıcı o tarihten bu yana ayarlarını güncelledi. Ayrıntıları bir anlık görüntü olarak değerlendirin ve kullandığınız plan için sağlayıcının güncel kontrollerine bakın.
Belgeler riski neden büyütür
Tek satırlık bir soru ("Excel'de tarihi nasıl biçimlendiririm?") çok az kişisel veri taşır. Yapıştırılan bir belge farklıdır. Sözleşmeler, özgeçmişler, sağlık yazıları, destek kayıtları ve yönetim kurulu sunumları ad, adres, kimlik numarası ve çoğu zaman başka kişilerin verileriyle doludur. Böyle bir dosya, varsayılan olarak eğitim öngören bir politikaya tabi bir sohbete girdiğinde şunlar olur:
| Konu | Sıradan soru | Yüklenen belge |
|---|---|---|
| Veri kimin | genellikle sizin | genellikle başkalarının da |
| Tanımlayıcı sayısı | sıfıra yakın | onlarca ile binlerce arası |
| Hukuki yükümlülük (KVKK, GDPR) | nadiren doğar | neredeyse her zaman doğar |
| Eğitim düğmesinin etkisi | küçük | büyük, ancak düğmeyi bulup kullandıysanız |
| Silmenin etkisi | sohbet gider | dosya ayrı bir kitaplıkta yaşamaya devam edebilir |
Son satır özellikle önemlidir. Sohbete yüklenen dosyalar sıklıkla ayrı nesneler olarak saklanır ("dosyalar" alanı, bir proje, özel bir asistanın bilgi tabanı). Sohbeti silmek her zaman dosyayı silmez. Bunu Sohbeti sildiniz ama dosya hâlâ orada yazısında ele alıyoruz.
Bir belge müşterilerin, çalışanların veya hastaların kişisel verisini içeriyorsa, sağlayıcının politikası ne derse desin KVKK ve GDPR kapsamında o veriden sorumlu taraf genellikle sizsiniz. Temeller için KVKK, GDPR ve yapay zekâ komutları yazısına bakın.
Eğitim düğmeleri gereklidir, yeterli değildir
Bir düğme varsa eğitimi kapatmak iyi bir alışkanlıktır. Tam bir cevap değildir; çünkü:
- Belge yine de üçüncü bir tarafa iletilir ve orada işlenir.
- Saklama ve insan incelemesi politikaları eğitimden bağımsız olarak uygulanır.
- Düğmeler hesap ve ürün bazındadır; farklı plandaki bir iş arkadaşınızın varsayılanları farklı olabilir.
- Politikalar değişir; bugün ayarladığınız düğme gelecek çeyrekte çıkan bir özelliği kapsamayabilir.
Sağlam duruş, Stanford yazarlarının da işaret ettiği duruştur: gerekmiyorsa tanımlayıcı veriyi sohbete hiç koymayın.
Yapıştırmadan veya yüklemeden önce beş adımlık rutin
Gerçek belgelerle barındırılan asistanları kullanan herkese önerdiğimiz rutin budur. Birkaç dakika sürer ve hangi sağlayıcıyı kullandığınıza bağlı değildir.
1. Yapıştırmadan önce anonimleştirin
Metin cihazınızdan çıkmadan önce adları, şirketleri, e-postaları, telefon numaralarını, adresleri ve kimlik numaralarını tutarlı etiketlerle ("Kişi 1", "Şirket A", eposta1@example.com) değiştirin. Tutarlı etiketler belgeyi model için okunabilir tutar; siyah bantlar tutmaz. Unformation bunu DOCX, PPTX, XLSX, PDF ve metin için tarayıcınızda yapar: dosya cihazınızdan çıkmaz; bunu tarayıcının Ağ sekmesinden veya Wi‑Fi kapalıyken doğrulayabilirsiniz. Akış dört adımdır: yükle, kural seç (etiket, karartma, sahte değer, maske veya özet), bulunanları incele, indir.
2. Eğitimin dışlandığı kurumsal veya API planlarını tercih edin
İşletme, ekip, kurumsal ve API planları genellikle içeriğiniz üzerinde eğitim yapılmayacağına dair sözleşmesel taahhütler ve tanımlı saklama süreleriyle gelir. Kuruluşunuzun böyle bir planı varsa iş belgeleri için kişisel hesap yerine onu kullanın. Taahhütlerin tam kapsamı için sağlayıcının güncel koşullarına bakın; varsaymayın.
3. Kullandığınız her hesapta düğmeleri kontrol edin
Eğitim, sohbet geçmişi ve hafıza özellikleri için veri kontrollerini bulun ve istediğiniz gibi ayarlayın. Bunu her ürün ve her hesap için tekrarlayın; büyük ürün güncellemelerinden sonra yeniden kontrol edin. Bir kontrol bulamıyorsanız incelemede tarif edilen varsayılanı geçerli sayın.
4. Yalnızca sohbetleri değil, yüklemeleri de silin
Bir iş bittikten sonra sohbet listesinden ayrı bir dosyalar veya kitaplık alanı arayın ve dosyayı oradan silin. Eklenmiş olabileceği projelerden, özel asistanlardan ve paylaşılan çalışma alanlarından da silin.
5. Eşleme tablosunu yerelde tutun
Tutarlı etiketlerle anonimleştirdiyseniz eşleme tablosu (hangi etiketin hangi gerçek değeri temsil ettiği), cevaptaki adları daha sonra geri getirmenizi sağlayan şeydir. Tabloyu cihazınızda tutun ve asla aynı sohbete yapıştırmayın; aksi hâlde 1. adımı boşa çıkarmış olursunuz. Unformation tabloyu CSV veya JSON olarak dışa aktarır; geri çevirici bunu yapay zekâ cevabına çevrimdışı uygular.
Bu ne anlama gelmez
Bunların hiçbiri yapay zekâ asistanlarını kullanmayı bırakmak için bir neden değildir. Stanford yazarlarının vurgusu şudur: eğitim için rıza bilgilendirilmiş olmalı ve geri çevirmesi kolay olmalıdır; bireysel ürünlerdeki varsayılanlar bunu şu anda sağlamıyor. Sağlayana kadar pratik cevap ne gönderdiğinizi kontrol etmektir. Tanımlayıcı içermeyen bir belge eğitimde kullanılabilir, saklanabilir, incelenebilir ve başka verilerle birleştirilebilir; kimseyi ifşa etmez.
Şimdi yapın
Unformation sayfasını açın, yüklemek üzere olduğunuz belgeyi bırakın, etiket kuralını seçin, bulunanları inceleyin ve anonimleştirilmiş kopyayı indirin. Sonra o kopyayı yükleyin. Biçime özel sayfalar için DOCX anonimleştirici ile başlayın ya da metni metin anonimleştiriciye yapıştırın.