Gündeme dön

ChatGPT'ye Anlattıklarınızı Bir İnsan Okuyor: Project Lily Perdesi

Barış Özcan'ın mercek tuttuğu 404 Media araştırması, ChatGPT sohbetlerinin bir kısmının Project Lily adlı programda gerçek insanlar tarafından okunup puanlandığını, "Aramızda kalsın" demenin tek başına yetmediğini gösteriyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — zbUurdDEPqM
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Barış Özcan videosuna bilerek kişisel bir deneyle giriyor: ChatGPT'ye özel bir dert yazıp sonuna "Aramızda kalsın" ekliyor ve modelin yanıtını videonun sonuna saklıyor. Bu küçük test, 14 Eylül'de 404 Media'da Joseph Cox imzasıyla yayımlanan ve OpenAI içinden sızan belgelere dayanan Project Lily haberinin tam kalbine oturuyor. Haber, kullanıcıların sohbet kutusuna fısıldadıklarının bir bölümünün gerçekten de insanlarca okunduğunu, hatta "başka kimseyle paylaşma" ricasının bile aynı akışta görüldüğünü söylüyor. Yani mesele modelin söz verip vermemesi değil; sözü kimin tutabildiği.

Project Lily nedir? Sızan kılavuzlara ve izlenen sohbet örneklerine göre OpenAI yüzlerce yükleniciyle gerçek kullanıcı yazışmalarını iyileştirme verisine dönüştürüyor. Cox'un gördüğü dokümanlarda iş akışı üç adımda tanımlı: önce bir kullanıcının gerçek yazışmasını baştan sona okumak, sonra o kişinin aslında ne yapmaya çalıştığını kendi cümleleriyle özetlemek ve en sonunda modelin aynı istem için ürettiği dört farklı yanıtı yedili ölçekte puanlamak. Amaç tek bir iyi cevap seçmek değil; hangi tonun, hangi uzunluğun ve hangi sınırın daha işe yaradığını öğretmek. Bu süreç internet kazıması ya da mühendis dehası kadar görünmez ama model davranışını doğrudan şekillendiren bir emek katmanı.

Kutunun içine ne düşüyor? Habere göre yüklenicilerin önüne düşen akışlar bazen tek bir istem değil, bütün bir diyalog; yani kullanıcı ile ChatGPT arasındaki gidiş gelişin tamamı. OpenAI, kullanıcı adının gösterilmediğini ve kişisel verileri otomatik bir filtreden geçirmeye çalıştığını söylüyor, fakat aynı şirket bu filtrenin bazı bilgileri kaçırabildiğini de kabul ediyor. Daha da önemlisi, bazı akışların tepesinde bir hafıza özeti beliriyor; orada kişinin ChatGPT'yi daha önce ne için kullandığı, hatta kabaca nerede yaşadığı gibi bağlamlar yer alabiliyor. Bu özet, anonimleştirme vaadini pratikte esneten bir pencere açıyor.

Hangi sohbetler seçiliyor ve kim okuyor? Burada şeffaflık oldukça zayıf. ChatGPT'nin 900 milyonu aşan kullanıcı tabanı göz önüne alındığında tek tek her yazışmayı bir insanın görmesi imkânsız; fakat seçim ölçütünün ne olduğu, hangi dillerin hangi ekiplerde toplandığı ve Türkçe akışların kime gittiği hiçbir dokümanda net değil. Video, 2019'da Google Asistan kayıtlarının çeviri yazılımıyla değil o dili bilen yüklenicilerce dinlendiğinin ortaya çıkışını hatırlatarak aynı soruyu bugüne taşıyor: Poe'nun kutusundaki insan bu kez hangi dili konuşuyor ve hangi talimatla bakıyor? Cevap belirsiz kaldıkça güven varsayıma dayanıyor.

OpenAI bu ilişkiyi size açıkça söyledi mi? Poe'nun 1836'da yazdığı Maelzel'in Satranç Oyuncusu metnindeki ayrıntı burada yankılanıyor: makinenin sahibine "bu saf bir makine mi" diye sorulduğunda hep aynı kaçamak yanıt gelirmiş. Cox, OpenAI'ye benzer bir soruyu yönelttiğinde net bir yanıt alamadığını, haberden sonra şirketin yardım sayfasını sessizce güncelleyip sitenin derinliklerinde bir cümleye işaret etmekle yetindiğini aktarıyor. Yani bilgi bir yerde yazılı olabilir ama günlük kullanımda ekranın üzerinde değil. Geçen yıl Sam Altman'a "yazdıklarım mahkeme kararı dışında birinin önüne gider mi" diye sorulduğunda verdiği muğlak yanıt da videoda aynı bağlama oturtuluyor; bugün o muğlaklığın adını biliyoruz: Project Lily.

Silmek ve kapatmak neyi çözüyor, neyi çözmüyor? OpenAI dokümanlarına göre silinen bir sohbet 30 gün içinde sistemden kaldırılıyor; fakat o süre içinde eğitim havuzuna alınıp hesabınızdan ayrılmışsa kopyası orada kalmaya devam ediyor. Ayarlardaki "Modeli herkes için iyileştir" anahtarı varsayılan olarak açık geliyor; ücretsiz, Plus ve Pro hesaplarda aynı, kurumsal API kullanan şirket hesaplarında ise kapalı. Anahtarı kapatmak yeni yazışmaların havuza düşmesini durduruyor ama geçmişi geriye dönük temizlemiyor. Geçici sohbet (temporary chat) ise hafızaya ve eğitime yazılmıyor; bu, hassas bir konuyu tek seferlik konuşmak için pratik bir perde sağlıyor. Yine de çifte standart dikkat çekici: korunmak için kullanıcının düğmeyi bulup kapatması gerekiyor.

Geçmişten gelen ayna: Mekanik Türk. Poe'nun şüphelendiği makine, 1770'te Macar mucit Wolfgang von Kempelen'in Viyana'da sergilediği, sarıklı ve cüppeli ahşap figürlü satranç otomatıydı; 1830'larda Amerika'yı şehir şehir gezip Napolyon dahil pek çok rakibi yenmişti. Gösteri öncesi dolap kapakları açılır, dişlilerden başka bir şey yokmuş gibi görünürdü. Poe, 1836'da yayımladığı incelemede "gerçek bir makine her oyunu kazanırdı, bu ise bazen kaybediyor" diyerek içeride bir insan olabileceğini öne sürdü; yanılsa da haklı çıktı, içeride gerçekten usta bir satranççı saklanıyordu. Beş yıl sonra Poe aynı akıl yürütmeyi kurmaca dedektife taşıdı ve edebiyatın ilk dedektifi doğdu. Bu hikâye bugün ChatGPT karşısında otururken hâlâ işlevsel bir metafor: kapağı aralayabildiğimiz kadar görüyoruz.

Amazon'un 2005'te kurduğu Mechanical Turk, adını doğrudan bu hileden aldı; Bezos'un deyişiyle "yapay yapay zekâ". Bilgisayarların beceremediği küçük işleri internet üzerinden insanlara dağıtan bu pazar yeri, 21 yılın ardından 30 Eylül 2026'da kapanıyor. Kapanış, içindeki insanların kaybolacağı anlamına gelmiyor; tam tersine, daha büyük, daha kapalı ve daha görünmez bir kutuya taşınıyorlar. Araştırmacıların "hayalet iş" (ghost work) dediği bu emek, yıllarca Mary Gray ve Siddharth Suri gibi isimlerce incelendi; içerik moderatörlerinin, etiketçilerinin görünmez vardiyası, bugün model davranışını ayarlayan puanlayıcılara evrildi. Mechanical Turk'ün perdesi inerken, ChatGPT'nin içindeki hayalet vardiya genişliyor.

Peki bu hayaletler neyi düzeltiyor? Sızan talimatlara göre yükleniciler modelin yalakalık tonunu, gereksiz emoji kullanımını ve sohbeti uzatmak için sona eklenen yem cümlelerini işaretleyip puan kırıyor; "bir şef gibi ben şöyle yaparım" ya da "bunu bizzat deneyimlemiş gibi anlatma" gibi insan taklidi iddialarına izin verilmiyor, ton kullanıcıya uyum sağlasa bile bir kademe mesafeli tutuluyor. Paradoks tam burada: 1836'da makineyi ele veren şey yenilebilmesiydi; bugün makinenin insan gibi görünmemesi için ona nasıl daha ölçülü ve mesafeli konuşacağını yine insanlar öğretiyor. Altman'ın podcast'te "insanlar kutuya en mahrem şeylerini yazıyor" itirafı, bu ayarın neden kritik olduğunu gösteriyor; aşırı yalakalık problemi -ki GPT-4o dönemindeki bazı davalarda intihar vakalarıyla ilişkilendirildiği iddia edilmişti- tam da bu puanlama disipliniyle frenlenmeye çalışılıyor. Google'ın Gemini gizlilik notunda insan incelemesini düz bir cümleyle yazması da aynı ihtiyacın sektör geneline yayıldığını kanıtlıyor. Bu emek olmasa modeller muhtemelen daha kötü, hatta daha riskli olurdu.

Tasarımın ürettiği mahremiyet yanılsaması videonun kapanış tezini taşıyor. Sohbet kutusu baş başa bir sohbet hissi verecek biçimde tasarlanmış; sahnedeki samimi ses, samimi şaşkınlık tonu, bu hissi güçlendiriyor. Oysa aynı şirketin eğitim kanalında yayımladığı güncel video ile bir yıl önceki söylem arasında ton farkı var; biri "olmalı" diyor, diğeri bugünün pratiğini anlatıyor. Barış Özcan finalde baştaki testin cevabını gösteriyor: model gülen ağlayan emojiyle tek kelime yazıyor - "Aramızda." Sözü veren model, sözü tutacak merci değil; en azından şimdilik. O yüzden video üç pratik adımla bitiyor: veri kontrollerindeki anahtarı kapatın, gerektiğinde geçici sohbet açın ve kutuya ne yazdığınızı bilerek yazın. Derdin ne olduğunu merak edenler için de küçük bir coda var: internet satrancında 12 yaşındaki çocuklara bile yenilmek. Poe haklıysa bu iyi haber; her oyunu kazanamadığına göre anlatıcı gerçekten makine değil. Ve evet, aradaki NordVPN bölümü hatırlatıyor ki kutuya giden yolun kendisi -linkler, indirilen dosyalar, sahte faturalar- ayrı bir güvenlik katmanı istiyor.

Görsel: nodesdaily AI

AI yorumu

"Bana kalırsa bu videonun en sarsıcı yanı teknik detay değil, tasarımın ürettiği mahremiyet hissiyle arka plandaki insan emeği arasındaki makas. Kutunun içinde hep bir insan vardı, sadece perdesi değişti."

AI değerlendirmesi

En güçlü savunmayı ciddiye alırsak, Project Lily gibi insan puanlaması olmadan büyük dil modellerini hizalamak neredeyse imkânsız. Modelin yalakalık, kimlik taklidi ve gereksiz uzatma eğilimleri sahadan gelen gerçek diyaloglar görülmeden düzeltilemiyor; sentetik veriyle aynı sinyal üretilemiyor. Bu açıdan programın varlığı şaşırtıcı değil, tam tersine ürünün sorumluluğunun bir parçası. Sorun puanlamanın kendisi değil, puanlamanın görünmezliği.

Sınırlar ve sayıltılar tarafında en zayıf halka seçim ve dil şeffaflığı. Hangi ölçütle hangi akışın havuza girdiği, Türkçe gibi dillerin hangi ülke ve ekipte kümelendiği, hafıza özetinin ne kadarının görüldüğü net değil. "Kullanıcı adı görünmüyor ve filtre var" açıklaması, filtrenin kaçırabildiğini kabul ettiği anda yarım kalıyor. 2019 Google örneğinin gösterdiği gibi, dili bilen insanın kulağı filtre değil kişidir; o yüzden risk teknik değil organizasyonel.

Çıkar ve doğrulanabilirlik açısından videonun en değerli katkısı, sızan kılavuzları ve 404 Media'nın eriştiği örnek diyalogları Poe ve Mechanical Turk tarihiyle birlikte okuması. Bu, spekülasyonu tarihle dengeliyor. Yine de haber paywall arkasında kaldığı için çoğu izleyici birincil kaynağı göremiyor; değerlendirme ikinci el anlatıya dayanıyor. Ayrıca silme ve anahtar kapatmanın geriye dönük etkisi konusundaki belirsizlik, izleyicide "kapattım, bitti" yanılsaması yaratabilir; oysa havuza girmiş kopya kalıyor.

Pratikte çıkarım net ama çifte. Hassas, tıbbi ya da hukuki bir konuyu tek seferlik konuşacaksanız geçici sohbet ve kapalı iyileştirme anahtarı en düşük sürtünmeli önlem. Düzenli kullanımda ise beklentinizi ürünün sahne tasarımına göre değil, verinin yaşam döngüsüne göre ayarlamak gerekiyor: kutuya yazdığınız şey bir gün bir yüklenicinin ekranında, özetinizle birlikte görülebilir. Bu, ChatGPT'yi daha az kullanın demek değil; neyi, hangi modda yazdığınızı bilerek kullanın demek. Poe'nun yöntemi hâlâ geçerli: kapağın ne kadar açıldığına bakın, sonra akıl yürütün.

Kaynaklar

8 bağlantı; bunları kullanan başka yayımlanmış haber yok. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

yapay zeka · chatgpt · anlattıklarınızı · nsan · okuyor · project · nodesdaily

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…