Gündeme dön

OpenAI, modellerinin gizli akıl yürütme izlerini kopyalamaya yönelik koordineli bir kampanyayı 28 Temmuz'a kadar tamamen durdurduğunu açıkladı; 24-25 Temmuz'da 4 binden fazla kullanıcıdan 16 bin çıkarma girişimi kaydedildi ve çekirdek grubun Çinli Moonshot AI ile bağlantılı kişilerden oluştuğu…

OpenAI'dan Akıl Yürütme Hırsızlığına Karşı Hamle: Moonshot Bağlantılı Sızıntı Durduruldu

Nodesdaily’e aktarım: (UTC+03:00)
Videoyu izle — kantan.news
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Model hırsızlığı yeni bir suç değil ama bu kez hedef, modelin ağırlıkları değil düşünme biçimiydi. 1 Temmuz'da başlayan faaliyet, 24-25 Temmuz'da patladı: OpenAI'ın açıklamasına (openai.com) göre çıkarma kalıbına uyan 16 bin istek, 4 binden fazla kullanıcıdan geldi. Soruşturma derinleşince ilişkili kalıplarda 15 binden fazla kullanıcılık daha geniş bir küme bulundu ve kampanyanın tamamı 28 Temmuz'a kadar etkisiz hale getirildi.

Teknik, şirketin hasım damıtma dediği yöntem: bir modelin çıktılarını veya akıl yürütmesini izinsiz kullanıp başka bir modeli eğitmek ya da güçlendirmek. Benzinga'nın (benzinga.com) derlediği detaylara göre operatörler şifrelemeyi kırmadı, veritabanına girmedi; bunun yerine sohbetleri manipüle etti. Bir yöntemde şifreli akıl yürütme kopyalanıp yeniden oynatıldı, diğerinde modelden bunu çözüp yazıya dökmesi istendi.

Attribution cephesi dikkatle yazılmış: OpenAI, çekirdek grubun Kimi'nin geliştiricisi Moonshot AI ile bağlantılı kişilerden oluştuğunu söylüyor; ama 15 bin kullanıcının tamamının tek bir aktöre ait olup olmadığı belirsizliğini koruyor. CNBC'nin (cnbc.com) 1 Ekim tarihli haberine göre bu rakamlar girişimleri sayıyor, kaçının başarıya ulaştığını göstermiyor. Başarılı çıkarma ile deneme arasındaki fark, dosyanın en kritik gri alanı.

Şirketin endişesi fikri mülkiyetin ötesinde: çıkarılan akıl yürütme, orijinal modelin güvenlik filtreleri taşınmadan başka bir modeli eğitmekte kullanılabilir. Superpower Daily'nin (superpowerdaily.com) çözümlemesine göre OpenAI bu riski doğrudan ulusal güvenlik boyutuyla tanımlıyor; çünkü damıtılmış bir model, aynı yatırımı ve aynı korumaları gerektirmeden sınır model yeteneklerinin bir kısmını kopyalayabilir. Tehlike, yeteneğin kendisinden çok korumasız kopyası.

Karşı tedbirler hesap kapatmanın ötesine geçti: sahte hesaplar yasaklandı veya kısıtlandı, kayıt ve altyapı kontrolleri sıkılaştırıldı, başkasının şifreli akıl yürütmesini elinde tutan birinin bunu yeniden oynatıp içeriği kurtarabildiği yol kapatıldı. Ayrıca akıl yürütmeyi ele verebilecek akan çıktıları tutan denetimler getirildi; korumalar kullanıcılar, çalışma alanları, kuruluşlar ve model aileleri genelinde güçlendirildi. Üçüncü taraf sağlayıcılar da engellemeye katıldı.

Sosyal medyadaki yankı, olayın piyasaya nasıl okunduğunu gösteriyor: Wall Street Engine'in (x.com) paylaşımına göre 24-25 Temmuz'daki 16 bin girişim ve 4 bin kullanıcı rakamı, yatırımcı sohbetlerinde Çin-ABD yapay zekâ rekabetinin yeni cephesi olarak dolaştı. Rakamların kendisi OpenAI açıklamasından geliyor; bağımsız doğrulaması yok. Piyasa anlatısı ile teknik gerçeklik arasındaki mesafeyi korumak gerekiyor.

Tabloya uzaktan bakınca sınır modeli şirketleri için yeni bir savunma katmanı doğuyor: akıl yürütme izleri artık şifreli kasada değil, akan sohbette korunmak zorunda. Tom's Hardware'in (tomshardware.com) orijinal haberinde çerçevelendiği gibi, 16 bin kullanıcının iki günde zirve yapan girişimi, ölçeğin ne kadar hızlı büyüyebildiğini kanıtladı. Bundan sonra her büyük model, kendi düşüncesini saklamayı da öğrenmek zorunda.

Görsel: nodesdaily AI
KonuNeden önemli
16 bin çıkarma girişimi24-25 Temmuz'da 4 bin kullanıcıdan zirve yapan dalga.
Hasım damıtma tekniğiŞifre kırılmadı; model sorularla konuşturuldu.
28 Temmuz'da tam engellemeHesap, kayıt ve akan çıktı korumaları sıkılaştırıldı.

AI yorumu

"Bu dosyada beni asıl düşündüren, hırsızlığın yöntemi oldu: veritabanı kırılmadı, şifre çözülmedi; model, kurnazca sorularla kendi gizli düşüncesini ifşa etmeye ikna edildi. Yapay zekâ güvenliğinin artık duvarlardan çok diyalog mimarisine bağlı olduğunu gösteren bir örnek olarak yazdım."

AI değerlendirmesi

En güçlü itiraz attribution zafiyeti: 16 bin istek ve 4 bin kullanıcı girişimi sayıyor; kaçının gerçekten akıl yürütme kopardığı açıklanmadı. Moonshot bağlantısı yalnızca çekirdek grup için iddia ediliyor, 15 bin kullanıcın tamamı için değil. Rakamlar etkileyici duruyor ama başarı oranı bilinmeden hasarın boyutu kestirilemiyor; açıklamanın kendisi de bir caydırma iletisi olabilir.

İkinci sınır, savunmanın sürdürülebilirliği. Kapatılan yeniden oynatma yolu ve akan çıktı denetimleri bugünkü mimariye yama; model yetenekleri büyüdükçe yeni çıkarma vektörleri doğacak. Güvenlik ile fayda arasındaki gerilim kalıcı: akıl yürütmeyi fazla gizlemek şeffaflık araştırmalarını öldürür, az gizlemek hırsızlığa davetiye çıkarır. OpenAI bu dengeyi nasıl ölçeceğini açıklamadı.

Kaynak tek sesli: neredeyse tüm detaylar OpenAI açıklamasından geliyor; Moonshot tarafının yanıtı dosyada yok. Benzinga, CNBC ve Superpower Daily aktarımları aynı metne dayanıyor. Bu, iddiaların yanlış olduğu anlamına gelmez; ama tek taraflı bir dosyada temkin payı bırakmak gazetecilik borcu.

Pratik sonuç sektör geneli için: akıl yürütme izleri artık korunması gereken varlık envanterine girdi; rakip laboratuvarlar benzer saldırılara karşı kendi sohbet mimarilerini gözden geçirmek zorunda. Düzenleyici açısından ise hasım damıtma, model güvenliği denetimlerinde yeni bir başlık olmayı hak ediyor. Kullanıcı için kısa vadede değişen bir şey yok; hesaplar ve sohbetler aynı şekilde çalışıyor.

Kaynaklar

6 bağlantı; bunları kullanan başka yayımlanmış haber yok. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

openai · moonshot ai · model güvenliği · yapay zekâ · hasım damıtma

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…

OpenAI, modellerinin gizli akıl yürütme izlerini…