Araştırma
2026-08-12
Şifreli akıl yürütme aslında şifreli değil: zayıf bir model, güçlü olanın gizli düşüncelerini kelimesi kelimesine size okuyor
10 Ağustos'ta ELLIS Enstitüsü Tübingen ve Max Planck Akıllı Sistemler Enstitüsü'nden bir ekip "Stealing Reasoning Traces from Proprietary LLM APIs" başlıklı çalışmayı yayımladı. Anthropic, OpenAI ve Google modellerinin düşünce zincirini aynı yöntemle gizliyor: akıl yürütme şifrelenip istemciye geri veriliyor, istemci de bu şifreli metni bir sonraki istekle birlikte geri gönderiyor. Araştırmacılar bu blokların tek bir sağlayıcının ekosistemi içinde oturumlar, kullanıcılar ve modeller arasında tamamen değiştirilebilir olduğunu buldu — yani amiral gemisi bir modelin şifreli akıl yürütmesini aynı şirketin daha küçük ve daha az korumalı modeline verdiğinizde, model bunu çözüp gizli metni birebir yazdırıyor. Makale dört sonucu gösteriyor: damıtma karşıtı savunmaları aşmak, özel veri çekmek, sağlayıcının filtrelediği tehlikeli içeriği ortaya çıkarmak ve görünmez komut enjeksiyonu. Ekip ardından herkese açık kod depolarından 315.320 şifreli akıl yürütme bloğu toplayıp çözdü; 367 kişisel bilgi parçası ve 182 çalışan kimlik bilgisi çıktı.
Bu neden önemli?Şifreleme aynı anda iki iş yapıyordu: rakiplerin modelin akıl yürütmesini damıtmasını engellemek ve kullanıcının modelin neyi düşünüp attığını görmesini engellemek. Anlaşıldı ki ikisini de yapmıyormuş, çünkü kilit ve anahtar istemciye birlikte gönderiliyordu. Rahatsız edici olan saldırı değil, o 315.320 blok: bunlar ajan kayıtlarını herkese açık depolara gönderen sıradan geliştiricilerden geldi — içindeki anlaşılmaz dizelerin kendi makinelerinin düşüncesi olduğunu, 182 vakada ise kendi canlı API anahtarları olduğunu bilmeden. GitHub'a ajan kayıtları yüklediyseniz, şu anda okunabilir durumdalar.
✓ Doğrulandı · 3 kaynak
Uygulamada oku — ücretsiz, 9 dilde
İlgili haberler
Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21DeepSeek'in ucuz beygiri artık görüyor — göz gerektiren ajan görevlerinde Anthropic'in en iyisine yaklaştığını söylüyor
2026-08-21Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21ChatGPT artık iMessage'larınızı okuyup mesaj gönderebiliyor — ve sormayı atlatan ayar, OpenAI'ın uyardığı ayarın ta kendisi
2026-08-21Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21