Araştırma
AI Minute Newsroom
2026-08-12
Şifreli akıl yürütme aslında şifreli değil: zayıf bir model, güçlü olanın gizli düşüncelerini kelimesi kelimesine size okuyor
10 Ağustos'ta ELLIS Enstitüsü Tübingen ve Max Planck Akıllı Sistemler Enstitüsü'nden bir ekip "Stealing Reasoning Traces from Proprietary LLM APIs" başlıklı çalışmayı yayımladı. Anthropic, OpenAI ve Google modellerinin düşünce zincirini aynı yöntemle gizliyor: akıl yürütme şifrelenip istemciye geri veriliyor, istemci de bu şifreli metni bir sonraki istekle birlikte geri gönderiyor. Araştırmacılar bu blokların tek bir sağlayıcının ekosistemi içinde oturumlar, kullanıcılar ve modeller arasında tamamen değiştirilebilir olduğunu buldu — yani amiral gemisi bir modelin şifreli akıl yürütmesini aynı şirketin daha küçük ve daha az korumalı modeline verdiğinizde, model bunu çözüp gizli metni birebir yazdırıyor. Makale dört sonucu gösteriyor: damıtma karşıtı savunmaları aşmak, özel veri çekmek, sağlayıcının filtrelediği tehlikeli içeriği ortaya çıkarmak ve görünmez komut enjeksiyonu. Ekip ardından herkese açık kod depolarından 315.320 şifreli akıl yürütme bloğu toplayıp çözdü; 367 kişisel bilgi parçası ve 182 çalışan kimlik bilgisi çıktı.
Bu neden önemli?Şifreleme aynı anda iki iş yapıyordu: rakiplerin modelin akıl yürütmesini damıtmasını engellemek ve kullanıcının modelin neyi düşünüp attığını görmesini engellemek. Anlaşıldı ki ikisini de yapmıyormuş, çünkü kilit ve anahtar istemciye birlikte gönderiliyordu. Rahatsız edici olan saldırı değil, o 315.320 blok: bunlar ajan kayıtlarını herkese açık depolara gönderen sıradan geliştiricilerden geldi — içindeki anlaşılmaz dizelerin kendi makinelerinin düşüncesi olduğunu, 182 vakada ise kendi canlı API anahtarları olduğunu bilmeden. GitHub'a ajan kayıtları yüklediyseniz, şu anda okunabilir durumdalar.
✓ Doğrulandı · 3 kaynak
Uygulamada oku — ücretsiz, 9 dilde
İlgili haberler
Bir model, bütün yapay zekâyı eğiten yöntem olmadan öğrendi.
2026-10-06TikTok izlediğiniz videonun içine alışveriş botu yerleştirdi.
2026-10-06Wikipedia mayıstaki kesinti için OpenAI ajanlarından şüpheleniyor.
2026-10-06Meta'nın asistanı çevrenizdeki herkes için saatlik dosya tutuyor.
2026-10-05İki senatör ajanı hackleyen şirket patronlarına hapis istiyor.
2026-10-05