aiminute. ← Tüm AI haberleri
Araştırma AI Minute Newsroom 2026-08-23

Küçük model sohbeti büyüğüne devrettiğinde büyük olan her şeyi baştan okur. Nvidia, çeviriyi düz bir doğrunun yapabileceğini söylüyor.

Küçük model sohbeti büyüğüne devrettiğinde büyük olan her şeyi baştan okur. Nvidia, çeviriyi düz bir doğrunun yapabileceğini söylüyor.

Ucuzla başlayıp zorlaştıkça güçlü modele geçen sistemler gizli bir bedel öder: devralan model tüm sohbeti sıfırdan okur. Uzun bir istemin maliyetinin büyük kısmı bu 'prefill' adımındadır. Bu hafta daha geniş ilgi gören bir arXiv makalesinde (2608.03893) Nvidia araştırmacıları, aynı aileden bir modelin iç anahtar-değer önbelleğinin bir diğerine sıradan doğrusal regresyonla eşlendiğini bildiriyor. Eşleme gradyan inişi olmadan, yalnızca 1.024 jetonluk 500 dizilik bir kalibrasyon kümesinden çıkarılıyor; konum kodlaması ayrıldığı için her bağlam uzunluğunda çalışıyor. 32.768 jetonluk bir önbelleğin aktarımı 278 milisaniye sürdü; yeniden okuma yaklaşık 7 saniye. Üç ailedeki altı model çiftinde eşleme, yeniden okumaya göre 2,7 ila 25 kat hızlı çalıştı. Dürüst kısım sonuçlarda: altı çiftin dördünde devralan modelin kendi doğruluğunun yüzde 73 ila 98'i korundu, ikisinde ise ciddi biçimde bozuldu.

Bu neden önemli?Kademelendirme — küçükle cevapla, soru zorlaşınca büyüğe devret — ciddi ajan sistemlerinin fiilen kurulma biçimi ve bugün bu devir, aynı bağlam için iki kez ödemek demek. İki modelin çalışma belleği arasındaki çeviri gerçekten doğrusala yakınsa, bu ikinci ödeme büyük ölçüde ortadan kalkıyor. Altı çiftin ikisinin kötü sonuç vermesi, bunu bir ürün değil araştırma bulgusu olarak okumanın nedeni: yöntem iki modelin aynı sayıda anahtar-değer başlığı ve aynı başlık boyutunu paylaşmasını gerektiriyor, yani aynı aileyi; farklı üreticiler arasında çalıştığını gösteren kimse yok.

✓ Doğrulandı · 2 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

OpenAI 722 matematik makalesini tek bir komutla üretti.
2026-10-07
Erdős problemleri sitesi yapay zekâ kanıtlarına kapandı.
2026-10-07
Aynı işi yirmi kez tekrarlayınca en iyi ajanın puanı üçte bir düştü.
2026-10-06
Bir model, bütün yapay zekâyı eğiten yöntem olmadan öğrendi.
2026-10-06
Matematikçiler beş açık problemi sıradan bir sohbet kutusuyla çözdü.
2026-10-05