Araştırma
AI Minute Newsroom
2026-08-23
Küçük model sohbeti büyüğüne devrettiğinde büyük olan her şeyi baştan okur. Nvidia, çeviriyi düz bir doğrunun yapabileceğini söylüyor.
Ucuzla başlayıp zorlaştıkça güçlü modele geçen sistemler gizli bir bedel öder: devralan model tüm sohbeti sıfırdan okur. Uzun bir istemin maliyetinin büyük kısmı bu 'prefill' adımındadır. Bu hafta daha geniş ilgi gören bir arXiv makalesinde (2608.03893) Nvidia araştırmacıları, aynı aileden bir modelin iç anahtar-değer önbelleğinin bir diğerine sıradan doğrusal regresyonla eşlendiğini bildiriyor. Eşleme gradyan inişi olmadan, yalnızca 1.024 jetonluk 500 dizilik bir kalibrasyon kümesinden çıkarılıyor; konum kodlaması ayrıldığı için her bağlam uzunluğunda çalışıyor. 32.768 jetonluk bir önbelleğin aktarımı 278 milisaniye sürdü; yeniden okuma yaklaşık 7 saniye. Üç ailedeki altı model çiftinde eşleme, yeniden okumaya göre 2,7 ila 25 kat hızlı çalıştı. Dürüst kısım sonuçlarda: altı çiftin dördünde devralan modelin kendi doğruluğunun yüzde 73 ila 98'i korundu, ikisinde ise ciddi biçimde bozuldu.
Bu neden önemli?Kademelendirme — küçükle cevapla, soru zorlaşınca büyüğe devret — ciddi ajan sistemlerinin fiilen kurulma biçimi ve bugün bu devir, aynı bağlam için iki kez ödemek demek. İki modelin çalışma belleği arasındaki çeviri gerçekten doğrusala yakınsa, bu ikinci ödeme büyük ölçüde ortadan kalkıyor. Altı çiftin ikisinin kötü sonuç vermesi, bunu bir ürün değil araştırma bulgusu olarak okumanın nedeni: yöntem iki modelin aynı sayıda anahtar-değer başlığı ve aynı başlık boyutunu paylaşmasını gerektiriyor, yani aynı aileyi; farklı üreticiler arasında çalıştığını gösteren kimse yok.
✓ Doğrulandı · 2 kaynak
Uygulamada oku — ücretsiz, 9 dilde
İlgili haberler
27 milyar parametrelik bir model, yayımlanmış makaleleri yeniden üretmede Opus 4.8 ve GPT-5.5'i geçti
2026-08-23Bir modele yayımlanmamış bir makalenin kaynakçasını verip makalenin ne dediğini sorun. En iyileri yüzde 15 isabet ediyor.
2026-08-22Amerikalıların dörtte üçü yakınında veri merkezi istemiyor. Bir yıl önce ikiye bölünmüşlerdi.
2026-08-22Model tek başına yüzde 30 aldı. Nvidia'nın iskeletine sarıldığında aynı model hepsini bitirdi.
2026-08-22Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21