aiminute. ← Tüm AI haberleri
Araştırma 2026-08-16

Beşinci sınıfın üstünde hiçbir şey okumamış bir dil modeli kurdular — sonra ona daha fazlasını öğretemediklerini gördüler

Beşinci sınıfın üstünde hiçbir şey okumamış bir dil modeli kurdular — sonra ona daha fazlasını öğretemediklerini gördüler

Max Planck Akıllı Sistemler Enstitüsü, ELLIS Enstitüsü Tübingen ve ETH Zürih'ten araştırmacılar LittleLearner'ı yayımladı: FineWeb-Edu'dan beş aşamalı bir süzgeçle damıtılmış, ABD Common Core ölçütlerine hizalanmış ve 5. sınıfın üzerinde öğretilen her şeyin çıkarıldığı 88 milyar token'lık bir derlem üzerinde sıfırdan eğitilmiş 0,6B, 1,3B ve 5B parametreli dil modelleri. Her modelin, aynı hattan geçen ama süzgeçsiz bir kontrol eşi var. Temel bulgu şu: modeli büyütmek, SFT ve GRPO ile eğitim sonrası çalışma ve bağlam içi öğrenme, müfredatın zaten içerdiği şeyi güçlendiriyor — ama hiçbiri müfredat dışındaki bilgide kayda değer bir iyileşme sağlamıyor. Derlem ve modeller, modellerin bilgiyi nasıl edindiğini incelemek için bir deney alanı olarak yayımlandı.

Bu neden önemli?Bir modelin ne "öğrendiğine" dair neredeyse her iddia sınanamaz durumda, çünkü eğitim verisinde ne olduğunu kimse söyleyemiyor. Bu modelin ise kasıtlı bir sınırı var; bu da onu alanın sürekli tartıştığı bir soru için kontrollü bir laboratuvara çeviriyor: modelleri iyileştirmek için kullanılan standart teknikler gerçekten bilgi ekliyor mu, yoksa zaten orada olandan daha fazlasını mı çıkarıyor? Bu sınır içinde cevap ikincisi çıktı — ve bu, neyle beslendiği bilinmeyen bir sınır modeli kurcalayarak elde edilemeyecek bir sonuç.
#Bilim & Araştırma

✓ Doğrulandı · 2 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21
Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21
Pew yarım milyon web sayfasını dedektörden geçirdi: ChatGPT'den bu yana yayımlanan her üç sayfadan biri yapay zekâ izi taşıyor
2026-08-21
FDA 1.357 yapay zekâlı tıbbi cihaza onay verdi. Bunların üçü hastaların daha uzun ya da daha iyi yaşayıp yaşamadığı üzerinden test edildi.
2026-08-20