aiminute. ← Tüm AI haberleri
Araştırma 2026-08-17

Dünyanın en çok ödül almış iki matematikçisi yapay zekânın gerçekte neyi çözdüğüne baktı ve aynı eksik parçada buluştu

Dünyanın en çok ödül almış iki matematikçisi yapay zekânın gerçekte neyi çözdüğüne baktı ve aynı eksik parçada buluştu

Fields madalyalı Timothy Gowers 12 Ağustos'ta yayımladığı yazıda matematiği, dil modellerinin iyi başa çıktığı ve çıkamadığı türler olarak ayırmayı denedi. Bulgusu şu: modeller, bilinen tekniklerin bir araya getirilmesiyle ulaşılabilen sonuçlarda güçlü — karşı örnek avı listelerinde alışılmadık biçimde öne çıkıyor — ama arama uzayı devasa olduğunda hangi yönün denemeye değer olduğuna dair muhakemede zayıf. Henüz temiz bir sınıflandırma olmadığını özellikle belirtiyor ve kuramcılardan bunu biçimselleştirmeye yardım etmelerini istiyor. Peter Sarnak, temmuzda Amerikan Matematik Derneği'nin Notices dergisinde farklı bir açıdan benzer bir yere vardı: yapay zekâ hâlihazırda var olan kuramdan sonuç türetebiliyor, ancak büyük ispatların genellikle üzerine kurulduğu yeni soyutlamaları icat etmekte zorlanıyor. DeepMind'dan Tom Zahavy'nin 'LLMs Can't Jump' makalesi aynı darboğazı teknik terimlerle adlandırıyor: yeni temel varsayımlar ortaya atamama. Bunların hiçbiri kontrollü deney değil; araçların gerçek matematik çalışmasında nasıl davrandığına dair uzman değerlendirmeleri.

Bu neden önemli?Bu, bir kıyaslama puanından daha kullanışlı bir sinyal; çünkü kıyaslamalar çoğunlukla tam da bu matematikçilerin modellerin zaten iyi olduğunu söylediği şeyi ölçüyor: hedef bilinip araçlar tanımlıyken aradaki boşluğu kapatmak. Eksik dedikleri kısım — neyin denemeye değer olduğuna karar vermek ve bir problemi çözülebilir kılan kavramı icat etmek — cevap anahtarı olan bir soru biçiminde ortaya çıkmaz, dolayısıyla değerlendirmelerde de görünmez. Bu aynı zamanda olimpiyat ve yarışma sonuçlarını araştırma düzeyinde yetkinlik kanıtı saymaya karşı bir uyarı: yarışma soruları tanımı gereği bilinen yöntemlerle çözülebilir olacak şekilde kurulur.
#Bilim & Araştırma

✓ Doğrulandı · 3 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21
Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21
Pew yarım milyon web sayfasını dedektörden geçirdi: ChatGPT'den bu yana yayımlanan her üç sayfadan biri yapay zekâ izi taşıyor
2026-08-21
FDA 1.357 yapay zekâlı tıbbi cihaza onay verdi. Bunların üçü hastaların daha uzun ya da daha iyi yaşayıp yaşamadığı üzerinden test edildi.
2026-08-20