Araştırma
2026-08-08
ARC Prize, DeepSeek V4 Flash'ı doğruladı: ARC-AGI-2'de %61 — görev başına dört sent
ARC Prize ekibi, DeepSeek'in açık ağırlıklı V4 Flash 0731 modeli için doğrulanmış yarı-özel sonuçları yayımladı: maksimum akıl yürütme modunda ARC-AGI-1'de görev başına yaklaşık iki sente %89,0; ARC-AGI-2'de yaklaşık dört sente %61,4. Model, jeton başına yalnızca 13 milyar parametre etkinleştiren 284 milyar parametreli bir uzman karışımı ve 1 milyon jetonluk bağlam penceresi taşıyor. Sonuç Hacker News'te zirveye çıktı; en çok konuşulan da fiyat-performans oranı oldu.
Bu neden önemli?ARC-AGI-2, ezberlemeye direnip gerçek soyut akıl yürütmeyi ödüllendirmek için tasarlandı; düşük etkin parametreli açık bir modelin cüzi fiyatlarla aldığı böyle bir skor, açık ve kapalı yapay zekâ arasındaki bir boşluğu daha kapatıyor. Geliştiriciler için anlamı şu: sınıra yakın akıl yürütme artık yalnızca kiralanan değil, indirip çalıştırabileceğiniz bir şey.
✓ Doğrulandı · 2 kaynak
▶ İlgili video: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
Uygulamada oku — ücretsiz, 9 dilde
İlgili haberler
Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21Pew yarım milyon web sayfasını dedektörden geçirdi: ChatGPT'den bu yana yayımlanan her üç sayfadan biri yapay zekâ izi taşıyor
2026-08-21FDA 1.357 yapay zekâlı tıbbi cihaza onay verdi. Bunların üçü hastaların daha uzun ya da daha iyi yaşayıp yaşamadığı üzerinden test edildi.
2026-08-20