aiminute. ← Tüm AI haberleri
Araştırma 2026-08-08

ARC Prize, DeepSeek V4 Flash'ı doğruladı: ARC-AGI-2'de %61 — görev başına dört sent

ARC Prize, DeepSeek V4 Flash'ı doğruladı: ARC-AGI-2'de %61 — görev başına dört sent

ARC Prize ekibi, DeepSeek'in açık ağırlıklı V4 Flash 0731 modeli için doğrulanmış yarı-özel sonuçları yayımladı: maksimum akıl yürütme modunda ARC-AGI-1'de görev başına yaklaşık iki sente %89,0; ARC-AGI-2'de yaklaşık dört sente %61,4. Model, jeton başına yalnızca 13 milyar parametre etkinleştiren 284 milyar parametreli bir uzman karışımı ve 1 milyon jetonluk bağlam penceresi taşıyor. Sonuç Hacker News'te zirveye çıktı; en çok konuşulan da fiyat-performans oranı oldu.

Bu neden önemli?ARC-AGI-2, ezberlemeye direnip gerçek soyut akıl yürütmeyi ödüllendirmek için tasarlandı; düşük etkin parametreli açık bir modelin cüzi fiyatlarla aldığı böyle bir skor, açık ve kapalı yapay zekâ arasındaki bir boşluğu daha kapatıyor. Geliştiriciler için anlamı şu: sınıra yakın akıl yürütme artık yalnızca kiralanan değil, indirip çalıştırabileceğiniz bir şey.

✓ Doğrulandı · 2 kaynak

▶ İlgili video: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21
Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21
Pew yarım milyon web sayfasını dedektörden geçirdi: ChatGPT'den bu yana yayımlanan her üç sayfadan biri yapay zekâ izi taşıyor
2026-08-21
FDA 1.357 yapay zekâlı tıbbi cihaza onay verdi. Bunların üçü hastaların daha uzun ya da daha iyi yaşayıp yaşamadığı üzerinden test edildi.
2026-08-20