aiminute. ← Tüm AI haberleri
Yeni Modeller 2026-08-17

Bir Kore laboratuvarı kendi modelinin puanını tek kuşakta üçe katladı — milyon token'ı 30 sent

Bir Kore laboratuvarı kendi modelinin puanını tek kuşakta üçe katladı — milyon token'ı 30 sent

Upstage bu ay Solar Pro 4'ü yayınladı. Artificial Analysis'in Zekâ Endeksi'nde 42 puan alıyor; Solar Pro 3 ise 14 almıştı — bu yıl herhangi bir laboratuvarın tek kuşakta kaydettiği en büyük sıçramalardan biri. Bu, modeli Thinking Machines'in Inkling'iyle aynı seviyeye, MiMo-V2.5-Pro'nun bir puan gerisine yerleştiriyor. Kazanım, Upstage'in hedeflediğini söylediği yerde yoğunlaşmış: ajan işleri. Terminal-Bench v2.1 43,2'den 57'ye, AA-LCR uzun belge muhakemesi 62,7'den 71'e çıktı; GDPval-AA v2 ajan ölçütünde Elo'su 498'den 1277'ye yükseldi — insan referans değeri 1000. Fiyat milyon girdi token'ı için 0,30 dolar, milyon çıktı için 1,20 dolar, önbellek isabetlerinde 0,06 dolar; 10 Eylül'e kadar %90 indirimli. Bağlam 384 bin token, çıktı 256 bin token'a kadar, yalnızca metin; Upstage API'si ve OpenRouter üzerinden sunuluyor. Bedeli var: model selefinden %17 daha az çıktı token'ı kullanıyor ama görev başına 6,0 dakika yerine 8,6 dakika harcıyor. İngilizce, Korece ve Japonca çalışıyor.

Bu neden önemli?İlginç olan sayı 42 değil — orada duran bir sürü model var. İlginç olan, Kore dışında çoğu kişinin hiç denemediği bir laboratuvarın tek kuşakta 14'ten 42'ye çıkması. Bu seviyeye ulaşmanın tarifi artık yeterince biliniyor ki orta ölçekli bir ulusal laboratuvar birkaç ayda uygulayabiliyor; fiyat tabanının sınırın ilerlemesinden daha hızlı düşmesinin nedeni bu. İnsan referansını aşan ajan Elo'suna, tek bir ölçüte gösterilmesi gereken temkinle yaklaşın; gecikmeyi de not edin: bu puanı yalnızca daha iyi ağırlıklarla değil, saatteki zamanla satın alıyor.
#Ajanlar

✓ Doğrulandı · 3 kaynak

▶ İlgili video: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

DeepSeek'in ucuz beygiri artık görüyor — göz gerektiren ajan görevlerinde Anthropic'in en iyisine yaklaştığını söylüyor
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21
ChatGPT artık iMessage'larınızı okuyup mesaj gönderebiliyor — ve sormayı atlatan ayar, OpenAI'ın uyardığı ayarın ta kendisi
2026-08-21
Robota bir kez gösterin — üç ila on iki saniye — hiç eğitim almadan işi yüzde 59 oranında doğru yapıyor
2026-08-21
Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21