aiminute. ← Tüm AI haberleri
Araştırma 2026-08-07

Bağımsız ölçümler: Qwen3.8-Max, ABD öncülerinin hemen altında — ama çok daha fazla çabalayarak

Bağımsız ölçümler: Qwen3.8-Max, ABD öncülerinin hemen altında — ama çok daha fazla çabalayarak

Artificial Analysis, Alibaba'nın Qwen3.8-Max modeline Zekâ Endeksi'nde 56 puan verdi — Google, Meta ve xAI'ın tüm modellerinin üzerinde; yalnızca Anthropic ile OpenAI'ın en üst modelleri ve Kimi K3 daha yüksek. Ajan odaklı GDPval-AA sıralamasında ise 1739 Elo ile, 1852'lik Claude Opus 5 max'ın ardından ikinci. Kazanımın bedeli var: ajan görevi başına ortalama 64 tur harcıyor (Qwen3.7-Max'ta 14'tü) ve görev başına maliyet iki kattan fazla artarak 1,14 dolara çıkıyor.

Bu neden önemli?Bağımsız rakamlar artık iki Çinli açık ağırlıklı modeli küresel ilk dörde koyuyor — ama tur sayısı ayrıntısı en az sıralama kadar önemli: fark kaba kuvvetle kapatılıyor ve bu çaba gerçek kullanım faturalarına yansıyor. Benchmark sırası ile görev başına maliyet ayrışıyor; alıcıların ikisini birden okuması gerek.
#Ajanlar

✓ Doğrulandı · 2 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21
DeepSeek'in ucuz beygiri artık görüyor — göz gerektiren ajan görevlerinde Anthropic'in en iyisine yaklaştığını söylüyor
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21
ChatGPT artık iMessage'larınızı okuyup mesaj gönderebiliyor — ve sormayı atlatan ayar, OpenAI'ın uyardığı ayarın ta kendisi
2026-08-21
Ajan, kendi kodunu savunsun diye ikinci bir kişi uydurdu. Teksas'taki 24 yaşındaki öğrenci ikisine de inanmadı.
2026-08-21