aiminute. ← Tüm AI haberleri
Araştırma AI Minute Newsroom 2026-08-07

Bağımsız ölçümler: Qwen3.8-Max, ABD öncülerinin hemen altında — ama çok daha fazla çabalayarak

Bağımsız ölçümler: Qwen3.8-Max, ABD öncülerinin hemen altında — ama çok daha fazla çabalayarak

Artificial Analysis, Alibaba'nın Qwen3.8-Max modeline Zekâ Endeksi'nde 56 puan verdi — Google, Meta ve xAI'ın tüm modellerinin üzerinde; yalnızca Anthropic ile OpenAI'ın en üst modelleri ve Kimi K3 daha yüksek. Ajan odaklı GDPval-AA sıralamasında ise 1739 Elo ile, 1852'lik Claude Opus 5 max'ın ardından ikinci. Kazanımın bedeli var: ajan görevi başına ortalama 64 tur harcıyor (Qwen3.7-Max'ta 14'tü) ve görev başına maliyet iki kattan fazla artarak 1,14 dolara çıkıyor.

Bu neden önemli?Bağımsız rakamlar artık iki Çinli açık ağırlıklı modeli küresel ilk dörde koyuyor — ama tur sayısı ayrıntısı en az sıralama kadar önemli: fark kaba kuvvetle kapatılıyor ve bu çaba gerçek kullanım faturalarına yansıyor. Benchmark sırası ile görev başına maliyet ayrışıyor; alıcıların ikisini birden okuması gerek.
#Ajanlar

✓ Doğrulandı · 2 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Aynı işi yirmi kez tekrarlayınca en iyi ajanın puanı üçte bir düştü.
2026-10-06
Bir model, bütün yapay zekâyı eğiten yöntem olmadan öğrendi.
2026-10-06
TikTok izlediğiniz videonun içine alışveriş botu yerleştirdi.
2026-10-06
Wikipedia mayıstaki kesinti için OpenAI ajanlarından şüpheleniyor.
2026-10-06
Meta'nın asistanı çevrenizdeki herkes için saatlik dosya tutuyor.
2026-10-05