aiminute. ← Tüm AI haberleri
Yeni Modeller 2026-08-11

Nvidia'nın yeni açık modeli 30 milyar parametreli ama aynı anda 3 milyarını kullanıyor — ve masaüstünde çalışıyor

Nvidia'nın yeni açık modeli 30 milyar parametreli ama aynı anda 3 milyarını kullanıyor — ve masaüstünde çalışıyor

Nvidia 11 Ağustos'ta Nemotron 3.5 Lightning'i yayımladı: her token için yalnızca 3 milyar parametresini etkinleştiren 30 milyar parametreli bir uzmanlar karışımı (MoE) modeli. Bağlam penceresi 1 milyon tokene kadar çıkıyor, ağırlıklar ise izin verici OpenMDW-1.1 lisansı altında — şirketler Nvidia'dan izin almadan indirip değiştirebilir ve üzerine ürün kurabilir. Model, ajan işinin gösterişsiz yarısı için tasarlanmış: kod incelemesi, araç çağrıları, güvenlik uyarılarının izlenmesi, fatura sorularının yanıtlanması; yani sınır modelin planlayacağı ama kendisinin yapmasına gerek olmayan adımlar. Nvidia, kendi sınıfındaki modellere kıyasla dört katına varan çıktı hızı ve %30 daha hızlı ajan görevi tamamlama iddia ediyor; MMLU Pro'da 81,62, GPQA Diamond'da 75,57 ve SWE-bench Verified'da 52,80 puan bildiriyor. Model RTX bilgisayarlarda, DGX Spark, DGX Station ve Jetson kartlarında yerel olarak çalışıyor, veri merkezlerine de ölçekleniyor; Hugging Face, ModelScope ve OpenRouter üzerinden erişilebiliyor. Nvidia aynı gün NeMo Switchyard'ı da açık kaynak yaptı: bir iş akışının her adımını o adımı kaldırabilecek en ucuz modele yönlendiren bir kütüphane. Nvidia'nın kendi ölçümlerine göre Switchyard ile yönlendirilen bir kurulum, her şeyi Opus 4.8'e yaptırmanın maliyetinin yaklaşık üçte birine iniyor.

Bu neden önemli?Yönlendirici, modelden daha önemli olabilir. Nvidia'nın savı şu: pahalı sınır modeli planlamayı yapsın, neredeyse başka hiçbir şey yapmasın — çünkü bir ajanın gerçekte yaptığı işin çoğu küçük, tekrarlayan ve bir iş istasyonuna sığan bir modele devredilebilir işler. Bu, Nvidia'nın çip sattığı laboratuvarların token başına gelir modeline doğrudan bir saldırı; üstelik Nvidia savın iki yarısını da tek günde, ücretsiz yayımladı. Kısıtlı bütçeyle ajan çalıştıran herkes için — bir okul laboratuvarı, küçük bir ekip, tek başına çalışan bir geliştirici — pratik sonuç şu: yerel model seçeneğinin ciddi bir adayı daha oldu ve lisansı kimseden izin almayı gerektirmiyor.
#Kodlama#Ajanlar

✓ Doğrulandı · 3 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Söylenti: Bir kodlama kıyaslamasının tepesine ücretsiz oturan isimsiz modelin, Zhipu'nun yayınlanmamış amiral gemisi olduğu iddia ediliyor
2026-08-21
DeepSeek'in ucuz beygiri artık görüyor — göz gerektiren ajan görevlerinde Anthropic'in en iyisine yaklaştığını söylüyor
2026-08-21
Nvidia, rakibinin model üreten makinesine 6 milyar dolar ödüyor — ve o makineyi çalıştıran 109 kişiyi işe alıyor
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21
ChatGPT artık iMessage'larınızı okuyup mesaj gönderebiliyor — ve sormayı atlatan ayar, OpenAI'ın uyardığı ayarın ta kendisi
2026-08-21