Nvidia 11 Ağustos'ta Nemotron 3.5 Lightning'i yayımladı: her token için yalnızca 3 milyar parametresini etkinleştiren 30 milyar parametreli bir uzmanlar karışımı (MoE) modeli. Bağlam penceresi 1 milyon tokene kadar çıkıyor, ağırlıklar ise izin verici OpenMDW-1.1 lisansı altında — şirketler Nvidia'dan izin almadan indirip değiştirebilir ve üzerine ürün kurabilir. Model, ajan işinin gösterişsiz yarısı için tasarlanmış: kod incelemesi, araç çağrıları, güvenlik uyarılarının izlenmesi, fatura sorularının yanıtlanması; yani sınır modelin planlayacağı ama kendisinin yapmasına gerek olmayan adımlar. Nvidia, kendi sınıfındaki modellere kıyasla dört katına varan çıktı hızı ve %30 daha hızlı ajan görevi tamamlama iddia ediyor; MMLU Pro'da 81,62, GPQA Diamond'da 75,57 ve SWE-bench Verified'da 52,80 puan bildiriyor. Model RTX bilgisayarlarda, DGX Spark, DGX Station ve Jetson kartlarında yerel olarak çalışıyor, veri merkezlerine de ölçekleniyor; Hugging Face, ModelScope ve OpenRouter üzerinden erişilebiliyor. Nvidia aynı gün NeMo Switchyard'ı da açık kaynak yaptı: bir iş akışının her adımını o adımı kaldırabilecek en ucuz modele yönlendiren bir kütüphane. Nvidia'nın kendi ölçümlerine göre Switchyard ile yönlendirilen bir kurulum, her şeyi Opus 4.8'e yaptırmanın maliyetinin yaklaşık üçte birine iniyor.