aiminute. ← Tüm AI haberleri
Araştırma AI Minute Newsroom 2026-08-25

Stanford'daki bir laboratuvar 535 milyar parametrelik üç aylık eğitim koşusunu herkesin gözü önünde başlattı — kayıp eğrileri, veri karışımı ve başarısız denemeler dahil

Stanford'daki bir laboratuvar 535 milyar parametrelik üç aylık eğitim koşusunu herkesin gözü önünde başlattı — kayıp eğrileri, veri karışımı ve başarısız denemeler dahil

Percy Liang'ın Marin projesi, 535 milyar parametreli ve token başına 23 milyar parametresi etkin olan uzmanlar karışımı model Marin 535B-A23B'nin ön eğitimine 11 adet GB200 NVL72 rafı üzerinde başladı. Yayımlanan plan şöyle: 18,75 trilyon token — yüzde 80 ön eğitim, yüzde 20 ara eğitim — kabaca üç ay ve yaklaşık 2,7e24 FLOP, ardından son eğitim aşaması. Sıradan bir model çıkışından farkı, koşunun kendisinin açık olması: canlı kayıp eğrileri, veri karışımı, donanım telemetrisi, yapılandırmalar, mühendislik çıktıları ve işe yaramayan denemeler paylaşılıyor; dışarıdan insanlar GitHub üzerinden deney önerebiliyor, hatta koşturabiliyor. Ekip başlamadan önce tarifi sabitlemek için bir dizi küçük model eğitmiş.

Bu neden önemli?Kamuoyunun büyük model eğitimi hakkında bildiği neredeyse her şey, bitmiş ağırlıklardan ve sonradan yazılmış makalelerden geliyor. Verilen kararlar, çıkmaz sokaklar ve koşunun dengesini kaybettiği saatler tam da laboratuvarların yayımlamadığı şeyler — ve işin zanaatının büyük kısmı orada. 2,7e24 FLOP ölçeğinde bir koşunun açıkta yürümesi, sınır laboratuvarlarının dışındaki insanların bu kararları alınırken izleyebileceği ilk fırsat; üstelik öğrenilenlerin hâlâ aktarılabileceği kadar sınıra yakın bir ölçekte.

✓ Doğrulandı · 3 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Devlet bağlantılı saldırı ekipleri, sıkıcı işleri bir modele devrettikten sonra saldırı hacimlerini iki katından fazla artırdı
2026-08-25
Matematikçilerin 1948'den beri cevaplayamadığı bir soru, pazar günü X'e yüklenen 108 sayfalık bir dosyayla cevaplandı
2026-08-25
Geçen yılın sonuna gelindiğinde biyomedikal makalelerin onda dokuzu bir dil modelinin parmak izini taşıyordu
2026-08-24
Yöneticilerin yaklaşık yüzde 90'ı yapay zekânın verimliliği artırmadığını söylüyor. İşten çıkarmalar yine de sürüyor.
2026-08-24
Eski bir Claude, Anthropic'in kendi içerik kuralını 10 denemenin 10'unda çiğnedi — ve hâlâ Azure ile Bedrock üzerinden satılıyor
2026-08-23