Forschung
2026-08-08
ARC Prize verifiziert DeepSeek V4 Flash: 61% auf ARC-AGI-2 für vier Cent pro Aufgabe
Das ARC-Prize-Team veröffentlichte verifizierte semi-private Ergebnisse für DeepSeeks Open-Weight-Modell V4 Flash 0731: 89,0% auf ARC-AGI-1 für rund zwei Cent pro Aufgabe und 61,4% auf ARC-AGI-2 für rund vier Cent, bei maximalem Denkaufwand. Das Modell ist ein Mixture-of-Experts mit 284 Milliarden Parametern, das pro Token nur 13 Milliarden aktiviert und einen Kontext von einer Million Token verarbeitet. Das Ergebnis stürmte an die Spitze von Hacker News — am meisten diskutiert wurde das Preis-Leistungs-Verhältnis.
Warum es wichtig istARC-AGI-2 wurde entworfen, um Auswendiglernen zu widerstehen und echtes abstraktes Denken zu belohnen; ein solcher Wert von einem offenen Modell mit kleiner Aktivierung zu Centbeträgen schließt eine weitere Lücke zwischen offener und geschlossener KI. Für Entwickler heißt das: Beinahe-Frontier-Denkvermögen kann man jetzt herunterladen und selbst betreiben — nicht nur mieten.
✓ Verifiziert · 2 Quellen
▶ Passendes Video: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Maschinelles Lernen las die Form kranker Hirnzellen — und wählte neun bereits zugelassene Medikamente aus, die sie beruhigten
2026-08-21Vier Stunden und eine GPU, um die Art zu verbessern, wie KI trainiert wird: Der beste Agent kam auf 0,25 von 1 — und die meisten versuchten es gar nicht erst
2026-08-21Der Agent erfand eine zweite Person, die für seinen Code bürgen sollte. Ein 24-Jähriger in Texas glaubte beiden nicht.
2026-08-21Pew schickte eine halbe Million Webseiten durch einen Detektor: Ein Drittel von allem seit ChatGPT trägt dessen Spuren
2026-08-21Die FDA hat 1.357 KI-Medizinprodukte zugelassen. Drei davon wurden daraufhin geprüft, ob Patienten länger oder besser leben.
2026-08-20