aiminute. ← Todas las noticias de IA
Investigación 2026-08-08

ARC Prize verifica a DeepSeek V4 Flash: 61% en ARC-AGI-2 a cuatro centavos por tarea

ARC Prize verifica a DeepSeek V4 Flash: 61% en ARC-AGI-2 a cuatro centavos por tarea

El equipo de ARC Prize publicó resultados semiprivados verificados del modelo de pesos abiertos V4 Flash 0731 de DeepSeek: 89,0% en ARC-AGI-1 a unos dos centavos por tarea y 61,4% en ARC-AGI-2 a unos cuatro centavos, con el máximo esfuerzo de razonamiento. El modelo es una mezcla de expertos de 284.000 millones de parámetros que solo activa 13.000 millones por token y maneja un contexto de un millón de tokens. El resultado escaló a lo más alto de Hacker News, donde la relación precio-rendimiento acaparó la conversación.

Por qué importaARC-AGI-2 se diseñó para resistir la memorización y premiar el razonamiento abstracto genuino; que un modelo abierto de activación pequeña logre esta puntuación a precios de calderilla cierra una brecha más entre la IA abierta y la cerrada. Para los desarrolladores significa que el razonamiento casi de frontera ya se puede descargar y ejecutar, no solo alquilar.

✓ Verificado · 2 fuentes

▶ Vídeo relacionado: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

El aprendizaje automático leyó la forma de células cerebrales enfermas y eligió nueve fármacos ya aprobados que las calmaron
2026-08-21
Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21
El agente se inventó a una segunda persona para avalar su código. Un joven de 24 años en Texas no creyó a ninguno de los dos.
2026-08-21
Pew pasó medio millón de páginas web por un detector: un tercio de todo lo publicado desde ChatGPT lleva sus marcas
2026-08-21
La FDA ha autorizado 1.357 dispositivos médicos con IA. Tres se han evaluado según si los pacientes viven más o mejor.
2026-08-20