aiminute. ← Toute l’actu IA
Nouveaux Modèles 2026-08-15

L'entreprise derrière l'Instagram chinois a ouvert les poids du frère du modèle qui a eu un score parfait aux Olympiades de mathématiques

L'entreprise derrière l'Instagram chinois a ouvert les poids du frère du modèle qui a eu un score parfait aux Olympiades de mathématiques

Xiaohongshu — l'application lifestyle connue à l'étranger sous le nom de RedNote — a publié le 14 août les poids ouverts de dots3-note-prev, un modèle à mélange d'experts totalisant 280 milliards de paramètres mais n'en activant que 16 milliards à la fois, avec une fenêtre de contexte de 512K et des entrées texte, image et parole. Il appartient à la même famille que dots-note-3.0, qui a enregistré le mois dernier ce que son laboratoire décrit comme le premier 42 sur 42 officiel d'une IA aux Olympiades internationales de mathématiques. Le laboratoire a également publié sa méthode d'entraînement, TEMPO, où le modèle alterne entre agir et noter sa propre progression sur des tâches longues, ainsi que deux jeux d'épreuves conçus pour cela : VibeSearchBench, 200 tâches dans 20 domaines, et VibeLifeBench, 20 tâches et 1 247 vérifications individuelles. Selon le laboratoire, ni Claude Opus 5 ni GPT-5.5 n'ont atteint son seuil de réussite.

Pourquoi c'est importantDeux choses sortent de l'ordinaire. D'abord, qui : une application de shopping social, et non un laboratoire, publie des poids ouverts la même semaine qu'Alibaba et Meta — rappel qu'en Chine les entreprises de l'internet grand public disposent de leurs propres équipes de pointe et acceptent d'en donner les résultats. Ensuite, ce qu'elles ont mesuré. Presque tous les jeux d'épreuves publics récompensent un modèle qui répond à une question ; ces deux-là récompensent celui qui mène à terme une course de plusieurs heures — organiser un voyage, faire tourner une opération — et le notent sur plus de mille petites vérifications. C'est l'examen le plus dur et le plus honnête pour un agent, et l'affirmation selon laquelle deux modèles de pointe y échouent mérite une réplication indépendante avant d'être tenue pour acquise.
#Agents IA

✓ Vérifié · 4 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21
Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21
ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21
Montrez-le au robot une fois — de trois à douze secondes — et il réussit 59 fois sur 100 sans le moindre entraînement
2026-08-21
L'agent a inventé une seconde personne pour cautionner son code. Un étudiant de 24 ans au Texas n'a cru ni l'un ni l'autre.
2026-08-21