Le 31 juillet, Huawei a publié les poids, le code d'inférence et le rapport technique d'openPangu-2.0-Pro : un modèle à mélange d'experts de 505 milliards de paramètres (environ 18 milliards actifs par token), doté d'une fenêtre de contexte de 512K et entraîné sur près de 34 000 milliards de tokens. Le point marquant est le matériel : tout l'entraînement s'est déroulé sur les NPU Ascend de Huawei, sans la moindre puce Nvidia. Cette publication honore la promesse faite à la conférence développeurs de juin.