Meta veröffentlichte Muse Voice Transcribe am 1. September, sein erstes Echtzeit-Audiomodell. In einem Durchgang schreibt es die Wörter, trennt die Sprecher und erkennt jede Pause. Der Endtext kommt 0,16 Sekunden nach dem Sprechen, und Meta verkauft ihn nur als Schnittstelle.