Microsoft ने 1 अक्टूबर को अपना पहला सजीव आवाज-से-लिखाई मॉडल MAI-Transcribe-2-Streaming जारी किया। आवाज मिलने के करीब 100 मिलीसेकंड बाद यह कच्चे शब्द देता है, रुकने पर 0.13 सेकंड में पूरा। Artificial Analysis ने सजीव सटीकता में इसे पहला रखा, गलती दर 2.5% और 60 भाषाएं।