aiminute. ← Alle KI-News
Neue Modelle AI Minute Newsroom 2026-09-14

Xiaomis offenes Modell greift eine Stimme aus dreien heraus.

Xiaomis offenes Modell greift eine Stimme aus dreien heraus.

Xiaomi veröffentlichte am Freitag CocktailASR-1, ein kostenloses Sprachmodell. Sie geben ihm eine kurze Probe der gesuchten Stimme, alle anderen blendet es aus. In einem Test mit drei Stimmen irrte es bei 12,29 Prozent der Wörter, bei zwei nur bei 4,11 Prozent.

Warum es wichtig istProtokolle und Untertitel zerfallen, sobald zwei Menschen gleichzeitig reden. Die Gewichte sind offen, das läuft also auf Ihrem eigenen Rechner statt auf einem Server.
#Audio & Musik

✓ Verifiziert · 3 Quellen

▶ Passendes Video: Solving the Cocktail Party Problem with Deep Learning (In-depth version)
WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

DeepSeek testet seinen ersten Sprachmodus bei wenigen Nutzern.
2026-09-14
ElevenLabs lässt sogar den Gratistarif seine Songs verkaufen.
2026-09-13
Das Gratismodell eines chinesischen Händlers malt die Welt im Gehen.
2026-09-13
Kimis günstiges Codemodell öffnet die Million Token für alle.
2026-09-12
Eine chinesische Kartenapp baute eine begehbare 3D-Welt.
2026-09-11