aiminute. ← Todas las noticias de IA
Nuevos Modelos AI Minute Newsroom 2026-09-14

El modelo abierto de Xiaomi aísla una voz entre tres que hablan.

El modelo abierto de Xiaomi aísla una voz entre tres que hablan.

Xiaomi publicó el viernes CocktailASR-1, un modelo de voz gratuito. Le das una muestra corta de la voz elegida y el modelo ignora a los demás. En una prueba con tres voces falló el 12,29% de las palabras, y el 4,11% con dos.

Por qué importaLas actas y los subtítulos se rompen en cuanto dos personas hablan a la vez. Los pesos son abiertos, así que esto corre en tu propio equipo y no en un servidor ajeno.
#Audio y Música

✓ Verificado · 3 fuentes

▶ Vídeo relacionado: Solving the Cocktail Party Problem with Deep Learning (In-depth version)
WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

DeepSeek prueba su primer modo de voz con unos pocos usuarios.
2026-09-14
ElevenLabs deja que hasta el plan gratuito venda sus canciones.
2026-09-13
El modelo gratis de una tienda china dibuja el mundo al caminar.
2026-09-13
El modelo barato de Kimi abre el millón de tokens a todos.
2026-09-12
Una app china de mapas creó un mundo 3D por el que volar.
2026-09-11