Un modèle vocal open-source écoute en continu et décide tous les 0,4s de parler
Audio Interaction traite la parole en temps réel sans attendre la fin d'un enregistrement, contrairement à GPT-4o ou Qwen3.5-Omni
Le modèle transcrit, traduit, répond et détecte les bruits ambiants (toux, etc.) dans un flux unique et continu
Code, poids du modèle et données d'entraînement disponibles en open-source sous licence Apache 2.0 sur GitHub
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.