Retour au feed
The Decoder·

New open-source voice model listens nonstop and decides every 0.4 seconds whether to speak or stay silent

Signal
72
Hype
35
En 3 lignesUn modèle vocal open-source écoute en continu et décide toutes les 0.4 secondes s'il doit parler ou rester silencieux. Contrairement à GPT-4o ou Qwen3.5-Omni, Audio Interaction traite transcription, traduction et chat en flux unique, détectant bruits ambiants (toux). Code, poids et données d'entraînement disponibles sur GitHub sous licence Apache 2.0.
Lire la source
Ton avis ?
VoixOpen sourceAgents IA

Résumé généré par Claude — vérifié par l'humain