L'IA vocale passe de la démo à la production, ce qui signifie que les passerelles API doivent gérer bien plus que de simples requêtes HTTP. OctaFuse 2.4.0 répond à ce besoin en unifiant le routage pour les services de reconnaissance vocale (ASR) et de synthèse vocale (TTS) de DashScope. La mise à jour prend en charge la conversion synchrone, les tâches asynchrones, les réponses audio complètes, les flux audio continus et la communication WebSocket bidirectionnelle pour la voix en temps réel. Pour les développeurs, cela signifie qu'une seule configuration de passerelle peut gérer divers modèles d'interaction vocale sans code de collage personnalisé. Cette version met en évidence une tendance plus large : à mesure que la voix devient une interface standard, l'infrastructure doit s'adapter à ses exigences uniques – sensibilité à la latence, données en streaming et protocoles de transport mixtes.
OctaFuse 2.4.0 introduit un routage unifié pour les services ASR et TTS de DashScope, prenant en charge les modes synchrone, asynchrone, streaming et WebSocket. Un signal de l'évolution des passerelles API vers des charges de travail vocales complexes.