Le plus grand salon du secteur des communications, Enterprise Connect, se tient cette semaine à Orlando, en Floride. Lors de l’événement, Amazon Web Services (AWS) a annoncé ses nouvelles analyses d’appels Amazon Chime SDK, un ensemble de fonctionnalités qui simplifient l’enregistrement des appels audio en temps réel et la génération d’informations à partir de ceux-ci, tout en réduisant leur coût.
Le service fonctionne avec n’importe quel système SIP ou WebRTC, de sorte que les clients peuvent utiliser leur solution UC ou CC préférée tout en profitant des avantages de Chime SDK.
Voir aussi :Les principaux fournisseurs et entreprises de services cloud
Intégrer les communications aux applications
Les SDK Amazon Chime constituent un ensemble de fonctionnalités de communication en temps réel permettant aux développeurs d’intégrer la voix, la vidéo, la messagerie et d’autres fonctions dans les applications. Chime est arrivé chez Amazon avec l’acquisition de Biba, en tant qu’application UC, mais AWS l’a fait évoluer d’un client prêt à l’emploi vers les SDK. Compte tenu de l’encombrement actuel du marché, c’est la bonne décision, car elle répond à ce que je considère comme les besoins futurs des communications.
Les travailleurs du savoir sont plus productifs avec un client UC, car celui-ci facilite la collaboration. En revanche, d’autres métiers gagneraient à disposer de communications directement intégrées à leur application.
Par exemple, un médecin pourrait communiquer plus efficacement avec un patient si le dossier médical et la vidéo se trouvaient dans une seule application, au lieu de devoir passer de l’un à l’autre. Le développeur peut également optimiser l’application en fonction du cas d’usage. C’est notamment le cas d’un appel dans un secteur réglementé, qui serait automatiquement enregistré et archivé, au lieu de nécessiter l’activation manuelle de l’enregistrement par un employé.
L’analyse de la tonalité vocale extrait le sentiment
Le nouveau SDK offre deux fonctionnalités essentielles. La première est l’analyse de la tonalité vocale, qui utilise l’apprentissage automatique pour extraire le sentiment d’un signal vocal à partir d’une analyse combinée des informations lexicales et linguistiques, ainsi que des données acoustiques et tonales.
Le produit fonctionne sur plusieurs systèmes et permet à une organisation de créer un lac de données unique regroupant toutes les informations vocales. Les administrateurs peuvent également utiliser les services AWS pour créer des tableaux de bord personnalisés afin de visualiser les données comme ils le souhaitent, à l’aide d’outils tels qu’Amazon Tableau ou QuickSight.
Le cas d’usage le plus évident de l’analyse de la tonalité vocale concerne les secteurs réglementés, soumis à de strictes exigences de conformité. Par exemple, une société financière pourrait déployer cette technologie sur son desk de négociation. Le produit peut servir à enregistrer tous les appels et à utiliser l’analyse de la tonalité vocale pour déterminer si les traders tiennent des propos qu’ils ne devraient pas tenir, ou si le ton d’un client passe du positif au négatif, ou inversement, ce qui pourrait signaler un problème.
Si des secteurs comme la finance et la santé sont les plus évidents, l’analyse de la tonalité vocale peut être utilisée dans tous les secteurs, car la capacité à comprendre le sentiment exprimé lors d’un appel peut servir à la formation ou à l’amélioration des processus. Les données peuvent être analysées, les problèmes identifiés et des mesures correctives prises.
La recherche de locuteurs simplifie l’identification des appelants
L’autre fonctionnalité s’appelle la recherche de locuteurs : un utilisateur se voit attribuer une « empreinte vocale » et l’identité de cette personne est enregistrée dans une base de données. Les algorithmes sont très efficaces et n’ont besoin que d’un court extrait vocal pour reconnaître un utilisateur connu.
La recherche de locuteurs accélère l’identification des appelants et enrichit les enregistrements ainsi que les transcriptions d’appels en leur associant une identité. Elle fournit un identifiant interne unique suggéré pour le locuteur, ainsi qu’un score de confiance. La décision d’associer le locuteur actuel à un locuteur connu de la base de données peut être prise au cas par cas, en fonction de l’utilisation de l’application.
Voir aussi :Les outils de communications unifiées stimulent le travail hybride, mais créent des risques
En résumé : promouvoir la plateforme cloud AWS
Pour les clients AWS, si le SDK apporte en lui-même une valeur ajoutée, son principal avantage est ailleurs. Une fois toutes les informations vocales agrégées, elles peuvent être stockées dans un lac de données situé à l’emplacement choisi par le client. Comme celui-ci utilise AWS, il les stockera probablement dans le cloud AWS. Les clients peuvent ainsi utiliser d’autres applications et services AWS pour tirer davantage de valeur de leurs données.
Par exemple, Amazon Transcribe et Transcribe Call Analytics peuvent être appliqués au lac de données afin de générer des informations. De même, les données peuvent être stockées dans un compartiment Amazon S3, tandis que les analyses vocales peuvent envoyer des notifications en temps réel à une fonction déployée sur AWS Lambda ou à une file d’attente SQS.
Au cours des dernières années, AWS a remarquablement simplifié l’utilisation d’un ensemble plus large de services cloud, permettant aux clients d’accélérer l’innovation. À mesure que les communications deviennent plus composables, je m’attends à voir AWS commercialiser davantage de SDK afin de permettre aux clients de créer des applications enrichies en fonctionnalités de communication.


