Die größte Messe der Kommunikationsbranche, die Enterprise Connect, findet diese Woche in Orlando, Florida, statt. Auf der Veranstaltung kündigte Amazon Web Services (AWS) seine neue Amazon-Chime-SDK-Anrufanalyse an. Dabei handelt es sich um eine Reihe von Funktionen, die das Aufzeichnen und die Gewinnung von Erkenntnissen aus Audioanrufen in Echtzeit vereinfachen und kostengünstiger machen.
Der Dienst funktioniert mit jedem SIP- oder WebRTC-System, sodass Kunden ihre bevorzugte UC- oder CC-Lösung einsetzen und dennoch die Vorteile des Chime SDK nutzen können.
Siehe auch: Die wichtigsten Cloud-Service-Provider und Unternehmen
Kommunikation in Anwendungen integrieren
Amazon Chime SDKs sind eine Reihe von Echtzeit-Kommunikationsfunktionen, mit denen Entwickler Sprach-, Video-, Messaging- und andere Funktionen in Anwendungen integrieren können. Chime kam durch die Übernahme von Biba als UC-Anwendung zu Amazon, aber AWS hat den Schwerpunkt von einem vorkonfigurierten Client auf die SDKs verlagert. Angesichts des heute so umkämpften Marktes ist das der richtige Schritt, denn damit wird auf das eingegangen, was meiner Ansicht nach die künftigen Anforderungen an Kommunikation sind.
Wissensarbeiter sind mit einem UC-Client produktiver, da er eine bessere Zusammenarbeit ermöglicht. Andere Tätigkeiten würden jedoch davon profitieren, wenn die Kommunikation direkt in die Anwendung integriert wäre.
Ein Arzt könnte beispielsweise effizienter mit einem Patienten sprechen, wenn sich die Krankenakte und das Video in einer Anwendung befänden, statt zwischen beiden wechseln zu müssen. Außerdem kann der Entwickler die Anwendung für den jeweiligen Anwendungsfall optimieren. Ein Beispiel dafür ist ein Anruf in einer regulierten Branche, der automatisch aufgezeichnet und archiviert würde, statt dass ein Mitarbeiter die Aufzeichnung erst aktivieren muss.
Sprachanalyse ermittelt die Stimmung
Das neue SDK bietet zwei zentrale Funktionen. Die erste ist die Sprachanalyse, die maschinelles Lernen nutzt, um anhand einer kombinierten Analyse lexikalischer und linguistischer Informationen sowie akustischer und tonaler Daten die Stimmung aus einem Sprachsignal zu ermitteln.
Das Produkt funktioniert systemübergreifend und ermöglicht es einem Unternehmen, einen einzigen Data Lake mit sämtlichen Sprachinformationen anzulegen. Außerdem können Administratoren die AWS-Dienste nutzen, um benutzerdefinierte Dashboards zu erstellen und die Daten mithilfe von Tools wie Amazon Tableau oder QuickSight so zu visualisieren, wie sie sie sehen möchten.
Der naheliegendste Einsatzbereich für die Sprachanalyse sind regulierte Branchen, in denen strenge Compliance-Anforderungen erfüllt werden müssen. Ein Finanzunternehmen könnte die Technologie beispielsweise an seinem Handelsdesk einsetzen. Das Produkt kann genutzt werden, um alle Anrufe aufzuzeichnen und mithilfe der Sprachanalyse festzustellen, ob Händler Dinge sagen, die sie nicht sagen sollten, oder ob die Stimmung eines Kunden von positiv zu negativ oder umgekehrt wechselt, da dies auf ein Problem hindeuten könnte.
Während Branchen wie das Finanz- und Gesundheitswesen die offensichtlichsten Einsatzbereiche sind, kann die Sprachanalyse in jeder Branche eingesetzt werden, da sich die Stimmung eines Anrufs beispielsweise für Coaching oder Prozessverbesserungen nutzen lässt. Die Daten können analysiert, Probleme erkannt und Korrekturmaßnahmen ergriffen werden.
Sprechersuche vereinfacht die Identifizierung von Anrufern
Die andere Funktion heißt Sprechersuche. Dabei wird ein Nutzer per „Stimmabdruck“ erfasst und die Identität der betreffenden Person in einer Datenbank gespeichert. Die Algorithmen sind äußerst effizient und benötigen nur einen kurzen Sprachabschnitt, um einen bekannten Nutzer zu erkennen.
Die Sprechersuche beschleunigt die Suche nach Anrufern und reichert Anrufaufzeichnungen und Transkripte mit einer Identitätszuordnung an. Sie liefert einen vorgeschlagenen eindeutigen internen Bezeichner für den Sprecher sowie einen Vertrauenswert. Ob der aktuelle Sprecher einem bekannten Sprecher aus der Datenbank zugeordnet wird, kann je nach Anwendung und Verwendungszweck auf Anwendungsebene entschieden werden.
Siehe auch: Unified-Communications-Tools fördern hybrides Arbeiten, schaffen aber Risiken
Fazit: Die AWS-Cloud-Plattform voranbringen
Für AWS-Kunden bietet das SDK selbst zwar einen Mehrwert, doch der größere Vorteil liegt woanders. Sobald alle Sprachinformationen zusammengeführt sind, können sie in einem Data Lake an einem vom Kunden gewählten Ort gespeichert werden. Da der Kunde AWS nutzt, werden die Daten wahrscheinlich in der AWS Cloud gespeichert. Auf diese Weise können Kunden weitere AWS-Anwendungen und -Dienste nutzen, um mehr Wert aus den Daten zu schöpfen.
Beispielsweise können Amazon Transcribe und Transcribe Call Analytics auf den Data Lake angewendet werden, um Erkenntnisse zu gewinnen. Ebenso können die Daten in einem Amazon-S3-Bucket gespeichert werden, während Sprachanalysen Echtzeitbenachrichtigungen an eine auf AWS Lambda bereitgestellte Funktion oder eine SQS-Warteschlange senden können.
In den vergangenen Jahren hat AWS hervorragende Arbeit geleistet, um die Nutzung eines breiteren Spektrums von Cloud-Diensten zu vereinfachen und Kunden dadurch zu ermöglichen, Innovationen schneller voranzutreiben. Da Kommunikation zunehmend aus modular kombinierbaren Komponenten besteht, erwarte ich, dass AWS weitere SDKs auf den Markt bringen wird, mit denen Kunden kommunikationsreiche Anwendungen entwickeln können.


