Wahrscheinlich haben Sie schon mehrmals an diesem Tag den Begriff „Daten“ gehört, noch bevor Sie diesen Leitfaden angeklickt haben. Daten gehören zu den wertvollsten Ressourcen jeder Organisation, insbesondere für Unternehmen aus dem IT-Bereich. Warum? Ihre Möglichkeiten sind grenzenlos.
Daten werden branchenübergreifend für zahlreiche innovative Anwendungsfälle eingesetzt. Daten helfen Maschinen beim Lernen und regen potenzielle Kunden zur Konversion an. Sie sagen Maschinenausfälle voraus, ermöglichen KI-Chatbots, und verbessern sogar das Gesundheitswesen. Außerdem gibt es sie in großer Fülle. Laut aktuellen Statistiken wird das weltweite Datenvolumen bis 2025 voraussichtlich 180 Zettabyte erreichen.
Doch was sind Daten? Diese Frage lässt möglicherweise Bilder von Tabellenkalkulationen mit endlosen Zeilen und Spalten voller Zahlen entstehen. Daten sind jedoch weitaus mehr als das. Wir müssen die verschiedenen Datentypen, Kategorien und Anwendungsfälle verstehen, um ihr volles Potenzial auszuschöpfen.
Weitere Informationen finden Sie auch unter: Was ist Datenvirtualisierung?
Was sind Daten?
Die Definition von Daten ist recht einfach. Laut Merriam-Webster sind Daten „sachliche Informationen (wie Messungen oder Statistiken), die als Grundlage für Schlussfolgerungen, Diskussionen oder Berechnungen dienen“, oder „Informationen in digitaler Form, die übertragen oder verarbeitet werden können“.
Der Begriff „Daten“ kann sich auf Rohdaten beziehen, also die ursprüngliche, unverarbeitete und nicht bereinigte Version von Daten, oder auf verarbeitete Daten, die in ein nutzbares Format übertragen wurden.
Siehe auch: Die besten Tools und Software für Datenanalysen 2022
Was sind die 7 wichtigsten Datentypen?
Daten werden in zwei Haupttypen eingeteilt: qualitative und quantitative.
Daten. Innerhalb dieser beiden Typen gibt es verschiedene Datenkategorien, die von nominalen bis zu intervallskalierten Daten reichen.
Qualitative Daten
Qualitative Daten werden typischerweise nicht in Zahlen, sondern meist in Worten ausgedrückt. Sie sind beschreibender Natur und beschreiben Eigenschaften, die nicht gemessen werden können.
Beispiele für qualitative Daten reichen von Farben bis hin zum Geschlecht. Qualitative Daten können auf vielfältige Weise erhoben werden, etwa durch Umfragen, die Interaktion mit Kunden oder Beobachtung. Anschließend werden sie in einem als qualitative Datenanalyse bezeichneten Verfahren ausgewertet.
Innerhalb des Datentyps der qualitativen Daten gibt es zwei Hauptkategorien: nominale und ordinale Daten.
Nominale Daten
Nominale Daten sind eine Form qualitativer Daten und möglicherweise der einfachste Datentyp. Nominale Daten können in verschiedene, klar voneinander abgegrenzte Kategorien eingeteilt werden, weisen jedoch keine Rangordnung auf. Beispiele für nominale Daten sind der Bundesstaat, in dem Sie leben, oder sogar Ihr bevorzugtes Filmgenre.
Ordinale Daten
Ordinale Daten sind eine Form qualitativer Daten, die in Kategorien eingeteilt werden. Diese Daten weisen jedoch abhängig von der Kategorie eine Rangordnung auf. Häufige Beispiele für ordinale Daten sind das Buchstabennotensystem oder eine Bewertung der Kundenzufriedenheit.
Quantitative Daten
Im Gegensatz zu qualitativen Daten können quantitative Daten in numerischer Form ausgedrückt und einfach gemessen werden. Beispiele für quantitative Daten sind Finanzdaten, Entfernungen, das Alter und die Anzahl verkaufter Produkte. Wenn sich Daten quantifizieren lassen, handelt es sich um quantitative Daten.
Innerhalb des Datentyps der quantitativen Daten gibt es drei Hauptkategorien: diskrete, kontinuierliche, und Intervalldaten.
Diskrete Daten
Diskrete Daten sind quantitative Daten, die mithilfe ganzer Zahlen (Integern) gezählt werden können. Sie lassen sich nicht als Bruch oder Dezimalzahl ausdrücken. Die Anzahl der monatlich wiederkehrenden Kunden ist beispielsweise ein Beispiel für diskrete Daten, da es keinen halben oder drittel Kunden geben kann.
Kontinuierliche Daten
Kontinuierliche Daten sind quantitative Daten, die als Dezimalzahlen und Brüche ausgedrückt werden können, da Genauigkeit entscheidend ist. Sie sind nicht unbedingt zählbar, aber messbar. Während diskrete Daten über einen festgelegten Zeitraum gleich bleiben, können sich kontinuierliche Daten im selben Zeitraum verändern. Beispiele für kontinuierliche Daten sind Eigenschaften wie die Körpergröße.
Intervallskalierte Daten
Intervallskalierte Daten sind quantitative Daten, die entlang einer Skala anhand von Intervallen oder Punkten gemessen werden, die den gleichen Abstand voneinander haben. Ein häufig vorkommender Typ intervallskalierter Daten ist die Zeit, bei der die Abstände zwischen Punkten (etwa von 12:00 bis 1:00 Uhr und von 1:00 bis 2:00 Uhr) gleich groß sind.
Weitere Informationen finden Sie auch unter: Die besten Lösungen für Predictive Analytics
Woher stammen Daten?
Daten werden aus zahlreichen Quellen erhoben. Zu den häufigsten Datenquellen gehören:
Aktivitäten in sozialen Medien: Öffentliche Daten sind eine der häufigsten Datenquellen. Eine enorme Menge öffentlicher Daten stammt aus den Inhalten, die wir in Social-Media-Konten wie Facebook, Twitter und Instagram teilen. Daten lassen sich auch aus den Websites gewinnen, die wir häufig besuchen, etwa Google.
Finanztransaktionen: Unternehmen nutzen häufig Kaufdaten ihrer Kunden, um Marketinginitiativen und die künftige Produktentwicklung zu planen. Zu den aus diesen Transaktionen gewonnenen Daten gehören Zahlungsmethoden, gekaufte Produkte, demografische Daten der Verbraucher und vieles mehr.
Sensoren des Internets der Dinge (IoT): Das Internet of Things bezeichnet das Netzwerk verbundener Geräte wie Smartphones, Wearables und IoT-Sensoren. Diese Sensoren werden häufig in Branchen wie der Fertigung eingesetzt, um Daten über die Funktion von Maschinen und die Produktion zu erfassen.
Kundeninteraktionen: Organisationen erfassen typischerweise Daten aus Kundeninteraktionen, sei es über einen Chatbot, per E-Mail oder telefonisch. Die Daten können von Kundennamen bis zu den Inhalten des Gesprächs reichen. Diese Daten können anschließend zur Verbesserung des Kundenservice, für Schulungen und für eine Vielzahl weiterer Initiativen verwendet werden. Kundendaten können auch direkt durch Umfragen und Fragebögen erhoben werden.
Wie werden Daten heute genutzt? 4 häufige Anwendungsfälle
Nach der Erfassung können Daten analysiert und auf vielfältige Weise genutzt werden. Das gilt unabhängig von der Branche. Tatsächlich sorgt Datenanalyse in allen Märkten für Bewegung – vom Gesundheitswesen bis zur Fertigung.
Maschinelles Lernen
Maschinelles Lernen bezeichnet die Fähigkeit einer Maschine, mithilfe historischer Daten zu „lernen“. Durch die Eingabe von Daten können Algorithmen darauf trainiert werden, Muster in künftigen Daten zu erkennen, Anomalien aufzuspüren und Entscheidungen zu treffen.
Maschinelles Lernen bietet in allen Branchen unzählige Anwendungsmöglichkeiten. Finanzinstitute können Verbraucher beispielsweise besser vor Betrug schützen, indem sie Modelle für maschinelles Lernen einsetzen, die betrügerische Aktivitäten auf Konten automatisch erkennen.
Künstliche Intelligenz
Künstliche Intelligenz ist inzwischen im Mainstream angekommen und wird auf vielfältige Weise eingesetzt. Ohne enorme Datenmengen wäre KI jedoch nicht möglich. ChatGPT, ein bahnbrechendes KI-Sprachmodell, benötigt beispielsweise riesige Mengen an Sprachdaten, um zu funktionieren. Diese Daten stammen aus Quellen wie Internetartikeln und anderen Texten.
Weitere Beispiele für KI sind virtuelle Assistenten, Robotik, Gesichtserkennung und sogar die Autokorrektur, die wir täglich nutzen. All diese Beispiele benötigen Daten in ihren vielfältigen Formen, um zu funktionieren.
Siehe auch: KI-Typen mit Anwendungsfällen
Business Intelligence
Business Intelligence bezeichnet den Prozess, Daten für fundierte Geschäftsentscheidungen zu nutzen. Beispielsweise können Finanzdaten eines Unternehmens zur Aufstellung der Jahresbudgets herangezogen werden, während Kundendaten die Entwicklung effektiverer Marketingkampagnen unterstützen können.
Kundentransaktionen und CRM-Software sind zwei wichtige Quellen für Business-Intelligence-Daten. Über Datenvisualisierungsplattformen , die speziell für Business Intelligence entwickelt wurden, lassen sich Erkenntnisse mithilfe einfacher Diagramme und Berichte problemlos in Echtzeit visualisieren.
Predictive Analytics
Predictive Analytics bezeichnet den Prozess, Daten zur Vorhersage von Ergebnissen und Ereignissen zu nutzen. In der Fertigung kann dieser Prozess beispielsweise eingesetzt werden, um vorherzusagen, wann Maschinen aufgrund einer Fehlfunktion ungeplante Stillstandszeiten haben werden, bevor dies geschieht. So können Hersteller vorbeugende Wartungsarbeiten oder Reparaturen durchführen, bevor die Produktion zum Stillstand kommt.
Predictive Analytics kann im Geschäftsbereich auch zur Vorhersage des Verbraucherverhaltens oder im Gesundheitswesen zur Vorhersage von Behandlungsergebnissen eingesetzt werden, was zu einer besseren Versorgung führen kann.
So schöpfen Sie das volle Potenzial von Daten aus
Daten können komplex wirken. In der heutigen datengetriebenen Welt ist die Datenanalyse jedoch einfacher als je zuvor. Data-Science-Plattformen können inzwischen Daten extrahieren, laden und transformieren und dabei ohne Ihr Zutun umsetzbare Erkenntnisse liefern. Die Zukunft sieht für Daten in all ihren Formen und für die Organisationen, die sie nutzen, vielversprechend aus.
Möchten Sie noch tiefer in Big Data und Analytics eintauchen? Sehen Sie sich unseren Leitfaden an: Was ist Datenanalyse?

