Ein Schlüsselelement der künstlichen Intelligenz, künstliche neuronale Netze (KNNs) funktionieren ähnlich wie das menschliche Gehirn. Sie ahmen die Funktionsweise echter biologischer Neuronen nach, um Antworten auf komplexe Fragen und Herausforderungen der Datenverarbeitung zu finden. Die Methode, die Millionen künstlicher Neuronen umfassen kann, fällt unter den Oberbegriff des maschinellen Lernens. Sie erzeugt mathematische Algorithmen, die häufig zur Erkennung von Mustern und zur Lösung komplexer Probleme in Wissenschaft und Wirtschaft eingesetzt werden.
KNNs, die auch als simulierte neuronale Netze (SNNs) bezeichnet werden, verwenden Schaltkreise, um miteinander zu kommunizieren. Typischerweise basiert ein neuronales Netz auf Knoten, die aus einer Eingabeschicht, einer oder mehreren verborgenen Schichten und einer Ausgabeschicht bestehen. Jedem einzelnen Knoten werden ein Gewicht und ein Schwellenwert zugewiesen. Wird ein Schwellenwert aktiviert, fließen Daten durch den Knoten und verbinden ihn mit anderen Knoten oder Schichten. Lösen die Daten keine Reaktion aus, ignoriert das System sie in der Regel.
Ein neuronales Netz verwendet Trainingsdaten, um komplexe und oft verborgene Muster zu erkennen und Algorithmen zu entwickeln. Mit der Zeit und zunehmender Datenmenge verbessert sich seine Genauigkeit. Dadurch erzeugt diese Technik des maschinellen Lernens Computeralgorithmen, die für eine Vielzahl von Aufgaben wertvoll sind, etwa Spracherkennung, Sprachübersetzung, Bilderkennung, Roboterverhalten und viele andere Bereiche der künstlichen Intelligenz (KI).
Deep-Learning-Systeme – eine Form des unüberwachten maschinellen Lernens – werden zunehmend zusammen mit neuronalen Netzen eingesetzt. Sie werden als „Deep Learning“ bezeichnet, weil sie eine große Zahl neuronaler Schichten enthalten. Mit verschiedenen Ansätzen können Datenwissenschaftler komplexe Aufgaben ausführen, die außerhalb der Fähigkeiten oder des Zuständigkeitsbereichs von Menschen liegen. Außerdem können sich diese Systeme kontinuierlich weiterentwickeln und verbessern, sobald neue Daten verfügbar werden.
Siehe auch: Was ist künstliche Intelligenz?
- Wie und warum werden neuronale Netze eingesetzt?
- Eine kurze Geschichte künstlicher neuronaler Netze
- Wie funktionieren neuronale Netze?
- Welche Arten künstlicher neuronaler Netze gibt es?
- Wie verwenden Datenwissenschaftler neuronale Netze zum Training?
- Wie verändern künstliche neuronale Netze Unternehmen?
- Welche ethischen und rechtlichen Bedenken gibt es?
- Wie sieht die Zukunft künstlicher neuronaler Netze aus?
Wie und warum werden neuronale Netze eingesetzt?
Das wachsende Datenvolumen, das von Computern erzeugt wird, enthält Antworten auf zahlreiche Fragen und Probleme. Einige Quellen aus der Industrie berichten, dass täglich mehr als 2,5 Trillionen Byte an Daten erzeugt werden und weltweit mehr als 100 Zettabyte an Daten existieren. Dazu gehören unter anderem strukturierte und unstrukturierte Daten aus Datenbanken, Vertriebsmanagementsystemen, Sensoren, Finanzsystemen, Blogs, sozialen Medien, Audio- und Videodateien, Texten und Protokollen sowie Tabellenkalkulationsdateien.
Daher werden Deep-Learning-Systeme auf Basis neuronaler Netze von Regierungen, Unternehmen, Forschern und anderen широко eingesetzt, um diese Daten auszuwerten. Das Beratungsunternehmen Gartner berichtet, dass inzwischen mehr als 80 % der Datenwissenschaftler KNNs verwenden und die durch Deep Learning unterstützte Generierung natürlicher Sprache mittlerweile Bestandteil von 90 % der modernen BI- und Analyseplattformen ist. Zu den häufigsten Einsatzbereichen gehören Biowissenschaften, Fertigung, Banken, Einzelhandel und der öffentliche Sektor.
Gesundheitsunternehmen setzen neuronale Netze beispielsweise für Aufgaben wie prädiktive Diagnostik, biomedizinische Bildgebung und Gesundheitsüberwachung ein. Finanzdienstleister verwenden sie zur Betrugserkennung, für die Überwachung von Kreditanalysen und zur Automatisierung von Beratungsdiensten. Einzelhändler nutzen Deep Learning für Marketing, Chatbots und Augmented Reality, die zunehmend in Smartphone-Apps eingesetzt wird. Hersteller setzen die Technik für Bildverarbeitungssysteme ein, die Fehler und Sicherheitsverstöße erkennen, sowie zur Automatisierung von Lieferketten und zur Prognose der Nachfrage.
Ein weiterer häufiger Anwendungsfall sind Smart-City-Initiativen. So können neuronale Netze beispielsweise Bilddaten von drahtlosen Kameras aufnehmen, woraufhin das maschinelle Lernsystem lernt, wie es Verkehrssignale und andere Systeme anpassen muss, um den Verkehrsfluss in Echtzeit zu optimieren. Dieser Ansatz ist deutlich kostengünstiger als die Installation von Sensoren und Sensoren im Straßenbelag. Diese Systeme – die häufig vernetzte Sensoren und Geräte des Internets der Dinge (IoT) integrieren – können außerdem die Leistung von Energiesystemen verbessern, weitere fortschrittliche Automatisierung bereitstellen und Sicherheitsfunktionen erweitern.
Siehe auch: KI vs. ML: Künstliche Intelligenz und maschinelles Lernen
Eine kurze Geschichte künstlicher neuronaler Netze
Die Ursprünge künstlicher neuronaler Netze reichen bis ins Jahr 1943 zurück. Damals stellten Warren McCulloch und Walter Pitts, die beide in den Bereichen Neurowissenschaften und Datenverarbeitung tätig waren, ein Rechenmodell vor, das Algorithmen namens Schwellenwertlogik verwendete. Das Modell basiert auf einem Logikgatter oder einem grundlegenden Baustein – in diesem Fall einem künstlichen Neuron –, um ein größeres Rechenframework aufzubauen.
In den 1940er- und 1950er-Jahren erforschten Wissenschaftler weiterhin Modelle künstlicher neuronaler Netze. 1958 setzte Frank Rosenblatt ein Perzeptron, einen Algorithmus für überwachtes Lernen, in einem echten Computergerät ein. In den 1960er-Jahren entstanden die ersten funktionsfähigen Modelle mit mehreren Schichten, und 1975 entwickelte der Forscher Kunihiko Fukushima das erste mehrschichtige neuronale Netz. In den 1980er-Jahren kamen moderne Fähigkeiten des maschinellen Lernens auf. Deutlich leistungsfähigere Rechenkapazitäten und Fortschritte auf diesem Gebiet in den folgenden drei Jahrzehnten führten zu weitaus leistungsfähigeren Möglichkeiten.
Eine der wichtigsten Entwicklungen auf diesem Gebiet war die Einführung von Grafikprozessoren (GPUs) im Jahr 2010. Diese Systeme bieten erhebliche Vorteile bei Geschwindigkeit und Leistung, unter anderem die Möglichkeit, Fehler durch eine umfassendere Feinabstimmung über die Schichten eines Modells hinweg zu reduzieren. Tatsächlich ermöglichen GPUs Funktionen und Fähigkeiten, die beim Deep Learning sonst nicht möglich wären. Die neuronalen Netze von heute nutzen mehrere Techniken und Modelle, um zunehmend komplexe Aufgaben zu bewältigen, die in manchen Fällen die menschlichen Fähigkeiten übersteigen.
Siehe auch: Top-KI-Software
Wie funktionieren neuronale Netze?
Die Grundlage eines neuronalen Netzes ist ein künstliches Neuron. Neuronen werden in drei verschiedene Schichttypen eingeordnet:
- Eingabeschicht: Die Eingabeschicht nimmt Daten auf und wandelt sie in Binärcode um, den der Computer verwenden kann.
- Verborgene Schicht: Die verborgene Schicht führt mithilfe nichtlinearer Verarbeitungstechniken mathematische Berechnungen an den Daten durch, die über die verschiedenen verborgenen Schichten des Modells hinweg funktionieren. Dieser Prozess der „Gewichtung“ entwickelt ein hierarchisches mathematisches Framework.
- Ausgabeschicht: Die Ausgabeschicht liefert den Algorithmus, der für die KI verwendet wird.
Eine Möglichkeit, sich neuronale Netze vorzustellen, besteht laut IBM darin, dass jeder einzelne Knoten sein eigenes Modell der linearen Regression ausführt, das Eingabedaten, Gewichte, einen Bias (oder Schwellenwert) und eine Ausgabe umfasst. Sobald das System eine Eingabeschicht identifiziert hat, weist es Gewichte zu, die den Wert einer bestimmten Variable bestimmen. Diese Eingaben werden in ein mathematisches Modell integriert. Wenn eine Ausgabe den gewünschten kritischen Schwellenwert erreicht, aktiviert sie den Knoten, der die Daten an den nächsten Knoten im Netz weiterleitet. Dieser Prozess wird fortgesetzt, bis ein Algorithmus entstanden ist.
In manchen Fällen fließen Daten in einem künstlichen neuronalen Netz nur in eine Richtung, von der Eingabe- zur Ausgabephase. Es ist jedoch möglich, andere Techniken wie die Backpropagation einzusetzen, um Daten von der Ausgabe zurück zur Eingabe zu untersuchen.
Dieser Ansatz ermöglicht es, die Fehlererkennung zu verbessern und verzerrte oder ungenaue Ergebnisse zu reduzieren. Mit dieser Technik lassen sich Gewichtungen ändern und ein Deep-Learning-Modell nach Bedarf anpassen und verändern.
Welche Arten künstlicher neuronaler Netze gibt es?
Neuronale Netze bilden zwar grob die Funktionsweise des menschlichen Gehirns ab, sind im Laufe der Zeit jedoch spezialisierter geworden. Heute gibt es vier grundlegende Arten künstlicher neuronaler Netze. Jede hat je nach vorgesehenem Zweck und praktischem Anwendungsfall Vor- und Nachteile. Dazu gehören:
- Faltungsneuronale Netze (CNNs): Diese Systeme des maschinellen Lernens werden häufig für maschinelles Sehen, Objekterkennung, Bildklassifizierung und bestimmte Arten von Prognosen eingesetzt. Ein CNN umfasst fünf verschiedene Schichten: Eingabe, Faltung, Pooling, vollständig verbunden und Ausgabe. Diese Systeme benötigen enorme Rechenleistung, die typischerweise von GPUs bereitgestellt wird.
- Rekurrente neuronale Netze (RNNs): Diese Art von KNN-Framework verwendet typischerweise Zeitreihendaten und andere sequenzielle Daten, um probabilistische Modelle zu erzeugen. Mit anderen Worten: Die Eingaben sind nicht unabhängig voneinander. Dadurch eignet sich der Ansatz ideal für Aufgaben wie die Verarbeitung natürlicher Sprache, Spracherkennung, Sentimentanalyse und textbezogene Anwendungen.
- Feedforward-neuronale Netze (FNNs): Als Nachfahren rekurrenter neuronaler Netze verwenden FNNs keinerlei Zyklus oder Schleife, um Daten zu verarbeiten und ein Modell zu entwickeln. Stattdessen fließen die Daten nur in eine Richtung – von den Eingabeknoten vorwärts durch beliebige verborgene Knoten zu den Ausgabeknoten. Daher werden FNNs häufig für Aufgaben des überwachten Lernens wie digitales Marketing und Vertrieb eingesetzt.
- Autoencoder-neuronale Netze: Diese unüberwachten Systeme des maschinellen Lernens, die manchmal als Autoassoziatoren bezeichnet werden, nehmen unbeschriftete Eingaben auf, kodieren Daten und dekodieren sie anschließend wieder, während sie versuchen, die wertvollsten Informationen zu bestimmen und zu extrahieren. Die Methode wurde entwickelt, um Datenrauschen zu reduzieren. Eine beliebte Anwendung dieser Methodik ist die Betrugserkennung.
Siehe auch: Die Zukunft der künstlichen Intelligenz
Wie verwenden Datenwissenschaftler neuronale Netze zum Training?
Nachdem ein Datenwissenschaftler einen Anwendungsfall für ein KNN identifiziert und einen bestimmten Ansatz ausgewählt hat, besteht der nächste Schritt darin, das System in Gang zu setzen. Datenwissenschaftler verwenden dafür zwei grundlegende Ansätze: überwachtes Lernen und unüberwachtes Lernen.
Überwachtes Lernen
Wie der Name schon sagt, überwacht ein Mensch diese Art von System des maschinellen Lernens. Der Bediener kennzeichnet Datensätze, um den Algorithmus zu trainieren, damit er Daten klassifizieren und Ergebnisse präzise vorhersagen kann.
So könnte ein Mensch Fotos verschiedener Katzenarten kennzeichnen – Löwen, Tiger, Jaguare, Leoparden, Pumas, Rotluchse, Ozelots und Hauskatzen –, damit ein System lernt, sie zu unterscheiden. Gelegenheitsnutzer erledigen diese Aufgabe möglicherweise unwissentlich, wenn sie beispielsweise E-Mails als Spam markieren. Überwachtes Lernen spielt häufig bei Objekterkennung, prädiktiver Analyse und Sentimentanalyse eine Rolle.
Unüberwachtes Lernen
Diese Systeme lernen aus Daten, die von einem Menschen weder klassifiziert noch gekennzeichnet wurden. Einfach ausgedrückt erkennt das System selbstständig Muster und erstellt ein algorithmisches Modell – daher die Bezeichnung „unüberwachtes Lernen“.
In manchen Fällen verwenden Datenwissenschaftler auch semi-überwachtes Lernen, das die beiden Ansätze kombiniert, sowie bestärkendes Lernen, bei dem Ergebnisse mithilfe eines Computerprogramms erzeugt werden, das beim Entwickeln eines Modells positive und negative „Belohnungen“ erhält.
Siehe auch: Die Geschichte der künstlichen Intelligenz
Wie verändern künstliche neuronale Netze Unternehmen?
Zu den häufigsten Einsatzmöglichkeiten von KNNs gehört die prädiktive Analyse. Eine wachsende Zahl von Unternehmenssoftwareplattformen – einschließlich Cloud-Frameworks – umfasst maschinelles Lernen, Deep Learning und weitere Tools, die beim Aufbau fortschrittlicher KI-Modelle helfen.
Diese Form der prädiktiven Analyse wird häufig für Aufgaben wie die Bereitstellung zielgerichteterer Inhalte für Kunden, die Ermittlung von Kreditrahmen und -genehmigungen, den Aufbau von Chatbots und anderen Tools für natürliche Sprache sowie die Bereitstellung von Empfehlungen für E-Commerce, soziale Medien und Streaming-Medien eingesetzt.
Doch auch in vielen anderen Branchen macht sich die prädiktive Analyse bemerkbar. Im Gesundheitswesen führt beispielsweise KI-gestützte Software Ärzte und andere Fachkräfte zu relevanten Ergebnissen, indem sie Medikamente und Behandlungen vorschlägt. In der Fertigung hilft maschinelles Sehen Herstellern, Fehler und Mängel zu erkennen, die dem menschlichen Auge entgehen würden. Im Fuhrparkmanagement und in der Logistik bestimmt Software Routen und optimiert Ausrüstung und Kraftstoff – und passt sich in Echtzeit an Wetter- oder Verkehrsbedingungen an. In der Cybersicherheit werden neuronale Netze zunehmend eingesetzt, um Malware und anderes verdächtiges Verhalten in einem Netzwerk zu erkennen.
Diese Systeme halten auch im Alltag der Softwareentwicklung und im Geschäftsleben Einzug. In vielen Fällen verfügen Unternehmensanwendungen über No-Code- oder Low-Code-Oberflächen mit Drag-and-drop-Funktionen, mit denen Benutzer KI- und ML-Aufgaben zusammenstellen können. KI-generierte Softwaresysteme wie OpenAI Codex, IBM’s Project Wisdom, Amazon’s CodeWhisperer und GitHub’s Copilot dringen ebenfalls in den Mainstream vor. Sie werden mit riesigen Datensätzen trainiert und können aus Eingaben in natürlicher Sprache Code erzeugen.
Durch die Nutzung von Cloud-Computing-Ressourcen bewältigen diese Systeme eine wachsende Zahl von Aufgaben – vom Aufbau von Chatbots und digitalen Marketingsystemen bis zur Automatisierung verschiedener Aufgaben. Forrester warnt jedoch davor, dass Fortschritte nicht ohne die richtige Technologieplattform erzielt werden. Investitionen in Systeme, die fortschrittliches maschinelles Lernen und Deep Learning unterstützen, sind entscheidend. Dazu gehören häufig Clouds, die leistungsfähige GPUs bereitstellen.
Siehe auch: Die besten Plattformen für maschinelles Lernen
Welche ethischen und rechtlichen Bedenken gibt es?
Ein Problem neuronaler Netze besteht darin, dass die von ihnen bereitgestellten Informationen nur so gut sind wie die Daten, mit denen das System gefüttert wird. Neben der Möglichkeit, ein schlecht funktionierendes System zu erhalten, haben Forscher zahlreiche Fälle impliziter Verzerrungen festgestellt, die zu geschlechtlicher oder rassistischer Diskriminierung führen können.
Dies kann Probleme – einschließlich rechtlicher Konsequenzen – für Versicherungsunternehmen, Gesundheitsdienstleister, Finanzdienstleister und staatliche Stellen verursachen. Daher sollten Unternehmen ethische und rechtliche Bedenken sorgfältig abwägen, bevor sie mithilfe neuronaler Netze und Deep Learning Entscheidungen treffen.
Wie sieht die Zukunft künstlicher neuronaler Netze aus?
Immer leistungsfähigere Computer und schnellere GPUs versprechen, KNNs und Deep Learning voranzubringen. In den kommenden Jahren werden diese Systeme Fortschritte in einer Vielzahl von Bereichen vorantreiben, darunter prädiktive Analysen, autonome Fahrzeuge, Schwarmrobotik, pharmazeutische Forschung, prädiktive Medizin, persönliche Assistenten und Chatbots, Cybersicherheit, Softwareentwicklung sowie die Automatisierung von Fertigung und Lieferketten.
Mit der Anhäufung weiterer Daten – einschließlich IoT-Sensordaten und Fortschritten beim Edge Computing – werden ebenfalls neue Anwendungsfälle entstehen.
Siehe auch: Trends in der Datenanalyse

