Auf der Konferenz re:Invent 2024 stellte Amazons AWS Nova vor, eine hochmoderne Familie von KI-Modellen, die darauf ausgelegt ist, die Nutzung von KI durch Unternehmen grundlegend zu verändern. Die Ankündigung markiert einen bedeutenden Sprung in Amazons KI-Entwicklung und rückt sechs generative KI-Modelle in den Mittelpunkt, die die Erstellung von Text-, Bild- und Videoinhalten vereinfachen sollen. Diese KI-Tools sind Unternehmenskunden über Amazon Bedrock zugänglich.
„Bei Amazon sind derzeit rund 1.000 Gen-AI-Anwendungen in Entwicklung, und wir hatten einen umfassenden Überblick darüber, mit welchen Problemen die Entwickler dieser Anwendungen noch zu kämpfen haben“, sagte Amazons SVP of Artificial General Intelligence Rohit Prasad in einer Erklärung. „Unsere neuen Amazon-Nova-Modelle sollen internen und externen Entwicklern bei diesen Herausforderungen helfen und überzeugende Ergebnisse bei der Intelligenz- und Inhaltserzeugung liefern sowie gleichzeitig deutliche Fortschritte bei Latenz, Kosteneffizienz, Anpassbarkeit, Informationsfundierung und agentischen Fähigkeiten ermöglichen.“
Die Nova-Modelle im Überblick
Die Nova-Serie umfasst fünf derzeit verfügbare Modelle sowie ein sechstes Modell, Nova Premier, das im 1. Quartal 2025 erscheinen soll. Die KI-Modelle sind darauf ausgelegt, unterschiedliche Anforderungen von Unternehmen abzudecken – von Texten bis hin zur Erstellung fortgeschrittener multimedialer Inhalte.
Zu den reinen Textmodellen gehören Micro, Lite und Pro:
- Nova Micro: Micro eignet sich ideal für schnelle Text-zu-Text-Aufgaben und ist zwar das kleinste Modell der Reihe, bietet aber die geringste Latenz. Sein Kontextfenster von 128.000 Token gewährleistet eine effiziente Bearbeitung von Aufgaben wie Textzusammenfassung, Übersetzung, Inhaltsklassifizierung, interaktivem Chat und Brainstorming sowie einfachem mathematischem Schlussfolgern und Programmieren.
- Nova Lite: Das Modell akzeptiert Bilder, Videos und Texte als Eingaben, erzeugt aber ausschließlich Text. Es verarbeitet Eingaben mit einer Länge von bis zu 300.000 Token und kann mehrere Bilder oder bis zu 30 Minuten Video in einer einzigen Anfrage analysieren.
- Nova Pro: Pro ist das leistungsfähigste der drei Modelle und bietet überlegene Genauigkeit sowie umfangreiche Multitasking-Fähigkeiten. Es verfügt ebenfalls über eine Kapazität von 300.000 Token und eignet sich damit für komplexe Arbeitsabläufe.
Zu den Modellen für kreative Inhalte gehören Canvas und Reel:
- Nova Canvas: Canvas ist auf die Bilderstellung spezialisiert und kann auf Basis von Text- oder Bild-Prompts visuelle Inhalte erzeugen. Das Modell ist für Branchen wie Werbung und Unterhaltung konzipiert und bietet Werkzeuge zur Farbanpassung und Bearbeitung von Hintergründen.
- Nova Reel: Reel ist ein leistungsstarkes Tool zur Videogenerierung und erstellt aus Text- und Bild-Prompts kurze Clips. Nutzer können Kamerabewegungen mithilfe von Befehlen in natürlicher Sprache steuern, was das Modell zu einem idealen Werkzeug für Marketingfachleute und Content-Ersteller macht.
- Nova Premier: Das fortschrittlichste Modell ist für komplexes Schlussfolgern und die Feinabstimmung individueller KI-Lösungen konzipiert. Amazon Nova Premier befindet sich noch im Training. Die Markteinführung ist für Anfang 2025 geplant.
Was macht Nova anders?
Ein herausragendes Merkmal von Nova ist der Fokus auf Kosteneffizienz. Amazon Nova Micro, Amazon Nova Lite und Amazon Nova Pro sind mindestens 75 Prozent günstiger als die leistungsstärksten Modelle ihrer jeweiligen Intelligenzklassen in Amazon Bedrock, sagte Amazon. Sie zeichnen sich außerdem durch ihre Anpassbarkeit aus und ermöglichen es Unternehmen, Modelle fein abzustimmen und dabei ihre proprietären Daten zu verwenden, um Genauigkeit und Relevanz zu verbessern.
Im Jahr 2025 werden die Kontextfenster einiger Nova-Modelle auf mehr als zwei Millionen Token erweitert und damit das Äquivalent von über 1,5 Millionen Wörtern unterstützen – ein weiterer großer Fortschritt. Darüber hinaus plant AWS, Anfang 2025 ein Speech-to-Speech-Modell auf den Markt zu bringen, das durch die Interpretation von Tonfall und Sprachrhythmus natürlich klingende Umwandlungen ermöglichen soll. Ein ambitioniertes Any-to-Any-Modell, das Eingaben und Ausgaben über Text, Sprache, Bilder und Videos hinweg kombiniert, wird noch im selben Jahr erwartet.
Erfahren Sie mehr über andere führende Unternehmen, die KI neu definieren und diese dynamische Technologie vorantreiben.

