OpenAI gab am Montag die Veröffentlichung von GPT-4.1 bekannt, dem neuesten Nachfolger seiner KI-Sprachmodellreihe GPT-4o. Laut OpenAI zeichnet sich GPT-4.1 durch die Befolgung von Anweisungen, Programmierung und die Verarbeitung langer Kontexte aus.
Das große Sprachmodell GPT-4.1 bringt verbesserte Funktionen und erweiterte Programmierfähigkeiten in die nächste Generation der GPT-4o-Modellreihe. Zur GPT-4o-Reihe gehören die Modelle GPT-4.1 mini und GPT-4.1 nano. OpenAI bestätigte, dass das mini-Modell Unterstützung für überwachte Feinabstimmung erhalten wird. Darüber hinaus erklärte OpenAI, das Unternehmen plane, das Modell GPT-4.5 Preview aus der API zurückzuziehen.
GPT-4.1 wird nicht über die ChatGPT-Oberfläche für Verbraucher verfügbar sein, sondern ausschließlich über die Entwickler-API.
Besondere Funktionen von GPT-4.1
Das KI-Modell GPT-4.1 wurde darauf trainiert, Entwickler durch seine Programmier- und Anweisungsbefolgungsfähigkeiten zu unterstützen, agentische Workflows zu verbessern und die Produktivität zu steigern.
GPT-4.1 bietet dieselben API-Funktionen wie die GPT-4o-Modellfamilie, etwa strukturierte Ausgaben und Tool-Aufrufe. Darüber hinaus weist es im Vergleich zu früheren Modellen folgende Verbesserungen auf:
- Längeres Kontextfenster: GPT-4.1 unterstützt bis zu eine Million Tokens – etwa viermal mehr als GPT-4o –, wodurch das Modell in einer einzigen Interaktion mehr Kontext aufnehmen und verstehen kann.
- Verbesserte Programmierung: Das Modell kann komplexe technische und programmierbezogene Probleme konsistenter und präziser verarbeiten.
- Verbesserte Anweisungsbefolgung: GPT-4.1 ist für die Befolgung detaillierter Anweisungen optimiert, da es intuitiver und kooperativer arbeitet.
- Aktualisierte Wissensbasis: GPT-4.1 verfügt über einen aktuelleren „Wissensstand“ (bis einschließlich Juni 2024) und bietet damit einen besser geeigneten zeitlichen Rahmen für aktuelle Ereignisse.
- Höhere Benchmark-Ergebnisse: GPT-4.1 erzielte im branchenweiten Programmier-Benchmark SWE-bench Verified 54,6 % und verbesserte sich damit deutlich gegenüber GPT-4.5 mit 38,0 %.
- Besseres Videoverständnis: Bei der Messung der Fähigkeit des Modells, Videoinhalte zu verstehen, mit Video-MME erreichte GPT-4.1 in der Videokategorie „lang, ohne Untertitel“ eine beeindruckende Genauigkeit von 72 %.
Mit Kosten von 2 US-Dollar pro Million Eingabetokens und 8 US-Dollar pro Million Ausgabetokens bietet GPT-4.1 laut internen Tests von OpenAI für seinen Preis eine konkurrenzfähige Leistung. Diese Evaluierungen von GPT-4.1 umfassten eine Reihe von Benchmarks, die in der Ankündigung von OpenAI ausführlich dargestellt werden.
Nachteile von GPT-4.1
OpenAI räumte einige Nachteile von GPT-4.1 ein, darunter:
- Die Tendenz, im Vergleich zu GPT-4o spezifischere Prompts zu benötigen.
- Das Modell wird unzuverlässiger, je mehr Eingabetokens es verarbeiten muss. In einem OpenAI-MRCR-Test sank die Genauigkeit des Modells von etwa 84 % bei 8.000 Tokens auf 50 % bei 1 Million Tokens.
Konkurrenten von OpenAI
OpenAI ist eines von vielen Technologieunternehmen, die KI-Programmiermodelle trainieren, um bei komplexen Softwareentwicklungsaufgaben zu helfen. Auch die Konkurrenten von OpenAI in der Branche arbeiten an der Entwicklung eigener hochentwickelter Programmiermodelle, darunter Claude 3.7 Sonnet von Anthropic, Googles Gemini 2.5 Pro und DeepSeeks aufgerüstetes V3.


