Kann KI den ultimativen Intelligenztest der Menschheit bestehen?

A robot teacher and a student in a classroom.

Image: stockasso/Envato Elements

Verfasst von
Brittany Brooks
Brittany Brooks
Jan 24, 2025
2 minute read
eWeek Inhalte und Produktempfehlungen sind redaktionell unabhängig. Wir können Geld verdienen, wenn Sie auf Links zu unseren Partnern klicken. Mehr erfahren

Eine bahnbrechende KI-Benchmark namens „Humanity’s Last Exam“ sorgt in der KI-Community für Aufsehen. Entwickelt vom Center for AI Safety (CAIS) in Zusammenarbeit mit Scale AI, soll sie der ultimative Test dafür sein, ob KI menschenähnliches Schlussfolgern, Kreativität und Problemlösung erreichen kann. Diese Eigenschaften unterscheiden echte Intelligenz von bloßer Nachahmung.

Humanity’s Last Exam wurde entwickelt, um die Grenzen dessen zu verschieben, was KI leisten kann. Die Benchmark fordert KI-Systeme dazu heraus, Fähigkeiten zu demonstrieren, die weit über traditionelle Aufgaben hinausgehen, und setzt damit einen neuen Standard für die Bewertung von KI.

Eine KI-Benchmark wie keine andere

Bei Humanity’s Last Exam geht es nicht darum, die reine Rechenleistung oder die Genauigkeit bei Aufgaben wie dem Zusammenfassen von Artikeln oder dem Erkennen von Bildern zu messen. Stattdessen bewertet sie allgemeine Intelligenz und ethisches Schlussfolgern. Die Benchmark fordert KI dazu heraus, Fragen in Mathematik, Wissenschaften und Logik zu lösen und sich zugleich mit moralischen Dilemmata und den Auswirkungen neuer Technologien auseinanderzusetzen.

„Wir wollten Probleme, die die Fähigkeiten der Modelle an der Grenze des menschlichen Wissens und Schlussfolgerns testen“, erklärte CAIS-Mitbegründer und Geschäftsführer Dan Hendrycks.

Ein herausragendes Merkmal der Benchmark ist die Einbeziehung von „Open-World“-Herausforderungen, bei denen es keine einzige richtige Antwort gibt. So könnte KI beispielsweise hypothetische Situationen analysieren, in denen ethische Erwägungen abgewogen und langfristige Konsequenzen vorhergesagt werden. Dieser ambitionierte Test fordert KI dazu heraus, kontextuelles Verständnis und Urteilsvermögen zu demonstrieren.

Wird KI zu intelligent?

Kritiker bezweifeln, ob Humanity’s Last Exam menschliche Eigenschaften zu stark in den Vordergrund rückt. Das entfacht Debatten über die praktische Anwendbarkeit der Benchmark und schürt die Befürchtung, dass KI eines Tages die menschliche Intelligenz übertreffen könnte. Ihre Befürworter argumentieren hingegen, dass Benchmarks wie diese unerlässlich sind, um die tatsächlichen Fähigkeiten von KI zu erforschen und ihre Grenzen offenzulegen. Indem sie Grenzen verschiebt, gewährt diese Prüfung einen wichtigen Einblick in die Zukunft der KI, eine Zukunft, die faszinierend und für manche auch etwas beunruhigend ist. Damit bleibt die Frage: Ist dies der Schlüssel zum Verständnis von KI, oder dringen wir in ein Gebiet vor, dem wir uns noch nicht gewachsen fühlen?

Advertisement

Was die Zukunft bringt

Die ersten Tests haben bereits begonnen, und große Akteure wie OpenAI, Anthropic und Google Deepmind nehmen daran teil. Bisher liegen die Modelle GPT-4 und GPT-o1 von OpenAI an der Spitze, doch keines der KI-Modelle hat die Marke von 50 Prozent… bisher. Hendrycks vermutet, dass die Ergebnisse der KI-Modelle bis zum Ende dieses Jahres über diese Marke steigen könnten. Ob sich Humanity’s Last Exam als unüberwindbare Herausforderung oder als Beginn einer neuen Ära der künstlichen allgemeinen Intelligenz erweisen wird, bleibt eine offene Frage.

Lesen Sie unsere Tests zu Grok, ChatGPT, und Gemini und beurteilen Sie ihre Intelligenz selbst.

Brittany Brooks

Brittany Brooks is a content writer with seven years of experience and has a passion for AI-driven innovation. For the past three years, she’s mastered AI-enabled tools and the art of prompt engineering to generate precise and impactful results. Alongside her writing, Brittany has developed strong skills in data analysis, leveraging AI to extract actionable insights and drive strategic decision-making. Obsessed with the intersection of AI and analytics, Brittany explores new ways to leverage AI to solve complex problems. As a self-proclaimed and proud tech geek, she embraces emerging technology and its future potential. When she’s not writing or analyzing data, you can find her in one of her many VR leagues, fully immersed in the next evolution of digital experiences.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Eigentum von TechnologyAdvice. © 2026 TechnologyAdvice. Alle Rechte vorbehalten

Werbetreibenden-Offenlegung: Einige der auf dieser Website erscheinenden Produkte stammen von Unternehmen, von denen TechnologyAdvice eine Vergütung erhält. Diese Vergütung kann beeinflussen, wie und wo Produkte auf dieser Website erscheinen, einschließlich beispielsweise der Reihenfolge, in der sie erscheinen. TechnologyAdvice schließt nicht alle Unternehmen oder alle auf dem Marktplatz verfügbaren Produkttypen ein.