BrainBench: KI-Vorhersagemodell nutzt LLM-Technologie und übertrifft Neurowissenschaftler um 23 %

Blurred motion of doctors and medical staff walking on a hospital hallway.
Verfasst von
Madeline Clarke
Madeline Clarke
Dec 16, 2024
2 minute read
eWeek Inhalte und Produktempfehlungen sind redaktionell unabhängig. Wir können Geld verdienen, wenn Sie auf Links zu unseren Partnern klicken. Mehr erfahren

Bei der Bewertung der Vorhersagefähigkeiten großer Sprachmodelle (LLMs) stellten Forscher des University College London (UCL) fest, dass die KI-Modelle die Ergebnisse geplanter neurowissenschaftlicher Studien genauer vorhersagen konnten als menschliche Experten. Die Forschung weist auf das Potenzial von KI hin, den wissenschaftlichen Fortschritt bei ihrem Einsatz in den Neurowissenschaften zu beschleunigen.

Die Forschungsergebnisse, veröffentlicht in Nature Human Behaviour, zeigten, dass LLMs menschliche Neurowissenschaftler bei der Vorhersage von Ergebnissen neurowissenschaftlicher Studien durchgängig übertrafen: Sie erreichten durchschnittlich eine Genauigkeit von 81,4 Prozent, verglichen mit 63,4 Prozent bei den menschlichen Experten.

Messung der Genauigkeit von KI-Prognosen

Um die Fähigkeit von LLMs zur Vorhersage von Studienergebnissen zu bewerten, entwickelten UCL-Forscher einen Benchmark für die Neurowissenschaften namens BrainBench. Das Tool quantifizierte und verglich die Vorhersagefähigkeit von 171 menschlichen Experten für Neurowissenschaften und 15 universell einsetzbaren LLMs. Die Forscher testeten ihre Fähigkeiten, aus jeweils zwei Studienabstracts den echten Abstract zu identifizieren, wobei einer der beiden Abstracts reale und der andere veränderte Ergebnisse enthielt.

Die Ergebnisse der Studie zeigten, dass die Genauigkeit der menschlichen Experten kontinuierlich hinter derjenigen der KI-Modelle zurückblieb. Zwar bestanden alle an der Studie beteiligten Menschen einen Screening-Test zur Vorhersage neurowissenschaftlicher Forschungsergebnisse, doch selbst die Experten mit der größten Fachkenntnis in bestimmten Bereichen der Neurowissenschaften erzielten mit 66 Prozent eine geringere Genauigkeit als die LLMs.

Die Forschung umfasste Testfälle aus allen Bereichen der Neurowissenschaften, darunter Zellbiologie/Molekularbiologie, Verhalten/Kognition, Systeme/Schaltkreise, Entwicklung/Plastizität/Reparatur sowie die Neurobiologie von Krankheiten. Zu den untersuchten LLMs gehörten verschiedene Versionen von Falcon, Llama, Mistral und Galactica. Als Reaktion auf diese Ergebnisse entwickelten die Forscher BrainGPT, ein neues LLM, das auf einer bestehenden Version von Mistral basiert und speziell mit neurowissenschaftlicher Literatur aus Fachzeitschriften trainiert wurde, die zwischen 2002 und 2022 veröffentlicht wurde. Das BrainGPT-Modell erreichte mit 86 Prozent eine noch höhere Genauigkeit.

Advertisement

Die Zukunft der KI in den Neurowissenschaften

Die Ergebnisse der Studie weisen auf das Potenzial von KI-Technologien zur Vorhersage hin, Prozesse in den Neurowissenschaften zu verbessern und den wissenschaftlichen Fortschritt zu beschleunigen.

„Der wissenschaftliche Fortschritt beruht oft auf Versuch und Irrtum, doch jedes sorgfältig durchgeführte Experiment erfordert Zeit und Ressourcen“, sagte Ken Luo, der Hauptautor der UCL-Studie. Selbst die versiertesten Forscher könnten wichtige Erkenntnisse aus der Literatur übersehen. „Unsere Arbeit untersucht, ob LLMs Muster in umfangreichen wissenschaftlichen Texten erkennen und die Ergebnisse von Experimenten prognostizieren können.“

Der Seniorautor der Studie, Professor Bradley Love, stimmte dem zu. „Dieser Erfolg legt nahe, dass ein großer Teil der Wissenschaft nicht wirklich neu ist, sondern bestehenden Ergebnismustern in der Literatur entspricht“, sagte er.

In Zukunft könnte die strategische Einbindung von gezielt trainierten LLMs in die größeren Systeme, die Neurowissenschaftler für ihre Forschung einsetzen, ihnen dabei helfen zu bestimmen, welche Experimente durchgeführt werden sollten, und sie dabei unterstützen, optimale Entscheidungen über begrenzte Ressourcen wie Geld und Zeit zu treffen, wodurch die Forschungseffizienz gesteigert würde.

Madeline Clarke

Madeline is a writer specializing in copywriting and content creation. After studying Art and earning her BFA in Creative Writing at Salisbury University she applied her knowledge of writing and design to develop creative and influential copy. She has since formed her business, Clarke Content, LLC, through which she produces entertaining, informational content and represents companies with professionalism and taste.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Eigentum von TechnologyAdvice. © 2026 TechnologyAdvice. Alle Rechte vorbehalten

Werbetreibenden-Offenlegung: Einige der auf dieser Website erscheinenden Produkte stammen von Unternehmen, von denen TechnologyAdvice eine Vergütung erhält. Diese Vergütung kann beeinflussen, wie und wo Produkte auf dieser Website erscheinen, einschließlich beispielsweise der Reihenfolge, in der sie erscheinen. TechnologyAdvice schließt nicht alle Unternehmen oder alle auf dem Marktplatz verfügbaren Produkttypen ein.