NachschlagenQuellenregister

Originalarbeiterreichbar

Can AI agents conduct open-ended AI research? Early evidence from two case studies

cruxevals.com (externe Seite)

Die Originalstudie beschreibt die Shadow-Evaluation-Methode, den Testaufbau mit Claude Opus 4.8 und das Ergebnis, dass beide erzeugten Arbeiten abgelehnt wurden.

geprüft 24.09.2026

Eine Studie mit unveröffentlichten Fachaufsätzen zeigt, wo KI-Agenten in offener Forschung noch scheitern

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.