August 14, 2026 at 05:37PM: The Decoder schreibt zum Thema
KI-Forschung: Autonome KI noch weit entfernt:
KI-Agenten können Ingenieursaufgaben übernehmen, scheitern aber an eigenständiger Forschung. Eine Studie zeigte, dass KI-Modelle von Anthropic und OpenAI trotz ihrer Fähigkeiten in der Forschung versagen.
- Die KI-Agenten hatten Schwierigkeiten mit wissenschaftlichem Urteilsvermögen, kreativer Problemlösung und Ressourcenmanagement.
-
Sie konnten keine neuen Beiträge liefern und wurden von den Originalautoren abgelehnt.
-
Die Studie nutzte die „Shadow Evaluation“ Methode, bei der KI-Agenten unveröffentlichte Forschungsfragen bearbeiteten.
-
Die Ergebnisse wurden von den Originalautoren bewertet, die die KI-generierten Arbeiten ablehnten.
-
Die Studie identifizierte fünf systematische Schwächen der KI-Agenten, darunter fehlendes Urteilsvermögen und ineffektives Ressourcenmanagement.
Zusammenfassung mit KI erstellt.