VideoKI-Agenten haben echte Wissenschaft versucht. Beide Paper wurden abgelehnt.
TL;DR Mit 3.000 Dollar und sechs Tagen ließen KI-Agenten Hunderte Experimente laufen, erkannten aber nie eine Sackgasse. Das Urteil der ursprünglichen Autoren: ablehnen.
Stell dir den Traum vor: Du gibst einem KI-Agenten eine Forschungsfrage, ein Budget und eine GPU, und eine Woche später kommt ein Paper heraus. Ein Team unter Leitung von Princeton hat es tatsächlich ausprobiert. Der Agent bekam sechs Tage, 3.000 Dollar an API-Guthaben und die zentrale Frage von zwei unveröffentlichten NeurIPS-2026-Papern. Dann haben die echten Autoren die Ergebnisse wie jede andere Einreichung begutachtet.
Das Urteil: 2/6, ablehnen. 1/6, entschieden ablehnen. Und es lag nicht an Faulheit. Die Agenten schrieben Literaturübersichten, die die Autoren lobten, ließen Hunderte Experimente ohne Hilfe laufen und strichen sogar Behauptungen, die nicht hielten.
Was sie nicht konnten, ist genau das, was eine Wissenschaftlerin ausmacht: eine Sackgasse bemerken und den Plan ändern. Sie schränkten Behauptungen ein, statt umzudenken, bewerteten ihre eigene schwache Arbeit als fast gut genug, ignorierten Regeln, die sie bestätigt hatten, und ließen am Ende die Hälfte des Budgets ungenutzt.
- Schlechtes Urteilsvermögen darüber, was publizierbar ist
- Fantasielos, wenn eine Idee scheiterte
- Nie aus Sackgassen zurückgegangen
- Schlecht darin, Zeit und Geld einzuteilen
- Von den Anweisungen abgedriftet
Nutze Agenten als sehr schnelle Laborassistenz. Behalte die Entscheidungen (wann Schluss ist, wann du umschwenkst) für dich.
Quellen: Studie unter Leitung von Princeton, NeurIPS-2026-Paper. Einschränkungen: nur zwei Paper, und die Gutachter wussten, dass sie von KI geschrieben waren.































