Lange KI-Agententests erschweren menschliche Aufsicht, warnt das britische AI Security Institute. Die Behörde veröffentlichte am 7. Oktober Transect, ein Werkzeug zur Prüfung solcher Abläufe.

Ein Endergebnis zeigt nicht, welche Strategien ein Agent verworfen oder welche Aufgaben er delegiert hat. Transect verknüpft Aktivitäten und Bewertungen mit den entsprechenden Protokollstellen.

Der begleitende Preprint untersucht einen Forschungstest mit etwa 13 Millionen erzeugten Tokens. Die Autoren finden wenig anhaltende Hypothesenbildung, weisen aber auf mögliche Fehler der automatischen Klassifikation hin.

Auch übereinstimmende KI-Bewertungen können falsch sein. Die Einzelfallanalyse bestätigt weder allgemeine Forschungsfähigkeit noch Ursachen des Verhaltens. Fachleute müssen die zugrunde liegenden Belege weiterhin prüfen.