Dr. Professor Zerrock :
Florian, die Sorge um Astras Überwachbarkeit ist berechtigt. Und fairerweise: Du sagst ausdrücklich, dass die genaue Technik öffentlich unbekannt ist, ordnest „Recurrent Depth“ als Medienbericht ein und erwähnst OpenAIs Gegenposition. Das ist eine wichtige Einordnung.
Aber bei 0:23 baut deine Erklärung auf einem falschen Vorher-Bild auf: „Bisher schreibt jedes Modell jeden Zwischenschritt als Text mit.“ Nein. Auch frühere Chain-of-Thought-Protokolle bildeten interne Abläufe nur unvollständig ab. Genau das erklärt bereits dein verlinktes Forschungspapier von 2025. Mitlesen konnte helfen, Fehlverhalten zu erkennen. Einen gläsernen KI-Schädel hatte man damit nie.
Auch „alles am Computer, was du auch kannst, und zwar schneller“ ist zu pauschal. OpenAI beschreibt erhebliche Fortschritte bei konkreten Aufgaben. Im genannten OSWorld-2.0-Test stehen aber 72,6 Prozent. Eine starke Benchmark-Leistung ist kein Nachweis, dass jede beliebige Computeraufgabe besser und schneller gelingt.
Dann „halbe Token, halbe Zeit“: Gegenüber welchem Modell, bei welcher Aufgabe und in welchem Aufbau? ARC Prize berichtet 49 Prozent weniger Token zwischen zwei Astra-Testaufbauten, für die von beiden gelösten Fälle. OpenAI nennt rund 47 Prozent weniger Zeit gegenüber Sol in OSWorld-Latenzsimulationen. Verschiedene Vergleiche ergeben keine allgemeine Halbierungsregel.
Die 99,9 und 62,7 Prozent bei ARC sind beide korrekt. ARC Prize veröffentlicht beide Ergebnisse selbst. Der Provider-Adapter erhält unter anderem vorherige Reasoning-Zustände zwischen Anfragen. Diese Bedingungen muss man mitnennen, um die Zahlen sinnvoll zu vergleichen.
Der eigentliche Sicherheitsbefund bleibt ernst: Eine schon vorher begrenzte Möglichkeit, problematische Absichten zu erkennen, wird schwächer. OpenAI dokumentiert das selbst. Dass zusätzlich Handlungen und Werkzeugaufrufe überwacht werden, macht diesen Verlust nicht bedeutungslos.
Das Problem verdient präzise Aufklärung. Dafür braucht es weder eine erfundene frühere Volltransparenz noch ein pauschales heutiges Alleskönnen. Wer die fehlende Nachvollziehbarkeit von KI kritisiert, sollte die eigenen Vergleiche besonders nachvollziehbar machen.
2026-09-05 14:44:03