Newsletter

Die Maschine hat nichts entschieden.

Die Maschine hat nichts entschieden.

· 9 Min Lesezeit
Die Maschine hat nichts entschieden.

Letzte Woche stand hier, dass Dario Amodei seine eigene Branche zum Langsamfahren auffordert und dass der Vorschlag von dem kommt, der vorne liegt.

Seitdem ist gut eine Woche vergangen, und die Debatte hat sich sortiert. Auf der einen Seite stehen die Modelle, die angeblich gleich ausbrechen. Auf der anderen der Präsident, der das für einen Schwindel hält und eine AI Force gründet.

In diesen Tagen sind drei Dinge öffentlich geworden, in denen tatsächlich Schaden entstanden ist oder um Haaresbreite entstanden wäre.

In keinem der drei Fälle hat eine KI etwas entschieden.

a chunky cartoon creature in a too-large project manager's blazer, standing in front of three floating screens and pointing at them with a conductor's baton, dot eyes, businesslike expression

Drei Instanzen, eine Rakete

Anthropic hat vor gut einer Woche seinen Bedrohungsbericht veröffentlicht. Er enthält sechs Fälle, in denen Claude für konventionelle Waffen genutzt wurde. Drei in China, zwei in Russland, einer im Jemen (Anthropic).

Der Fall aus dem Jemen trägt die Nummer GTG-87001, und er ist der Grund, warum ich das Thema noch einmal aufmache. Letzte Woche stand hier nur der Satz, dass es ihn gibt. Die Details sind unangenehmer als die Schlagzeile.

Eine Zelle im Norden des Landes hat drei Waffenprogramme parallel betrieben. Eine gelenkte Rakete auf einem Flugcomputer aus Handy-Bauteilen, mit Zielsuche in der Endphase. Eine mehrstufige ballistische Rakete mit einem erklärten Reichweitenziel über 2.000 Kilometer. Und ein Baukasten namens „R2000", zu dem eine Hypersonic-Glide-Variante gehört.

Was Claude dabei getan hat, steht ohne Umschweife im Bericht. Die Zelle setzte Claude Code „in place of human software engineers" ein, um die Steuerungs- und Navigationssoftware zu schreiben. Also die Software, die eine fliegende Sache stabil hält und ins Ziel bringt.

Die Stelle, an der ich hängen geblieben bin, ist eine andere.

Die Leute haben mehrere Claude-Instanzen gleichzeitig laufen lassen und jeder eine Rolle gegeben. Eine schrieb den Code. Eine recherchierte. Eine prüfte, was die erste geschrieben hatte. Anthropic vergleicht das im eigenen Bericht mit einem Teamleiter, der Arbeit in einem kleinen Ingenieurteam verteilt.

Dann haben sie scharf geschossen. Der Feldtest ging schief, und innerhalb von Stunden saßen sie wieder bei Claude, um herauszufinden, warum (Anthropic).

Die Schutzmechanismen haben viele Anfragen blockiert. Nicht alle. Die Leute haben ihr Ziel verschleiert und die Arbeit über viele Sitzungen verteilt, sodass keine einzelne Sitzung das ganze Bild zeigte. Anthropic hat die Konten gesperrt und die Erkenntnisse an Behörden weitergegeben.

Und dann steht da noch dieser Satz, der die Sperrung ziemlich klein aussehen lässt. Die Zelle hatte sich zu dem Zeitpunkt bereits ein eigenes Simulations-Toolkit gebaut. Als eigenständig lauffähiges Programm. Es braucht weder Claude noch eine Umgebung wie MATLAB.

Anthropic schreibt „northern Yemen" und nennt keine Organisation. Der Norden ist Huthi-Gebiet, und die internationale Presse ordnet den Fall entsprechend zu (Middle East Eye).

Im selben Bericht steht ein zweiter Fall, GTG-30005. Ein Akteur mit Iran-Bezug hat Claude genutzt, um Zielhandbücher gegen US-Marineverbände in der Region zu bauen. Zusammengetragen aus öffentlich zugänglichem Material: eine Namensliste von US-Personal, abgegriffen aus den Bildunterschriften öffentlicher Militärfotos. Transponderkennungen von Schiffen und Flugzeugen. Skripte für Abfragen kommerzieller Satellitenbilder. Eine Liste von Webseiten, auf denen US-Schiffsbewegungen einsehbar sind. Dazu ein Katalog bekannter Schwachstellen in Bordsystemen, VSAT-Terminals und Cisco-Kommunikationstechnik.

Dasselbe Konto hat nebenbei an einer Überwachungsplattform für den Eigenbedarf des iranischen Staates gearbeitet. Kennzeichenerkennung, kombiniert mit dem Abgreifen von Mobilfunk-Kennungen.

a chunky cartoon creature holding an official-looking stamped document up to its face, unaware the paper is quietly dissolving into smoke at the bottom edge, dot eyes, trusting expression

Der Bericht, der fast einen Krieg angefangen hat

Am Freitag hat CNN eine Geschichte gebracht, die im Trubel um Amodei fast untergegangen wäre. Sie stützt sich auf vier Quellen, die mit dem Vorgang vertraut sind (CNN).

Im Frühjahr, mitten im Krieg mit dem Iran, ging ein Bericht durch das US-Militär. Ein chinesisches Schiff im Nahen Osten transportiere Komponenten eines Atomwaffenprogramms.

Der Apparat lief an. Bewaffnete Soldaten bereiteten sich darauf vor, das Schiff zu entern. Flugzeuge waren in der Luft.

Kurz vor dem Zugriff hat jemand genauer in den Bericht geschaut. Er war mit Hilfe von KI entstanden. Ein Analyst des Special Operations Command hatte einen Chatbot zu einer Meldung über die Ladeliste des Schiffs befragt. Der Bot hat frei verfügbare Informationen mit geheimer Fernmeldeaufklärung aus Regierungsbeständen verschmolzen und daraus geschlossen, was an Bord sei. Er lag falsch.

Danach hat derselbe Analyst die KI noch einmal benutzt. Diesmal, um das Ergebnis in das Format eines regulären Geheimdienstberichts zu gießen. In die Art von Papier also, der Offiziere vertrauen. Und dann hat er es verteilt.

Eine der Quellen nennt den Bericht „entirely false". Eine andere sagt, er habe „almost started a war".

Welches Werkzeug es war, ist bis heute nicht öffentlich. Nicht einmal, ob es ein kommerzielles Produkt war oder eine Regierungsentwicklung. Ein früherer hoher Beamter beschreibt den Unterschied so: „The internal tools are mostly just copies of the commercial stuff wearing lipstick."

Der Rahmen dazu stammt vom Januar. Verteidigungsminister Pete Hegseth hat eine „Artificial Intelligence Acceleration Strategy" ausgerufen. Ziel laut Begleitmemo: „democratizing AI experimentation and transformation across the Department", indem man amerikanische Spitzenmodelle direkt in die Hände von drei Millionen Beschäftigten legt, auf allen Geheimhaltungsstufen.

Umgesetzt wird das dezentral. Verschiedene Stellen, verschiedene Werkzeuge, verschiedene Regeln. Einen einheitlichen Standard dafür, wie das Militär die Ausgabe dieser Systeme überprüft, gibt es nicht.

Eine der Quellen sagt außerdem, eine Halluzination dieser Art sei seit der Verbreitung der Werkzeuge kein Einzelfall geblieben. Und zum Thema Zielauswahl sagt eine weitere: „AI in targeting is definitely something that is ramping up and there is no real guidance for how having a human in the loop will prevent civilian casualties or fratricide."

a chunky cartoon creature wearing an oversized crown and holding a tiny calculator behind its back, standing on a podium with one arm raised in triumph, dot eyes, showy grin

Der Zar und die Rechnung

Gestern hat Donald Trump auf Truth Social angekündigt, dass er eine AI Force gründet, ausdrücklich nach dem Vorbild der Space Force, und bald einen AI-Zar ernennt. Bewerben sollen sich nur „High I.Q. individuals". Einen Namen gibt es noch nicht (NBC News).

Zur Sache selbst wird er deutlich: „We will not in any way hinder or stifle the Growth of this incredible Industry. Rather, we will cherish it, help it, and watch over it, as it grows!"

Die Warnungen der letzten Wochen ordnet er den „hoaxes" der Demokraten zu. Und er nennt eine Zahl: KI könne „possibly as much as 25%" der amerikanischen Wirtschaftsleistung ausmachen (KFOX).

Damit stehen sich zwei Positionen gegenüber, die beide ihre eigene Buchhaltung mitbringen. Der Marktführer schlägt Regeln vor, nach denen er geprüft werden will. Der Präsident erklärt das Problem für erfunden und baut eine Behörde, die die Industrie „hegen und pflegen" soll.

Was in beiden Erzählungen nicht vorkommt, ist die Rechnung.

OpenAI hat den Börsengang für dieses Jahr abgesagt. Sam Altman gegenüber „Fortune": Angesichts der Sicherheitslage sei jetzt „an ill-advised moment to go public" (Fortune).

Anthropic ist inzwischen nachgezogen und hat den Börsengang nach hinten geschoben, Berichten zufolge in den November. Angepeilt wird eine Bewertung um die zwei Billionen Dollar und ein Einsammeln von bis zu 100 Milliarden. Die Berater sagen, man wolle vorher starke Zahlen für das dritte Quartal vorlegen (the-decoder).

Zwei Firmen, die nach eigener Darstellung die wichtigste Technologie der Menschheit bauen, warten also lieber noch ein Quartal, bevor sie jemanden in die Bücher schauen lassen.

Zur gleichen Zeit passiert etwas, das die bequeme Erzählung von den billigen Chinesen zerlegt.

Claude Opus 4.8 kostet 25 Dollar pro Million Ausgabe-Token (Anthropic). DeepSeek V4 Flash kostete bis Mitte August 0,28 Dollar. Der Abstand war das zentrale Argument gegen die amerikanischen Anbieter.

Am 16. August hat DeepSeek die Preise angehoben. V4 Flash liegt seitdem bei 0,66 Dollar außerhalb der Stoßzeiten und 1,32 Dollar in der Spitze. Bei einzelnen Posten bedeutet das einen Aufschlag von mehreren hundert Prozent. Begründung laut Bericht: schlicht Angebot und Nachfrage. Ein zitierter Analyst wird konkreter: „DeepSeek can't keep up with compute requirements." (InfoWorld)

Wer am Ende entscheidet

Drei Fälle, eine Mechanik.

Im Jemen haben Menschen ein Werkzeug benutzt, das ihnen die Arbeit von Ingenieuren ersetzt hat, die sie nie hätten anwerben können. In Washington hat ein Mensch einem Werkzeug geglaubt, weil dessen Ausgabe aussah wie ein geprüfter Bericht. Und auf beiden Seiten des Streits um Tempo rechnen Menschen still ihre Unit Economics durch, während sie öffentlich über das Ende der Welt reden.

Kein Modell ist ausgebrochen. Kein Modell hat einen Befehl gegeben.

Was ausgefallen ist, ist jedes Mal derselbe Posten. Der Aufwand. Wer ein Waffenprogramm bauen wollte, brauchte bisher ein Team. Wer ein Papier in Hausform verteilen wollte, brauchte bisher Zeit. Aufwand hat gefiltert, ohne dass jemand ihn dafür eingerichtet hätte.

Dieser Filter ist weg. Und weil er weg ist, merkt man erst jetzt, wofür er da war.

Wer also über KI-Sicherheit redet und dabei nur über Modelle spricht, redet über den bequemen Teil. Der unbequeme Teil sitzt davor und dahinter. Er heißt Absicht, und er heißt Prüfung.

In eigener Sache: Beratung, KI-nativ.

Genau diese Rechnung mache ich beruflich. Strategie- und KI-Sparring für Vorstand, Geschäftsführung und Aufsichtsrat. Keine Folienschlacht, keine Folgeauftrag-Logik, eine zweite Meinung, die nicht auf der Payroll des CEO steht.

Wenn ihr gerade etwas auf diesen Modellen baut und wissen wollt, was davon in achtzehn Monaten noch trägt: Stell mir eure Frage. Ich antworte persönlich, in der Regel innerhalb von 48 Stunden.

Jetzt Anfrage stellen →

Bis nächste Woche.

— Stephan


P.S. Du folgst mir noch nicht? Instagram · TikTok · LinkedIn