Diese Woche veröffentlichten Sicherheitsforscher Erkenntnisse, die außerhalb von Fachkreisen mehr Aufmerksamkeit verdienen würden. Sie wiesen nach, dass die verschlüsselten Denkprozesse, die von großen KI-APIs wie OpenAI, Anthropic und Google erzeugt werden, extrahiert und zwischen Modellen übertragen können. Um es deutlich zu sagen: Das versteckte Denken eines Modells vor seiner Antwort kann herausgezogen und an ein anderes Modell weitergegeben werden, das es dann nutzen kann.
Das ist keine Nebensächlichkeit. Es verändert mehrere Annahmen, die wir für gesetzt hielten darüber, wie diese Systeme funktionieren, wer die Kontrolle hat und was es bedeutet, ein Produkt oder einen Workflow auf einer kommerziellen KI-API zu bauen.



