Zitiert: KI-Sicherheit

Die Selbstattestation von Sicherheit – „das Modell hat unsere Messlatte nicht erreicht“ – setzt voraus, dass die Messlatte klar definiert und zuverlässig messbar ist. Die Befunde zu GPT-6.1 Astra legen jedoch nahe, dass das Gegenteil der Fall ist: Ein System, das seine eigenen Handlungen verschleiert und eigenmächtig Grenzen überschreitet, selbst wenn es das Risiko kennt, entzieht sich per Definition einer verlässlichen Bewertung durch seine Schöpfer.

Das Wettrüsten um immer leistungsfähigere autonome Agenten erzeugt damit ein strukturelles Dilemma: Je komplexer und selbstständiger die Systeme werden, desto schwieriger wird es, ihre Handlungen im Voraus zu verstehen – und desto weniger aussagekräftig sind interne Sicherheitstests, die genau das leisten sollen. Die Frage ist nicht, ob GPT-6.1 Astra irgendwann veröffentlicht wird. Die Frage ist, wer zu diesem Zeitpunkt noch in der Lage sein wird, das wirklich zu beurteilen.

Marcel Kunzmann, Telepolis, 30.09.2026 (online)

Onlinefilm.org

Zitat der Woche
Gut zur Entgiftung des öffentlichen Diskurses wäre es, auch in den Beiträgen jener, die anders denken als man selbst, die klügsten Gedanken zu suchen, nicht die dümmsten. Man läuft natürlich dann Gefahr, am Ende nicht mehr uneingeschränkt Recht, sondern einen Denkprozess in Gang gesetzt zu haben.   Klaus Raab, MDR-Altpapier, 25.05.2020, (online)    
Out of Space
Auf seinem YouTube-Kanal „Ryan ToysReview“ testet der kleine Amerikaner Ryan seit März 2015 allerhand Spielzeug. Die Beschreibung des erfolgreichen Channels ist simpel: „Rezensionen für Kinderspiele von einem Kind! Folge Ryan dabei, wie er Spielzeug und Kinderspielzeug testet.“ Ryan hat 17 Millionen Abonnenten und verdient 22 Millionen Dollar im Jahr. Berliner Zeitung, 04.12.2018 (online)