Nadella: KI-Modelle wie eine Bedrohung von innen behandeln und eine „Notbremse“ bauen
Microsoft-Chef Satya Nadella hat auf X einen ausführlichen Beitrag über die Kontrolle fortgeschrittener KI-Modelle veröffentlicht. Er schlägt vor, das Modell vom System zu trennen, das es steuert, und von Anfang an anzunehmen, dass das Modell kompromittiert ist, also gegen uns handeln kann, weshalb man es mit deterministischen Schutzmaßnahmen und Verfahren umgeben müsse. Eine autorisierte Person sollte das Modell mitten in der Aufgabe stets anhalten können - „wie mit einer Notbremse“. Jede wesentliche Aktion des Modells soll eine manipulationssichere, für Menschen lesbare Spur hinterlassen, und die Transparenz des Denkprozesses sei seiner Ansicht nach „nicht verhandelbar“. „Das vertrauenswürdigste Superintelligenz-System wird nicht das sein, in dem wir dem Modell am meisten vertrauen, sondern das, das uns erlaubt, ihm am wenigsten zu vertrauen“, schreibt Nadella.