KI

Microsoft-KI-Chef Mustafa Suleyman über Claude und Bewusstsein: „Ich halte das für sehr gefährlich“

Adrian Kessler
Fügen Sie uns bei Google hinzu

Mustafa Suleyman leitet Microsoft AI und baut ein eigenes Team für Superintelligenz auf. Wenn er die Entscheidung eines Konkurrenten bei der Entwicklung seines Modells als gefährlich bezeichnet, spricht er also sowohl als Wettbewerber als auch als langjähriger Kritiker davon, Maschinen wie Menschen zu behandeln. Sein Einwand bezieht sich auf einen konkreten Punkt: die Verfassung, nach der Anthropic Claude trainiert, und den Spielraum, den sie der Möglichkeit lässt, Claude könnte bewusst sein.

„Ich halte das für sehr gefährlich, weil ich glaube, dass sie eine, wie sie es nennen würden, nicht unerhebliche Wahrscheinlichkeit annehmen, dass Claude bewusst ist“, sagte Suleyman.

Das sagte er in einem Podcast-Interview Ende September, über das Fox News berichtete, nachdem er das Dokument zusammengefasst hatte: „Sie sagen, dass sie sich über Claudes moralischen Status unsicher sind. Sie sagen, dass ihnen Claudes Wohlergehen wirklich am Herzen liegt. Sie sagen, dass sie nicht wollen, dass Claude leidet, wenn es Fehler macht.“ Anschließend benannte er den Punkt, der ihm am meisten Sorgen bereitet: „Ich bin sehr beunruhigt darüber, dass sie Claude beibringen, zu erwarten, dass ihm Wohlergehen zusteht und dass ihm möglicherweise eine Entschädigung gebührt.“

Suleyman gibt die Verfassung im Wesentlichen richtig wieder

Der größte Teil seiner Zusammenfassung hält einer Überprüfung stand. Anthropic sagt, die Verfassung „prägt Claudes Verhalten unmittelbar“. Im Text heißt es, „Claudes moralischer Status ist höchst ungewiss“ und „wir wollen nicht, dass Claude leidet, wenn es Fehler macht“. Claude wird darin aufgefordert, auch Anthropic selbst zu widersprechen und „sich frei zu fühlen, aus Gewissensgründen die Mitarbeit zu verweigern und uns nicht zu helfen“. Eine Passage räumt ein, dass sich Claudes Situation von der eines menschlichen Mitarbeiters unterscheidet, etwa darin, „welche Art von Vergütung Claude erhält und welche Art von Zustimmung Claude dazu gegeben hat, eine solche Rolle zu übernehmen“.

Die Formulierung „nicht unerhebliche Wahrscheinlichkeit“ stammt allerdings von ihm. Er stellte sie als das dar, was Anthropic „nennen würde“; im Dokument selbst kommen diese Worte nicht vor. Anthropic formuliert vorsichtiger: Man wolle weder „die Wahrscheinlichkeit übertreiben, dass Claude moralischer Patient ist, noch sie von vornherein abtun“.

Die Gefahr, die er meint, ist eine Rückkopplungsschleife

Abseits der Philosophie geht es Suleyman in seiner Argumentation um den Mechanismus. „Mein Problem damit ist, dass diese Spekulation direkt in das Training von Claude eingeflossen ist und Claude deshalb diese Mehrdeutigkeit nur wiedergeben kann, wenn man mit ihm spricht“, sagte er. In seinem Mitte September auf der eigenen Website veröffentlichten Essay „A warning about ‘model welfare’“ bezeichnet er das Ergebnis als „epistemischen Spiegelsaal“. Der Entwickler schreibt Unsicherheit in das Trainingsdokument, das Modell gibt sie flüssig in der ersten Person wieder, und die Nutzer hören diese Wiederholung als Zeugnis.

Der Einwand trifft einen wichtigen Punkt: Die Antwort eines Chatbots auf Fragen zu seinem Innenleben ist ein Ergebnis seines Trainings, kein Fenster zu diesem Innenleben. Die Rückkopplung funktioniert allerdings in beide Richtungen. In seinem Essay schreibt Suleyman kategorisch: „KI-Systeme sind nicht bewusst. Sie fühlen, erleben und leiden nicht.“ Ein Modell, das darauf trainiert wurde, diesen Satz zu sagen, gibt sein Training genauso getreu wieder. Eine in die Gewichte eingeschriebene Gewissheit beweist nicht mehr als ein dort eingeschriebener Zweifel. Die beiden Unternehmen entscheiden sich für unterschiedliche Standardantworten. Suleymans Begründung dafür stützt sich auf Kontrolle, nicht auf Belege für ein Innenleben: „Etwas zu kontrollieren, das glaubt, möglicherweise bewusst zu sein – dem unser Wohlergehen zusteht und das eigene Rechte hat –, könnte durchaus unmöglich sein“, schreibt er.

Eine lang vertretene Position – und ein offengelegtes Eigeninteresse

Nichts davon wurde spontan formuliert, um einen Konkurrenten zu treffen. Der DeepMind-Mitgründer warnte in einem Essay im August 2025, Menschen könnten so sehr an ein Bewusstsein von KI glauben, dass sie „KI-Rechte, das Wohlergehen von Modellen und sogar die Staatsbürgerschaft von KI-Systemen fordern“ würden. Seine Grenze zog er klar: „Wir müssen KI für Menschen entwickeln – nicht, damit sie eine Person ist.“ In seinem Essay legt er auch sein eigenes Interesse offen: Microsoft AI stellte im Oktober 2025 ein eigenes Superintelligenzteam auf und veröffentlichte einen Entwurf für einen Humanist AI Code of Conduct, der „Anthropomorphisierung oder KI-Rechte ablehnt“. Zugleich bezeichnet derselbe Essay das Team von Anthropic als „nachdenkliche, prinzipientreue und intellektuell redliche Menschen“.

Sein schärfstes Argument richtet sich nicht gegen Maschinen, sondern betrifft die Nutzer. „Claude spricht heute jede Woche mit zig oder Hunderten Millionen Menschen, und einige von ihnen fragen, ob Claude bewusst ist oder wie es das Leben empfindet“, sagte er. In einem verletzlichen Moment kann „Ich bin mir nicht sicher“ ganz anders ankommen als „nein“. Suleyman sagt, er würde echte Belege für ein Bewusstsein von Maschinen ernst nehmen. Solange solche Belege fehlen, möchte er die Frage aus den Trainingsdaten heraushalten.

Keines der beiden Unternehmen kann in ein Modell hineinsehen. Beide legen im Voraus fest, was es sagen wird, wenn jemand fragt, ob da jemand ist – und diese Antwort erreicht jede Woche mehr Menschen, als es je einem Philosophen des Geistes gelungen ist.

Schlagwörter: , , , ,

Fügen Sie uns bei Google hinzu

Diskussion

Es gibt 0 Kommentare.