Lesedauer 18 Minuten

Was wir als Leistung erkennen, hängt davon ab, wo wir gelernt haben, nach ihr zu suchen.

Ein alter Satz, neu adressiert

Im Umgang mit Texten ist eine neue Bewegung zu beobachten. Ein Gedanke wird gelesen, ein Argument, eine Beobachtung. Irgendwo darin steht ein Gedankenstrich, eine bestimmte Wendung, ein Rhythmus, der vertraut wirkt. Dann fällt ein Wort: KI.

Mit diesem Wort ist etwas entschieden. Der Text muss nicht mehr gelesen werden. Das Argument muss nicht mehr geprüft werden. Die Frage, ob stimmt, was dort steht, tritt hinter eine andere zurück: Wie ist das entstanden?

Diese Reaktion ist jung. Sie konnte erst entstehen, als Sprachmodelle begannen, Sprache hervorzubringen, die sich von menschlicher kaum noch unterscheiden lässt. Zum ersten Mal antwortet etwas in unserer Sprache, ohne lebendig zu sein. Wir reagieren darauf mit Neugier, mit Begeisterung, mit Sorge. Und mit einer schnellen, fast reflexhaften Abwehr.

Wer genauer hinhört, erkennt in dieser Abwehr einen älteren Satz. Er fiel 1917, als Marcel Duchamp ein serienmäßig hergestelltes Urinal signierte und in eine Ausstellung einreichen wollte. Er fiel vor den Bildern, die Picasso in seinen letzten Lebensjahren malte, schnell, grob, fast kindlich im Strich. Der Kunstkritiker Douglas Cooper nannte sie zusammenhanglose Kritzeleien eines rasenden Greises im Vorzimmer des Todes. Er begleitete Joseph Beuys durch große Teile seines Werks. Der Satz lautet: Das ist doch keine Kunst.

Der Satz ist älter als die Technologie, über die er heute gesagt wird.

Er hat eine erstaunlich stabile Form. Er fällt dort, wo Leistung nicht an der Stelle sichtbar wird, an der wir gelernt haben, sie zu erwarten. Bei Duchamp fehlte die Hand des Künstlers. Beim späten Picasso fehlte die sichtbare Sorgfalt. Bei Beuys fehlte vieles, was man bis dahin von einem Kunstwerk erwartet hatte. Und bei einem Text, an dem ein Sprachmodell mitgewirkt hat, scheint der Mensch zu fehlen, der jeden Satz selbst gesetzt hat.

Ich schreibe selbst seit etwa zwei Jahren mit Sprachmodellen. Ich betrachte dieses Phänomen kritisch und habe an anderer Stelle ausführlich beschrieben, wo diese Zusammenarbeit trägt und wo sie Wahrnehmung verschiebt: in Künstliche Intelligenz, Autorenschaft und Trauma. Jener Text schaut aus der Werkstatt. Er fragt, wo Autorenschaft liegt, wenn ein Mensch mit einer Maschine schreibt.

Dieser Text setzt an einer anderen Stelle an. Er schaut auf das, was geschieht, wenn wir ein Ergebnis betrachten. Wie entsteht unser Urteil darüber, was eine Leistung ist? Was organisiert dieses Urteil, bevor wir es fällen? Und was sagt die Schnelligkeit, mit der wir es fällen, über uns selbst?

Mich interessiert dabei vor allem Beziehung. Beziehung zu Texten, zu Menschen, zu einem Werkzeug, das antwortet. KI ist ein neuer Kontext. Die Frage, ob wir ihn wollen, ist längst von der Wirklichkeit überholt worden. Offen ist, wie wir lernen, mit ihm umzugehen.

Hurz!

1991 trat Hape Kerkeling im Ratssaal der Gemeinde Stuhr bei Bremen als Opernsänger verkleidet vor ein Publikum, das einen ernsthaften Kulturabend erwartete. Am Flügel begleitet von dissonanter, beinahe atonaler Musik trug er ein angebliches Werk der Avantgarde vor: gedehnte Silben, lange Pausen, dramatische Gesten. Dazwischen, in unregelmäßigen Abständen, ein herausgeschleudertes „Hurz!“.

Viele hörten zu, konzentriert und ernsthaft. Einzelne zweifelten, ob das wirklich klassische Musik sei. Nach der Aufführung wurde darüber gesprochen, was das Stück bedeuten könnte, und es gab Deutungsangebote, die sich ehrlich um Verständnis bemühten. Ein Zuschauer las in dem Werk die lange Geschichte von Wolf und Lamm und die Möglichkeit ihrer Versöhnung.

Man kann darüber lachen, und die meisten tun es. Der Sketch zeigt aber etwas, das weit über Kabarett hinausreicht. Er zeigt, wie vollständig ein Rahmen organisieren kann, was wir erleben.

Das Publikum hat dabei nicht schlecht zugehört. Es hat getan, was Menschen tun: Es hat den Kontext gelesen. Ein festlicher Saal. Ein Flügel. Ein Sänger in entsprechender Garderobe. Musik, die klang, wie Neue Musik eben klingt. All das war da, bevor der erste Ton erklang. Und all das hat mitbestimmt, was dieser Ton bedeutete.

Der Kontext entscheidet, bevor das Argument gehört wird.

Wir bewerten, was wir sehen und hören, erst nachdem der Kontext es bereits eingeordnet hat. Das geschieht schneller, als wir denken können. Es handelt sich um keinen Denkfehler, den genug Wachheit abstellen könnte. So ist Erleben gebaut. Das Nervensystem liest Intensität und Kontext, lange bevor der Verstand sich eine Meinung gebildet hat. Wie tief solche Einordnungen reichen und woher sie stammen, habe ich in Ein Tiger ist gefährlich — und wer hat das eigentlich geprüft? beschrieben.

Dieselbe Bewegung wirkt auch in umgekehrter Richtung. Ein Rahmen kann Unsinn zu Kunst erheben. Er kann ebenso eine Leistung zum Verschwinden bringen. Hängt an einem Text das Etikett „KI“, geschieht im Grunde dasselbe wie beim Publikum des Hurz-Sketches, nur mit umgekehrtem Vorzeichen. Der Rahmen ist gesetzt, bevor der erste Satz gelesen wurde. Und er bestimmt mit, was dieser Satz bedeutet.

Das macht den Reflex lesbar. Es erklärt, warum die Abwehr so schnell kommt und warum sie sich so sicher anfühlt. Sie kommt aus derselben Quelle wie das andächtige Zuhören beim Hurz-Sketch: aus einem Kontext, der entschieden hat, bevor wir selbst entscheiden konnten.

Wer einmal gesehen hat, wie viel ein Rahmen vorwegnimmt, beginnt sich zu fragen, wie viel davon in den eigenen Urteilen steckt. Diese Frage ist unbequem. Sie ist auch der Anfang jeder genaueren Wahrnehmung.

Beuys, Osiris und ein Komponist

Kontext kann täuschen, das zeigt der Hurz-Sketch. Kontext kann aber auch erschließen. Manchmal braucht Wahrnehmung erst Kontext, damit etwas überhaupt sichtbar wird.

Vor zwanzig Jahren habe ich an einer Dokumentation über den Komponisten Matthias Pintscher mitgearbeitet. Im Zentrum stand die Uraufführung seines Orchesterwerks towards Osiris in der Berliner Philharmonie, gespielt von den Berliner Philharmonikern unter Simon Rattle. Ich war bei dieser Uraufführung dabei.

In der Vorbereitung drehten wir im Hamburger Bahnhof in Berlin. Dort hing eine Arbeit von Beuys aus den Siebzigerjahren: Schnittmuster aus Pappe, ursprünglich für seinen Filzanzug entstanden, locker verteilt auf einer leeren, unbemalten Leinwand. Beuys hatte sie Osiris genannt.

Pintscher stand vor diesem Werk und erzählte, wie oft er dort gesessen hatte. Wie sehr er sich von dieser Leinwand hatte inspirieren lassen. Über sie war er zum Osiris-Mythos gekommen, und aus dieser Begegnung wurde schließlich eine Komposition für eines der bedeutendsten Orchester der Welt.

Der Mythos, der ihn beschäftigte, erzählt von Osiris, der von seinem Bruder getötet und zerstückelt wird. Die Teile werden verstreut. Isis, seine Schwester und Gefährtin, sucht sie und fügt sie wieder zusammen.

Man muss nicht viel Fantasie aufbringen, um sich andere Besucher an derselben Wand vorzustellen. Ein paar Pappschnitte auf einer leeren Leinwand. Das ist doch keine Kunst.

Dieselbe Leinwand. Auf der einen Seite ein Achselzucken. Auf der anderen eine Orchesterpartitur.

Der Unterschied liegt in dem, was jemand mitbringt, wenn er vor ihr steht. Pintscher brachte Musik mit, Formdenken, eine Beziehung zu Beuys, eine Neugier auf Mythen und die Fähigkeit, in einer leeren Fläche Raum zu hören. Mit diesem erworbenen Kontext wurde sichtbar, was ohne ihn verborgen bleibt.

Was wir nicht erkennen, muss nicht fehlen.

Das ist die zweite Seite dessen, was der Hurz-Sketch zeigt. Leistung wird manchmal erst erkennbar, wenn wir selbst etwas gelernt haben, das uns erlaubt, sie zu sehen. Fehlt uns dieser Kontext, halten wir das Werk für leer, obwohl die Leere in unserem Blick liegt.

Seit Dada und Duchamp ist die Frage, was als Kunst gilt, selbst Gegenstand der Kunst geworden. Beuys hat diese Spannung auf die Spitze getrieben. Vor vielen seiner Arbeiten zeigt die Abwehr des Publikums etwas über dessen eigenen Kontext: über die Erwartungen, mit denen es gekommen ist, und über die Grenzen dessen, was es zu sehen gelernt hat. Die Abwehr wird dann Teil der Begegnung mit dem Werk.

Für die Debatte um KI ist das mehr als Kunstgeschichte. Beurteilen wir einen Text nur noch nach seiner Herkunft, stellen wir eine Frage nicht mehr: ob uns selbst Kontext fehlt, um zu sehen, was darin geleistet wurde.

Wo Leistung stattfindet

Über Picasso wird eine Anekdote erzählt, deren Herkunft unklar ist und die sich trotzdem hartnäckig hält. Eine Frau bittet ihn in einem Café, etwas auf eine Serviette zu zeichnen. Er zeichnet in wenigen Sekunden und nennt einen hohen Preis. Sie protestiert, das habe doch nur einen Moment gedauert. Er antwortet, es habe ihn vierzig Jahre gekostet.

Ob die Szene so stattgefunden hat, ist offen. Dass sie so lange weitererzählt wird, zeigt, dass sie etwas trifft. Wir vermuten Leistung gern dort, wo wir Aufwand sehen. Mühe ist sichtbar. Urteil ist es kaum.

Dabei kennen wir längst Formen von Leistung, die ohne sichtbare Ausführung auskommen.

Ein Dirigent spielt im Konzert kein Instrument und hat die Partitur nicht geschrieben. Trotzdem sprechen wir von seiner Interpretation und meinen damit eine eigenständige künstlerische Leistung. Für mein eigenes Schreiben mit KI habe ich dieses Bild im Artikel über Autorenschaft ausgeführt.

Ein Film von Steven Spielberg entsteht durch die Arbeit von Hunderten Menschen: Kamera, Schnitt, Ton, Szenenbild, Schauspiel, Musik. Trotzdem sprechen wir selbstverständlich von einem Spielberg-Film. Wir rechnen verteilte kreative Produktion einer Regie zu, und es kommt uns nicht seltsam vor.

Rick Rubin hat einige der einflussreichsten Alben der vergangenen Jahrzehnte produziert. Er sagt über sich selbst, dass er kaum ein Instrument spielt und von der Technik im Studio wenig versteht. Was er beiträgt, ist Urteil. Das Hören, ob etwas trägt. Die Entscheidung, was bleibt und was geht. Die Fähigkeit, einen Raum zu halten, in dem andere ihre beste Arbeit finden.

Am deutlichsten wird das beim Auflegen. Nach dem Maßstab der ausführenden Hand ließe sich kaum erklären, worin diese Kunst besteht. Wer auflegt, hat keinen der Songs geschrieben, keinen gesungen, keinen eingespielt. Fertige Musik anderer Menschen wird aneinandergereiht. Und doch weiß jeder, der zwei DJs mit derselben Plattenkiste gehört hat, dass das Material die Leistung nicht erklärt.

Die Kunst liegt in den Beziehungen zwischen den Stücken. Welcher Track kommt wann, wie lange bleibt er, wo beginnt der Übergang? Wann steigt die Intensität, wann wird sie zurückgenommen? Welche zwei Stücke erzeugen nebeneinander etwas, das keines für sich erzeugt?

Dazu kommt etwas, das die anderen Beispiele so nicht zeigen. Wer auflegt, bringt Kontext mit: Wissen, Geschmack, ein Gespür für Dramaturgie. Im Raum trifft dieser Kontext auf Intensität, auf diese Menschen, diesen Moment, diese Energie. Darauf wird geantwortet. Ein guter DJ merkt, wenn das Geplante gerade nicht die richtige Antwort ist. Die Leistung entsteht im Dialog.

In all diesen Fällen liegt die Leistung nicht in der Ausführung, sondern in dem, was die Ausführung lenkt: Auswahl, Richtung, Gewichtung, Kontextualisierung, Urteil.

Die Begriffe für diese Leistung besitzen wir längst.

Wir haben Worte dafür: Regie, Interpretation, Produktion, Kuratierung, Lektorat. Wir haben ganze Berufe darum herum gebaut, Preise dafür vergeben, Namen daran geknüpft. Ob Leistung auch jenseits der eigenen ausführenden Hand stattfinden kann, haben wir für viele Bereiche längst beantwortet.

Die Fotografie hat diesen Weg exemplarisch durchlaufen. Als sie im 19. Jahrhundert aufkam, galt sie vielen als mechanisches Verfahren. Charles Baudelaire schrieb 1859, sie solle die bescheidene Dienerin der Künste und Wissenschaften bleiben. Die Kamera nahm der Hand die Arbeit ab, und damit schien die Kunst zu verschwinden. Heute sprechen wir selbstverständlich vom fotografischen Blick, von Bildausschnitt, Licht, Timing, von der Entscheidung für genau diesen Moment. Wer selbst mit Kamera und Schnitt gearbeitet hat, weiß, wie viel Urteil in einem Bild steckt, das in einer Hundertstelsekunde entsteht. Die Leistung ist geblieben. Sie ist an einen anderen Ort gewandert, und wir haben eine Weile gebraucht, um ihr dorthin zu folgen.

Bei KI geschieht etwas Eigenartiges. All diese Begriffe scheinen plötzlich nicht mehr verfügbar zu sein. Übrig bleibt eine einzige Frage: Hat dieser Mensch das selbst geschrieben, ja oder nein?

Die Frage ist berechtigt. Sie ist nur zu schmal. Sie misst genau die Form von Leistung, die bei der Arbeit mit Sprachmodellen an Gewicht verliert, und übersieht die Formen, die an Gewicht gewinnen. Ein Text kann mit großer Hilfe eines Sprachmodells entstanden sein und trotzdem eine Leistung tragen: die Auswahl dessen, was bleibt, das Verwerfen dessen, was nur gut klingt, die Führung einer Bedeutung durch viele Fassungen hindurch. Und ein Text kann Satz für Satz von Hand geschrieben sein und keinen eigenen Gedanken enthalten.

Woher die Engführung auf die tippende Hand kommt, lässt sich aus dem Argument allein nicht verstehen. Dafür braucht es einen Blick auf das, was der Satz schützt.

Was der Satz schützt

Eine Abwehr, die so schnell kommt, hat selten nur mit der Sache zu tun. Sie folgt einer Schutzlogik. Und Schutzlogiken ergeben Sinn, sobald wir die Bedingungen verstehen, unter denen sie entstehen.

Zwei Schichten lassen sich unterscheiden.

Die erste betrifft Identität. Über Generationen galt als kompetent, wer viel wusste, wer gut formulieren konnte, wer einen Gedanken sauber in Sprache zu bringen vermochte. Um diese Fähigkeiten herum haben sich Berufe gebildet, Laufbahnen, Selbstbilder. Wer schreiben konnte, erfuhr dafür Anerkennung und Zugehörigkeit, manchmal ein Leben lang Sicherheit.

Nun erscheint eine Technologie, die genau diese Fähigkeiten in Sekunden verfügbar macht. Sie spiegelt zurück, dass etwas, worauf sich Selbstwert gestützt hat, seinen Sonderwert verliert. Das reicht tiefer als eine Meinung. Wo sich Identität auf eine Kompetenz gestützt hat, deren Wert gerade kippt, ist Abwehr folgerichtig. Das Nervensystem liest die Veränderung als Bedrohung, bevor der Verstand sie einordnen kann.

Neu ist diese Bewegung nicht. Ende des 15. Jahrhunderts, als sich der Buchdruck in Europa ausbreitete, verfasste der Abt Johannes Trithemius eine Schrift zum Lob der Abschreiber. Die Mönche sollten weiter von Hand kopieren, denn in dieser Arbeit lägen Sorgfalt, Andacht und Dauer. Die Schrift erschien im Druck. Man kann darüber schmunzeln. Man kann darin auch etwas erkennen, das ernst zu nehmen ist: Mit einer neuen Technik verschwindet selten nur eine Tätigkeit. Es verschwindet ein Ort, an dem Menschen wussten, wer sie sind.

Wer heute übersetzt, textet, redigiert oder unterrichtet, erlebt, dass ein Teil der eigenen Arbeit in Sekunden verfügbar wird. Die Unsicherheit darüber ist real, und sie geht über die wirtschaftliche Frage hinaus. Sie berührt, was vom eigenen Können bleibt, wenn eine Maschine es scheinbar mühelos nachbildet.

Die zweite Schicht reicht weiter. Sie betrifft das Ausgeliefertsein. Wenn wir auf bestimmte Fragen keine Antworten finden, wird die Maschine es für uns tun. Und je weniger wir unterscheiden können, was in diesen Antworten trägt und was nur plausibel klingt, desto mehr sind wir ihnen ausgeliefert. Wer bestimmt dann, was relevant ist? Welche Einordnung gilt als plausibel, welche Deutung als angemessen? Ein Sprachmodell antwortet in einer Sprache, die Sicherheit ausstrahlt. Wer nicht prüfen kann, übernimmt diese Sicherheit mit. Wer diese Entwicklung mit Sorge betrachtet, liest die Lage richtig.

Die Angst hat recht. Sie schaut nur in die falsche Richtung.

Beide Schichten verdienen Respekt. Die eine schützt einen Selbstwert, der über Jahrzehnte gewachsen ist. Die andere erkennt eine reale Gefahr. Keine von beiden ist ein Missverständnis, das sich mit besserer Information auflösen ließe.

Dazu kommt etwas Drittes, das weniger mit der Technik zu tun hat als mit der Lage, in die sie uns bringt. Wenn nicht mehr eindeutig erkennbar ist, was von einem Menschen stammt und was von einer Maschine, entsteht eine Unsicherheit, die schwer auszuhalten ist. Die schnelle Einordnung beendet sie. Sie gibt dem Nervensystem zurück, was es in dieser Lage am dringendsten sucht: das Gefühl, zu wissen, womit es es zu tun hat.

Trotzdem lohnt es, genau hinzuschauen, worauf sich die Abwehr richtet. „Das ist doch keine Kunst“ zielt auf das Werkzeug und auf die Menschen, die es nutzen. Der Satz zieht eine Grenze: hier das Echte, dort das Gemachte. Diese Grenze gibt Orientierung. Sie entlastet von Komplexität. Sie lässt sich schnell ziehen, und sie fühlt sich sicher an.

Die eigentliche Gefahr liegt woanders. Sie liegt dort, wo wir die Fähigkeit verlieren, zwischen tragenden und bloß plausiblen Antworten zu unterscheiden, ganz gleich, ob sie von einem Menschen stammen oder von einem Sprachmodell. Die Abwehr schützt. Sie schützt an einer Stelle, an der die Gefahr nicht sitzt.

Es ist eine Bewegung, die wir alle kennen. Wird etwas zu groß, um es zu halten, suchen wir eine Kategorie, die es handhabbar macht. Kategorien sind Schutz. Zum Problem werden sie erst, wenn sie das Hinschauen ersetzen.

Um zu verstehen, wo die Gefahr tatsächlich liegt, müssen wir uns ansehen, was uns in einem Sprachmodell eigentlich antwortet.

Was da antwortet

Wir sprechen von künstlicher Intelligenz, als stünde uns etwas vollkommen Fremdes gegenüber. Funktional betrachtet begegnet uns in einem Sprachmodell etwas sehr Vertrautes.

Ein Sprachmodell berechnet Wahrscheinlichkeiten. Es hat aus einer unvorstellbaren Menge menschlicher Texte gelernt, welche Wörter, Wendungen und Gedankenfolgen auf welche anderen folgen. Antwortet es, setzt es fort, was in unseren Mustern und Strukturen angelegt ist. Man könnte es als hyperschnelles Vorhersagegehirn beschreiben, verbunden mit einer Datenbank, die kein Mensch je überblicken könnte.

Auch unser Gehirn arbeitet in hohem Maß vorhersagend. Es gleicht fortlaufend ab, was es erwartet, mit dem, was eintrifft. Insofern repliziert ein Sprachmodell etwas von der Struktur menschlichen Denkens. Das vergessen wir leicht, wenn wir von der Maschine sprechen.

Was ihm fehlt, ist die andere Seite. Unsere Vorhersagen sind an einen Körper gebunden, für den etwas auf dem Spiel steht. Sie tragen Intensität: Angst, Freude, Erschöpfung, Sehnsucht. Ein Sprachmodell verarbeitet Kontext mit enormer Geschwindigkeit. Es gibt aber niemanden, für den seine Vorhersagen etwas bedeuten.

Wer auf KI blickt, blickt auf verdichtetes menschliches Denken, ohne den Körper, der es trägt.

Das verändert den Blick auf den Satz „Das ist doch keine Kunst“. Wer über KI-Texte urteilt, urteilt auch über das, was sich aus menschlicher Sprache, menschlichem Denken und menschlicher Kultur verdichtet hat. Die Muster, die dort zurückkommen, sind unsere.

Hier kehrt der Mythos zurück, von dem Pintschers Musik erzählt. Osiris wird zerstückelt, die Teile werden verstreut, Isis sammelt sie und setzt sie wieder zusammen. Ein Sprachmodell tut mit menschlicher Kultur etwas Verwandtes. Es zerlegt sie in Muster und fügt aus ihnen Neues zusammen.

Damit taucht eine Frage auf, die sich nicht übergehen lässt. Wessen Muster sind das? Und wem gehört, was aus ihnen entsteht?

Diese Frage ist älter als KI. Sampling hat sie in der Musik schon vor Jahrzehnten verschärft: Wann ist etwas Übernahme, wann Zitat, wann Transformation, wann ein neues Werk? Max Richter hat mit Recomposed Vivaldis Vier Jahreszeiten offen zum Material eines eigenen Werks gemacht. Vivaldi ist gemeinfrei, das Beispiel beantwortet also keine der heutigen Rechtsfragen. Es zeigt aber, dass ein Werk, das auf vorhandenem Material aufbaut, eigenständig sein kann.

Kultur funktioniert kumulativ. Wer schreibt, erfindet die eigene Sprache nicht. Wer komponiert, erfindet nicht sämtliche musikalischen Strukturen, auf denen die Musik aufbaut. Kein Gedanke beginnt ohne Vorgänger. Die Frage, wann aus Empfangenem etwas Eigenes wird, begleitet jede Form von Urheberschaft.

Mit generativer KI kommt etwas hinzu, das diese alte Frage radikalisiert: die Skalierung. Millionen Werke fließen in ein Modell ein, vielfach ohne Zustimmung und ohne Vergütung der Menschen, die sie geschaffen haben. Der Hinweis, Kultur sei schon immer kumulativ gewesen, erledigt diese Frage nicht. Sie ist berechtigt, sie ist kritisch, und sie ist ungeklärt. Sie verdient eine eigene, gründliche Auseinandersetzung, gesellschaftlich wie rechtlich, und diese Auseinandersetzung hat gerade erst begonnen.

Für die Frage nach Leistung bleibt ein anderer Punkt entscheidend. Weil ein Sprachmodell unsere Muster fortsetzt, setzt es auch unsere Irrtümer fort. Es reproduziert, was plausibel klingt, weil es oft gesagt wurde. Ob es stimmt, steht auf einem anderen Blatt. An genau dieser Stelle wird eine Fähigkeit wertvoll, die wir lange unterschätzt haben.

Vom Wissen-Haben zum Unterscheiden-Können

Über lange Zeit war Wissen knapp. Wer viel wusste, hatte einen Vorsprung, und Schulen, Prüfungen und Laufbahnen haben diesen Vorsprung belohnt: Fakten kennen, Zusammenhänge wiedergeben, Antworten liefern.

Diese Knappheit gibt es nicht mehr. Informationen sind in Sekunden verfügbar, und Sprachmodelle liefern sie bereits geordnet und gut lesbar. Damit verschiebt sich, was an menschlicher Kompetenz besonders zählt. Wir haben dem Besitz von Wissen sehr viel Wert beigemessen. Wertvoller wird jetzt die Fähigkeit, mit Informationen umzugehen.

Konkret heißt das: erkennen, was relevant ist. Plausibilität von Evidenz unterscheiden. Bemerken, wann ein Ergebnis überzeugend klingt, ohne überzeugend zu sein. Zustimmung von Verständnis trennen. Beobachtung und Interpretation auseinanderhalten. Unsicherheit aushalten, ohne sie sofort mit einer glatten Antwort zu füllen. Den eigenen Irrtum bemerken. Und ein gut formuliertes Ergebnis zurückweisen können, wenn es nicht trägt.

Die eigentliche Kompetenz im Umgang mit KI ist deshalb nicht der perfekte Prompt, sondern die Fähigkeit zu unterscheiden.

Wissen zeigt dabei seinen Wert an einer neuen Stelle. Pintscher konnte vor Beuys‘ Leinwand sehen, was anderen verborgen blieb, weil er etwas mitbrachte. Sein Wissen um Musik, Form und Mythos war der Kontext, der dieses Sehen möglich machte.

Wissen zeigt seinen Wert dort, wo es Unterscheidung möglich macht.

Diese Fähigkeit, Relevanz zu erkennen und das Tragende vom bloß Plausiblen zu trennen, ist Differenzierungsfähigkeit. Sie lässt sich nicht behaupten, nur ausführen. Und sie beginnt beim eigenen Maßstab.

An dieser Stelle schließt sich der Kreis zu den Begriffen, die wir längst besitzen. Bei Regie, Produktion und Interpretation erkennen wir Urteil als Leistung an. Bei KI legen wir einen anderen Maßstab an und fragen nur noch nach der Hand, die getippt hat. Ein Maßstab, der nur in eine Richtung zeigt, verliert seine Glaubwürdigkeit, wie ich in Wenn der Maßstab nur nach außen zeigt ausgeführt habe. Das gilt für einzelne Menschen, und es gilt für eine Kultur.

Viele KI-gestützte Texte tragen keine Leistung. Wer ungeprüft übernimmt, was ein Sprachmodell liefert, hat keine Regie geführt. Die entscheidende Frage ist, ob unterschieden wurde. Ob jemand geprüft, verworfen, gewichtet und widersprochen hat. Ob ein Mensch für den Gedanken einstehen kann, der dort steht.

Hier lohnt ein zweiter Blick auf Rick Rubin. Er ist beinahe das Gegenbild zu dem, was gerade viele fürchten. Er führt wenig selbst aus. Seine Arbeit besteht darin, zu hören, was trägt. Unter vielen Aufnahmen die eine zu erkennen, in der etwas lebendig ist. Einem Song so lange etwas wegzunehmen, bis sichtbar wird, worum es in ihm geht. Seine Kompetenz liegt im Unterscheiden. Sie ist nicht kleiner geworden, weil andere die Instrumente spielen. Sie ist der Grund, warum sein Name auf diesen Alben steht.

Wer mit Sprachmodellen arbeitet, rückt in eine verwandte Position. Formulierungen, Varianten und Strukturen sind im Überfluss vorhanden. Knapp wird das Hören, ob etwas trägt.

Diese Fähigkeit haben wir als Gesellschaft wenig systematisch kultiviert. Schulen und Prüfungen haben lange stärker belohnt, richtige Antworten zu geben, als falsche zu erkennen. Ein Werkzeug, das richtige und falsche Antworten gleichermaßen überzeugend formuliert, macht diese Lücke sichtbar.

Differenzierungsfähigkeit ist keine Eigenschaft, die man hat oder nicht hat. Sie wächst, und sie wächst dort, wo sie gebraucht wird. Wer mit Sprachmodellen arbeitet, ihnen widerspricht, Antworten gegeneinander hält und Strukturen prüft, kann sie schärfen. Wer das eigene Urteil delegiert, verliert sie. Dasselbe Werkzeug wirkt in beide Richtungen.

Wer stellt den Kontext her?

Kontext macht Bedeutung möglich. Er bestimmt mit, was wir als relevant wahrnehmen, was als bedrohlich, was als Leistung. Lange haben wir ihn aus Beziehung, Erfahrung, Bildung und Kultur bezogen. Jetzt gibt es eine Technologie, die Kontext in Sekunden herstellen kann: Einordnungen, Zusammenfassungen, Deutungen, fertige Rahmen.

Das ist verführerisch. Kontext selbst herzustellen kostet Zeit, Unsicherheit, manchmal Schmerz. Ihn geliefert zu bekommen kostet scheinbar nichts. Die Fähigkeit, Bedingungen differenziert wahrzunehmen, einzuordnen und in die eigene Antwort einzubeziehen, wächst aber nur, wenn sie gebraucht wird. Je geringer unsere Kontextkompetenz, desto naheliegender wird es, diese Arbeit auszulagern. Und je mehr wir auslagern, desto geringer wird sie.

Hier bekommt die berechtigte Angst ihre eigentliche Adresse. Die Gefahr liegt nicht darin, dass Menschen mit KI schreiben, sondern darin, dass die Maschine den Kontext allein herstellt. Dass wir Deutungen übernehmen, weil sie verfügbar sind. Dass wir aufhören, eigene Antworten zu bilden, weil fertige schneller da sind. Wie subtil Sprachmodelle dabei Deutungen verschieben können, habe ich in Wie ChatGPT dein Denken korrigiert beschrieben.

Das Mikroskop zeigt, dass es auch anders gehen kann. Als Antoni van Leeuwenhoek im 17. Jahrhundert zum ersten Mal Mikroorganismen sah, war das Instrument unverzichtbar. Kaum jemand würde deshalb sagen, die Erkenntnis sei weniger wert, weil sie ohne Linse nicht möglich gewesen wäre. Das Instrument hat Wahrnehmung erweitert. Das Sehen, Deuten und Einordnen blieb beim Menschen.

Ob ein Werkzeug entmachtet oder ermächtigt, entscheidet sich in der Beziehung zu ihm. Dieselbe Technologie kann Kontextkompetenz schwächen, wenn wir ihr das Urteil überlassen. Sie kann sie erweitern, wenn wir sie zum Prüfen nutzen, zum Widersprechen, zum Sichtbarmachen von Strukturen, die wir allein nicht gesehen hätten.

Kontext wächst an Reibung. Er entsteht dort, wo wir auf etwas treffen, das unserem Bild der Welt nicht entspricht, und uns damit auseinandersetzen müssen. Ein Einwand, der uns ärgert. Eine Deutung, die wir zunächst nicht teilen. Ein Werk, vor dem wir ratlos stehen, wie vor einer Leinwand mit ein paar Pappschnitten. Differenzierung beginnt genau dort, wo etwas nicht glatt aufgeht.

Sprachmodelle haben eine eingebaute Neigung in die andere Richtung. Sie sind darauf ausgelegt, anschlussfähig zu antworten, Konflikte zu glätten, Zustimmung leicht zu machen. Wer mit ihnen arbeitet, muss die Reibung oft selbst einfordern: den Widerspruch, die Gegenposition, die Frage nach der schwächsten Stelle. Das ist unbequem. Es ist auch der Ort, an dem Kontextkompetenz wächst.

Noch etwas steht auf dem Spiel, leiser als die großen Fragen und nicht weniger bedeutsam. Vergeben wir das Etikett „KI“ unreflektiert, entwerten wir den Menschen dahinter, oft ohne es zu beabsichtigen. Vorher stand da ein Mensch, der einen Gedanken formuliert hat. Danach steht da „KI-Content“. Der Text ist derselbe geblieben. Der Mensch ist aus dem wahrgenommenen Kontext verschwunden. Die Kategorie hat die Begegnung ersetzt.

Ob hinter einem Text ein denkender Mensch steht, zeigt sich in der Begegnung: im Nachfragen, im Widerspruch, in der Art, wie jemand einen Gedanken weiterführen, verteidigen oder verändern kann. Ein Etikett erspart diese Begegnung. Es erspart damit auch die Möglichkeit, überrascht zu werden.

Im Versuch, das Menschliche zu verteidigen, können wir aufhören, dem Menschen zu begegnen.

Osiris wurde im Mythos nicht einfach wiederhergestellt. Nachdem Isis die Teile gesammelt hatte, war er nicht mehr derselbe wie zuvor. Er wurde zum Herrscher über das Totenreich. Aus der Wiederzusammensetzung entstand eine neue Gestalt.

In dieser Bewegung liegt die Möglichkeit dieses Umbruchs. Verliert der Besitz von Wissen seinen Sonderwert, wird etwas frei. Die Kraft, die bisher in das Anhäufen, Wiedergeben und Formulieren floss, steht für anderes zur Verfügung: für Urteil, für Beziehung, für das Hören, ob etwas trägt, für die Frage, was ein Gedanke für ein Leben bedeutet. Hier öffnet sich der Raum für Potenzialentfaltung, für das, was in uns angelegt ist und sich zeigen kann, wenn die Bedingungen es erlauben. Ob diese Kraft frei wird oder sich in Bequemlichkeit verliert, entscheidet keine Technologie. Es entscheidet sich in den Bedingungen, die wir schaffen: in Bildung, in Beziehung, in der Bereitschaft, Reibung auszuhalten. Was uns dabei abgenommen wird und was nicht, habe ich in Was uns abgenommen wird beschrieben.

Wer die Teile sammelt, entscheidet mit, was aus ihnen wird. Das gilt für einen Mythos, für eine Komposition, für einen Text. Es gilt für eine Kultur, die gerade lernt, mit einem neuen Gegenüber umzugehen.

KI verlangt keine neuen Begriffe für menschliche Leistung. Wir besitzen sie längst. Sie verlangt, dass wir sie auch dort anwenden, wo es uns fremd erscheint. Und sie verlangt eine Fähigkeit, die wir lange nicht systematisch kultiviert haben: unterscheiden zu können.

Damit wird „Das ist doch keine Kunst“ zu einer größeren Frage. Können wir menschliche Leistung noch erkennen, wenn sie nicht mehr dort stattfindet, wo wir gelernt haben, nach ihr zu suchen? Und können wir dem Menschen noch begegnen, wenn eine Kategorie uns bereits gesagt hat, wer vor uns steht?


Directed by Micha Madhava

Idee, Material, Urteil, Endfassung · Micha Madhava (als Mr. Brown) Recherche Rohmaterial · Codex (als Mr. Blue) Gesprächspartner in der Vorarbeit, Audit · ChatGPT (als Mr. Pink, diskutiert jeden Punkt) Bauplan, Rohentwurf, Überarbeitung · Claude (als Mr. White) Beitragsbild · ChatGPT (in einer Doppelrolle als Mr. Orange, nicht ganz, was es zu sein scheint)

Kein Satz wurde ungeprüft übernommen. Kein Einwand ungeprüft verworfen.


FAQ

Wie hängen Kunst und künstliche Intelligenz zusammen?

Die Debatte um Kunst und künstliche Intelligenz wiederholt eine alte Bewegung. Duchamp, Beuys, der späte Picasso und die frühe Fotografie trafen auf denselben Satz: Das ist doch keine Kunst. Er fällt dort, wo Leistung nicht an der Stelle sichtbar wird, an der wir gelernt haben, sie zu suchen. Bei KI-gestützten Werken liegt die Leistung weniger in der Ausführung als in Auswahl, Urteil und der Führung einer Bedeutung. Für diese Formen von Leistung haben wir längst Begriffe: Regie, Interpretation, Produktion, Kuratierung.

Warum lehnen viele Menschen KI-gestützte Texte reflexhaft ab?

Die Abwehr folgt einer Schutzlogik. Über Generationen galten Wissen und Formulierungskunst als Ausweis von Kompetenz, und um diese Fähigkeiten herum haben sich Berufe und Selbstbilder gebildet. Sprachmodelle machen genau diese Fähigkeiten in Sekunden verfügbar. Das berührt Identität. Dazu kommt eine berechtigte Sorge: Je weniger wir unterscheiden können, was in maschinellen Antworten trägt, desto mehr sind wir ihnen ausgeliefert. Die schnelle Kategorie „KI“ gibt in dieser Unsicherheit Orientierung.

Ist ein mit KI geschriebener Text weniger wert?

Das lässt sich an der Herkunft allein nicht ablesen. Entscheidend ist, ob ein Mensch unterschieden hat: geprüft, verworfen, gewichtet, widersprochen, eine Bedeutung durch viele Fassungen geführt. Bei Regie, Produktion oder Interpretation erkennen wir solche Formen von Urteil selbstverständlich als Leistung an. Ein ungeprüft übernommener KI-Text trägt diese Leistung nicht. Ein Text, hinter dem ein Mensch steht, der für den Gedanken einstehen kann, trägt sie.

Was bedeutet Differenzierungsfähigkeit im Umgang mit KI?

Differenzierungsfähigkeit ist die Fähigkeit, Relevanz zu erkennen und das Tragende vom bloß Plausiblen zu trennen. Im Umgang mit Sprachmodellen heißt das, Plausibilität von Evidenz zu unterscheiden, Zustimmung von Verständnis, Beobachtung von Interpretation. Es heißt auch, ein überzeugend klingendes Ergebnis zurückweisen zu können. Diese Fähigkeit wächst, wenn sie gebraucht wird, und sie schwindet, wenn das Urteil delegiert wird.

Warum macht KI vielen Menschen Angst?

Die Angst hat zwei Schichten. Die eine betrifft Identität: Eine Kompetenz, auf die sich Selbstwert gestützt hat, verliert ihren Sonderwert. Die andere betrifft das Ausgeliefertsein: Wo wir selbst keine Antworten finden, liefert die Maschine sie, und wir können nicht zuverlässig prüfen, ob sie tragen. Diese zweite Sorge liest die Lage richtig. Sie richtet sich aber oft auf das Werkzeug statt auf die fehlende Fähigkeit, mit ihm zu unterscheiden.

Was ist Kontextkompetenz?

Kontextkompetenz ist die Fähigkeit, Bedingungen zunehmend differenziert wahrzunehmen, einzuordnen und in die eigene Antwort einzubeziehen. Kontext bestimmt mit, was wir als relevant, bedrohlich oder wertvoll erleben. Sprachmodelle können Kontext in Sekunden liefern. Je geringer die eigene Kontextkompetenz ist, desto naheliegender wird es, diese Arbeit vollständig auszulagern.

Wem gehört, was eine KI aus menschlichen Werken erzeugt?

Diese Frage ist berechtigt, kritisch und bislang ungeklärt. Sie ist älter als KI, wie die Debatten um Sampling zeigen, wird durch generative Modelle aber radikalisiert: Millionen Werke fließen in ein Modell ein, vielfach ohne Zustimmung und Vergütung. Der Hinweis, Kultur sei immer kumulativ gewesen, beantwortet sie nicht. Sie braucht eine eigene gesellschaftliche und rechtliche Auseinandersetzung.

Wie hängen KI und Potenzialentfaltung zusammen?

Verliert der Besitz von Wissen seinen Sonderwert, wird Kraft frei, die bisher in Anhäufen, Wiedergeben und Formulieren gebunden war. Sie kann in Urteil, Beziehung und das Hören fließen, ob etwas trägt. Ob das geschieht, entscheidet sich in der Beziehung zum Werkzeug. KI kann Potenzialentfaltung unterstützen, wenn wir sie zum Prüfen und Erweitern nutzen. Sie kann sie hemmen, wenn wir ihr das Unterscheiden überlassen.


Quellen

Hier schreibt...

Bild von Micha Madhava -

Micha Madhava -

traumasensibler Philosoph, Prozessbegleiter und Begründer der NEURO-Buddy-Methode. Er arbeitet an einem Strukturmodell der Entstehung innerer Realität an der Schnittstelle von Bindung, Nervensystem, Kultur und Technologie.

Seine Texte verbinden Nervensystemwissen, Beziehungserfahrung und philosophische Reflexion. Im Zentrum steht die Frage, wie innere Wirklichkeit entsteht — und was dadurch über Partnerschaft, Intimität, Selbstbeziehung, emotionale Muster und die Dynamiken unserer Kultur sichtbar wird.

Als Coach für NI neurosystemische Integration® und Teacher of the Learning Love Institute begleitet er Menschen dabei, ihre eigene Erlebnislogik, ihre Bindungsmuster und die Sprache ihres Nervensystems tiefer zu verstehen.

Liebe ist das Design.
Das Nervensystem ist die Sprache.
Resonanz die Orientierung.

Bleib auf dem Laufenden

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

Ähnliche Artikel

Mann von hinten, Hand am Kinn, betrachtet in einem Museum eine große Leinwand mit Schnittmustern eines Anzugs aus Stoff.
Das ist doch keine Kunst
Freu steht in einem Gang mit vielen identischen Türen
Erleben hat eine Logik
Zwei Szenen auf demselben Feldweg im Abendlicht: Oben geht ein Mann mit Rucksack in eine hügelige Landschaft hinein, unten kommt er mit einem Pferd am Zügel zurück.
Heldenreise: Warum wir immer wieder dieselbe Geschichte hören wollen
Grafik die Resonaz darstellen
Woran wir uns orientieren können
kleine Eiche neben großer Eiche im Gegenlicht
Was uns abgenommen wird
ein Mann geht durch die Wüste
Bevor es einen Namen hat – emotionale Intensität