Heft 929, Oktober 2026

Datenpunkte

von Dirk Baecker

Medien

Wir sind seit Marshall McLuhan seltsamen Dingen auf der Spur. Diese bestimmen, so formuliert McLuhan 1964 in seinem Buch Understanding Media, den Maßstab, das Tempo und das Schema, die die Situation des Menschen kennzeichnen. Diese seltsamen Dinge sind Medien. Fritz Heider hat sie schon 1926 von Dingen im eigentlichen Wortsinn unterschieden. Medien sind lose gekoppelte Elemente, in die letztere als feste Kopplungen eingeprägt werden, so wie ein Fußabdruck im Sand, ein Anblick im Licht, ein Gedanke in einem Text, eine Zahlung im Medium des Geldes, eine Kommunikation im Medium des Sinns. Jedes Mal ist das, was es ist, nur das, was es ist, weil im selben Medium auch andere Formen möglich sind, ein anderer Abdruck, ein anderer Anblick, ein anderer Gedanke, eine andere Zahlung, eine andere Kommunikation. Der Blick auf Medien medialisiert die Welt zu ihrem Raum alternativer Möglichkeiten.

McLuhan hatte vor allem das Fernsehen vor Augen, das die Totenglocke der Gutenberg-Galaxis geläutet hat. So wie er das Fernsehen mit dem Buchdruck verglich, entdeckte seine Schule zusätzlich die Rolle der Schrift und wurde der Begriff auf die Wahrnehmungsmedien der Optik, Akustik, Olfaktorik und Taktilität und auf Erfolgsmedien der Kommunikation wie Macht, Liebe, Recht, Wahrheit, Glaube, Geld erweitert. Wenn wir heute von elektronischen und digitalen Medien sprechen, sollte dieser Vergleich mit anderen Medien mitlaufen.

Was also hat es mit elektronischen Medien auf sich, wenn wir noch kaum gelernt haben, die Sprache, das Blatt Papier, die Liebe und die Macht als Medien zu begreifen? Mit einem Begriff, den wir diesen elektronischen Medien verdanken, können wir sagen: Es geht immer nur um Datenpunkte. Die Sprache ist ein Datenpunkt, indem sie auf das Wort setzt und nicht auf den Blick oder das Schweigen. Sie setzt aber auch einen Datenpunkt nach dem nächsten, indem sie Wörter, Sätze, Texte in die Welt setzt, an die weitere Wörter, Sätze und Texte anschließen. Ein Datenpunkt macht einen Unterschied, an den weitere Operationen anschließen. Das Blatt Papier ist selbst ein Datenpunkt, indem man darauf festhalten kann, was andernfalls schwer zu fixieren wäre. Es trägt aber auch lauter Datenpunkte, indem es Worte mit Worten, Gedanken mit Gedanken, Formeln mit Formeln, Bilder mit Bildern verknüpft – und natürlich multimedial das eine mit dem anderen. Eine Liebeserklärung ist ein Datenpunkt, der einen Unterschied macht, je nachdem, ob sie erfolgt oder nicht. Sie enthält jedoch auch weitere Datenpunkte, indem sie in diesem oder in jenem Tonfall, zu diesem oder einem anderen Zeitpunkt erfolgen kann. Und natürlich ist die Macht ein Datenpunkt, indem man mit ihr erreichen kann, was sich anders nicht erreichen lässt, oder ganz im Gegenteil mit ihr unerreichbar wird, was sich andernfalls hätte erreichen lassen. Und sie ist selbst voller Datenpunkte, indem sie Ressourcen, Kontexte, Assoziationen ins Spiel bringt, die ihre Drohungen entweder glaubwürdig machen oder nicht.

Die Welt ist eine Welt der Datenpunkte. Jedes Erleben und jedes Handeln setzt an einem Datenpunkt an. Und jeder Datenpunkt ist nicht nur ein neutrales Relais, das andere Daten passieren lässt oder nicht, sondern eine Sanktion, die bewertet, bestraft und belohnt und nur so ihre Rolle spielen kann. Insofern liefern elektronische Medien nichts Neues unter der Sonne. Der Telegraf, das erste elektronische Medium, setzt den Datenpunkt einer schnellen Erreichbarkeit jedes angeschlossenen Orts auf der Erde durch Nachrichten von einem anderen Ort und ermöglicht weitere Datenpunkte je nach Zeitpunkt, Adresse und Inhalt der Nachricht. Der Film setzt den Datenpunkt der Übertragung von Wirklichkeit durch die Kommunikation bewegter Bilder und weitere Datenpunkte durch den Inhalt, das Drama, die Emotion dieser Bilder. Das Fernsehen setzt den Datenpunkt eines globalen Dorfes, in dem, je nach Verfügung von Kamera und Perspektive, jeder jedem dabei zuschauen kann, was er treibt und unterlässt.

McLuhan hat die Instantaneität der Übertragung von Kommunikation als den revolutionären, katastrophalen Bruch im Mediengeschehen der Gesellschaft durch elektronische Medien beschrieben. Dieser Bruch unterscheidet die orale, alphabetische und literale Gesellschaft der Vergangenheit von der Gesellschaft unserer Gegenwart. Peter Drucker hat sie die »nächste Gesellschaft« getauft, nicht nur, weil sie als nächste kommt, sondern auch, weil sie so unerbittlich wie keine Gesellschaft zuvor in jedem Moment danach fragt, was als Nächstes kommt. In der Tat geht jede Beruhigung, Entspannung und Reflexion verloren, die nur durch räumliche und zeitliche Distanz gewonnen werden kann. Das heißt nicht, dass sich Raum und Zeit auflösen, wie einige vermuten, aber es heißt, dass sie eine neue Gestalt annehmen, sich reformatieren. Die Formulierung ändert nichts am Drama, macht es aber beschreibbar. Der Raum wird multidimensional, verknüpft jenseits jeder euklidischen Übersichtlichkeit und im wilden Wechsel zwischen den Perspektiven Punkte, die keiner bekannten Ordnung genügen. Und die Zeit verwandelt sich in eine ungeduldige Gegenwart, für die Vergangenheit und Zukunft als illusionäre Horizonte eine Rolle spielen, die keinen Halt verspricht.

Was also ist der Datenpunkt, den der Computer, das Internet und die Künstliche Intelligenz setzen; und welche Datenpunkte machen sie möglich, die im Buchdruck, in der Schrift und in der Sprache zunächst nichts Vergleichbares haben? Diese Datenpunkte sind kein Abstraktum. An ihnen setzen konkrete Operationen an, Sanktionen, die andernfalls nicht möglich wären. Jedes Textverarbeitungsprogramm auf einem Computer, jedes Videospiel, jeder Eintrag in einer Datenbank, jeder Post auf einer Plattform, jeder Abruf einer App, jede Berechnung durch einen Algorithmus setzen das voraus. Diese Medien haben alle ein doppeltes Gesicht. Sie verändern die Wirklichkeit, indem sie Möglichkeiten schaffen, die es vorher nicht gab; und sie schaffen eine neue Wirklichkeit, indem sie diesen Möglichkeiten ihren Raum und ihre Zeit geben.

Diese Datenpunkte werden in einer analogen Umwelt gesetzt, von der sie zunächst nichts wissen. Teile dieser analogen Umwelt sind mitgedacht, insofern nichts läuft ohne ein theoretisches Minimum, aber praktisches Maximum an Hardware, elektrischem Strom, Eingaben in Programmen und Datenbanken, Posts auf Plattformen, sensorischen Daten, Trainingseinheiten der Modelle. Und weitere Teile dieser Umwelt treten überraschend auf, weil Nutzer sich verweigern, Programme nicht genutzt oder umgangen werden, Posts eine Eigendynamik gewinnen, sensorische Daten unzureichend sind und jedes Training eine Schlagseite aufweist, die sich in der Regel zu spät offenbart. So oder so ist das Digitale nicht ohne das Analoge zu denken. Und dieses Analoge ist nicht nur Infrastruktur, unternehmerisches Geschäftsmodell, politische Deregulierung und ein soziales Umfeld, das sich beglücken lässt, sondern auch Widerstand, Verweigerung und Ignoranz.

Wie Wasser

Was kann man unter diesen Umständen über die Datenpunkte der jüngeren elektronischen Medien sagen? Douglas R. Hofstadter hat dazu vor bereits dreißig Jahren ein interessantes Bild ins Spiel gebracht. Er vergleicht »algorithmische Dinge« (Frieder Nake), also Dinge, die eine rechnerische Unterfläche und eine interpretative Oberfläche haben, mit Wassermolekülen, denn auch H2O-Moleküle sind fluide und stochastische Cluster, die sich bilden und wieder zerfallen, sich mit anderen verknüpfen und sich wieder trennen. Diese Fluidität und Stochastik, das wäre Hofstadters Anregung, gilt es zu verstehen. Denn sie ist einerseits durch und durch medial, indem alle möglichen Kombinationen möglich sind, und lässt sich andererseits programmatisch und algorithmisch bezwingen, wenn auch mit unerwarteten Konsequenzen.

Sybille Krämer spricht von »strukturierten Punktmengen« als Grundlage der Algorithmen maschinellen Lernens. Doch diese strukturierten Punktmengen, das wäre die Pointe, halten nicht still, sondern sind laufend in Bewegung. Sie definieren keinen automatischen Zusammenhang, in dem ein Input verlässlich und insofern trivial in einen Output umgerechnet wird, sondern eine lebendige Maschine, die nichttrivial laufend ihre Zustände wechselt. Die Algorithmen der großen Sprach- und demnächst wohl auch Weltmodelle arbeiten stochastisch mit einer stochastischen Umwelt. Sie nehmen die Kontingenz der Welt wörtlich und setzen sie um in eigene Kontingenz. Das ist neu und hat schon so manchen dazu verführt, ihnen ein eigenes Denken, wenn nicht sogar ein eigenes Bewusstsein zu unterstellen. Doch das wäre eine romantisierende Übertreibung, weil sich in diesen Modellen nur, wenn auch höchst raffiniert, Zufälle an Zufällen reiben, ohne irgendeinen Blick dafür, was das mit einer Welt zu tun hat, in der diese Reibung einen situativ bestimmten Ort hat.

Wir müssen uns deswegen noch etwas genauer anschauen, was in diesen Modellen passiert. Leonardo Impett und Fabian Offert schlagen dafür den Begriff der »Vektormedien« vor. Vektormedien arbeiten im Spannungsfeld von Kompression, Einbettung und Ausgabe. Sie zerlegen Text-, Bild- und Audiodaten in multidimensionale Vektorräume, in denen jeder Vektor die Bestimmung eines Datenpunkts durch seine Verknüpfung mit anderen Datenpunkten ermöglicht und diese Bestimmung wiederum abhängig ist von der Gewichtung dieser Vektoren und ihrer Auswahl. Brutale Methoden wie das Wegschneiden eines Teils des Vektorraums (»Drop-Out«) zeigen, dass sich dadurch am Prinzip nichts ändert, weil sich die Datenpunkte neue Vektoren suchen. Vektormedien sind sowohl das Medium des Vektorraums, in dem die Vektoren bestimmbar werden, als auch die Form jedes einzelnen Vektors, die sich in diesem Medium erhält.

Die begriffliche Unschärfe an dieser Stelle ließe sich durch eine Referenz auf Heiders Medienbegriff beheben. Man denke auch an einen Begriff wie den des »Mediumdesigns« von Keller Easterling, der genauer zu erfassen erlaubt, wie sich die Dispositionen von Daten im Wechselspiel von Medium und Form variieren lassen. Denn er macht deutlich, dass Designleistungen sich nicht darauf beschränken, die Formen oder Dinge zu variieren, sondern auch das Medium selbst, etwa durch die Auswahl und das Training der Modelle, jeweils unterschiedlich gestalten. Vektoren wären in diesem Sinne als Formen im Medium des Vektorraums zu verstehen, die allerdings ihrerseits zum Medium der Formulierung neuer Vektoren werden. Die alten Träume einer Typentheorie à la Bertrand Russell und Alfred North Whitehead, die Operator und Operation zu unterscheiden versucht, brechen spätestens an dieser Stelle zusammen und machen dem Horrorszenario einer selbstreferenziellen Organisation des Vektorraums Platz.

Genau darum geht es Impett und Offert. Ihre beiden zentralen Begriffe sind »Kompression« und »Einbettung«. Kompression, das wissen wir seit Formaten wie ZIP, MP3, MP4, JPEG oder MOV, reduzieren die zur Konstruktion eines Texts, eines Bilds, eines Films oder einer Audiodatei erforderliche Datenmenge auf eine redundanzfreie Menge. Dafür gibt es verlustlose (»lossless«) und verlusthafte (»lossy«) Methoden. Die Methoden der großen Sprachmodelle sind verlusthaft. Sie »reduzieren Komplexität«, wie es sich Luhmann für seine Systeme nicht besser vorstellen konnte. Das aber heißt, sie greifen nicht nur zu, sondern ein. Sie schaffen sich den für ihre Berechnungen erforderlichen Datenraum und können nur hoffen, dass durch Dekompression ein Text, ein Bild oder eine Audiodatei wiedergewonnen werden kann, die mit dem Original eine gewisse Ähnlichkeit aufweisen. Unser oftmals flüchtiger Blick auf meist »arme Bilder« (Hito Steyerl) springt dieser Dynamik bei. Je ungenauer wir hinschauen und hinhören, desto besser funktioniert es.

Die analoge Dimension kommt jedoch, das ist eine der Pointen des Buchs von Impett und Offert, sofort wieder ins Spiel, weil die Vektoren der Datenpunkte nicht maschinell eindeutig bestimmt und festgehalten, sondern in den Raum weiterer Vektoren und Datenpunkte »eingebettet« werden. Diese Einbettung (»embedding«) überführt sie von ihrer substanziellen Bestimmtheit, wenn sie denn je eine hatten, in ihre relationale, funktionale und differenzielle Bestimmbarkeit. Erst jetzt stehen die Datenpunkte untereinander in Beziehungen, die in diesem multidimensionalen Raum durch ihre Entfernung, das heißt durch geringere und größere Nähe zueinander, gemessen werden. Sie werden zu Tokens und zu Tokens auf Tokens. Es ist schwer, sich davon ein Bild zu machen.

Weitere Artikel des Autors