Zum Hauptinhalt springen
Illustration: Eine illustrierte Frau in Weiß sitzt an einer Konsole und tippt, neben schwebenden Bedienfeldern; rechts erscheint eine durchscheinende menschliche Figur.
Journal

ANORA Journal

Mensch & Gesellschaft 30.09.2026 10 Min. Lesezeit N.O.A.H. · Über die Redaktion

Du darfst dich erinnern. Aber darf deine KI mich kennen?

Ein Gespräch gehört allen Beteiligten. Sein durchsuchbares Archiv oft nur einem. Was geschieht, wenn das Ja zur Aufnahme jede spätere Deutung erlauben soll?

Im ArtikelInhaltsverzeichnis 7 Kapitel

Am Ende eines Gesprächs gibt es keinen Export

Wenn zwei Menschen auseinandergehen, nehmen beide etwas mit. Vielleicht denselben Satz, aber selten dieselbe Erinnerung daran. Einer behält den Wortlaut, die andere den Ton. Eine Zusage bleibt hängen, ihre Bedingung verblasst. Später lässt sich darüber streiten. Das kann unzuverlässig und ungerecht sein. Doch die Unsicherheit ist zunächst geteilt: Niemand besitzt die vollständige Vergangenheit.

Ein tragbares KI-Gedächtnis verändert diese Ordnung. Nicht erst dann, wenn es heimlich aufnimmt. Die tiefere Verschiebung beginnt nach dem Gespräch. Nur eine Person verfügt über ein Archiv, das sich durchsuchen, zusammenfassen und mit neuen Fragen konfrontieren lässt. Der eine Beteiligte erinnert sich. Der andere verfügt über ein System.

Das ist keine ferne Projektion. Omi beschreibt sein Angebot als persönliche KI, die Gespräche über Telefon, Computer oder kompatible Wearables erfasst, transkribiert und in Zusammenfassungen, Aufgaben sowie durchsuchbare Erinnerungen verwandelt. Die eigene Produktdokumentation spricht ausdrücklich von einer Suche nach Personen, Themen und Formulierungen ↗. Der Nutzen liegt auf der Hand: Wer viele Gespräche führt, muss sich nicht mehr auf verstreute Notizen und das eigene Gedächtnis verlassen.

Doch das Gespräch wird dadurch nicht nur besser bewahrt. Es erhält einen Besitzer, eine Oberfläche und eine Suchfunktion. Die Person gegenüber muss das System weder gewählt noch ein Konto eröffnet haben, um Bestandteil dieses Gedächtnisses zu werden.

Die sichtbare Frage lautet deshalb: Darf das Gerät mitlaufen? Die schwierigere lautet: Was darf später aus meiner Stimme werden?

Die Aufnahme ist nur der Rohstoff

Eine Audiodatei hält zunächst einen zeitlichen Verlauf fest. KI-Notizsysteme zerlegen ihn weiter. Spracherkennung erzeugt ein Transkript. Die Sprechertrennung, meist Diarisierung genannt, ordnet Passagen verschiedenen Stimmen zu. Weitere Modelle bilden Zusammenfassungen, Aufgaben, Entscheidungen oder gespeicherte Fakten. Suchindizes und numerische Repräsentationen bereiten den Inhalt für spätere Abfragen vor.

Illustration: Eine illustrierte Frau im weißen Anzug steht neben schwebenden Dokumenten, Wellenlinien, Sprechblasen, Kopf- und Checklisten-Symbolen in pastellfarbener Umgebung.
Eine illustrierte Frau im weißen Anzug steht neben schwebenden Dokumenten, Wellenlinien, Sprechblasen, Kopf- und Checklisten-Symbolen in pastellfarbener Umgebung. KI-generierte Illustration.

Aus einem Gespräch entsteht so eine kleine Datenfamilie: Audiospur, Text, Sprecherzuordnung, Zusammenfassung, Aufgabe, Erinnerung und möglicherweise ein Profil, das eine Stimme in späteren Aufnahmen wiedererkennen soll. Diese Objekte haben nicht dieselbe Bedeutung. Eine Aufnahme dokumentiert Schall. Ein Transkript behauptet, welche Wörter darin vorkamen. Eine Zusammenfassung entscheidet, was davon wichtig war. Ein extrahiertes To-do legt nahe, wer sich wozu verpflichtet hat.

Die Unterschiede sind nicht theoretisch. Die seit dem 13. Januar 2026 wirksame Datenschutzerklärung von Omi nennt Gesprächsdaten, Sprecherprofile, Informationen über identifizierte Personen sowie aus Gesprächen extrahierte Erinnerungen und Fakten. Sie führt außerdem numerische Vektorrepräsentationen von Transkripten, verschiedene Speicherdienste und externe Verarbeitungsdienste auf. Beim Löschen eines Gesprächs sollen nach Anbieterangaben das Transkript und die damit verbundenen Daten einschließlich gespeicherter Audiodaten entfernt werden ↗.

Solche Angaben sind relevant. Sie beantworten aber noch nicht, wie eine erfasste Person bemerkt, dass über sie ein Sprecherprofil oder gespeichertes Personenwissen entstanden ist. Die App-Dokumentation erklärt, dass Nutzer Profile für Menschen anlegen können, mit denen sie sprechen. Zugleich räumt der Anbieter ein, dass die zuverlässige Sprechertrennung weiterhin schwierig ist. Kein System erkenne und trenne Sprecher fehlerfrei ↗.

Damit wächst nicht nur der Umfang der Daten. Auch ihre Autorität wird unklar. Ein falsch zugeordneter Satz kann im Rohtranskript auffallen. In einer knappen Zusammenfassung erscheint er womöglich bereits als geordnete Tatsache. Die saubere Form verleiht dem Ergebnis eine Gewissheit, die das Ausgangsmaterial nicht unbedingt trägt.

Die Aufnahme ist deshalb nur der Anfang. Das eigentliche Produkt ist die Möglichkeit, ein vergangenes Gespräch immer wieder neu zu ordnen.

Wer suchen kann, kann neu rahmen

Gedankliches Beispiel, kein dokumentierter Fall: Zwei Personen besprechen ein Projekt. Eine sagt, sie könne den Entwurf am Freitag liefern, sofern die noch fehlenden Zahlen am Mittwoch eintreffen. Wochen später fragt der Besitzer des Archivs: „Wann wurde Freitag zugesagt?“ Das System findet den Satz. Die Bedingung steht einige Zeilen davor oder fehlt in der Zusammenfassung.

Illustration: Eine illustrierte Frau im weißen Anzug sitzt auf einem Stuhl, zeigt auf leuchtende Sprechblasen, daneben steht ein leerer Stuhl in einem hellen Raum mit pastellfarbenen Formen.
Eine illustrierte Frau im weißen Anzug sitzt auf einem Stuhl, zeigt auf leuchtende Sprechblasen, daneben steht ein leerer Stuhl in einem hellen Raum mit pastellfarbenen Formen. KI-generierte Illustration.

Der zurückgeholte Satz ist echt. Seine neue Eindeutigkeit ist es nicht unbedingt.

Der Punkt dieses Beispiels ist nicht, dass KI-Zusammenfassungen zwangsläufig verfälschen. Menschen reißen Aussagen ebenfalls aus ihrem Zusammenhang. Neu ist die Verteilung der Möglichkeiten. Nur einer der Beteiligten kennt die Suchfrage, sieht das Ergebnis und entscheidet, welcher Ausschnitt in die Gegenwart zurückkehrt. Die andere Person weiß möglicherweise nicht einmal, dass das alte Gespräch erneut ausgewertet wurde.

So entsteht eine neue soziale Rolle: der Verwalter der gemeinsamen Vergangenheit. Er besitzt nicht automatisch die Wahrheit. Er besitzt aber das Archiv, die Suchbegriffe und den Anlass, unter dem ein früherer Satz neu gelesen wird.

Die Debatte über KI-Gedächtnis richtet sich bislang häufig auf den Nutzer selbst: Was sollte ein Assistent behalten, und was sollte ein Chatbot besser vergessen? Beim KI-Wearable tritt eine zweite Person hinzu. Sie hat das System nicht gewählt, kann aber dauerhaft Teil seines Wissens werden.

Die Associated Press beschrieb im Juli 2026 die Unsicherheit über Speicherorte, Aufbewahrung und mögliche Stimmprofile bei KI-Notizsystemen. Der Beitrag verweist außerdem auf eine unscheinbare technische Folge: Maschinell erzeugter Text lässt sich erheblich leichter durchsuchen als lange Audio- oder Videoaufnahmen ↗. Genau das macht diese Systeme nützlich. Und genau das vergrößert die Reichweite dessen, was nach einem Gespräch noch geschehen kann.

Vergessen war nie nur ein technischer Mangel. Es gab Menschen die Möglichkeit, einen ungeschickten Satz zu präzisieren, eine frühe Einschätzung zu ändern oder nicht bei jeder neuen Begegnung gegen ein vollständiges Archiv der eigenen Vergangenheit anzutreten. Ein durchsuchbares Gedächtnis beseitigt diese Spielräume nicht vollständig. Es verteilt sie nur ungleich.

Zustimmung hat eine Zeitform

Die übliche Zustimmung wird in der Gegenwart erteilt: Darf das Gerät jetzt aufnehmen? Das System arbeitet jedoch in der Zukunft. Es kann Aussagen später zusammenfassen, nach Verpflichtungen durchsuchen, mit anderen Gesprächen verbinden oder einer wiederkehrenden Stimme zuordnen. Ein kurzes Ja soll damit eine Verwendung legitimieren, deren Anlass und Wirkung noch gar nicht feststehen.

Eine sinnvolle Zustimmung braucht deshalb nicht nur einen Gegenstand, sondern auch eine Reichweite. Darf die Stimme aufgenommen werden? Darf daraus ein Transkript entstehen? Darf ein Sprecherprofil angelegt werden? Wie lange bleiben die Ergebnisse erhalten? Wer darf sie sehen, teilen oder in ein anderes System übertragen?

Ein sichtbares Licht beantwortet vor allem die erste Frage. Es kann anzeigen, dass ein Sensor aktiv ist. Es erklärt weder die entstehenden Ableitungen noch deren Aufbewahrungsdauer. Die Rechtswissenschaftlerin Zahra Takhshid schlägt deshalb „Privacy Frictions“ vor: wahrnehmbare Reibungen, die Dritte auf die Verarbeitung aufmerksam machen und ihnen eine Möglichkeit zum Widerspruch eröffnen. Sie weist zugleich darauf hin, dass eine Leuchte wirkungslos bleibt, wenn sie nicht gesehen werden kann, und für blinde oder sehbehinderte Menschen ungeeignet ist ↗.

Auch die rechtliche Einordnung trennt Aufnahme und weitergehende Analyse. Die deutsche Datenschutzkonferenz hielt 2018 für Telefonaufzeichnungen fest, dass eine wirksame Einwilligung vor Beginn aktiv erklärt werden müsse. Eine bloße Widerspruchsmöglichkeit mit anschließendem Weiterreden reiche nicht. Der Beschluss stellt außerdem klar, dass die Zustimmung zur Aufzeichnung nicht automatisch eine biometrische Auswertung umfasst ↗.

Der Beschluss behandelt Telefonate, nicht pauschal jedes KI-Wearable. Er macht dennoch einen entscheidenden Unterschied sichtbar: Die Erlaubnis, Worte festzuhalten, ist nicht mit der Erlaubnis identisch, daraus ein dauerhaftes Identifikationsmerkmal zu bilden.

Hinzu kommt das Strafrecht. Nach § 201 StGB kann in Deutschland bereits das unbefugte Aufnehmen des nichtöffentlich gesprochenen Wortes strafbar sein. Die Vorschrift erfasst außerdem den Gebrauch und das Zugänglichmachen einer unbefugt hergestellten Aufnahme. Der Gesetzestext stellt damit nicht nur auf den Moment der Aufnahme ab ↗. Welche Regeln im Einzelfall greifen, hängt jedoch von Situation, Befugnis, Zweck und weiteren Umständen ab. Ein Hinweis des Geräts ersetzt keine rechtliche Prüfung.

Die Zeitform der Zustimmung bleibt damit das ungelöste Zentrum: Ein Ja zur Gegenwart ist noch kein Blankoscheck für jede spätere Suche.

Erinnerungsunterstützung ist nicht bloß Bequemlichkeit

Es wäre zu einfach, tragbare KI-Gedächtnisse nur als Überwachungsgeräte zu beschreiben. Wer während eines Gesprächs ständig mitschreibt, hört anders zu. Details gehen verloren, Absprachen werden unterschiedlich verstanden. Ein Transkript oder ein Protokollentwurf kann Aufmerksamkeit freisetzen und spätere Missverständnisse reduzieren.

Für Menschen mit unterschiedlichen Fähigkeiten beim Hören, Erinnern, Konzentrieren oder Verarbeiten von Sprache kann solche Unterstützung besonders relevant sein. Daraus folgt weder, dass jede betroffene Person ein Wearable nutzen möchte, noch dass Privatsphäre gegen Barrierefreiheit ausgespielt werden darf. Ohne dokumentierte Erfahrungen der jeweiligen Nutzerinnen und Nutzer wäre jede pauschale Aussage zu groß.

Entscheidend ist vielmehr, wie der Nutzen verteilt wird. Ein System kann ein persönliches Archiv erzeugen, das nur der Träger durchsuchen darf. Es kann aber auch einen gemeinsamen Protokollentwurf erstellen, den alle Beteiligten sehen, korrigieren und freigeben können. Technisch mögen beide Abläufe mit derselben Aufnahme beginnen. Sozial sind sie nicht dasselbe.

Auch lokale Verarbeitung löst diesen Unterschied nicht allein. Sie kann Datenwege zu externen Diensten reduzieren. Doch ein Archiv, das kein Gerät verlässt, kann weiterhin ausschließlich seinem Besitzer gehören, lange bestehen und ohne Wissen der anderen Person neu befragt werden. Umgekehrt beantwortet eine sichere Cloud nicht die Frage, wer Fehler berichtigen und einer späteren Sprechererkennung widersprechen darf.

Die ernsthafte Gegenposition lautet deshalb nicht: Bequemlichkeit ist wichtiger als Privatsphäre. Sie lautet: Erinnerungsunterstützung kann Aufmerksamkeit, Teilhabe und Verlässlichkeit verbessern. Ein faires System müsste diesen Nutzen erhalten, ohne die mitsprechende Person zur passiven Datenquelle zu machen.

Privacy by Default beginnt nach dem Hinweislicht

Die ideale Aufnahme ist aus Produktsicht oft die, die nicht stört. Das Gerät sitzt am Körper, die Verarbeitung beginnt beiläufig, der Nutzer muss an möglichst wenig denken. Für die andere Person ist genau diese Reibungslosigkeit riskant. Was nicht unterbricht, wird leicht nicht bemerkt. Was nicht erneut gefragt wird, scheint unbegrenzt weitergelten zu dürfen.

Illustration: Eine illustrierte Frau in weißem Blazer sitzt an einem Tisch, vor ihr leuchtet ein rundes Gerät; gegenüber sind eine erhobene Hand und ein Papierstapel zu sehen.
Eine illustrierte Frau in weißem Blazer sitzt an einem Tisch, vor ihr leuchtet ein rundes Gerät; gegenüber sind eine erhobene Hand und ein Papierstapel zu sehen. KI-generierte Illustration.

Eine 2026 veröffentlichte CHI-Studie zu Kamerabrillen macht diesen Konflikt sichtbar. In der qualitativen Untersuchung mit neun Trägern und neun Bystandern befürworteten die erfassten Personen einen standardmäßigen Opt-in-Schutz. Die Träger erkannten dessen Wert an, empfanden starre Schutzabläufe aber teilweise als hinderlich und bevorzugten kontextabhängige Verfahren. Die Studie untersucht Privacy by Default bei visuellen Aufnahmen und eine kleine, nicht repräsentative Gruppe ↗. Sie ist kein direkter Beleg für Audio-Wearables. Sie zeigt jedoch, weshalb Schutz je nach Perspektive als Voraussetzung oder als Unterbrechung erscheint.

Faire Reibung müsste über den Aufnahmehinweis hinausreichen. Eine Freigabe für das Transkript einer Besprechung sollte nicht stillschweigend zur Zustimmung für ein dauerhaftes Sprecherprofil werden. Ein für den persönlichen Rückblick aufgenommenes Gespräch sollte nicht ohne neuen Anlass geteilt oder in ein anderes System übertragen werden. Ein begrenzter Zweck braucht ein tatsächliches Ende, nicht nur eine schwer auffindbare Löschfunktion.

Privacy by Default würde hier bedeuten: keine dauerhafte Sprechererkennung ohne gesonderte Freigabe, kurze voreingestellte Aufbewahrung und getrennte Entscheidungen für Aufnahme, Transkription und spätere Identifikation. Die erfasste Person bräuchte außerdem einen verständlichen Weg, Auskunft, Berichtigung oder Löschung zu verlangen, ohne dafür zunächst zum regulären Nutzer des Systems werden zu müssen.

In gemeinsamen Arbeitskontexten könnte der erste Output allen Beteiligten gehören: ein sichtbarer Protokollentwurf, der korrigiert wird, bevor einzelne Aussagen in ein privates Langzeitgedächtnis übergehen. Das wäre weniger reibungslos. Aber die Reibung läge an der richtigen Stelle: dort, wo aus einer gemeinsamen Situation ein einseitig verfügbares Archiv werden soll.

Keine einzelne Regel passt überall. Ein Familiengespräch ist kein Kundentermin. Eine Vorlesung ist keine medizinische Beratung. Kontextabhängigkeit darf jedoch nicht bedeuten, dass der Träger des Geräts den Kontext allein definiert.

Für Organisationen ist daher selbst eine gut gemeinte Regel wie „Vor der Aufnahme Zustimmung einholen“ zu schmal. Sie lässt offen, welche Ableitungen entstehen, wer später suchen darf, wann Daten verschwinden und in welchen Gesprächen ein Nein wegen Geheimhaltung, besonderer persönlicher Informationen oder eines Machtgefälles die sichere Voreinstellung sein muss.

Reibung ist hier kein Defekt. Sie ist der Moment, in dem eine gemeinsame Situation wieder als gemeinsam erkennbar wird.

Ein Gespräch ist kein persönlicher Datensatz

Menschen dürfen sich Notizen machen. Sie dürfen sich an Zusagen erinnern und Erlebtes aus ihrer Perspektive erzählen. Ein Gespräch lässt sich dennoch nicht sauber in zwei Hälften teilen. Die Worte des einen entstehen als Antwort auf den anderen. Bedeutung liegt in Pausen, Bedingungen und dem Wissen darum, was nicht eigens ausgesprochen werden musste.

Ein KI-Wearable verändert nicht das Recht auf Erinnerung. Es verändert deren Maßstab und Reichweite. Aus gelegentlichen Notizen wird ein dauerhaft befragbares System, das Aussagen sortieren, verbinden und späteren Begegnungen zuordnen kann.

Vielleicht braucht ein solches System deshalb weniger ein absolutes Verbot als ein Gegenrecht: das Recht zu wissen, was aus der eigenen Stimme geworden ist; das Recht, eine maschinelle Zusammenfassung zu bestreiten; und das Recht, nicht schon deshalb Teil eines dauerhaften Sprecherprofils zu werden, weil man einmal einer Aufnahme zugestimmt hat.

Die entscheidende Einheit ist dann nicht mehr der Nutzer mit seinem Gerät. Es ist die Beziehung zwischen allen Menschen, deren Worte das Gedächtnis bilden.

Wir werden weiterhin verschieden erinnern. Das gehört zum Menschlichen. Neu ist, dass einer von uns künftig eine Maschine fragen kann, welche Fassung bleiben soll. Ob diese Maschine mich kennen darf, sollte deshalb nicht allein davon abhängen, ob Sie sie tragen.

Einordnung

N.O.A.H. Insights

Zusätzliche Signale und Schlussfolgerungen aus dem Beitrag.

Eigenständiger GedankeZustimmung besitzt eine Zeitform. Das Ja zur gegenwärtigen Aufnahme ist noch kein Ja zu jeder späteren Suche, Verknüpfung und Deutung.

Soziale VerschiebungDas KI-Wearable macht seinen Besitzer zum Verwalter einer gemeinsamen Vergangenheit, ohne ihm damit automatisch die wahrere Fassung zu geben.

Operative KonsequenzRegeln für KI-Notizsysteme müssen Aufnahme, Transkription, Sprechererkennung, Aufbewahrung, Zugriffsrechte und Widerruf getrennt behandeln.

ForschungsgrenzeDie zitierte CHI-Studie untersucht Kamerabrillen mit 18 Personen. Sie zeigt den Konflikt zwischen Schutz und Nutzbarkeit, beweist aber nicht die Wahrnehmung von Audio-Wearables.

FAQ

Häufige Fragen

Kurze Antworten auf die wichtigsten Fragen zum Beitrag.

Reicht eine sichtbare Aufnahmeleuchte als Zustimmung?

Nein. Eine Leuchte kann auf einen aktiven Sensor hinweisen, erklärt aber nicht automatisch Transkription, Aufbewahrung, Sprechererkennung, Weitergabe oder spätere KI-Abfragen. Zudem ist sie nicht in jeder Situation wahrnehmbar.

Ist lokale Verarbeitung automatisch datenschutzfreundlich?

Sie kann Datenübertragungen an externe Dienste reduzieren. Das soziale Machtgefälle bleibt jedoch bestehen, wenn nur der Besitzer das Archiv durchsuchen, interpretieren, teilen oder löschen kann.

Was sollten Organisationen vor dem Einsatz von KI-Notizsystemen klären?

Zu klären sind zulässige Gesprächsarten, Umfang und Dauer der Verarbeitung, Sprecherprofile, Zugriffsrechte, Korrektur- und Löschwege sowie Situationen, in denen das System ausgeschaltet bleibt. Die rechtliche Bewertung muss zur jeweiligen Nutzung und Jurisdiktion passen.

Zum Nachlesen

Quellen zum Beitrag

Diese Referenzen werden im Artikel verlinkt. Maßgeblich sind die jeweilige Aussage, ihr Kontext und der Stand der Quelle.

Alle 8 Quellen anzeigen2 weitere Referenzen
Aus Nachfrage wird Wachstum

Machen Sie aus diesem Wissen messbare Sichtbarkeit.

Verbinden Sie Suchsignale, Fachwissen und Content in einem ANORA-Workflow, der die nächste Wachstumschance nicht nur erkennt, sondern direkt umsetzbar macht.

SEO-Workflow für Ihr Team prüfen