Technologie & KIEinblickeÜber unsKarriere Gespräch buchen

Blog-Artikel

Können Sie belegen, welche Inhalte Ihres Unternehmens KI-geschrieben sind? Warum KI-Textwasserzeichen nicht reichen

Könnte Ihr Unternehmen sagen, welche Inhalte mit KI entstanden sind? OpenAI setzt in der EU Wasserzeichen in ChatGPT-Texte, doch die Markierung ist anfällig. Warum Nachweise zählen und was zu tun ist.

Autor

Incresco

Incresco

AI & Product Strategy Team

Stellen Sie sich vor, ein Kunde, ein Prüfer oder eine Aufsichtsbehörde stellt eine einfache Frage: Welche Ihrer Inhalte wurden mit KI geschrieben? Wenn Ihre ehrliche Antwort „Wir wissen es nicht” lautet, haben Sie ein Problem, das sich heute leicht vermeiden und später kaum beheben lässt. Dieser Beitrag erklärt anhand der Nachrichten dieser Woche, warum, und zwar verständlich für Führungskräfte, die noch nie von Text-Herkunftsnachweisen gehört haben.


Das Risiko, es nicht zu wissen

KI-Tools schreiben heute in den meisten Unternehmen E-Mails, Angebote, Berichte, Webseiten und Support-Antworten, oft ohne dass es jemand festhält. Das ist unproblematisch, bis jemand eine Antwort braucht. Dieser Teil ist unsere Einschätzung, und Ihre Rechtsabteilung sollte die eigenen Pflichten prüfen:


  • Sie können eine Grundfrage womöglich nicht beantworten. Welche Dokumente wurden mit KI entworfen oder bearbeitet, mit welchem Tool, und wer hat sie geprüft? Wenn das bei der Arbeit niemand festgehalten hat, gibt es später nichts nachzuschlagen.
  • Sie können es nachträglich nicht rekonstruieren. Wie der nächste Abschnitt zeigt, sind Erkennungstools schwach. „Wir prüfen das später” ist also kein Plan.
  • Neue Regeln kommen. Die EU-KI-Verordnung enthält inzwischen Transparenzregeln für KI-generierte Inhalte, und KI-Anbieter beginnen deshalb, ihre Ausgaben zu markieren. Kunden und Partner in der EU werden voraussichtlich mehr Fragen dazu stellen, wie Sie KI einsetzen.

Warum Erkennung Sie nicht rettet

Die naheliegende Lösung wäre, Ihre Inhalte auf KI zu scannen. OpenAIs eigene Zahlen zeigen, warum das nur schlecht funktioniert. Das sind Tests des Anbieters, keine unabhängigen:


  • Kürzere oder stärker eingeschränkte Texte sind schwieriger. Bei einer Ziel-Falsch-Positiv-Rate von 1 % fand OpenAIs Detektor das Wasserzeichen in rund 80 % der Passagen mit 200 Token und in rund 95 % der Passagen mit 400 Token, bei Inhalten wie Psychologie. Laut OpenAI lagen die Erkennungsraten bei Inhalten wie Mathematik, wo die Wortwahl weniger Spielraum lässt, deutlich niedriger.
  • Bearbeitung kann das Wasserzeichen schwächen. In OpenAIs Auswertung englischer Passagen mit 400 Token sank die Erkennung von etwa 92 % auf 66 %, wenn 10 % der Wörter durch Synonyme ersetzt wurden. Bei 25 % der Wörter sank sie auf 17 %.
  • Umschreiben und Übersetzen verschlechtern es. Laut OpenAI-Hilfecenter können umfassendes Umschreiben, Paraphrasieren oder Übersetzen die Erkennung unzuverlässiger machen, und auch unveränderter Wortlaut garantiert kein erkennbares Wasserzeichen.
  • Kein Zeichen beweist nichts. OpenAI sagt, dass ein fehlendes Wasserzeichen nicht beweist, dass ein Mensch den Text geschrieben hat, und ein gefundenes zeigt nicht, wie viel menschliches Urteil darin steckt.
  • Der Detektor ist nicht öffentlich. OpenAI nimmt Anträge auf Zugang an, der zunächst auf zugelassene Forschende und Fachorganisationen beschränkt ist. Starke Leistung unter Idealbedingungen garantiert laut OpenAI „keine zuverlässige Erkennung im Alltag”.

Der praktische Punkt: Einen Nachweis, den Sie bei der Arbeit nicht festgehalten haben, kann ein Tool später nicht wiederherstellen.


Was hat OpenAI angekündigt?

Die Fakten in diesem Abschnitt stammen aus OpenAIs Ankündigung vom 5. Oktober und dem zugehörigen Hilfeartikel sowie aus Berichten von TechCrunch und Search Engine Journal.


OpenAI sagt, die EU-KI-Verordnung verlange von Anbietern generativer KI, erzeugten Text maschinenlesbar erkennbar zu machen, und nennt Text-Wasserzeichen und -Erkennung „frühe Technologien mit erheblichen Einschränkungen”. Das schrittweise Vorgehen hat drei Teile: API-Kunden weltweit können Text-Wasserzeichen ab dem 5. Oktober für ausgewählte Modelle aktivieren (standardmäßig aus); in den kommenden Wochen kommt bei berechtigten ChatGPT- und Codex-Texten in der EU ein unsichtbares Wasserzeichen hinzu; und OpenAI nimmt Anträge auf Zugang zu seinem Text-Detektor an. Das Verfahren, das OpenAI textGrain nennt, fügt der Wortwahl des Modells ein unsichtbares statistisches Signal hinzu, nach dem ein Detektor sucht. Da das Signal in den Wörtern selbst steckt, bleibt es laut TechCrunch beim Kopieren und Einfügen erhalten. OpenAI plant, die Technologie als Open Source bereitzustellen, und will den technischen Bericht in den kommenden Wochen ergänzen.


OpenAI sagt, dass Text-Wasserzeichen zum Start kein globaler Standard werden. Laut OpenAI-Hilfecenter wählen API-Kunden selbst, welche Modelle das Wasserzeichen erhalten, und die Abdeckung wird in den kommenden Wochen auf ältere Modelle ausgeweitet. Search Engine Journal weist darauf hin, dass die Ankündigung nicht nennt, ob EU-Nutzer von ChatGPT das Wasserzeichen abschalten können. Das gilt nur für Text: Die Prüfwerkzeuge für Bilder und Audio, darunter openai.com/verify und die Content Provenance API, bleiben laut OpenAI öffentlich zugänglich. OpenAI arbeitet außerdem mit Cloud-Partnern daran, Wasserzeichen in berechtigte Ausgaben einzubetten; die Verfügbarkeit kann je nach Partner variieren.


TechCrunch berichtet, dass die Transparenzregeln der EU-KI-Verordnung am 2. August in Kraft traten und verlangen, KI-generierte Inhalte so zu kennzeichnen, dass andere Systeme sie erkennen. Search Engine Journal ergänzt, dass Systeme, die vor diesem Datum auf den Markt kamen, bis zum 2. Dezember Zeit haben, die Pflicht zur Kennzeichnung und Erkennung zu erfüllen, und dass Anthropic Claude-Texte weltweit markiert. Da das ChatGPT-Wasserzeichen nur in der EU gilt, kann derselbe Prompt in Berlin markierten und in Toronto unmarkierten Text liefern.


Was sollte Ihr Unternehmen ändern?

Dieser Abschnitt ist unsere Empfehlung, nicht die von OpenAI. Ziel ist, nachzuweisen, was Ihre eigenen Systeme getan haben, statt es nachträglich erkennen zu wollen:


  1. Führen Sie Herkunftsnachweise. Halten Sie bei wichtigen Dokumenten fest, welches KI-Tool und welches Modell den Text erstellt oder bearbeitet hat, wann und wer ihn geprüft hat.
  2. Passen Sie Ihre Inhalts-Workflows an. Ergänzen Sie für KI-gestützte Texte einen Prüf- und Freigabeschritt und dokumentieren Sie ihn dort, wo Ihr Team ohnehin arbeitet.
  3. Aktualisieren Sie Ihre KI-Richtlinie. Legen Sie fest, welche Tools Mitarbeitende für welche Inhalte nutzen dürfen und wer für das Ergebnis verantwortlich ist.
  4. Fragen Sie Ihre KI-Anbieter. Wie kennzeichnen sie ihre Ausgaben? Ist das standardmäßig aktiv? Unterscheidet es sich nach Region? Was können Sie mit der Markierung tun, und was nicht?
  5. Planen Sie EU- und Nicht-EU-Geltung ein. Mitarbeitende in der EU erzeugen womöglich markierten Text, Kollegen anderswo nicht, auch im selben Tarif. Gehen Sie nicht davon aus, dass die Markierung vorhanden oder nicht vorhanden ist.
  6. Nutzen Sie Erkennung nicht als Beweis. Vermeiden Sie Klauseln oder Regeln, die ein Wasserzeichen-Ergebnis als Autorenbeweis behandeln.
  7. Behalten Sie sichtbare Hinweise bei. Laut OpenAI ersetzen Wasserzeichen keine sichtbaren Kennzeichnungen oder andere Hinweise, die erforderlich sein können; Ihre Rechtsabteilung sollte die eigenen Pflichten prüfen.

So unterstützt Incresco

Incresco steht für digitale Transformation mit KI. Die Lücke zwischen einer neuen Regel und dem, was die Technik belegen kann, ist genau dort, wo wir mit Unternehmen arbeiten. Unsere KI-Transformation deckt die genannten Änderungen ab:


  • KI-Strategie und Beratung: eine Bestandsaufnahme, wo in Ihrem Unternehmen KI-Texte entstehen, eine KI-Richtlinie und eine Roadmap, die Regeln wie die EU-KI-Verordnung berücksichtigt.
  • Individuelle KI-Entwicklung: KI-Agenten, Copilots und Workflow-Automatisierung mit eingebauter Protokollierung, damit Herkunftsnachweise entstehen, während die Arbeit läuft.
  • KI-Integration: Anbindung dieser Nachweise an Ihre bestehenden Systeme durch Workflow-Automatisierung, API-Integration und Modernisierung von Altsystemen.

Wenn Sie auf die Frage „Welche unserer Inhalte sind KI-geschrieben?” mit einem Nachweis statt einer Vermutung antworten wollen, sprechen Sie mit unserem Team.

Bereit, das Experimentieren zu beenden und
in den produktiven Betrieb zu starten?