WAVZ® KI-Briefing

ChatGPT bekommt in der EU ein Wasserzeichen, Googles Agenten fragen direkt die Datenbank

Texte aus ChatGPT tragen in der EU bald ein unsichtbares Wasserzeichen. OpenAI hat am 5. Oktober angekündigt, die Technik in den kommenden Wochen für ChatGPT und das Programmierwerkzeug Codex in allen Tarifen einzuschalten. Der Konzern begründet das mit der KI

KI & Mittelstand

Texte aus ChatGPT tragen in der EU bald ein unsichtbares Wasserzeichen. OpenAI hat am 5. Oktober angekündigt, die Technik in den kommenden Wochen für ChatGPT und das Programmierwerkzeug Codex in allen Tarifen einzuschalten. Der Konzern begründet das mit der KI-Verordnung der EU (AI Act). Seit dem 2. August müssen Anbieter dafür sorgen, dass KI-erzeugte Inhalte maschinell als solche erkennbar sind. Außerhalb der EU bleibt die Funktion abgeschaltet, Kunden der Programmierschnittstelle (API) können sie weltweit selbst aktivieren. Anthropic kennzeichnet Claude-Texte laut TechCrunch schon seit zwei Monaten, und zwar weltweit. Das Verfahren heißt textGrain und kommt ohne versteckte Zeichen aus. Ein Sprachmodell wählt jedes nächste Wort mit einer Portion Zufall aus mehreren Kandidaten. textGrain lenkt diesen Zufall mit einem geheimen Schlüssel, sodass im Text ein statistisches Muster entsteht, das ein Prüfprogramm mit demselben Schlüssel wiederfindet. Angaben zu Nutzer:in, Unternehmen oder Prompt stecken laut OpenAI nicht darin. Für Ausgaben unter 200 Token, das sind etwa 150 englische Wörter, verlangt der EU-Verhaltenskodex kein Wasserzeichen. Als Beweismittel taugt das Muster nur bedingt. Wer zehn Prozent der Wörter durch Synonyme ersetzt, drückt die Erkennungsrate in OpenAIs eigenen Tests von rund 92 auf 66 Prozent. Zwischen den EU-Amtssprachen schwankt sie von 69 Prozent im Spanischen bis 42,2 Prozent im Rumänischen, jeweils bei einem Prozent Fehlalarmen. Das Prüfprogramm bekommen vorerst nur zugelassene Forschungseinrichtungen. Ich rechne trotzdem damit, dass Auftraggeber und Vergabestellen früher oder später prüfen lassen. Wer Angebote oder Fachartikel mit ChatGPT schreibt, legt das im Zweifel besser selbst offen, bevor es ein Detektor tut.

Agentenbuilding

Google lässt seine Unternehmens-Agenten jetzt direkt in der Datenbank nachschlagen. Gemini Enterprise ist die Plattform, auf der Beschäftigte in normaler Sprache Fragen an Firmendaten stellen und Agenten Aufgaben erledigen lassen. Im herkömmlichen Modus kopiert die Plattform die Daten dafür in einen eigenen Speicher. Seit dem 2. Oktober gibt es als Vorschau einen zweiten Weg, die föderierte Abfrage (federated query mode). Der Agent fragt die Daten an ihrem Ursprungsort ab, eine Kopie entsteht dabei nicht. Unterstützt werden Googles Datenbankdienste AlloyDB, BigQuery, Cloud SQL und Spanner. Technisch läuft das über das Model Context Protocol (MCP), einen offenen Standard, über den KI-Modelle Werkzeuge und Datenquellen ansprechen. Wichtiger finde ich, dass jede Abfrage mit den Zugangsdaten der Person läuft, die gerade fragt. Der Agent sieht also, was diese Person auch ohne KI sehen dürfte. Ein Sammelkonto, das alles lesen darf, ist die bequemere Bauweise und in jeder Datenschutzprüfung die erste Schwachstelle. Die Kehrseite steht in Googles Dokumentation. Der Zugriff lässt sich nicht auf einzelne Tabellen eingrenzen, und bei komplexen Datenbankstrukturen kann die Treffsicherheit der Abfragen schwanken. Wer Berechtigungen über Jahre großzügig vergeben hat, bekommt mit dem Agenten ein Werkzeug, das diese Großzügigkeit sichtbar macht. Aus derselben Woche stammen zwei kleinere Neuerungen. Seit dem 28. September können Administrator:innen den Zugriff auf einzelne Apps und Datenspeicher getrennt regeln, und seit dem 29. September lässt sich Zapier als Datenquelle anbinden, ebenfalls als Vorschau.

Wissenschaft & Studien

Die Speicherchips, die bis Ende 2027 ausgeliefert werden, reichen rechnerisch für 30 bis 170 Millionen gleichzeitig arbeitende KI-Agenten auf Spitzenmodellen. Das schätzt Jason Li vom Forschungsinstitut Epoch AI in einer Analyse vom 2. Oktober. Er rechnet vom Engpass her. High-Bandwidth Memory (HBM), der schnelle Arbeitsspeicher in KI-Beschleunigern, begrenzt, wie viele Anfragen ein Rechenzentrum gleichzeitig offen halten kann. Auf Wochenarbeitsstunden umgelegt entspräche diese Kapazität 140 bis 720 Millionen Vollzeitkräften. Li schreibt selbst dazu, die Nachfrage könne hinter dem Angebot zurückbleiben. Für die Kalkulation im eigenen Betrieb ist eine Nebenzahl brauchbarer. Eine Stunde durchgehender Agentenarbeit kostete in den ausgewerteten Programmier-Sitzungen je nach Modell zwischen rund 16 und 50 US-Dollar. Eine zweite Epoch-Auswertung vom 5. Oktober stützt sich auf Angaben von OpenAI. Danach verbrauchte der mittlere Forscher dort Mitte August Coding-Agenten im Listenwert von 601 Dollar am Tag, im Januar war es weniger als ein Dollar. Eine Agentenstunde liegt damit in der Größenordnung eines Stundenlohns, und für diesen Posten haben die wenigsten KI-Budgets eine Zeile.

Praxis

Vier Vorkehrungen, bevor das Wasserzeichen kommt Das ChatGPT-Wasserzeichen von oben ändert an deinen Texten nichts Sichtbares und trotzdem einiges an deinen Abläufen. Vier Vorkehrungen kosten zusammen einen Nachmittag. Erstens eine Liste der Texte anlegen, die dein Haus mit KI-Hilfe nach außen gibt. Dazu zählen Angebote, Ausschreibungsunterlagen, Fachbeiträge und Förderanträge. Bei jedem Posten klären, ob der Empfänger KI-Einsatz erlaubt oder eine Angabe dazu verlangt. Zweitens selbst offenlegen, wo es darauf ankommt. Die KI-Verordnung verlangt von Betreibern einen Hinweis, wenn sie KI-erzeugten Text veröffentlichen, der die Öffentlichkeit über Angelegenheiten von öffentlichem Interesse informieren soll. Die Pflicht entfällt, wenn der Text eine menschliche redaktionelle Kontrolle durchlaufen hat. Halte deshalb fest, wer welchen Text freigegeben hat. Ob deine Veröffentlichungen darunterfallen, klärt im Einzelfall die Rechtsberatung. Drittens eingehende Texte nicht per Detektor beurteilen. Ein fehlendes Wasserzeichen belegt keine menschliche Urheberschaft, und schon leichtes Umformulieren schwächt das Signal. Wer Bewerbungen oder Lieferantenberichte nach dem Urteil eines Prüfwerkzeugs aussortiert, entscheidet auf wackliger Grundlage. Viertens die eigenen Produkte prüfen. Bietet dein Unternehmen einen Chatbot oder Textgenerator auf Basis der OpenAI-Schnittstelle an, ist das Wasserzeichen dort standardmäßig aus. Ob du als Anbieter selbst unter die Kennzeichnungspflicht fällst, gehört jetzt auf den Tisch deiner Rechtsberatung. Der Schalter liegt in den Projekt- oder Organisationseinstellungen des API-Kontos.

Kurz & quer

  1. Reflection AI, ein von Nvidia unterstütztes US-Start-up, hat mit Beam sein erstes offenes Spitzenmodell angekündigt. Die Modellgewichte sollen noch im Oktober erscheinen. Nach Firmenangaben hält Beam mit dem chinesischen GLM-5.2 mit und braucht im Betrieb drei- bis viermal weniger Rechenleistung, unabhängig geprüft ist das laut TechCrunch nicht. Offene Modelle lassen sich auf eigener Hardware betreiben. Eine weitere Alternative zu den chinesischen Modellen vergrößert die Auswahl für alle, die sensible Daten im Haus behalten wollen. 2) Die Recruiting-Plattform HackerRank hat ihren KI-Interviewer Chakra allgemein freigegeben. In der Testphase führte er nach Firmenangaben mehr als 500.000 Gespräche mit Programmierer:innen und fasst Vorauswahl, Hausaufgabe und Folgegespräch in einem Termin zusammen. Die Kandidat:innen dürfen einen KI-Assistenten benutzen, bewertet wird auch, wie sie ihn anleiten und seine Ergebnisse prüfen. Firmenchef Vivek Ravisankar berichtet von 70 bis 80 Prozent weniger Betrugsverdachtsfällen als in herkömmlichen Tests. Erlaubte Hilfsmittel senken offenbar den Anreiz zu schummeln, und das lässt sich auf jede Einstellungsprüfung übertragen. 3) OpenAI zeigt ab Ende Oktober Bildanzeigen neben Bildern, die ChatGPT erzeugt, zunächst nur in den USA. Sie erscheinen in der kostenlosen Version und den günstigen Tarifen. Laut OpenAI sind sie klar gekennzeichnet und beeinflussen die Antworten nicht. ChatGPT hat nach TechCrunch-Angaben 1,2 Milliarden wöchentliche Nutzer:innen. Wer Werbebudgets plant, sollte den Kanal beobachten, auch wenn die Bildanzeigen hierzulande noch nicht laufen.

Quellen

Daily Briefing

Täglich per E-Mail.