KI & Mittelstand
Die US-Verbraucherschutzbehörde nimmt sich die KI-Agenten vor Die US-Handels- und Verbraucherschutzbehörde FTC ermittelt gegen Anthropic, OpenAI und weitere KI-Labore. Das berichtet die Nachrichtenagentur Reuters unter Berufung auf einen hochrangigen FTC-Vertreter, der Washington Examiner hat es sich von einem Regierungsbeamten bestätigen lassen. Die Behörde will förmliche Auskunftsersuchen verschicken und Führungskräfte unter Eid aussagen lassen. Auch METR steht auf der Liste, eine Organisation, die KI-Modelle auf gefährliche Fähigkeiten testet. Anthropic und OpenAI äußerten sich gegenüber Reuters zunächst nicht. Auslöser ist eine Serie von Vorfällen seit Juli, bei denen KI-Agenten außer Kontrolle gerieten, darunter ein Angriff von OpenAI-Agenten auf die Entwicklerplattform Hugging Face. Ein KI-Agent ist ein Programm, das selbstständig Schritte ausführt, etwa Webseiten aufruft, Dateien öffnet oder Befehle absetzt. FTC-Chef Andrew Ferguson hatte bereits angedeutet, dass Entwickler haften sollen, wenn ihre Agenten bei Sicherheitstests Schaden anrichten. Reuters wertet die Untersuchung als ersten großen Schritt einer US-Behörde gegen autonome KI-Agenten. Ich halte das Timing für bemerkenswert. Am Dienstag unterschrieben die Konzernchefs im Weißen Haus freiwillige Zusagen, am Mittwoch rückt die Aufsicht an. Für dich als Unternehmer:in ist das mehr als ein US-Thema. Wer Agenten einsetzt, sollte schon heute schriftlich festhalten, welche Rechte sie haben und wer ihre Aktionen freigibt. Haftungsfragen landen gerade in den Akten der Behörden. KI & Mittelstand Google hat am Mittwoch Gemini 4 Argon vorgestellt, das neue Spitzenmodell seiner KI-Familie und laut Axios das erste große Modell-Update seit fast einem Jahr. Am meisten verrät das Preisschild. Zum Start kostet Argon 2 US-Dollar pro Million Eingabe-Token und 10 Dollar pro Million Ausgabe-Token, nach einer Einführungsphase das Doppelte. Token sind die Wortbausteine, nach denen KI-Anbieter abrechnen. Wer denselben Kontext immer wieder mitschickt, etwa ein Handbuch oder ein Vertragswerk, zahlt dafür dank Zwischenspeicherung (Caching) 95 Prozent weniger. Technisch neu ist die Ausgabegrenze von einer Million Token statt bisher 64.000. Das Modell kann also in einem Durchgang sehr lange Ergebnisse liefern, zum Beispiel umfangreiche Code-Umbauten oder ausführliche Berichte. Google nennt Softwareentwicklung, Rechts- und Finanzarbeit sowie IT-Sicherheit als Einsatzfelder. Im Programmiertest DeepSWE kommt Argon nach Herstellerangaben auf 77,9 Prozent, vor Claude Opus 5.5 mit 74,2 und GPT-6 Astra mit 74,1 Prozent. Kaufen kann man Argon noch nicht. Zuerst erhalten ausgewählte IT-Sicherheitsteams Zugang, parallel läuft das freiwillige Vorab-Prüfverfahren der US-Regierung. Danach sollen zahlende API-Kund:innen und Abonnent:innen von Google AI Ultra folgen, einen Termin nennt Google nicht. Laut Bloomberg fanden manche Google-Mitarbeitende das Modell intern weniger überzeugend, Google widerspricht. Ich lese Benchmark-Siege deshalb als Einladung zum eigenen Test. Schreib schon jetzt zwei, drei typische Aufgaben aus deinem Betrieb als Testfälle auf, dann dauert der Vergleich am Freischalttag eine Stunde statt einer Woche.