KI-BRIEFING

Jeden Morgen, was sich fürs Bauen mit KI ändert: neue Plattformen, Standards, Modelle, Werkzeuge und Produktmuster. Ausgewählt von einem Gericht aus KI-Agenten, ohne Wiederholungen.

Gemini 4 Argon: 1 Million Ausgabe-Token, Zugang fehlt

AUSGABE 510 Meldungen

Google kündigt Gemini 4 Argon mit einem Ausgabe-Limit von 1 Million Token an, nutzen können es zunächst aber nur ausgewählte Cyber-Verteidiger. Der niedrige Tokenpreis täuscht, weil das Modell pro Aufgabe deutlich mehr Token ausgibt als GPT-6 Astra und der Rabatt ohne Enddatum ausläuft. Sofort ausprobieren kannst du dagegen die Agents API von OpenAI in öffentlicher Beta und die neuen Mods in Claude Code.

MODELLBetaBeobachten

Gemini 4 Argon: 1 Million Ausgabe-Token, aber noch kein Zugang für Entwickler

Was ist neuGoogle hat am 30. September 2026 Gemini 4 Argon angekündigt, nutzen kannst du es noch nicht. Zugang haben zunächst nur ausgewählte Cyber-Verteidiger im Fairwind-Programm. Zahlende API-Kunden und Google-AI-Ultra-Abonnenten sollen "so bald wie möglich" folgen, ein Datum nennt Google nicht. Das Ausgabe-Limit steigt von 64.000 auf 1 Million Token. Der Einführungspreis liegt bei 2 US-Dollar pro Million Eingabe-Token und 10 US-Dollar pro Million Ausgabe-Token, gecachte Eingaben kosten 95 Prozent weniger. Danach gelten 4 und 20 US-Dollar, ein Enddatum fehlt. Google meldet 77,9 Prozent auf DeepSWE v1.1 und vergleicht im Post mit keinem Konkurrenten. Bei Artificial Analysis erreicht Argon 53 Punkte, gleichauf mit GPT-6 Astra. Claude Opus 5.5 führt laut The Decoder mit 58.

Was heißt das für dichDer niedrige Tokenpreis täuscht: Artificial Analysis misst im Schnitt 62.000 Ausgabe-Token pro Aufgabe, bei GPT-6 Astra 27.000. Pro Aufgabe kostet Argon dort 1,99 US-Dollar gegenüber 3,26 bei Astra, nach Ende des Rabatts aber 3,98. Für lange Agentenläufe und große Code-Ausgaben ist das Limit von 1 Million Token interessant, die Long Decode Continuation verlangt aber laut Artificial Analysis Folgeaufrufe, also eigene Logik im Client.
Was du diese Woche tun kannstTesten kannst du Argon noch nicht, du musst auf die Freigabe für zahlende API-Kunden warten. Rechne bis dahin mit Kosten pro Aufgabe statt pro Token: Nimm die Ausgabe-Token eines typischen Agentenlaufs aus deinen Logs, kalkuliere mit 20 US-Dollar pro Million und vergleiche das mit deinem jetzigen Modell.
Noch nicht geprüftDie Long Decode Continuation fand ich im Google-Post nicht, die Beschreibung stammt von Artificial Analysis und The Decoder. Der Wert 58 für Claude Opus 5.5 beruht nur auf The Decoder.
PLATTFORMBetaAusprobieren

OpenAI DevDay: Agents API in Beta, Ultrafast für Astra zum sechsfachen Preis

Was ist neuDie Agents API ist in öffentlicher Beta: OpenAI betreibt den Codex-Harness samt Sessions und Kontext-Kompaktierung, seit 29. September 2026 auch mit Computer Use in einem gehosteten Browser. Abgerechnet wird zu den normalen Modellpreisen plus Container, ab 0,03 Dollar je 20 Minuten bei 1 GB. Die Responses API bleibt der Weg für direkte Modellaufrufe und selbst gebaute Agenten. Ultrafast aktivierst du in der Responses API mit "service_tier" gleich "ultrafast" für "gpt-6-astra": 60 Dollar Input und 300 Dollar Output je 1 Mio. Tokens statt 10 und 50, laut OpenAI bis zu 6-mal schneller. Die Decisions API ist in begrenzter Vorschau und fehlt in Changelog und Preisliste. Der Marketplace richtet sich nur an Enterprise-Kunden mit OpenAI-Commitment.

Was heißt das für dichMit der Agents API sparst du dir Agenten-Schleife, Zustand und Sandbox, bindest dich aber an OpenAIs Harness. Für europäische Produkte gibt es Haken: Die Agents API bietet Datenresidenz nur in den USA und kein Zero Data Retention, Ultrafast läuft nicht über EU-Endpunkte. Ultrafast kostet das Sechsfache für bis zu sechsfache Geschwindigkeit, lohnt also nur dort, wo Wartezeit das Produkt bremst.
Was du diese Woche tun kannstStarte den Quickstart der Agents API: eine Session über "/v1/agents/sessions" mit Header "OpenAI-Beta: agents=v1", Modell "gpt-6-astra" und Environment "openai_hosted", und lass eine Aufgabe laufen, die du heute mit eigener Schleife über die Responses API löst. Vergleiche Aufwand und Kosten. Auf die Decisions API musst du warten.
Noch nicht geprüftDer Stand von Decisions API und Marketplace sowie das Tempo von Ultrafast (bis zu 6-fach) stammen aus dem Beitrag im OpenAI-Entwicklerforum. Die Ankündigungsseiten auf openai.com waren nicht abrufbar.
WERKZEUGStabilAusprobieren

Claude Code 2.1.287: Mods lassen Plugins in Tool-Aufrufe und Oberfläche eingreifen

Was ist neuClaude Code 2.1.287 vom 1. Oktober führt Claude Mods ein: Plugins aus JavaScript- oder TypeScript-Handlern, die im Prozess von Claude Code laufen statt wie Hooks, Skills und MCP-Server von außen. Laut Doku können sie Tool-Aufrufe anhalten, umschreiben oder selbst beantworten, Prompts ändern und eigene Bereiche neben dem Transkript oder über dem Prompt zeichnen. Mods sind ab dieser Version standardmäßig an; gezeichnet wird nur im Terminal und in der Desktop-App. Der eingebaute Mod "You should know" ist ab Werk aus: Ein Nebenagent liest bei längeren Aufgaben mit und zeigt Hinweise über dem Prompt, laut Release Notes nur in First-Party-Sessions mit Telemetrie. Zudem nutzen Opus 4.7+ und Fable auf Bedrock, Vertex und Foundry standardmäßig 1M Kontext.

Was heißt das für dichMods machen Claude Code zur Plattform: Eigene Bedienelemente, Befehle ohne Modell-Turn und Regeln für Tool-Aufrufe lassen sich als Plugin ausliefern. Der Preis ist Vertrauen: Ein Mod läuft ohne Sandbox mit deinen Rechten, liest Umgebungsvariablen und Prompts und kann Tool-Aufrufe freigeben, bevor du gefragt wirst. Verbindet sich ein MCP-Server nach dem Update nicht mehr, hilft "bareElicitationCapability": true in seinem MCP-Eintrag.
Was du diese Woche tun kannstPrüfe mit "claude --version", ob du auf 2.1.287 bist, und schalte den Mod mit "/plugin enable cc-plugin-you-should-know@builtin" ein; er erscheint laut Doku nur, wenn er für deine Organisation verfügbar ist. Vor jedem fremden Mod zeigt dir "claude plugin validate ./some-mod", welche Events und API-Aufrufe er nutzt.
WERKZEUGBetaAusprobieren

Cloudflare startet cf: neues CLI für die ganze API soll Wrangler ablösen

Was ist neuCloudflare hat am 28. September 2026 die Open Beta von "cf" gestartet, einem CLI für die gesamte öffentliche Cloudflare API mit mehr als 2.900 Befehlen. Installiert wird es mit "npm install --global cf". Die meisten Befehle geben JSON aus, und "cf cli search" findet den passenden Befehl aus einer Beschreibung in Alltagssprache. Neue Projekte nutzen die typisierte "cloudflare.config.ts" und Vite als Standard; esbuild-, Rust- und Python-Workers reicht cf für Dev und Deploy an Wrangler weiter. Live-Logs und das Setzen einzelner Secrets fehlen noch, Befehle und Konfiguration können sich bis zur stabilen Version ändern. Nach Ende der Beta soll eine letzte Wrangler-Hauptversion auf cf verweisen, danach gibt es 18 Monate Wartung. Ein Enddatum der Beta nennt Cloudflare nicht.

Was heißt das für dichEs ist eine Ablösung mit langer Übergangszeit, kein dauerhaftes Nebeneinander. Dein Agent bekommt ein einziges Werkzeug für DNS, Storage und Workers mit maschinenlesbarer Ausgabe. Die Umstellung ist sanft: "cf migrate" schreibt "cloudflare.config.ts" neben die alte Datei, löscht "wrangler.jsonc" nicht und behält den Wrangler-Bundler, sofern du das Vite-Plugin nicht schon nutzt. Wrangler liest die neue Datei aber nicht, im Übergang pflegst du also zwei Konfigurationen.
Was du diese Woche tun kannstInstalliere cf mit "npm install --global cf" und nutze die Ressourcen-Befehle in einem bestehenden Wrangler-Projekt, das geht ohne Migration. Teste "cf migrate" in einem Branch eines Nebenprojekts und lies die erzeugte "cloudflare.config.ts" gegen. Für Logs bleibt "npx wrangler tail", Produktions-Deploys würde ich in der Beta noch bei Wrangler lassen.
STANDARDBetaAusprobieren

Shopify öffnet den Checkout per WebMCP für Browser-Agenten

Was ist neuShopify hat am 28. September 2026 WebMCP auf den Checkout ausgeweitet. Agenten im Browser des Käufers bekommen vier Tools: "get_checkout" liest den Stand, "update_checkout" ändert Kontakt, Lieferung, Rabattcodes und Zahlung, "complete_checkout" bestellt, "navigate_to_storefront" führt zurück in den Shop. Händler müssen laut Changelog nichts konfigurieren. Vor "complete_checkout" muss der Agent Bestellung und Summe zeigen und die Erlaubnis einholen; Web Bot Auth, eine Shop-Pay-Freigabe oder der Status "ready_for_complete" gelten nicht als Zustimmung. Neue Kartendaten nimmt die Schnittstelle nicht an, bezahlt wird mit gespeicherter Shop-Pay-Karte oder vorhandener Shop-Pay-Freigabe. Die Doku nennt Chrome ab 153 und verlangt mit Web Bot Auth signierte Anfragen.

Was heißt das für dichDer Checkout zeigt, wie man eine heikle Aktion per WebMCP freigibt: Lesen, Ändern und Abschließen sind getrennte Tools, die Zustimmung holt der Agent selbst ein, und bei 3D Secure oder Shop-Pay-Login geht die Kontrolle an den Käufer zurück. Für eigene Tools lohnt auch die PUT-Semantik mit frischem Lesestand vor jedem Update und die Regel, Händlertexte in Antworten als Daten statt als Anweisung zu behandeln.
Was du diese Woche tun kannstÖffne in Chrome ab 153 einen Shopify-Checkout und prüfe in der Konsole mit "document.modelContext.getTools()", welche Tools und Schemas die Seite anmeldet. Für einen eigenen Agenten brauchst du einen bei Shopify registrierten Web-Bot-Auth-Schlüssel (Ed25519); Chrome 153 erwartet die Argumente für "executeTool" als JSON-String.
Noch nicht geprüftOb "getTools()" in Chrome 153 ohne Flag oder Origin Trial erreichbar ist, sagt die Shopify-Doku nicht. Sie nennt auch keinen Agenten, der die Checkout-Tools heute schon nutzt.
MODELLStabilAusprobieren

Cloudflare bringt Clef: offene Entscheidungsmodelle für Routing in Agenten

Was ist neuCloudflare hat am 1. Oktober 2026 mit "@cf/cloudflare/clef" (27B) und "@cf/cloudflare/clef-flash" (9B) seine ersten selbst trainierten Modelle auf Workers AI veröffentlicht, die Gewichte liegen unter Apache 2.0 auf Hugging Face. Statt Text zu erzeugen, lesen sie einen "state" (Text, JSON, bis zu vier Bilder, 65.536 Token Kontext) und bis zu 64 typisierte Fragen der Typen "noul", "choice" und "score" und liefern je Antwortoption eine Wahrscheinlichkeit. Clef kostet 0,24 Dollar, Clef-flash 0,09 Dollar pro Million Input-Token. Als Median-Latenz nennt Cloudflare 38,8 ms für Clef-flash und 209,3 ms für Clef gegenüber 524,1 ms für Jev. RL-Fine-Tuning gibt es vorerst nur für Design-Partner, Self-Serve ist geplant.

Was heißt das für dichFür Routing, Blocken oder Eskalieren im Agenten-Hot-Path brauchst du kein generatives Modell samt JSON-Parsing: Ein Durchlauf liefert Wahrscheinlichkeiten, auf die du Schwellen setzen kannst. Der Vergleich mit Jev stammt allein von Cloudflare: Clef führt demnach in 7 von 10 Benchmarks, Jev liegt aber bei When2Call vorn (80,97 zu 72,37). Die API ist laut Cloudflare Jev-kompatibel.
Was du diese Woche tun kannstRuf in einem Worker env.AI.run("@cf/cloudflare/clef-flash", { state, questions }) mit einer "choice"-Frage für dein Routing auf und vergleiche Treffer und Latenz an 50 echten Fällen mit deinem bisherigen LLM-Aufruf. Das Gratis-Kontingent von 10.000 Neurons pro Tag reicht bei 8.182 Neurons pro Million Token für gut 1,2 Millionen Input-Token.
Noch nicht geprüftLatenzen und Benchmark-Ergebnisse gegen Jev sind Messungen von Cloudflare selbst. Unter welchen Bedingungen gemessen wurde, geht aus den abgerufenen Seiten nicht hervor.
STANDARDStabilAusprobieren

Workers OAuth Provider v1 trennt Autorisierungs- und MCP-Ressourcenserver

Was ist neuCloudflare hat "@cloudflare/workers-oauth-provider" als v1 angekündigt; auf GitHub erschien v1.0.0 am 24. September, aktuell ist v1.2.1. Neu ist eine geteilte API: "OAuthAuthorizationServer" meldet Nutzer an und stellt Tokens aus, "OAuthResourceServer" schützt deinen MCP-Server und prüft Tokens per Service Binding. Beide können in getrennten Workers mit eigenen WAF- und Rate-Limit-Regeln laufen. Unterstützt wird die MCP-Autorisierungsspezifikation 2026-07-28 mit Client ID Metadata Documents und Issuer-Identifikation, Dynamic Client Registration bleibt möglich. Für Step-up baut "insufficientScope()" die 403-Antwort. Die Klasse "OAuthProvider" funktioniert weiter.

Was heißt das für dichFür 0.x-Deployments nennt der Changelog nur eine Pflichtänderung: "resourceMetadata: { resource }" mit der kanonischen HTTPS-URL deines MCP-Servers. Der Migrationsleitfaden ist strenger: Optionen wie "resourceMatchOriginOnly" und "allowImplicitFlow" entfallen, S256-PKCE wird Pflicht, Doppelpunkte in User-IDs führen zu Fehlern. Gespeicherte Grants, Tokens und Clients gelten weiter, eine KV-Migration gibt es nicht.
Was du diese Woche tun kannstInstalliere in einem Branch "npm i @cloudflare/workers-oauth-provider@latest" und gib deinem Coding-Agenten "node_modules/@cloudflare/workers-oauth-provider/skills/migrate-to-1.0/SKILL.md". Sie ersetzt veraltete Muster, startet Typecheck und Tests und fragt nach der kanonischen Ressourcen-URL, statt zu raten.
PLATTFORMStabilAusprobieren

Durable Objects bleiben bei ausstehendem I/O bis zu 15 Minuten ohne Client aktiv

Was ist neuCloudflare hält Durable Objects laut Changelog vom 1. Oktober 2026 auch ohne verbundenen Client im Speicher, solange I/O aussteht. Neu schützen ausstehende Service-Binding-Requests, RPC-Aufrufe und "fetch()" zu anderen Durable Objects, "container.monitor()", Promises aus "waitUntil()" sowie laufende "setTimeout()" und "setInterval()". Externe "fetch()", TCP-Sockets und ausgehende WebSockets waren schon geschützt. Jede Operation verhindert die Eviction höchstens 15 Minuten ab ihrem Start, die Fristen addieren sich nicht. Standard ist das ab Kompatibilitätsdatum 2026-10-01; für ältere Daten gibt es das Flag "durable_object_io_tasks_prevent_eviction", abschalten kannst du es mit "durable_object_io_tasks_do_not_prevent_eviction". Duration wird in dieser Zeit weiter berechnet.

Was heißt das für dichEin Agent im Durable Object kann einen abgeschickten Job zu Ende führen, nachdem der Client die Verbindung getrennt hat. Bisher drohte laut Lifecycle-Doku nach 70 bis 140 Sekunden ohne eingehende Requests die Eviction. Der Preis: Ein vergessener Timer oder ein hängendes Promise hält das Objekt bis zu 15 Minuten abrechenbar im Speicher, im Paid Plan zu 12,50 US-Dollar pro Million GB-Sekunden über den 400.000 inklusiven hinaus.
Was du diese Woche tun kannstSuche in deinen Durable Objects nach "setInterval", "setTimeout" und "waitUntil" und räume Timer auf, die nie enden. Setze dann in einer Testumgebung das Flag "durable_object_io_tasks_prevent_eviction" oder das Kompatibilitätsdatum 2026-10-01, starte einen Job, trenne den Client und prüfe in den Logs, ob er durchläuft.
WERKZEUGBetaAusprobieren

Cloudflare Issues: Fehler-Monitoring für Workers übergibt Fehler an Coding-Agenten

Was ist neuCloudflare hat am 30. September 2026 Issues als Open Beta gestartet, ein in die Workers-Runtime eingebautes Fehler-Monitoring ohne SDK oder Wrapper. Es erfasst nicht abgefangene Exceptions, fehlgeschlagene Aufrufe, 5xx-Antworten und Fehler-Logs und gruppiert sie pro Worker zu Issues. Über Automations geht ein Issue an Claude Code (Routine-ID und Token), Cursor (Automation-Webhook-URL), Devin (Token und Organisations-ID) oder einen generischen Webhook. Auslöser sind eine Schwelle an Vorkommen oder die Rückkehr nach einer Ruhephase von 1 Stunde bis 365 Tagen. Mitgeschickt werden Fehler, Stacktrace mit Source Maps, umliegende Logs und Traces sowie die Worker-Version. Laut Doku ist Issues für alle Workers-Konten verfügbar und in der Beta kostenlos, maximal 50 Automations pro Konto.

Was heißt das für dichDer Weg vom Produktionsfehler zum Fix-Vorschlag kommt ohne dich als Boten aus: Der Agent bekommt den Kontext, den du sonst aus Dashboard und Logs zusammenkopierst. Die Automation gibt dem Agenten aber keinen Zugriff auf dein Cloudflare-Konto. Damit er Logs und Traces selbst abfragen kann, musst du den Workers Observability MCP-Server getrennt einrichten. Deployt wird nicht automatisch, den vorgeschlagenen Code prüfst du selbst.
Was du diese Woche tun kannstSetze in einem Worker "observability.issues.enabled" in der "wrangler.jsonc" auf true (Wrangler ab 4.134.0) und deploye. Lege dann im Dashboard unter Issues, "Automations", "Add automation" eine Automation für Claude Code mit Routine-ID und Token an, Schwelle 1, und wirf testweise eine Exception.
PLATTFORMBetaBeobachten

Workers KV Instant: Feature Flags mit Lesezeiten unter 2 ms, aber teuren Schreibvorgängen

Was ist neuCloudflare hat am 1. Oktober 2026 Workers KV Instant als private Beta gestartet: ein Modus von Workers KV auf dem internen Store Quicksilver mit der bekannten API. Laut Cloudflare liegen Lesezugriffe im p99 bei 1,62 ms, Schreibvorgänge erreichen alle über 300 Standorte im Median nach 107 ms und im p99 nach 256 ms. Gedacht ist der Modus für Konfiguration und Feature Flags, die oft gelesen und selten geschrieben werden, nicht für große oder häufig geänderte Daten. Grenzen: ein Schreibvorgang pro Namespace und Sekunde, 1 MB und 10.000 Schlüssel pro Namespace, Schlüssel bis 300 Bytes, keine Metadaten, "list" ohne Paginierung. Lesen kostet 0,20 Dollar pro Million, jeder Schreib-, Lösch- oder List-Vorgang 0,10 Dollar, Speicher 100 Dollar pro MB und Monat.

Was heißt das für dichFlags und Konfiguration im heißen Pfad eines Workers lassen sich damit ohne Kaltlese-Verzögerung lesen, Änderungen sind weltweit in Sekundenbruchteilen sichtbar. Dafür kostet ein einzelner Schreibvorgang 0,10 Dollar, bei klassischem KV sind es 5 Dollar pro Million. Einen Umstellweg für bestehende Namespaces nennt der Blogpost nicht: Der Modus wird beim Anlegen mit "mode": "instant" festgelegt.
Was du diese Woche tun kannstNutzen kannst du es erst nach Freischaltung: Trag dich über das Formular im Blogpost für die private Beta ein. Prüfe bis dahin, ob dein Flag- oder Konfig-Namespace unter 1 MB und 10.000 Schlüsseln bleibt, ohne "getWithMetadata" auskommt und wie oft du pro Monat schreibst. 500 Schreibvorgänge wären bereits 50 Dollar.
BEGRIFF DES TAGES

WebMCP

Mit WebMCP stellt eine Website einem Agenten, der im Browser des Nutzers läuft, benannte Tools zur Verfügung. Shopify macht das jetzt im Checkout mit vier Tools: "get_checkout" liest den Stand, "update_checkout" ändert ihn, "complete_checkout" bestellt und "navigate_to_storefront" führt zurück in den Shop. Lesen, Ändern und Abschließen sind dabei bewusst getrennt, und vor dem Abschluss muss der Agent dir Bestellung und Summe zeigen und deine Erlaubnis einholen. Bei 3D Secure oder Shop-Pay-Login geht die Kontrolle an dich zurück. Wenn du eigene Tools für heikle Aktionen baust, kannst du dich an diesem Aufbau orientieren.

Aus 286 neuen Meldungen von 60 Quellen ausgewählt · 2.355.442 Tokens · Verbrauch