Field Notes

OpenAI skizziert neuen Agenten-Stack, AWS zeigt praxistaugliches RAG, No-Code-Agenten ziehen ein

Heute geht es um Agenten, sichere Kontrollen und kleine Schritte, die du sofort nutzen kannst.

Wichtige KI-Nachrichten

OpenAI skizziert neuen Agenten-Stack: Decisions API, Agents API und schnellere Computer Use

OpenAI stellte auf dem DevDay neue Bausteine für Agenten vor: asynchrone Toolaufrufe, Mid-turn-Steering (steuern, während die Antwort läuft), WebSockets, UltraFast-Inferenz und die Decisions API.1 Ari Weinstein sagte, Computer Use sei heute „180 Grad anders“, und Screenshots plus Accessibility-Daten, DOM, Playwright und generierter Code beschleunigen Aufgaben.1 Status: angekündigt im Podcast-Gespräch, Details und Verfügbarkeit sind Anbieterangaben ohne unabhängige Prüfung.1 Wenn du Agenten baust, plane strukturierte Entscheidungen mit niedriger Latenz, sowie längere Prompt-Caches und Pre-Warming ein.1

White House Accord: große Labore sagen externe Prüfungen und Kontrollen zu

Laut einem Bericht haben Branchenführer eine gemeinsame Selbstverpflichtung mit externen Audits, internen Kontrollen und mehrschichtigen Reviews unterzeichnet; der US-Präsident nannte sie „moralisch bindend“.2 Die Liste der Unterzeichner und der Hinweis, dass Microsoft und Amazon nicht sichtbar unterschrieben hätten, stammen aus dieser Quelle und sind nicht offiziell bestätigt.2 Wenn du Frontier-Modelle einsetzt, bereite eine externe Prüfbeziehung vor und dokumentiere deine internen KI-Kontrollen.2

ML-Vorwarnungen für Stromnetze bei Sonnenstürmen

Microsoft Research beschreibt ein System mit 30–60 Minuten Vorwarnzeit und ortsgenauen Risiken für 66.935 US-Umspannwerke.3 Es erkannte im Zeitraum 2020–2026 rund 80 Prozent großer Ereignisse; gemeldet werden 76,5 Prozent Treffer ab 10 nT/min, 81,2 Prozent ab 20 nT/min und 64,1 Prozent ab 50 nT/min.3 Arbeitest du in Netzbetrieb oder kritischen Diensten in den USA, binde solche Signale in Bereitschaft, Alarmierung und Kundenkommunikation ein.3

Highlights für deinen Arbeitsalltag

Baue einen claims-fähigen Assistenten mit Amazon Bedrock Knowledge Bases: Die Agentic-Retrieve-Stream API plant Unterabfragen, prüft Belege und liefert Antworten mit Quellen; eine Guardrail sichert die inhaltliche Bindung an Dokumente ab (Agentic Retrieval heißt: der Assistent plant und wiederholt Abrufe selbst).4 Google führt Skills als wiederverwendbare Anweisungen ein und ersetzt Gems: Du definierst einmal deine Routine und nutzt sie dann für wiederkehrende Aufgaben.5 n8n zeigt einen neuen Agenten ohne Code: Fotos von Notizzetteln werden zu Aufgaben, Belege werden geloggt, E-Mails morgens vorsortiert, gesteuert per Telegram.6

Tools und Updates

  • LangChain Managed Deep Agents 0.8 nehmen jetzt Anfragen über beliebige Webhooks an; ein Beispiel protokolliert Ausgaben, wenn du einen Beleg per SMS weiterleitest. Voraussetzung: Managed Deep Agents Zugang.7
  • Nemotron 3 Diarization in Transformers 5.18.0 trennt Sprecher in Echtzeit und offline bis zu acht Stimmen, sortiert nach Ankunftsreihenfolge; nützlich für Meetings und Call-Auswertung. Speaker Diarization heißt: „Wer sprach wann“.8
  • NVIDIA NeMo Relay protokolliert Agentenschritte detailliert, damit du Umwege erkennst und Latenzen sowie Tokenverbrauch senkst; erfordert NeMo Relay.9

In fünf Minuten ausprobieren

1) Öffne deinen bevorzugten KI-Chat und füge diesen Beispieltext ein: „CLM-100482: Auto-Schaden, Status offen, eingereicht am 09.07.2026, aktueller Betrag 14.250 USD. Der überarbeitete Kostenvoranschlag vom 22.07.2026 ersetzt die Fax-Fassung vom 15.07.2026. Provisorische Zahlung vom 01.08.2026 wurde am 12.08.2026 storniert. Geplante Scheckausstellung nach Genehmigung des überarbeiteten Voranschlags.“4 2) Frage: „Wurde der Voranschlag für CLM-100482 genehmigt, und wann wird der Scheck ausgestellt? Antworte nur aus dem Text und setze nach jeden Satz eine Quellenklammer wie [T1].“4 3) Prüfe die Antwort. Bitte die KI um Korrektur, wenn sie Inhalte ergänzt, die nicht im Text stehen, oder wenn ein Satz keine [T1]-Klammer trägt.4

Erwartetes Ergebnis: Eine kurze Antwort mit 1–2 Sätzen, jeweils belegt mit [T1], ohne zusätzliche Annahmen.4 Prüfkriterium: Jeder Satz stützt sich ausschließlich auf den Beispieltext und trägt eine Belegklammer.4

Quellen

  1. Why Dwarkesh is Wrong about Computer Use + How OpenAI shipped its Jev competitor in 1 Week (latent.space)
  2. A ‘Morally Binding’ White House Accord on AI Safety (thezvi.substack.com)
  3. Forecasting space weather risks on power grids (microsoft.com)
  4. Query claims in natural language with Amazon Bedrock Knowledge Bases (aws.amazon.com)
  5. Let skills in Gemini tackle your most repetitive tasks (blog.google)
  6. @n8n_io: n8n now has a new kind of agent 🤖 Liam shows you how easy it is to set one up: a Telegram assistant that turns sticky-note photos into tasks, logs receipts, and sorts your email ev (x.com)
  7. @langchain: Managed Deep Agents 0.8 ships HTTP channels: agents can take requests from any webhook, not just Slack.

@ndrezn built an expense agent that lives in text messages.

Text a receipt (x.com) 8. Transformers 5.18.0 (github.com) 9. Tracing Agent Harness Behavior with NVIDIA NeMo Relay (developer.nvidia.com)