Field Notes

GPT-6 Sol und Luna halb so teuer und auf Bedrock. So senkst du KI-Kosten jetzt.

Heute kannst du komplexe und Routine-Aufgaben günstiger automatisieren und deine Sicherheitsmaßnahmen nachschärfen.

Wichtige KI-Nachrichten

GPT-6 Sol und Luna: halbierter Preis und Start auf Bedrock

OpenAI hat GPT-6 Sol und GPT-6 Luna deutlich günstiger bepreist. Laut Simon Willison kostet Luna 0,10 US-$ pro Million Eingabetoken und 0,50 US-$ pro Million Ausgabetoken. Sol liegt bei 2 US-$ und 10 US-$. Das ist etwa halb so viel wie die GPT-5.6-Pendants im Aktionspreis. Die Modelle sind jetzt allgemein verfügbar auf Amazon Bedrock. Bedrock unterstützt explizites Prompt-Caching, IAM-Kontrollen und VPC-Zugriff. OpenAI meldet in eigenen Tests weniger Faktfehler bei Sol als bei 5.6 Sol. Das sind Anbieterangaben. Für dich heißt das: Du routest Volumen-Jobs auf Luna und behältst komplexe Fälle für Sol, mit Cache auf wiederverwendbaren Instruktionen.12.

Anthropic senkt Opus 5.5. Teste „max“ vor dem Einsatz.

Anthropic reduziert Opus 5.5 auf 4 US-$ pro Million Eingabetoken und 20 US-$ pro Million Ausgabetoken. Cache-Reads fallen um 60 Prozent. Das ist eine 20-Prozent-Senkung gegenüber Opus 5.0 bis 5.1. Simon Willison berichtet, dass Opus 5.5 im „max“-Denkniveau bei seinem SVG-Test zweimal ohne Antwort blieb, weil es die maximale Ausgabelänge verausgabte. Die beiden Läufe dauerten je fast 20 Minuten und kosteten je 2,56 US-$. Einzelergebnis eines Testers, keine breite Auswertung. Wenn du Opus 5.5 „max“ einplanst, simulierst du deinen Prompt realistisch und misst Abbruchraten. Sonnet 5.5 und Haiku 5.5 sind von Anthropic „coming soon“.1.

Meta und Polizei Singapur gehen gegen Scam-Netze vor

Meta meldet mit der Singapore Police Force umfangreiche Abschaltungen. Januar bis Juni 2026: über 113.000 betrügerische Entitäten und Seiten auf Facebook und Instagram. Juni: 33.600 weitere bei einer Aktion gegen E-Commerce-Betrug. Juli: präventiv über 3,6 Millionen „Shell-Pages“ deaktiviert, bevor sie aktiviert wurden. Für dich heißt das: Du schaltest 2-FA und Passkeys für Firmen-Accounts ein, prüfst Werbekonten auf impersonierte Seiten und dokumentierst interne Freigaben. Zahlen stammen vom Anbieter.3.

Highlights für deinen Arbeitsalltag

  • Du senkst Laufzeitkosten sofort, wenn du Aufgaben trennst: Klassifizieren, Extrahieren und kurze Antworten an GPT-6 Luna. Längere Analysen, Codereviews und Tool-Ketten an GPT-6 Sol. Markiere Policies, Tools und Schemata als Prompt-Cache auf Bedrock. So zahlst du für wiederkehrenden Kontext weniger. Leistungsangaben zu Sol sind Anbieterangaben.21.

  • Modelle ohne Stillstand tauschen. Together AI beschreibt Canary-Rollouts mit gestuften Traffic-Rampen, Metrik-Gates und automatischem Rollback. Du definierst messbare Gates wie Fehlerrate, Latenz und Eskalationen, lässt 1–5 Prozent laufen, prüfst, und erhöhst dann.4.

  • Vertrauliche Daten bleiben geschützt, auch im Betrieb. NVIDIA zeigt Confidential Computing für performante LLM-Inference in speicherverschlüsselten Umgebungen mit vertraulichen GPUs. Wenn du Gesundheits-, Finanz- oder Kundendaten verarbeitest, planst du diese Betriebsart für neue KI-Workloads ein..

Tools und Updates

  • RetroChimera: Offenes Microsoft-Framework und Gewichte für Retrosynthese. Kombiniert zwei Modelle und lernt ein Re-Ranking. Nützlich für frühe Routenbewertungen in Pharma und Materialien. Chemiedaten und Bewertung durch Fachleute bleiben Voraussetzung.5.
  • Industrielle Sicherheit in Sekunden: Tata Elxsi beschreibt IRIS auf AWS. Frames werden am Edge vorgefiltert, nur relevante Bilder und Metadaten laufen in eine serverlose Pipeline mit Echtzeit-Alerts. Für Betreiber vieler Kameras mit knappen Leitständen.6.
  • Rebalancer von Meta: Open-Source-Bibliothek für Zuweisungs- und Platzierungsprobleme. Trennung von Spezifikation und Lösung, Heuristiken oder MIP. Einsetzbar für Ressourcen-, Aufgaben- oder Traffic-Verteilung.7.
  • Regionale KI in SEA: NVIDIA Nemotron Open-Modelle werden von Behörden und Firmen genutzt. Beispiel: ThaiLLM adaptiert Nemotron 3 Nano für Rechtsanwendungen, treibt den Legal-Assistenten Thanoy mit rund 43.000 Nutzern. Für lokale Sprach-Anwendungen.8.

In fünf Minuten ausprobieren

Ein kleiner Sicherheitsgewinn: Abhängigkeits-Cooldowns einführen.

1) Lege fest, dass Produktions-Dependencies erst x Tage nach Release aktualisiert werden, etwa 72 Stunden. Dokumentiere die Regel im PR-Template.9. 2) Ergänze deine CI, damit automatische Upgrades in Produktion nur nach Ablauf des Cooldowns erlaubt sind. Staging darf früher testen.9. 3) Wähle eine Top-Abhängigkeit und setze den nächsten Versionssprung auf Staging, nicht Produktion. Notiere Release-Datum und frühestes Produktionsdatum im Ticket.9.

Erwartetes Ergebnis: Weniger Risiko durch kompromittierte Releases. Prüfkriterium: Kein Paket geht ohne abgelaufenen Cooldown in Produktion.9.

Ein guter Fund

John Platt über ERA von Google: Viele Wissenschaftsprobleme lassen sich als „scorebare“ Aufgaben formulieren. ERA führt Evolutionsschritte über einen Versuchs-Baum aus und wählt mit einer Optimierungsregel vielversprechende Abzweige. Zwei praktische Punkte: Formuliere zuerst eine belastbare Score-Funktion. Prüfe Ergebnisse gegen Goodhart-Effekte und starte konservativ mit einfachen Baselines wie linearer Regression oder SVM. Übertragbar auf interne Optimierungsaufgaben mit klarer Zielfunktion. Grundlage sind die Shownotes.10.

Quellen

  1. Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war (simonwillison.net)
  2. Bring more intelligence to everyday work with GPT-6 Sol and GPT-6 Luna on Amazon Bedrock (aws.amazon.com)
  3. Meta Takes Action on 3.7 Million Accounts, Pages and Content In Partnership With Singapore Police Force (about.fb.com)
  4. Canary rollouts: upgrade models in production without downtime (together.ai)
  5. Improving synthesis prediction of small molecules at scale with RetroChimera (microsoft.com)
  6. How Tata Elxsi detects industrial safety risks in seconds on AWS (aws.amazon.com)
  7. Open-Sourcing Rebalancer: A Generic, High-Performance Library for Solving Assignment Problems (engineering.fb.com)
  8. At AI Day Singapore, NVIDIA and Partners Showcase AI Advancements Across Southeast Asia (blogs.nvidia.com)
  9. Be alert: targeted attacks on prominent Rustaceans (simonwillison.net)
  10. 🔬 An Oscar, Two Asteroids, and the Algorithm in Your sklearn: John Platt on AI for Science (latent.space)