Astra steuert Drohne, Nvidia prüft 10 Mrd. für Anthropic, Aufsicht gewinnt Rückenwind
Agenten werden praktischer, Kapital und Governance ziehen nach, und neue Modelle treffen Suche und Musik.
Die wichtigsten Meldungen
Astra steuert eine Überwachungsdrohne und betreibt eigenständig ein kleines Geschäft. Es verdient nahezu das Dreifache von Claude Fable 5.1. Die Angaben stammen vom Anbieter, unabhängige Audits gibt es nicht. Du brauchst klare Freigaben und Telemetrie, bevor du so etwas live stellst.1
Frühe Benchmarks deuten bei GPT-6 Astra auf einen Sprung im räumlichen Schlussfolgern hin, also Denken über Lage und Bewegung im Raum. In einem neuen Robotik-Benchmark legt das Modell deutlich zu. Auch hier fehlen unabhängige Bestätigungen. Du kannst Planungsaufgaben mit weniger Betreuung testen, sobald du Zugriff hast.2
Nvidia verhandelt über bis zu 10 Milliarden Dollar für Anthropics geplanten Börsengang. Es sind Gespräche, kein Abschluss. Das würde die Rechenallianz zwischen beiden festigen. Du könntest mehr Kapazität bei Claude buchen, Preisdruck bleibt aber unklar.3
Sam Altman, Elon Musk und Demis Hassabis unterstützen Dario Amodeis Ruf nach unabhängiger Aufsicht. Im Fokus steht rekursive Selbstverbesserung, also Modelle, die sich ohne externe Hilfe weiter verbessern. Das verschiebt die Debatte von freiwilligen Zusagen zu verbindlicher Prüfung. Wenn du an Frontier-Features arbeitest, rechne mit Audits.4
Google stellt ein neues Modell vor, das künftige Verkäufe aus Verkaufsdaten, Wetter und Rabattplänen schätzt. Zahlen zu Genauigkeit und Verfügbarkeit fehlen in der Ankündigung. Wenn du Forecasting machst, plane einen Vergleich gegen deine Baseline, sobald Zugriff möglich ist.5
Iris-mini und Iris-pro führen als open-weight Suchagenten ihre Klassen an. Die Einstufung basiert auf den angegebenen Benchmarks. Du kannst sie lokal oder in der eigenen Cloud testen und anpassen.6
ElevenLabs bringt Music v2.5 in App und API, mit Free- und Pro-Tarifen. Die Version ist verfügbar. Du kannst damit Ideen skizzieren und die API in deinen Workflow hängen.7
OpenAI setzt seinen Kurs fort und beansprucht diese Woche eine Lösung für ein Millennium-Preisproblem. Das wäre groß, doch externe Validierung steht noch aus. Der Text rahmt das als Flaggenpolitik: gewinnen statt abwarten.8
Tools und Releases
- Perplexity setzt Astra für Kommunikation, Code-Änderungen und Produktions-Monitoring ein und greift deutlich seltener manuell ein.9
- Ein offenes Benchmarking-Testgerüst für OpenAI-Modelle auf Bedrock misst Kosten pro korrekter Antwort, Agenten-Trajektorienkosten und Qualitätsnoten; es erschien vor drei Tagen.10
- Moonshot AI peilt 2 Milliarden Dollar Jahresumsatz an, vor drei Tagen meldete OpenRouter bis zu 300 Milliarden K3-Token täglich, beides ohne unabhängige Prüfung.11
Research
- Geschriebene Begründungsschritte korrespondieren mit klar abgrenzbaren inneren Aktivitätsmustern, was neue Hebel für Analyse und Steuerung andeutet.12
- Eine zweijährige Unistudie findet: Studierende schneiden schlechter ab, wenn KI im Unterricht verboten ist, verglichen mit angeleiteter Nutzung.13
Quellen
- GPT-6 Astra pilots a surveillance drone and runs a business on its own (the-decoder.com)
- GPT-6 Astra appears to show a "step change" in spatial reasoning based on early benchmarks (the-decoder.com)
- Nvidia wants to pour up to $10 billion into Anthropic's record-breaking IPO (the-decoder.com)
- Altman, Musk, and Hassabis back Amodei's call to add independent oversight (the-decoder.com)
- Google's new AI model predicts the future from sales data, weather, and discount schedules (the-decoder.com)
- Iris-mini and Iris-pro are the strongest open-weight search agents in their class (the-decoder.com)
- Elevenlabs makes Music v2.5 available via app and API with free and pro tier options (the-decoder.com)
- OpenAI just wants to win (theverge.com)
- Perplexity trusts GPT-6 Astra with end-to-end systems (openai.com)
- Beyond the price per token: Choosing the right OpenAI model on Amazon Bedrock for your workload (aws.amazon.com)
- Kimi-maker Moonshot AI targets $2B in annual revenue (techcrunch.com)
- AI models' written reasoning steps correspond to distinct internal patterns, a new study finds (the-decoder.com)
- Two-year university study finds banning AI from classrooms leaves students worse off (the-decoder.com)