Field Notes

OpenAI-Claim zum Millennium-Problem, 2.4T-Qwen auf HyperPod, Suno v6 mit Labels, WeChat-Zero-Click

Große Versprechen, große Modelle, und eine Schwachstelle, die ohne Tipp auskommt.

Die wichtigsten Meldungen

OpenAI behauptet, eines der Millennium-Preisprobleme gelöst zu haben. Eine unabhängige Bestätigung steht aus. Das wäre ein großer mathematischer Schritt und zeigt das Tempo, das KI in Beweise bringt. Nutze das Ergebnis erst, wenn es Fachgutachten gibt.1

Ein Leitfaden zeigt, wie du Qwen3.8-2.4T-A95B mit vLLM auf SageMaker HyperPod ausrollst. Er deckt Clusteraufbau und NVFP4 ab, NVFP4 ist ein 4-Bit-Float-Format für dichte Modelle. Du bekommst einen OpenAI-kompatiblen Endpoint mit Reasoning, Toolaufrufen und MTP Speculative Decoding, Speculative Decoding ist eine Vorhersage- und Bestätigungstechnik für schnellere Ausgabe. Wenn du extrem große Modelle betreibst, kannst du damit einen Pfad testen.2

Suno startet v6, laut Firma gemeinsam mit Warner, BMG und Believe gebaut. Das Modell sei von Grund auf mit neuem, lizenziertem Material trainiert, inklusive Label-Inhalten, laut Suno. Das ist die erste Version mit offizieller Label-Unterstützung und eine Antwort auf laufende Klagen. Wenn du Musik generierst, senkt das rechtliche Unsicherheit, eine unabhängige Prüfung der Trainingsbasis fehlt aber.345

Nach dem gestrigen Start von GPT-6 Astra legt OpenAI nun die System Card und Ausrichtungsdetails vor. Die Firma nennt Astra das weltweit intelligenteste und am stärksten ausgerichtete verfügbare Modell, das ist eine Anbieter-Aussage. Wenn du Regulierung erfüllen musst, lies die Card und gleiche sie mit deinen Auflagen ab.67

Calif Research zeigt mit WeWorm eine Demo eines Zero-Click-Wurms, ein Angriff ohne Nutzerinteraktion, der sich über WeChat-Anrufe auf iOS und Android verbreitet. Das Opfer muss den Anruf nicht annehmen, so die Forscher. Es ist eine Demo, kein gemeldeter Ausbruch. Setze mobile Anrufkanäle als angreifbare Oberfläche auf deine Risiko-Liste.8

IBM veröffentlicht Granite Time Series PatchTST-FM-r2 als SOTA-Modell für Zeitreihen. Die Lizenz ist kommerzfreundlich. Du kannst damit Prognosen produktiv bauen, ohne lange Lizenzprüfungen.9

AWS setzt bei KI-Inference auf Qualcomm, während Qualcomm AWS Bedrock für das Chipdesign nutzt. Es ist eine wechselseitige Vertiefung über mehrere Produktlinien. Plane mit neuen Optionen in AWS-Stacks, die Kosten und Leistung verschieben können.10

Tools und Releases

  • Hugging Face startet ML Intern, ein Chat, der ML-Experimente anstößt und Workflows im Browser zusammenklickt.11
  • Apple erläutert in einem Dokument, wie Siri Recap, Live Rewind, Sound Recognition und Music Recognition trotz permanentem Hören Datenschutz wahren sollen.12
  • Massachusetts verschärft die Strom- und Sauber-Energie-Vorgaben für Rechenzentren als dritter US-Bundesstaat in kurzer Zeit.13
  • Microsoft vereinbart mit der AFT Grundsätze für sichere und datenschutzkonforme KI an Schulen, nach lokalen Verboten.14
  • Apple sagt, das Scharnier des faltbaren iPhone Duo entstand mit KI-gestützter Konstruktion und 3D-Druck.15

Research

  • Nvidia beschreibt Encode-Prefill-Decode-Disaggregation als Architektur, die multimodales Serving beschleunigt, und gibt Kriterien, wann sich der Split lohnt.16

Quellen

  1. OpenAI’s sly mathematical breakthrough sends a chill through academia (theverge.com)
  2. Deploying Qwen3.8-2.4T-A95B on Amazon SageMaker HyperPod with vLLM (aws.amazon.com)
  3. Suno launches v6 music models built with Warner, BMG, and Believe (the-decoder.com)
  4. Suno releases its first AI music model made with record industry help (theverge.com)
  5. Suno replaces its AI models with a new one trained on licensed music as copyright suits pile up (techcrunch.com)
  6. GPT-6 Astra: The System Card, Alignment and What Comes Next (thezvi.substack.com)
  7. GPT-6 Astra: The next generation in intelligence for work (openai.com)
  8. Quoting Calif Research (simonwillison.net)
  9. IBM releases SOTA Granite Time Series PatchTST-FM-r2 model with commercial-friendly license (huggingface.co)
  10. AWS is using Qualcomm for AI inference while Qualcomm uses AWS Bedrock to design the chips (the-decoder.com)
  11. Hugging Face's new ML Intern lets anyone run machine learning experiments through a simple chat (the-decoder.com)
  12. Read the Apple document explaining how new listening features still protect your privacy (theverge.com)
  13. Massachusetts hits data centers with new clean power rules (techcrunch.com)
  14. Microsoft has new AI privacy rules for schools (theverge.com)
  15. The hinge for Apple’s new foldable phone was built with AI (techcrunch.com)
  16. When to Use Encode-Prefill-Decode Disaggregation to Accelerate Multimodal Model Serving (developer.nvidia.com)