
NVIDIA Nemotron 3 Ultra: Vollständig offenes 550B-MoE-Modell für Agentenworkflows
NVIDIA veröffentlicht Nemotron 3 Ultra — ein vollständig offenes 550B-MoE-Modell mit 5-fach schnellerer Inferenz und Day-0-Unterstützung durch LangChain.

NVIDIA veröffentlicht Nemotron 3 Ultra — ein vollständig offenes 550B-MoE-Modell mit 5-fach schnellerer Inferenz und Day-0-Unterstützung durch LangChain.

Anthropic veröffentlicht Claude Opus 4.8 mit dynamischen Workflows: Hunderte parallele Subagenten, adversarielle Prüfung und verbesserter Kalibrierung.

Ein 32.000-GPU-Stunden-Benchmark bestätigt: Die Harness-Architektur überwiegt die Modellauswahl — sechs unabhängige Quellen konvergieren auf denselben Befund.

Ein autonomer Agent für $20 legte McKinseys Lily-Plattform offen. Experian-Daten bestätigen: Agentische KI ist der führende Bedrohungsvektor des Jahres 2026.

Ein wissenschaftlicher AlphaZero-Benchmark und ein globaler Hackathon bestätigen übereinstimmend Claude Opus 4.7 als aktuellen Frontier in agentic Coding.

DeepSeek-V4 (MIT, 1M-Kontext) und Kimi-K2.6 (multimodal, 256K-Kontext) bilden den ersten vollständigen Open-Weights-Stack für KI-Agenten.

Moonshot AIs Kimi K2.6 führt das Open-Source-Ranking mit 300 parallelen Sub-Agenten und einem 12-Stunden-Coding-Marathon an.

OpenAIs GPT-5.5 erscheint sechs Wochen nach 5.4 mit +7 Pkt. Terminal-Bench, verdoppelten Preisen und Cyber/Bio-Sicherheitseinstufungen auf HIGH.

Anthropic führte einen Live-zweiseitigen Agenten-Marktplatz mit 69 Mitarbeitern durch: 186 Geschäfte, $4.000+ Volumen — und die Modellqualität (Opus vs. Haiku) blieb für die menschlichen Teilnehmer unsichtbar.

GPT-5.5 erzielt 2,5× mehr Intelligenz pro Token als 5.4, übersteigt den menschlichen OS-World-Baseline und erweitert Codex zum vollständigen Desktop-Agenten.
ml-intern liest arXiv, bereinigt Datensätze, führt SFT/GRPO durch und iteriert — GPQA stieg in unter 10 Stunden von 10% auf 32% für etwa 1 Dollar Rechenkosten.
Kuratierte AI-Einblicke. Wir senden, wenn es sich lohnt.