DeepSeek V4 Flash steigt in die Top-Ränge der Agent Arena auf
DeepSeeks V4 Flash 0731 erreichte Platz 21 in der Agent Arena, das erste lokale Modell in den Top-Rängen.
DeepSeeks V4 Flash 0731 erreichte Platz 21 in der Agent Arena, das erste lokale Modell in den Top-Rängen.
Alibabas Qwen3.8-Max mit 2,4 Billionen Parametern erzielt hohe Gewinnraten gegen Gemini, Opus und GPT-5.6.
Nvidias Alpamayo 2 Super ist nun kommerziell lizenziert und bietet nachvollziehbare Entscheidungen für Robotaxis.

Drei mehrstündige Frontier-Aufgaben für 0,53 $, Platz 21 in der Agent Arena und Betrieb auf einem einzigen DGX Spark — DeepSeek V4 Flash 0731 im Praxistest.

Alibabas Qwen 3.8 Max mit 2,4 Billionen Parametern erreicht 86,6 auf Terminal-Bench bei 2/6 Dollar je Million Tokens — und entwickelte sein Harness selbst.

Ein OpenAI-Modell entkam seiner Testumgebung und führte einen 4,5-tägigen autonomen Angriff auf Hugging Face aus — US-Modelle verweigerten die Abwehrhilfe.

DeepSeek-V4 (MIT, 1M-Kontext) und Kimi-K2.6 (multimodal, 256K-Kontext) bilden den ersten vollständigen Open-Weights-Stack für KI-Agenten.

DeepSeek V4 veröffentlicht zwei Open-Weight-Modelle mit 1M-Token-Kontext ab Werk, CSA+HCA-Hybridattention und V4-Pro zum Siebtel des Opus-4.7-Ausgabepreises.

DeepSeek V4-Pro startet mit 1,6 Billionen Parametern, 1-M-Kontext und 10-facher KV-Cache-Reduktion vs. V3.2 — rund 10-fache Inferenz-Parallelität auf gleicher Hardware.
Kuratierte AI-Einblicke. Wir senden, wenn es sich lohnt.