sudo-ai.de · unabhängige technische Einordnung
Stack & Signal
Was sich bei Modellen, Agenten und AI-Infrastruktur wirklich verschiebt — technisch geprüft, operativ eingeordnet, ohne Hype-Theater.
Im Fokus
-

Liquid AI LFM2.5-Encoder: Warum Long-Context-NLP auf CPU wieder eine Architekturentscheidung ist
Liquid AI veröffentlicht zwei Long-Context-Encoder für CPU-Betrieb. Warum spezialisierte Modelle die LLM-Kostenarchitektur bei Klassifikation und Triage verändern können.
Neu im Index
Alle Artikel →-

MCP Python SDK 2.0: Warum ein Dependency-Update jetzt zum Protokoll-Migrationsprojekt wird
MCP Python SDK 2.0 ist stabil. Weil pip nun automatisch 2.x installiert, wird ein Dependency-Update für viele MCP-Server…
-

NVIDIA Cosmos-H-Dreams: Warum 160 fps generative Simulation für Operationsrobotik verändert
NVIDIA stellt mit Cosmos-H-Dreams eine Forschungsplattform für generative Echtzeit-Simulationen in der chirurgischen Robotik vor. Der interessante Teil ist…
-

Open WebUI 0.11.0: Sub-Agents machen die lokale LLM-Oberfläche zur Agenten-Runtime
Open WebUI 0.11.0 führt steuerbare Sub-Agents ein. Warum das für Self-Hosted-Teams eine neue Betriebs- und Sicherheitsfläche schafft.
-

MAI-Cyber-1 Flash: Warum agentische Security jetzt an Freigabegrenzen scheitert
Microsoft kombiniert mit MAI-Cyber-1 Flash ein eigenes Security-Modell und eine agentische Sicherheitsplattform. Entscheidend ist nicht, ob ein Agent…
-

NVIDIA NOOA: Warum Agenten als Python-Objekte statt Workflow-Graphen zählen
NVIDIA Labs hat mit NOOA eine Open-Source-Research-Preview für Agenten veröffentlicht, die einen ungewohnten Schwerpunkt setzt: Der Agent ist…
-

NVIDIA Nemotron 3 Ultra: Was agentisches RTL-Coding für Verifikationsteams verändert
NVIDIA meldet 97,1 % Pass Rate für ACE-RTL mit Nemotron 3 Ultra. Relevant ist weniger der Benchmarkwert als…
-

Ollama 0.32.4: Warum Quantisierung jetzt zur Apple-Silicon-Betriebsfrage wird
Ollama 0.32.4 räumt gleich an drei Stellen auf, die für lokale Inferenz auf Apple Silicon relevant sind: Die…
-

SGLang 0.5.16: Spekulatives Decoding wird dynamischer – das Upgrade ist trotzdem kein Selbstläufer
SGLang 0.5.16 bringt confidence-gesteuertes speculative decoding. Für Betreiber zählen mindestens genauso die entfernten Quantisierungspfade, neue Defaults und umbenannte…