Artikel
-
LiteLLM Auto-Router: Deployment-Affinität wird zum Betriebsfeature
Artikel lesen →: LiteLLM Auto-Router: Deployment-Affinität wird zum BetriebsfeatureLiteLLM verschiebt im Release Candidate 1.97.0-rc.1 einen wichtigen Default im Auto-Router: Die Deployment-Affinität ist nun unabhängig und standardmäßig aktiv. Für Gateway-Teams ist das keine kosmetische Router-Option, sondern ein …
-
llama.cpp isoliert Agent-Tools experimentell in Docker
Artikel lesen →: llama.cpp isoliert Agent-Tools experimentell in Dockerllama.cpp kann Agent-Tools jetzt experimentell in einen Docker-Container auslagern. Das Release b10328 ergänzt llama-server um eine Runtime-Option, die eingebaute Datei- und Shell-Tools nicht mehr zwingend im Host-Kontext ausführt. …
-
GitHub Copilot: Ein Agent-Identifier wird zur Kennzahl
Artikel lesen →: GitHub Copilot: Ein Agent-Identifier wird zur KennzahlGitHub trennt die Aktivität externer Agent Apps in der Copilot Usage Metrics API erstmals pro Agent auf. Für Organisationen, die Claude, Codex und Copilot parallel in GitHub einsetzen, …
-
SGLang 0.5.17: Warum Agenten-Inference jetzt Sitzungsgedächtnis braucht
Artikel lesen →: SGLang 0.5.17: Warum Agenten-Inference jetzt Sitzungsgedächtnis brauchtSGLang 0.5.17 ist kein gewöhnliches Runtime-Update: Das Projekt verlegt erstmals den Serving-Pfad vom Netzwerk-Ingress bis zum GPU-Scheduler teilweise in ein Rust-Frontend, ergänzt einen sitzungsbewussten Radix-Cache und erprobt eine …
-
LiteLLM 1.94.2 schließt Token-Leak im MCP-Dashboard
Artikel lesen →: LiteLLM 1.94.2 schließt Token-Leak im MCP-DashboardLiteLLM 1.94.2 räumt eine unnötig riskante Stelle im MCP-Dashboard auf: Session-Daten für MCP-Server werden über den gemeinsamen Browser-Storage-Helfer abgelegt; ein refresh_token bleibt dabei nicht mehr im gespeicherten Payload. …
-
GitHub Copilot: MCP-Sicherheit wird zur Fail-Closed-Policy
Artikel lesen →: GitHub Copilot: MCP-Sicherheit wird zur Fail-Closed-PolicyGitHub Copilot kann MCP-Server in Enterprise-Umgebungen jetzt zentral erlauben oder sperren – und behandelt fehlerhafte oder nicht verifizierbare Richtlinien bewusst als Blockade. Damit wird aus der lokalen Tool-Konfiguration …
-
Kimi K3 in GitHub Copilot: Der Modell-Picker wird zur Governance-Entscheidung
Artikel lesen →: Kimi K3 in GitHub Copilot: Der Modell-Picker wird zur Governance-EntscheidungKimi K3 landet in GitHub Copilot. Für Business und Enterprise entscheidet nun eine Admin-Policy über den Zugang – bei nutzungsbasierter Abrechnung zu Providerpreisen.
-
Cloudflare vereint Workers AI und AI Gateway: Die Control Plane wird zum Routing-Layer
Artikel lesen →: Cloudflare vereint Workers AI und AI Gateway: Die Control Plane wird zum Routing-LayerCloudflare bündelt Workers AI und AI Gateway in einer Control Plane. Entscheidend ist die gemeinsame Schicht für Routing, Abrechnung und Observability über eigene GPUs und externe Modellanbieter.
-
OpenAI Codex 0.147.0: Plugins und MCP machen Coding-Agenten portabler
Artikel lesen →: OpenAI Codex 0.147.0: Plugins und MCP machen Coding-Agenten portablerOpenAI erweitert Codex um portable Agent-Plugins und eine opt-in-Implementierung des MCP-Standards vom 28. Juli 2026. Für Teams ist das weniger ein kosmetisches CLI-Release als ein Baustein für übertragbare …
-
Anthropic senkt Fable-5-Biologie-Fallbacks um 85 Prozent
Artikel lesen →: Anthropic senkt Fable-5-Biologie-Fallbacks um 85 ProzentAnthropic hat den Biologie-Classifier von Claude Fable 5 neu trainiert. Dadurch sollen 85 Prozent weniger harmlose Biologie-Anfragen auf Opus 5 umgeleitet werden – während Dual-Use-Routing bestehen bleibt.