Autor: Juliana Moretti
-
Google veröffentlicht ATLAS: Warum KI-Nutzung auf Aufgabenebene gemessen werden muss
Artikel lesen →: Google veröffentlicht ATLAS: Warum KI-Nutzung auf Aufgabenebene gemessen werden mussGoogle legt mit ATLAS einen Report zur tatsächlichen KI-Nutzung vor. Entscheidend ist die Trennung von Aktivität, Aufgabe und Adoption – ein nützliches Messgerüst für KI-Teams.
Verfasst von
-
Cursor Router: Wie automatisches Model-Routing AI-Coding-Kosten steuern soll
Artikel lesen →: Cursor Router: Wie automatisches Model-Routing AI-Coding-Kosten steuern sollCursor führt mit „Cursor Router“ ein automatisches Model-Routing für Teams und Enterprise ein. Statt ein einziges Modell für jede Coding-Anfrage festzuschreiben, klassifiziert der Dienst Anfrage, Repository-Kontext, Aufgabenkomplexität und …
Verfasst von
-
Hugging Face bringt 4-Bit-Diffusion-Inferenz mit Nunchaku in Diffusers
Artikel lesen →: Hugging Face bringt 4-Bit-Diffusion-Inferenz mit Nunchaku in DiffusersHugging Face integriert Nunchaku in Diffusers. Was 4-Bit-Quantisierung für VRAM, GPU-Auswahl und den Betrieb von Diffusion-Transformern praktisch verändert.
Verfasst von
-
OpenAI- und Hugging-Face-Incident: Warum Agenten-Evals harte Systemgrenzen brauchen
Artikel lesen →: OpenAI- und Hugging-Face-Incident: Warum Agenten-Evals harte Systemgrenzen brauchenEin Sicherheitsvorfall während einer Modell-Evaluierung zeigt: Agenten-Evals brauchen isolierte Sandboxes, minimale Rechte und kontrollierten Netzwerkzugang.
Verfasst von
-
Google bringt Gemini 3.6 Flash, Flash-Lite und Flash Cyber: Was sich für Modellrouting ändert
Artikel lesen →: Google bringt Gemini 3.6 Flash, Flash-Lite und Flash Cyber: Was sich für Modellrouting ändertGoogle erweitert sein Gemini-Portfolio um Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und Gemini 3.5 Flash Cyber. Für Teams ist das weniger ein einfacher Modell-Refresh als eine Routing-Frage: Schnelligkeit, …
Verfasst von
-
NVIDIA veröffentlicht Cosmos 3 Edge: Ein 4B-Weltmodell für lokale Physical AI
Artikel lesen →: NVIDIA veröffentlicht Cosmos 3 Edge: Ein 4B-Weltmodell für lokale Physical AINVIDIA veröffentlicht Cosmos 3 Edge als kompaktes 4B-Weltmodell für multimodale Physical-AI-Workloads. Entscheidend ist, wie Teams es sicher in lokale Robotik- und Sensorikpfade integrieren.
Verfasst von
-
Qwen3.8-Max-Preview ist in QwenCloud gelistet: Was Teams jetzt prüfen sollten
Artikel lesen →: Qwen3.8-Max-Preview ist in QwenCloud gelistet: Was Teams jetzt prüfen solltenQwenCloud listet Qwen3.8-Max-Preview im Token Plan. Für Teams zählt jetzt ein kontrollierter Canary-Test statt eines vorschnellen Modellwechsels.
Verfasst von
-
LiteLLM 1.93.0: Mehr Kontrolle für MCP-Identitäten und Routing
Artikel lesen →: LiteLLM 1.93.0: Mehr Kontrolle für MCP-Identitäten und RoutingLiteLLM 1.93.0 trennt Router-Limits für Ein- und Ausgabe, ergänzt einen Entra-OBO-Pfad für MCP und härtet Spend-Logs gegen Bearer-Key-Leaks.
Verfasst von
-
NVIDIA und Hugging Face skalieren das Fine-Tuning für Bild- und Videomodelle
Artikel lesen →: NVIDIA und Hugging Face skalieren das Fine-Tuning für Bild- und VideomodelleDer Engpass ist nicht mehr nur die Inferenz NVIDIA und Hugging Face koppeln NeMo AutoModel mit Diffusers, um das Fine-Tuning von Bild- und Videomodellen auf mehrere GPUs und …
Verfasst von
-
OpenAI will KI-Erfolg als „Useful Work“ messen
Artikel lesen →: OpenAI will KI-Erfolg als „Useful Work“ messenOpenAI schlägt für KI-Projekte eine andere Erfolgsrechnung vor: Nicht Tokenverbrauch oder Modellgröße sollen im Zentrum stehen, sondern der Anteil erfolgreich abgeschlossener Aufgaben.Die am 17. Juli veröffentlichte AI Scorecard …
Verfasst von









