Zum Inhalt springen
beirat
Der KI-Kompass
Beirat Akademie
Blog
Grundlagen
Über uns
Kontakt
Anmelden
◐
Thema
Lokale KI
(2 Beiträge)
Prompt Caching und KV-Cache-Optimierung: Wie Unternehmen Inferenzkosten und Latenzen bei Sprachmodellen um bis zu 90 Prozent senken
03.09.2026 · Lesezeit 5 min
Qwen3.8-27B lokal oder per API: Was das Open-Weights-Modell wirklich kann
25.08.2026 · Lesezeit 7 min