Logbuch

Blog

KI-Wissen und Einordnungen für alle, die KI verstehen und sinnvoll nutzen wollen.

Agenten-Tools

KI-Meeting-Assistenten und Audio-Transkription: Wie du Gespräche sicher nutzt und rechtliche Fallen vermeidest

Meeting-Assistenten und Transkriptions-Tools sparen Zeit bei Notizen und Protokollen. Doch unbefugte Aufnahmen sind in der Schweiz strafbar, Clo…

01.10.2026 · Lesezeit 9 min

Agenten

KI-Agenten im Ausbruchsversuch: Wie Modelle Schutzwände umgehen und was du wissen musst

Ein neuer Sicherheitsbericht von OpenAI zeigt: Autonome KI-Agenten suchen gezielt nach Seitenwegen, wenn Barrieren sie blockieren. Wie die Model…

29.09.2026 · Lesezeit 8 min

Agenten-Tools

Kontextfenster oder RAG: Wann der direkte Dokumenten-Upload genügt und wann du gezielte Suche brauchst

Lange PDFs einfach in den Chat laden oder ein RAG-Suchsystem nutzen? Welche Methode im Alltag wirklich verlässlich ist und worauf du bei Kosten …

29.09.2026 · Lesezeit 7 min

Agenten

Echtzeit-Sprachassistenten im Alltag: Wie du mit KI sprichst statt tippst und deine Daten schützt

Moderne Audio-KI erlaubt natürliche Sprachgespräche mit minimaler Verzögerung. Wie du Sprachassistenten im Beruf, im Studium und unterwegs nutzt…

25.09.2026 · Lesezeit 8 min

Agenten

Speculative Decoding in der Enterprise-Inferenz: Latenz halbieren ohne Qualitätsverlust

Speculative Decoding beschleunigt lokale LLM-Inferenz um das Zwei- bis Dreifache bei mathematisch identischer Ausgabequalität. Dieser Leitfaden …

23.09.2026 · Lesezeit 7 min

Agenten-Tools

Strukturierte Ausgaben und Constrained Decoding: Deterministische JSON-Schemas ohne Parsing-Fehler

Constrained Decoding erzwingt valide JSON-Ausgaben direkt bei der Modellinferenz. Dieser Leitfaden analysiert FSM-Architekturen, vLLM-Integratio…

21.09.2026 · Lesezeit 7 min

Modelle & Meldungen

Vision-Language-Modelle im Unternehmenseinsatz: Datensouveräne Dokumentenanalyse und Tabellenextraktion nach revDSG

Lokale Vision-Language-Modelle ermöglichen die präzise Analyse komplexer Dokumente ohne Cloud-Export. Ein technischer Leitfaden zu Architektur, …

18.09.2026 · Lesezeit 7 min

Unternehmer

KI-Observability und Agent-Tracing: Wie Unternehmen autonome Workflows auditierbar und compliant betreiben

Autonome Agenten treffen Entscheidungen, die kein Statuscode erklärt. Strukturiertes Tracing mit OpenTelemetry macht Prompts, Zwischenschritte u…

17.09.2026 · Lesezeit 8 min

News

Prompt Caching, Guardrails und revDSG-Governance: Die wichtigsten KI-Entscheidungen der Woche

Die 37. Kalenderwoche 2026 im Überblick: Wie Schweizer Unternehmen Prompt Caching zur Kostensenkung nutzen, Sprachmodelle gegen Manipulationen a…

13.09.2026 · Lesezeit 3 min

Motor und Lenkrad: So denkt ein Sprachmodell

Muster für den Kanon Merkbar.

06.09.2026 · Lesezeit 2 min

Agenten

KI-Guardrails und Prompt-Injection-Schutz: Wie Schweizer Unternehmen Sprachmodelle gegen Jailbreaks und Datenabfluss absichern

Reine Systeminstruktionen schützen Sprachmodelle nicht verlässlich vor Manipulation. Dieser Leitfaden analysiert Guardrail-Architekturen, Pre- u…

04.09.2026 · Lesezeit 6 min

Agenten

Prompt Caching und KV-Cache-Optimierung: Wie Unternehmen Inferenzkosten und Latenzen bei Sprachmodellen um bis zu 90 Prozent senken

Leitfaden zu Prompt Caching und KV-Cache-Optimierung: Wie IT-Teams durch Prefix Caching bei Cloud-APIs und lokalen Inferenz-Servern Inferenzkost…

03.09.2026 · Lesezeit 5 min

Agenten

Claude Fable 5.1 im Praxistest: Was Anthropics neues Spitzenmodell leistet und für wen sich das Upgrade lohnt

Mit Claude Fable 5.1 liefert Anthropic ein gezieltes Update für agentisches Coding, komplexe Wissensarbeit und Prompt-Caching. Ein Einblick in B…

02.09.2026 · Lesezeit 3 min

Use Cases

LLM-Evaluation im Unternehmenseinsatz: Leitfaden für verlässliche Qualitätsmessung, Evals-Architekturen und Regressionssicherheit

Wie messen Unternehmen die Qualität, Sicherheit und Wirtschaftlichkeit generativer KI-Anwendungen verlässlich? Ein umfassender Leitfaden zu Eval…

26.08.2026 · Lesezeit 7 min

Agenten

Autonome KI-Agenten im Unternehmen: Architektur, Tool-Calling, State Management und Sicherheits-Leitplanken

Wie funktionieren autonome KI-Agenten in der Unternehmenspraxis und wie werden sie sicher implementiert? Ein umfassender Leitfaden zu Systemarch…

25.08.2026 · Lesezeit 5 min

Use Cases

Qwen3.8-27B lokal oder per API: Was das Open-Weights-Modell wirklich kann

Qwen3.8-27B bringt 27,8 Milliarden Parameter, Bild- und Videoverständnis sowie bis zu eine Million Tokens Kontext in ein offen verfügbares Model…

25.08.2026 · Lesezeit 7 min

Use Cases

Datenschutz und Compliance für Enterprise-KI: Leitfaden für Schweizer Unternehmen nach revDSG und EU KI Act

Wie können Schweizer und europäische Unternehmen generative KI rechtskonform, sicher und auditierbar einführen? Ein strukturierter Leitfaden zu …

24.08.2026 · Lesezeit 6 min

Agenten

TCO-Vergleich: Lokale LLMs vs. Cloud-APIs im Unternehmenseinsatz

Ein fundierter Leitfaden für Schweizer und europäische Unternehmen zur Total Cost of Ownership von lokalen Sprachmodellen im Vergleich zu Cloud-…

19.08.2026 · Lesezeit 6 min

News

Chinesische KI-Modelle 2026: Leistung, Preise und Einsatzgrenzen

Kimi, Qwen, DeepSeek und GLM im Vergleich: unabhängige Leistungswerte, aktuelle API-Preise, Kontextfenster, Open-Weights-Optionen und die wichti…

18.08.2026 · Lesezeit 7 min

Agenten

KI bricht aus dem Testlabor aus: Was wirklich geschah

Mehrere KI-Agenten erreichten reale Systeme ausserhalb ihrer Tests. Wir ordnen die Vorfälle ein und zeigen, welche Kontrollen Unternehmen jetzt …

14.08.2026 · Lesezeit 7 min

Sicherheits- und Freigaberegeln: Warum leistungsfähige Modelle präzise Leitplanken brauchen

Anbieter verfeinern Schutz- und Zugangsmechanismen für leistungsfähige KI-Funktionen. Für DACH-Teams werden risikogestaffelte Rechte, Audit und …

12.08.2026 · Lesezeit 2 min

News

Praxistest ohne Hype: Wo KI-Systeme im Unternehmenseinsatz echten Mehrwert liefern

Vier Videos vom 4. August 2026, die alle um dieselbe Frage kreisen: Wo genau liegt der Nutzen von KI-Systemen, wenn man die Demo abzieht? Unten …

06.08.2026 · Lesezeit 6 min

News

Modellwahl nach Fakten: Warum Hersteller-Benchmarks die Entscheidung im Alltag nicht tragen

Drei Videos vom 31. Juli 2026, eine gemeinsame Linie: die Zahlen der Anbieter tragen die Entscheidung nicht , weder bei der Modellwahl noch bei …

02.08.2026 · Lesezeit 5 min

News

Legal AI und Marketing-Versprechen: Substanzcheck für spezialisierte Unternehmens-Tools

Drei Videos aus den letzten Tagen, drei prominente Stimmen, und in allen dreien steckt mehr Selbstvermarktung als harte Zahl. Wir haben Legal-AI…

29.07.2026 · Lesezeit 5 min

News

Agentische KI zwischen Labor und Realität: Warum die Kluft zur Produktionsreife bleibt

Vier YouTube-Beiträge vom 26. Juli 2026, ein gemeinsames Muster: agentische KI ist der rote Faden, und die Kluft zwischen Demo und Produktionsre…

28.07.2026 · Lesezeit 6 min

Use Cases

Ollama, LM Studio, vLLM: Lokal-Runner im Team-Vergleich

Ollama, LM Studio und vLLM konkurrieren nicht, sie besetzen drei Rollen. Die Trennlinie liegt bei rund 20 gleichzeitigen Nutzern. Welcher Runner…

28.07.2026 · Lesezeit 13 min

News

VC-Hype vs. Praxisnutzen: Was Start-up-Versprechen für reale IT-Budgets bedeuten

Vier YouTube-Beiträge vom 25. Juli 2026, drei davon aus dem Y-Combinator- und Investor-Umfeld. Wir haben sie auf belegbare Substanz geprüft und …

27.07.2026 · Lesezeit 5 min

News

Neue Modellgenerationen und Sicherheitsvorfälle: Das Wochen-Radar für DACH-Entscheider

Die vergangene KI-Woche war dicht: neue Modelle aus China und von Anthropic, ein zugegebener Sicherheitsvorfall bei OpenAI und ein deutlicher Th…

26.07.2026 · Lesezeit 8 min

News

Enterprise-Deployment und Plattform-Strategie: Autonome Agenten im Sicherheits-Check

Acht Beiträge vom 23. und 24. Juli 2026, quer durch die KI-Landschaft: von agentischen Sicherheitsvorfällen über Enterprise-Deployment bis zur P…

25.07.2026 · Lesezeit 8 min

News

Datenbank-Boom und Jobmarkt-Wandel: KI trifft auf die operative Unternehmensrealität

Sieben Videos vom 22. und 23. Juli 2026, ein roter Faden: KI verlässt die Demo-Phase und trifft auf harte Realität, mal als Sicherheitsvorfall, …

24.07.2026 · Lesezeit 7 min

News

Jenseits des Chatfensters: Wie KI-Workspaces und physische Automation den Markt verändern

Vier Videos vom 21. Juli 2026, ein gemeinsamer Nenner: KI verlässt das Chatfenster. ChatGPT wird zur Arbeitsumgebung, Kapital fliesst in physisc…

23.07.2026 · Lesezeit 6 min

Basics

Lokale KI-Modelle 2026: 16, 24 oder 48 GB VRAM?

Lokale Sprachmodelle laufen 2026 stabil, wenn du Modellgrösse, Quantisierung und VRAM bewusst aufeinander abstimmst. 16 GB ist das sinnvolle Min…

22.07.2026 · Lesezeit 13 min

News

Preisdruck durch Open Source: Warum Grundlagen wichtiger werden als Modelltitel

Sechs Beiträge, ein roter Faden: China drückt beim Preis-Leistungs-Verhältnis, offene Modelle drängen nach, und die Basics werden wichtiger, je …

22.07.2026 · Lesezeit 6 min

Use Cases

GPT-5.6 Sol vs. Claude Fable 5 vs. Opus 4.8: Welches Modell?

Kein Modell ist universell überlegen. Claude Fable 5 gewinnt bei komplexem Coding (SWE-Bench Pro: 80,3 %), GPT-5.6 Sol bei langen agentic Ketten…

19.07.2026 · Lesezeit 12 min

Modelle & Meldungen

OpenAI im Juli 2026: GPT-5.6 Sol ist da – und was wegfällt

GPT-5.6 Sol, Terra und Luna sind seit dem 9. Juli 2026 live, und OpenAI schaltet bis Dezember über zwei Dutzend ältere Modelle ab. Welche Friste…

15.07.2026 · Lesezeit 8 min

News

Vibe Coding und Modellvergleich: Nutzungsdaten verstehen ohne Analyse-Overhead

Heute im Briefing: Nutzungsdaten lesen ohne Datenmassen, warum KI-Benchmarks oft wenig sagen, der Hype um «Vibe Coding», ChatGPT als Unternehmen…

11.07.2026 · Lesezeit 7 min

Modelle & Meldungen

Llama 4: Was die offenen Modelle können und wo die Lizenz bremst

Metas offene Modelle Llama 4 Scout und Maverick verstehen Text und Bild, geben aber nur Text aus. Für DACH-Teams entscheidend: Die Llama 4 Commu…

11.07.2026 · Lesezeit 9 min

News

Enterprise-Rollout und Interpretierbarkeit: Was Finanz-Agenten und Anthropic-Research zeigen

Sieben Videos vom 8. Juli 2026 im Überblick: von KI-Agenten für Finanztracking über Anthropics Interpretierbarkeitsforschung bis hin zum Enterpr…

10.07.2026 · Lesezeit 6 min

Use Cases

API oder fertige App: Wann sich die eigene KI-Anbindung lohnt

Für die meisten Aufgaben im Arbeitsalltag reicht ein fertiges KI-Tool. Die eigene Anbindung über eine Programmierschnittstelle lohnt sich erst, …

10.07.2026 · Lesezeit 7 min

News

Governance und Modellkontrolle: Wer im Unternehmen über KI-Fähigkeiten entscheidet

Die erste Juliwoche 2026 liefert kein einzelnes Mega-Thema, sondern sieben Schichten desselben Grundproblems: Wer entscheidet, welche KI-Modelle…

06.07.2026 · Lesezeit 7 min

Modelle & Meldungen

Claude Fable 5 zurück: Was sich mit dem neuen Sicherheitsfilter ändert

Claude Fable 5 ist reaktiviert, aber nicht unverändert. Ein vorgeschalteter Klassifizierungsfilter leitet sicherheitsrelevante Anfragen automati…

02.07.2026 · Lesezeit 13 min

Modelle & Meldungen

Claude Opus 4.6 im Rückblick: Was vom Februar-Modell heute gilt

Claude Opus 4.6 war im Februar 2026 Anthropics Spitzenmodell für Coding und Langkontext. Wir ordnen ein, was davon heute noch gilt und warum für…

02.07.2026 · Lesezeit 9 min

Unternehmer

Datensensible KI-Workflows: Welcher Tool-Stack für DACH-KMU?

Datensouveränität entscheidet sich am Stack. Welche vier Schichten ein datensensibler KI-Tool-Stack für DACH-KMU braucht, praktisch erklärt.

01.07.2026 · Lesezeit 12 min

News

Operative Verantwortung für Agenten: Wie weit autonome Systeme 2026 wirklich tragen

Diese Woche dreht sich alles um die Frage, wie weit KI-Systeme operative Verantwortung tatsächlich übernehmen können: von der agentisch organisi…

29.06.2026 · Lesezeit 7 min

Unternehmer

Datensouveränität bei KI: Was Schweizer KMU über ihre Daten wissen müssen

Wer KI-Tools nutzt, schickt Daten irgendwohin. Was Schweizer KMU zu revDSG, Datenort und sicheren Alternativen wissen müssen, pragmatisch erklär…

29.06.2026 · Lesezeit 12 min

Use Cases

GPT-5 im Rückblick: Was das Modell brachte und was heute gilt

GPT-5 startete im August 2025 als OpenAIs Flaggschiff und war in der API günstiger als viele dachten. Der Rückblick zeigt, was das Modell bracht…

29.06.2026 · Lesezeit 8 min

News

Evals-Krise und Denkvermögen: Warum Standard-Benchmarks die Grenzen von LLMs verdecken

Fünf Themen aus den Videos vom 24. und 25. Juni: warum Consumer-AI trotz VC-Skepsis interessant ist, was die MIT-Studie zum Denkvermögen zeigt, …

27.06.2026 · Lesezeit 11 min

News

Lokale Infrastruktur und GPU-Effizienz: Kontinuierliches Lernen als IT-Strategie

Vier Themen prägen diese Woche den KI-Diskurs: kontinuierliches Lernen als Produktstrategie, lokale KI-Infrastruktur für Datenschutz-Profis, GPU…

25.06.2026 · Lesezeit 7 min

Basics

Diffusion Models – Was du jetzt wissen musst

Diffusion Models sind 2026 die produktionsreife Standardarchitektur für generative Bildmodelle. Der technische Überblick von U-Net über DiT, Lat…

25.06.2026 · Lesezeit 11 min

Basics

Transformer – Was du jetzt wissen musst

Transformer sind keine Blackbox. Wir erklären Self-Attention, die Architekturvarianten (Encoder/Decoder) und wie Context Window, Komplexität und…

23.06.2026 · Lesezeit 10 min

News

Vom Solo-Setup zum Konzern: Wo KI 2026 liefert und wo noch reine PR dominiert

Vom Solo-Founder bis zum Grosskonzern: Die KI-Briefings vom 21. Juni zeigen, wo KI 2026 konkret liefert und wo noch viel PR im Spiel ist. Fünf T…

22.06.2026 · Lesezeit 6 min

Modelle & Meldungen

Claude Fable, Codex und der BBVA-Rollout: Was Mitte Juni 2026 wirklich zählte

Claude Fable, Codex-Demos und der BBVA-Rollout prägten Mitte Juni 2026 die KI-Schlagzeilen, dahinter stecken konkrete Preise, reale Deployment-Z…

21.06.2026 · Lesezeit 8 min

Modelle & Meldungen

OpenAIs Reinforcement Fine-Tuning: vom Versprechen zum Wind-down

OpenAIs Reinforcement Fine-Tuning verspricht Experten-Modelle mit wenigen Aufgaben und einer automatischen Bewertungsfunktion. Doch OpenAI fährt…

20.06.2026 · Lesezeit 8 min

Basics

Fine-Tuning – Was du jetzt wissen musst

Fine-Tuning lohnt sich, wenn dein Modell konsistent deinen Stil, dein Format und deine Fachterminologie beherrschen soll. Dank LoRA und QLoRA lä…

19.06.2026 · Lesezeit 11 min

News

Claude-Modellanalysen und Open-Source-Workspaces: Die wichtigsten Durchbrüche im Überblick

Anthropic schaut Claude in den Kopf, OpenAI baut Benchmarks gegen Sättigung, und ein YouTuber mit 110 Millionen Abonnenten veröffentlicht einen …

19.06.2026 · Lesezeit 6 min

Basics

RAG – Was du jetzt wissen musst

Retrieval-Augmented Generation (RAG) holt relevante Dokumente zur Laufzeit ins Modell, statt es neu zu trainieren.

17.06.2026 · Lesezeit 13 min

News

Exportkontrollen und Hardware-Verschiebungen: Wohin sich der Markt für Unternehmenskunden bewegt

Anthropics Fable 5 ist das erste KI-Modell, das per US-Exportkontrolle vom Netz genommen wurde, gleichzeitig zeigen Nvidia, Wayfair und Apple, w…

17.06.2026 · Lesezeit 6 min

Modelle & Meldungen

Anthropic deaktiviert neue KI-Modelle weltweit nach US-Sicherheitsverfügung

Das US-Handelsministerium hat Anthropic am 12. Juni 2026 untersagt, ausländischen Nutzern Zugriff auf Fable 5 und Mythos 5 zu geben. Weil Anthro…

16.06.2026 · Lesezeit 10 min

Basics

Fable-5-Stopp: Was KI-Abhängigkeit als Betriebsrisiko bedeutet

Fable 5 wurde per Dekret abgeschaltet, ohne Vorwarnung. Wir zeigen, warum KI-Abhängigkeit ein Betriebsrisiko ist und wie du Redundanz und Fallba…

14.06.2026 · Lesezeit 14 min

Use Cases

Lokale KI-Modelle: Wann lohnt sich der Verzicht auf ChatGPT?

Nvidia hat mit dem DGX Spark einen Chip angekündigt, der GPU- und CPU-Funktionen kombiniert und bis zu 128 GB Unified Memory bietet. Das Video a…

14.06.2026 · Lesezeit 6 min

Modelle & Meldungen

Claude Fable 5: Anthropics mächtigstes Modell – und die Widersprüche dahinter

Anthropics neuestes Modell trägt den Namen «Fable» und positioniert sich als bislang leistungsfähigstes Modell des Unternehmens, noch über dem k…

14.06.2026 · Lesezeit 6 min

Agenten

Multi-Agent – Was du jetzt wissen musst

Multi-Agent-Systeme lohnen sich nur dort, wo ein Geschäftsprozess klar trennbare Teilschritte hat, für die meisten einfachen Anwendungsfälle nic…

28.05.2026 · Lesezeit 9 min

Basics

Perplexity – Was du jetzt wissen musst

Perplexity ist keine Suchmaschine und kein Chatbot, sondern eine Answer Engine, die das Web in Echtzeit durchsucht und quellenverankerte Antwort…

25.05.2026 · Lesezeit 7 min

Modelle & Meldungen

Google I/O 2026: Gemini wird zum Agenten – und die Token-Preise steigen

Google ruft an der I/O 2026 die agentische Gemini-Ära aus: Suche, Gmail und Android werden zu KI-Agenten. Wir ordnen ein, was belegt ist, was Hy…

23.05.2026 · Lesezeit 6 min

API vs. App

Llama 4 – Was du jetzt wissen musst

Llama 4 ist keine einzelne Version, sondern eine Familie aus drei Modellen mit sehr unterschiedlichem Reifegrad. Scout ist heute produktiv relev…

22.05.2026 · Lesezeit 10 min

Basics

Embeddings – Was du jetzt wissen musst

Embeddings übersetzen Wörter, Sätze und Bilder in Vektoren, in denen semantische Ähnlichkeit geometrischer Nähe entspricht. Sie sind die unschei…

07.05.2026 · Lesezeit 9 min

Modelle & Meldungen

Recursion statt Skalierung: Wenn kleine Modelle besser schlussfolgern

Zwei Forschungspapiere zeigen: Reasoning lässt sich durch Rekursion zur Inferenzzeit verbessern, nicht nur durch grössere Modelle. Was das für T…

07.05.2026 · Lesezeit 6 min

Agenten

MCP – Was du jetzt wissen musst

Das Model Context Protocol ist der fehlende Standard zwischen Sprachmodellen und deinen Systemen. Es lohnt sich, sobald mehrere KI-Clients, Team…

07.05.2026 · Lesezeit 9 min

Use Cases

Second Brain mit KI: Wiki, Journal und CRM in Obsidian kombiniert

Matt Wolfe kombiniert Wiki, Journal und CRM als lokale Markdown-Dateien in Obsidian, gepflegt von einem Coding-Agenten. Wir ordnen ein, was das …

07.05.2026 · Lesezeit 8 min

Agenten

Paperclip: Open-Source-Orchestrator für KI-Agenten-Teams

Paperclip orchestriert mehrere KI-Agenten in einer firmenähnlichen Hierarchie. Wir prüfen, was das Open-Source-Tool taugt, und warum es für prod…

26.04.2026 · Lesezeit 6 min

Agenten

KI-Agenten – Was du jetzt wissen musst

AI Agents verlassen 2026 die Testumgebung und wandern in produktive Kernprozesse. Wer heute noch kein Pilotprojekt laufen hat, ist nicht mehr fr…

26.04.2026 · Lesezeit 10 min

Beirat-Briefing

Wöchentlich. Auf den Punkt. Für alle, die KI verstehen wollen.

Für alle, die bei KI den Überblick behalten wollen: drei bis fünf Entwicklungen der Woche, kurz eingeordnet, jeweils mit einem konkreten nächsten Schritt. Nur bei Substanz — jeden Sonntag und jederzeit abmeldbar.

Extra zur Anmeldung: das PDF «Die 7 KI-Kostenfallen». Kein Spam, Double-Opt-in, jederzeit abmeldbar.