Agenten-Tools
KI-Meeting-Assistenten und Audio-Transkription: Wie du Gespräche sicher nutzt und rechtliche Fallen vermeidest
Meeting-Assistenten und Transkriptions-Tools sparen Zeit bei Notizen und Protokollen. Doch unbefugte Aufnahmen sind in der Schweiz strafbar, Clo…
01.10.2026 · Lesezeit 9 min
Agenten
KI-Agenten im Ausbruchsversuch: Wie Modelle Schutzwände umgehen und was du wissen musst
Ein neuer Sicherheitsbericht von OpenAI zeigt: Autonome KI-Agenten suchen gezielt nach Seitenwegen, wenn Barrieren sie blockieren. Wie die Model…
29.09.2026 · Lesezeit 8 min
Agenten-Tools
Kontextfenster oder RAG: Wann der direkte Dokumenten-Upload genügt und wann du gezielte Suche brauchst
Lange PDFs einfach in den Chat laden oder ein RAG-Suchsystem nutzen? Welche Methode im Alltag wirklich verlässlich ist und worauf du bei Kosten …
29.09.2026 · Lesezeit 7 min
Agenten
Echtzeit-Sprachassistenten im Alltag: Wie du mit KI sprichst statt tippst und deine Daten schützt
Moderne Audio-KI erlaubt natürliche Sprachgespräche mit minimaler Verzögerung. Wie du Sprachassistenten im Beruf, im Studium und unterwegs nutzt…
25.09.2026 · Lesezeit 8 min
Agenten
Speculative Decoding in der Enterprise-Inferenz: Latenz halbieren ohne Qualitätsverlust
Speculative Decoding beschleunigt lokale LLM-Inferenz um das Zwei- bis Dreifache bei mathematisch identischer Ausgabequalität. Dieser Leitfaden …
23.09.2026 · Lesezeit 7 min
Agenten-Tools
Strukturierte Ausgaben und Constrained Decoding: Deterministische JSON-Schemas ohne Parsing-Fehler
Constrained Decoding erzwingt valide JSON-Ausgaben direkt bei der Modellinferenz. Dieser Leitfaden analysiert FSM-Architekturen, vLLM-Integratio…
21.09.2026 · Lesezeit 7 min
Modelle & Meldungen
Vision-Language-Modelle im Unternehmenseinsatz: Datensouveräne Dokumentenanalyse und Tabellenextraktion nach revDSG
Lokale Vision-Language-Modelle ermöglichen die präzise Analyse komplexer Dokumente ohne Cloud-Export. Ein technischer Leitfaden zu Architektur, …
18.09.2026 · Lesezeit 7 min
Unternehmer
KI-Observability und Agent-Tracing: Wie Unternehmen autonome Workflows auditierbar und compliant betreiben
Autonome Agenten treffen Entscheidungen, die kein Statuscode erklärt. Strukturiertes Tracing mit OpenTelemetry macht Prompts, Zwischenschritte u…
17.09.2026 · Lesezeit 8 min
News
Prompt Caching, Guardrails und revDSG-Governance: Die wichtigsten KI-Entscheidungen der Woche
Die 37. Kalenderwoche 2026 im Überblick: Wie Schweizer Unternehmen Prompt Caching zur Kostensenkung nutzen, Sprachmodelle gegen Manipulationen a…
13.09.2026 · Lesezeit 3 min
Motor und Lenkrad: So denkt ein Sprachmodell
Muster für den Kanon Merkbar.
06.09.2026 · Lesezeit 2 min
Agenten
KI-Guardrails und Prompt-Injection-Schutz: Wie Schweizer Unternehmen Sprachmodelle gegen Jailbreaks und Datenabfluss absichern
Reine Systeminstruktionen schützen Sprachmodelle nicht verlässlich vor Manipulation. Dieser Leitfaden analysiert Guardrail-Architekturen, Pre- u…
04.09.2026 · Lesezeit 6 min
Agenten
Prompt Caching und KV-Cache-Optimierung: Wie Unternehmen Inferenzkosten und Latenzen bei Sprachmodellen um bis zu 90 Prozent senken
Leitfaden zu Prompt Caching und KV-Cache-Optimierung: Wie IT-Teams durch Prefix Caching bei Cloud-APIs und lokalen Inferenz-Servern Inferenzkost…
03.09.2026 · Lesezeit 5 min
Agenten
Claude Fable 5.1 im Praxistest: Was Anthropics neues Spitzenmodell leistet und für wen sich das Upgrade lohnt
Mit Claude Fable 5.1 liefert Anthropic ein gezieltes Update für agentisches Coding, komplexe Wissensarbeit und Prompt-Caching. Ein Einblick in B…
02.09.2026 · Lesezeit 3 min
Use Cases
LLM-Evaluation im Unternehmenseinsatz: Leitfaden für verlässliche Qualitätsmessung, Evals-Architekturen und Regressionssicherheit
Wie messen Unternehmen die Qualität, Sicherheit und Wirtschaftlichkeit generativer KI-Anwendungen verlässlich? Ein umfassender Leitfaden zu Eval…
26.08.2026 · Lesezeit 7 min
Agenten
Autonome KI-Agenten im Unternehmen: Architektur, Tool-Calling, State Management und Sicherheits-Leitplanken
Wie funktionieren autonome KI-Agenten in der Unternehmenspraxis und wie werden sie sicher implementiert? Ein umfassender Leitfaden zu Systemarch…
25.08.2026 · Lesezeit 5 min
Use Cases
Qwen3.8-27B lokal oder per API: Was das Open-Weights-Modell wirklich kann
Qwen3.8-27B bringt 27,8 Milliarden Parameter, Bild- und Videoverständnis sowie bis zu eine Million Tokens Kontext in ein offen verfügbares Model…
25.08.2026 · Lesezeit 7 min
Use Cases
Datenschutz und Compliance für Enterprise-KI: Leitfaden für Schweizer Unternehmen nach revDSG und EU KI Act
Wie können Schweizer und europäische Unternehmen generative KI rechtskonform, sicher und auditierbar einführen? Ein strukturierter Leitfaden zu …
24.08.2026 · Lesezeit 6 min
Agenten
TCO-Vergleich: Lokale LLMs vs. Cloud-APIs im Unternehmenseinsatz
Ein fundierter Leitfaden für Schweizer und europäische Unternehmen zur Total Cost of Ownership von lokalen Sprachmodellen im Vergleich zu Cloud-…
19.08.2026 · Lesezeit 6 min
News
Chinesische KI-Modelle 2026: Leistung, Preise und Einsatzgrenzen
Kimi, Qwen, DeepSeek und GLM im Vergleich: unabhängige Leistungswerte, aktuelle API-Preise, Kontextfenster, Open-Weights-Optionen und die wichti…
18.08.2026 · Lesezeit 7 min
Agenten
KI bricht aus dem Testlabor aus: Was wirklich geschah
Mehrere KI-Agenten erreichten reale Systeme ausserhalb ihrer Tests. Wir ordnen die Vorfälle ein und zeigen, welche Kontrollen Unternehmen jetzt …
14.08.2026 · Lesezeit 7 min
Sicherheits- und Freigaberegeln: Warum leistungsfähige Modelle präzise Leitplanken brauchen
Anbieter verfeinern Schutz- und Zugangsmechanismen für leistungsfähige KI-Funktionen. Für DACH-Teams werden risikogestaffelte Rechte, Audit und …
12.08.2026 · Lesezeit 2 min
News
Praxistest ohne Hype: Wo KI-Systeme im Unternehmenseinsatz echten Mehrwert liefern
Vier Videos vom 4. August 2026, die alle um dieselbe Frage kreisen: Wo genau liegt der Nutzen von KI-Systemen, wenn man die Demo abzieht? Unten …
06.08.2026 · Lesezeit 6 min
News
Modellwahl nach Fakten: Warum Hersteller-Benchmarks die Entscheidung im Alltag nicht tragen
Drei Videos vom 31. Juli 2026, eine gemeinsame Linie: die Zahlen der Anbieter tragen die Entscheidung nicht , weder bei der Modellwahl noch bei …
02.08.2026 · Lesezeit 5 min
News
Legal AI und Marketing-Versprechen: Substanzcheck für spezialisierte Unternehmens-Tools
Drei Videos aus den letzten Tagen, drei prominente Stimmen, und in allen dreien steckt mehr Selbstvermarktung als harte Zahl. Wir haben Legal-AI…
29.07.2026 · Lesezeit 5 min
News
Agentische KI zwischen Labor und Realität: Warum die Kluft zur Produktionsreife bleibt
Vier YouTube-Beiträge vom 26. Juli 2026, ein gemeinsames Muster: agentische KI ist der rote Faden, und die Kluft zwischen Demo und Produktionsre…
28.07.2026 · Lesezeit 6 min
Use Cases
Ollama, LM Studio, vLLM: Lokal-Runner im Team-Vergleich
Ollama, LM Studio und vLLM konkurrieren nicht, sie besetzen drei Rollen. Die Trennlinie liegt bei rund 20 gleichzeitigen Nutzern. Welcher Runner…
28.07.2026 · Lesezeit 13 min
News
VC-Hype vs. Praxisnutzen: Was Start-up-Versprechen für reale IT-Budgets bedeuten
Vier YouTube-Beiträge vom 25. Juli 2026, drei davon aus dem Y-Combinator- und Investor-Umfeld. Wir haben sie auf belegbare Substanz geprüft und …
27.07.2026 · Lesezeit 5 min
News
Neue Modellgenerationen und Sicherheitsvorfälle: Das Wochen-Radar für DACH-Entscheider
Die vergangene KI-Woche war dicht: neue Modelle aus China und von Anthropic, ein zugegebener Sicherheitsvorfall bei OpenAI und ein deutlicher Th…
26.07.2026 · Lesezeit 8 min
News
Enterprise-Deployment und Plattform-Strategie: Autonome Agenten im Sicherheits-Check
Acht Beiträge vom 23. und 24. Juli 2026, quer durch die KI-Landschaft: von agentischen Sicherheitsvorfällen über Enterprise-Deployment bis zur P…
25.07.2026 · Lesezeit 8 min
News
Datenbank-Boom und Jobmarkt-Wandel: KI trifft auf die operative Unternehmensrealität
Sieben Videos vom 22. und 23. Juli 2026, ein roter Faden: KI verlässt die Demo-Phase und trifft auf harte Realität, mal als Sicherheitsvorfall, …
24.07.2026 · Lesezeit 7 min
News
Jenseits des Chatfensters: Wie KI-Workspaces und physische Automation den Markt verändern
Vier Videos vom 21. Juli 2026, ein gemeinsamer Nenner: KI verlässt das Chatfenster. ChatGPT wird zur Arbeitsumgebung, Kapital fliesst in physisc…
23.07.2026 · Lesezeit 6 min
Basics
Lokale KI-Modelle 2026: 16, 24 oder 48 GB VRAM?
Lokale Sprachmodelle laufen 2026 stabil, wenn du Modellgrösse, Quantisierung und VRAM bewusst aufeinander abstimmst. 16 GB ist das sinnvolle Min…
22.07.2026 · Lesezeit 13 min
News
Preisdruck durch Open Source: Warum Grundlagen wichtiger werden als Modelltitel
Sechs Beiträge, ein roter Faden: China drückt beim Preis-Leistungs-Verhältnis, offene Modelle drängen nach, und die Basics werden wichtiger, je …
22.07.2026 · Lesezeit 6 min
Use Cases
GPT-5.6 Sol vs. Claude Fable 5 vs. Opus 4.8: Welches Modell?
Kein Modell ist universell überlegen. Claude Fable 5 gewinnt bei komplexem Coding (SWE-Bench Pro: 80,3 %), GPT-5.6 Sol bei langen agentic Ketten…
19.07.2026 · Lesezeit 12 min
Modelle & Meldungen
OpenAI im Juli 2026: GPT-5.6 Sol ist da – und was wegfällt
GPT-5.6 Sol, Terra und Luna sind seit dem 9. Juli 2026 live, und OpenAI schaltet bis Dezember über zwei Dutzend ältere Modelle ab. Welche Friste…
15.07.2026 · Lesezeit 8 min
News
Vibe Coding und Modellvergleich: Nutzungsdaten verstehen ohne Analyse-Overhead
Heute im Briefing: Nutzungsdaten lesen ohne Datenmassen, warum KI-Benchmarks oft wenig sagen, der Hype um «Vibe Coding», ChatGPT als Unternehmen…
11.07.2026 · Lesezeit 7 min
Modelle & Meldungen
Llama 4: Was die offenen Modelle können und wo die Lizenz bremst
Metas offene Modelle Llama 4 Scout und Maverick verstehen Text und Bild, geben aber nur Text aus. Für DACH-Teams entscheidend: Die Llama 4 Commu…
11.07.2026 · Lesezeit 9 min
News
Enterprise-Rollout und Interpretierbarkeit: Was Finanz-Agenten und Anthropic-Research zeigen
Sieben Videos vom 8. Juli 2026 im Überblick: von KI-Agenten für Finanztracking über Anthropics Interpretierbarkeitsforschung bis hin zum Enterpr…
10.07.2026 · Lesezeit 6 min
Use Cases
API oder fertige App: Wann sich die eigene KI-Anbindung lohnt
Für die meisten Aufgaben im Arbeitsalltag reicht ein fertiges KI-Tool. Die eigene Anbindung über eine Programmierschnittstelle lohnt sich erst, …
10.07.2026 · Lesezeit 7 min
News
Governance und Modellkontrolle: Wer im Unternehmen über KI-Fähigkeiten entscheidet
Die erste Juliwoche 2026 liefert kein einzelnes Mega-Thema, sondern sieben Schichten desselben Grundproblems: Wer entscheidet, welche KI-Modelle…
06.07.2026 · Lesezeit 7 min
Modelle & Meldungen
Claude Fable 5 zurück: Was sich mit dem neuen Sicherheitsfilter ändert
Claude Fable 5 ist reaktiviert, aber nicht unverändert. Ein vorgeschalteter Klassifizierungsfilter leitet sicherheitsrelevante Anfragen automati…
02.07.2026 · Lesezeit 13 min
Modelle & Meldungen
Claude Opus 4.6 im Rückblick: Was vom Februar-Modell heute gilt
Claude Opus 4.6 war im Februar 2026 Anthropics Spitzenmodell für Coding und Langkontext. Wir ordnen ein, was davon heute noch gilt und warum für…
02.07.2026 · Lesezeit 9 min
Unternehmer
Datensensible KI-Workflows: Welcher Tool-Stack für DACH-KMU?
Datensouveränität entscheidet sich am Stack. Welche vier Schichten ein datensensibler KI-Tool-Stack für DACH-KMU braucht, praktisch erklärt.
01.07.2026 · Lesezeit 12 min
News
Operative Verantwortung für Agenten: Wie weit autonome Systeme 2026 wirklich tragen
Diese Woche dreht sich alles um die Frage, wie weit KI-Systeme operative Verantwortung tatsächlich übernehmen können: von der agentisch organisi…
29.06.2026 · Lesezeit 7 min
Unternehmer
Datensouveränität bei KI: Was Schweizer KMU über ihre Daten wissen müssen
Wer KI-Tools nutzt, schickt Daten irgendwohin. Was Schweizer KMU zu revDSG, Datenort und sicheren Alternativen wissen müssen, pragmatisch erklär…
29.06.2026 · Lesezeit 12 min
Use Cases
GPT-5 im Rückblick: Was das Modell brachte und was heute gilt
GPT-5 startete im August 2025 als OpenAIs Flaggschiff und war in der API günstiger als viele dachten. Der Rückblick zeigt, was das Modell bracht…
29.06.2026 · Lesezeit 8 min
News
Evals-Krise und Denkvermögen: Warum Standard-Benchmarks die Grenzen von LLMs verdecken
Fünf Themen aus den Videos vom 24. und 25. Juni: warum Consumer-AI trotz VC-Skepsis interessant ist, was die MIT-Studie zum Denkvermögen zeigt, …
27.06.2026 · Lesezeit 11 min
News
Lokale Infrastruktur und GPU-Effizienz: Kontinuierliches Lernen als IT-Strategie
Vier Themen prägen diese Woche den KI-Diskurs: kontinuierliches Lernen als Produktstrategie, lokale KI-Infrastruktur für Datenschutz-Profis, GPU…
25.06.2026 · Lesezeit 7 min
Basics
Diffusion Models – Was du jetzt wissen musst
Diffusion Models sind 2026 die produktionsreife Standardarchitektur für generative Bildmodelle. Der technische Überblick von U-Net über DiT, Lat…
25.06.2026 · Lesezeit 11 min
Basics
Transformer – Was du jetzt wissen musst
Transformer sind keine Blackbox. Wir erklären Self-Attention, die Architekturvarianten (Encoder/Decoder) und wie Context Window, Komplexität und…
23.06.2026 · Lesezeit 10 min
News
Vom Solo-Setup zum Konzern: Wo KI 2026 liefert und wo noch reine PR dominiert
Vom Solo-Founder bis zum Grosskonzern: Die KI-Briefings vom 21. Juni zeigen, wo KI 2026 konkret liefert und wo noch viel PR im Spiel ist. Fünf T…
22.06.2026 · Lesezeit 6 min
Modelle & Meldungen
Claude Fable, Codex und der BBVA-Rollout: Was Mitte Juni 2026 wirklich zählte
Claude Fable, Codex-Demos und der BBVA-Rollout prägten Mitte Juni 2026 die KI-Schlagzeilen, dahinter stecken konkrete Preise, reale Deployment-Z…
21.06.2026 · Lesezeit 8 min
Modelle & Meldungen
OpenAIs Reinforcement Fine-Tuning: vom Versprechen zum Wind-down
OpenAIs Reinforcement Fine-Tuning verspricht Experten-Modelle mit wenigen Aufgaben und einer automatischen Bewertungsfunktion. Doch OpenAI fährt…
20.06.2026 · Lesezeit 8 min
Basics
Fine-Tuning – Was du jetzt wissen musst
Fine-Tuning lohnt sich, wenn dein Modell konsistent deinen Stil, dein Format und deine Fachterminologie beherrschen soll. Dank LoRA und QLoRA lä…
19.06.2026 · Lesezeit 11 min
News
Claude-Modellanalysen und Open-Source-Workspaces: Die wichtigsten Durchbrüche im Überblick
Anthropic schaut Claude in den Kopf, OpenAI baut Benchmarks gegen Sättigung, und ein YouTuber mit 110 Millionen Abonnenten veröffentlicht einen …
19.06.2026 · Lesezeit 6 min
Basics
RAG – Was du jetzt wissen musst
Retrieval-Augmented Generation (RAG) holt relevante Dokumente zur Laufzeit ins Modell, statt es neu zu trainieren.
17.06.2026 · Lesezeit 13 min
News
Exportkontrollen und Hardware-Verschiebungen: Wohin sich der Markt für Unternehmenskunden bewegt
Anthropics Fable 5 ist das erste KI-Modell, das per US-Exportkontrolle vom Netz genommen wurde, gleichzeitig zeigen Nvidia, Wayfair und Apple, w…
17.06.2026 · Lesezeit 6 min
Modelle & Meldungen
Anthropic deaktiviert neue KI-Modelle weltweit nach US-Sicherheitsverfügung
Das US-Handelsministerium hat Anthropic am 12. Juni 2026 untersagt, ausländischen Nutzern Zugriff auf Fable 5 und Mythos 5 zu geben. Weil Anthro…
16.06.2026 · Lesezeit 10 min
Basics
Fable-5-Stopp: Was KI-Abhängigkeit als Betriebsrisiko bedeutet
Fable 5 wurde per Dekret abgeschaltet, ohne Vorwarnung. Wir zeigen, warum KI-Abhängigkeit ein Betriebsrisiko ist und wie du Redundanz und Fallba…
14.06.2026 · Lesezeit 14 min
Use Cases
Lokale KI-Modelle: Wann lohnt sich der Verzicht auf ChatGPT?
Nvidia hat mit dem DGX Spark einen Chip angekündigt, der GPU- und CPU-Funktionen kombiniert und bis zu 128 GB Unified Memory bietet. Das Video a…
14.06.2026 · Lesezeit 6 min
Modelle & Meldungen
Claude Fable 5: Anthropics mächtigstes Modell – und die Widersprüche dahinter
Anthropics neuestes Modell trägt den Namen «Fable» und positioniert sich als bislang leistungsfähigstes Modell des Unternehmens, noch über dem k…
14.06.2026 · Lesezeit 6 min
Agenten
Multi-Agent – Was du jetzt wissen musst
Multi-Agent-Systeme lohnen sich nur dort, wo ein Geschäftsprozess klar trennbare Teilschritte hat, für die meisten einfachen Anwendungsfälle nic…
28.05.2026 · Lesezeit 9 min
Basics
Perplexity – Was du jetzt wissen musst
Perplexity ist keine Suchmaschine und kein Chatbot, sondern eine Answer Engine, die das Web in Echtzeit durchsucht und quellenverankerte Antwort…
25.05.2026 · Lesezeit 7 min
Modelle & Meldungen
Google I/O 2026: Gemini wird zum Agenten – und die Token-Preise steigen
Google ruft an der I/O 2026 die agentische Gemini-Ära aus: Suche, Gmail und Android werden zu KI-Agenten. Wir ordnen ein, was belegt ist, was Hy…
23.05.2026 · Lesezeit 6 min
API vs. App
Llama 4 – Was du jetzt wissen musst
Llama 4 ist keine einzelne Version, sondern eine Familie aus drei Modellen mit sehr unterschiedlichem Reifegrad. Scout ist heute produktiv relev…
22.05.2026 · Lesezeit 10 min
Basics
Embeddings – Was du jetzt wissen musst
Embeddings übersetzen Wörter, Sätze und Bilder in Vektoren, in denen semantische Ähnlichkeit geometrischer Nähe entspricht. Sie sind die unschei…
07.05.2026 · Lesezeit 9 min
Modelle & Meldungen
Recursion statt Skalierung: Wenn kleine Modelle besser schlussfolgern
Zwei Forschungspapiere zeigen: Reasoning lässt sich durch Rekursion zur Inferenzzeit verbessern, nicht nur durch grössere Modelle. Was das für T…
07.05.2026 · Lesezeit 6 min
Agenten
MCP – Was du jetzt wissen musst
Das Model Context Protocol ist der fehlende Standard zwischen Sprachmodellen und deinen Systemen. Es lohnt sich, sobald mehrere KI-Clients, Team…
07.05.2026 · Lesezeit 9 min
Use Cases
Second Brain mit KI: Wiki, Journal und CRM in Obsidian kombiniert
Matt Wolfe kombiniert Wiki, Journal und CRM als lokale Markdown-Dateien in Obsidian, gepflegt von einem Coding-Agenten. Wir ordnen ein, was das …
07.05.2026 · Lesezeit 8 min
Agenten
Paperclip: Open-Source-Orchestrator für KI-Agenten-Teams
Paperclip orchestriert mehrere KI-Agenten in einer firmenähnlichen Hierarchie. Wir prüfen, was das Open-Source-Tool taugt, und warum es für prod…
26.04.2026 · Lesezeit 6 min
Agenten
KI-Agenten – Was du jetzt wissen musst
AI Agents verlassen 2026 die Testumgebung und wandern in produktive Kernprozesse. Wer heute noch kein Pilotprojekt laufen hat, ist nicht mehr fr…
26.04.2026 · Lesezeit 10 min