Blog
Engineering notes on AI agents, automation, and the infrastructure behind them.

September 14, 2026 · 6 min read
Foundry oder eigener Kontext-Layer? Umfang, Betriebskosten und Freigaben für den Mittelstand vergleichen. Mit lokalem Open-Source-Beispiel.
September 11, 2026 · 7 min read
Ein temporaler Wissensgraph speichert jeden Fakt mit Gültigkeit und Erfassungszeit. Wie er für KI-Agenten funktioniert, wie Graphiti ihn umsetzt und wann er passt.

July 5, 2026 · 8 min read
Claude Fable 5 und 5.1 kosten 10/50 USD pro Million Tokens, doppelt so viel wie Opus 5. Was die Rechnung treibt und wie Sie den Verbrauch steuern.

May 21, 2026 · 4 min read
Fünf Voice-AI-Anbieter im direkten Vergleich für DACH-IT-Verantwortliche: Datenresidenz, NIS2-Tauglichkeit, Kosten, Wechselfähigkeit.

May 21, 2026 · 3 min read
Eine Seite. Sieben Audit-Kategorien. Was Sie bei jedem hosted Voice-AI-Anbieter prüfen müssen, bevor Sie unter NIS2 unterschreiben.

May 9, 2026 · 6 min read
KI-Prozessautomatisierung 2026: Use Cases aus DACH, Integration mit SAP, HubSpot, n8n, Workflows mit Claude. Praxisleitfaden, AI Made in Germany.

April 29, 2026 · 14 min read
Claude Code auf lokalem LLM via ANTHROPIC_BASE_URL. Native Anthropic-Endpoints für Ollama, LM Studio, llama.cpp, vLLM. 32K-Kontext-Untergrenze.

April 24, 2026 · 14 min read
EU AI Act im Mittelstand, Stand September 2026: Was seit 2. August gilt, was auf 2027 verschoben ist, Bußgeld-Rechnung für KMU, Aufwand in Tagen.

April 20, 2026 · 17 min read
Selbstgehostetes LLM vs Claude API, Stand September 2026: aktuelle GPU- und Token-Preise, neu gerechneter Break-Even und wann die API gewinnt.

April 20, 2026 · 10 min read
MCP vs. Custom-API-Integration, entschieden nach realen Produktions-Tradeoffs. Wann ein MCP-Server, wann Tools im Claude-Code, und wie Sie waehlen. Laden Sie die kostenlose AI Automation Checklist herunter.

April 19, 2026 · 17 min read
Claude API Tool Use Referenz. input_schema (JSON Schema 2020-12), stop_reason-Flow, parallele Calls, Streaming, MCP. TypeScript aus 10 Agenten.

April 19, 2026 · 22 min read
LLM API Vergleich für Production: Claude, GPT, Gemini, Mistral und DeepSeek zu Kosten, EU-Datenresidenz, Uptime und Lock-in. Stand September 2026.
Die Kontextschicht für Ihre KI-Agenten
Ihre Agenten antworten aus dem, was die Suche gerade findet, und oft ist das der Stand vom letzten Quartal. Ich baue die Kontextschicht, aus der sie antworten und handeln: einen temporalen Wissensgraphen, der jeden Fakt mit Quelle und Gültigkeitszeitraum hält, mit den Rechten der jeweiligen Person liest und nichts ohne Freigabe einer Person schreibt. Auf Ihrem eigenen Tenant, nach Stunden abgerechnet, Schritt für Schritt.