AI-Tooling & Notizen
Die Agenten und Werkzeuge, auf denen die tägliche Arbeit tatsächlich läuft: Claude Code und seine Skills, MCP-Server, Sub-Agent-Teams, Memory-Dateien, lokale Modelle, Token-Kosten. Jede Notiz stellt dieselbe Frage — was ist übertragbar und was eine Eigenheit meines Setups.
-
Native gegen normalisierte Tokens: warum die eigene Kostenformel von der OpenRouter-Rechnung abweicht
Drei Systeme zeigten drei Summen für dasselbe Fenster. Nur eine davon war eine unabhängige Messung, und die Tokens in der Antwort waren nicht die Tokens auf der Rechnung.
-
Die Agentenschleife unter einem Durable-Orchestrator: wo die Grenze verläuft
Agentengraph und Durable-Execution-Engine sind beide Orchestratoren. Ein Monat auf dem Prüfstand zeigte, wo die Grenze verläuft und was sie kostet.
-
Ein Staff Engineer aus Subagenten: Was ich übernehme und was nicht
Das Senior-Staff-Engineer-Muster für Claude Code, gelesen von einem Ingenieur mit eigenen Vier-Rollen-Subagenten-Teams: Kontextisolation und Verification-Gate — ja; 1%-Regel und Delete-Regel — nein.
-
MCP für DevOps: mit einem Read-only-Agenten im Cluster beginnen
Anfang 2026 gibt es über 10.000 MCP-Server. Der erste, den ein Agent im Cluster bekommen sollte, ist read-only — was er bringt und wie man Zugriff vergibt.
-
KI schreibt DevOps neu: von der Syntax zum Urteil
Was KI heute besser kann als ein Ingenieur, wo der menschliche Mehrwert bleibt und wie sich die Senior-DevOps-Rolle bis 2026 verschiebt.
-
Eine lokale LLM fürs Coden: nicht «welche», sondern «wo»
Eine Besprechung der praktischen Methode, ein lokales Coding-Modell nach Hardware zu wählen — und wo lokale Modelle eine echte Nische haben, während nur die Cloud die Präzision hält.
-
Der Terminal-Stack 2026 mit Linux-Augen: Was portabel ist und was MacBook-Optik
Der Leitfaden zum „ultimativen Stack 2026" ist für macOS geschrieben. Ich bespreche ihn aus dem Linux/Wayland-Stuhl: Ghostty gegen Konsole, starkes Backend, offene Lücken.
-
Agenten-Sicherheit: Enterprise-Muster in einen Solo-Harness portiert
Biswas' Architektur deckt die Identitätsebene per OAuth und Token Exchange gut ab — doch die echte Gefahr lebt auf der Absichtsebene, die der Artikel nie erreicht.
-
Tokens sparen in Agenten: Was der Überblick richtig macht und was überverkauft ist
Eine Karte von vier Token-Kosten-Techniken — Caching, Lazy-Tools, Routing, Kompaktion. Die eigentliche Folge des Cache versteckt sie in einer Fußnote, während zwei kontraintuitive Fakten die ganze Karte wert sind.
-
Die kurze Memory-Datei bricht im großen Maßstab zusammen: Token gegen Regel-Vorrang
Die Memory-Datei winzig zu halten stimmt für ein Solo-Repository. Doch Compliance-Regeln mehrerer Organisationen lassen sich nicht an Pfade binden — sie müssen geroutet werden.
-
Ein Obsidian-Zweitgehirn ist eine Schicht, nicht das ganze Agenten-Gedächtnis
Monteiros zoniertes Wiki ist der richtige Mechanismus, doch Agenten-Gedächtnis ist eine Taxonomie von Schichten; jede Schicht, die die Außenwelt ingestiert, muss vor der Synthese auf Injektion gescannt werden.
-
CLAUDE.md: Vertrag oder Schichten? Wo die virale Datei recht hat und wo nicht
Die virale CLAUDE.md hat recht für den Median: flach beginnen. Doch Compliance lässt sich nicht erbitten — sie muss mechanisiert werden. Was in die Datei gehört und was in die Harness.
-
Das Harness ist der billige Teil: Notizen zum Nachbau von Claude Code
Ein Kommentar zu Fareed Khans Nachbau von Claude Code von Grund auf — und warum man seine zentrale Schlussfolgerung umdrehen sollte.
-
Claude Code ist eine Fertigkeit: Anmerkungen zu Leo Godins These
Zustimmung zur These „LLMs sind eine Fertigkeit“ und Ergänzung um die Erfahrung, die das Original auslässt.
-
Sollte man 2026 noch Programmieren lernen — Anmerkungen zu Marina Wyss
Ein Kommentar zu ihrem Medium-Text: wo sie recht hat, wo sie vereinfacht und was ich ergänzen würde.