KI-Agenten
Artikel mit dem Tag „KI-Agenten“ — Notizen und Analysen zu diesem Thema.
-
Native gegen normalisierte Tokens: warum die eigene Kostenformel von der OpenRouter-Rechnung abweicht
Drei Systeme zeigten drei Summen für dasselbe Fenster. Nur eine davon war eine unabhängige Messung, und die Tokens in der Antwort waren nicht die Tokens auf der Rechnung.
-
Die Agentenschleife unter einem Durable-Orchestrator: wo die Grenze verläuft
Agentengraph und Durable-Execution-Engine sind beide Orchestratoren. Ein Monat auf dem Prüfstand zeigte, wo die Grenze verläuft und was sie kostet.
-
Ein Staff Engineer aus Subagenten: Was ich übernehme und was nicht
Das Senior-Staff-Engineer-Muster für Claude Code, gelesen von einem Ingenieur mit eigenen Vier-Rollen-Subagenten-Teams: Kontextisolation und Verification-Gate — ja; 1%-Regel und Delete-Regel — nein.
-
Observability 2.0: eBPF, OpenTelemetry und KI, die die Ursache findet
Die Instrumentierung wanderte in den Kernel, die Telemetrie in den OTel-Standard, die Ursachensuche zur Maschine. Drei Verschiebungen — und ihre richtige Reihenfolge.
-
MCP für DevOps: mit einem Read-only-Agenten im Cluster beginnen
Anfang 2026 gibt es über 10.000 MCP-Server. Der erste, den ein Agent im Cluster bekommen sollte, ist read-only — was er bringt und wie man Zugriff vergibt.
-
KI schreibt DevOps neu: von der Syntax zum Urteil
Was KI heute besser kann als ein Ingenieur, wo der menschliche Mehrwert bleibt und wie sich die Senior-DevOps-Rolle bis 2026 verschiebt.
-
Policy as Code in der AI-Code-Ära: das Paradox aus Geschwindigkeit und Kontrolle
Das Tempo von Production-Code überholt das Human Review. Ohne deterministic Guardrails in CI und Admission wird ein AI-Agent zum Verstärker von Fehlern — nicht von Durchsatz.
-
Agenten-Sicherheit: Enterprise-Muster in einen Solo-Harness portiert
Biswas' Architektur deckt die Identitätsebene per OAuth und Token Exchange gut ab — doch die echte Gefahr lebt auf der Absichtsebene, die der Artikel nie erreicht.
-
Tokens sparen in Agenten: Was der Überblick richtig macht und was überverkauft ist
Eine Karte von vier Token-Kosten-Techniken — Caching, Lazy-Tools, Routing, Kompaktion. Die eigentliche Folge des Cache versteckt sie in einer Fußnote, während zwei kontraintuitive Fakten die ganze Karte wert sind.
-
Die kurze Memory-Datei bricht im großen Maßstab zusammen: Token gegen Regel-Vorrang
Die Memory-Datei winzig zu halten stimmt für ein Solo-Repository. Doch Compliance-Regeln mehrerer Organisationen lassen sich nicht an Pfade binden — sie müssen geroutet werden.
-
Ein Obsidian-Zweitgehirn ist eine Schicht, nicht das ganze Agenten-Gedächtnis
Monteiros zoniertes Wiki ist der richtige Mechanismus, doch Agenten-Gedächtnis ist eine Taxonomie von Schichten; jede Schicht, die die Außenwelt ingestiert, muss vor der Synthese auf Injektion gescannt werden.
-
Ein Kubernetes-Debugging-Agent: Abfragevorlagen oder Skripte?
Zinchenko gibt dem LLM MetricsQL-Vorlagen; mein VM-Skill füttert den Agenten mit einem fertigen Aggregat. Ich seziere die Achse Flexibilität gegen Reproduzierbarkeit und warum read-only per Blacklist schwächer ist.
-
Das Harness ist der billige Teil: Notizen zum Nachbau von Claude Code
Ein Kommentar zu Fareed Khans Nachbau von Claude Code von Grund auf — und warum man seine zentrale Schlussfolgerung umdrehen sollte.
-
Sollte man 2026 noch Programmieren lernen — Anmerkungen zu Marina Wyss
Ein Kommentar zu ihrem Medium-Text: wo sie recht hat, wo sie vereinfacht und was ich ergänzen würde.