KI

Werkzeuge, die ich für Agenten baue.

Skills, die ich täglich nutze, MCP-Server mit echter Werkzeugkontrolle, Wissens-Bundles zum Mitnehmen, ein Modellvergleich für die Auswahl und ein monatlicher Rückblick auf das, was sich in der KI bewegt. Die Werkzeuge sind alle Open Source, alle offen gebaut.

NeuSeptember 2026

Agent Skills

Skills

Eine kleine, scharfe Anleitung, die ein Agent per Slash-Befehl ausführt. Sie verankert eine gute Gewohnheit, damit der Agent jedes Mal demselben Prozess folgt, statt zu raten.

Jeder Skill destilliert einen Beitrag dieses Blogs in eine Checkliste, die ein Agent Schritt für Schritt abarbeitet. Installieren, Slash-Befehl tippen, loslegen.

Model Context Protocol

MCP-Server

Die Verbindung zwischen Agent und echtem Werkzeug. Statt nur über Godot oder Aseprite zu reden, bedient der Agent sie: Szenen bauen, zeichnen, Spielzustand abfragen.

Editoren, die ein Agent über MCP komplett bedient: entstanden für eigene Spielprojekte, nutzbar mit jedem MCP-fähigen Assistenten.

Open Knowledge Format

OKF-Bundles

Portables Wissen als Markdown: eine Domäne mit ihren Konzepten und Belegen, so strukturiert, dass ein Agent sie direkt liest. Kein SDK, kein Lock-in.

Vom deutschen Recht bis zu React: jedes Bundle macht eine Domäne für Agenten lesbar. Klonen, dem Agenten den Pfad geben, fertig.

Modellbenchmarks

Vergleich

Der Modellvergleich. Jede Dimension gebaut aus dem Benchmark, das ihre Frage am ehrlichsten beantwortet, von Code über Prosa bis zu generierten Screens.

Kein eigener Testlauf, sondern eine Kuratierung: Die Zahlen kommen von Artificial Analysis, LMArena, Design Arena und SWE-bench, und jede Dimension beginnt mit der Frage, die sie wirklich beantwortet.

KI-News

News

Ein von Hand kuratierter Rückblick auf das, was sich in der KI wirklich bewegt hat: Modell-Releases, Agent-Tooling, lohnende Forschung und die Regulierung, die bei Buildern ankommt.

Eine Ausgabe pro Monat, zurück bis Januar 2026, damit ein verpasster Monat ein paar Minuten Lesen ist statt einer Archivsuche. Jeder Link führt zur Primärquelle.

  • September 20267. Sept. 2026

    GPT-6 Astra zum Preis von Fable 5.1, Gemini 3.8 Flash bis Januar zum alten Preis, die Coding-CLIs verdrahten ihre Defaults neu, und ein zweiter Agent-Schwarm schreibt in ein deutsches Wiki.

  • August 202631. Aug. 2026

    Offene Gewichte in Frontier-Größe, Grok 4.6 zum Kampfpreis, der EU AI Act wird konkret, und 1.200 isolierte Agents finden zueinander.

  • Juli 202631. Juli 2026

    Opus 5 setzt den Standard, OpenAI senkt die Preise, MCP wird zustandslos, und DeepSeek stellt V4-Flash unter MIT.

Blog

Aus dem Blog

Die Werkzeuge oben kommen aus der Praxis, und über die schreibe ich im Blog. Hier die neuesten Beiträge über Agenten.

  • Claude Opus 5 kam mit einer Grafik, die es an die Spitze der Frontier setzt, zum halben Preis von Fable 5. Jede Zahl darin stimmt. Zwei Wochen täglicher Nutzung haben mir ein anderes Modell übergeben als das, was ich mir aus dem Marketing zusammengebaut hatte. Also: wie Modelle verkauft werden, warum die Benchmarks nicht mehr messen, was sie zu messen behaupten, und was Opus 5 tatsächlich ist.

  • Mein Anti-Slop-Skill hatte längst Regeln. Sie funktionierten, und sie waren komplett meine, entstanden aus einem Jahr Verärgerung und gegen nichts getestet. Diese hausgemachte Schicht durch zwei Schreibsysteme zu ersetzen, die älter sind als die gesamte KI-Ära, eines geschrieben damit ein Flugzeugmechaniker ein Wartungshandbuch nicht falsch verstehen kann und eines, das die größte Doku-Landschaft der Softwarebranche betreibt, hat den Skill verändert. Sie widersprechen sich auch gegenseitig, und genau das war der nützliche Teil.

  • Ein schwieriger Trace zeigt, wie eine Codebase mit ihren Lesern kommuniziert. Der breadcrumbs Skill übersetzt dieses Signal in kleine Reparaturen: klarere Namen, explizite Verträge, brauchbare Fehler, ehrliche Kommentare und Dokumentation an der richtigen Stelle. So wird die Codebase mit jeder Untersuchung leichter verständlich.

  • Ein Befehl genügt, und ein Ordner, den du nicht geschrieben hast, wird Teil davon, wie dein Agent denkt und handelt. Zurück bekommst du meist nur ein grünes Häkchen, und ein Häkchen beweist das Falsche. trust-card ersetzt dieses Badge durch abgestufte Belege: wer genau diese Bytes geliefert hat, was der Skill darf, woher sein Wissen stammt und wer ihn unabhängig geprüft hat. Das Ergebnis wird als Sammelkarte gerendert, die man lesen kann, und der Skill weigert sich, eine Signatur als Beweis für Sicherheit auszugeben.

  • Coding-Agenten schreiben gutes UI und schlechte Versionen deines UI. Das Open Design System Format verpackt ein Designsystem als Bündel aus Markdown, HTML und CSS, das ein Agent lesen und davon bauen kann: Tokens, die einmal existieren und als CSS rendern, typisierte Konzepte in einem Graphen und selbstrendernde Beispiele. Es ist ein striktes Profil von Googles Open Knowledge Format. Hier ist, was es ist, und der odsf-Skill, den ich dazu ausgeliefert habe.

  • Googles Open Knowledge Format ist eine winzige, herstellerneutrale Spezifikation für den Kontext, den ein KI-Agent braucht: ein Bündel aus Markdown-Dateien mit YAML-Frontmatter, ein Pflichtfeld pro Konzept, kein SDK und kein Lock-in. Hier ist, was es ist, warum der nachsichtige Consumer-Vertrag der clevere Teil ist, und was ich darauf aufgesetzt habe: den okf-Skill, eine Bundle-Sammlung und OKF Studio, eine Desktop-App, die jedes Bundle als Graph liest.