Zum Inhalt springen

Agent Harness Engineering für Unternehmen in Deutschland

Agent Harness Engineering ist die Arbeit am Harness eines KI-Agenten, also an dem Code und den Regeln rund um das Modell. Ich baue diesen Harness für Softwareteams, deren Entwickler mit Coding-Agenten wie Claude, Codex oder einem Open-Source-Harness arbeiten, damit die Agenten Code nach den Regeln Ihres Teams schreiben. Diese Arbeit übernehme ich als Freelancer oder im Interimsmandat, vorwiegend remote. Sprechen wir in einem kostenlosen Videocall von 30 Minuten über Ihren Bedarf.

Porträt von Michael Wutzke, Agent Harness Engineer in Deutschland
Michael Wutzke, Agent Harness Engineer in Deutschland

Was ich für Ihre Entwickler mitbringe

  • Erfahrung mit Software und Teams

    Seit mehr als zwanzig Jahren baue ich Software und führe die Menschen, die sie bauen. Ein Harness muss zur Arbeitsweise Ihrer Entwickler passen, denn eine Prüfung, die gültige Arbeit blockiert, wird abgeschaltet.

  • Prüfungen vor jedem Werkzeugaufruf

    Ein Hook liest jeden Werkzeugaufruf eines Agenten, bevor er läuft, und blockiert, was eine Regel verbietet, etwa einen Push auf den Release-Branch. Jeder Hook hat eine Testmatrix aus erlaubten und verbotenen Aufrufen.

  • Grenzen an der Ressource

    Ein Agent bekommt die Rechte eines neuen Kollegen am ersten Tag: eine Datenbankrolle, die nur liest, Tokens, die nur für die Entwicklung gelten, und keinen Push auf den Produktions-Branch. Diese Grenzen halten in jedem Harness.

  • Eine Regeldatei

    Claude, Codex und Gemini lesen ihre Regeln über Importe aus einer gemeinsamen Quelldatei. Jede Regel steht nur an einer Stelle, und ein später hinzugefügter Harness importiert dieselbe Datei.

  • Wissen vor der Änderung

    Eine Sperre lässt einen Agenten Code erst ändern, nachdem er einen Wissensgraphen des Repositorys zu dem Teil abgefragt hat, den er anfasst. Dann kennt der Agent die Aufrufer und die früheren Entscheidungen.

  • Im täglichen Einsatz

    Ich helfe einem Kunden, seine Plattform mit Claude und Codex unter einem solchen Harness umzubauen. Das Projekt hat mehr als 300 RESTful-API-Endpunkte und mehr als 8.000 Commits.

Was ein Agent Harness ist

Ein Agent Harness ist alles an einem KI-Agenten außer dem Modell: der System-Prompt, die Werkzeuge und MCP-Server, die Sandbox, die Schleife, die den Agenten ausführt, und die Hooks, die seine Schritte prüfen (LangChain, 10. März 2026). Harness Engineering passt diesen Harness an eine Codebasis und ein Team an. Birgitta Böckeler von Thoughtworks unterscheidet bei seinen Kontrollen zwischen Guides, die einen Agenten steuern, bevor er handelt, und Sensoren, die seine Arbeit danach prüfen (martinfowler.com, 2. April 2026).

Warum ein Prompt einen Agenten nicht bindet

Ein Coding-Agent befolgt eine schriftliche Regel meistens. Für Code, der in Produktion geht, ist meistens zu wenig. Aus meinen Kundenprojekten:

  • Ein Agent versteht eine frühere Freigabe als dauerhafte Freigabe, oder er beginnt einen Schritt, den er nur angekündigt hatte.
  • Ein Harness kürzt eine lange Regeldatei, sobald sie eine Größengrenze überschreitet, und sieht den Rest nie.
  • Ein Hook bindet nur den Harness, der ihn lädt. Ein Agent in einem zweiten Harness kommt an ihm vorbei.
  • Eine Prüfung, die gültige Arbeit blockiert, schalten die Entwickler ab.

Eine Regel, deren Verletzung großen Schaden anrichtet, wird deshalb zu einer maschinellen Prüfung, und die Prüfung bekommt eigene Tests.

Open-Source-Harnesses und die Wahl des Modells

DeepSeek hat DeepSeek Harness im August 2026 als Developer Preview unter der MIT-Lizenz veröffentlicht. Modelladapter, Werkzeugregister, Sitzungsprotokoll und Agentenschleife sind Plugins, und das Modell kann eine entfernte API oder ein lokaler Modellserver sein (InfoQ, 20. August 2026). Mit einem offenen Harness wählt Ihr Team das Modell selbst, auch ein Open-Weight-Modell auf Ihrem eigenen Server. Weder ein offener noch ein proprietärer Harness kennt die Regeln Ihres Unternehmens. Diesen Teil baue ich.

Die Schichten eines Harness, den ich baue

Die Tabelle stammt aus meinen Kundenprojekten. Sie zeigt, was jede Schicht verhindert und welchen Harness sie bindet. Die ersten beiden Schichten halten, gleich in welchem Harness ein Agent läuft.

SchichtWas sie verhindertBindet
Grenzen an der RessourceEinen Schreibzugriff auf Produktionsdaten, einen Push auf den Produktions-BranchJeden Harness, weil Datenbank und Repository sie durchsetzen
Bestätigung durch einen Menschen, außerhalb des ChatsEine Freigabe, die aus dem Chat für eine andere Änderung zitiert wirdJeden Harness
Hook vor jedem WerkzeugaufrufEine Löschung im Dateispeicher, einen Push, bevor die lokalen CI-Prüfungen bestanden sindDen Harness, der ihn lädt
Testmatrix je HookEinen Hook, der gültige Arbeit blockiert und deshalb abgeschaltet wirdDen Hook, den sie testet
Eine Regeldatei mit ImportenRegeln, die sich zwischen Claude, Codex und Gemini unterscheidenJeden Harness, der sie importiert
Sperre über den WissensgraphenEine Codeänderung ohne Blick auf die Aufrufer und die früheren EntscheidungenDen Harness, der sie lädt
Review-Hook für längere TexteEinen ersten Entwurf, der ohne Prüfung gespeichert wirdDen Harness, der ihn lädt

Die Seite KI-Agenten unter denselben Regeln wie Menschen beschreibt jede Schicht im Detail.

Wer ich bin

Ich bin Michael Wutzke, AI Engineer in Frankfurt. In den vergangenen Monaten habe ich gelernt, KI-Harnesses über den ganzen Stack einzusetzen, von der Infrastruktur über den Code bis zu den Daten. In Kundenprojekten baue ich Software mit Claude und Codex, und mich interessieren Open-Source-KI-Modelle, die ein Unternehmen auf eigenen Servern betreibt. Ich unterrichte im Claude Hacker House, wo meine Sitzungen MCP-Server und virtuelle Organisationen behandeln, und habe eine Ausbildungsberechtigung der IHK Frankfurt für zwei IT-Ausbildungsberufe. Zuvor war ich CIO beim Frankfurter Unternehmen Blocksize Capital. Details: Lehre und Zertifizierungen.

So entsteht Ihr Harness

  1. Kostenloser Videocall

    In 30 Minuten sprechen wir über die Coding-Agenten, die Ihre Entwickler nutzen, und darüber, was diese Agenten in Ihrem Repository dürfen.

  2. Gemeinsame Bestandsaufnahme

    Wir gehen die Rechte Ihrer Agenten und die Regeln durch, die Ihr Team aufgeschrieben hat, und halten fest, was eine maschinelle Prüfung stoppen soll.

  3. Angebot und Auftrag

    Am Ende der Bestandsaufnahme steht ein Angebot. Sobald Sie es annehmen, beginne ich mit dem Bau.

  4. Bau

    Ich schreibe die Regeldatei und die Hooks mit ihren Testmatrizen und setze die Grenzen an der Datenbank, an den Tokens und an den Branches.

  5. Probelauf mit Ihren Entwicklern

    Ihre Entwickler arbeiten mit dem Harness an echten Aufgaben. Ein Hook, der gültige Arbeit blockiert, wird vor der Übergabe korrigiert.

  6. Übergabe

    Die Regeln und die Tests gehören Ihrem Team. Es ändert sie im Repository wie jeden anderen Code.

Fragen, die Unternehmen stellen

Was unterscheidet einen Agent Harness von einem Agent-Framework?

Ein Framework ist eine Bibliothek, mit der man einen Agenten in Code schreibt. Ein Harness ist die laufende Umgebung um ein Modell, mit Prompt, Werkzeugen, Hooks und Schleife (LangChain, 10. März 2026). Coding-Agenten wie Claude und Codex bringen einen Harness mit, und Harness Engineering ergänzt ihn um die Regeln Ihres Unternehmens.

Mit welchen Harnesses arbeiten Sie?

In Kundenprojekten mit Claude, Codex und der Gemini CLI unter einer gemeinsamen Regeldatei, dazu mit Paperclip als Control Plane für Agenten mit Rollen. Ein Open-Source-Harness wie DeepSeek Harness bekommt dieselben Schichten: Grenzen an der Ressource halten in jedem Harness, und Hooks schreibe ich für den Harness, der sie lädt.

Kann der Harness ein Open-Weight-Modell nutzen?

Ja. Open-Source-Harnesses wie DeepSeek Harness laden das Modell über einen Adapter. Das kann eine entfernte API sein oder ein Modellserver auf Ihrer eigenen Hardware. Um das Modell selbst geht es auf der Seite Lokale KI für Unternehmen.

Bremst ein Harness unsere Entwickler aus?

Ein Hook blockiert die Aufrufe, die eine Regel verbietet, und lässt die anderen durch. Seine Testmatrix belegt beides. Die Bestandsaufnahme entscheidet, welche Regeln eine maschinelle Prüfung bekommen und welche schriftlich bleiben.

Welche Formen der Zusammenarbeit bieten Sie an?

Freelance- oder Interim-Projekte, in Teilzeit oder Vollzeit. Ich arbeite remote von Frankfurt aus und treffe Ihre Entwickler vor Ort, wenn die Arbeit es verlangt, in Frankfurt Rhein-Main oder in Ihrem Büro.

Details zur Arbeit hinter dieser Seite

Agent Harness Engineering: Ihr Harness Engineer in Deutschland

Ich bin Michael Wutzke, Agent Harness Engineer in Deutschland, und arbeite von Frankfurt aus. In einem kostenlosen Videocall von 30 Minuten sprechen wir über die Coding-Agenten Ihrer Entwickler und die Regeln, die Ihre Codebasis braucht. Sie erfahren, welche Prüfungen ein Harness Ihrem Repository hinzufügen würde.

Porträt von Michael Wutzke, Agent Harness Engineer in Deutschland

Suchanfragen zu diesem Thema

  • agent harness
  • agent harness deutsch
  • agent harness bedeutung
  • agent harness engineering
  • agent harness comparison
  • harness engineering
  • harness engineering deutsch
  • harness engineering ai
  • harness engineering claude
  • coding agent harness
  • coding agents
  • coding agents vergleich
  • coding agent open source
  • ki coding agenten
  • welche coding agenten gibt es
  • agentenbasiertes coding
  • ki coding agent
  • ki coding tools
  • agentic coding
  • agentic coding deutsch
  • agentic coding vs vibe coding
  • agentic engineering
  • agentic engineering patterns
  • agentic engineering workflow
  • ki agenten softwareentwicklung
  • ki agenten in der softwareentwicklung
  • ki in der softwareentwicklung
  • ki risiken in der softwareentwicklung
  • ki agenten sicherheit
  • ki agenten sicherheitsrisiko
  • claude hooks
  • claude hooks best practices
  • codex hooks
  • agents.md
  • agents.md vs claude.md
  • claude.md best practices
  • deepseek harness plugins
  • deepseek harness mcp
  • vibe coding sicherheit
  • ki code review