Agent Harness Engineering für Unternehmen in Deutschland
Agent Harness Engineering ist die Arbeit am Harness eines KI-Agenten, also an dem Code und den Regeln rund um das Modell. Ich baue diesen Harness für Softwareteams, deren Entwickler mit Coding-Agenten wie Claude, Codex oder einem Open-Source-Harness arbeiten, damit die Agenten Code nach den Regeln Ihres Teams schreiben. Diese Arbeit übernehme ich als Freelancer oder im Interimsmandat, vorwiegend remote. Sprechen wir in einem kostenlosen Videocall von 30 Minuten über Ihren Bedarf.
Was ich für Ihre Entwickler mitbringe
-
Erfahrung mit Software und Teams
Seit mehr als zwanzig Jahren baue ich Software und führe die Menschen, die sie bauen. Ein Harness muss zur Arbeitsweise Ihrer Entwickler passen, denn eine Prüfung, die gültige Arbeit blockiert, wird abgeschaltet.
-
Prüfungen vor jedem Werkzeugaufruf
Ein Hook liest jeden Werkzeugaufruf eines Agenten, bevor er läuft, und blockiert, was eine Regel verbietet, etwa einen Push auf den Release-Branch. Jeder Hook hat eine Testmatrix aus erlaubten und verbotenen Aufrufen.
-
Grenzen an der Ressource
Ein Agent bekommt die Rechte eines neuen Kollegen am ersten Tag: eine Datenbankrolle, die nur liest, Tokens, die nur für die Entwicklung gelten, und keinen Push auf den Produktions-Branch. Diese Grenzen halten in jedem Harness.
-
Eine Regeldatei
Claude, Codex und Gemini lesen ihre Regeln über Importe aus einer gemeinsamen Quelldatei. Jede Regel steht nur an einer Stelle, und ein später hinzugefügter Harness importiert dieselbe Datei.
-
Wissen vor der Änderung
Eine Sperre lässt einen Agenten Code erst ändern, nachdem er einen Wissensgraphen des Repositorys zu dem Teil abgefragt hat, den er anfasst. Dann kennt der Agent die Aufrufer und die früheren Entscheidungen.
-
Im täglichen Einsatz
Ich helfe einem Kunden, seine Plattform mit Claude und Codex unter einem solchen Harness umzubauen. Das Projekt hat mehr als 300 RESTful-API-Endpunkte und mehr als 8.000 Commits.
Was ein Agent Harness ist
Ein Agent Harness ist alles an einem KI-Agenten außer dem Modell: der System-Prompt, die Werkzeuge und MCP-Server, die Sandbox, die Schleife, die den Agenten ausführt, und die Hooks, die seine Schritte prüfen (LangChain, 10. März 2026). Harness Engineering passt diesen Harness an eine Codebasis und ein Team an. Birgitta Böckeler von Thoughtworks unterscheidet bei seinen Kontrollen zwischen Guides, die einen Agenten steuern, bevor er handelt, und Sensoren, die seine Arbeit danach prüfen (martinfowler.com, 2. April 2026).
Warum ein Prompt einen Agenten nicht bindet
Ein Coding-Agent befolgt eine schriftliche Regel meistens. Für Code, der in Produktion geht, ist meistens zu wenig. Aus meinen Kundenprojekten:
- Ein Agent versteht eine frühere Freigabe als dauerhafte Freigabe, oder er beginnt einen Schritt, den er nur angekündigt hatte.
- Ein Harness kürzt eine lange Regeldatei, sobald sie eine Größengrenze überschreitet, und sieht den Rest nie.
- Ein Hook bindet nur den Harness, der ihn lädt. Ein Agent in einem zweiten Harness kommt an ihm vorbei.
- Eine Prüfung, die gültige Arbeit blockiert, schalten die Entwickler ab.
Eine Regel, deren Verletzung großen Schaden anrichtet, wird deshalb zu einer maschinellen Prüfung, und die Prüfung bekommt eigene Tests.
Open-Source-Harnesses und die Wahl des Modells
DeepSeek hat DeepSeek Harness im August 2026 als Developer Preview unter der MIT-Lizenz veröffentlicht. Modelladapter, Werkzeugregister, Sitzungsprotokoll und Agentenschleife sind Plugins, und das Modell kann eine entfernte API oder ein lokaler Modellserver sein (InfoQ, 20. August 2026). Mit einem offenen Harness wählt Ihr Team das Modell selbst, auch ein Open-Weight-Modell auf Ihrem eigenen Server. Weder ein offener noch ein proprietärer Harness kennt die Regeln Ihres Unternehmens. Diesen Teil baue ich.
Die Schichten eines Harness, den ich baue
Die Tabelle stammt aus meinen Kundenprojekten. Sie zeigt, was jede Schicht verhindert und welchen Harness sie bindet. Die ersten beiden Schichten halten, gleich in welchem Harness ein Agent läuft.
| Schicht | Was sie verhindert | Bindet |
|---|---|---|
| Grenzen an der Ressource | Einen Schreibzugriff auf Produktionsdaten, einen Push auf den Produktions-Branch | Jeden Harness, weil Datenbank und Repository sie durchsetzen |
| Bestätigung durch einen Menschen, außerhalb des Chats | Eine Freigabe, die aus dem Chat für eine andere Änderung zitiert wird | Jeden Harness |
| Hook vor jedem Werkzeugaufruf | Eine Löschung im Dateispeicher, einen Push, bevor die lokalen CI-Prüfungen bestanden sind | Den Harness, der ihn lädt |
| Testmatrix je Hook | Einen Hook, der gültige Arbeit blockiert und deshalb abgeschaltet wird | Den Hook, den sie testet |
| Eine Regeldatei mit Importen | Regeln, die sich zwischen Claude, Codex und Gemini unterscheiden | Jeden Harness, der sie importiert |
| Sperre über den Wissensgraphen | Eine Codeänderung ohne Blick auf die Aufrufer und die früheren Entscheidungen | Den Harness, der sie lädt |
| Review-Hook für längere Texte | Einen ersten Entwurf, der ohne Prüfung gespeichert wird | Den Harness, der ihn lädt |
Die Seite KI-Agenten unter denselben Regeln wie Menschen beschreibt jede Schicht im Detail.
Wer ich bin
Ich bin Michael Wutzke, AI Engineer in Frankfurt. In den vergangenen Monaten habe ich gelernt, KI-Harnesses über den ganzen Stack einzusetzen, von der Infrastruktur über den Code bis zu den Daten. In Kundenprojekten baue ich Software mit Claude und Codex, und mich interessieren Open-Source-KI-Modelle, die ein Unternehmen auf eigenen Servern betreibt. Ich unterrichte im Claude Hacker House, wo meine Sitzungen MCP-Server und virtuelle Organisationen behandeln, und habe eine Ausbildungsberechtigung der IHK Frankfurt für zwei IT-Ausbildungsberufe. Zuvor war ich CIO beim Frankfurter Unternehmen Blocksize Capital. Details: Lehre und Zertifizierungen.
So entsteht Ihr Harness
-
Kostenloser Videocall
In 30 Minuten sprechen wir über die Coding-Agenten, die Ihre Entwickler nutzen, und darüber, was diese Agenten in Ihrem Repository dürfen.
-
Gemeinsame Bestandsaufnahme
Wir gehen die Rechte Ihrer Agenten und die Regeln durch, die Ihr Team aufgeschrieben hat, und halten fest, was eine maschinelle Prüfung stoppen soll.
-
Angebot und Auftrag
Am Ende der Bestandsaufnahme steht ein Angebot. Sobald Sie es annehmen, beginne ich mit dem Bau.
-
Bau
Ich schreibe die Regeldatei und die Hooks mit ihren Testmatrizen und setze die Grenzen an der Datenbank, an den Tokens und an den Branches.
-
Probelauf mit Ihren Entwicklern
Ihre Entwickler arbeiten mit dem Harness an echten Aufgaben. Ein Hook, der gültige Arbeit blockiert, wird vor der Übergabe korrigiert.
-
Übergabe
Die Regeln und die Tests gehören Ihrem Team. Es ändert sie im Repository wie jeden anderen Code.
Fragen, die Unternehmen stellen
Was unterscheidet einen Agent Harness von einem Agent-Framework?
Ein Framework ist eine Bibliothek, mit der man einen Agenten in Code schreibt. Ein Harness ist die laufende Umgebung um ein Modell, mit Prompt, Werkzeugen, Hooks und Schleife (LangChain, 10. März 2026). Coding-Agenten wie Claude und Codex bringen einen Harness mit, und Harness Engineering ergänzt ihn um die Regeln Ihres Unternehmens.
Mit welchen Harnesses arbeiten Sie?
In Kundenprojekten mit Claude, Codex und der Gemini CLI unter einer gemeinsamen Regeldatei, dazu mit Paperclip als Control Plane für Agenten mit Rollen. Ein Open-Source-Harness wie DeepSeek Harness bekommt dieselben Schichten: Grenzen an der Ressource halten in jedem Harness, und Hooks schreibe ich für den Harness, der sie lädt.
Kann der Harness ein Open-Weight-Modell nutzen?
Ja. Open-Source-Harnesses wie DeepSeek Harness laden das Modell über einen Adapter. Das kann eine entfernte API sein oder ein Modellserver auf Ihrer eigenen Hardware. Um das Modell selbst geht es auf der Seite Lokale KI für Unternehmen.
Bremst ein Harness unsere Entwickler aus?
Ein Hook blockiert die Aufrufe, die eine Regel verbietet, und lässt die anderen durch. Seine Testmatrix belegt beides. Die Bestandsaufnahme entscheidet, welche Regeln eine maschinelle Prüfung bekommen und welche schriftlich bleiben.
Welche Formen der Zusammenarbeit bieten Sie an?
Freelance- oder Interim-Projekte, in Teilzeit oder Vollzeit. Ich arbeite remote von Frankfurt aus und treffe Ihre Entwickler vor Ort, wenn die Arbeit es verlangt, in Frankfurt Rhein-Main oder in Ihrem Büro.
Details zur Arbeit hinter dieser Seite
-
KI-Agenten unter denselben Regeln wie Menschen
Grenzen an der Ressource, eine blockierende Prüfung vor jedem Tool-Aufruf und Freigaben, die nur ein Mensch erteilt.
-
Virtuelle Organisationen autonomer Agenten
KI-Agenten können wie ein Team arbeiten, doch wie man sie verlässlich führt, wissen bisher wenige. Ich teste, wie Rollen und Regeln sie in der Spur halten.
-
Ein Unternehmen aus KI-Agenten mit Paperclip führen
KI-Agenten im Organigramm auf der Open-Source-Control-Plane Paperclip, Juni 2026: die Delegationsregel, die Freigabe und vier Lehren aus den ersten Jobs.
-
Lehre und Zertifizierungen
Wo ich unterrichte, meine Zertifikate mit ihren Ausstellern und mein Bildungsweg.
Agent Harness Engineering: Ihr Harness Engineer in Deutschland
Ich bin Michael Wutzke, Agent Harness Engineer in Deutschland, und arbeite von Frankfurt aus. In einem kostenlosen Videocall von 30 Minuten sprechen wir über die Coding-Agenten Ihrer Entwickler und die Regeln, die Ihre Codebasis braucht. Sie erfahren, welche Prüfungen ein Harness Ihrem Repository hinzufügen würde.
Suchanfragen zu diesem Thema
- agent harness
- agent harness deutsch
- agent harness bedeutung
- agent harness engineering
- agent harness comparison
- harness engineering
- harness engineering deutsch
- harness engineering ai
- harness engineering claude
- coding agent harness
- coding agents
- coding agents vergleich
- coding agent open source
- ki coding agenten
- welche coding agenten gibt es
- agentenbasiertes coding
- ki coding agent
- ki coding tools
- agentic coding
- agentic coding deutsch
- agentic coding vs vibe coding
- agentic engineering
- agentic engineering patterns
- agentic engineering workflow
- ki agenten softwareentwicklung
- ki agenten in der softwareentwicklung
- ki in der softwareentwicklung
- ki risiken in der softwareentwicklung
- ki agenten sicherheit
- ki agenten sicherheitsrisiko
- claude hooks
- claude hooks best practices
- codex hooks
- agents.md
- agents.md vs claude.md
- claude.md best practices
- deepseek harness plugins
- deepseek harness mcp
- vibe coding sicherheit
- ki code review