Zum Inhalt springen

KI-Agenten unter denselben Regeln wie Menschen

Ich baue die Informationsplattform eines Kunden mit KI-Coding-Agenten mit auf. Mehrere Agenten-Sessions und das menschliche Team arbeiten gleichzeitig an einem Repository. Diese Seite beschreibt, wie für die Agenten dieselben Regeln gelten wie für die Menschen und was ein Agent nicht tun kann.

Regeln in Prosa binden keinen Agenten

Ein Agent hält sich meistens an eine schriftliche Regel, und für den Produktivbetrieb ist das zu wenig. Er versteht eine frühere Erlaubnis als dauerhafte, oder er beginnt einen Schritt, den er nur angekündigt hatte. Eine lange Regeldatei macht das schlimmer: Ein Harness schneidet die Datei an einer Größengrenze ab und sieht den Rest nie. Eine Regel, deren Verletzung großen Schaden anrichtet, braucht deshalb eine maschinelle Prüfung.

Die erste Linie: Grenzen an der Ressource

Ein Agent bekommt die Rechte eines neuen Kollegen an dessen erstem Tag. Seine Datenbankrolle darf lesen, aber nicht schreiben. Seine Tokens gelten nur für die Entwicklungsumgebung. Der Produktions-Branch ist geschützt, die Zugangsdaten eines Agenten können dorthin nicht pushen. Eine Änderung an der Produktion braucht die Bestätigung eines Menschen, und zwar außerhalb des Chats. Ein Agent kann nämlich aus dem Chat eine Freigabe zitieren, die für etwas anderes gedacht war.

Die zweite Linie: eine Prüfung vor jedem Tool-Aufruf

Ein Hook liest jeden Tool-Aufruf des Agenten, bevor er ausgeführt wird, und blockiert die Aufrufe, die eine Regel verbietet: einen Schreibzugriff auf Produktionsdaten, ein Löschen im Dateispeicher, einen Push auf den Release-Branch, einen Push, bevor die lokale Kopie der CI-Prüfungen bestanden ist. Zu jedem Hook gehört eine Testmatrix aus erlaubten und verbotenen Aufrufen, denn einen Hook, der gültige Arbeit blockiert, schaltet man ab. Ein Hook bindet nur das Harness, das ihn lädt. Deshalb bleiben die Grenzen an der Ressource die erste Linie.

Eine Regeldatei für jedes Harness

Claude, Codex und Gemini lesen ihre Anweisungen aus verschiedenen Dateien. Eine Datei ist die einzige Quelle, die anderen importieren sie. Die Datei ist ein Index: Jede harte Regel ist eine Zeile, die auf das Dokument verweist, das ein Agent liest, bevor er handelt. Längere Anleitungen liegen in Skills, die geladen werden, wenn die Aufgabe passt.

Wissen vor dem Handeln

Das Repository hat einen Knowledge Graph, der aus Code und Dokumentation gebaut ist. Ein Gate lässt einen Agenten Code erst ändern, wenn er den Graphen zu dem Teil abgefragt hat, den er ändern will. Der Agent kennt dann die Aufrufer und die früheren Entscheidungen. Ein neuer menschlicher Kollege würde danach im Team fragen.

Schreiben unter Prüfung

Ein weiterer Hook lädt bei jedem Prompt einen gekürzten Styleguide und weist den ersten Entwurf jedes längeren Textes zurück, bis der Agent ihn geprüft hat. Der Hook kann den Text nicht beurteilen. Er sorgt dafür, dass die Prüfung stattfindet.

Was sich übertragen lässt

Ich habe die Grenzen für Agenten an der Ressource gesetzt und die blockierenden Prüfungen geschrieben und getestet. Jede Entscheidung über die Produktion bleibt bei einem Menschen. Details: Teams aus Agenten als virtuelle Organisationen.

Suchanfragen zu diesem Thema

  • KI Agenten
  • KI Agenten für Unternehmen
  • KI Agenten Unternehmen
  • KI Agenten Sicherheit
  • KI Agenten Sicherheitsrisiko
  • KI Agenten Governance
  • KI Agenten Risiken Governance
  • KI Agenten Softwareentwicklung
  • KI Agenten in der Softwareentwicklung
  • KI Agenten Mittelstand
  • KI Coding Agent
  • KI Agentic Coding
  • Agentic Coding
  • Agentic Coding deutsch
  • KI gestützte Softwareentwicklung
  • KI Programmierung
  • KI Governance
  • KI Governance im Unternehmen
  • KI Governance Framework
  • KI Sicherheit Unternehmen
  • KI Sicherheit Maßnahmen Unternehmen
  • KI Richtlinien Unternehmen
  • KI Regeln Unternehmen
  • KI Compliance
  • KI Freigabeprozess
  • Guardrails für KI
  • KI Leitplanken
  • Human in the Loop
  • Human in the Loop KI
  • Human in the Loop Prinzip
  • Claude Hooks
  • Claude Hooks Best Practices
  • Claude Skills
  • CLAUDE.md
  • AGENTS.md
  • AGENTS.md vs CLAUDE.md
  • Codex AGENTS.md
  • Wissensgraph KI