Ich habe einen internen Agenten-Kontrollraum rund um meinen Engineering-Agenten-Workflow für Conviro aufgebaut. Er vereint den Agentenstatus, Aktivitäten, Ausführungen, Ergebnisse, Fehler, Ausgabenübersicht und menschliche Genehmigungsgrenzen. Das Ziel ist es, die laufende Arbeit so prüfbar zu machen, dass ich entscheiden kann, was Aufmerksamkeit benötigt.
Ein Agent, der berichtet, dass er eine Aufgabe abgeschlossen hat, ist nützlicher Input, aber er lässt mehrere betriebliche Fragen offen. Welche Aufgabe hat er ausgeführt? Wie aktuell sind die Informationen? Was hat er geändert? Welche Beweise unterstützen das Ergebnis? Worauf wartet er noch?
Frische ist Teil des Zustands
Der Kontrollraum unterscheidet zwischen Live-Informationen und einem Snapshot. Dieser Unterschied ist in einer betrieblichen Schnittstelle wichtig, da alte Daten durchaus plausibel erscheinen können. Eine Statuskarte kann weiterhin einen Agenten anzeigen, der arbeitet, selbst wenn die Quelle nicht mehr aktualisiert wird.
Ich möchte, dass ein Betrachter die Natur der Beweise versteht, bevor er den Status interpretiert. Ein Snapshot bleibt nützlich für den Kontext, sollte jedoch nicht die Autorität einer Live-Beobachtung erlangen, nur weil das Layout aktuell aussieht.
Das ändert auch, wie ich über leere Panels denke. Keine Ergebnisse und keine verfügbaren Quellen sind unterschiedliche Situationen. Eine betriebliche Schnittstelle sollte diese Unterscheidung bewahren, anstatt für beide denselben beruhigenden leeren Zustand zu verwenden.
Ein Lauf, ein Ergebnis und eine Entscheidung sind verschiedene Objekte.
Eine Agentenausführung beschreibt eine Ausführung. Ein Ergebnis beschreibt etwas, das die Ausführung beobachtet oder vorgeschlagen hat. Eine menschliche Entscheidung bestimmt, was als Nächstes geschehen soll, wenn die Aktion eine Genehmigungsgrenze überschreitet. Die Kombination aller drei Elemente in eine generische Aktivitätsnachricht erschwert die Inspektion des Workflows.
Der Kontrollraum bietet operative Sichtbarkeit über diese Kategorien. Das ermöglicht mir, eine präzisere Frage zu stellen als „Sind die Agenten beschäftigt?“ Ich kann nach blockierter Arbeit, wiederholten Fehlern, Erkenntnissen, die Aufmerksamkeit erfordern, und Aktionen suchen, die auf eine Person warten sollten.
Zum Beispiel kann ein Agent seine Analyse erfolgreich abschließen, während er eine Änderung vorschlägt, die nicht automatisch angewendet werden sollte. Der Abschluss der Analyse ist keine Genehmigung der vorgeschlagenen Maßnahme. Die Benutzeroberfläche benötigt Platz für beide Fakten.
Genehmigung benötigt eine konkrete Handlung
Die Grenzen der menschlichen Genehmigung sind Teil des Designs. Das zugrunde liegende Ingenieurprinzip besagt, dass eine Person den Vorgang, den sie autorisiert, einschließlich seines Ziels und relevanter Beweise, verstehen sollte.
Meine Überprüfungsfragen umfassen, ob der Vorschlag spezifisch ist, ob der zugrunde liegende Kontext noch aktuell ist und ob die Ausführung im genehmigten Rahmen bleibt. Eine allgemeine Botschaft, dass ein Agent „helfen darf“, ist zu vage für eine folgenschwere Handlung.
Eine sichtbare Genehmigungskontrolle ist nur die Schnittstellenseite dieser Grenze. Die Durchsetzung gehört weiterhin in den Ausführungspfad. Das System sollte sich nicht allein auf einen Dashboard-Button verlassen, um zu verhindern, dass ein Agent über einen anderen Weg eine Aktion ausführt.
Spend ist ein nützlicher operativer Kontext
Die Sichtbarkeit der Ausgaben war ein weiterer Teil des Kontrollraums. Sie hilft dabei, Aktivitäten mit dem Ressourcenverbrauch zu verbinden, insbesondere wenn ein Agent eine Aufgabe wiederholt oder auf einen anhaltenden Fehler stößt. Eine Kostensumme ist nützlicher, wenn sie im Zusammenhang mit der Arbeit betrachtet werden kann, die sie erzeugt hat.
Ich betrachte eine höhere Aktivität nicht als Beweis für bessere Ergebnisse. Ein ruhiger Agent mit einer klaren, abgeschlossenen Aufgabe kann nützlicher sein als einer, der viele Durchläufe produziert, ohne seine Erkenntnisse zu klären. Das Dashboard sollte dieses Urteil unterstützen, anstatt das Ausführungsvolumen in eine Erfolgsbewertung umzuwandeln.
Aus demselben Grund benötigen Fehlzählungen Kontext. Ein Fehler, der verstanden wird und auf eine externe Abhängigkeit wartet, erfordert eine andere Reaktion als eine Schleife, die weiterhin Ressourcen verbraucht, ohne Fortschritte zu machen.
Eine betriebliche Sicht für ingenieurtechnisches Urteilsvermögen
Der Kontrollraum ist eine interne betriebliche Oberfläche. Ich präsentiere es nicht als Beweis dafür, dass jede ingenieurtechnische Maßnahme autonom ist oder dass jede vorgeschlagene Fähigkeit an Kunden freigegeben wurde.
Sein Wert liegt darin, das Überprüfen von Zustand, Beweisen und Eskalationen zu erleichtern. Der Aufbau hat mich dazu gebracht, den Agenten-Workflow expliziter zu gestalten: was ausgeführt wurde, was gelernt wurde, was es gekostet hat und wo eine Person weiterhin entscheiden muss. Diese Sichtbarkeit unterstützt verantwortungsvolle Delegation, während das technische Urteilsvermögen an der Arbeit festgehalten wird.
Aktualisiert am 26. September 2026.