Geben Sie jedem Agenten eine Stoppbedingung und einen Wiederherstellungsweg

Definieren Sie Erfolg, Mangel an Fortschritt, Stornierung und Eskalation, bevor Sie einen Agenten ausführen, damit wiederholte Aktivitäten nicht zu einem endlosen Ersatz für den Abschluss werden.

Ein Agent kann aktiv bleiben, während er keinen nützlichen Fortschritt macht. Er kann eine Suche wiederholen, denselben Absatz überarbeiten oder zwischen zwei Werkzeugen wechseln. Ein aktiver Aktivitäts-Feed lässt das System engagiert erscheinen, aber Aktivität ist kein Beweis dafür, dass die Aufgabe näher an der Fertigstellung ist.

Ich definiere Abbruchbedingungen neben dem Ziel. Das System muss akzeptierte Abschlüsse, unzureichende Beweise, eine blockierende Abhängigkeit und ein erschöpftes Ausführungslimit erkennen. Jede sollte zu einem verständlichen Ergebnis führen.

Definieren Sie die Vollständigkeit außerhalb des Modells Vertrauens.

„Der Agent sagt, es ist fertig“ ist eine schwache Akzeptanzbedingung. Für eine Forschungsaufgabe könnte der Abschluss Quell-unterstützte Felder und explizit ungelöste Elemente erfordern. Für eine betriebliche Aufgabe könnte es eine Bestätigung des Systems erfordern, das die Änderung akzeptiert hat.

Ich würde die erforderlichen Artefakte und Überprüfungen vor der Ausführung angeben. Das Modell kann helfen zu beurteilen, ob weitere Arbeiten sinnvoll sind, aber eine anwendungsbesitzende Bedingung sollte bestimmen, ob das Ergebnis den Vertrag der Aufgabe erfüllt.

Für die Forschung rund um PVFirms, mein Verzeichnis für Solarunternehmen kann ein nützliches Ergebnis fehlende Informationen umfassen. Unendlich weiter zu suchen, verwandelt eine undokumentierte Unternehmensinformation nicht in eine dokumentierte.

Erkenne wiederholte Zustände, nicht nur wiederholte Wörter

Eine Schleife kann unterschiedlichen Text erzeugen, während sie dieselbe Aktion mit denselben Eingaben wiederholt. Ich würde eine Betriebssignatur verfolgen, die das Tool, normalisierte Argumente und die relevante Quellversion erfasst. Wiederholte Signaturen ohne neue Beweise sind ein nützliches Signal dafür, dass der Plan überprüft werden muss.

Das Signal benötigt Kontext. Einige Abfragen sind legitim, wenn ein bekannter Job noch läuft. Wiederholtes Abfragen einer nicht verfügbaren Quelle ohne Änderung der Bedingungen ist eine andere Situation. Der Workflow sollte identifizieren, welche Art von Wiederholung er zulässt.

Fortschritt kann als akzeptierte Erkenntnisse, gelöste Fragen oder abgeschlossene Schritte ausgedrückt werden. Diese Maßnahmen sind informativer als die Anzahl der generierten Tokens oder die Länge der neuesten Erklärung.

Verwenden Sie mehrere Ausführungsgrenzen

Ein Iterationslimit steuert die Anzahl der Durchläufe. Ein Wanduhrenlimit steuert die verstrichene Zeit. Eine Ressourcenbeschränkung kontrolliert den Verbrauch. Beschränkungen für einzelne Werkzeuge können verhindern, dass eine kostspielige Operation die Aufgabe dominiert.

Die Schwellenwerte sollten dem Wert der Aufgabe und den Betriebsbedingungen folgen. Ich würde sie nicht wählen, weil eine Demo zufällig nach einer bestimmten Anzahl von Schritten beendet wurde. Das System sollte erklären, welcher Grenzwert die Arbeit gestoppt hat und das nützliche Ergebnis, das bisher gesammelt wurde, beibehalten.

Diese Grenzen gehören neben der Entscheidung darüber, wie viel Autonomie der Workflow benötigt. Sie machen den gewählten Umfang operationell konkret.

Machen Sie die Stornierung zu einem Anwendungszustand

Das Schließen eines Browser-Tabs führt nicht zwangsläufig zur Stornierung eines Workers. Eine Stornierungsanfrage sollte einen dauerhaften Zustand darstellen, den der ausführende Prozess beobachten kann. Der Worker sollte dies an geeigneten Grenzen überprüfen, insbesondere bevor er eine weitere externe Aktion startet.

Eine bereits von einem anderen Dienst akzeptierte Operation kann dennoch abgeschlossen werden. Der endgültige Status sollte zwischen angeforderter Stornierung, gestoppter weiterer Arbeit und Effekten, die weiterhin eine Abstimmung erfordern, unterscheiden. Zu behaupten, dass eine Stornierung eine akzeptierte Remote-Aktion gelöscht hat, würde das Ergebnis falsch darstellen.

Hinterlassen Sie eine nützliche Übergabe

Wenn der Agent stoppt, benötigt der nächste Operator das Ziel, die akzeptierten Ergebnisse, ungelöste Fragen und den zuletzt bestätigten Zustand. Ein umfangreiches Protokoll kann die Untersuchung unterstützen, aber eine prägnante Übergabe sollte die nächste Entscheidung klar machen.

Dauerhafter Ausführungszustand macht die Übergabe zuverlässiger. Ein fortgesetzter Job kann von bekannten Fakten ausgehen, während eine neue Entscheidung einen erschöpften oder ungültigen Plan ausdrücklich ersetzen kann.

Ich würde das Stoppverhalten mit einer wiederholten Abfrage, einer fehlenden Quelle, einer abgelaufenen Abhängigkeit und einer Stornierung während einer externen Anfrage überprüfen. Ein gut funktionierender Agent sollte mit einem wahrheitsgemäßen Bericht über seinen Fortschritt stoppen. Zu wissen, wann man aufhören sollte, ist Teil der verantwortungsvollen Aufgabenerledigung.

Aktualisiert am 30. September 2026.