CLI-Schritte zwischen menschlichen Entscheidungen ausführen
Benötigt: Claude Code + Codex + Gemini CLI · Dieser Ablauf braucht alle genannten Tools. Die Auswahl zeigt passende Abläufe und ersetzt keine Voraussetzung.
Diese Seite behandelt andere Tools als deine Auswahl. Du kannst sie weiterhin lesen. Passende Anleitungen finden
Claude Code, Codex und Gemini CLI konfigurieren, das Ausführungsprofil prüfen und freigegebene Schritte vom lokalen Koordinator starten und überwachen lassen.
Wenn Eingabe, Ausgabeformat und Abnahmekriterien feststehen, kann ein Koordinator den nächsten zulässigen Tool-Schritt starten. Menschen entscheiden weiterhin über Umfang, Entwurf und Abnahme.
Das Referenzpaket unterstützt jetzt optional die Ausführung nativer CLIs. Die konkrete Aufgabe bleibt klein: firstAttempt in einer Retry-Konfiguration korrigieren, die Wartezeiten prüfen und die Belege bewerten. Die Website führt keine dieser Befehle aus.
Einen Ausführungsmodus wählen
| Modus | Verhalten |
|---|---|
fixtures, der Standard | Synthetische Antworten prüfen den Ablauf ohne Anbieteraufrufe. |
import | Eine Person startet das Tool und importiert Ausgabe und beobachteten Prozessstatus. |
native | Konfigurierte CLI-Schritte laufen als überwachte Kindprozesse. Optionale API-Konfiguration ermöglicht direkte Aufrufe; manuelle und nicht konfigurierte API-Schritte warten auf Importe. |
Codex und Claude Code bieten programmatische Schnittstellen. Die JSON-Hülle von Gemini CLI enthält eine innere Antwort, die zusätzlich geparst und validiert werden muss. Ein Modell-API-Aufruf stellt nicht automatisch die Werkzeuge und Konfiguration eines Coding-Agenten bereit.
Das Ausführungsprofil vorbereiten
Das gemischte Recherche-Rezept beschreibt die API-Ausführung. Das folgende Profil für CLI-Implementierung braucht keine API-Konfiguration.
Entpacke das Paket und kopiere profiles/native.example.json in eine private lokale Konfigurationsdatei. Ersetze alle Platzhalter. Wähle die installierte Programmdatei, ein verfügbares Modell, die Tool-Version und die Namen der Umgebungsvariablen, die das jeweilige Konto benötigt.
Unter Windows brauchst du eine echte .exe. Für eine npm-CLI wählst du node.exe und den installierten JavaScript-Einstiegspunkt. Shell-Wrapper wie codex.ps1 oder gemini.cmd werden abgelehnt. Die Beispielpfade erklären die Felder; prüfe die tatsächliche Installation.
Lege workspace_root als separates Verzeichnis für die Ausführungen an. Beschreibe unter isolation_note, welche Dateien, Zugangsdaten und Netzwerkzugriffe die vorbereitete Umgebung zugänglich macht. Dieser Text konfiguriert keine Sandbox. Richte die Grenze ein und prüfe sie vor der Freigabe.
Gemini CLI benötigt eine ausdrücklich ausgewählte, geprüfte Richtliniendatei. Das Paket enthält ein Beispiel, das Tool-Aufrufe für diese reine JSON-Aufgabe ablehnt. Prüfe, ob deine Version es tatsächlich lädt: Vorhandene zentrale Admin-Richtlinien können ergänzende --admin-policy-Dateien verdrängen. Eine solche Datei deaktiviert keine Start-Erweiterungen und ersetzt keine Isolation durch das Betriebssystem.
Die Konfigurationsänderung ausführen
Starte das vorhandene Implementierungsrezept:
node cli.mjs new ./native-run --recipe implementation --execution native --profile /absolute/path/to/my-profile.json
Vor dem ersten Modellschritt erscheint das Umfangspaket. Prüfe Quelldateien, Empfänger, Grenzen, angeforderte Modelle, geerbte Variablennamen sowie die gespeicherten Hashes der Programme, Einstiegspunkte und Richtlinien. Die Werte von Zugangsdaten gehören nicht in dieses Paket.
Halte deine Entscheidung mit dem angezeigten Digest fest und fahre fort:
node cli.mjs decide ./native-run --gate scope --digest PRINTED_DIGEST --decision approve --by YOUR_NAME
node cli.mjs run ./native-run
Claude Code schlägt einen Plan vor; anschließend wartet der Lauf auf die Entwurfsentscheidung. Prüfe den Plan und den Prozessbeleg. Nach der Freigabe des neuen Entwurfs-Digests und einem weiteren run schlägt Codex die Konfiguration vor. Der feste Prüfer kontrolliert sie. Claude Code und Gemini CLI begutachten unabhängig dieselben Belege. Die Abnahme bleibt bei dir.
Der Vorschlag ändert firstAttempt von 0 auf 1. Für die Versuche 1, 2 und 6 werden 1000, 2000 und 30000 ms erwartet; 0 und 1,5 sind ungültige Versuchsnummern. Der Prüfer wertet JSON-Daten aus. Dieses Rezept schreibt keine Änderungen in ein Entwicklungsrepository.
Fehler und Abbruch prüfen
Der Koordinator erfasst den beobachteten Exit-Status, das angeforderte Modell, die Laufzeit sowie Byteanzahl und Hashes der Ausgabeströme. Das tatsächliche Modell kann unbekannt bleiben. Auch ein erfolgreich beendeter Prozess muss die Hüllen-, Schema- und Belegprüfung bestehen. Bei fehlgeschlagenen oder ungeklärten Schritten liefert run den Exit-Code 1.
Pro Versuch gelten Laufzeit- und Ausgabegrenzen. Hinzu kommen das gemeinsame Bytebudget und die Frist des gesamten Laufs. Diese Grenzen begrenzen nicht verbindlich die finanziellen Kosten deines Kontos.
Brich den Lauf aus einem zweiten Terminal ab:
node cli.mjs cancel ./native-run --by YOUR_NAME
Der aktive Koordinator erkennt die Anforderung und beendet seinen eigenen Prozessbaum. Strg-C fordert ebenfalls das Herunterfahren an. Ein beendeter lokaler Prozess beweist nicht, dass ein entfernter Auftrag oder ein abgekoppelter Dienst gestoppt wurde. Unterbrochene oder ungeklärte Arbeit muss abgeglichen werden. Der Runner wiederholt sie nicht automatisch und beendet keine PID aus einem alten Lauf.
Was schiefgeht
Eine Änderung des gespeicherten Profils macht die Freigabe ungültig. Aktualisierte Programme oder Richtlinien stoppen den nächsten Start, bis ein neuer Lauf freigegeben wurde. Programm-Hashes erfassen nicht jede Abhängigkeit, Kontoeinstellung oder jeden entfernten Dienst. Eine IDE als Host legt nicht fest, wessen Abonnement genutzt wird; prüfe das tatsächliche Tool-Konto.
Ein frisches Verzeichnis begrenzt nicht automatisch sämtliche Dateizugriffe. Ein erfolgreicher Exit ersetzt keine Abnahmeprüfung. Die README im Paket erklärt die Grenzen und die Behandlung von Fehlern genauer.
So prüfst du es
Führe im entpackten Paket aus:
node --test test.mjs executor.test.mjs api-executor.test.mjs
Die Tests starten echte lokale Kindprozesse mit synthetischen Antworten. Sie prüfen menschliche Haltepunkte, parallele unabhängige Reviews, gefilterte Umgebungsvariablen, geänderte Programme, fehlerhafte Exit-Codes, zu große Ausgaben, Zeitüberschreitungen und den Abbruch über einen zweiten CLI-Prozess.
Diese Prüfung lief unter Windows mit Node.js 24.13.0. Die Optionen von Codex CLI 0.153.4 und Claude Code 2.1.263 wurden lokal geprüft; Gemini CLI war nicht installiert. Anbieteraufrufe mit Zugangsdaten und die POSIX-Prozessbeendigung wurden hier nicht ausgeführt. Prüfe vor der Nutzung deines Kontos das Profil und dieselbe synthetische Aufgabe mit deinen installierten Tools. Dokumentiere dieses Ergebnis getrennt von den Offline-Tests des Pakets.
Quellen
- OpenAI: nicht-interaktiver Codex Tier 1 2026-09-08
- Anthropic: Claude Code programmatisch verwenden Tier 1 2026-09-08
- Google: Richtlinien für Gemini CLI Tier 1 2026-09-08
- Node.js: Kindprozesse Tier 1 2026-09-08
Stimmt etwas auf dieser Seite nicht?
Schreib, was du erwartet hast und was passiert ist. Das ist meist der kürzeste Weg zu einer Korrektur, und es landet im öffentlichen Issue-Tracker, damit die Änderung nachvollziehbar bleibt.