Repository-Arbeit statt Demo-Prompt
Verglichen wird ein vollständiger Engineering-Ablauf: Repository verstehen, Änderung planen, Dateien bearbeiten, Tests ausführen und einen prüfbaren Diff liefern. Skills, MCP, lokale Ausführung und Cloud-Aufgaben werden nur dort einbezogen, wo sie im Zielbetrieb tatsächlich vorgesehen sind.
Grenze: Agentenrechte sind Produktionsrechte
Dateipfade, Shell-Befehle, Netzwerkzugriff, Secrets, Branch-Regeln und Freigaben werden für beide Systeme einzeln protokolliert. Ein besserer Diff rechtfertigt keine weiter gefassten Rechte.
Pilot: drei Issues mit bekanntem Soll
- Einen Bugfix, ein kleines Feature und eine Testverbesserung verwenden
- Je System mit demselben Commit und denselben Repository-Regeln starten
- Testquote, unerwünschte Änderungen, Reviewzeit und Abbrüche messen
- Lokale und Cloud-Ergebnisse nicht in einer Kennzahl vermischen
Entscheidungsmatrix
| Kriterium | Claude Code | Codex |
|---|---|---|
| Agentenpfad | Skills, MCP und Repository-Anweisungen im Zielablauf prüfen | Lokale und Cloud-Aufgaben mit identischen Akzeptanztests prüfen |
| Rechte | Datei-, Shell- und Netzwerkfreigaben sichtbar protokollieren | Sandbox, Freigaben und Remote-Umgebung sichtbar protokollieren |
| Abnahme | Diff, Tests und manuelle Korrekturzeit | Diff, Tests und manuelle Korrekturzeit |
Nachvollziehbar bleiben
Primärquellen
- Claude SonnetQuellenstand:
- Claude EnterpriseQuellenstand:
- Anthropic: commercial data and trainingQuellenstand:
- Anthropic: Remote MCP connectorsQuellenstand:
- OpenAI: ChatGPT WorkQuellenstand:
- OpenAI: Codex CloudQuellenstand:
- OpenAI: sandbox and approvalsQuellenstand:
- OpenAI: enterprise privacy and controlsQuellenstand:



