DEV Community

Cover image for Wie man Codex, Claude Code und OpenCode nebeneinander in parallelen Worktrees ausführt
Emre Demir
Emre Demir

Posted on Originally published at apidog.com

Wie man Codex, Claude Code und OpenCode nebeneinander in parallelen Worktrees ausführt

Orca: Mehrere Coding-Agenten parallel ausführen, ohne dass sie sich gegenseitig stören

TL;DR: Orca ist eine Desktop-App von Stably, mit der Sie mehrere Coding-Agenten gleichzeitig ausführen können – jeder in einem isolierten Git-Worktree. Sie unterstützt CLI-Agenten über Ihre bestehenden Abonnements, bietet Terminal-Splits, Diff-Annotationen, SSH-Worktrees, einen Chromium Design Mode, GitHub- und Linear-Browsing sowie eine mobile Begleit-App. Stand 1. September 2026 hat Orca 58.464 Sterne, ist MIT-lizenziert und läuft auf macOS, Windows und Linux. Orca beseitigt Sie als Engpass für den Durchsatz, entscheidet aber nicht, welcher von fünf Diffs korrekt ist, und erstellt keinen dauerhaften Datensatz für Ihr Team.

Apidog heute ausprobieren

Dieser Artikel ist ein tiefer Einblick in eines der Tools aus der Zusammenstellung fünf Open-Source-KI-Agenten-Tools, die es wert sind, 2026 installiert zu werden.

Ein Agent in einem Terminal ist eine Arbeitseinheit: Prompt eingeben, warten, Ergebnis prüfen und erneut anweisen. Der Agent arbeitet schnell – Sie sind der langsame Teil.

Die naheliegende Lösung ist, mehrere Agenten gleichzeitig auszuführen. Das Problem: Agenten, die denselben Arbeitsbaum bearbeiten, überschreiben oder zerstören gegenseitig ihre Änderungen. Orca löst dieses Problem mit isolierten Worktrees und ergänzt Funktionen, die Kontextwechsel reduzieren.

Orca – parallele Coding-Agenten

Die Kernidee: ein Worktree pro Agent

Git-Worktrees erlauben mehrere Arbeitsverzeichnisse desselben Repositorys, jeweils auf unterschiedlichen Branches. Orca macht dieses Modell zum Grundprinzip:

  • Jeder Agent erhält einen eigenen Worktree.
  • Mehrere Agenten können gleichzeitig am selben Repository arbeiten.
  • Änderungen eines Agenten überschreiben nicht die Dateien eines anderen.

Das ermöglicht Fan-out:

Verteilen Sie einen Prompt auf fünf Agenten in isolierten Worktrees, vergleichen Sie die Ergebnisse und übernehmen Sie den besten Ansatz.

Für eine klar spezifizierte Aufgabe ist das meist Verschwendung. Für schwierige Aufgaben mit mehreren plausiblen Lösungswegen kann es sich lohnen. Drei unterschiedliche Ansätze für eine knifflige Migration scheitern wahrscheinlich nicht auf dieselbe Weise – und die Auswahl des besten Ergebnisses ist effizienter, als den ersten Ansatz endlos zu iterieren.

Manuell benötigen Sie dafür fünf Terminal-Tabs, fünf git worktree add-Befehle und eine mentale Zuordnung, welcher Tab zu welchem Agenten gehört. Genau diese Buchhaltung übernimmt Orca.

Welche Agenten Orca ausführt

Orca kann alles ausführen, was in einem Terminal läuft. Die unterstützte Liste umfasst unter anderem:

  • Claude Code
  • Codex
  • Cursor CLI
  • GitHub Copilot CLI
  • OpenCode
  • Grok, Amp und Antigravity
  • Pi und oh-my-pi
  • Hermes Agent, Devin und Goose
  • Auggie, Charm, Cline und Codebuff
  • Command Code, Continue, Droid und Kilocode
  • Kimi, Kiro, Mistral Vibe und Qwen Code
  • Rovo Dev und MiMo Code

Zusätzlich gibt es allgemeine Unterstützung für andere CLI-Agenten.

Wichtig: Orca verwendet Ihre eigenen Abonnements und API-Schlüssel. Tokens werden nicht weiterverkauft und Anfragen nicht über einen zusätzlichen Anbieter-Proxy geleitet. Wenn Sie beispielsweise Claude Code mit Opus 5 und Codex gegen Open-Modelle einsetzen, laufen beide über die Konten, für die Sie bereits bezahlen.

Dadurch wird der Vergleich mehrerer Modelle günstig: Ein Prompt an Claude Code, Codex und OpenCode verbraucht drei vorhandene Anfragen statt eine neue Anbieterbeziehung zu erfordern.

Installation

# macOS
brew install --cask stablyai/orca/orca

# Arch Linux
yay -S stably-orca-bin
Enter fullscreen mode Exit fullscreen mode

Direkte Downloads für macOS Apple Silicon und Intel, einen Windows-Installer sowie ein Linux-AppImage finden Sie auf der Releases-Seite.

Für Headless-Linux-Server stehen orca serve und eine eigene Anleitung im Repository zur Verfügung.

Die mobile Begleit-App lässt sich mit der Desktop-App koppeln. Sie ist im iOS App Store verfügbar; eine Android-APK gibt es in den Releases.

Funktionen, die im Alltag wichtig werden

Kontowechsel und Nutzungsverfolgung

Orca zeigt die Nutzung von Claude und Codex sowie die Zeit bis zur Rücksetzung von Rate Limits. Konten lassen sich wechseln, ohne sich ab- und wieder anzumelden.

Bei fünf parallelen Agenten stoßen Sie schneller an Limits. Die Rücksetzzeiten zu kennen, macht den Unterschied zwischen planbarer Arbeit und einem unerwarteten Stillstand mitten in der Aufgabe.

KI-Diffs annotieren

Sie können Kommentare direkt an einzelnen Diff-Zeilen hinterlassen und an den Agenten zurücksenden. So lassen sich Änderungen prüfen, bearbeiten und committen, ohne die App zu verlassen.

Das ist für Agenten-Output besonders nützlich: Gutes Review-Feedback ist fast immer zeilenspezifisch. Ein Satz wie „Der Backoff im Retry-Helper sollte exponentiell sein“ verliert in einem allgemeinen Chat schnell seinen Bezug.

SSH-Worktrees

Agenten können auf einer größeren Remote-Maschine arbeiten – inklusive Dateibearbeitung, Git und Terminals. Automatische Wiederverbindung und Portweiterleitung helfen, wenn der eigene Laptop mehrere Builds nicht zuverlässig parallel ausführen kann.

Design-Modus

Klicken Sie in einem echten Chromium-Fenster auf ein Element. Orca übergibt HTML, CSS und einen zugeschnittenen Screenshot an den Agenten.

Damit entfällt eine der schwierigsten Aufgaben bei Frontend-Agenten: zu beschreiben, welches Element genau fehlerhaft aussieht.

Terminal-Splits

Orca bietet Terminals mit WebGL-Rendering, unbegrenzten Splits und Scrollback, der Neustarts überlebt. Dieser dauerhafte Scrollback ist praktisch – ersetzt aber keinen Team-Datensatz.

GitHub und Linear

PRs, Issues und Boards lassen sich direkt in Orca durchsuchen. Ein Worktree kann unmittelbar aus einer Aufgabe heraus geöffnet werden.

Orca CLI

Agenten können Orca selbst über Befehle wie diese steuern:

orca worktree create
orca snapshot
orca click
orca fill
Enter fullscreen mode Exit fullscreen mode

Damit werden Workflows skriptfähig und nicht nur über die Benutzeroberfläche bedienbar.

Weitere Funktionen:

  • Drag-and-Drop von Dateien und Bildern in Prompts
  • VS-Code-basierter Editor mit Autosave
  • schnelles Öffnen über Worktrees und Agenten hinweg
  • Markdown- und PDF-Vorschauen
  • Computernutzung für Workflows mit echter UI-Interaktion
  • Benachrichtigungen und Ungelesen-Status

Die Maintainer veröffentlichen täglich. Der Changelog ist daher praktisch die eigentliche Feature-Liste – zugleich Warnung und gutes Zeichen.

Orca – Worktrees und Agenten

Wann Fan-out sinnvoll ist

Parallelität ist nicht kostenlos. Fünf Agenten benötigen ungefähr fünfmal so viele Tokens, um fünf Versionen derselben Lösung zu erzeugen.

Eine brauchbare Faustregel lautet:

Bei Unklarheit ausfächern, bei klarer Spezifikation einzeln ausführen.

Fächern Sie aus, wenn …

  • mehrere vertretbare Architekturansätze existieren
  • Sie ein State-Management-Refactoring planen
  • eine schwierige Datenmigration ansteht
  • der Engpass eines Performance-Problems noch unbekannt ist
  • eine Bibliotheksintegration schlecht dokumentiert ist

Hier divergieren die Modelle tatsächlich. Drei Agenten können drei unterschiedliche Strukturen erzeugen – und eine davon kann besser sein, als Sie sie selbst entworfen hätten.

Verwenden Sie einen Agenten, wenn …

  • ein Feld zu einem bestehenden Endpunkt hinzugefügt wird
  • ein Handler nach dem Muster von vier vorhandenen Handlern verdrahtet werden soll
  • Tests für eine dokumentierte Funktion geschrieben werden

In solchen Fällen erzeugen fünf Agenten meist fünf nahezu identische Diffs. Sie zahlen dann fünfmal für eine Aufgabe, die nur eine sinnvolle Lösung besitzt.

Vergleichen Sie Modelle, nicht nur Runs

Drei Claude-Code-Instanzen mit demselben Prompt liefern oft ähnliche Ergebnisse. Claude Code, Codex und OpenCode divergieren stärker, weil die Unterschiede aus Training und Implementierung stammen – nicht nur aus der Stichprobenziehung.

Orcas Ein-Klick-Vergleich mehrerer Modelle ist deshalb besonders wertvoll. Genau hier helfen auch Kontowechsel und Nutzungsverfolgung.

Akzeptanzkriterien zuerst definieren

Schreiben Sie die Akzeptanzkriterien auf, bevor Sie den Fan-out starten. Andernfalls wählen Sie wahrscheinlich den „saubersten“ Diff statt den korrekten.

Drei kurze Kriterienpunkte reichen oft:

  1. Welche Eingaben müssen funktionieren?
  2. Welche Ausgaben und Fehlercodes sind korrekt?
  3. Welche Tests müssen erfolgreich sein?

Das macht das Review überprüfbar und verbessert meist auch die Ergebnisse aller Agenten.

Fan-out tauscht Tokens gegen eine breitere Suche im Lösungsraum. Das ist ein guter Tausch bei vielen möglichen Lösungen – und ein schlechter, wenn es nur eine vernünftige Antwort gibt.

Das Problem, das Orca erzeugt

Fünf Agenten liefern fünf Diffs. Was nun?

Ihre Fähigkeit, korrekt von plausibel zu unterscheiden, wächst nicht automatisch mit der Anzahl der Agenten. Fünf Diffs sorgfältig zu lesen kann länger dauern, als den Code selbst zu schreiben. In der Praxis überfliegen viele deshalb die Ergebnisse, wählen den saubersten Diff und mergen ihn.

Ein sauberer Diff ist jedoch nicht zwangsläufig korrekt. Besonders problematisch ist das bei APIs: Jeder Agent kann eine eigene Vorstellung vom Response-Format entwickeln. Anschließend schreibt er Code und Tests, die genau zu dieser Annahme passen.

Sie benötigen deshalb einen Schiedsrichter, der nicht nur Ihr Bauchgefühl ist: einen verbindlichen Vertrag und eine deterministische Testsuite.

  • Die OpenAPI-Spezifikation ist die gemeinsame Wahrheit. Alle Agenten lesen dieselben Schemata, Statuscodes und Fehlerumschläge. Das wird auch in OpenAPI-Spezifikationen als Agenten-Tools beschrieben.
  • Mocks werden aus der Spezifikation generiert. Fehlerzweige gehören dazu, damit Happy-Path-Implementierungen sofort auffallen.
  • Vertragstests entscheiden. Führen Sie dieselbe Testsuite für alle Worktrees aus. Zwei bestehen, drei scheitern – das ist eine evidenzbasierte Merge-Entscheidung.
  • Vertragsänderungen müssen sichtbar scheitern. Wenn sich der Upstream-Vertrag ändert, sollten Tests brechen, statt dass sich das Verhalten stillschweigend verschiebt. Siehe dazu was passiert, wenn API-Änderungen KI-Agenten brechen.

Hier ergänzt Apidog Orca sinnvoll: Orca erzeugt günstig mehrere Kandidaten, während eine Spezifikation und eine deterministische Testsuite die Auswahl automatisierbarer machen.

Laden Sie Apidog herunter und integrieren Sie die Spezifikation, bevor Sie Fan-out aktivieren. Weitere Hintergründe finden Sie in Brauchen Sie im Zeitalter der KI-Agenten noch ein API-Tool? sowie in den Empfehlungen zur Zuverlässigkeit von KI-Agenten in der Produktion.

Vertragstests und API-Spezifikation

Scrollback ist kein Datensatz

Orca ist ein ausgezeichnetes Cockpit für einzelne Operatoren. Worktrees, Terminals, Diffs und Scrollback leben auf Ihrer Maschine. Das passt gut zu Solo-Arbeit, wird aber schwierig, sobald eine zweite Person Kontext benötigt.

Angenommen, Sie führen am Donnerstag fünf Agenten aus. Am Montag fragt ein Teammitglied, warum sich die Wiederholungslogik im Zahlungs-Client geändert hat. Die Antwort liegt vielleicht noch in einem Terminalfenster auf Ihrem Laptop. Der ursprüngliche Prompt und die Begründung sind jedoch verschwunden. Dauerhaft bleibt oft nur eine automatisch erzeugte Commit-Nachricht.

Prompts sind keine Aufzeichnungen. Ein Cockpit ist keine Organisation.

Sharkly setzt an dieser Grenze an. Beide Systeme isolieren Arbeit pro Einheit und unterstützen Ihre eigene Ausführung sowie Ihre eigenen Abonnements. Der Unterschied ist die Einheit:

  • Orcas Einheit ist ein Worktree, den Sie gerade betrachten.
  • Sharklys Einheit ist eine Aufgabe, die eine Sitzung überdauert.

Sharkly bietet dabei:

  • Einen gemeinsamen Aufgaben-Datensatz: Fortschritt, Tool-Aufrufe und Ergebnisse werden an der Aufgabe gespeichert. Agenten-Output wird zu Kommentaren, auf die Sie antworten können.
  • Gespeicherte Agent-Konfigurationen: Anweisungen, Laufzeit, Fähigkeiten, Repositories und Umgebung werden wiederverwendbar.
  • Crews: Ein Leader-Agent kann weitere Agenten und Personen einbeziehen, Ergebnisse zusammenführen und an einem Ort dokumentieren. Das ist Fan-out mit Syntheseschritt.
  • BYO-Ausführung: Sie verbinden einen Laptop, Server oder Container mit der bereits installierten Laufzeitumgebung.
  • Einen Worktree pro Aufgabe: Die Isolierung wird auf Aufgabenebene statt auf Pane-Ebene angewendet.
  • Einen pausierten Backlog: Eine Aufgabe im Backlog startet nichts. Arbeit kann vorbereitet und geprüft werden, bevor Tokens verbraucht werden.
  • Teamstrukturen: Spaces, Projekte, Sprints und Aufgaben sowie Jira-Synchronisierung.

Die Kurzfassung: Für Solo-Arbeit ist Orca wahrscheinlich ausreichend. Sobald eine zweite Person Einblick in die Agentenarbeit benötigt, brauchen Sie einen dauerhaften Aufgabenrekord. Scrollback kann das nicht ersetzen.

Ein funktionierendes Setup

Eine Reihenfolge, die unnötiges Chaos vermeidet:

  1. Orca installieren und zunächst eine Woche mit einem Agenten verwenden. Lernen Sie Terminal, Editor und Diff-Annotation kennen, bevor Sie parallelisieren.
  2. Spezifikation und Vertragstests zuerst verbinden. Fan-out ohne Schiedsrichter vervielfacht nur den Review-Aufwand.
  3. Nur schwierige Probleme ausfächern. Drei Agenten für ein unklar spezifiziertes Refactoring, einer für ein klares Ticket.
  4. Token-Kosten pro Agent reduzieren. Fünf Agenten, die dasselbe Repository durchsuchen, verursachen fünfmal dieselbe Verschwendung. Kombinieren Sie Orca beispielsweise mit codebase-memory-mcp.
  5. Annotieren statt erneut prompten. Zeilenkommentare behalten den Kontext besser als eine komplett neu formulierte Anweisung.
  6. Bei Bedarf auf SSH-Worktrees wechseln. Spätestens bei mehreren echten Builds reicht ein Laptop oft nicht mehr aus.
  7. Bei Teamarbeit eine Aufgabenebene ergänzen. Allein können Sie darauf verzichten; im Team ist die Aufzeichnung entscheidend.

FAQ

Ersetzt Orca meine IDE?

Für agentengesteuerte Arbeit meistens. Orca bietet einen VS-Code-basierten Editor mit Autosave, Dateiexplorer, Terminals und Diff-Review. Für tiefgreifendes Debugging verwenden viele weiterhin eine vollständige IDE.

Benötige ich für jeden parallelen Agenten ein separates Abonnement?

Nein. Orca verwendet Ihre vorhandenen Konten. Die integrierte Nutzungsverfolgung zeigt Claude- und Codex-Limits sowie Rücksetzzeiten.

Beim parallelen Ausführen mehrerer Agenten stoßen Sie trotzdem auf Rate Limits. Das ist eine Einschränkung Ihres Plans, nicht von Orca.

Ist die parallele Arbeit in einem Repository sicher?

Ja – für Repository-Dateien. Jeder Agent erhält einen eigenen Git-Worktree und kann die Dateien der anderen nicht überschreiben.

Gemeinsamer Zustand außerhalb des Repositorys bleibt Ihre Verantwortung: Datenbanken, laufende Entwicklungsserver und Ports können weiterhin kollidieren. Verwenden Sie getrennte Umgebungen, damit Infrastrukturfehler nicht wie Agentenfehler aussehen.

Wie wähle ich zwischen den Diffs?

Führen Sie dieselbe Testsuite für alle Worktrees aus und lassen Sie die Ergebnisse entscheiden. Wenn Ihre Tests die Kandidaten nicht unterscheiden können, müssen Sie zuerst die Tests verbessern.

Auch die Verfolgung von Agenten-Tool-Aufrufen kann helfen, nachzuvollziehen, was jeder Agent tatsächlich ausgeführt hat.

Orca oder ein Arbeitsmanagement-Tool wie Sharkly?

Das sind unterschiedliche Ebenen:

  • Orca steuert Agenten während der Arbeit.
  • Ein Aufgabensystem speichert, weist zu und macht Arbeit später überprüfbar.

Für Solo-Arbeit benötigen Sie möglicherweise nur Orca.

Ist Orca wirklich MIT-lizenziert?

Ja. Stably ist ein kommerzielles Unternehmen, die Desktop-App ist jedoch Open Source und unter der MIT-Lizenz veröffentlicht.

Zusammenfassung

Orca ist eine starke Lösung für das Durchsatzproblem: parallele Worktrees, echte Terminals, Diff-Annotationen, Remote-Ausführung und eine mobile Begleit-App. Die Verwendung Ihrer bestehenden Abonnements statt eines Token-Reselling-Modells ist ebenfalls überzeugend.

Mehr Kandidatenantworten pro Stunde sind aber nur dann ein Fortschritt, wenn Sie zwischen ihnen entscheiden und später nachvollziehen können, was passiert ist:

  • Entscheidung: Vertrag und Testsuite, zum Beispiel mit Apidog.
  • Erinnerung und Zusammenarbeit: Eine dauerhafte Aufgabe, zum Beispiel mit Sharkly.

Fünf Agenten ohne Schiedsrichter liefern nicht die fünffache Ausgabe. Sie erzeugen die fünffache Überprüfungswarteschlange.

Top comments (0)