{"id":33381,"date":"2026-08-17T09:21:00","date_gmt":"2026-08-17T07:21:00","guid":{"rendered":"https:\/\/contabo.com\/blog\/?p=33381"},"modified":"2026-08-17T09:30:21","modified_gmt":"2026-08-17T07:30:21","slug":"orca-vps-selbst-hosten-anleitung","status":"publish","type":"post","link":"https:\/\/contabo.com\/blog\/de\/orca-vps-selbst-hosten-anleitung\/","title":{"rendered":"Orca auf einem VPS selbst hosten: Schritt-f\u00fcr-Schritt-Anleitung"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\"><strong>Kurz gesagt.<\/strong> <a href=\"https:\/\/www.onorca.dev\" rel=\"nofollow\">Orca<\/a> (stablyai\/orca) ist eine quelloffene Agentic Development Environment (ADE), die parallele Coding-Agenten in isolierten Git-Worktrees aus einer einzigen Oberfl\u00e4che heraus ausf\u00fchrt. Das Setup auf einem headless Ubuntu-VPS dauert unter 20 Minuten \u2013 du brauchst das offizielle AppImage und <code>orca serve<\/code>. Einstieg f\u00fcr ein Zwei- oder Drei-Agenten-Fleet: <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 6<\/a> (6 vCPU, 12 GB RAM). F\u00fcr vier oder mehr parallele Agenten empfiehlt sich der <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 8<\/a> (8 vCPU, 24 GB RAM).<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><a href=\"https:\/\/www.onorca.dev\" rel=\"nofollow\">Orca<\/a> ist eine selbst gehostete KI-Agent-Runtime von stablyai. Auf einem VPS betrieben bekommst du persistente Agenten-Sessions, keine lokalen Rechenkosten und eine serverseitige Umgebung, auf die sich dein Desktop oder Mobilger\u00e4t von \u00fcberall verbinden kann.<\/p>\n\n\n\n<h2 id=\"h-voraussetzungen\" class=\"wp-block-heading\">Voraussetzungen<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Orca als selbst gehostete KI-Agent-Runtime braucht einen VPS mit ausreichend RAM und eine headless-f\u00e4hige Linux-Umgebung. Sorge daf\u00fcr, dass folgendes bereitsteht:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Einen Contabo <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 6<\/a> oder h\u00f6her (Gr\u00f6\u00dfenorientierung in Schritt 1). <strong>Die folgenden Befehle sind auf Ubuntu 22.04 LTS getestet.<\/strong> Ubuntu-24.04-Nutzer: Lies den Hinweis in Schritt 2 zu den abweichenden Paketnamen.<\/li>\n\n\n\n<li>Root-SSH-Zugang zum Server.<\/li>\n\n\n\n<li>Mindestens ein Agenten-Abo, das du in Orca einbringst \u2013 z. B. Claude Code, Codex oder OpenCode. Orca enth\u00e4lt keinen eigenen Agenten und berechnet auch keinen.<\/li>\n\n\n\n<li>Eine Domain, wenn du HTTPS-Zugang \u00fcber einen Reverse Proxy willst (optional, f\u00fcr alles jenseits eines lokalen Tests empfohlen).<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Orca hat kein eigenes Account-System und kein Login. Deine bestehenden Agenten-Abos sind die Credentials, die es verwendet.<\/p>\n\n\n\n<h2 id=\"h-schritt-1-deinen-contabo-vps-bereitstellen\" class=\"wp-block-heading\">Schritt 1: Deinen Contabo VPS bereitstellen<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Orcas Ressourcenbedarf w\u00e4chst mit der Anzahl der Agenten, die du parallel betreiben willst. Jeder Agent h\u00e4lt einen Git-Worktree offen und f\u00fchrt eine Terminal-Session mit einem aktiven Claude-Code- oder Codex-Prozess aus. Eine praktische Faustregel: Plane etwa 4 GB RAM pro parallelem Agenten, plus 4 GB Basis f\u00fcr das OS, Xvfb und die Orca-Runtime selbst.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr die Orca ADE auf einem VPS decken diese Contabo-Pl\u00e4ne die h\u00e4ufigsten Anwendungsf\u00e4lle ab:<\/p>\n\n\n\n<figure class=\"wp-block-table\"><table class=\"has-fixed-layout\"><thead><tr><th><strong>Anwendungsfall<\/strong><\/th><th><strong>Empfohlener Plan<\/strong><\/th><th><strong>vCPU<\/strong><\/th><th><strong>RAM<\/strong><\/th><th><strong>NVMe<\/strong><\/th><th><strong>Preis (2-Jahres-Vertrag)<\/strong><\/th><\/tr><\/thead><tbody><tr><td>1\u20132 Agenten, privat<\/td><td><a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 6<\/a><\/td><td>6<\/td><td>12 GB<\/td><td>100 GB<\/td><td>&gt; $6,00\/Monat<\/td><\/tr><tr><td>3\u20135 Agenten, Team\/CI<\/td><td><a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 8<\/a><\/td><td>8<\/td><td>24 GB<\/td><td>200 GB<\/td><td>&gt; $8,00\/Monat<\/td><\/tr><tr><td>6+ Agenten oder gro\u00dfe Repos<\/td><td><a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 12<\/a><\/td><td>12<\/td><td>48 GB<\/td><td>400 GB<\/td><td>&gt; $24,00\/Monat<\/td><\/tr><\/tbody><\/table><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">So bereitest du deinen Server vor:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Geh auf <a href=\"https:\/\/contabo.com\/de\/vps\/\">contabo.com<\/a> und w\u00e4hle den Cloud VPS-Plan, der zu deiner Arbeitslast passt.<\/li>\n\n\n\n<li>W\u00e4hle Ubuntu 22.04 LTS als Betriebssystem.<\/li>\n\n\n\n<li>Suche ein Rechenzentrum in der N\u00e4he deines Teams. EU-Rechenzentren (Deutschland, Niederlande) halten deinen Code und deine Prompts in EU-Infrastruktur.<\/li>\n\n\n\n<li>Schlie\u00dfe die Bestellung ab. Dein Server ist in der Regel innerhalb weniger Minuten verf\u00fcgbar.<\/li>\n\n\n\n<li>Verbinde dich per SSH: <code>ssh root@&lt;deine-server-ip><\/code><\/li>\n<\/ul>\n\n\n\n<h2 id=\"h-schritt-2-die-orca-runtime-installieren\" class=\"wp-block-heading\">Schritt 2: Die Orca-Runtime installieren<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Orca wird als eigenst\u00e4ndiges Linux-AppImage ausgeliefert. F\u00fcr den Betrieb als selbst gehostete KI-Agent-Runtime auf einem headless VPS brauchst du <code>libfuse2<\/code> (erforderlich f\u00fcr AppImage), <code>xvfb-run<\/code> (der Wrapper, der f\u00fcr jeden Befehl ein virtuelles Display startet) sowie GTK- und Electron-Laufzeitbibliotheken, die ein minimales Ubuntu-Server-Image nicht standardm\u00e4\u00dfig enth\u00e4lt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Installiere alle Abh\u00e4ngigkeiten und lade dann das AppImage herunter:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo apt-get update\n\nsudo apt-get install -y \\\n  curl libfuse2 xvfb \\\n  libatk1.0-0 libatk-bridge2.0-0 libcups2 libdrm2 libxkbcommon0 \\\n  libxcomposite1 libxdamage1 libxfixes3 libxrandr2 libgbm1 \\\n  libpango-1.0-0 libcairo2 libgtk-3-0 libgdk-pixbuf2.0-0 \\\n  libnss3 libnspr4 libxss1 libxtst6 libasound2t64\n\nsudo mkdir -p \/opt\/orca\n\nsudo curl -L https:\/\/github.com\/stablyai\/orca\/releases\/latest\/download\/orca-linux.AppImage \\\n  -o \/opt\/orca\/orca-linux.AppImage\n\nsudo chmod +x \/opt\/orca\/orca-linux.AppImage<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Ubuntu-24.04-Nutzer:<\/strong> <code>libfuse2<\/code> wurde in 24.04 in <code>libfuse2t64<\/code> und <code>libasound2<\/code> in <code>libasound2t64<\/code> umbenannt. Der obige Befehl verwendet bereits die 24.04-Namen. Auf Ubuntu 22.04 ersetzt du <code>libfuse2t64<\/code> durch <code>libfuse2<\/code> und <code>libasound2t64<\/code> durch <code>libasound2<\/code>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pr\u00fcfe, ob das Binary ausf\u00fchrbar ist, bevor du weitermachst:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>\/opt\/orca\/orca-linux.AppImage --version<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Du solltest einen Orca-Versionsstring sehen. Bekommst du einen <code>libfuse.so.2: cannot open shared object file<\/code>-Fehler, pr\u00fcfe, ob das richtige <code>libfuse<\/code>-Paket f\u00fcr deine Ubuntu-Version installiert ist. Bei <code>libatk-1.0.so.0: cannot open shared object file<\/code> f\u00fchre den vollst\u00e4ndigen <code>apt-get install<\/code>-Block oben erneut aus.<\/p>\n\n\n\n<h2 id=\"h-schritt-3-service-user-anlegen-und-vordergrundtest-ausfuhren\" class=\"wp-block-heading\">Schritt 3: Service-User anlegen und Vordergrundtest ausf\u00fchren<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Lege den dedizierten Non-Root-Service-User an, bevor du irgendeinen Test startest. Electron verweigert den Start als Root ohne <code>--no-sandbox<\/code>, und der Service-User muss das Orca-Verzeichnis besitzen, bevor die systemd-Unit ihn ausf\u00fchrt:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo useradd --system --create-home --shell \/usr\/sbin\/nologin orca\nsudo chown -R orca:orca \/opt\/orca<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Starte jetzt <code>orca serve<\/code> im Vordergrund als <code>orca<\/code>-User, um zu best\u00e4tigen, dass die Runtime sauber startet, und um die Pairing-URL abzurufen. Der <code>xvfb-run<\/code>-Wrapper startet automatisch ein virtuelles Display. Orca startet Xvfb auf einem headless VPS nicht von selbst:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo -u orca sh -c 'xvfb-run --auto-servernum \\\n  LIBGL_ALWAYS_SOFTWARE=1 \\\n  \/opt\/orca\/orca-linux.AppImage serve --port 6768'<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Das Terminal gibt einen Runtime-Endpoint und eine Pairing-URL aus. \u00d6ffne die Pairing-URL in deiner Desktop-Orca-App (Datei &gt; Mit Remote verbinden) oder scanne sie mit der Orca-Mobile-App, um deine lokale Session mit der VPS-Runtime zu verkn\u00fcpfen. Stoppe den Vordergrundprozess mit Ctrl+C, sobald du die Verbindung best\u00e4tigt hast.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Wenn Clients den Server \u00fcber ein privates Netzwerk oder Tailscale erreichen, erg\u00e4nze <code>--pairing-address<\/code> mit der Adresse, die sie verwenden sollen:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo -u orca sh -c 'xvfb-run --auto-servernum \\\n  LIBGL_ALWAYS_SOFTWARE=1 \\\n  \/opt\/orca\/orca-linux.AppImage serve --port 6768 --pairing-address 100.64.1.20'<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Ersetze <code>100.64.1.20<\/code> durch die LAN-IP, Tailscale-IP oder den \u00f6ffentlichen Hostnamen deines Servers.<\/p>\n\n\n\n<h2 id=\"h-schritt-4-die-agent-runtime-als-persistenten-dienst-starten\" class=\"wp-block-heading\">Schritt 4: Die Agent-Runtime als persistenten Dienst starten<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\"><code>orca serve<\/code> als systemd-Dienst zu betreiben h\u00e4lt deine selbst gehostete KI-Agent-Runtime durch SSH-Trennungen und Reboots am Leben. Der Service-User wurde bereits in Schritt 3 angelegt. Schreibe jetzt die Service-Unit:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo tee \/etc\/systemd\/system\/orca-serve.service &gt; \/dev\/null &lt;&lt; 'EOF'\n&#91;Unit]\nDescription=Orca runtime server\nAfter=network-online.target\nWants=network-online.target\n\n&#91;Service]\nType=simple\nUser=orca\nWorkingDirectory=\/home\/orca\nEnvironment=LIBGL_ALWAYS_SOFTWARE=1\nExecStart=\/usr\/bin\/xvfb-run --auto-servernum \/opt\/orca\/orca-linux.AppImage serve --port 6768 --pairing-address YOUR_SERVER_IP\nRestart=on-failure\nRestartSec=5\n\n&#91;Install]\nWantedBy=multi-user.target\nEOF<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\"><code>xvfb-run --auto-servernum<\/code> startet ein virtuelles Display und setzt <code>DISPLAY<\/code> automatisch. F\u00fcge keine zus\u00e4tzliche <code>DISPLAY=<\/code>-Umgebungsvariable hinzu \u2013 das w\u00fcrde zu einem Konflikt f\u00fchren. Ersetze <code>YOUR_SERVER_IP<\/code> durch die Adresse, die Clients verwenden werden. Aktiviere und starte den Dienst:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo systemctl daemon-reload\nsudo systemctl enable --now orca-serve.service\nsudo journalctl -u orca-serve.service -f<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Der Journal-Output sollte den Runtime-Endpoint und die Pairing-URL anzeigen. Schl\u00e4gt der Dienst sofort fehl, lies die Fehlermeldung im Journal. Der Abschnitt Fehlerbehebung weiter unten deckt die h\u00e4ufigsten Ursachen ab.<\/p>\n\n\n\n<h2 id=\"h-schritt-5-dein-agenten-fleet-konfigurieren\" class=\"wp-block-heading\">Schritt 5: Dein Agenten-Fleet konfigurieren<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Mit laufendem <code>orca serve<\/code> verbindest du deine Desktop-Orca-App mit dem VPS:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>\u00d6ffne Orca auf deinem Desktop oder Laptop.<\/li>\n\n\n\n<li>Geh zu Datei > Mit Remote verbinden und gib die Pairing-URL aus dem Journal-Output ein, oder scanne sie mit der Orca-Mobile-App.<\/li>\n\n\n\n<li>Sobald die Verbindung steht, erstellst du einen neuen Worktree: Klicke auf <strong>New Worktree<\/strong>, w\u00e4hle ein Repository und einen Agenten (Claude Code, Codex oder einen anderen unterst\u00fctzten CLI-Agenten).<\/li>\n\n\n\n<li>Der Agentenprozess l\u00e4uft auf dem VPS in diesem Worktree. Deine Desktop-App ist die Oberfl\u00e4che. Die gesamte Rechenarbeit findet auf dem Server statt.<\/li>\n\n\n\n<li>Um parallele Agenten zu betreiben, erstellst du weitere Worktrees auf demselben oder auf anderen Repositories. Jeder bekommt seinen eigenen isolierten Git-Worktree und eine eigene Terminal-Session.<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Die Orca-Mobile-Companion-App (iOS und Android) l\u00e4sst dich Agentenstatus \u00fcberwachen und Folgeanweisungen vom Smartphone senden, w\u00e4hrend die Orca ADE die eigentliche Arbeit auf dem VPS erledigt.<\/p>\n\n\n\n<h2 id=\"h-optional-reverse-proxy-einrichten\" class=\"wp-block-heading\">Optional: Reverse Proxy einrichten<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Standardm\u00e4\u00dfig lauscht <code>orca serve<\/code> auf Port 6768 ohne TLS. Eine selbst gehostete KI-Agent-Runtime ohne TLS auf einer \u00f6ffentlichen IP zu betreiben ist keine gute Idee. Schalte Nginx davor und hol dir ein Zertifikat von Certbot:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo apt-get install -y nginx certbot python3-certbot-nginx<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Lege eine Site-Konfiguration an:<\/p>\n\n\n\n<pre class=\"wp-block-code\"><code>sudo tee \/etc\/nginx\/sites-available\/orca &lt;&lt; 'EOF'\nserver {\n    listen 80;\n    server_name orca.yourdomain.com;\n\n    location \/ {\n        proxy_pass http:\/\/127.0.0.1:6768;\n        proxy_http_version 1.1;\n        proxy_set_header Upgrade $http_upgrade;\n        proxy_set_header Connection \"upgrade\";\n        proxy_set_header Host $host;\n        proxy_read_timeout 86400;\n    }\n}\nEOF\n\nsudo ln -s \/etc\/nginx\/sites-available\/orca \/etc\/nginx\/sites-enabled\/\nsudo nginx -t &amp;&amp; sudo systemctl reload nginx\nsudo certbot --nginx -d orca.yourdomain.com<\/code><\/pre>\n\n\n\n<p class=\"wp-block-paragraph\">Nach dem Certbot-Durchlauf ist deine Orca-Runtime unter <code>https:\/\/orca.yourdomain.com<\/code> mit einem g\u00fcltigen TLS-Zertifikat erreichbar. Aktualisiere die Pairing-Adresse in der systemd-Service-Unit entsprechend.<\/p>\n\n\n\n<h2 id=\"h-fehlerbehebung-haufige-probleme\" class=\"wp-block-heading\">Fehlerbehebung: H\u00e4ufige Probleme<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Falls deine selbst gehostete KI-Agent-Runtime oder die Orca ADE nicht startet oder Agenten sich nicht verbinden k\u00f6nnen, geh diese h\u00e4ufigen Ursachen durch:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong><code>dlopen(): error loading libfuse.so.2<\/code><\/strong>: Das korrekte <code>libfuse<\/code>-Paket f\u00fcr deine Ubuntu-Version ist nicht installiert. Auf Ubuntu 22.04: <code>sudo apt-get install -y libfuse2<\/code>. Auf Ubuntu 24.04: <code>sudo apt-get install -y libfuse2t64<\/code>.<\/li>\n\n\n\n<li><strong>Missing X server or $DISPLAY<\/strong>: Orca startet Xvfb auf einem headless VPS nicht automatisch. Verwende <code>xvfb-run --auto-servernum<\/code> wie in den Schritten 3 und 4 gezeigt. Fehlt <code>xvfb-run<\/code> selbst, installiere es mit <code>sudo apt-get install -y xvfb<\/code>.<\/li>\n\n\n\n<li><strong><code>libatk-1.0.so.0: cannot open shared object file<\/code><\/strong> (oder \u00e4hnliche GTK\/Electron-Bibliotheksfehler): Die vollst\u00e4ndigen GTK- und Electron-Laufzeitabh\u00e4ngigkeiten aus Schritt 2 wurden nicht installiert. F\u00fchre den vollst\u00e4ndigen <code>apt-get install<\/code>-Block aus Schritt 2 erneut aus.<\/li>\n\n\n\n<li><strong>Out of memory \/ Agent st\u00fcrzt mitten in der Aufgabe ab<\/strong>: Der RAM deines Plans reicht f\u00fcr die Anzahl paralleler Agenten nicht aus. Pr\u00fcfe den freien Speicher mit <code>free -h<\/code> w\u00e4hrend Agenten laufen. Wechsle zum <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 8<\/a> oder h\u00f6her, wenn 12 GB dauerhaft voll sind.<\/li>\n\n\n\n<li><strong>Port-Konflikt auf 6768<\/strong>: Ein anderer Prozess nutzt den Port. F\u00fchre <code>sudo ss -tlnp | grep 6768<\/code> aus, um ihn zu identifizieren, oder \u00e4ndere das <code>--port<\/code>-Flag in der Service-Unit auf einen freien Port.<\/li>\n\n\n\n<li><strong>API-Key-Fehler von einem Agenten<\/strong>: Orca reicht deine bestehenden Agenten-Credentials durch. Authentifiziere dich mit dem Agenten-CLI direkt auf dem VPS erneut (z. B. <code>claude auth login<\/code>), w\u00e4hrend du als <code>orca<\/code>-Service-User eingeloggt bist: <code>sudo -u orca claude auth login<\/code>.<\/li>\n\n\n\n<li><strong>Clients k\u00f6nnen sich nicht verbinden<\/strong>: Best\u00e4tige, dass Port 6768 in der Contabo-Firewall (oder im OS-Level-<code>ufw<\/code>) offen ist und dass <code>--pairing-address<\/code> mit der Adresse \u00fcbereinstimmt, die Clients verwenden.<\/li>\n<\/ul>\n\n\n\n<h2 id=\"h-faq-orca-selbst-hosten\" class=\"wp-block-heading\">FAQ: Orca selbst hosten<\/h2>\n\n\n\n<div class=\"schema-faq wp-block-yoast-faq-block\"><div class=\"schema-faq-section\" id=\"faq-question-1786951787054\"><strong class=\"schema-faq-question\">Wie viel RAM braucht Orca auf einem VPS?<\/strong> <p class=\"schema-faq-answer\">Runtime und Xvfb verbrauchen auf einem headless VPS etwa 1\u20132 GB. Jeder parallele Agent addiert je nach Repository-Gr\u00f6\u00dfe und verwendetem Modell ungef\u00e4hr 2\u20134 GB. Ein <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 6<\/a> mit 12 GB RAM bew\u00e4ltigt zwei Agenten komfortabel. F\u00fcr vier oder mehr parallele Agenten oder gro\u00dfe Monorepos ist der <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 8<\/a> mit 24 GB RAM die produktionstaugliche Basis. \u00dcberwache mit <code>free -h<\/code> w\u00e4hrend deiner ersten echten Arbeitslast.<\/p> <\/div> <div class=\"schema-faq-section\" id=\"faq-question-1786951791955\"><strong class=\"schema-faq-question\">Kann ich Orca mit Ollama statt OpenAI betreiben?<\/strong> <p class=\"schema-faq-answer\">Ja. Orca ist eine Orchestrierungsschicht, kein LLM-Backend. Es f\u00fchrt jeden CLI-Agenten aus, den du einbringst \u2013 einschlie\u00dflich Agenten, die auf einen lokalen Ollama-Endpoint konfiguriert sind. Setze <code>OPENAI_API_BASE=http:\/\/localhost:11434\/v1<\/code> in der Umgebung deines Agenten, bevor du ihn in Orca startest. Orca selbst t\u00e4tigt keine LLM-API-Aufrufe. Die praktische Einschr\u00e4nkung ist der RAM: Ein 7B-Modell, das Ollama l\u00e4dt, braucht rund 8 GB zus\u00e4tzlich zur Runtime.<\/p> <\/div> <div class=\"schema-faq-section\" id=\"faq-question-1786951796330\"><strong class=\"schema-faq-question\">Wie viele parallele Agenten kann ich mit 24 GB RAM betreiben?<\/strong> <p class=\"schema-faq-answer\">Auf einem <a href=\"https:\/\/contabo.com\/de\/vps\/\">Core VPS 8<\/a> mit 24 GB RAM kannst du vier bis f\u00fcnf parallele selbst gehostete KI-Agent-Sessions komfortabel aufrechterhalten \u2013 mit Claude Code oder Codex ohne lokales Modell. Jeder Agentenprozess verbraucht je nach Kontextgr\u00f6\u00dfe etwa 2\u20134 GB. Schaltest du ein lokales 7B-Ollama-Modell dazu, sinkt die Obergrenze: Das Modell allein belegt rund 8 GB, sodass vor dem Auftreten von Speicherdruck noch zwei oder drei Sessions Platz haben.<\/p> <\/div> <\/div>\n\n\n\n<p class=\"wp-block-paragraph\"><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Orca (stablyai\/orca) ist eine quelloffene Agentic Development Environment, mit der du parallele Coding-Agenten in isolierten Git-Worktrees betreibst. Diese Anleitung f\u00fchrt dich durch das Setup auf einem headless Ubuntu-VPS \u2013 vom Bereitstellen des Servers bis zum ersten Agenten-Fleet.<\/p>\n","protected":false},"author":65,"featured_media":0,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"inline_featured_image":false,"_uag_custom_page_level_css":"","site-sidebar-layout":"default","site-content-layout":"","ast-site-content-layout":"default","site-content-style":"default","site-sidebar-style":"default","ast-global-header-display":"","ast-banner-title-visibility":"","ast-main-header-display":"","ast-hfb-above-header-display":"","ast-hfb-below-header-display":"","ast-hfb-mobile-header-display":"","site-post-title":"","ast-breadcrumbs-content":"","ast-featured-img":"","footer-sml-layout":"","ast-disable-related-posts":"","theme-transparent-header-meta":"","adv-header-id-meta":"","stick-header-meta":"","header-above-stick-meta":"","header-main-stick-meta":"","header-below-stick-meta":"","astra-migrate-meta-layouts":"set","ast-page-background-enabled":"default","ast-page-background-meta":{"desktop":{"background-color":"var(--ast-global-color-4)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"ast-content-background-meta":{"desktop":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"footnotes":"","_members_access_role":[],"_members_access_error":""},"categories":[1399],"tags":[],"ppma_author":[1489],"class_list":["post-33381","post","type-post","status-publish","format-standard","hentry","category-tutorials"],"uagb_featured_image_src":{"full":false,"thumbnail":false,"medium":false,"medium_large":false,"large":false,"1536x1536":false,"2048x2048":false},"uagb_author_info":{"display_name":"Julia Mink","author_link":"https:\/\/contabo.com\/blog\/de\/author\/julia-mink\/"},"uagb_comment_info":0,"uagb_excerpt":"Orca (stablyai\/orca) ist eine quelloffene Agentic Development Environment, mit der du parallele Coding-Agenten in isolierten Git-Worktrees betreibst. Diese Anleitung f\u00fchrt dich durch das Setup auf einem headless Ubuntu-VPS \u2013 vom Bereitstellen des Servers bis zum ersten Agenten-Fleet.","authors":[{"term_id":1489,"user_id":65,"is_guest":0,"slug":"julia-mink","display_name":"Julia Mink","avatar_url":"https:\/\/secure.gravatar.com\/avatar\/26ce5d4ae17d160425d842da4ea00c56716ffb5d4c58ee0cfb73de57b1de5272?s=96&d=mm&r=g","author_category":"","user_url":"","last_name":"Mink","first_name":"Julia","job_title":"","description":""}],"_links":{"self":[{"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/posts\/33381","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/users\/65"}],"replies":[{"embeddable":true,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/comments?post=33381"}],"version-history":[{"count":1,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/posts\/33381\/revisions"}],"predecessor-version":[{"id":33383,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/posts\/33381\/revisions\/33383"}],"wp:attachment":[{"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/media?parent=33381"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/categories?post=33381"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/tags?post=33381"},{"taxonomy":"author","embeddable":true,"href":"https:\/\/contabo.com\/blog\/de\/wp-json\/wp\/v2\/ppma_author?post=33381"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}