OpenClaw -Gateways unter macOS eignen sich für langlaufende Agenten: MCP-Fan-out, Workspace-Leses und Jobs, die Megabytes Logs pro Modellrunde liefern. Headroom (GitHub: chopratejas/headroom) sitzt als lokale Kompressionsschicht vor dem LLM—Proxy, Bibliothek oder MCP—und schrumpft Tool-Outputs, JSON und Verlauf vor der 60–95% -Abrechnung. Öffentliche Benchmarks: 65,694 → 5,118 weniger Tokens; SRE-Debugging von 92% Tokens (
Wer OpenClaw auf Mac mini M4 mit launchd-Planung und Gateway-Abgleich für Nacht-Audits nutzt, braucht Headroom-Proxy-Routing für Anthropic—sonst fressen grep-lastige Tools das API-Budget. Env-Proxy, LaunchAgent-Kotenanz, MCP und Hochdurchsatz-Nachtpipeline—minimaler NodeMac-Pitch.
Warum OpenClaw + Headroom zusammenpassen
OpenClaw-Agenten sind tool-lastig: FS, MCP stdio, Webhooks, Mehrschritt-Tasks.
- Tausende Dateien listen.
- Volles CI-/Linter-JSON.
- Tool-Payloads in den nächsten Turn.
Anthropic berechnet Eingabe-Tokens. Ohne Kompression 50k–80k pro Repo-Lauf.
Headroom ergänzt Matrizen, ersetzt nicht Gateway-Env-Präzedenz-Matrix oder MCP-Transport-Allowlist-Matrix. Transparenter HTTP-Shim, ContentRouter, CCR lokal.
Architektur: drei Modi
┌─────────────────────────────────────────────────────────────┐
│ OpenClaw Gateway (launchd) │
│ skills · MCP tools · scheduled nightly audit jobs │
└───────────────────────────┬─────────────────────────────────┘
│ HTTPS (Anthropic-compatible)
▼
┌─────────────────────────────────────────────────────────────┐
│ Headroom Proxy 127.0.0.1:8787 (launchd or headroom wrap) │
│ CacheAligner → ContentRouter → SmartCrusher / Code / CCR │
└───────────────────────────┬─────────────────────────────────┘
│ compressed /v1/messages
▼
api.anthropic.com (or Bedrock/OpenRouter)
| Modus | Wann | OpenClaw-Hook |
|---|---|---|
| Proxy + Env | Produktion, kein Code-Change | ANTHROPIC_BASE_URL=http://127.0.0.1:8787 in LaunchAgent plist |
| headroom wrap openclaw | Dev laptops, quick A/B | Wraps CLI; installs ContextEngine plugin path |
| Headroom MCP | Compress ad-hoc tool payloads inside MCP clients | headroom mcp install alongside OpenClaw MCP servers |
Zitierbar: ANTHROPIC_BASE_URL=http://127.0.0.1:8787—alle Calls über /v1/messages ohne Skill-Umbau.
Kostenmatrix
| Workload | Vorher | Nachher | Ersparnis | OpenClaw-Fit |
|---|---|---|---|---|
| Codesuche (100) | 17,765 | 1,408 | 92% | Nacht-grep |
| SRE-Incident | 65,694 | 5,118 | 92% | Gateway-Logs+MCP |
| GitHub-Triage | 54,174 | 14,761 | 73% | Webhook-Loops |
| Repo-Exploration | 78,502 | 41,254 | 47% | breites tools.fs |
| Typisches Nacht-Audit | ~40,000 | ~12,000 | ~70% | Multi-Repo launchd |
Bei 3 $/M Eingabe spart 40k→12k ~0,084 $/Lauf, ~2,50 $/Monat/Repo täglich; 20 Repos amortisieren Mac mini M4.
Szenario A: Nacht-Audit-Pipeline
Ziel: 02:00: Workspaces, statische Checks, Slack.
Ohne Headroom: Linter-JSON pro Turn, >30 Min., Limits.
Mit Headroom: JSON/Logs komprimiert; mit launchd-Planung und Gateway-Abgleich nach :8787/health.
Durchsatz: ~70 % weniger Eingabe → 2–3× Repos/Nacht.
Szenario B: Interaktives Gateway
Ziel: Tags Chat, nachts gleicher Host.
Risiko: OOM mit --llmlingua auf 16 GB.
Abhilfe: Ohne LLMLingua (~1 GB), Concurrency-Caps, /stats→Prometheus.
Empfohlener Pfad
- Prod: ANTHROPIC_BASE_URL im plist—siehe Gateway-Env-Präzedenz-Matrix.
- Compliance: CCR an.
- Egress: Egress-Proxy-TLS-Allowlist für TLS upstream.
- <40 % nach einer Woche: /stats-history.
Runbook: acht Schritte Mac mini M4
1. Headroom installieren
pip install "headroom-ai[proxy,mcp]"
headroom --version
2. Proxy lokal starten und Health prüfen
headroom proxy --host 127.0.0.1 --port 8787 \
--log-file ~/.headroom/openclaw-proxy.jsonl
curl -s http://127.0.0.1:8787/health | jq .
Nach Testaufrufen erwarten Sie "optimize": true und steigende tokens_saved (Proxy-Doku).
3. Baseline Token-Verbrauch (ein OpenClaw-Job)
Führen Sie ein repräsentatives Audit ohne Proxy (direkt Anthropic) aus. Erfassen Sie Input-Tokens im Anthropic-Dashboard oder in Gateway-Logs. Anthropic-Doku.
4. OpenClaw über LaunchAgent-Env auf Headroom zeigen
Zum EnvironmentVariables-Dict der OpenClaw-Gateway-plist hinzufügen (Produktionspfad—schlägt .env):
<key>ANTHROPIC_BASE_URL</key>
<string>http://127.0.0.1:8787</string>
<key>ANTHROPIC_API_KEY</key>
<string>sk-ant-…</string>
Neu laden: launchctl kickstart -k gui/$(id -u)/ai.openclaw.gateway (Label an Ihre Installation anpassen).
5. Optional: OpenAI-kompatible Modelle über denselben Proxy
export OPENAI_BASE_URL=http://127.0.0.1:8787/v1
Dokumentieren Sie, welche Provider-Keys in Keychain vs. plist liegen—niemals Secrets committen.
6. Headroom MCP für In-Flight-Kompressionsstatistik
headroom mcp install
In OpenClaw MCP-Konfiguration gemäß MCP-Transport-Allowlist-Matrix registrieren—Tool-Präfix headroom_ gegen Kollisionen.
7. Nacht-Audit mit Gateway- und Proxy-Readiness-Gate planen
#!/bin/bash
set -euo pipefail
curl -sf http://127.0.0.1:8787/health >/dev/null
curl -sf http://127.0.0.1:18789/health >/dev/null # OpenClaw gateway port—adjust
/usr/local/bin/openclaw job run --workspace ~/audits/acme --profile nightly
Loggen Sie die Ausgabe von curl http://127.0.0.1:8787/stats nächtlich ins SIEM.
8. Einsparungen messen und Budget-Alarme setzen
headroom perf
curl -s http://127.0.0.1:8787/stats | jq '.stats.savings_percent'
Optional: headroom proxy --budget 50.0 für USD-Tagescap. Alarm, wenn savings_percent drei Nächte hintereinander < 35%—Bypass-Header x-headroom-bypass: true prüfen.
Fehlerbehebung
OpenClaw trifft weiterhin api.anthropic.com direkt
Symptom: Anthropic-Dashboard zeigt volle Token-Zahlen; /stats flacht ab.
Fix: launchctl print gui/$(id -u)/ai.openclaw.gateway | grep ANTHROPIC—effektive Env bestätigen. Konflikt-ANTHROPIC_BASE_URL aus niedriger priorisierter .env entfernen. Gateway nach plist-Änderung neu starten.
Komprimiertes Audit verliert Zeilenkontext
Symptom: Agent fasst zusammen, zitiert aber falsche Zeilennummern.
Fix: CCR-Abruf in Agent-Anweisungen aktivieren („headroom_retrieve vor Sev-1-Abschluss aufrufen“). Temporär x-headroom-bypass: true auf einem Repro-Job. SmartCrusher-Scope verengen, wenn JSON-Schema Keys verliert.
Proxy startet, OpenClaw bekommt HTTP 502
Symptom: Gateway-Logs: Verbindung zu :8787 abgelehnt.
Fix: Headroom in eigenem LaunchAgent mit KeepAlive=true. Boot staffeln: Headroom +15s vor OpenClaw-Gateway per launchd ThrottleInterval.
Perplexitäts-Pruning oder Proxy-CCR? Siehe
Headroom vs LLMLingua Vergleich
—Entscheidungsmatrix, Hybrid --llmlingua, 8-Schritte-Eval.
FAQ
Ändert Headroom OpenClaw-Skills oder MCP-Konfigurationen?
Im Proxy-Modus sind keine Codeänderungen nötig. Sie routen über ANTHROPIC_BASE_URL. Skills und MCP-Server bleiben identisch; nur Prompt-Payloads schrumpfen an der HTTP-Grenze.
Ist die Kompression für Security-Audits verlustbehaftet?
Headroom nutzt reversibles CCR—Originale bleiben lokal; das Modell holt wörtliche Chunks bei Bedarf. Benchmarks: ±0 auf GSM8K und 97 % SQuAD-v2-Genauigkeit bei ~19 % Kompression. Führen Sie weiter Golden-File-Tests auf Ihrem Linter-JSON-Schema aus.
Worin unterscheidet sich das vom OpenClaw-Egress-Corporate-Proxy?
Corporate-Egress-Proxies steuern den ausgehenden Netzwerkpfad und TLS-Inspektion. Headroom ist ein localhost-LLM-Shim, der Nachrichtenkörper komprimiert. Nutzen Sie beides: Headroom auf Loopback, Egress-Allowlist-Matrix für upstream Anthropic.
Headroom MCP mit Claude Code auf demselben Mac?
Ja. Headroom unterstützt headroom wrap claude und geteilten Cross-Agent-Speicher. OpenClaw-Gateway auf gepinntem plist-env; Wrap-Modus nur für interaktive Entwicklung, um Env-Kollisionen zu vermeiden.
Welche Einsparungen bei OpenClaw-Nacht-Audits?
Tool-lastige Audits erreichen oft 50–85 % Input-Reduktion laut Headrooms veröffentlichten Agent-Workloads. Chat-leichte Gateways sehen vielleicht < 30 %—messen Sie eine Woche mit /stats-history, bevor die Finanzabteilung 80 % versprochen bekommt.