OpenClaw sur macOS excellent pour les agents longue durée : fan-out MCP, lectures workspace et jobs planifiés qui injectent des mégaoctets de logs à chaque tour. Headroom (GitHub: chopratejas/headroom) se place devant le LLM comme couche de compression locale—proxy, bibliothèque ou serveur MCP—et réduit sorties d'outils, JSON et historique avant 60–95% facturation. Les benchmarks publics montrent 65,694 → 5,118 de réduction ; le debug SRE passe de 92% tokens (
Si vous exécutez déjà OpenClaw sur Mac mini M4 avec des audits nocturnes via guide alignement launchd et gateway , il manque le routage Anthropic via le proxy Headroom pour éviter que grep et scans de dépôt ne vident le budget API. Cet article assemble routage proxy par env, cohabitation LaunchAgent, MCP et pipeline d'inspection nocturne à haut débit—pitch NodeMac minimal.
Pourquoi OpenClaw + Headroom est inévitable
Les agents OpenClaw sont conçus pour les outils : FS, MCP stdio, webhooks et tâches multi-étapes gonflent le contexte plus vite qu'un bot chat.
- Lister des milliers de fichiers.
- JSON complet CI ou linters.
- Réinjecter les payloads d'outils au tour suivant.
Anthropic facture les tokens d'entrée. Sans compression, 50k–80k par passage dépôt—bande où Headroom annonce 47–92 %.
Headroom complète les matrices ops, ne remplace pas matrice de précédence env du gateway ni matrice allowlist transport MCP. HTTP transparent, ContentRouter, CCR local.
Architecture : trois modes
┌─────────────────────────────────────────────────────────────┐
│ OpenClaw Gateway (launchd) │
│ skills · MCP tools · scheduled nightly audit jobs │
└───────────────────────────┬─────────────────────────────────┘
│ HTTPS (Anthropic-compatible)
▼
┌─────────────────────────────────────────────────────────────┐
│ Headroom Proxy 127.0.0.1:8787 (launchd or headroom wrap) │
│ CacheAligner → ContentRouter → SmartCrusher / Code / CCR │
└───────────────────────────┬─────────────────────────────────┘
│ compressed /v1/messages
▼
api.anthropic.com (or Bedrock/OpenRouter)
| Mode | Quand | Accroche OpenClaw |
|---|---|---|
| Proxy + variables | Prod, zéro changement code | ANTHROPIC_BASE_URL=http://127.0.0.1:8787 in LaunchAgent plist |
| headroom wrap openclaw | Dev laptops, quick A/B | Wraps CLI; installs ContextEngine plugin path |
| Headroom MCP | Compress ad-hoc tool payloads inside MCP clients | headroom mcp install alongside OpenClaw MCP servers |
Citable : ANTHROPIC_BASE_URL=http://127.0.0.1:8787 envoie chaque appel via /v1/messages sans réécrire les skills.
Matrice coût : avant / après
| Charge | Avant | Après | Gain | Fit OpenClaw |
|---|---|---|---|---|
| Recherche code (100) | 17,765 | 1,408 | 92% | grep nocturne |
| Debug SRE | 65,694 | 5,118 | 92% | logs gateway + MCP |
| Triage GitHub | 54,174 | 14,761 | 73% | boucles webhook |
| Exploration dépôt | 78,502 | 41,254 | 47% | tools.fs large |
| Audit nocturne type | ~40,000 | ~12,000 | ~70% | launchd multi-dépôts |
À 3 $/M entrée, 40k→12k ≈ 0,084 $/run, ~2,50 $/mois/dépôt quotidien ; 20 dépôts amortissent un Mac mini M4.
Scénario A : pipeline d'audit nocturne
Objectif : 02h00 : scan workspaces, checks statiques, Slack—Mac headless.
Sans Headroom : JSON linters à chaque tour, >30 min, rate limits.
Avec Headroom : Compression JSON + CCR ; avec guide alignement launchd et gateway après health :8787.
Débit : ~70 % tokens en moins → 2–3× dépôts/nuit sur le même M4.
Scénario B : gateway interactif
Objectif : Jour : ponts chat ; nuit : mêmes hôtes.
Risque : OOM avec --llmlingua sur 16 Go.
Atténuation : Sans LLMLingua (~1 Go), plafonds concurrence, /stats Prometheus.
Chemin recommandé
- Prod launchd : ANTHROPIC_BASE_URL dans le plist—voir matrice de précédence env du gateway.
- Conformité : garder CCR.
- Egress corporate : matrice allowlist TLS egress pour TLS amont.
- <40 % après une semaine : /stats-history.
Runbook : huit étapes sur Mac mini M4
1. Installer Headroom
pip install "headroom-ai[proxy,mcp]"
headroom --version
2. Proxy et santé
headroom proxy --host 127.0.0.1 --port 8787 \
--log-file ~/.headroom/openclaw-proxy.jsonl
curl -s http://127.0.0.1:8787/health | jq .
optimize: true ( docs proxy.
3. Baseline tokens
Audit sans proxy ; docs Anthropic.
4. LaunchAgent env
EnvironmentVariables du plist :
<key>ANTHROPIC_BASE_URL</key>
<string>http://127.0.0.1:8787</string>
<key>ANTHROPIC_API_KEY</key>
<string>sk-ant-…</string>
launchctl kickstart…
5. OpenAI compatible (opt.)
export OPENAI_BASE_URL=http://127.0.0.1:8787/v1
Clés Keychain/plist.
6. MCP Headroom
headroom mcp install
Config OpenClaw : matrice allowlist transport MCP préfixe headroom_.
7. Planification
#!/bin/bash
set -euo pipefail
curl -sf http://127.0.0.1:8787/health >/dev/null
curl -sf http://127.0.0.1:18789/health >/dev/null # OpenClaw gateway port—adjust
/usr/local/bin/openclaw job run --workspace ~/audits/acme --profile nightly
Log /stats SIEM.
8. Mesure et budget
headroom perf
curl -s http://127.0.0.1:8787/stats | jq '.stats.savings_percent'
--budget 50.0 ; alerte 3 nuits <35 %.
Dépannage
Toujours api.anthropic.com direct
Symptôme : Tokens pleins ; /stats plat.
Correctif : launchctl print | grep ANTHROPIC ; retirer .env conflictuel.
Contexte ligne perdu
Symptôme : Mauvais numéros de ligne.
Correctif : headroom_retrieve ; bypass ponctuel.
HTTP 502
Symptôme : :8787 refusé.
Correctif : LaunchAgent Headroom +15s avant gateway.
Perplexité ou proxy CCR ? Consultez la
comparaison Headroom vs LLMLingua
—matrice de décision, hybride --llmlingua, runbook 8 étapes.
FAQ
Change-t-il skills/MCP ?
Mode proxy : non, via ANTHROPIC_BASE_URL.
Perte pour audits sécu ?
Headroom utilise un CCR réversible—les originaux restent locaux ; le modèle récupère des chunks verbatim si besoin. Benchmarks : ±0 sur GSM8K et 97 % de précision SQuAD v2 à ~19 % de compression. Exécutez toujours des tests golden-file sur le schéma JSON de vos linters.
Différence egress ?
Egress = chemin réseau. matrice allowlist TLS egress Headroom = shim localhost.
Claude Code même Mac ?
Oui. Headroom supporte headroom wrap claude et la mémoire partagée inter-agents. Gardez le gateway OpenClaw sur env plist épinglé ; mode wrap seulement pour le dev interactif.
Économies nocturnes ?
Les audits tool-heavy atteignent souvent 50–85 % de réduction d'entrée selon les workloads agent publiés par Headroom. Les gateways chat-légers peuvent voir < 30 %—mesurez une semaine avec /stats-history avant de promettre 80 % à la finance.