JUNI 2026 MAC
KOSTENLOSE_
KI_CODING_
TOKENS.
Im Juni 2026 erreicht die Dichte kostenloser KI-Coding-Tokens ein Maximum — parallel zum Countdown zum Gemini-CLI-Cutoff am 18.06. Schmerzpunkt: Mac-Entwickler rotieren zwischen Cursor, Copilot, Gemini CLI und OpenCode, ohne belastbare Daten darüber zu haben, was noch €0 kostet, Proxy braucht oder Gemini nach dem Cutoff ersetzt. Ergebnis: eine Quota-Matrix, fünf Setup-Schritte und eine dreistufige Mac-Routing-Tabelle ermöglichen den Alltagseinsatz von Coding-Agenten ohne Kreditkarte; EU-Teams dokumentieren zugleich DSGVO-konforme Verarbeitung. Aufbau: Quota-Tabelle → Schmerzpunkte → Gemini-Migration → EU-/CN-APIs → IDE-Free-Tiers → Terminal-Agenten → fünf Schritte → Fallstudie → Mac-Miet-Entscheidung.
1. Schmerzpunkte: Viele Free-Tiers, fragmentierte Wahrheit
1) Policy-Fenster schmal: Gemini CLI OAuth liefert noch 1.000 Requests/Tag bei 60 RPM, aber Free/Pro/Ultra-Privatnutzer verlieren Zugang am 18.06. — offizieller Pfad: geschlossene Antigravity CLI (siehe unsere Gemini-CLI-Richtlinienanalyse). 2) Netzwerk-Split: Google-OAuth aus der EU meist unproblematisch; aus Festlandchina brauchen OAuth-Tools Proxy, während SiliconFlow 20 M permanente Tokens, Alibaba Bailian 70 M Tokens und Zhipu 20 M Tokens direkt erreichbar sind. 3) IDE- vs. CLI-Quotas stapeln nicht: Cursor Hobby 2.000 Tab-Completions + 50 langsame Premium-Requests/Monat; Copilot Free spiegelt das — Einzel-Tool-Budgets scheitern; Multi-Tool-Rotation gewinnt. 4) Token-Senken: Claude Code und Codex /init scannen ganze Repos — hunderttausende Tokens pro Lauf. Free-Tier-Nutzer müssen das verbieten. 5) DSGVO: Prompts mit Kundendaten, Ticket-IDs oder internen URLs sind personenbezogene Verarbeitung — dokumentieren Sie Zweck, Empfänger und AVV vor dem Rollout.
2. Eine Tabelle: Free-Quota-Snapshot Juni 2026
| Tool / Plattform | Free-Quota | Bezahl-Account? | EU/DE direkt | Bestes Hebel |
|---|---|---|---|---|
| Gemini CLI (OAuth) | 1.000 req/Tag, 60 RPM | Nein — Google-Konto | Ja (OAuth) | Letztes Fenster vor 18.06., keine Karte |
| Gemini API (AI Studio) | Flash 1.500/Tag | Nein | Ja | 2.5 Pro 100/Tag |
| Codex CLI | ChatGPT Free (limitiert) | Nein | Ja | Domestic/EU-API anbinden |
| OpenCode | Tool free + BYOK | Nein | Ja mit API-Key | 75+ Provider, 146K Stars |
| OpenClaw | Tool free + Multi-Provider | Nein | Ja | Gemini OAuth / EU-Keys wiederverwenden |
| GitHub Copilot Free | 2.000 Completions + 50 Premium/Mo | Nein | Ja | In GitHub-Einstellungen aktivieren |
| Cursor Hobby | 2.000 Tab + 50 langsam/Mo | Nein | Ja | Voller VS-Code-Fork |
| SiliconFlow | 20 M Tokens (permanent) | Nein — CN-Telefon | Ja (API) | DeepSeek / Qwen / GLM-5 |
| Alibaba Bailian | 70 M Tokens | Nein — Alipay KYC | Ja (API) | 70+ Modelle |
| Zhipu AI | 20 M Tokens (permanent) | Nein | Ja (API) | GLM-5, Claude-Relay |
Back-of-the-envelope: Gemini CLI (pre-cutoff) + SiliconFlow + Cursor Hobby + Copilot Free spart gegenüber Paid-Stacks grob €30–€80/Monat — genug für mehrere Tage gemieteter Remote-Mac-Kapazität. Messen Sie Ihre Baseline in einer git-trackten CSV: Tokens/Run, p95-Latenz, Fehlerquote.
3. Gemini CLI: Letzte Tage vor dem 18.06.
Pfade nach Cutoff: (1) Antigravity CLI (agy, Google-Konto, reportedly engere Limits); (2) Gemini-API-Key via AI Studio Free-Tier; (3) SiliconFlow + OpenCode/Codex für Teams ohne Google-OAuth. OAuth-Tokens über Drittanbieter-Proxies leiten verstößt gegen ToS und riskiert Kontosperre — für DSGVO-relevante Workloads: EU-Endpoint + AVV prüfen, keine PII in Telemetrie.
4. API-Routing ohne Proxy-Abhängigkeit: SiliconFlow / Bailian / Zhipu
Stack-Empfehlung: tägliches Coding auf DeepSeek-V3 (SiliconFlow); Long Context auf Qwen3.5-Max (Bailian); Claude-Code-Relay auf Zhipu GLM-5. Setzen Sie 80-%-Quota-Alarme in jedem Console — und tragen Sie API-Keys getrennt nach Umgebung (dev/stage/prod) im Verarbeitungsverzeichnis (Art. 30 DSGVO) ein.
5. IDE-Free-Tiers: Cursor Hobby und GitHub Copilot
| Feature | Cursor Hobby | Copilot Free | Copilot Student |
|---|---|---|---|
| Completions | 2.000/Monat | 2.000/Monat | Unbegrenzt |
| Premium-Agent | 50 langsam/Monat | 50/Monat | 300/Monat (~Pro) |
| Studentenpfad | cursor.com/students — 1 Jahr Pro | GitHub Education | .edu-E-Mail |
Rotation: Tab-Completions auf Copilot (Cursor-Slow-Quota schonen), Refactors auf Cursor Agent (50 Requests gezielt), Batch-Terminal auf OpenCode + API. Studierende: GitHub Education + Cursor Student Pro — weitere €240/Jahr gespart. Für Teams mit Kundendaten: Copilot Business/Enterprise mit DPA statt Consumer-Free — messbar an auditierbarem Subprocessor-Nachweis.
6. Terminal-Agent-Stack: OpenCode und OpenClaw
OpenCode eignet sich für Multi-Modell-Experimente; OpenClaw für 7×24-IM-Automation. Beide Tools sind kostenlos — Token-Kosten hängen am angebundenen API. Keys in ~/.zshrc, nie in Git; lokale Logs unter ~/.gemini/ mit Löschfrist definieren.
7. Fünf Schritte: Vom Nullpunkt zum laufenden Free-Agent-Workflow
Schritt 1 — API registrieren, Quota-Alarme setzen
Start mit SiliconFlow, Bailian oder Zhipu; zwei Anbieter für Failover. DSGVO: Zweck „Code-Assistenz“ im Verarbeitungsverzeichnis; AVV beim Cloud-Provider prüfen.
Schritt 2 — OpenCode oder Codex CLI installieren, Endpoint verifizieren
codex doctor oder OpenCode /connect; Einzeldatei-Prompt testen; Latenz <3 s bestätigen.
Schritt 3 — Gemini-CLI-OAuth vor 18.06. (optional)
1.000/Tag-Fenster nutzen; AI-Studio-API-Key als Backup exportieren.
Schritt 4 — Cursor + Copilot Dual-IDE-Rotation
Cursor Custom Model auf SiliconFlow-OpenAI-Endpoint; Copilot für Tab; Cursor-Slow für harte Refactors reservieren.
Schritt 5 — Modell-Cheat-Sheet und Token-Disziplin
Flash/Lite für einfache Tasks, Pro für schwere; nie /init Voll-Repo; Einzeldatei-Ops; Ollama Qwen3:8b lokal für Entwürfe.
8. Zehn Token-Sparregeln (Free-Tier Pflicht)
/init-Repo-Scans verbieten. Nur Einzeldatei-Scope. Gemini Flash-Lite (1.500/Tag) für Entwürfe. 80-%-Quota-Alarme. Getrennte Google-Konten für unabhängige Gemini-API-Pools (innerhalb ToS). Ollama + OpenCode lokal. Kurze System-Prompts. OpenRouter-Free-Modelle via OpenClaw scannen. Multi-Key-Load-Balance gegen 429s. Vendor-Promo-Credits beobachten. DSGVO: Prompt-Redaction-Skills vor Kundendaten.
9. Mac-Dreistufen-Routing-Matrix
| Stufe | Nutzer | Stack | Hardware |
|---|---|---|---|
| Lokal leicht | Studierende, Side Projects | Cursor Hobby + SiliconFlow + Gemini CLI (bis 18.06.) | MacBook Air 16 GB |
| Multi-Tool-Rotation | Indie-Dev | OpenCode + Copilot Free + Dual-API-Failover | MacBook Pro 24–32 GB |
| Remote 7×24 | Agent / Team | OpenClaw Gateway + launchd + API-Pool | MACGPU Remote Mac mini M4 Pro |
10. Fallstudie: Indie-Dev spart €67/Monat
„Ein Solo-Entwickler in Berlin zahlte Cursor Pro (€20/Mo.) plus Claude-API (~€47/Mo.), während ein 16-GB-MacBook Air OpenClaw unter Thermaldrosselung lief. Nach Umstellung: Copilot Free für Tab, Cursors 50 Slow-Requests + SiliconFlow DeepSeek-V3 für Refactors, Gemini CLI für Skripte bis Cutoff, OpenClaw auf MACGPU M4 Pro 32 GB Remote. Monatsende: €0 Abos, 18 M SiliconFlow-Tokens übrig — €67 Äquivalent gespart. Lokaler Mac behielt Cursor-Review und Final Cut; Agenten liefen nachts per Cron auf dem Remote-Mac — DSGVO-Log: nur Pseudonymisierte Prompts in der Cloud.“
Branchenlesart: Mitte 2026 sind Free-Tiers keine Demos mehr — sie validieren echte Workflows. Aber Policy-Fenster verengen sich (Gemini-CLI-Cutoff, teilweise Copilot-Pro-Pausen seit April 2026). Kluge Strategie: Workflows auf Free-Tiers beweisen, 7×24-Gateway auf Remote-Mac auslagern, statt Laptop-UM und Thermik an Docker-Sandboxen zu binden. Apple-Silicon-Unified-Memory bleibt die beste Preis/Leistungs-Basis für Hybrid local-Ollama + Cloud-API.
11. Zitierbare Zahlen und Checkliste
Gemini CLI OAuth: 1.000 req/Tag, Cutoff 18.06. SiliconFlow: 20 M Tokens permanent. Bailian: 70 M Tokens. Cursor Hobby: 2.000 Tab + 50 langsam/Mo. Copilot Student: ~€10/Mo. Wert. OpenCode: 146K+ GitHub Stars.
Checkliste: API konfiguriert □ | Codex/OpenCode Einzeldatei-Test □ | Gemini OAuth oder Migrationsplan □ | Cursor/Copilot-Rotation dokumentiert □ | /init-Verbot in Team-Policy □ | 80-%-Alarm gesetzt □ | Mac-Dreistufen-Routing □ | DSGVO-Eintrag Verarbeitungsverzeichnis □
Windows und Linux können SiliconFlow und OpenCode ebenfalls — macOS gewinnt bei parallelem Xcode/Final Cut/ComfyUI, Claude-Code-Seatbelt, launchd-OpenClaw 7×24 und Metal-Ollama-Validierung. Wenn Free-Agent-Stacks auf 16 GB Thermaldrosselung oder Docker-Memory-Pressure auslösen — MACGPU Remote-Mac-Knoten (M3 Pro 32 GB / Mac mini M4 Pro) hosten OpenClaw/Hermes und Headless-CI; der Laptop behält Cursor-Review und leichte API-Calls. Vorhersehbare Monatsmiete statt instabiler Durchsatz.