JUNI 2026 MAC
KOSTENLOSE_
KI_CODING_
TOKENS.

Kostenlose KI-Coding-Tokens für Mac-Entwickler

Im Juni 2026 erreicht die Dichte kostenloser KI-Coding-Tokens ein Maximum — parallel zum Countdown zum Gemini-CLI-Cutoff am 18.06. Schmerzpunkt: Mac-Entwickler rotieren zwischen Cursor, Copilot, Gemini CLI und OpenCode, ohne belastbare Daten darüber zu haben, was noch €0 kostet, Proxy braucht oder Gemini nach dem Cutoff ersetzt. Ergebnis: eine Quota-Matrix, fünf Setup-Schritte und eine dreistufige Mac-Routing-Tabelle ermöglichen den Alltagseinsatz von Coding-Agenten ohne Kreditkarte; EU-Teams dokumentieren zugleich DSGVO-konforme Verarbeitung. Aufbau: Quota-Tabelle → Schmerzpunkte → Gemini-Migration → EU-/CN-APIs → IDE-Free-Tiers → Terminal-Agenten → fünf Schritte → Fallstudie → Mac-Miet-Entscheidung.

1. Schmerzpunkte: Viele Free-Tiers, fragmentierte Wahrheit

1) Policy-Fenster schmal: Gemini CLI OAuth liefert noch 1.000 Requests/Tag bei 60 RPM, aber Free/Pro/Ultra-Privatnutzer verlieren Zugang am 18.06. — offizieller Pfad: geschlossene Antigravity CLI (siehe unsere Gemini-CLI-Richtlinienanalyse). 2) Netzwerk-Split: Google-OAuth aus der EU meist unproblematisch; aus Festlandchina brauchen OAuth-Tools Proxy, während SiliconFlow 20 M permanente Tokens, Alibaba Bailian 70 M Tokens und Zhipu 20 M Tokens direkt erreichbar sind. 3) IDE- vs. CLI-Quotas stapeln nicht: Cursor Hobby 2.000 Tab-Completions + 50 langsame Premium-Requests/Monat; Copilot Free spiegelt das — Einzel-Tool-Budgets scheitern; Multi-Tool-Rotation gewinnt. 4) Token-Senken: Claude Code und Codex /init scannen ganze Repos — hunderttausende Tokens pro Lauf. Free-Tier-Nutzer müssen das verbieten. 5) DSGVO: Prompts mit Kundendaten, Ticket-IDs oder internen URLs sind personenbezogene Verarbeitung — dokumentieren Sie Zweck, Empfänger und AVV vor dem Rollout.

2. Eine Tabelle: Free-Quota-Snapshot Juni 2026

Tool / PlattformFree-QuotaBezahl-Account?EU/DE direktBestes Hebel
Gemini CLI (OAuth)1.000 req/Tag, 60 RPMNein — Google-KontoJa (OAuth)Letztes Fenster vor 18.06., keine Karte
Gemini API (AI Studio)Flash 1.500/TagNeinJa2.5 Pro 100/Tag
Codex CLIChatGPT Free (limitiert)NeinJaDomestic/EU-API anbinden
OpenCodeTool free + BYOKNeinJa mit API-Key75+ Provider, 146K Stars
OpenClawTool free + Multi-ProviderNeinJaGemini OAuth / EU-Keys wiederverwenden
GitHub Copilot Free2.000 Completions + 50 Premium/MoNeinJaIn GitHub-Einstellungen aktivieren
Cursor Hobby2.000 Tab + 50 langsam/MoNeinJaVoller VS-Code-Fork
SiliconFlow20 M Tokens (permanent)Nein — CN-TelefonJa (API)DeepSeek / Qwen / GLM-5
Alibaba Bailian70 M TokensNein — Alipay KYCJa (API)70+ Modelle
Zhipu AI20 M Tokens (permanent)NeinJa (API)GLM-5, Claude-Relay

Back-of-the-envelope: Gemini CLI (pre-cutoff) + SiliconFlow + Cursor Hobby + Copilot Free spart gegenüber Paid-Stacks grob €30–€80/Monat — genug für mehrere Tage gemieteter Remote-Mac-Kapazität. Messen Sie Ihre Baseline in einer git-trackten CSV: Tokens/Run, p95-Latenz, Fehlerquote.

3. Gemini CLI: Letzte Tage vor dem 18.06.

npm install -g @google/gemini-cli gemini # Sign in with Google /model gemini-2.5-flash /stats model

Pfade nach Cutoff: (1) Antigravity CLI (agy, Google-Konto, reportedly engere Limits); (2) Gemini-API-Key via AI Studio Free-Tier; (3) SiliconFlow + OpenCode/Codex für Teams ohne Google-OAuth. OAuth-Tokens über Drittanbieter-Proxies leiten verstößt gegen ToS und riskiert Kontosperre — für DSGVO-relevante Workloads: EU-Endpoint + AVV prüfen, keine PII in Telemetrie.

4. API-Routing ohne Proxy-Abhängigkeit: SiliconFlow / Bailian / Zhipu

export OPENAI_API_KEY="sk-xxxx" export OPENAI_BASE_URL="https://api.siliconflow.cn/v1" # ~/.codex/config.toml # openai_base_url = "https://api.siliconflow.cn/v1" # model = "deepseek-ai/DeepSeek-V3" # sandbox_mode = "workspace-write" # Bailian: https://dashscope.aliyuncs.com/compatible-mode/v1

Stack-Empfehlung: tägliches Coding auf DeepSeek-V3 (SiliconFlow); Long Context auf Qwen3.5-Max (Bailian); Claude-Code-Relay auf Zhipu GLM-5. Setzen Sie 80-%-Quota-Alarme in jedem Console — und tragen Sie API-Keys getrennt nach Umgebung (dev/stage/prod) im Verarbeitungsverzeichnis (Art. 30 DSGVO) ein.

5. IDE-Free-Tiers: Cursor Hobby und GitHub Copilot

FeatureCursor HobbyCopilot FreeCopilot Student
Completions2.000/Monat2.000/MonatUnbegrenzt
Premium-Agent50 langsam/Monat50/Monat300/Monat (~Pro)
Studentenpfadcursor.com/students — 1 Jahr ProGitHub Education.edu-E-Mail

Rotation: Tab-Completions auf Copilot (Cursor-Slow-Quota schonen), Refactors auf Cursor Agent (50 Requests gezielt), Batch-Terminal auf OpenCode + API. Studierende: GitHub Education + Cursor Student Pro — weitere €240/Jahr gespart. Für Teams mit Kundendaten: Copilot Business/Enterprise mit DPA statt Consumer-Free — messbar an auditierbarem Subprocessor-Nachweis.

6. Terminal-Agent-Stack: OpenCode und OpenClaw

curl -fsSL https://opencode.ai/install | bash opencode # /connect provider, /models switch npm install -g openclaw@latest openclaw models auth login --provider google-gemini-cli --set-default

OpenCode eignet sich für Multi-Modell-Experimente; OpenClaw für 7×24-IM-Automation. Beide Tools sind kostenlos — Token-Kosten hängen am angebundenen API. Keys in ~/.zshrc, nie in Git; lokale Logs unter ~/.gemini/ mit Löschfrist definieren.

7. Fünf Schritte: Vom Nullpunkt zum laufenden Free-Agent-Workflow

Schritt 1 — API registrieren, Quota-Alarme setzen

Start mit SiliconFlow, Bailian oder Zhipu; zwei Anbieter für Failover. DSGVO: Zweck „Code-Assistenz“ im Verarbeitungsverzeichnis; AVV beim Cloud-Provider prüfen.

Schritt 2 — OpenCode oder Codex CLI installieren, Endpoint verifizieren

codex doctor oder OpenCode /connect; Einzeldatei-Prompt testen; Latenz <3 s bestätigen.

Schritt 3 — Gemini-CLI-OAuth vor 18.06. (optional)

1.000/Tag-Fenster nutzen; AI-Studio-API-Key als Backup exportieren.

Schritt 4 — Cursor + Copilot Dual-IDE-Rotation

Cursor Custom Model auf SiliconFlow-OpenAI-Endpoint; Copilot für Tab; Cursor-Slow für harte Refactors reservieren.

Schritt 5 — Modell-Cheat-Sheet und Token-Disziplin

Flash/Lite für einfache Tasks, Pro für schwere; nie /init Voll-Repo; Einzeldatei-Ops; Ollama Qwen3:8b lokal für Entwürfe.

8. Zehn Token-Sparregeln (Free-Tier Pflicht)

/init-Repo-Scans verbieten. Nur Einzeldatei-Scope. Gemini Flash-Lite (1.500/Tag) für Entwürfe. 80-%-Quota-Alarme. Getrennte Google-Konten für unabhängige Gemini-API-Pools (innerhalb ToS). Ollama + OpenCode lokal. Kurze System-Prompts. OpenRouter-Free-Modelle via OpenClaw scannen. Multi-Key-Load-Balance gegen 429s. Vendor-Promo-Credits beobachten. DSGVO: Prompt-Redaction-Skills vor Kundendaten.

9. Mac-Dreistufen-Routing-Matrix

StufeNutzerStackHardware
Lokal leichtStudierende, Side ProjectsCursor Hobby + SiliconFlow + Gemini CLI (bis 18.06.)MacBook Air 16 GB
Multi-Tool-RotationIndie-DevOpenCode + Copilot Free + Dual-API-FailoverMacBook Pro 24–32 GB
Remote 7×24Agent / TeamOpenClaw Gateway + launchd + API-PoolMACGPU Remote Mac mini M4 Pro

10. Fallstudie: Indie-Dev spart €67/Monat

„Ein Solo-Entwickler in Berlin zahlte Cursor Pro (€20/Mo.) plus Claude-API (~€47/Mo.), während ein 16-GB-MacBook Air OpenClaw unter Thermaldrosselung lief. Nach Umstellung: Copilot Free für Tab, Cursors 50 Slow-Requests + SiliconFlow DeepSeek-V3 für Refactors, Gemini CLI für Skripte bis Cutoff, OpenClaw auf MACGPU M4 Pro 32 GB Remote. Monatsende: €0 Abos, 18 M SiliconFlow-Tokens übrig — €67 Äquivalent gespart. Lokaler Mac behielt Cursor-Review und Final Cut; Agenten liefen nachts per Cron auf dem Remote-Mac — DSGVO-Log: nur Pseudonymisierte Prompts in der Cloud.“

Branchenlesart: Mitte 2026 sind Free-Tiers keine Demos mehr — sie validieren echte Workflows. Aber Policy-Fenster verengen sich (Gemini-CLI-Cutoff, teilweise Copilot-Pro-Pausen seit April 2026). Kluge Strategie: Workflows auf Free-Tiers beweisen, 7×24-Gateway auf Remote-Mac auslagern, statt Laptop-UM und Thermik an Docker-Sandboxen zu binden. Apple-Silicon-Unified-Memory bleibt die beste Preis/Leistungs-Basis für Hybrid local-Ollama + Cloud-API.

11. Zitierbare Zahlen und Checkliste

Gemini CLI OAuth: 1.000 req/Tag, Cutoff 18.06. SiliconFlow: 20 M Tokens permanent. Bailian: 70 M Tokens. Cursor Hobby: 2.000 Tab + 50 langsam/Mo. Copilot Student: ~€10/Mo. Wert. OpenCode: 146K+ GitHub Stars.

Checkliste: API konfiguriert □ | Codex/OpenCode Einzeldatei-Test □ | Gemini OAuth oder Migrationsplan □ | Cursor/Copilot-Rotation dokumentiert □ | /init-Verbot in Team-Policy □ | 80-%-Alarm gesetzt □ | Mac-Dreistufen-Routing □ | DSGVO-Eintrag Verarbeitungsverzeichnis □

Windows und Linux können SiliconFlow und OpenCode ebenfalls — macOS gewinnt bei parallelem Xcode/Final Cut/ComfyUI, Claude-Code-Seatbelt, launchd-OpenClaw 7×24 und Metal-Ollama-Validierung. Wenn Free-Agent-Stacks auf 16 GB Thermaldrosselung oder Docker-Memory-Pressure auslösen — MACGPU Remote-Mac-Knoten (M3 Pro 32 GB / Mac mini M4 Pro) hosten OpenClaw/Hermes und Headless-CI; der Laptop behält Cursor-Review und leichte API-Calls. Vorhersehbare Monatsmiete statt instabiler Durchsatz.