JUIN 2026 MAC
JETONS_IA_
CODAGE_
GRATUITS.
En juin 2026, la densité des jetons IA codage gratuits atteint un pic — tandis que le cutoff Gemini CLI du 18 juin se rapproche. Problème : les développeurs Mac alternent entre Cursor, Copilot, Gemini CLI et OpenCode sans savoir ce qui reste à 0 €, ce qui exige un proxy, ni comment remplacer Gemini après la date butoir. Conclusion : une matrice de quotas, cinq étapes de déploiement et un routage Mac en trois niveaux permettent d’exploiter des agents de codage au quotidien sans carte bancaire ; les équipes basées en Chine peuvent brancher SiliconFlow, Bailian ou Zhipu sans proxy sur Codex CLI et OpenCode. Plan : tableau des quotas → points de friction → migration Gemini → APIs domestiques → IDE gratuits → agents terminal → cinq étapes → étude de cas → décision de location Mac.
1. Points de friction : abondance d’offres, vérité fragmentée
1) Fenêtre politique étroite : Gemini CLI OAuth offre encore 1 000 requêtes/jour à 60 RPM, mais les comptes Free/Pro/Ultra personnels perdent l’accès le 18 juin — voie officielle : Antigravity CLI propriétaire (voir notre analyse de la politique Gemini CLI). 2) Coupure réseau : les outils Google OAuth depuis la Chine continentale requièrent un proxy ; SiliconFlow accorde 20 M de tokens permanents, Alibaba Bailian 70 M tokens, Zhipu 20 M tokens — tous en accès direct. 3) Quotas IDE et CLI non cumulables : Cursor Hobby propose 2 000 complétions Tab + 50 requêtes premium lentes/mois ; Copilot Free reflète ce plafond — la rotation multi-outils s’impose. 4) Puits à tokens : Claude Code et Codex /init scannent des dépôts entiers — des centaines de milliers de tokens en une passe. À interdire en free tier.
2. Un tableau : snapshot des quotas gratuits — juin 2026
| Outil / plateforme | Quota gratuit | Compte payant ? | Accès direct FR/EU | Meilleur levier |
|---|---|---|---|---|
| Gemini CLI (OAuth) | 1 000 req/j, 60 RPM | Non — compte Google | Oui (OAuth) | Dernière fenêtre avant le 18/06, sans carte |
| Gemini API (AI Studio) | Flash 1 500/j | Non | Oui | 2.5 Pro 100/j |
| Codex CLI | ChatGPT free (limité) | Non | Oui | Pointer vers API domestique |
| OpenCode | Outil free + BYOK | Non | Oui avec clé API | 75+ fournisseurs, 146K stars |
| OpenClaw | Outil free + multi-provider | Non | Oui | Réutiliser OAuth Gemini / clés |
| GitHub Copilot Free | 2 000 complétions + 50 premium/mois | Non | Oui | Activer dans les paramètres GitHub |
| Cursor Hobby | 2 000 Tab + 50 lentes/mois | Non | Oui | Fork VS Code complet |
| SiliconFlow | 20 M tokens (permanents) | Non — téléphone CN | Oui (API) | DeepSeek / Qwen / GLM-5 |
| Alibaba Bailian | 70 M tokens | Non — KYC Alipay | Oui (API) | 70+ modèles |
| Zhipu AI | 20 M tokens (permanents) | Non | Oui (API) | GLM-5, relais Claude |
Estimation rapide : Gemini CLI (avant cutoff) + SiliconFlow + Cursor Hobby + Copilot Free économise environ 30–80 $/mois par rapport à un stack payant — de quoi financer plusieurs jours de nœud Mac distant loué.
3. Gemini CLI : derniers jours avant le 18 juin
Voies post-cutoff : (1) Antigravity CLI (agy, compte Google, quotas plus serrés) ; (2) clé API Gemini via le free tier AI Studio ; (3) SiliconFlow + OpenCode/Codex pour ceux qui évitent OAuth Google. Router les tokens OAuth Gemini via des proxys tiers viole les CGU et expose au bannissement de compte.
4. Route sans proxy : SiliconFlow / Bailian / Zhipu
Recommandation : codage quotidien sur DeepSeek-V3 (SiliconFlow) ; long contexte sur Qwen3.5-Max (Bailian) ; relais Claude Code sur Zhipu GLM-5. Configurez des alertes à 80 % de quota dans chaque console.
5. IDE gratuits : Cursor Hobby et GitHub Copilot
| Fonctionnalité | Cursor Hobby | Copilot Free | Copilot Student |
|---|---|---|---|
| Complétions | 2 000/mois | 2 000/mois | Illimitées |
| Agent premium | 50 lentes/mois | 50/mois | 300/mois (~Pro) |
| Parcours étudiant | cursor.com/students — 1 an Pro | GitHub Education | E-mail .edu |
Rotation : complétions Tab sur Copilot (préserver le quota lent Cursor), refactors sur Cursor Agent (dépenser les 50 avec parcimonie), travail terminal par lots sur OpenCode + API. Étudiants : GitHub Education + Cursor Student Pro — 240 $/an économisés supplémentaires.
6. Stack agents terminal : OpenCode et OpenClaw
OpenCode excelle dans les expérimentations multi-modèles ; OpenClaw dans l’automatisation IM 7×24. Les deux outils sont gratuits — le coût en tokens dépend entièrement de l’API branchée. Free tiers domestiques = coût d’exploitation nul.
7. Cinq étapes : du zéro au workflow agent gratuit
Étape 1 — Enregistrer une API, configurer les alertes quota
Commencez par SiliconFlow, Bailian ou Zhipu ; enregistrez-en deux pour le failover. Stockez les clés dans ~/.zshrc, jamais dans Git.
Étape 2 — Installer OpenCode ou Codex CLI, vérifier l’endpoint
Lancez codex doctor ou OpenCode /connect ; testez un prompt mono-fichier ; confirmez une latence inférieure à 3 s.
Étape 3 — Compléter OAuth Gemini CLI avant le 18 juin (optionnel)
Les utilisateurs disposant d’un accès proxy devraient exploiter la fenêtre 1 000/j ; exportez une clé API AI Studio en secours.
Étape 4 — Configurer la rotation dual-IDE Cursor + Copilot
Pointez le modèle personnalisé Cursor vers l’endpoint OpenAI SiliconFlow ; laissez Copilot gérer le Tab ; réservez les requêtes lentes Cursor aux refactors difficiles.
Étape 5 — Aide-mémoire modèles et discipline tokens
Flash/Lite pour tâches simples, Pro pour les complexes ; jamais /init sur tout le dépôt ; opérations mono-fichier ; Ollama Qwen3:8b local pour les brouillons.
8. Dix règles d’économie de tokens (obligatoires en free tier)
Interdire les scans /init. Scope mono-fichier uniquement. Gemini Flash-Lite (1 500/j) pour brouillons. Alertes quota à 80 %. Comptes Google séparés pour pools API Gemini indépendants (dans les CGU). Ollama + OpenCode pour brouillons locaux. Prompts système courts. Modèles free OpenRouter via OpenClaw. Load balance multi-clés contre les 429. Surveiller les crédits promo des éditeurs.
9. Matrice de routage Mac en trois niveaux
| Niveau | Profil | Stack | Matériel |
|---|---|---|---|
| Local léger | Étudiant, projets annexes | Cursor Hobby + SiliconFlow + Gemini CLI (jusqu’au 18/06) | MacBook Air 16 Go |
| Rotation multi-outils | Indépendant | OpenCode + Copilot Free + failover dual API | MacBook Pro 24–32 Go |
| Remote permanent | Agent 7×24 / équipe | OpenClaw Gateway + launchd + pool API | MACGPU Mac mini M4 Pro distant |
10. Étude de cas : un indépendant économise 67 $/mois
« Un développeur solo à Lyon payait Cursor Pro (20 $/mois) plus l’API Claude (~47 $/mois), tandis qu’un MacBook Air 16 Go peinait sous OpenClaw. Après restructuration : Copilot Free pour le Tab, les 50 requêtes lentes Cursor + SiliconFlow DeepSeek-V3 pour les refactors, Gemini CLI pour les scripts jusqu’au cutoff, OpenClaw migré vers un nœud distant MACGPU M4 Pro 32 Go. Facture de fin de mois : 0 $ d’abonnements, 18 M tokens SiliconFlow restants — 67 $ économisés en équivalent. Le Mac local conservait Cursor pour la revue et Final Cut ; les agents exécutaient des cron nocturnes sur le Mac distant. »
Lecture sectorielle : mi-2026, les free tiers ne sont plus des démos — ils valident des workflows réels. Mais les fenêtres politiques se resserrent (cutoff Gemini CLI, pauses partielles Copilot Pro depuis avril 2026). Stratégie avisée : prouver les workflows en free tier, déléguer le Gateway 7×24 à un Mac distant plutôt que d’épuiser la mémoire unifiée et la thermique du portable sur des sandboxes Docker. La mémoire unifiée Apple Silicon reste la base prix/performance idéale pour l’architecture hybride brouillon Ollama local + API cloud principale.
11. Chiffres citables et checklist
Gemini CLI OAuth : 1 000 req/j, cutoff 18 juin. SiliconFlow : 20 M tokens permanents. Bailian : 70 M tokens. Cursor Hobby : 2 000 Tab + 50 lentes/mois. Copilot Student : ~10 $/mois de valeur. OpenCode : 146K+ stars GitHub.
Checklist : API configurée □ | Test mono-fichier Codex/OpenCode □ | OAuth Gemini ou plan de migration □ | Rotation Cursor/Copilot documentée □ | Interdiction /init en politique d’équipe □ | Alerte quota 80 % □ | Routage Mac trois niveaux □
Windows et Linux peuvent aussi exécuter SiliconFlow et OpenCode, mais macOS demeure supérieur pour les workflows parallèles Xcode/Final Cut/ComfyUI, le sandbox Seatbelt de Claude Code, OpenClaw launchd 7×24 et la validation Ollama côté Metal. Si un stack agent gratuit sur 16 Go provoque throttling thermique ou pression mémoire Docker — les nœuds Mac distants MACGPU (M3 Pro 32 Go / Mac mini M4 Pro) hébergent OpenClaw/Hermes et la CI headless pendant que le portable conserve Cursor pour la revue et les appels API légers : un loyer mensuel prévisible contre un débit stable.