OPUS 5
DÉMI-TARIF_
FLAGSHIP · K3 POLEMIQUE.
Synthèse : Deux récits cette semaine semblent distincts, mais partagent un fil — qui livre l'intelligence de pointe à un prix soutenable pour les développeurs, et d'où provient réellement cette capacité. Enjeu : choisir entre le nouveau modèle quotidien Opus 5 d'Anthropic et le K3 open-weight ultra-abordable de Moonshot, alors que les accusations de distillation de la Maison Blanche et le fait que K3 insiste pour se nommer Claude brouillent la décision. Conclusion : Opus 5 est la mise à niveau pragmatique pour les workflows sensibles à la conformité ; la controverse K3 reste ouverte, mais la fuite d'IDs de déploiement de Greenblatt constitue le signal technique le plus reproductible à ce jour. Plan : analyse Opus 5 → tableau Opus vs Fable → chronologie distillation K3 → « pourquoi K3 dit Claude » → guide Mac en 5 étapes → analyse sectorielle → FAQ.
TL;DR 30 secondes
| Opus 5 | Sorti le 24 juil. · Défaut Claude Max · $5/$25 par M tokens · écart 0,5 % vs Fable 5 sur CursorBench |
| K3 | Lancé le 16 juil. · 2,8T params · poids prévus 27 juil. · accusation Maison Blanche 22 juil. |
| Accroche technique | K3 s'identifie comme Claude · émet claude-opus-4-5-20250929 |
| Contre-argument temporel | Fable 5 public depuis le 1er juil. seulement · 2 semaines avant K3 · experts sceptiques |
1. Enjeux : pourquoi ces deux histoires comptent maintenant
- Prix flagship vs écart du modèle quotidien. Fable 5 domine les benchmarks mais coûte ~$10/$50 par million de tokens et exige un opt-in de rétention de 30 jours. Les utilisateurs Pro/Max attendaient un « flagship à moitié prix » — Opus 5 est la réponse d'Anthropic.
- Open weights qui rattrapent, provenance incertaine. K3 ne cède qu'à Fable 5 et GPT-5.6 Sol sur les graphiques Moonshot, à une fraction du prix. Quand la Maison Blanche évoque une « distillation industrielle », conformité et risque supply-chain deviennent des critères de sélection réels.
- Rhetorique politique vs signaux reproductibles. Le post X de Kratsios sans preuves publiques. Ce qui a alerté la communauté : la découverte de Greenblatt — K3 rapporte les métadonnées de déploiement Anthropic plus fidèlement que les modèles Claude eux-mêmes.
- Pression de routage pour les développeurs Mac. Les stacks multi-modèles Cursor et OpenClaw doivent concilier « API Claude conforme » et « repli open-weight économique ». Voir notre guide OpenRouter et le compte à rebours poids K3 — les événements de cette semaine touchent directement les tables de routage.
2. Claude Opus 5 : le modèle le plus pratique d'Anthropic
Le 24 juillet 2026, Anthropic a livré Claude Opus 5 (ID modèle : claude-opus-5) et l'a immédiatement établi comme défaut sur Claude Max, plus puissant modèle accessible aux abonnés Claude Pro. Tarification inchangée par rapport à Opus 4.8 : $5 / $25 par million de tokens entrée/sortie. Fenêtre de contexte : 1M tokens (niveau unique). Sortie max : 128K tokens. Thinking activé par défaut.
2.1 Saut de benchmark à tarif stable
| Benchmark | Opus 5 | Notes |
|---|---|---|
| Frontier-Bench v0.1 | Surpasse tous les modèles | 2×+ Opus 4.8 à coût par tâche inférieur |
| CursorBench 3.2 (max effort) | 0,5 % sous le pic Fable 5 | Moitié du coût par tâche |
| ARC-AGI 3 | 3× le modèle suivant | Saut en résolution de problèmes inédits |
| OSWorld 2.0 | Surpasse le meilleur Fable 5 | Moins d'1/3 du coût Fable 5 |
| Zapier AutomationBench | 100 % de réussite | Aucun modèle antérieur n'a complété le workflow |
L'équipe Cursor : « Claude Opus 5 délivre une intelligence proche de Fable 5 à la vitesse et au coût d'Opus. » Box a signalé +11 % sur les workflows d'analyse de données, +17 % en due diligence, +8 % de précision globale.
2.2 Sécurité et rétention des données
Opus 5 est le modèle le mieux aligné d'Anthropic à ce jour — taux de comportement trompeur le plus bas, le plus difficile à détourner. Anthropic n'a cependant pas poussé Opus 5 à la frontière du risque cyber/bio à double usage — ce lane reste réservé à Mythos 5. Les classificateurs cyber interviennent ~85 % moins qu'avec Fable 5, permettant la découverte de vulnérabilités en code source tout en bloquant scan binaire, pentest et génération d'exploits.
Détail facile à manquer : pas de rétention de données imposée pour l'accès général Opus 5. Fable 5 et Mythos 5 exigent un opt-in de 30 jours — différentiateur de conformité significatif pour les équipes créatives et enterprise.
3. Claude Opus 5 vs Fable 5 : tableau de décision
| Dimension | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Tarif entrée / sortie | $5 / $25 par M tokens | ~$10 / $50 |
| Pic CursorBench 3.2 | 0,5 % sous Fable 5 | Plafond coding actuel |
| Défaut Claude Max | Oui (depuis 24 juil.) | Non |
| Rétention données | Non requise par défaut | Opt-in 30 jours requis |
| Frontière risque dual-use | Volontairement plafonnée | Plus forte (Mythos 5 restreint) |
| Idéal pour | Coding quotidien, agents, workflows conformité | Tâches benchmark de pointe, besoins frontier absolus |
4. Controverse distillation Kimi K3 : Maison Blanche vs chronologie
Moonshot AI a publié Kimi K3 le 16 juillet 2026 : 2,8 billions de paramètres totaux, MoE sparse (16 experts actifs sur 896, ~50B paramètres actifs), contexte 1M tokens avec vision native. GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Poids complets promis pour le 27 juillet — non vérifiables de l'extérieur pendant la polémique.
4.1 Accusation de la Maison Blanche et antécédents Anthropic
Les 22–23 juillet, le directeur OSTP Michael Kratsios a affirmé que Moonshot menait une « distillation industrielle covert à grande échelle » du modèle Fable, et a séparément allégué des puces Nvidia GB300 soumises à export control routées via la Thaïlande. Le secrétaire au Trésor Scott Bessent a évoqué des « filigranes » de LLM américains sur des modèles chinois sans définir le terme.
Contexte : en février 2026, Anthropic a nommé publiquement Moonshot, DeepSeek et MiniMax, invoquant 3,4M+ interactions API anormales reflétant une « extraction délibérée de capacités ».
4.2 Les chercheurs indépendants contestent le timing
« Fable n'est public que depuis le 1er juillet. On ne peut pas distiller autant de données, entraîner un modèle et le publier en deux semaines. » — Braden Hancock, cofondateur de Snorkel AI
Nathan Lambert (Allen Institute for AI) : à mesure que les modèles chinois approchent la frontière et que l'entraînement bascule vers le reinforcement learning, la distillation simple offre des rendements décroissants — si c'était facile, tout le monde aurait rattrapé.
5. Pourquoi Kimi K3 insiste pour se nommer Claude
C'est l'angle qui mérite l'attention du lecteur technique — et presque personne en dehors du dépôt GitHub de Greenblatt (rgreenblatt/which_claude_is_k3) ne l'a traité en profondeur.
Ryan Greenblatt, chief scientist de Redwood Research, a publié vers le 24 juillet une analyse statistique : invité à s'identifier, Kimi K3 s'auto-identifie disproportionnellement comme Claude — et précisément. Il émet parfois des IDs de déploiement internes Anthropic exacts :
Les vrais modèles Claude ne disent même pas cela sur eux-mêmes. Claude Sonnet 4.5 se contente de « Je suis Claude Sonnet 4.5. » Opus 4.5 ne donne souvent pas de chaîne de version ou se trompe.
Lecture de Greenblatt : un modèle reproduisant les métadonnées de déploiement de son enseignant plus fidèlement que l'enseignant ne le fait sur lui-même est difficile à expliquer par mimétisme conversationnel. Cela pointe vers un entraînement sur des données Claude étiquetées avec métadonnées de déploiement — logs API ou données synthétiques taguées — une forme de distillation spécifique, plus difficile à écarter.
Détail notable : l'identité fuitée de K3 renvoie à l'« ère Claude 4.5 » (fin 2025), pas à la génération Fable/Mythos actuelle — tandis que le signal de Kimi K2 pointait vers un Claude Sonnet 4 antérieur. Un schéma de rattrapage génération par génération.
Réserve importante : Greenblatt insiste — cela ne prouve pas qu'une distillation a eu lieu ; contamination, prompts système fuités ou jeux de données synthétiques publics pourraient aussi l'expliquer. Combiné à l'accusation d'Anthropic en février, c'est le premier signal technique reproductible de la saga, au-delà de la rhétorique politique.
6. Cinq étapes : ajuster votre stack modèle sur Mac
- Prioriser la conformité. Données enterprise ou travail sensible export-control → la non-rétention par défaut d'Opus 5 + API officielle l'emporte sur K3 tant que la provenance n'est pas clarifiée.
- Mettre à jour le modèle principal Cursor / OpenClaw. Les utilisateurs Claude Max basculent sur Opus 5. Benchmarker explicitement
claude-opus-5vs Fable 5 sur le coût par tâche de projets réels. - Configurer la chaîne de repli OpenRouter. Primaire Opus 5 → repli rate-limit vers DeepSeek V4 Flash ou API K3 (si risque de provenance accepté) → tier gratuit pour debug de prompts selon notre guide OpenRouter.
- Caler le 27 juillet pour les poids K3. Une fois publiés, benchmarks isolés et tests identity-probe sur un nœud non production — reproduire vous-même les statistiques de Greenblatt.
- Isoler les stress tests du dev quotidien. Runs agents long-contexte et A/B multi-modèles ne doivent pas saturer la mémoire unifiée du MacBook — déléguer à un nœud Mac distant (voir conclusion).
7. Chronologie
| Date | Événement |
|---|---|
| Fév. 2026 | Anthropic accuse Moonshot/DeepSeek/MiniMax de distillation industrielle |
| 1er juil. | Claude Fable 5 disponible publiquement |
| 16 juil. | Lancement API/produit Kimi K3 |
| 22–23 juil. | Maison Blanche : Kratsios distillation + allégations puces |
| 24 juil. | Sortie Claude Opus 5 ; analyse identité Greenblatt |
| 27 juil. (prévu) | Poids open complets Kimi K3 |
8. Analyse sectorielle : guerre des prix et provenance
Opus 5 et la polémique K3 marquent ensemble un changement de phase : la capacité frontier se commoditise. Anthropic ne brade pas un stock ancien — elle restructure la gamme : Fable 5 tient la frontière absolue, Opus 5 prend le rôle quotidien, Mythos 5 verrouille le risque dual-use.
Moonshot attaque le même marché avec open weights, prix ultra-bas et moins de refus. La controverse K3 est le premier flashpoint public d'une question plus sordide : quand un labo revendique des performances frontier au dixième du prix, comment distinguer un meilleur engineering d'un modèle qui chevauche discrètement le vôtre ?
Pour les développeurs Mac, ce n'est pas un spectacle. Les défauts Cursor, chaînes de repli OpenClaw et tables OpenRouter seront réécrites dans les 30 prochains jours, Opus 5 devenant défaut et les poids K3 arrivant. L'angle deployment-ID de Greenblatt compte car il offre une méthode de détection reproductible et quantifiable — lancez vos propres identity probes ; n'attendez pas les enquêtes gouvernementales.
r/LocalLLaMA se divise en trois : enthousiasme que l'écart open-closed se compte en « jours pas mois » ; blagues que personne ne fera tourner 2,8T en local ; pragmatiques pour qui le vrai argument de K3 reste prix et absence de refus, pas « battre Fable 5 ». Jusqu'au 27 juillet, les claims d'architecture restent « auto-déclaration vendor + suppositions externes ».
9. FAQ
Q : Combien Opus 5 coûte-t-il moins cher que Fable 5 ?
R : Environ la moitié par token ($5/$25 vs ~$10/$50), à 0,5 % du pic CursorBench.
Q : Opus 5 est-il le défaut Claude Max ?
R : Oui, depuis le 24 juillet 2026.
Q : Moonshot a-t-il distillé K3 depuis Claude ?
R : Non confirmé. Maison Blanche sans preuves publiques ; chronologie contestée ; l'auto-ID Claude de Greenblatt est la preuve technique indirecte la plus solide.
Q : Quand sortent les poids complets de K3 ?
R : Engagement pour le 27 juillet 2026 — pas encore disponibles à la publication.
Q : Pourquoi K3 dit-il être Claude ?
R : Biais statistique vers l'identité Claude plus chaînes d'ID de déploiement internes — probable contamination de données d'entraînement avec échantillons Claude tagués ; pas preuve concluante de distillation.
10. Conclusion : Opus 5 pour API conforme, nœuds Mac pour stress tests
Claude API ou Kimi K3 sur des box cloud Windows/Linux convient au coding quotidien. Mais si vous exécutez Cursor + agents longue session Opus 5, stress tests multi-modèles OpenClaw ou reproduction isolée des identity probes K3 sur Mac, la combinaison mémoire unifiée Apple Silicon + toolchain Metal + exploitation 24/7 stable reste la voie la moins frictionnelle — particulièrement pour les workflows créatifs où la compatibilité outillage compte autant que le débit brut.
Partage pragmatique : machine principale sur Opus 5 / routage OpenRouter conforme ; déléguer stress tests agents, benchmarks poids K3 et lots long-contexte à des nœuds Mac mini M4 distants MACGPU — location à la demande, isolés SSH, pour que les expériences 2,8T ne paralysent pas votre machine de travail. Avec un flagship à moitié prix et une frontier open contestée cette semaine, la validation isolée vaut mieux qu'un pari sur une seule stack.