GROK 4.6
7_AUG_
1,5T_
TARGET.
28 июля 2026 Илон Маск в ответе Guillermo Rauch (CEO Vercel) на X заявил: Grok 4.6 выйдет «примерно 7 августа» с 1,5T параметров и упором на SFT/RL post-training; через несколько недель — Grok 4.7 на 2,1T. Это не официальный релиз xAI, а твит. Боль: «Musk time» сдвигает дедлайны, zero benchmark data на анонсированные спеки, и окно выбора сжато open-weight-шоком Kimi K3. Вывод: пока xAI не выкатит model card, решать нужно по token efficiency и реальной стоимости задачи — не по счётчику параметров. Структура: таймлайн, spec-таблицы, разбор SFT/RL, сравнение с конкурентами, caveats, bottleneck августа 2026, 5-step guide, FAQ.
Executive summary за 30 секунд
| Источник | Ответ Маска на X 28 июля (не пост xAI) |
| Grok 4.6 | ~7 авг. · 1,5T params · фокус SFT/RL upgrade |
| Grok 4.7 | Конец авг.–нач. сен. · 2,1T · лучше 4.6, чуть медленнее serving |
| Конкурентный контекст | ~10 дней после open weights Kimi K3 · слухи Fable 5.1 в том же месяце |
| Цены / бенчмарки | Всё пусто — нет model card, нет third-party scores |
1. Pain points: почему превью важно — и почему ему нельзя доверять полностью
- «Musk time» — не мем, а метрика. Дедлайны xAI, Tesla и SpaceX исторически сдвигаются на дни–недели.
- Единственный source of truth — твит. В отличие от Grok 4.5 с 15 бенчмарками и model card, у 4.6/4.7 ноль независимой верификации.
- Kimi K3 поднял планку. Open-weight релиз 26 июля (2,8T, Frontend Code Arena 1 679 pts) получил одобрение самого Маска; ускорение роадмапа xAI — самое правдоподобное объяснение.
2. Таймлайн: Grok 4.5 → 4.6 → 4.7
| Дата | Событие |
|---|---|
| 8 июл. 2026 | xAI шипит Grok 4.5: coding/agentic flagship, co-training с Cursor, 500K context, $2/$6 за 1M input/output tokens |
| 16 июл. | Hosted preview Kimi K3 от Moonshot AI |
| 26 июл. | Full open-weight release Kimi K3 (2,8T, 1M context) |
| 28 июл. | Маск постит роадмап Grok 4.6/4.7; в тот же день 1 200+ сотрудников публикуют «Pacing the Frontier» |
| ~7 авг. | Target Grok 4.6: 1,5T params, фокус SFT/RL upgrade |
| ~Конец авг.–нач. сен. | Target Grok 4.7: 2,1T params, broadly лучше 4.6, slightly slower serving, лучше token efficiency |
3. Core data table
| Модель | Дата | Параметры | Фокус | Статус |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 апр. 2026 | Не раскрыто | Baseline | Shipped |
| Grok 4.5 | 8 июл. 2026 | Не раскрыто | Coding/agentic, Cursor co-training | Shipped, benchmarked |
| Grok 4.6 | ~7 авг. | 1,5T | SFT/RL upgrade | Announced via tweet |
| Grok 4.7 | ~Конец авг.–нач. сен. | 2,1T | Broad upgrade over 4.6 | Announced via tweet |
4. Почему xAI давит на post-training, а не только на scale
4.1 SFT и RL — что реально меняется под капотом
Supervised fine-tuning (SFT) шлифует поведение на curated examples; reinforcement learning (RL) учит multi-step agentic sequences через reward signals. Фрейминг Маска — «significantly improved SFT & RL» — продолжает playbook Grok 4.5: реальные Cursor dev sessions дали Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, и ~15 954 output tokens на SWE-Bench Pro task vs 67 020 у Opus 4.8 — gap в 4,2× по token efficiency. Это не абстрактная метрика: при $6/M output tokens разница в 51K tokens на задачу — прямой hit в COGS.
4.2 Scale vs throughput trade-off
Grok 4.6 на 1,5T — реальный scale jump, но framing Grok 4.7 (2,1T, «better in every way except slightly slower to serve») намекает на два SKU с разными latency/quality профилями. Для инженера это значит: 4.6 — throughput-first tier, 4.7 — quality-per-token tier. Аналог Sonnet/Opus у Anthropic и mini/full у OpenAI.
4.3 Конкурентное давление Kimi K3
Target date Grok 4.6 — ровно ~10 дней после open weights K3. K3 топнул Frontend Code Arena с 1 679 pts — первый open-weight, обошедший все closed models на доске — и занял 3-е место в Artificial Analysis Intelligence Index. Для routing table это уже не hype, а baseline для сравнения.
5. Grok vs поле: spec comparison
| Модель | Вендор | Параметры | Context | Цена (in/out за 1M) | Источник |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Не раскрыто | 500K | $2 / $6 | xAI official |
| Grok 4.6 (announced) | xAI | 1,5T | Не раскрыто | Не раскрыто | Musk X post (unverified) |
| Kimi K3 | Moonshot AI | 2,8T (MoE, ~16/896 active) | 1M | $0,30 cache hit / $3 miss in, $15 out | Moonshot official |
| Claude Fable 5.1 (rumored) | Anthropic | Не раскрыто | Не раскрыто | Rumor $10 / $50 | 36kr, WinCentral leaks |
| GPT-5.6 Sol | OpenAI | Не раскрыто | Не раскрыто | Не раскрыто | OpenAI official |
6. Caveats: что проверить до trust в timeline
- Единственный source — твит — нет xAI blog post, model card, product page.
- Benchmarks и pricing blank — «1,5T parameters» и «SFT/RL upgrade» — unverified vendor claims.
- xAI safety controversies — иск в июле 2026 по CSAM generation через bypassed safeguards; в январе 2026 Common Sense Media поставил Grok среди worst для child-safety risks.
- Industry split on AI pacing — в тот же день, когда Маск анонсировал 4.6/4.7, 1 200+ сотрудников OpenAI, Anthropic, Google DeepMind и Meta опубликовали «Pacing the Frontier»; xAI отсутствует в списке подписантов.
7. Industry insight: август 2026 как release bottleneck
Если timeline Маска держится, Grok 4.6 и 4.7 приземляются в том же месяце, что rumored Claude Fable 5.1, и через недели после open-weight shock Kimi K3 — август 2026 станет одним из самых плотных frontier-model release months в истории. Shelf life любого flagship сжимается до недель, не кварталов.
Глубже shift: от leaderboard rank к per-task total cost. Grok 4.5 доказал, что output-token efficiency может компенсировать lower intelligence-index scores; Kimi K3 сделал self-hosting hard option; rumored Fable 5.1 ещё сожмёт closed-model premium. Три пути — closed API, open self-hosting, hybrid routing — получат concentrated stress test в августе.
Операционный риск для engineering teams — routing-table drift: model aliases, fallback chains и cost caps, которые раньше были quarterly maintenance, превращаются в weekly incidents, если три trillion-parameter-class модели шипятся в одном 30-day window. Throughput падает не из-за GPU, а из-за chaos в routing layer.
8. Five-step selection guide до model card
- Lock information sources: xAI blog, Grok Build console, Musk X account — не bake announced specs в SLA pre-launch.
- Build three-tier route: primary (current Grok 4.5 или Kimi K3 API) → high-precision review (Claude/GPT) → offline fallback (local MLX quantized open weights).
- Baseline token efficiency: record output tokens per real repo task сейчас; прогон 20 production-like tasks на любом новом моделе перед switch defaults. Считай tokens/sec и $/task, не только accuracy.
- August release-window playbook: reserve 48-hour evaluation window per major launch — no full production cutover day one.
- Vendor risk audit: включи recent xAI safety litigation alongside technical benchmarks в enterprise reviews.
9. FAQ
Когда точно выйдет Grok 4.6?
Маск сказал «around August 7, 2026» в X post; xAI официально дату не подтвердил.
Чем отличаются Grok 4.6 и 4.7?
4.6 — 1,5T с SFT/RL focus; 4.7 — 2,1T, expected weeks later, outperforming 4.6 except serving speed, где latency traded за better token efficiency.
Grok 4.6 обгонит Kimi K3 или Claude Fable 5.1?
Too early — no published Grok 4.6 benchmarks; K3 has verified scores; Fable 5.1 unconfirmed by Anthropic.
Сколько будет стоить Grok 4.6?
Unknown. Grok 4.5 launched at $2/$6 per million input/output tokens как reference point.
Где будет доступен Grok 4.6?
Based on Grok 4.5 rollout: likely Grok Build, xAI API, console first, then third-party platforms like Cursor.
10. Closing: frontier API chase + Mac local open-weight hedge
Windows/Linux cloud box может track Grok 4.6 headlines и call APIs, но проигрывает на local open-weight baselines, Cursor/OpenClaw agent residency, MLX-quantized Kimi K3 fallbacks и unified-memory long-context routing. В August release bottleneck scarce resource — не «какая модель score highest», а auditable compute для 48-hour real-task comparisons без vendor lock-in. Если нужны local MLX для K3 quantization, 24/7 remote nodes для OpenClaw multi-model routing tests и unified memory для agent session splitting, ставь three-tier stack: local MLX для daily work и offline hedge; frontier closed APIs для Grok/Claude hard reasoning; MACGPU remote Mac nodes для agent residency и isolated evaluation — лучший hedge против «Musk time» и release-month routing storm.