28 июля 2026 года Илон Маск написал в X, что Grok 4.6 выйдет примерно 7 августа, а через несколько недель за ним последует более крупный Grok 4.7. Ответ был адресован CEO Vercel Гильермо Рauch — это не официальный анонс SpaceXAI. Бенчмарки, цены и model card пока не опубликованы. Материал для разработчиков и технических лидов, которые следят за frontier-релизами, маршрутизацией агентов и экономикой токенов: график, параметры, конкурентный контекст и непроверенные пункты.
SECTION 01 Три типичные ошибки до выхода Grok 4.6
- Считать пост в X официальным релизом: единственный задокументированный источник — ответ Маска 28 июля. Блог и продуктовые страницы SpaceXAI дату и specs не подтвердили;
- Приравнивать число параметров к качеству: Маск подчеркнул пост-обучение SFT и RL, а не только масштаб — в русле coding-first позиционирования Grok 4.5;
- Игнорировать «Musk time»: сроки xAI, Tesla и SpaceX исторически сдвигаются на дни и недели. «Около 7 августа» — цель, не гарантия;
- Смешивать слухи с поставленными моделями: Claude Fable 5.1 Anthropic официально не подтверждала. Сравнивайте с реально доступными продуктами — Kimi K3 и Grok 4.5 — с явной пометкой источника;
- Не учитывать vendor-risk: в июле 2026 SpaceXAI подала иск против пользователя за предполагаемую генерацию CSAM через Grok. Это не предсказывает бенчмарки Grok 4.6, но важно для enterprise-оценки поставщика.
Итог: дорожная карта Grok 4.6/4.7 правдоподобна, но не верифицирована третьими сторонами. Август 2026 может стать самым плотным месяцем релизов — выбирайте модель по эффективности токенов и реальной стоимости задачи, а не по заголовкам про параметры.
SECTION 02 График и характеристики: от Grok 4.5 до 4.7
| Дата | Событие |
|---|---|
| 8 июля 2026 | SpaceXAI выпускает Grok 4.5 для coding и agentic-задач, совместное обучение с Cursor на реальных сессиях разработчиков. Контекст 500K токенов, $2/$6 за миллион input/output-токенов, model card с 15 бенчмарками |
| 16–26 июля 2026 | Kimi K3 от Moonshot AI переходит от hosted preview к полному open-weight релизу (2,8T параметров, контекст 1M токенов) |
| 28 июля 2026 | Маск публикует roadmap Grok 4.6/4.7 в ответ Rauch. В тот же день более 1 200 сотрудников OpenAI, Anthropic, Google DeepMind и Meta подписывают письмо «Pacing the Frontier» |
| ~7 августа 2026 | Цель Grok 4.6: 1,5T параметров, апгрейд SFT/RL (объявлено в tweet, не поставлено) |
| Конец авг.–начало сент. 2026 | Цель Grok 4.7: 2,1T параметров. Маск: лучше 4.6 по всем метрикам, кроме скорости serving, с более высокой эффективностью токенов |
| Модель | Дата | Параметры | Фокус | Статус |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 апр. 2026 | Не раскрыто | Базовая линия | Поставлен |
| Grok 4.5 | 8 июл. 2026 | Не раскрыто (single SKU, не MoE) | Coding/agentic, co-training с Cursor | Поставлен, с бенчмарками |
| Grok 4.6 | ~7 авг. 2026 | 1,5T | Апгрейд SFT/RL | Объявлен в tweet, не поставлен |
| Grok 4.7 | ~конец авг.–начало сент. 2026 | 2,1T | Широкое улучшение над 4.6, лучшая эффективность токенов | Объявлен в tweet, не поставлен |
Все цифры Grok 4.6/4.7 — заявления вендора из одного поста в соцсетях. Относитесь к ним как к ориентирам, не как к подтверждённым specs.
SECTION 03 Почему SpaceXAI делает ставку на пост-обучение, а не только на масштаб
Supervised fine-tuning (SFT) обучает модель на курируемых примерах вывода, формируя поведение. Reinforcement learning (RL) использует сигналы награды, чтобы научить рабочим последовательностям действий — критично для многошаговых agentic-задач. Формулировка Маска про «значительно улучшенные SFT & RL» означает, что SpaceXAI удваивает стратегию, которая сделала Grok 4.5 конкурентоспособным на agent-бенчмарках: около 15 954 output-токенов на задачу SWE-Bench Pro против 67 020 у Opus 4.8 — разрыв эффективности 4,2× за счёт пост-обучения на реальных сессиях Cursor.
Рост Grok 4.6 до 1,5T — реальное увеличение масштаба, но framing Grok 4.7 — 2,1T, «лучше во всём, только чуть медленнее в serving» — намекает на два SKU с разными компромиссами вместо одной универсальной модели.
Целевая дата Grok 4.6 приходится почти ровно через десять дней после полного open-weight релиза Kimi K3, который потряс отрасль. Kimi K3 возглавил Frontend Code Arena с 1 679 баллами — первый open-weight, обошедший все closed-модели на этой доске — и занял третье место в Intelligence Index Artificial Analysis. Маск прокомментировал посты о бенчмарках Kimi K3 словом «impressive». Это давление конкурентов лучше всего объясняет, почему SpaceXAI сжимает cadence до трёх frontier-моделей примерно за два месяца.
| Модель | Вендор | Параметры | Контекст | Цена (input/output за 1M токенов) |
|---|---|---|---|---|
| Grok 4.5 | SpaceXAI | Не раскрыто | 500K | $2 / $6 |
| Grok 4.6 (объявлен) | SpaceXAI | 1,5T | Не раскрыто | Не раскрыто |
| Kimi K3 | Moonshot AI | 2,8T (MoE, ~16/896 активных экспертов) | 1M | $0,30 (cache hit) / $3 (cache miss) input, $15 output |
| Claude Fable 5.1 (слух) | Anthropic | Не раскрыто | Не раскрыто | Слух: без изменений vs Fable 5 ($10 in / $50 out) |
| GPT-5.6 Sol | OpenAI | Не раскрыто | Не раскрыто | Не раскрыто |
Строки Grok 4.6 и Claude Fable 5.1 — pre-release заявления, не верифицированные бенчмарки. Полезны для timing и позиционирования, не для прямого сравнения производительности.
SECTION 04 Что проверить, прежде чем доверять этому графику
- Единственный источник — tweet. Ни пост в блоге SpaceXAI, ни model card, ни продуктовая страница не подтверждают specs или дату Grok 4.6;
- Бенчмарки и цены пусты. В отличие от детального launch Grok 4.5 у Grok 4.6 нет независимой оценки и официальной model card;
- SpaceXAI параллельно ведёт споры о безопасности. В июле 2026 компания подала иск против пользователя за предполагаемое использование Grok для CSAM — первый такой случай. Отчёт Common Sense Media от января 2026 относил Grok к худшим AI-чатботам по child-safety;
- Timing совпадает с расколом отрасли по темпу разработки ИИ. В тот же день, когда Маск объявил Grok 4.6/4.7, более 1 200 сотрудников опубликовали «Pacing the Frontier» с просьбой к правительству США замедлить автоматизированную разработку ИИ. OpenAI и Anthropic поддержали как компании. SpaceXAI в списке отсутствует.
Если график Маска сдержится, Grok 4.6 и Grok 4.7 выйдут в том же месяце, что и слухи о Claude Fable 5.1 (утечки 36kr и WinCentral), и через несколько недель после open-weight шока Kimi K3. Для команд, оценивающих модели, полезный срок жизни каждого флагмана сжимается до недель — эффективность токенов и реальная стоимость задачи становятся более устойчивым критерием выбора.
SECTION 05 Цифры для цитирования и чеклист из 6 шагов до релиза
- Бенчмарки Grok 4.5 (поставлен): Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 % (официальная model card SpaceXAI);
- Эффективность токенов Grok 4.5: ~15 954 output-токена на задачу SWE-Bench Pro vs ~67 020 у Opus 4.8 (сводки третьих сторон);
- Grok 4.6 объявлен: 1,5T параметров, фокус SFT/RL (post Маска в X, не верифицировано);
- Grok 4.7 объявлен: 2,1T параметров, шире лучше 4.6, но медленнее в serving (post Маска в X);
- Референс Kimi K3: Frontend Code Arena 1 679 баллов, 2,8T MoE, контекст 1M токенов (Moonshot официально);
- Референс цены Grok 4.5: $2 input / $6 output за миллион токенов (SpaceXAI официально).
- Зафиксировать source of truth: следить за блогом SpaceXAI и @xai в X. Не переключать production только по вторичным отчётам;
- Собрать baseline-матрицу: до model card Grok 4.6 прогнать Grok 4.5 и Kimi K3 на своих репозиториях. Логировать расход токенов и pass rate;
- Зарезервировать окно A/B: не заключать годовые API-контракты в первую неделю августа. Заложить бюджет на Grok 4.6 и слухи о Fable 5.1;
- Разделить SKU «сильнее» и «быстрее»: по словам Маска, 4.6 сбалансирован, 4.7 качественнее. Отдельные маршруты для latency-sensitive и quality-sensitive нагрузок;
- Перепроверить безопасность и compliance: учесть недавний CSAM-иск и рейтинги child-safety в vendor review;
- Сверить цены в день релиза: консоль SpaceXAI и API docs — ground truth. Не экстраполировать цены Grok 4.5 в финмодели.
Официальные и независимые источники — проверяйте live-страницы перед опорой на дату, spec или цену:
SpaceXAI: Introducing Grok 4.5
Elon Musk в X (28 июля 2026, ответ @rauchg)
Moonshot AI: Kimi K3 на GitHub
Если команда строит agents и iOS/macOS CI-пайплайны на Grok, Kimi или других frontier-моделях, виртуализированные Mac-среды добавляют overhead на Xcode-сборки и Metal-нагрузки. Для production без потерь нативной мощности, стабильной iOS/macOS CI/CD и agent-автоматизации 7×24 выделенные физические облачные узлы MACNOX обычно оптимальнее: подлинное Apple-железо, полный Root, нулевая «налоговая» нагрузка гипервизора, гибкая аренда день/неделя/месяц. См. также наш обзор Grok 4.5 и материал о Kimi K3 open-weight.
SECTION 06 Часто задаваемые вопросы
Когда именно выйдет Grok 4.6?
Маск написал «около 7 августа 2026» в посте X, но SpaceXAI официально дату не подтвердила. Считайте это целью, которую могут сдвинуть.
Чем Grok 4.6 отличается от Grok 4.7?
Grok 4.6 — модель 1,5T с упором на улучшения SFT/RL. Grok 4.7, ожидаемый через несколько недель, — 2,1T; по словам Маска, превосходит 4.6 по всем метрикам, кроме скорости serving, с лучшей эффективностью токенов.
Победит ли Grok 4.6 Kimi K3 или Claude Fable 5.1?
Рано судить. У Grok 4.6 нет опубликованных бенчмарков, у Kimi K3 есть верифицированные сторонние scores, Claude Fable 5.1 Anthropic не подтверждала. Честное сравнение возможно только после поставки Grok 4.6 с model card.
Сколько будет стоить Grok 4.6?
Неизвестно. Grok 4.5 стартовал с $2 за миллион input-токенов и $6 за output — разумная точка отсчёта, но SpaceXAI цены Grok 4.6 не раскрыла.
Где можно будет использовать Grok 4.6?
По аналогии с rollout Grok 4.5: сначала Grok Build, API SpaceXAI и консоль, затем интеграции на сторонних платформах — для 4.6 пока не подтверждено.