Главная / Блог / Opus 5 · K3
ENGINEERING_BLOG · 2026.07.25

Claude Opus 5 вдвое дешевле —
Kimi K3 называет себя Claude

На неделе 24 июля 2026 вышли две новости, которые на первый взгляд не связаны — релиз модели и геополитическое обвинение в дистилляции. Для разработчиков ИИ и инженерных команд обе отвечают на один вопрос: кто поставляет frontier-уровень интеллекта по цене, которую можно держать в production, и как проверить происхождение этих возможностей? В статье — сравнение Claude Opus 5 и Fable 5, спецификации Kimi K3, заявление White House, возражения экспертов по срокам, анализ Greenblatt, чеклист из 6 шагов, цифры и FAQ.

SECTION 01 Почему выбор модели в середине 2026 года стал сложнее

Frontier-модели обновляются почти каждый месяц. Production-команды по-прежнему сталкиваются с тремя давлениями — на этой неделе все три оказались на первых полосах:

  • Юнит-экономика: Fable 5 и GPT-5.6 Sol мощны, но цена за token делает круглосуточных агентов и CI дорогими.
  • Комплаенс и хранение данных: флагманские тарифы часто требуют согласия на 30-дневное хранение — блокер для финансов, медицины и регулируемых отраслей.
  • Риск происхождения: когда open-weight модели обещают «frontier за долю цены», обвинения в дистилляции и геополитика становятся скрытыми издержками выбора. См. наши материалы о сроках open weights K3 и обзор K3; история с дистилляцией — новая.

Общая тема: кто может дать frontier-интеллект по доступной цене — и можно ли доверять источнику этих возможностей.

SECTION 02 Claude Opus 5 против Fable 5: стоит ли переключаться?

24 июля 2026 Anthropic выпустила Claude Opus 5 и сразу сделала её моделью по умолчанию в Claude Max — самым мощным уровнем для подписчиков Claude Pro. Цена не изменилась относительно Opus 4.8; производительность — да.

Claude Opus 5 vs Fable 5 — сводка (релиз 24 июля 2026)
Параметр Claude Opus 5 Claude Fable 5
Цена input / output $5 / $25 за миллион tokens ~$10 / $50 за миллион tokens
Контекст 1 млн tokens (единственный tier) 1 млн tokens
CursorBench 3.2 (max effort) В пределах 0,5 % от пика Fable 5 Эталонный пик
Frontier-Bench v0.1 Лидирует; >2× Opus 4.8
Хранение данных Без принудительного retention по умолчанию Требуется opt-in на 30 дней
Default в Claude Max Да (с 24.07.2026) Нет
Вывод Ежедневные агенты и код: Opus 5 ~вдвое дешевле при минимальном gap; dual-use security frontier остаётся у Mythos 5

Помимо кода Opus 5 показывает рост в structural biology, organic chemistry и bioinformatics — например, +10,2 п.п. во внутренних задачах спектроскопия→структура и +7,7 п.п. в предсказании функции белковых вариантов. Клиент Box сообщил +8 % общей точности, +11 % в data-analysis и +17 % в due diligence.

Автоматический аудит поведения Anthropic классифицирует Opus 5 как наиболее aligned модель на сегодня — минимум обманного поведения, сложнее ввести в злоупотребление. Но Anthropic сознательно не выводила Opus 5 на offensive cybersecurity или biology frontier — это остаётся у ограниченного Mythos 5. Cyber-классификаторы Opus 5 срабатывают примерно на 85 % реже, чем у Fable 5: подходит для поиска уязвимостей в исходниках, но блокирует binary scanning, pentest и генерацию exploit.

SECTION 03 Скандал дистилляции Kimi K3: White House и скепсис по срокам

Если Opus 5 — спокойный релиз, Kimi K3 после API-запуска 16 июля стал историей хаоса.

Kimi K3 — specs и официальные бенчмарки (Moonshot AI, 16 июля 2026)
Параметр Значение
Всего параметров 2,8 трлн (первая open 3T-class модель)
Архитектура Sparse MoE: 896 experts, 16 active/token (~50B active); KDA + Attention Residuals
Контекст 1 млн tokens, native vision
GPQA-Diamond 93,5 % (лучший open-weight на момент релиза)
BrowseComp 91,2 % (лучший в категории)
Полные веса Обещаны 27 июля 2026 (на момент публикации ещё не вышли)

22–23 июля 2026 директор OSTP White House Michael Kratsios обвинил Moonshot в «крупномасштабной скрытой промышленной дистилляции» технологий Fable Anthropic — и отдельно в использовании export-restricted Nvidia GB300 через серверы в Таиланде. Министр финансов Scott Bessent заявил о «watermarks» американских LLM в китайских моделях.

Это не первое обвинение. В феврале 2026 Anthropic публично назвала Moonshot, DeepSeek и MiniMax, заявив о более чем 3,4 млн аномальных API-взаимодействий как о «намеренном извлечении capabilities», часть активности привязана к руководству Moonshot через metadata запросов.

TechCrunch опросил исследователей, скептичных к версии «K3 = дистилляция Fable» — главным образом из-за сроков. Сооснователь Snorkel AI Braden Hancock: «Fable публично доступен только с 1 июля. За две недели нельзя дистиллировать столько данных, обучить модель и выпустить». Исследователь Allen Institute Nathan Lambert считает, что marginal benefit простой дистилляции падает по мере перехода к RL.

Даже Elon Musk признал, что xAI дистиллировала модели OpenAI при создании Grok — дистилляция в отрасли распространена. Спор в том, где заканчивается «нормальное заимствование техник» и начинается «скрытая промышленная кража».

SECTION 04 Почему Kimi K3 называет себя Claude: вывод Greenblatt

Технически самая интересная часть — от главного учёного Redwood Research Ryan Greenblatt (~24 июля, GitHub: rgreenblatt/which_claude_is_k3). Он сравнил ответы моделей на вопрос «кто ты?».

  • Частая self-ID как Claude: Kimi K3 часто называет себя Claude, а не Kimi.
  • Internal deployment ID: строки вроде claude-opus-4-5-20250929 и claude-sonnet-4-5-20250929настоящие Claude так точно не называют внутренние ID.
  • Поколение за поколением: K2 указывал на Claude Sonnet 4 (середина 2025); K3 — на Opus 4.5 (конец 2025), не на текущую линейку Fable/Mythos.
  • Интерпретация Greenblatt: student-модель, воспроизводящая deployment metadata teacher точнее, чем teacher о себе, — слабо объясняется «имитацией стиля»; вероятнее training на данных Claude с метками deployment metadata (API logs или synthetic data).

Greenblatt осторожен: это не доказывает дистилляцию — путаница identity может быть от contamination, leaked prompts или публичных synthetic datasets. Вместе с обвинением Anthropic в феврале — первое по-настоящему техническое evidence, а не политическое.

SECTION 05 Чеклист из 6 шагов: Opus 5, Fable 5 или Kimi K3?

  1. Определите workload: ежедневные агенты и код → сначала Opus 5. Extreme research или dual-use security → Fable 5 / Mythos 5 по необходимости. Минимальная цена при приемлемом provenance risk → K3 API или ждите 27 июля для self-hosting.
  2. Проверьте retention и комплаенс: Opus 5 без forced retention по умолчанию. Fable 5 / Mythos 5 — opt-in 30 дней. K3 self-hosting может работать offline; API требует оценки политики вендора и геополитики.
  3. Бенчмарк на реальных задачах: свой codebase, document RAG и automation — не только public leaderboards. CursorBench, Frontier-Bench и Zapier AutomationBench — лишь ориентиры.
  4. Token economics: Opus 5 ~вдвое дешевле Fable 5. K3 API дешевле обоих, но учитывайте refusal policies и fallback. OpenRouter упрощает A/B-маршрутизацию.
  5. Следите за релизом весов K3: после 27 июля — Hugging Face, community reproduction, верификация архитектуры. До этого capabilities K3 — «заявление вендора + внешние догадки».
  6. Задокументируйте supplier risk: компании, чувствительные к дистилляции, должны фиксировать решения по provenance. Держите fallback Anthropic / OpenAI / open-weight против single-vendor или геополитических сбоев.

SECTION 06 Цифры, источники и сигнал для инженерных команд

  • Цена Opus 5: $5 input / $25 output за миллион tokens, как у Opus 4.8; Fast mode ~2,5× скорость за 2× цену.
  • Opus 5 ARC-AGI 3: 3× следующей модели; OSWorld 2.0 обходит лучший Fable 5 менее чем за треть стоимости.
  • Параметры K3: 2,8T total, MoE 896 experts, 16 active/token (~50B active).
  • Масштаб обвинения Anthropic (февраль): 3,4M+ аномальных API-взаимодействий, связанных с Moonshot.
  • Timeline: Fable 5 public 01.07 → K3 launch 16.07 → White House 22–23.07 → Greenblatt ~24.07 → веса K3 27.07.

Первоисточники для сверки после публикации:

Anthropic: анонс Claude Opus 5

TechCrunch: скепсис исследователей к timeline дистилляции K3

Ryan Greenblatt: анализ self-identification Kimi K3 (GitHub)

Обе истории вместе: Anthropic сжимает gap между flagship и everyday по цене; Moonshot идёт в open-weight, ultra-cheap и с меньшими отказами. Скандал K3 — первый публичный flashpoint более жёсткого вопроса: когда lab заявляет frontier за долю цены — как отличить инженерный прорыв от «езды» на чужой модели?

Командам, интегрирующим LLM-агентов, Xcode и macOS CI/CD, одного API недостаточно: нужны локальная верификация Metal / Core ML, 24/7 agent pipeline и физически изолированный runtime для комплаенса. macOS CI на VM даёт overhead гипервизора и friction в signing chain; локальный Mac выключается — pipeline рвётся. Для production с нативной Apple-вычислительной мощностью без потерь, стабильным iOS CI/CD и 24/7 автоматизацией агентов выделенные физические Mac MACNOX обычно лучший выбор: 100 % Apple hardware, полный root, без hypervisor tax, гибкая оплата по дням/неделям/месяцам. См. Mac Mini M4: аренда vs покупка и гайд OpenRouter.

SECTION 07 Часто задаваемые вопросы

Насколько Claude Opus 5 дешевле Claude Fable 5?

Opus 5 стоит примерно вдвое меньше Fable 5 за token ($5/$25 против ~$10/$50 за миллион input/output tokens), при отставании менее 0,5 % от пика Fable 5 на CursorBench 3.2 max effort.

Claude Opus 5 — модель по умолчанию на Claude Max?

Да. С 24 июля 2026 Opus 5 — default в Claude Max и самая мощная модель для подписчиков Claude Pro.

Moonshot AI действительно дистиллировала Kimi K3 из Claude?

Не подтверждено и оспаривается. Заявление White House без публичных доказательств; исследователи считают двухнедельное окно для глубокой дистилляции нереалистичным. Вывод Greenblatt о том, что K3 называет себя Claude с internal deployment ID, — сильнейшее техническое evidence на сегодня.

Когда выйдут полные веса Kimi K3?

Moonshot обещала 27 июля 2026. Независимая верификация архитектуры и бенчмарков на момент публикации ещё не проводилась.

Почему Kimi K3 говорит, что он Claude?

Анализ Greenblatt: K3 непропорционально часто идентифицирует себя как Claude и иногда выдаёт точные internal deployment ID Anthropic точнее, чем сами модели Claude. Это указывает на training data с deployment metadata, но не доказывает дистилляцию.