Если выбор модели всё ещё основан на бенчмарках прошлого квартала, решения уже устарели. Для AI-разработчиков, platform-лидов и команд agent-продуктов рейтинг OpenRouter ближе к продакшену, чем любой маркетинговый слайд: оплаченный token-трафик реальных нагрузок, а не лабораторный IQ. Этот разбор опирается на данные по 25 июля 2026: три ключевых сдвига июля, миграция долей вендоров, гантелеобразный рынок «объём vs качество», скрытый app-слой, чеклист маршрутизации из 6 шагов и прогноз на август.
SECTION 01 Выбор LLM в 2026: устаревшие бенчмарки, объём ≠ качество, суточная волатильность
Frontier-модели выходят ежемесячно, но многие команды всё ещё ориентируются на неверные сигналы:
- Культ статических бенчмарков: SWE-bench и MMLU не отражают стоимость API, латентность и то, за что разработчики реально платят.
- Путаница объёма токенов с качеством: OpenRouter ранжирует оплаченный трафик. Дешёвая модель за high-volume приложением может доминировать в таблице, не касаясь ваших hardest reasoning paths.
- Игнорирование суточных скачков: Mimo V2.5 и Claude Opus 4.8 менялись местами между 24 и 25 июля. Один снимок — не постоянный лидерборд.
- Слепая зона enterprise-медиа: roleplay и companion-приложения дают огромную долю open-model трафика, но почти не попадают в B2B AI-обзоры.
- Отсутствие tiered routing: chat, code и complex reasoning через одну модель — либо взрыв бюджета, либо провал по качеству. Данные OpenRouter уже показывают гантелеобразную структуру рынка.
Рейтинг OpenRouter измеряет реальный оплаченный объём токенов, а не интеллект модели. Понимание этого разрыва отделяет стратегию маршрутизации от статьи с копипастой таблицы.
SECTION 02 OpenRouter июль 2026: Xiaomi на вершине, китайские лаборатории ~46 %
На 25 июля — top 12 по суточному token-объёму на OpenRouter. Цифры обновляются ежедневно — перед продакшен-решениями сверяйтесь с openrouter.ai/rankings.
| Место | Модель | Вендор | Токены/день | Сумма 30 дн. |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (бесплатно) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot AI | 157,6B | 1,6T |
| 10 | Ling 3.0 Flash | InclusionAI (Ant) | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
Семь из top-10 — китайские вендоры. Агрегат по долям (7-дневный blended, округлённо):
| Вендор | Регион | Доля (прибл.) |
|---|---|---|
| DeepSeek | Китай | 16 %–18 % |
| Xiaomi | Китай | 8 %–18 % |
| Anthropic | США | 10 %–15 % |
| Tencent | Китай | 8 %–13 % |
| США | 8 %–13 % | |
| OpenAI | США | 6 %–8 % |
| Китай суммарно | — | ~46 % |
| US Big Three суммарно | — | ~30 %–36 % |
Год назад доля Китая была ниже 2 %, US Big Three — около 70 %. Один из крутейших сдвигов в индустрии. Драйвер: DeepSeek V4 Flash input ~$0,05–0,14/M против GPT-5.5 ~$5/M — разрыв ~35×. Месячный champion меняется часто: февраль MiniMax M2.5, апрель MiMo-V2-Pro, июль Mimo V2.5.
SECTION 03 Высокий объём ≠ высокое качество: гантель-рынок и ценовая матрица
По доле расходов по типу задачи (не по объёму токенов) картина иная:
- Общий диалог: 35,7 %
- Agent-воркфлоу: 30,4 %
- Код: 26,5 %
- Обработка данных: 7,5 %
На классификации и complex reasoning Claude Sonnet 4.6 и Claude Opus 4.7 делят первое место по 13,5 %; GPT-5.5 — 11,6 %. Дешёвые open-модели из volume-рейтинга здесь практически отсутствуют.
| Модель | Input/M | Output/M | Позиционирование |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05–0,14 | ~$0,24–0,28 | Лидер цена/качество, agentic coding |
| GLM 5.2 | $0,45 | $3,31 | Open weights, планирование уровня Opus |
| Kimi K3 | ~$3 | ~$15 | 1,4 TB open weights, closed-tier capability |
| Claude Opus 5 | $5 (fast $10) | $25 (fast $50) | Closed frontier, FrontierBench v0.1 43,3 % |
Рынок естественно сегментируется: дешёвые китайские open-модели поглощают массовые fault-tolerant нагрузки; closed frontier удерживает ценообразование на критических задачах. Claude Opus 5, вышедший 24 июля, — типичный представитель второй категории.
SECTION 04 App-слой: coding-агенты доминируют, roleplay остаётся невидимым
Рейтинги моделей показывают популярные «мозги». Лидерборд OpenRouter Apps показывает, для чего их используют:
| Место | Приложение | Тип | Доля |
|---|---|---|---|
| 1 | Hermes Agent | Персональный agent / CLI | ~45 % |
| 2 | Kilo Code | Coding agent | ~13 % |
| 3 | OpenClaw | Универсальный agent | ~9 % |
| 4 | Claude Code | Coding agent | ~6 % |
| 5 | Descript | Контент-производство | ~4,5 % |
| Линейка | Cline → Roo Code → Kilo Code: три форка одной кодовой базы; «внук» обогнал предка | ||
Roleplay-приложения (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) вместе дают значительный трафик. Отчёт OpenRouter × a16z State of AI: креативный roleplay — более половины open-model usage. Кто читает только enterprise-прессу, упускает вторую половину рынка.
SECTION 05 Tiered routing LLM API: чеклист выбора из 6 шагов
На основе июльских данных и нашего гайда по интеграции OpenRouter — шесть шагов для eval и routing stack:
- Метка даты и ритм обновления: рейтинги меняются ежедневно. В конце месяца проверяйте openrouter.ai/rankings; не цитируйте устаревшие позиции в runbook.
- Разделение нагрузок по типу задачи: chat/креатив, code assist, agent planning, complex reasoning/классификация — доля и fault tolerance по каждому bucket.
- Volume tier на дешёвые open-модели: chat и roleplay сначала на DeepSeek V4 Flash и GLM 5.2; code assist дополнить MiniMax M3.
- Closed frontier для hard tasks: complex reasoning и high-risk agent decisions — Claude Opus 5 / GPT-5.6; fallback-цепочки OpenRouter для failover.
- Внутренний eval-набор: не доверять только публичному лидерборду. Adoption rate, error rate, P95 latency на реальных промптах — высокий объём ≠ подходящая модель.
- Безопасность и compliance: security posture вендора — в scorecard. Agent-деплои требуют permission scoping независимо от победителя по цене; при обработке чувствительных данных документируйте потоки и ограничения доступа.
SECTION 06 Прогноз на август и цитируемые метрики
- Доля китайских open-моделей: вероятный рост к 50 % в этом году, если US-вендоры не срежут list price агрессивно.
- Ротация месячного volume champion: Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax и Moonshot не замедляют release и pricing cycles.
- Volume tier Anthropic: Haiku-класс для throughput возможен в августе; Opus 5 уже четвёртый flagship за два месяца.
- Community quantization Kimi K3: сжатые сборки 1,4 TB weights ожидаются за 2–4 недели.
- Миграция долей: Китай ~46 % сегодня vs. <2 % год назад; US Big Three ~30 %–36 % vs. ~70 %.
- Ценовой якорь: input DeepSeek V4 Flash vs. GPT-5.5 ~35× — главный драйвер миграции трафика.
- Концентрация app-слоя: Hermes Agent один ~45 % app token share; семейство coding agents (Kilo Code, OpenClaw, Claude Code) суммарно >28 %.
После публикации снова откройте эти источники и сверьте с актуальными upstream-данными:
Официальный рейтинг OpenRouter
Блог OpenRouter: DeepSeek V4 Adoption
Отчёт OpenRouter × a16z State of AI
Главный вывод июля: capability и popularity расходятся. OpenRouter унифицирует multi-model API, но команды, связывающие LLM-агентов, Xcode build chain и macOS CI/CD, упираются в macOS CI в VM с overhead гипервизора и локальный Mac без 24/7. Для продакшена с нативной Apple-вычислительностью без потерь, стабильным iOS CI/CD и круглосуточной agent-автоматизацией выделенные физические Mac-узлы MACNOX обычно оптимальнее: 100 % Apple hardware, полный root, без hypervisor tax, гибкая оплата по дням/неделям/месяцам.
SECTION 07 FAQ
Отражает ли рейтинг OpenRouter качество моделей?
Нет. Сортировка по оплаченному объёму токенов — сколько тратят разработчики, а не насколько модель «умна». Дешёвые модели на high-traffic apps могут быть наверху, не касаясь hardest reasoning. Сочетайте spend share с собственным eval-набором.
Какая модель лидировала на OpenRouter в июле 2026?
На 25 июля: Xiaomi Mimo V2.5 с ~1,4 трлн токенов/день, далее DeepSeek V4 Flash и Tencent Hy3. Рейтинг меняется ежедневно — live на openrouter.ai/rankings.
Какую долю занимают китайские модели на OpenRouter?
7-дневный blended: китайские вендоры (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba и др.) ~46 % token share, год назад <2 %. US Big Three вместе ~30 %–36 %.
Как indie-разработчику выбрать модель?
OpenRouter — отличная песочница: один key, сотни моделей. DeepSeek V4 Flash и GLM 5.2 для coding; Claude Opus 5 / GPT-5.6 — для шагов, где реально застряли. Hybrid routing сильно снижает cost. Учитывайте latency (~180–250 ms из некоторых регионов) и compliance до продакшена.
Что ждать в августе?
Доля китайских open-моделей продолжит расти; месячный лидер снова сменится; Anthropic может выпустить более дешёвый throughput tier; появятся community-quantized Kimi K3 builds; security и compliance станут весомее в enterprise selection.