Главная / Блог / OpenRouter
ENGINEERING_BLOG · 2026.07.27

Рейтинг OpenRouter июль 2026:
кто реально выигрывает гонку LLM

Если выбор модели всё ещё основан на бенчмарках прошлого квартала, решения уже устарели. Для AI-разработчиков, platform-лидов и команд agent-продуктов рейтинг OpenRouter ближе к продакшену, чем любой маркетинговый слайд: оплаченный token-трафик реальных нагрузок, а не лабораторный IQ. Этот разбор опирается на данные по 25 июля 2026: три ключевых сдвига июля, миграция долей вендоров, гантелеобразный рынок «объём vs качество», скрытый app-слой, чеклист маршрутизации из 6 шагов и прогноз на август.

SECTION 01 Выбор LLM в 2026: устаревшие бенчмарки, объём ≠ качество, суточная волатильность

Frontier-модели выходят ежемесячно, но многие команды всё ещё ориентируются на неверные сигналы:

  • Культ статических бенчмарков: SWE-bench и MMLU не отражают стоимость API, латентность и то, за что разработчики реально платят.
  • Путаница объёма токенов с качеством: OpenRouter ранжирует оплаченный трафик. Дешёвая модель за high-volume приложением может доминировать в таблице, не касаясь ваших hardest reasoning paths.
  • Игнорирование суточных скачков: Mimo V2.5 и Claude Opus 4.8 менялись местами между 24 и 25 июля. Один снимок — не постоянный лидерборд.
  • Слепая зона enterprise-медиа: roleplay и companion-приложения дают огромную долю open-model трафика, но почти не попадают в B2B AI-обзоры.
  • Отсутствие tiered routing: chat, code и complex reasoning через одну модель — либо взрыв бюджета, либо провал по качеству. Данные OpenRouter уже показывают гантелеобразную структуру рынка.

Рейтинг OpenRouter измеряет реальный оплаченный объём токенов, а не интеллект модели. Понимание этого разрыва отделяет стратегию маршрутизации от статьи с копипастой таблицы.

SECTION 02 OpenRouter июль 2026: Xiaomi на вершине, китайские лаборатории ~46 %

На 25 июля — top 12 по суточному token-объёму на OpenRouter. Цифры обновляются ежедневно — перед продакшен-решениями сверяйтесь с openrouter.ai/rankings.

Объём токенов OpenRouter — Top 12 моделей (2026-07-25)
Место Модель Вендор Токены/день Сумма 30 дн.
1 Mimo V2.5 Xiaomi 1,4T 31,2T
2 DeepSeek V4 Flash DeepSeek 943,9B 23,6T
3 Hy3 Tencent 590B 23,4T
4 Nemotron 3 Ultra 550B (бесплатно) NVIDIA 428,6B 9T
5 DeepSeek V4 Pro DeepSeek 413,7B 11,6T
6 GLM 5.2 Z.ai 316,7B 13,3T
7 MiniMax M3 MiniMax 262,5B 15,1T
8 Step 3.7 Flash StepFun 204,8B 5,9T
9 Kimi K3 Moonshot AI 157,6B 1,6T
10 Ling 3.0 Flash InclusionAI (Ant) 128,3B 417,3B
11 Gemini 3 Flash Preview Google 106,3B 4T
12 Claude Sonnet 5 Anthropic 99,5B 3,6T

Семь из top-10 — китайские вендоры. Агрегат по долям (7-дневный blended, округлённо):

Доли токенов по вендорам (7 дней, прибл.)
Вендор Регион Доля (прибл.)
DeepSeek Китай 16 %–18 %
Xiaomi Китай 8 %–18 %
Anthropic США 10 %–15 %
Tencent Китай 8 %–13 %
Google США 8 %–13 %
OpenAI США 6 %–8 %
Китай суммарно ~46 %
US Big Three суммарно ~30 %–36 %

Год назад доля Китая была ниже 2 %, US Big Three — около 70 %. Один из крутейших сдвигов в индустрии. Драйвер: DeepSeek V4 Flash input ~$0,05–0,14/M против GPT-5.5 ~$5/M — разрыв ~35×. Месячный champion меняется часто: февраль MiniMax M2.5, апрель MiMo-V2-Pro, июль Mimo V2.5.

SECTION 03 Высокий объём ≠ высокое качество: гантель-рынок и ценовая матрица

По доле расходов по типу задачи (не по объёму токенов) картина иная:

  • Общий диалог: 35,7 %
  • Agent-воркфлоу: 30,4 %
  • Код: 26,5 %
  • Обработка данных: 7,5 %

На классификации и complex reasoning Claude Sonnet 4.6 и Claude Opus 4.7 делят первое место по 13,5 %; GPT-5.5 — 11,6 %. Дешёвые open-модели из volume-рейтинга здесь практически отсутствуют.

Цены и позиционирование (июль 2026)
Модель Input/M Output/M Позиционирование
DeepSeek V4 Flash ~$0,05–0,14 ~$0,24–0,28 Лидер цена/качество, agentic coding
GLM 5.2 $0,45 $3,31 Open weights, планирование уровня Opus
Kimi K3 ~$3 ~$15 1,4 TB open weights, closed-tier capability
Claude Opus 5 $5 (fast $10) $25 (fast $50) Closed frontier, FrontierBench v0.1 43,3 %

Рынок естественно сегментируется: дешёвые китайские open-модели поглощают массовые fault-tolerant нагрузки; closed frontier удерживает ценообразование на критических задачах. Claude Opus 5, вышедший 24 июля, — типичный представитель второй категории.

SECTION 04 App-слой: coding-агенты доминируют, roleplay остаётся невидимым

Рейтинги моделей показывают популярные «мозги». Лидерборд OpenRouter Apps показывает, для чего их используют:

App-слой OpenRouter — Top 10 (доля токенов, прибл.)
Место Приложение Тип Доля
1 Hermes Agent Персональный agent / CLI ~45 %
2 Kilo Code Coding agent ~13 %
3 OpenClaw Универсальный agent ~9 %
4 Claude Code Coding agent ~6 %
5 Descript Контент-производство ~4,5 %
Линейка Cline → Roo Code → Kilo Code: три форка одной кодовой базы; «внук» обогнал предка

Roleplay-приложения (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) вместе дают значительный трафик. Отчёт OpenRouter × a16z State of AI: креативный roleplay — более половины open-model usage. Кто читает только enterprise-прессу, упускает вторую половину рынка.

SECTION 05 Tiered routing LLM API: чеклист выбора из 6 шагов

На основе июльских данных и нашего гайда по интеграции OpenRouter — шесть шагов для eval и routing stack:

  1. Метка даты и ритм обновления: рейтинги меняются ежедневно. В конце месяца проверяйте openrouter.ai/rankings; не цитируйте устаревшие позиции в runbook.
  2. Разделение нагрузок по типу задачи: chat/креатив, code assist, agent planning, complex reasoning/классификация — доля и fault tolerance по каждому bucket.
  3. Volume tier на дешёвые open-модели: chat и roleplay сначала на DeepSeek V4 Flash и GLM 5.2; code assist дополнить MiniMax M3.
  4. Closed frontier для hard tasks: complex reasoning и high-risk agent decisions — Claude Opus 5 / GPT-5.6; fallback-цепочки OpenRouter для failover.
  5. Внутренний eval-набор: не доверять только публичному лидерборду. Adoption rate, error rate, P95 latency на реальных промптах — высокий объём ≠ подходящая модель.
  6. Безопасность и compliance: security posture вендора — в scorecard. Agent-деплои требуют permission scoping независимо от победителя по цене; при обработке чувствительных данных документируйте потоки и ограничения доступа.

SECTION 06 Прогноз на август и цитируемые метрики

  • Доля китайских open-моделей: вероятный рост к 50 % в этом году, если US-вендоры не срежут list price агрессивно.
  • Ротация месячного volume champion: Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax и Moonshot не замедляют release и pricing cycles.
  • Volume tier Anthropic: Haiku-класс для throughput возможен в августе; Opus 5 уже четвёртый flagship за два месяца.
  • Community quantization Kimi K3: сжатые сборки 1,4 TB weights ожидаются за 2–4 недели.
  • Миграция долей: Китай ~46 % сегодня vs. <2 % год назад; US Big Three ~30 %–36 % vs. ~70 %.
  • Ценовой якорь: input DeepSeek V4 Flash vs. GPT-5.5 ~35× — главный драйвер миграции трафика.
  • Концентрация app-слоя: Hermes Agent один ~45 % app token share; семейство coding agents (Kilo Code, OpenClaw, Claude Code) суммарно >28 %.

После публикации снова откройте эти источники и сверьте с актуальными upstream-данными:

Официальный рейтинг OpenRouter

Лидерборд OpenRouter Apps

Блог OpenRouter: DeepSeek V4 Adoption

Отчёт OpenRouter × a16z State of AI

Главный вывод июля: capability и popularity расходятся. OpenRouter унифицирует multi-model API, но команды, связывающие LLM-агентов, Xcode build chain и macOS CI/CD, упираются в macOS CI в VM с overhead гипервизора и локальный Mac без 24/7. Для продакшена с нативной Apple-вычислительностью без потерь, стабильным iOS CI/CD и круглосуточной agent-автоматизацией выделенные физические Mac-узлы MACNOX обычно оптимальнее: 100 % Apple hardware, полный root, без hypervisor tax, гибкая оплата по дням/неделям/месяцам.

SECTION 07 FAQ

Отражает ли рейтинг OpenRouter качество моделей?

Нет. Сортировка по оплаченному объёму токенов — сколько тратят разработчики, а не насколько модель «умна». Дешёвые модели на high-traffic apps могут быть наверху, не касаясь hardest reasoning. Сочетайте spend share с собственным eval-набором.

Какая модель лидировала на OpenRouter в июле 2026?

На 25 июля: Xiaomi Mimo V2.5 с ~1,4 трлн токенов/день, далее DeepSeek V4 Flash и Tencent Hy3. Рейтинг меняется ежедневно — live на openrouter.ai/rankings.

Какую долю занимают китайские модели на OpenRouter?

7-дневный blended: китайские вендоры (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba и др.) ~46 % token share, год назад <2 %. US Big Three вместе ~30 %–36 %.

Как indie-разработчику выбрать модель?

OpenRouter — отличная песочница: один key, сотни моделей. DeepSeek V4 Flash и GLM 5.2 для coding; Claude Opus 5 / GPT-5.6 — для шагов, где реально застряли. Hybrid routing сильно снижает cost. Учитывайте latency (~180–250 ms из некоторых регионов) и compliance до продакшена.

Что ждать в августе?

Доля китайских open-моделей продолжит расти; месячный лидер снова сменится; Anthropic может выпустить более дешёвый throughput tier; появятся community-quantized Kimi K3 builds; security и compliance станут весомее в enterprise selection.