Карта рынка: четыре сегмента

Удобно делить китайские модели не по компаниям, а по тому, зачем их берут. Один и тот же вендор обычно держит по модели в нескольких сегментах: дешёвая ветка для потока, флагман для сложных задач, отдельная линейка под длинный контекст или медиа.

Четыре сегмента, в которых живут китайские модели Распределение по типу задачи, а не рейтинг качества. Один вендор может присутствовать в нескольких сегментах. ДЕШЁВЫЕ НА ПОТОКЕ Doubao · ByteDance Step · StepFun GLM Flash · Zhipu DeepSeek Flash Qwen Turbo классификация, автоответы, разметка, черновики РАССУЖДЕНИЯ И КОД DeepSeek Pro Kimi K3 · Moonshot Qwen Max · Alibaba GLM · Zhipu Hunyuan · Tencent анализ, планирование, сложный код, договоры ДЛИННЫЙ КОНТЕКСТ MiniMax (до 1 млн) Kimi · Moonshot Qwen Long GLM Long аудит документов, архивы, длинные переписки МУЛЬТИМОДАЛЬНЫЕ Doubao · ByteDance SenseNova · SenseTime MiniMax Qwen VL · Alibaba ERNIE · Baidu картинки и документы на входе, агенты
Как пользоваться картой. Сначала определите сегмент задачи, потом выбирайте вендора внутри него. Ошибка новичка — брать флагман для разметки сотен коротких сообщений и удивляться счету в конце месяца.

Вендоры и модели

Ниже — те, кого в 2026 году чаще всего обсуждают в китайских публикациях о рынке моделей. Порядок — не рейтинг, а просто удобная группировка.

ВендорМодельЧем известна
DeepSeek (深度求索)DeepSeek V4, Flash и ProСложные рассуждения и код; сильные ответы на русском; пиковое и ночное окно тарификации
Alibaba (通义千问)Qwen, в том числе VL и LongДокументы, таблицы, мультиязычность, длинный контекст; большая линейка открытых весов
Zhipu AI (智谱)GLMМассовые задачи и агентные сценарии; одна из старейших исследовательских команд Китая
Moonshot AI (月之暗面)KimiДлинный контекст и работа с большими документами
ByteDance (字节跳动)Doubao, Seedream, SeedanceЕдиное семейство: текст, изображения, видео. По публикациям 2026 года — один из лидеров по суточному объёму вызовов
MiniMaxАгентная линейка, Hailuo (видео)Очень длинный контекст — по заявлениям вендора до миллиона токенов, мультимодальный вход; активный рост потребления токенов в 2026 году
StepFun (阶跃星辰)Step 3.5 FlashОдна из самых быстрых моделей по скорости вывода — по публикациям, лидер в отдельных недельных рейтингах по объёму вызовов
SenseTime (商汤)SenseNovaМультимодальные агентные модели для офисных процессов; заявленное снижение расхода токенов у лёгкой версии
Baidu (文心)ERNIEМодель, вокруг которой построена платформа Baidu с интеграцией сторонних моделей
Tencent (混元)HunyuanКорпоративный сегмент, интеграция с экосистемой Tencent
iFlytek (星火)SparkСильные голосовые технологии и корпоративные решения

Данные о позициях и рейтингах приведены по внешним публикациям за 2026 год (отраслевые отчёты и пресс-релизы вендоров). Это не наш замер, оценки меняются от месяца к месяцу. Все названия принадлежат правообладателям.

Почему не все модели попадают в каталог

Разработчику со стороны кажется, что достаточно «подключить всё». На практике каталог — это компромисс из четырёх ограничений.

ОграничениеЧто означает на практике
Канал доступаМодель должна быть технически доступна по стабильному каналу, подходящему под единый формат API. Не у всех вендоров канал одинаково предсказуем
Условия вендораЧасть вендоров ограничивает передачу доступа третьим лицам или требует отдельного письменного согласия. Это фильтрует каталог сильнее, чем технические причины
ЭкономикаЕсли закупка идёт по цене, близкой к официальной, наценка съедает маржу — модель невыгодно держать в публичном каталоге
ПоддержкаПо каждой модели нужна документация, примеры, лимиты и помощь пользователю. Моделей может быть много, людей — нет

Мультимодельность как страховка

Вторая причина держать несколько моделей — не выбор, а устойчивость. Условия вендоров меняются: цена, лимиты, доступность модели, правила использования. Если продукт привязан к одной модели в коде, каждое такое изменение превращается в аварию.

Надёжность продукта зависит не от того, какую модель вы выбрали, а от того, насколько дешёво её заменить.

Практический приём: держите название модели параметром конфигурации или таблицей маршрутизации, а не строковой константой в коде. Тогда переход с модели на модель — это правка строки, а не переписывание интеграции. Именно поэтому единый адрес API и совместимый формат важнее «самой лучшей» модели: об этом же — разбор про различия платформ.

Что у нас в каталоге и в очереди

СтатусМодели
В каталоге на стартеDeepSeek V4 (Flash и Pro), Qwen, GLM, Kimi
В работеDoubao (ByteDance), MiniMax, Step (StepFun), SenseNova (SenseTime)
Дорожная карта: медиаSeedream, Seedance, Kling, Hailuo, Wan
Честно о сроках

Мы не обещаем даты подключения: и техническое, и юридическое состояние каждой модели проверяется отдельно, а часть вендоров ограничивает передачу доступа. Статусы в каталоге отражают реальное положение дел на сегодня. Если нужна конкретная модель — напишите: по таким запросам понятнее приоритет подключения.

Правовая рамка

Китай-API — независимый сервис и не является официальным партнёром, представителем или агентом DeepSeek, Alibaba, Zhipu AI, Moonshot AI, ByteDance, MiniMax, StepFun, SenseTime, Baidu или Tencent. Названия моделей используются для обозначения технологий.

Коротко
  1. Четыре известные модели — не весь рынок: рядом Doubao, MiniMax, Step и SenseNova.
  2. Выбирайте модель по сегменту задачи, а не по громкости названия.
  3. Каталог ограничен каналом, условиями вендора, экономикой и поддержкой — а не «нежеланием подключать».
  4. Мультимодельность нужна не для выбора, а для устойчивости: модель должна заменяться дёшево.
  5. Статусы моделей в каталоге лучше показывать честно — «в работе» значит «в работе».