За последние три недели каталог PlusVibe пополнился больше чем десятком языковых моделей. Флагманам — Claude Opus 5.5 и семейству GPT-6 — мы посвятили отдельные статьи. Здесь собраны остальные новинки, которые сейчас доступны в российском каталоге: что это за модели, чем они отличаются и для чего пригодятся. Характеристики и цены взяты из каталога на 24 сентября 2026 года.
Коротко: все новинки и цены
МодельРазработчикКонтекстИзображенияРассуждения Grok 4.7xAI480 000нетда, 4 уровня GLM-5.3 FlashXZhipu AI1 048 000нетда Qwen 3.8 FlashAlibaba (Qwen)256 000нетда Tencent Hy4 PreviewTencent262 144нетда, low / high Qwen3.8-27BAlibaba (Qwen)262 144да— DeepSeek V4.1 FlashDeepSeek1 000 000дада Gemini 3.8 FlashGoogle1 000 000дада, всегда включены Grok Build 0.1xAI256 000дане настраиваютсяЦены в рублях за 1M токенов на канале по умолчанию подставляются из живого каталога:
| Модель | Вход | Выход |
|---|---|---|
| grok-4.7 | 9 ₽/1M | 22,63 ₽/1M |
| glm-5.3-flashx | 4,56 ₽/1M | 15,4 ₽/1M |
| qwen3.8-flash | 2,11 ₽/1M | 6,2 ₽/1M |
| hy4-preview | 9,17 ₽/1M | 27,51 ₽/1M |
| qwen3.8-27b | 31 ₽/1M | 153 ₽/1M |
| deepseek-v4.1-flash | 1,14 ₽/1M | 4,53 ₽/1M |
| gemini-3.8-flash | 3,78 ₽/1M | 18,86 ₽/1M |
| grok-build-0.1 | 13,58 ₽/1M | 27,16 ₽/1M |
Идентификаторы для поля model — на странице каждой модели в каталоге.
Grok 4.7 от xAI
Новая версия Grok появилась в каталоге 23 сентября. Контекст — 480 000 токенов: это значение мы подтвердили живым запросом, а не взяли из анонса. Ответ — до 32 768 токенов, ввод только текстовый. Рассуждения настраиваются через reasoning_effort (minimal, low, medium, high), поддерживаются вызов инструментов и JSON-режим. Срез знаний по каталогу — июнь 2026 года.
Модель подойдёт для анализа длинных текстов и задач, где важны свежие знания. Для интерактивных сценариев включайте потоковую выдачу ("stream": true), чтобы пользователь видел ответ по мере генерации. Идентификатор: grok-4.7. Предыдущую версию мы разбирали в статье «Grok 4.6 от xAI: обзор, возможности и цены».
GLM-5.3 FlashX от Zhipu AI
Быстрая ступень линейки GLM-5.3, открыта 23 сентября. Контекст — 1 048 000 токенов, рассуждения и вызов инструментов поддерживаются, ввод только текстовый. Идентификатор: glm-5.3-flashx. Старшие модели линейки описаны в статье «GLM-5.3 в PlusVibe: миллион токенов контекста и reasoning».
Qwen 3.8 Flash от Alibaba
Быстрая MoE-модель семейства Qwen 3.8 для массовых задач, в каталоге с 22 сентября. Контекст — 256 000 токенов, ответ до 32 000 токенов. Поддерживает рассуждения, вызов инструментов и JSON-режим, по каталогу уверенно работает с русским языком. Хороший кандидат для классификации, извлечения данных и коротких ответов в потоке. Идентификатор: qwen3.8-flash. Старшая модель семейства — Qwen3.8 Max, о ней отдельная статья.
Tencent Hy4 Preview
Предварительная версия текстовой модели Tencent для рассуждений и агентных задач, в каталоге с 22 сентября. Контекст — 262 144 токена, два уровня рассуждений (low и high), вызов инструментов и JSON-режим. Слово Preview в названии стоит воспринимать буквально: прежде чем ставить модель в продакшен, проверьте её на своих данных. Идентификатор: hy4-preview.
Qwen3.8-27B на серверах в России
Компактная модель семейства Qwen 3.8, в каталоге с 20 сентября. Главная её особенность не в размере: канал по умолчанию работает на серверах в России, и в каталоге он отмечен значком «Серверы в РФ». Там же есть фильтр, который оставляет только такие варианты. Это имеет значение, если по требованиям вашей компании данные не должны уходить за рубеж. Контекст — 262 144 токена, модель принимает изображения. Идентификатор: qwen3.8-27b. О том, какие данные можно передавать во внешние модели, рассказано на странице «152-ФЗ и данные».
DeepSeek V4.1 Flash
Новая версия DeepSeek V4 Flash, в каталоге с сентября. Контекст — 1 000 000 токенов, ответ до 393 216 токенов, поддерживаются рассуждения, вызов инструментов, JSON-режим и ввод изображений. Среди новинок этой подборки DeepSeek V4.1 Flash — одна из самых дешёвых моделей с миллионным контекстом. Идентификатор: deepseek-v4.1-flash. Сравнение младшей и старшей моделей DeepSeek V4 — в статье «DeepSeek V4 Flash против DeepSeek V4 Pro».
Gemini 3.8 Flash от Google
Быстрая модель Google с контекстом 1 000 000 токенов и ответом до 65 000 токенов. Принимает изображения, поддерживает вызов инструментов. Рассуждения у неё включены всегда: учитывайте это при оценке расхода выходных токенов. Идентификатор: google/gemini-3.8-flash. Подробный разбор и сравнение с 3.7 Flash — в статье «Gemini 3.8 Flash: обзор, цена и сравнение с 3.7 Flash».
Grok Build 0.1 от xAI
Быстрая агентная модель xAI для работы с кодом. Контекст — 256 000 токенов, ответ до 230 400 токенов. Понимает изображения, поддерживает вызов инструментов и JSON-режим. Настраиваемого режима рассуждений в каталоге для неё не заявлено. Идентификатор: x-ai/grok-build-0.1.
Ещё одна новинка: модель решений
18 сентября в каталоге появилась typesafe/jev-1.13 — специализированная модель для принятия решений со своим эндпоинтом. Это не чат-модель, поэтому в таблицу выше она не попала. Как её вызывать и сколько она стоит — в отдельной статье «typesafe/jev-1.13: модель решений в API».
Как попробовать
Все модели из подборки работают через OpenAI-совместимый API с одним ключом. Достаточно поменять значение model:
curl https://plusvibeapi.ru/v1/chat/completions \
-H "Authorization: Bearer sk-pv-ВАШ_КЛЮЧ" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-flash",
"messages": [{"role": "user", "content": "Классифицируй обращение: «не проходит оплата картой»."}]
}'
Лучший способ выбрать — взять десяток своих реальных запросов и прогнать их на двух-трёх кандидатах, сравнив ответы и расход токенов. Быстрый старт описан в документации. Как убедиться, что по API отвечает именно заявленная модель, — на странице «Проверка модели».
Все новые модели — через один ключ
Оплата в рублях, для юрлиц — договор и оплата по счёту.
Попробовать →Полный список моделей и актуальные цены — в каталоге PlusVibe.



