·4 мин. чтения

Новые модели в PlusVibe: Grok 4.7, Qwen 3.8, GLM и другие

Какие языковые модели появились в PlusVibe в сентябре 2026: Grok 4.7, Grok Build, GLM-5.3 FlashX, Qwen 3.8, Hy4, DeepSeek V4.1 Flash, Gemini 3.8 Flash.

Новые модели в PlusVibe: Grok 4.7, Qwen 3.8, GLM и другие

За последние три недели каталог PlusVibe пополнился больше чем десятком языковых моделей. Флагманам — Claude Opus 5.5 и семейству GPT-6 — мы посвятили отдельные статьи. Здесь собраны остальные новинки, которые сейчас доступны в российском каталоге: что это за модели, чем они отличаются и для чего пригодятся. Характеристики и цены взяты из каталога на 24 сентября 2026 года.

Коротко: все новинки и цены

МодельРазработчикКонтекстИзображенияРассуждения Grok 4.7xAI480 000нетда, 4 уровня GLM-5.3 FlashXZhipu AI1 048 000нетда Qwen 3.8 FlashAlibaba (Qwen)256 000нетда Tencent Hy4 PreviewTencent262 144нетда, low / high Qwen3.8-27BAlibaba (Qwen)262 144да— DeepSeek V4.1 FlashDeepSeek1 000 000дада Gemini 3.8 FlashGoogle1 000 000дада, всегда включены Grok Build 0.1xAI256 000дане настраиваются

Цены в рублях за 1M токенов на канале по умолчанию подставляются из живого каталога:

МодельВходВыход
grok-4.79 ₽/1M22,63 ₽/1M
glm-5.3-flashx4,56 ₽/1M15,4 ₽/1M
qwen3.8-flash2,11 ₽/1M6,2 ₽/1M
hy4-preview9,17 ₽/1M27,51 ₽/1M
qwen3.8-27b31 ₽/1M153 ₽/1M
deepseek-v4.1-flash1,14 ₽/1M4,53 ₽/1M
gemini-3.8-flash3,78 ₽/1M18,86 ₽/1M
grok-build-0.113,58 ₽/1M27,16 ₽/1M

Идентификаторы для поля model — на странице каждой модели в каталоге.

Grok 4.7 от xAI

Новая версия Grok появилась в каталоге 23 сентября. Контекст — 480 000 токенов: это значение мы подтвердили живым запросом, а не взяли из анонса. Ответ — до 32 768 токенов, ввод только текстовый. Рассуждения настраиваются через reasoning_effort (minimal, low, medium, high), поддерживаются вызов инструментов и JSON-режим. Срез знаний по каталогу — июнь 2026 года.

Модель подойдёт для анализа длинных текстов и задач, где важны свежие знания. Для интерактивных сценариев включайте потоковую выдачу ("stream": true), чтобы пользователь видел ответ по мере генерации. Идентификатор: grok-4.7. Предыдущую версию мы разбирали в статье «Grok 4.6 от xAI: обзор, возможности и цены».

GLM-5.3 FlashX от Zhipu AI

Быстрая ступень линейки GLM-5.3, открыта 23 сентября. Контекст — 1 048 000 токенов, рассуждения и вызов инструментов поддерживаются, ввод только текстовый. Идентификатор: glm-5.3-flashx. Старшие модели линейки описаны в статье «GLM-5.3 в PlusVibe: миллион токенов контекста и reasoning».

Qwen 3.8 Flash от Alibaba

Быстрая MoE-модель семейства Qwen 3.8 для массовых задач, в каталоге с 22 сентября. Контекст — 256 000 токенов, ответ до 32 000 токенов. Поддерживает рассуждения, вызов инструментов и JSON-режим, по каталогу уверенно работает с русским языком. Хороший кандидат для классификации, извлечения данных и коротких ответов в потоке. Идентификатор: qwen3.8-flash. Старшая модель семейства — Qwen3.8 Max, о ней отдельная статья.

Tencent Hy4 Preview

Предварительная версия текстовой модели Tencent для рассуждений и агентных задач, в каталоге с 22 сентября. Контекст — 262 144 токена, два уровня рассуждений (low и high), вызов инструментов и JSON-режим. Слово Preview в названии стоит воспринимать буквально: прежде чем ставить модель в продакшен, проверьте её на своих данных. Идентификатор: hy4-preview.

Qwen3.8-27B на серверах в России

Компактная модель семейства Qwen 3.8, в каталоге с 20 сентября. Главная её особенность не в размере: канал по умолчанию работает на серверах в России, и в каталоге он отмечен значком «Серверы в РФ». Там же есть фильтр, который оставляет только такие варианты. Это имеет значение, если по требованиям вашей компании данные не должны уходить за рубеж. Контекст — 262 144 токена, модель принимает изображения. Идентификатор: qwen3.8-27b. О том, какие данные можно передавать во внешние модели, рассказано на странице «152-ФЗ и данные».

DeepSeek V4.1 Flash

Новая версия DeepSeek V4 Flash, в каталоге с сентября. Контекст — 1 000 000 токенов, ответ до 393 216 токенов, поддерживаются рассуждения, вызов инструментов, JSON-режим и ввод изображений. Среди новинок этой подборки DeepSeek V4.1 Flash — одна из самых дешёвых моделей с миллионным контекстом. Идентификатор: deepseek-v4.1-flash. Сравнение младшей и старшей моделей DeepSeek V4 — в статье «DeepSeek V4 Flash против DeepSeek V4 Pro».

Gemini 3.8 Flash от Google

Быстрая модель Google с контекстом 1 000 000 токенов и ответом до 65 000 токенов. Принимает изображения, поддерживает вызов инструментов. Рассуждения у неё включены всегда: учитывайте это при оценке расхода выходных токенов. Идентификатор: google/gemini-3.8-flash. Подробный разбор и сравнение с 3.7 Flash — в статье «Gemini 3.8 Flash: обзор, цена и сравнение с 3.7 Flash».

Grok Build 0.1 от xAI

Быстрая агентная модель xAI для работы с кодом. Контекст — 256 000 токенов, ответ до 230 400 токенов. Понимает изображения, поддерживает вызов инструментов и JSON-режим. Настраиваемого режима рассуждений в каталоге для неё не заявлено. Идентификатор: x-ai/grok-build-0.1.

Ещё одна новинка: модель решений

18 сентября в каталоге появилась typesafe/jev-1.13 — специализированная модель для принятия решений со своим эндпоинтом. Это не чат-модель, поэтому в таблицу выше она не попала. Как её вызывать и сколько она стоит — в отдельной статье «typesafe/jev-1.13: модель решений в API».

Как попробовать

Все модели из подборки работают через OpenAI-совместимый API с одним ключом. Достаточно поменять значение model:

curl https://plusvibeapi.ru/v1/chat/completions \
  -H "Authorization: Bearer sk-pv-ВАШ_КЛЮЧ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-flash",
    "messages": [{"role": "user", "content": "Классифицируй обращение: «не проходит оплата картой»."}]
  }'

Лучший способ выбрать — взять десяток своих реальных запросов и прогнать их на двух-трёх кандидатах, сравнив ответы и расход токенов. Быстрый старт описан в документации. Как убедиться, что по API отвечает именно заявленная модель, — на странице «Проверка модели».

Все новые модели — через один ключ

Оплата в рублях, для юрлиц — договор и оплата по счёту.

Попробовать →

Полный список моделей и актуальные цены — в каталоге PlusVibe.

новые модели APIGrok 4.7Grok Build 0.1GLM-5.3 FlashXQwen 3.8 FlashQwen3.8-27BTencent Hy4DeepSeek V4.1 FlashGemini 3.8 FlashLLM API Россия

Попробуйте PlusVibe API

OpenAI-совместимый API: GPT, Claude, Gemini, видео и изображения — один рублёвый ключ. Работает из России без VPN, оплата рублями.

Читайте также

Новые модели в PlusVibe: Grok 4.7, Qwen 3.8, GLM и другие