В старой версии этой статьи сравнивались Qwen 3.6 и Llama 4, но этих моделей больше нет в текущем публичном каталоге PlusVibe. Ниже — актуальная пара моделей из каталога: Qwen 3.7 Plus и GPT-Oss 120B. Они также рассчитаны на разные сценарии применения.
В PlusVibe мы разобрали, где Qwen 3.7 Plus удобнее, а где GPT-Oss 120B подходит лучше — в кодинге, reasoning, API и self-hosting. Ниже — выводы, которые можно проверить по текущим ID и параметрам каталога.
Главное наблюдение: «качество против скорости и размера»
Qwen 3.7 Plus и GPT-Oss 120B делают разные ставки:
- Qwen 3.7 Plus — текстовая модель с контекстом 256 000 токенов и максимальным ответом 32 000 токенов. Подходит для кода и многошагового анализа.
- GPT-Oss 120B — текстовая модель с контекстом 128 000 токенов и максимальным ответом 32 000 токенов. Удобна как отдельный вариант для текстовых и кодовых задач.
Это не «две модели одного класса» по параметрам контекста: Qwen 3.7 Plus в каталоге рассчитана на более длинный контекст, а GPT-Oss 120B — на меньший. Качество и скорость на вашей нагрузке лучше проверять собственным тестовым набором.
Сценарий 1. Локальный кодинг и self-hosting
Публичный каталог PlusVibe подтверждает доступность этих моделей через API, но не является источником требований к локальному железу. Поэтому для self-hosting нельзя честно обещать объём RAM, скорость или совместимость с конкретным рантаймом без отдельного теста.
- Qwen 3.7 Plus — выбирайте, если в задаче важен контекст до 256 000 токенов.
- GPT-Oss 120B — выбирайте, если достаточно контекста до 128 000 токенов и нужен второй текстовый вариант для сравнения.
Вывод по сценарию: для локального запуска сначала проверьте официальные веса и требования выбранного рантайма; через PlusVibe обе модели доступны по API.
Сценарий 2. Качество кода и рассуждение
Каталог содержит технические ограничения, но не публикует единый сопоставимый benchmark качества кода. Делать вывод о победителе по неподтверждённому индексу было бы неправильно.
- Qwen 3.7 Plus даёт больше пространства для длинного контекста — до 256 000 токенов.
- GPT-Oss 120B также поддерживает ответы до 32 000 токенов при контексте до 128 000.
- Для реального выбора сравните обе модели на своих тестах: исправление кода, генерация тестов и анализ репозитория.
Вывод по сценарию: по одному каталогу нельзя объявить модель сильнее в кодинге; выбор зависит от вашего тестового набора и требуемого контекста.
Сценарий 3. Скорость и throughput
Публичный каталог не гарантирует фиксированную скорость ответа: она зависит от провайдера, нагрузки и размера запроса. Поэтому старые значения токенов в секунду и сравнительные множители здесь удалены.
- Qwen 3.7 Plus и GPT-Oss 120B доступны как отдельные текстовые модели.
- Для high-throughput-задач измеряйте time-to-first-token и tokens per second на одинаковых запросах.
Вывод по сценарию: зафиксированного победителя по скорости по данным каталога нет.
Сценарий 4. Vision и мультимодальность
В текущем каталоге обе модели описаны как текстовые: в поле modalitiesIn указано text, а vision отключён. Изображения через эти два ID заявлять нельзя.
Для задач с изображениями выбирайте модель, у которой в текущем каталоге явно указаны vision: true и модальность image; эти параметры могут измениться вместе с каталогом.
Сценарий 5. Контекстное окно
- Qwen 3.7 Plus — 256 000 токенов контекста, максимальный ответ 32 000 токенов.
- GPT-Oss 120B — 128 000 токенов контекста, максимальный ответ 32 000 токенов.
Для анализа больших документов и кодовых баз преимущество по заявленному контексту у Qwen 3.7 Plus: 256 000 против 128 000 токенов.
Сценарий 6. Цена и экономика
Реальные цены в PlusVibe:
Цены в рублях за 1M токенов подставляются из живого каталога в момент открытия страницы:
| Модель | Вход | Выход |
|---|---|---|
| qwen3.7-plus | 24,18 ₽/1M | 96,7 ₽/1M |
| gpt-oss-120b | 37 ₽/1M | 78 ₽/1M |
Варианты с суффиксом маршрута и ставки кэша у каждой модели свои — они указаны на страницах Qwen 3.7 Plus, GPT-OSS 120B.
Как прикинуть бюджет: умножьте дневной объём в миллионах токенов на цены из таблицы. При нагрузке 10M входа и 5M выхода в день это 10 × цена входа + 5 × цена выхода для каждой модели.
Сценарий 7. Локальный запуск и железо
Точные требования к локальному запуску не следуют из API-каталога, поэтому старые значения RAM и tokens/sec удалены.
- Перед self-hosting проверьте официальные веса, лицензию, формат квантования и требования выбранного рантайма.
- Для API-сценария обе модели уже доступны через единый OpenAI-совместимый endpoint.
Когда что брать: сводная таблица
СценарийРекомендация PlusVibeПочему Длинный контекстqwen3.7-plus256 000 токенов против 128 000 у GPT-Oss 120B
Второй вариант для A/B-теста кодаgpt-oss-120bОтдельная текстовая модель с контекстом 128 000
Минимальная цена входаqwen3.7-plus9.06 ₽/1M против 37 ₽/1M
Минимальная цена выходаqwen3.7-plus36.2 ₽/1M против 78 ₽/1M
VisionНи одна из двухВ каталоге у обеих указана только модальность text
Сравнение на вашей кодовой базеОбе моделиВыбор качества требует собственного теста
Как подключить обе модели через PlusVibe API
PlusVibe даёт и Qwen 3.7 Plus, и GPT-Oss 120B под одним ключом по prepaid-рублёвой оплате, через единый OpenAI-совместимый base_url. Достаточно сменить поле model на один из актуальных публичных ID.
Получить ключ — на plusvibeapi.ru. Живой каталог моделей и цен — на plusvibeapi.ru/models или через GET /api/catalog.
Пример: запрос к Qwen 3.7 Plus (curl)
# $PV_KEY — ваш ключ PlusVibe (подставьте ключ из личного кабинета)
curl -X POST https://plusvibeapi.ru/v1/chat/completions \
-H "Authorization: Bearer $PV_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-plus",
"messages": [{"role": "user", "content": "Напиши REST API CRUD для управления задачами на FastAPI."}],
"max_tokens": 2000
}'
Пример: запрос к GPT-Oss 120B (curl)
curl -X POST https://plusvibeapi.ru/v1/chat/completions \
-H "Authorization: Bearer $PV_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Проанализируй логи ошибок и выдели ТОП-3 проблемы."}],
"max_tokens": 1500
}'
Гибридная схема: две модели для одного пайплайна (Python)
Один клиент может отправлять разные этапы пайплайна в разные модели. Это позволяет сравнить стоимость и качество на одинаковых данных без смены интеграции.
from openai import OpenAI
client = OpenAI(
api_key="sk-pv-ВАШ_КЛЮЧ",
base_url="https://plusvibeapi.ru/v1"
)
def ask(model: str, prompt: str) -> str:
response = client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": prompt}],
max_tokens=2000
)
return response.choices[0].message.content
analysis = ask("qwen3.7-plus", "Проанализируй логи и выдели критические ошибки.")
fix = ask("gpt-oss-120b", f"Предложи исправление на основе анализа:\n{analysis}")
Итог: две модели для сравнения API-сценариев
Qwen 3.7 Plus и GPT-Oss 120B сейчас доступны в публичном каталоге PlusVibe. По подтверждаемым параметрам Qwen 3.7 Plus имеет более длинный контекст и более низкую цену, а GPT-Oss 120B остаётся отдельным вариантом для сравнения текстовых и кодовых задач.
- Qwen 3.7 Plus — контекст 256 000 токенов, 9.06/36.20 ₽ за 1M входа/выхода.
- GPT-Oss 120B — контекст 128 000 токенов, 37/78 ₽ за 1M входа/выхода.
Выбирать навсегда не нужно. PlusVibe API даёт обе модели под одним ключом. Проверьте их на ваших реальных задачах: собственная эмпирика надёжнее неподтверждённых пересказов бенчмарков.
Эта статья — редакционный разбор PlusVibe, основанный на публичном каталоге моделей и цен. Получить доступ к обеим моделям под одним ключом — plusvibeapi.ru.
Попробуйте Qwen 3.7 Plus и GPT-Oss 120B через PlusVibe API
Обе модели под одним ключом, оплата в рублях. Актуальные цены на plusvibeapi.ru/models.
Зарегистрироваться бесплатно


