·6 мин. чтения

Qwen 3.7 Plus и GPT-Oss 120B: открытые модели для кодинга

Сравнение доступных через PlusVibe Qwen 3.7 Plus и GPT-Oss 120B в задачах кодинга, API и self-hosting. Сценарии, актуальные цены и рекомендации.

Qwen 3.7 Plus и GPT-Oss 120B: открытые модели для кодинга

В старой версии этой статьи сравнивались Qwen 3.6 и Llama 4, но этих моделей больше нет в текущем публичном каталоге PlusVibe. Ниже — актуальная пара моделей из каталога: Qwen 3.7 Plus и GPT-Oss 120B. Они также рассчитаны на разные сценарии применения.

В PlusVibe мы разобрали, где Qwen 3.7 Plus удобнее, а где GPT-Oss 120B подходит лучше — в кодинге, reasoning, API и self-hosting. Ниже — выводы, которые можно проверить по текущим ID и параметрам каталога.

Главное наблюдение: «качество против скорости и размера»

Qwen 3.7 Plus и GPT-Oss 120B делают разные ставки:

  • Qwen 3.7 Plus — текстовая модель с контекстом 256 000 токенов и максимальным ответом 32 000 токенов. Подходит для кода и многошагового анализа.
  • GPT-Oss 120B — текстовая модель с контекстом 128 000 токенов и максимальным ответом 32 000 токенов. Удобна как отдельный вариант для текстовых и кодовых задач.

Это не «две модели одного класса» по параметрам контекста: Qwen 3.7 Plus в каталоге рассчитана на более длинный контекст, а GPT-Oss 120B — на меньший. Качество и скорость на вашей нагрузке лучше проверять собственным тестовым набором.

Сценарий 1. Локальный кодинг и self-hosting

Публичный каталог PlusVibe подтверждает доступность этих моделей через API, но не является источником требований к локальному железу. Поэтому для self-hosting нельзя честно обещать объём RAM, скорость или совместимость с конкретным рантаймом без отдельного теста.

  • Qwen 3.7 Plus — выбирайте, если в задаче важен контекст до 256 000 токенов.
  • GPT-Oss 120B — выбирайте, если достаточно контекста до 128 000 токенов и нужен второй текстовый вариант для сравнения.

Вывод по сценарию: для локального запуска сначала проверьте официальные веса и требования выбранного рантайма; через PlusVibe обе модели доступны по API.

Сценарий 2. Качество кода и рассуждение

Каталог содержит технические ограничения, но не публикует единый сопоставимый benchmark качества кода. Делать вывод о победителе по неподтверждённому индексу было бы неправильно.

  • Qwen 3.7 Plus даёт больше пространства для длинного контекста — до 256 000 токенов.
  • GPT-Oss 120B также поддерживает ответы до 32 000 токенов при контексте до 128 000.
  • Для реального выбора сравните обе модели на своих тестах: исправление кода, генерация тестов и анализ репозитория.

Вывод по сценарию: по одному каталогу нельзя объявить модель сильнее в кодинге; выбор зависит от вашего тестового набора и требуемого контекста.

Сценарий 3. Скорость и throughput

Публичный каталог не гарантирует фиксированную скорость ответа: она зависит от провайдера, нагрузки и размера запроса. Поэтому старые значения токенов в секунду и сравнительные множители здесь удалены.

  • Qwen 3.7 Plus и GPT-Oss 120B доступны как отдельные текстовые модели.
  • Для high-throughput-задач измеряйте time-to-first-token и tokens per second на одинаковых запросах.

Вывод по сценарию: зафиксированного победителя по скорости по данным каталога нет.

Сценарий 4. Vision и мультимодальность

В текущем каталоге обе модели описаны как текстовые: в поле modalitiesIn указано text, а vision отключён. Изображения через эти два ID заявлять нельзя.

Для задач с изображениями выбирайте модель, у которой в текущем каталоге явно указаны vision: true и модальность image; эти параметры могут измениться вместе с каталогом.

Сценарий 5. Контекстное окно

  • Qwen 3.7 Plus — 256 000 токенов контекста, максимальный ответ 32 000 токенов.
  • GPT-Oss 120B — 128 000 токенов контекста, максимальный ответ 32 000 токенов.

Для анализа больших документов и кодовых баз преимущество по заявленному контексту у Qwen 3.7 Plus: 256 000 против 128 000 токенов.

Сценарий 6. Цена и экономика

Реальные цены в PlusVibe:

Цены в рублях за 1M токенов подставляются из живого каталога в момент открытия страницы:

МодельВходВыход
qwen3.7-plus24,18 ₽/1M96,7 ₽/1M
gpt-oss-120b37 ₽/1M78 ₽/1M

Варианты с суффиксом маршрута и ставки кэша у каждой модели свои — они указаны на страницах Qwen 3.7 Plus, GPT-OSS 120B.

Как прикинуть бюджет: умножьте дневной объём в миллионах токенов на цены из таблицы. При нагрузке 10M входа и 5M выхода в день это 10 × цена входа + 5 × цена выхода для каждой модели.

Сценарий 7. Локальный запуск и железо

Точные требования к локальному запуску не следуют из API-каталога, поэтому старые значения RAM и tokens/sec удалены.

  • Перед self-hosting проверьте официальные веса, лицензию, формат квантования и требования выбранного рантайма.
  • Для API-сценария обе модели уже доступны через единый OpenAI-совместимый endpoint.

Когда что брать: сводная таблица

СценарийРекомендация PlusVibeПочему Длинный контекстqwen3.7-plus256 000 токенов против 128 000 у GPT-Oss 120B Второй вариант для A/B-теста кодаgpt-oss-120bОтдельная текстовая модель с контекстом 128 000 Минимальная цена входаqwen3.7-plus9.06 ₽/1M против 37 ₽/1M Минимальная цена выходаqwen3.7-plus36.2 ₽/1M против 78 ₽/1M VisionНи одна из двухВ каталоге у обеих указана только модальность text Сравнение на вашей кодовой базеОбе моделиВыбор качества требует собственного теста

Как подключить обе модели через PlusVibe API

PlusVibe даёт и Qwen 3.7 Plus, и GPT-Oss 120B под одним ключом по prepaid-рублёвой оплате, через единый OpenAI-совместимый base_url. Достаточно сменить поле model на один из актуальных публичных ID.

Получить ключ — на plusvibeapi.ru. Живой каталог моделей и цен — на plusvibeapi.ru/models или через GET /api/catalog.

Пример: запрос к Qwen 3.7 Plus (curl)

# $PV_KEY — ваш ключ PlusVibe (подставьте ключ из личного кабинета)
curl -X POST https://plusvibeapi.ru/v1/chat/completions \
  -H "Authorization: Bearer $PV_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.7-plus",
    "messages": [{"role": "user", "content": "Напиши REST API CRUD для управления задачами на FastAPI."}],
    "max_tokens": 2000
  }'

Пример: запрос к GPT-Oss 120B (curl)

curl -X POST https://plusvibeapi.ru/v1/chat/completions \
  -H "Authorization: Bearer $PV_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-oss-120b",
    "messages": [{"role": "user", "content": "Проанализируй логи ошибок и выдели ТОП-3 проблемы."}],
    "max_tokens": 1500
  }'

Гибридная схема: две модели для одного пайплайна (Python)

Один клиент может отправлять разные этапы пайплайна в разные модели. Это позволяет сравнить стоимость и качество на одинаковых данных без смены интеграции.

from openai import OpenAI

client = OpenAI(
    api_key="sk-pv-ВАШ_КЛЮЧ",
    base_url="https://plusvibeapi.ru/v1"
)

def ask(model: str, prompt: str) -> str:
    response = client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": prompt}],
        max_tokens=2000
    )
    return response.choices[0].message.content

analysis = ask("qwen3.7-plus", "Проанализируй логи и выдели критические ошибки.")
fix = ask("gpt-oss-120b", f"Предложи исправление на основе анализа:\n{analysis}")

Итог: две модели для сравнения API-сценариев

Qwen 3.7 Plus и GPT-Oss 120B сейчас доступны в публичном каталоге PlusVibe. По подтверждаемым параметрам Qwen 3.7 Plus имеет более длинный контекст и более низкую цену, а GPT-Oss 120B остаётся отдельным вариантом для сравнения текстовых и кодовых задач.

  • Qwen 3.7 Plus — контекст 256 000 токенов, 9.06/36.20 ₽ за 1M входа/выхода.
  • GPT-Oss 120B — контекст 128 000 токенов, 37/78 ₽ за 1M входа/выхода.

Выбирать навсегда не нужно. PlusVibe API даёт обе модели под одним ключом. Проверьте их на ваших реальных задачах: собственная эмпирика надёжнее неподтверждённых пересказов бенчмарков.

Эта статья — редакционный разбор PlusVibe, основанный на публичном каталоге моделей и цен. Получить доступ к обеим моделям под одним ключом — plusvibeapi.ru.

Попробуйте Qwen 3.7 Plus и GPT-Oss 120B через PlusVibe API

Обе модели под одним ключом, оплата в рублях. Актуальные цены на plusvibeapi.ru/models.

Зарегистрироваться бесплатно
Qwen 3.7 PlusGPT-Oss 120Bоткрытые LLM для кодингаopen weights моделилокальный запуск LLMсамохостинг LLM 2026

Попробуйте PlusVibe API

OpenAI-совместимый API: GPT, Claude, Gemini, видео и изображения — один рублёвый ключ. Работает из России без VPN, оплата рублями.

Читайте также

Qwen 3.7 Plus и GPT-Oss 120B: открытые модели для кодинга